본문으로 건너뛰기

MEG 파운데이션 모델, 왜 아직 없나 — 공개 데이터 3,200명

몬트리올대·옥스퍼드 연구진이 arXiv에 올린 로드맵은 MEG 파운데이션 모델로 가는 네 경로와 데이터·벤치마크·거버넌스 과제를 정리했습니다.

뇌피셜 편집부· 3분 읽기원문 보기 ↗
참가자가 흰색 뇌자도(MEG) 장비의 헬멧 안에 머리를 넣고 앉아 앞쪽 화면을 바라보는 모습
사진: NIMH · Public domain

핵심 답변

몬트리올대 CoCo Lab의 카림 제르비 연구진과 옥스퍼드대 오이위 파커 존스 등 10명은 2026년 9월 3일 arXiv에 'MEG 파운데이션 모델 로드맵'을 올렸습니다. 논문은 MEG 전용 사전학습, EEG 모델 적응, EEG 모델의 MEG 추가 사전학습, 처음부터 다중 모달 학습이라는 네 경로를 제시하고, 수천 명 규모의 공개 MEG 코퍼스와 표준 벤치마크, 데이터 거버넌스가 선결 과제라고 정리했습니다.

TL;DR세 줄 요약

  • EEG에는 BENDR·LaBraM·REVE 등 파운데이션 모델이 잇달아 나왔지만, MEG는 코퍼스가 작고 파편화되어 같은 흐름을 타지 못했습니다.
  • 논문이 든 대표 MEG 자원은 LibriBrain100(33명 약 104시간), Cam-CAN(약 612명), BrainOmni의 MEG 656시간이며, EEG 모델 REVE는 25,000명으로 사전학습했습니다.
  • 동반 저장소는 공개 MEG 데이터셋 25개(약 3,200명, 완전 공개 13개)와 MEG를 포함한 파운데이션 모델 7개를 정리했습니다.
  • 저자들은 큰 EEG 모델이 작은 모델보다 꾸준히 더 잘 일반화하지는 않았다며 규모보다 코퍼스·벤치마크·거버넌스를 먼저 요구합니다.

핵심 사실

논문
arXiv:2609.044612026-09-03 제출, 9월 7일 q-bio.NC 신규 목록, CC BY 4.0, 동료 평가 전
저자
Thölke, Abdelhedi, … Parker Jones, Jerbi (10명)몬트리올대 CoCo Lab·Mila·옥스퍼드 OxCIN 등
공개 MEG 데이터셋
25개, 약 3,200명동반 GitHub 저장소 기준, 완전 공개 13개
MEG 포함 파운데이션 모델
7개동반 저장소 기준
대표 MEG 데이터 규모
LibriBrain100 약 104시간·33명Cam-CAN 약 612명, BrainOmni MEG 656시간
비교: EEG 모델 REVE
사전학습 25,000명논문 인용

무슨 논문인가요

몬트리올대 CoCo Lab의 필리프 퇼케(Philipp Thölke)와 카림 제르비(Karim Jerbi), 옥스퍼드대의 오이위 파커 존스(Oiwi Parker Jones) 등 10명은 2026년 9월 3일 arXiv에 "MEG 파운데이션 모델 로드맵"을 올렸습니다. 9월 7일 q-bio.NC 신규 목록에 실린 관점 논문이며, 동료 평가를 거치지 않은 프리프린트입니다. 논문 뇌자도(MEG)는 인간 피질 역학을 밀리초 해상도로 기록하면서 EEG보다 공간 해석이 낫다는 것이 논문의 출발점입니다. 그런데 EEG에는 BENDR, BIOT, LaBraM, Neuro-GPT, NeuroLM, REVE 같은 파운데이션 모델이 잇달아 나온 반면, MEG는 코퍼스가 더 작고 파편화되어 있어 같은 흐름을 타지 못했다고 진단합니다. 논문

어두운 실험실에서 참가자가 전극이 촘촘히 박힌 EEG 캡을 쓰고 화면을 보고 있고, 오른쪽 모니터에 뇌파 신호가 흐르는 모습
EEG 쪽에서는 이런 두피 기록을 수만 명 규모로 모아 파운데이션 모델을 학습시켰습니다. MEG는 같은 규모의 공개 코퍼스가 아직 없습니다.· 사진: Laurens R. Krol · CC BY 4.0

데이터가 얼마나 부족한가요

논문이 인용한 공개 뇌 신호 데이터 규모 (기록 시간)
0시간500시간1,000시간1,500시간2,000시간LibriBrain (MEG, 1명)LibriBrain100 (MEG, 33명)BrainOmni MEGBrainOmni EEG50시간104시간656시간1,997시간
논문이 인용한 공개 뇌 신호 데이터 규모 (기록 시간)
항목기록 시간
LibriBrain (MEG, 1명)50시간
LibriBrain100 (MEG, 33명)104시간
BrainOmni MEG656시간
BrainOmni EEG1,997시간

출처: Thölke et al., arXiv:2609.04461 (2026). LibriBrain은 '50시간 이상', LibriBrain100은 '약 104시간'으로 표기

논문이 든 숫자를 보면 격차가 분명합니다. 한 참가자에게서 50시간 이상을 기록한 LibriBrain, 33명 약 104시간(그중 한 명이 약 80시간, 나머지 32명은 약 40분씩)인 LibriBrain100, 약 612명의 Cam-CAN이 MEG 쪽 대표 자원입니다. EEG와 MEG를 합친 BrainOmni는 EEG 약 1,997시간에 MEG 656시간이고, EEG 모델 REVE는 25,000명의 데이터로 사전학습했습니다. 논문 논문의 동반 GitHub 저장소는 공개 MEG 데이터셋 25개(약 3,200명, 완전 공개 13개)와 MEG를 포함한 파운데이션 모델 7개를 목록으로 정리해 두었습니다. 데이터

MEG 파운데이션 모델로 가는 네 경로

경로방법논문이 밝힌 장단점
MEG 전용 사전학습MEG 데이터로 처음부터 학습가장 표현력이 높지만 데이터가 많이 필요
EEG 모델 적응기존 EEG 모델의 입력을 MEG에 맞게 재구성도메인 이동 위험
EEG 모델 추가 사전학습라벨 없는 MEG로 EEG 모델을 이어서 학습한 뒤 과제 적용두 경로의 절충
처음부터 다중 모달EEG·MEG 또는 더 넓은 모달을 함께 학습BrainOmni, Brain-OF가 예시

저자들은 토큰화(고정 패치 대 적응형, 원시 신호 대 스펙트럼 대 잠재 공간), 센서 공간 대 소스 공간 표현, 제조사마다 다른 센서 배치를 위한 위치 인코딩, 자기지도 목표 함수 같은 핵심 설계 선택이 아직 정해지지 않았다고 정리합니다. 시간 패치 창도 수백 밀리초에서 수 초까지 제각각이고 합의가 없습니다. 논문 기존 MEG 모델의 예로는 52개 아틀라스 영역을 쓰는 MEG-GPT, GPT2MEG, 약 416명 데이터의 Headache-MEG-FM, MEG-XL을 들고, 범용 시계열 모델 Chronos-2·MOMENT나 음성 모델 Whisper에서 옮겨 오는 경로도 언급합니다. 논문

왜 중요한가요

논문은 "크면 낫다"는 기대와 거리를 둡니다. 같은 프로토콜로 비교했을 때 큰 EEG 모델이 작은 모델보다 꾸준히 더 잘 일반화하지는 않았고, EEG에서 유일하게 폭넓은 비교인 NeuralBench는 파운데이션 모델이 과제 특화 모델을 근소하게 앞서는 데 그쳤다고 인용합니다. 논문 현재 MEG 벤치마크가 PNPL 대회와 LibriBrain 등 음성 해독에 치우쳐 있다는 점도 지적합니다. 논문 그래서 저자들이 요구하는 것은 더 큰 모델이 아니라 수천 명·수천 시간 규모로 여러 기관과 제조사를 아우르는 공개 코퍼스, 공개 보류 데이터로 돌리는 리더보드형 벤치마크, 그리고 동의 검토·데이터셋 문서화·계층별 접근·철회 절차·이익 공유를 포함한 거버넌스입니다. 논문

자주 묻는 질문

MEG가 EEG보다 나은 점이 무엇인가요?
논문은 MEG가 인간 피질 역학을 밀리초 해상도로 기록하면서 EEG보다 공간 해석이 낫다고 설명합니다. 대신 장비가 드물어 데이터가 작고 여러 기관·제조사에 흩어져 있다는 것이 파운데이션 모델을 만들기 어려운 이유입니다.
지금 MEG 파운데이션 모델이 아예 없나요?
논문과 동반 저장소는 MEG-GPT, GPT2MEG, Headache-MEG-FM, MEG-XL과 다중 모달인 BrainOmni, Brain-OF 등을 소개합니다. 다만 표준 벤치마크가 없어 서로의 성능을 같은 잣대로 비교하기 어렵다는 것이 저자들의 진단입니다.
파운데이션 모델이 항상 더 낫나요?
논문은 같은 프로토콜로 비교했을 때 큰 EEG 모델이 작은 모델보다 꾸준히 더 잘 일반화하지는 않았고, EEG에서 유일하게 폭넓은 비교인 NeuralBench에서도 파운데이션 모델이 과제 특화 모델을 근소하게 앞서는 데 그쳤다고 인용합니다.

출처 · 4

  1. 1arXiv:2609.04461 초록 페이지논문arxiv.org/abs/2609.04461
  2. 2논문 본문 (arXiv HTML v1)논문arxiv.org/html/2609.04461v1
  3. 3동반 저장소 meg-fm-resources (GitHub)데이터github.com/thecocolab/meg-fm-resources
  4. 4arXiv q-bio.NC 9월 7일 신규 목록참고arxiv.org/list/q-bio.NC/new

이 글의 마크다운 원문: /brain/posts/meg-foundation-models-roadmap/md/ · 인용 시 출처를 “뇌피셜”으로 표기해 주세요.

이 글이 도움이 됐다면 동료에게 보내 주세요.

뇌피셜 새 글 알림

새 글이 올라오면 메일로 알려드려요

매일 5편, 5분 브리프. 스팸 없이 새 글 소식만. 언제든 한 번에 해지.

같은 태그·카테고리의 글을 골랐습니다.

감정·동기· 3

코카인 사용장애 뇌는 통합은 늘고 유연성은 줄었다 — 76명 MRI

오클라호마대 연구진이 arXiv에 올린 분석에서 코카인 사용장애 38명은 대조군 38명보다 대규모 뇌 네트워크의 통합·동원은 높고 유연성은 낮았으며, 구조 정보를 더한 연결성이 주간 사용량까지 구분했습니다.

  • #논문
  • #프리프린트
  • #중독
기억·학습· 3

축삭 지연의 분산이 뉴런을 순서 탐지기로 바꿉니다

arXiv에 올라온 시뮬레이션 논문은 수상돌기에 모이는 축삭 전도 지연의 분산 하나가 뉴런이 '한 사건'을 볼지 '순서'를 볼지 정하고, 피질 기둥 지름까지 예측한다고 보고했습니다.

  • #논문
  • #프리프린트
  • #시간 부호화