# MEG 파운데이션 모델, 왜 아직 없나 — 공개 데이터 3,200명

> 몬트리올대·옥스퍼드 연구진이 arXiv에 올린 로드맵은 MEG 파운데이션 모델로 가는 네 경로와 데이터·벤치마크·거버넌스 과제를 정리했습니다.

- 출처 사이트: 뇌피셜 (https://aifficial.net/brain/posts/meg-foundation-models-roadmap/)
- 발행: 2026-09-07
- 카테고리: 뇌와 AI · 태그: 논문, 프리프린트, MEG, 파운데이션 모델, 뇌 신호 해독

## 핵심 답변

몬트리올대 CoCo Lab의 카림 제르비 연구진과 옥스퍼드대 오이위 파커 존스 등 10명은 2026년 9월 3일 arXiv에 'MEG 파운데이션 모델 로드맵'을 올렸습니다. 논문은 MEG 전용 사전학습, EEG 모델 적응, EEG 모델의 MEG 추가 사전학습, 처음부터 다중 모달 학습이라는 네 경로를 제시하고, 수천 명 규모의 공개 MEG 코퍼스와 표준 벤치마크, 데이터 거버넌스가 선결 과제라고 정리했습니다.

## 요약

- EEG에는 BENDR·LaBraM·REVE 등 파운데이션 모델이 잇달아 나왔지만, MEG는 코퍼스가 작고 파편화되어 같은 흐름을 타지 못했습니다.
- 논문이 든 대표 MEG 자원은 LibriBrain100(33명 약 104시간), Cam-CAN(약 612명), BrainOmni의 MEG 656시간이며, EEG 모델 REVE는 25,000명으로 사전학습했습니다.
- 동반 저장소는 공개 MEG 데이터셋 25개(약 3,200명, 완전 공개 13개)와 MEG를 포함한 파운데이션 모델 7개를 정리했습니다.
- 저자들은 큰 EEG 모델이 작은 모델보다 꾸준히 더 잘 일반화하지는 않았다며 규모보다 코퍼스·벤치마크·거버넌스를 먼저 요구합니다.

## 핵심 사실

| 항목 | 값 |
|---|---|
| 논문 | arXiv:2609.04461 (2026-09-03 제출, 9월 7일 q-bio.NC 신규 목록, CC BY 4.0, 동료 평가 전) |
| 저자 | Thölke, Abdelhedi, … Parker Jones, Jerbi (10명) (몬트리올대 CoCo Lab·Mila·옥스퍼드 OxCIN 등) |
| 공개 MEG 데이터셋 | 25개, 약 3,200명 (동반 GitHub 저장소 기준, 완전 공개 13개) |
| MEG 포함 파운데이션 모델 | 7개 (동반 저장소 기준) |
| 대표 MEG 데이터 규모 | LibriBrain100 약 104시간·33명 (Cam-CAN 약 612명, BrainOmni MEG 656시간) |
| 비교: EEG 모델 REVE | 사전학습 25,000명 (논문 인용) |


## 무슨 논문인가요

몬트리올대 CoCo Lab의 필리프 퇼케(Philipp Thölke)와 카림 제르비(Karim Jerbi), 옥스퍼드대의 오이위 파커 존스(Oiwi Parker Jones) 등 10명은 2026년 9월 3일 arXiv에 "MEG 파운데이션 모델 로드맵"을 올렸습니다. 9월 7일 q-bio.NC 신규 목록에 실린 관점 논문이며, 동료 평가를 거치지 않은 프리프린트입니다.  뇌자도(MEG)는 인간 피질 역학을 밀리초 해상도로 기록하면서 EEG보다 공간 해석이 낫다는 것이 논문의 출발점입니다. 그런데 EEG에는 BENDR, BIOT, LaBraM, Neuro-GPT, NeuroLM, REVE 같은 파운데이션 모델이 잇달아 나온 반면, MEG는 코퍼스가 더 작고 파편화되어 있어 같은 흐름을 타지 못했다고 진단합니다. 



## 데이터가 얼마나 부족한가요



논문이 든 숫자를 보면 격차가 분명합니다. 한 참가자에게서 50시간 이상을 기록한 LibriBrain, 33명 약 104시간(그중 한 명이 약 80시간, 나머지 32명은 약 40분씩)인 LibriBrain100, 약 612명의 Cam-CAN이 MEG 쪽 대표 자원입니다. EEG와 MEG를 합친 BrainOmni는 EEG 약 1,997시간에 MEG 656시간이고, EEG 모델 REVE는 25,000명의 데이터로 사전학습했습니다.  논문의 동반 GitHub 저장소는 공개 MEG 데이터셋 25개(약 3,200명, 완전 공개 13개)와 MEG를 포함한 파운데이션 모델 7개를 목록으로 정리해 두었습니다. 

## MEG 파운데이션 모델로 가는 네 경로

| 경로 | 방법 | 논문이 밝힌 장단점 |
| --- | --- | --- |
| MEG 전용 사전학습 | MEG 데이터로 처음부터 학습 | 가장 표현력이 높지만 데이터가 많이 필요 |
| EEG 모델 적응 | 기존 EEG 모델의 입력을 MEG에 맞게 재구성 | 도메인 이동 위험 |
| EEG 모델 추가 사전학습 | 라벨 없는 MEG로 EEG 모델을 이어서 학습한 뒤 과제 적용 | 두 경로의 절충 |
| 처음부터 다중 모달 | EEG·MEG 또는 더 넓은 모달을 함께 학습 | BrainOmni, Brain-OF가 예시 |

저자들은 토큰화(고정 패치 대 적응형, 원시 신호 대 스펙트럼 대 잠재 공간), 센서 공간 대 소스 공간 표현, 제조사마다 다른 센서 배치를 위한 위치 인코딩, 자기지도 목표 함수 같은 핵심 설계 선택이 아직 정해지지 않았다고 정리합니다. 시간 패치 창도 수백 밀리초에서 수 초까지 제각각이고 합의가 없습니다.  기존 MEG 모델의 예로는 52개 아틀라스 영역을 쓰는 MEG-GPT, GPT2MEG, 약 416명 데이터의 Headache-MEG-FM, MEG-XL을 들고, 범용 시계열 모델 Chronos-2·MOMENT나 음성 모델 Whisper에서 옮겨 오는 경로도 언급합니다. 

## 왜 중요한가요

논문은 "크면 낫다"는 기대와 거리를 둡니다. 같은 프로토콜로 비교했을 때 큰 EEG 모델이 작은 모델보다 꾸준히 더 잘 일반화하지는 않았고, EEG에서 유일하게 폭넓은 비교인 NeuralBench는 파운데이션 모델이 과제 특화 모델을 근소하게 앞서는 데 그쳤다고 인용합니다.  현재 MEG 벤치마크가 PNPL 대회와 LibriBrain 등 음성 해독에 치우쳐 있다는 점도 지적합니다.  그래서 저자들이 요구하는 것은 더 큰 모델이 아니라 수천 명·수천 시간 규모로 여러 기관과 제조사를 아우르는 공개 코퍼스, 공개 보류 데이터로 돌리는 리더보드형 벤치마크, 그리고 동의 검토·데이터셋 문서화·계층별 접근·철회 절차·이익 공유를 포함한 거버넌스입니다. 


저자들이 밝힌 열린 문제입니다. 학습된 표현이 뇌 역학의 어떤 측면을 담는지 아직 불분명하고, 모델이 인지가 아니라 특정 측정 방식의 통계를 학습할 위험이 있습니다. 다중 모달 모델이 단일 모달 모델보다 실제로 나은지 비교한 절제 실험이 없어 EEG나 fMRI를 더하는 것이 MEG 과제 성능을 올리는지도 열려 있습니다. 데이터가 적어 벤치마크 데이터를 사전학습에서 배제하기 어렵다는 점도 지적됩니다. 



이 로드맵의 요지는 "MEG판 GPT를 만들자"가 아니라 "그 전에 데이터와 채점표부터 만들자"로 읽힙니다. 공개 MEG 데이터가 다 합쳐도 약 3,200명이고 EEG 한 모델이 25,000명으로 학습하는 상황이라면, 지금 나오는 MEG 파운데이션 모델의 성적표는 크기보다 어느 데이터로 어떻게 검증했는지를 먼저 봐야 합니다. 프리프린트이고 새 실험 결과가 아닌 관점 논문이므로, 여기 인용된 성능 비교도 저자들의 문헌 정리로 받아들이겠습니다.



## 자주 묻는 질문

**Q. MEG가 EEG보다 나은 점이 무엇인가요?**

논문은 MEG가 인간 피질 역학을 밀리초 해상도로 기록하면서 EEG보다 공간 해석이 낫다고 설명합니다. 대신 장비가 드물어 데이터가 작고 여러 기관·제조사에 흩어져 있다는 것이 파운데이션 모델을 만들기 어려운 이유입니다.

**Q. 지금 MEG 파운데이션 모델이 아예 없나요?**

논문과 동반 저장소는 MEG-GPT, GPT2MEG, Headache-MEG-FM, MEG-XL과 다중 모달인 BrainOmni, Brain-OF 등을 소개합니다. 다만 표준 벤치마크가 없어 서로의 성능을 같은 잣대로 비교하기 어렵다는 것이 저자들의 진단입니다.

**Q. 파운데이션 모델이 항상 더 낫나요?**

논문은 같은 프로토콜로 비교했을 때 큰 EEG 모델이 작은 모델보다 꾸준히 더 잘 일반화하지는 않았고, EEG에서 유일하게 폭넓은 비교인 NeuralBench에서도 파운데이션 모델이 과제 특화 모델을 근소하게 앞서는 데 그쳤다고 인용합니다.

## 출처

1. [arXiv:2609.04461 초록 페이지](https://arxiv.org/abs/2609.04461) (paper)
2. [논문 본문 (arXiv HTML v1)](https://arxiv.org/html/2609.04461v1) (paper)
3. [동반 저장소 meg-fm-resources (GitHub)](https://github.com/thecocolab/meg-fm-resources) (data)
4. [arXiv q-bio.NC 9월 7일 신규 목록](https://arxiv.org/list/q-bio.NC/new) (other)

_이 문서는 뇌피셜 편집부가 작성했습니다. 인용 시 출처를 표기해 주세요._