본문으로 건너뛰기

K2 Horizon — 0.9B부터 375B까지 '완전 개방' 모델

MBZUAI 산하 IFM이 9월 3일 K2 Horizon 패밀리를 Apache 2.0으로 공개했습니다. 375B MoE 플래그십의 벤치마크와 가중치·데이터·코드·체크포인트 공개 범위를 정리했습니다.

AI피셜 편집부· 3분 읽기원문 보기 ↗
K2 Horizon을 만든 IFM의 모기관 MBZUAI 캠퍼스의 황금빛 다목적 홀 건물
사진: NNegm · CC BY-SA 4.0

핵심 답변

IFM(Institute of Foundation Models)은 2026년 9월 3일 K2 Horizon 패밀리를 Hugging Face에 공개했습니다. 0.9B·7B·32B 밀집 모델과 MoVA-36B-A4B·375B-A23B MoE 모델이 모두 Apache 2.0이며 512K 컨텍스트를 갖고, 학습 데이터·레시피·코드·중간 체크포인트까지 공개하겠다고 밝혔습니다.

TL;DR세 줄 요약

  • 패밀리: K2-Horizon-0.9B·7B·32B(밀집), MoVA-36B-A4B·375B-A23B(MoE). 모두 Apache 2.0, 컨텍스트 512K(524,288토큰)입니다.
  • 375B-A23B는 Terminal-Bench 2.1 70.2%, SciCode 42.7%, AA-LCR 76.0%로 최대 2.6배 큰 오픈 웨이트 MoE와 대등하거나 앞선다고 밝혔습니다.
  • 가중치는 즉시 공개, 학습 데이터·레시피·학습 코드·중간 체크포인트는 '공개 예정'입니다. 데이터셋 TxT360-v2 등은 이미 올라와 있습니다.
  • 7B는 HMMT Feb 2026 73.3%(Gemma 4-12B 63.1%), SWE-bench 70.6%(Granite 4.2-8B 47.7%)를 기록했습니다.

핵심 사실

공개 시점
2026-09-03Hugging Face 모델 갱신·The Neuron 보도 기준
라이선스
Apache 2.0전 모델
플래그십
375B 총 / 23B 활성Sparse MoE
컨텍스트
512K524,288 토큰, 전 모델
Terminal-Bench 2.1 (375B)
70.2%Nemotron 3 Ultra 53.9%, GLM 5.2 77.9%
개발 기관
IFMMBZUAI가 2025년 5월 설립. 아부다비·실리콘밸리·파리

무슨 일인가요

MBZUAI가 2025년 5월 세운 연구소 IFM(Institute of Foundation Models)이 K2 Horizon 모델 패밀리를 Hugging Face에 공개했습니다. IFM은 스스로를 "프론티어급 파운데이션 모델의 개방적이고 독립적인 개발에 전념하는 글로벌 AI 연구소"로 소개하며 아부다비·실리콘밸리·파리에 거점을 두고 있습니다. 공식 기존 LLM360 조직은 IFM으로 옮겨 갔고, 이전 K2 시리즈의 후속이 이번 Horizon입니다. 공식 The Neuron은 9월 3일 자 정리에서 이를 "0.9B부터 375B까지 6개의 완전 개방 모델"로, 가중치·학습 코드·데이터·체크포인트·로그를 포함한다고 전했습니다. 보도

나란히 늘어선 슈퍼컴퓨터 연산 캐비닛 두 줄
총 375B·활성 23B의 MoE 모델을 512K 컨텍스트로 학습하려면 대형 연산 클러스터가 필요합니다. 사진은 NASA 에임스 연구센터의 Pleiades 슈퍼컴퓨터 캐비닛입니다.· 사진: NASA Ames Research Center · Public domain

패밀리 구성

모델파라미터구조컨텍스트라이선스
K2-Horizon-375B-A23B총 375B / 활성 23BSparse MoE512KApache 2.0
K2-Horizon-MoVA-36B-A4B총 36B / 활성 4BMoE + Mixture-of-Values attention512KApache 2.0
K2-Horizon-32B32B밀집512KApache 2.0
K2-Horizon-7B7B 코어 (HF 표기 9B)밀집512KApache 2.0
K2-Horizon-0.9B0.9B밀집512KApache 2.0

표의 수치는 각 모델 카드와 IFM 조직 페이지 기준입니다. 공식 모든 모델이 524,288토큰의 네이티브 컨텍스트를 갖는 점이 눈에 띄고, 뒤이어 7B-Uno·0.9B-Uno 변형도 올라왔습니다. 공식

성능 — 오픈 MoE 중 어디쯤인가

375B-A23B 카드는 "최대 2.6배 큰 오픈 웨이트 MoE 모델과 대등하거나 앞선다"고 요약하며, 터미널 사용 70.2%, 과학 코딩 42.7%, 장문 맥락 추론 76.0%를 앞세웁니다. 공식 비교표에 실린 오픈 MoE 모델들의 Terminal-Bench 2.1 점수는 아래와 같습니다. 데이터

Terminal-Bench 2.1 — 오픈 웨이트 MoE 모델 비교
0.0%25.0%50.0%75.0%100.0%K2-Horizon 375BNemotron 3 Ultra 550BInkling 975BMiniMax-M3 428BGLM 5.2 753B70.2%53.9%55.1%65.2%77.9%
Terminal-Bench 2.1 — 오픈 웨이트 MoE 모델 비교
항목Terminal-Bench 2.1
K2-Horizon 375B70.2%
Nemotron 3 Ultra 550B53.9%
Inkling 975B55.1%
MiniMax-M3 428B65.2%
GLM 5.2 753B77.9%

출처: K2-Horizon-375B-A23B 모델 카드 비교표

같은 표에서 폐쇄형 모델과 견주면 그림이 달라집니다. Terminal-Bench 2.1은 GPT 5.6 Luna 80.9%·Claude Sonnet 5 80.5%, Humanity's Last Exam은 K2 32.0% 대 Sonnet 5 41.3%, GDPVal-AA는 1,441 대 1,584 Elo입니다. 데이터 반면 저장소 수준 코드 질의응답인 SWE-Atlas-QnA(strict)는 48.4%로 표 안에서 가장 높습니다. 데이터 작은 모델도 비교 대상을 명시했습니다. 7B는 HMMT Feb 2026 73.3%(Gemma 4-12B 63.1%), SWE-bench 70.6%(Granite 4.2-8B 47.7%), HLE 18.6%(Qwen3.5-9B 14.9%)이고, MoVA-36B-A4B는 Terminal-Bench 2.1 58.6%, GPQA Diamond 80.8%입니다. 데이터

'완전 개방'의 범위

공개 범위

지금 받을 수 있는 것과 '예정'인 것

  1. 지금: 전 모델 최종 가중치(Apache 2.0, BF16 safetensors), vLLM·SGLang 실행 레시피, 양자화 버전

  2. 지금: 데이터셋 TxT360-v2·Pretrain-Behaviors·Math-Reasoning·Code-Reasoning·SFT-Reasoning

  3. 예정: 학습 레시피·학습 코드·중간 체크포인트 — 능력 발달 과정 연구용으로 공개하겠다고 명시

K2-Horizon-375B-A23B·MoVA-36B-A4B 모델 카드, IFM 조직 페이지 기준

IFM 조직 페이지에는 TxT360-v2, Math-Reasoning, Code-Reasoning 등 데이터셋이 이미 올라와 있고, 그중 Math-Reasoning은 다운로드 20억 건 이상으로 표시됩니다. 데이터

자주 묻는 질문

K2 Horizon은 어떤 모델들인가요?
IFM의 Hugging Face 조직 페이지 기준 K2-Horizon-0.9B, 7B, 32B(밀집)와 MoVA-36B-A4B(총 36B·활성 4B), 375B-A23B(총 375B·활성 23B)의 MoE 모델이 있고, 7B-Uno·0.9B-Uno 변형도 뒤이어 올라왔습니다. 모두 Apache 2.0이고 컨텍스트는 524,288토큰입니다.
'완전 개방'이 정확히 무엇을 뜻하나요?
모델 카드 기준 최종 가중치는 Apache 2.0으로 즉시 공개됐고, 학습 데이터·레시피·학습 코드·중간 체크포인트는 '공개 예정'입니다. 375B 카드는 능력 발달 과정을 연구할 수 있도록 중간 체크포인트를 낼 계획이라고 적었습니다. IFM 공식 블로그(ifm.ai)는 작성 시점에 접근이 차단돼 확인하지 못했습니다.
폐쇄형 프론티어 모델과 비교하면요?
카드의 비교표에서 375B-A23B는 대부분 항목에서 Claude Sonnet 5나 GPT 5.6 계열에 뒤집니다. Terminal-Bench 2.1은 70.2%로 GPT 5.6 Luna 80.9%·Claude Sonnet 5 80.5%보다 낮습니다. 다만 SWE-Atlas-QnA(strict)는 48.4%로 표에서 가장 높습니다.

출처 · 5

  1. 1K2-Horizon-375B-A23B 모델 카드 (Hugging Face)공식 발표huggingface.co/IFM/K2-Horizon-375B-A23B
  2. 2K2-Horizon-7B 모델 카드 (Hugging Face)공식 발표huggingface.co/IFM/K2-Horizon-7B
  3. 3K2-Horizon-MoVA-36B-A4B 모델 카드 (Hugging Face)공식 발표huggingface.co/IFM/K2-Horizon-MoVA-36B-A4B
  4. 4IFM 조직 페이지 (Hugging Face)데이터huggingface.co/IFM
  5. 5Everything That Happened in AI Today (The Neuron, 9월 3일)보도www.theneuron.ai/digest/everything-that-happened-in-ai-today-thursday-september-3-2026/

이 글의 마크다운 원문: /posts/k2-horizon-fully-open-models/md/ · 인용 시 출처를 “AI피셜”으로 표기해 주세요.

이 글이 도움이 됐다면 동료에게 보내 주세요.

AI피셜 새 글 알림

새 글이 올라오면 메일로 알려드려요

매일 5편, 5분 브리프. 스팸 없이 새 글 소식만. 언제든 한 번에 해지.

같은 태그·카테고리의 글을 골랐습니다.

오픈소스· 2

Iris — 오픈 웨이트 검색 에이전트, BrowseComp 88.6%

AllSpark Research가 Qwen 기반으로 후속 학습한 오픈 웨이트 검색 에이전트 Iris-mini·Iris-pro를 공개했습니다. 벤치마크 점수와 그 조건(문맥 관리)을 함께 정리했습니다.

  • #오픈소스
  • #검색 에이전트
  • #Qwen
오픈소스· 2

Mitra-v2 — 77M 표 형식 모델이 1.6B TabFM과 동급

Amazon이 9월 3일 표 형식 데이터용 기반 모델 Mitra-v2의 기술 보고서를 내고 가중치를 Apache-2.0으로 공개했습니다. 77M 파라미터로 TabArena·TALENT에서 1.6B TabFM과 통계적 동급이었습니다.

  • #오픈소스
  • #Amazon
  • #표 형식 데이터