# Vals 보고서 — 에이전트 작업 전력, 모델 따라 최대 75배

> 벤치마크 기관 Vals AI가 9월 3일 오픈 웨이트 모델 16종의 에이전트 작업 전력·탄소·물 사용량을 추정한 보고서를 냈습니다. 같은 벤치마크를 완주하는 데 드는 전력이 모델에 따라 수십 배 차이 났다는 내용입니다.

- 출처 사이트: AI피셜 (https://aifficial.net/posts/vals-agentic-environmental-footprint/)
- 발행: 2026-09-04
- 카테고리: 업계 동향 · 태그: 환경, 추론 비용, 벤치마크, 오픈 웨이트, 데이터

## 핵심 답변

Vals AI는 2026년 9월 3일 금융·코딩·의료·법률 분야 2,157개 에이전트 과제(Vals Index)를 오픈 웨이트 모델 16종으로 돌렸을 때의 전력·탄소·물 사용량을 EcoLogits로 추정한 보고서를 냈습니다. 전체 완주 전력은 Ling 3.0 Flash 23.8kWh부터 Qwen 3.8 Max 1.8MWh까지 약 75배 차이가 났고, 토큰 가격이나 토큰 수가 환경 비용을 잘 예측하지 못한다고 결론지었습니다.

## 요약

- Vals Index 2,157개 과제를 완주하는 데 드는 전력은 Ling 3.0 Flash 23.8kWh, DeepSeek V4 Flash 139.7kWh, Kimi K3 1.7MWh, Qwen 3.8 Max 1.8MWh로 추정됐습니다.
- 10회 대화 기준 DeepSeek V4 Flash는 10.5Wh·5.7gCO₂e·46mL, Kimi K3는 169.5Wh·92.4gCO₂e·733mL로 약 16배 차이입니다.
- Kimi K3는 토큰을 GLM 5.2의 절반만 쓰고도 과제당 환경 비용이 3배였고, DeepSeek V4 Pro는 토큰당 가격이 Kimi K3의 1/15인데 환경 비용은 비슷했습니다.
- 추정은 H100·16비트·vLLM 가정의 EcoLogits 계산이며 폐쇄형 모델은 제외됐습니다. Bloomberg는 이를 '에이전트 작업이 단순 질의의 약 1만 배'로 요약했지만 보고서 본문에 그 배수는 없습니다.

## 핵심 사실

| 항목 | 값 |
|---|---|
| 발표일 | 2026-09-03 (Vals AI 블로그) |
| 과제 수 | 2,157개 (금융·코딩·의료·법률, Vals Index) |
| 모델 수 | 오픈 웨이트 16종 (Bloomberg 보도 기준 14종이 중국 모델) |
| 완주 전력 최소 | 23.8kWh (Ling 3.0 Flash 2607) |
| 완주 전력 최대 | 1.8MWh (Qwen 3.8 Max) |
| 가정 | NVIDIA H100 · 16비트 · vLLM (EcoLogits 추정) |


## 무슨 일인가요

독립 벤치마크 기관 Vals AI는 2026년 9월 3일 오픈 웨이트 모델들이 긴 에이전트 과제를 수행할 때의 전력·탄소·물 사용량을 추정한 보고서를 냈습니다. 저자는 Olivia Fowler, Omar Almatov, Daniel Fein입니다.  데이터는 금융·코딩·의료·법률 분야의 장기·다회차 에이전트 과제 2,157개로 구성된 Vals Index에서 측정한 토큰 사용량이며, 여기에 오픈소스 라이브러리 EcoLogits를 적용해 모델 파라미터 수와 함께 환경 비용을 계산했습니다.  배포 가정은 NVIDIA H100, 16비트 가중치, vLLM 서빙입니다. 



대상은 Kimi K3, DeepSeek V4 Flash, GLM-5.2, MiniMax M2.7, Mistral Medium 3.5, Inkling Small, MiMo V2.5 등 오픈 웨이트 16종이며, 폐쇄형 모델은 구조 정보가 없어 제외됐습니다.  AI Weekly가 전한 Bloomberg 보도에 따르면 16종 중 14종이 중국 모델입니다. 

## 숫자로 보면

같은 2,157개 과제를 완주하는 데 드는 전력 추정치는 모델에 따라 크게 달랐습니다. 



최소인 Ling 3.0 Flash(23.8kWh)와 최대인 Qwen 3.8 Max(1.8MWh)의 차이는 약 75배로, 이 배수는 보고서의 두 수치로 계산한 값입니다.  보고서는 Kimi K3의 완주 비용을 탄소는 "샌프란시스코에서 마이애미까지 비행", 물은 "소방차 물탱크 하나"에 비유했습니다. 

일상 규모로 내려오면 10회 대화 기준 수치가 있습니다. 

| 모델 | 전력 | 탄소 | 물 |
| --- | --- | --- | --- |
| DeepSeek V4 Flash | 10.5 Wh | 5.7 gCO₂e | 46 mL |
| GLM-5.2 | 50.4 Wh | 27.4 gCO₂e | 218 mL |
| Kimi K3 | 169.5 Wh | 92.4 gCO₂e | 733 mL |

미국의 일일 AI 챗봇 사용자 6,600만 명이 각각 DeepSeek V4 Flash로 대화 한 번을 한다면 합계는 약 690MWh, 탄소 375톤, 물 300만 리터라고 보고서는 추산했습니다. 

## 가격과 토큰 수는 왜 믿을 수 없나요

보고서의 핵심 주장은 "토큰 가격은 에너지 사용의 불완전한 대리 지표"라는 것입니다.  Kimi K3는 GLM 5.2보다 토큰을 절반만 쓰고도 과제당 환경 비용이 약 3배였고, DeepSeek V4 Pro는 토큰당 가격이 Kimi K3의 1/15인데 환경 비용은 비슷했습니다.  에이전트 과제에서는 값싼 모델이 오히려 토큰 효율이 낮아 자원 수요와 과제당 비용을 함께 끌어올릴 수 있다는 설명입니다. 

Bloomberg는 이 보고서를 "웹앱 만들기 같은 긴 '사고' 과제가 단발 질문의 약 1만 배 환경 영향을 갖는다"고 요약했고, Vals의 Omar Almatov는 "더 이상 단발 질문이 아니기 때문에 발자국이 급격히 커진다"고 말했다고 AI Weekly가 전했습니다.  다만 이 글에서 직접 읽은 보고서 본문에는 그 배수가 명시돼 있지 않았습니다. 


분석은 오픈 웨이트 모델에 한정되며, EcoLogits는 단순화 가정에 기대므로 실제 값은 양자화 수준, 하드웨어 구성, 데이터센터 효율, 전력원에 따라 달라집니다. 빛·소음·수질 오염, 도시 열섬, 전력망 부담 같은 외부 효과는 제외됐고, 결과는 "직접 측정이 아닌 최선의 추정치"입니다. 



이 보고서가 실무자에게 주는 메시지는 환경 문제 이전에 비용 문제입니다. 에이전트 과제에서는 토큰 단가가 아니라 "과제 하나를 끝내는 데 드는 총 연산"이 청구서를 결정하는데, 이 총량은 모델 크기와 토큰 효율의 곱이라 가격표만 보고는 알 수 없습니다. 모델을 고를 때 과제당 총 토큰과 활성 파라미터를 함께 적어 두는 습관이, 환경 보고서를 쓰든 클라우드 청구서를 줄이든 같은 답을 줍니다. 



이 글은 2026년 9월 3일 Vals AI 보고서와 AI Weekly가 전한 Bloomberg 보도를 바탕으로 정리한 비공식 요약입니다. Bloomberg 원문은 직접 열지 못해 출처에 넣지 않았습니다. 완주 기준 탄소·물 수치는 보고서에 표로 제시되지 않아 싣지 않았습니다.



## 자주 묻는 질문

**Q. 왜 토큰 수가 적은 모델이 환경 비용은 더 큰가요?**

EcoLogits 추정은 토큰 수에 모델 파라미터 수를 곱해 계산합니다. 보고서는 Kimi K3가 GLM 5.2보다 토큰을 절반만 쓰고도 과제당 환경 비용이 3배였다고 했는데, 큰 모델일수록 토큰 하나를 만드는 데 더 많은 연산이 들기 때문입니다.

**Q. 실제 측정값인가요?**

아닙니다. 보고서는 Vals가 측정한 토큰 사용량에 오픈소스 라이브러리 EcoLogits를 적용한 '최선의 추정치'라고 밝혔습니다. 양자화, 하드웨어 구성, 데이터센터 효율, 전력원에 따라 실제 값은 달라지며, 폐쇄형 모델은 구조 정보가 없어 제외됐습니다.

**Q. '1만 배'라는 숫자는 어디서 나왔나요?**

AI Weekly가 전한 Bloomberg 기사 제목과 본문의 표현입니다. 이 글에서 직접 확인한 Vals 보고서 본문에는 단순 질의 대비 배수가 명시돼 있지 않아, 보도 수준의 주장으로 표기했습니다.

## 출처

1. [Vals Environmental Impacts Report (Vals AI)](https://www.vals.ai/blogs/vals-environmental-impacts-report) (data)
2. [Vals AI: Agentic Tasks Rack Up 10,000x the Environmental Footprint (AI Weekly, Bloomberg 인용)](https://aiweekly.co/alerts/vals-ai-agentic-tasks-rack-up-10000x-the-environmental-footprint-of-simple-llm) (report)

_이 문서는 AI피셜 편집부가 작성했습니다. 인용 시 출처를 표기해 주세요._