• AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
STORIUM
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
STORIUM
No Result
View All Result

미니맥스 M3, MSA 아키텍처로 100만 토큰 컨텍스트와 멀티모달 구현

한이준 리포터 작성: 한이준 리포터
2026년 06월 02일 11시 12분
Reading Time: 1 min read
A A
Home 반도체·인프라
Share on FacebookShare on Twitter

중국 AI 기업 미니맥스(MiniMax)가 6월 1일 M3 모델을 공식 출시했다. M3는 새로운 희소 어텐션 아키텍처인 MSA(MiniMax Sparse Attention)를 채택해 100만 토큰 컨텍스트 창을 구현하면서도 연산 효율을 획기적으로 개선했다. 기존 풀 어텐션 방식이 토큰 수에 따라 연산 비용이 제곱으로 증가하는 것과 달리, MSA는 KV 캐시(key-value cache)를 블록으로 나눠 필요한 블록만 선별해 처리한다. 100만 토큰 길이에서 토큰당 연산량은 직전 세대 M2 대비 20분의 1이며, 프리필(prefill) 단계는 9배 이상, 디코딩 단계는 15배 이상 빨라졌다.

코딩 성능 벤치마크에서 M3는 소프트웨어 엔지니어링 기준 지표인 SWE-Bench Pro에서 59.0%를 기록해 GPT-5.5와 제미나이(Gemini) 3.1 Pro를 앞섰다. 미니맥스가 수행한 내부 실험에서 M3는 LLM 파인튜닝 논문을 약 12시간 동안 자율적으로 재현해 18개 커밋과 23개 실험 그래프를 생성했다. GPU 커널 최적화 실험에서는 NVIDIA Hopper GPU의 FP8 행렬 연산 하드웨어 활용률을 7.6%에서 71.3%로 9.4배 향상시켰으며, 최고 성능은 145번째 시도에서 나왔다. 컴퓨터 자율 조작 벤치마크 OSWorld-Verified에서는 70.06%의 작업 완료율을 달성했다. 나아가 M3는 텍스트·이미지·동영상을 초기 훈련 단계부터 함께 학습한 네이티브 멀티모달 구조를 채택했으며, 100조 토큰 규모 데이터로 훈련됐다.

Detailed view of code and file structure in a software development environment.
사진: Daniil Komov / Pexels

MSA는 오퍼레이터 수준에서도 혁신을 포함한다. KV 블록을 외부 루프로 삼아 해당 블록을 필요로 하는 쿼리들을 일괄 처리하는 ‘KV 아우터 개더(KV outer gather Q)’ 방식으로, 블록당 메모리 접근이 한 번으로 줄고 연속적인 메모리 접근 패턴이 가능해진다. 미니맥스는 Flash-Sparse-Attention 등 오픈소스 구현 대비 4배 이상 빠른 실행 속도를 보고했다. 한국 AI 연구자와 기업 개발자들은 모델 가중치 공개 시점(출시 후 10일 이내)을 주목할 필요가 있다. 100만 토큰 컨텍스트와 코딩·멀티모달 성능을 갖춘 오픈웨이트 모델은 자체 인프라 기반의 에이전트 개발과 장기 문서 처리 애플리케이션에 활용 가능성이 크다.

M3의 API는 현재 이용 가능하며, 자체 에이전트 도구인 미니맥스 코드(MiniMax Code)와 미니맥스 토큰 플랜을 통해서도 바로 쓸 수 있다. 미니맥스는 모델 가중치와 기술 보고서를 출시 후 10일 이내에 공개하겠다고 밝혔다. M3는 M2.7에 이은 M 시리즈의 다음 모델로, 프런티어급 코딩 성능과 100만 토큰 컨텍스트, 네이티브 멀티모달 입력을 단일 아키텍처에 결합한 첫 오픈웨이트 모델이라는 점을 내세운다.

다만 공개된 수치 대부분이 미니맥스 자체 실험과 발표에 근거한다는 점은 감안해야 한다. 벤치마크 성적과 속도 개선 폭은 가중치와 기술 보고서가 공개된 뒤 제3자 재현으로 검증될 문제다. 그럼에도 이번 발표가 주목받는 이유는 분명하다. 100만 토큰 컨텍스트, 프런티어급 코딩 성능, 네이티브 멀티모달을 오픈웨이트로 묶어 내놓는 사례 자체가 드물고, 이런 모델이 실제로 공개되면 클라우드 API에 의존하지 않고 자체 인프라에서 장문 처리와 에이전트를 구축하려는 조직에게 선택지가 하나 늘기 때문이다. 공개 시한으로 제시된 열흘이 검증의 출발점이 될 것이다.

저작권자 © STORIUM 무단전재 및 재배포 금지

Tags: LLMMiniMaxM3MSA멀티모달미니맥스에이전틱코딩희소어텐션
한이준 리포터

한이준 리포터

안녕하세요, 한이준 리포터입니다. 구글·마이크로소프트·메타 같은 글로벌 빅테크의 AI 전략과 플랫폼 경쟁을 좇으며, 발표 뒤에 숨은 셈법을 읽어 드립니다. 모든 기사는 발행 전 편집인의 검수를 통과합니다.

관련 기사

Dynamic blue ink swirls in water creating abstract shapes on a dark backdrop.
AI 모델·연구

MiniMax, MSA 희소 어텐션 공개…100만 토큰 문맥서 연산비용 28배 절감

2026년 06월 18일 11시 52분
Vibrant 3D rendering of colorful geometric shapes arranged in an abstract layout.
AI 모델·연구

멀티모달 QA 토큰 소비 10배 줄이는 ‘잠재 메모리’ 기법 제안

2026년 06월 12일 13시 24분
A close up of a computer circuit board
AI 모델·연구

H2HMem, 인간 간 대화 속 AI 에이전트 멀티모달 기억 벤치마크 첫 공개

2026년 06월 10일 15시 35분
Elderly doctor with glasses and stethoscope working on a laptop in a medical office.
AI 모델·연구

LLM 기반 한의학 진단 시스템, 지식 그래프로 신뢰도 높인다

2026년 06월 08일 21시 23분
Next Post
Close-up image of an RTX 2080 GPU, highlighting modern and sleek design.

엔비디아, AI 클라우드 파트너십 6개 대륙으로 확대

답글 남기기 응답 취소

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다

  • 인기 급상승
  • 최신
Close-up of a GeForce RTX graphics card on a desk, showcasing its design and technology.

엔비디아 RTX 스파크 가격, 최소 2000달러 전망…윈도 노트북 ‘M1 모먼트’ 걸림돌

2026년 06월 02일 11시 19분
A 3D rendering of a neural network with abstract neuron connections in soft colors.

퍼플렉시티, 로컬·클라우드 AI를 자동 판단하는 하이브리드 추론 시스템 발표

2026년 06월 04일 08시 53분
Contemporary building with a glass facade and geometric patterns, low angle view.

앤트로픽·네이버 개발자 밋업 개최…서울 오피스 개소 앞두고 본사 임원 참석

2026년 06월 06일 21시 12분
책상에서 법률 문서에 서명하는 모습

클로드 ‘드리밍’ 기능 공개…앤트로픽, 법률·의료 AI 성능 대폭 향상

2026년 05월 30일 21시 11분
Close-up of a wooden gavel on a judge's desk, symbolizing justice.

AI 생성 성인 콘텐츠 유료 판매 운영자들, 법원서 잇달아 징역형

2026년 06월 05일 22시 40분
엔비디아 미국 본사 건물

엔비디아·37개 창립 파트너, Open Secure AI Alliance 출범

2026년 07월 28일 19시 45분
미국 연방 로비가 이뤄지는 워싱턴 의사당 공식 사진

미 주요 기술·AI 기업·단체 11곳, 상반기 로비 4,180만달러

2026년 07월 28일 18시 46분
다리오 아모데이 앤트로픽 CEO의 2023년 TechCrunch 행사 자료사진

Claude 공개 공유 대화 일부 검색 노출…비공개 자동 유출과는 달라

2026년 07월 28일 17시 53분
일리야 수츠케버가 참석한 2014년 스탠퍼드 대담 자료사진

SSI, 엔비디아 Vera Rubin 도입…연산 자원 10배 확대

2026년 07월 28일 16시 20분
중국 항저우 앤트그룹 A Space 건물

앤트그룹 Ling-3.0-Flash 공개…1,240억개 중 51억개 활성

2026년 07월 28일 15시 07분

검색

No Result
View All Result

인기 태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 멀티에이전트 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

카테고리

  • AI 모델·연구 (1,482)
  • AI 서비스·툴 (826)
  • 반도체·인프라 (537)
  • 빅테크·기업 (566)
  • 산업 적용 (415)
  • 스타트업·투자 (251)
  • 정책·윤리 (455)

STORIUM은 트렌드와 인사이트를 전하는 종합 뉴스 매체입니다. 정확성, 균형, 맥락의 편집 원칙으로 신뢰받는 뉴스를 전합니다.

카테고리

  • AI 모델·연구
  • AI 서비스·툴
  • 반도체·인프라
  • 빅테크·기업
  • 산업 적용
  • 스타트업·투자
  • 정책·윤리

태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 멀티에이전트 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

최근 뉴스

엔비디아 미국 본사 건물

엔비디아·37개 창립 파트너, Open Secure AI Alliance 출범

2026년 07월 28일 19시 45분
미국 연방 로비가 이뤄지는 워싱턴 의사당 공식 사진

미 주요 기술·AI 기업·단체 11곳, 상반기 로비 4,180만달러

2026년 07월 28일 18시 46분
  • 소개
  • 문의
  • 광고문의
  • 개인정보처리방침
  • 이용약관
  • 청소년보호정책
  • 정정·반론 보도 안내
  • 편집·윤리강령

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.

No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.