• AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
STORIUM
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
STORIUM
No Result
View All Result

SKT A.X K2, 120K 장문 처리 성능과 산업 활용 전망

유지율 리포터 작성: 유지율 리포터
2026년 08월 04일 18시 32분
Reading Time: 1 min read
A A
Home AI 모델·연구
Share on FacebookShare on Twitter

SK텔레콤이 8월 4일 독자 AI 파운데이션 모델 A.X K2의 장문 처리 성능과 산업 적용 계획을 공개했다. 김태윤 SK텔레콤 파운데이션 모델 담당은 이 모델이 단순 질의응답을 넘어 여러 차례의 대화와 도구 호출을 이어가는 AI 에이전트 업무를 겨냥했다고 설명했다. A.X K2는 전체 6,880억 개 매개변수를 갖췄고, 추론할 때 실제 활성화되는 매개변수는 330억 개로 유지했다. 모델 규모를 키우면서도 연산 부담을 통제하려는 혼합 전문가 구조의 운용 방식이다.

핵심은 긴 문맥을 다루는 자체 SGA 구조다. 입력 길이가 32K를 넘으면 처리량과 지연 시간에서 이점이 나타나며, 120K 입력에서는 A.X K1보다 전체 토큰 처리량이 67.7% 개선됐다는 것이 회사 측 설명이다. 국내외 14개 벤치마크 평균 성능은 전작보다 32.2%포인트 높아졌고, 장문 이해와 에이전트 관련 평가의 개선 폭은 약 83.9%포인트였다. 개별 평가에서는 AIME26 97.1점, 한국어 지식 평가 KMMLU-Pro 80.5점, 한국 문화 이해 평가 CLIcK 91.6점을 기록했다.

A.X K2를 설명하는 김태윤 SK텔레콤 파운데이션 모델 담당
A.X K2의 산업 활용 전략을 설명하는 김태윤 담당. 사진: SK텔레콤 뉴스룸
확인 항목 공개 내용
전체 규모 6,880억 개 매개변수
활성 매개변수 추론 시 330억 개
장문 처리 120K 입력에서 전작 대비 토큰 처리량 67.7% 개선
현장 적용 KG스틸·코넥 제조 실증, SK하이닉스 사내 도구 연동

실제 사용처는 제조와 사내 업무부터 잡았다. SK텔레콤은 KG스틸과 코넥의 생산 현장에서 과거 불량 사례를 학습해 원인과 조치 방법을 안내하는 제조 특화 AI 에이전트를 실증할 계획이다. SK하이닉스의 사내 도구 LLM Chat에는 경량 모델을 연결해 반도체 지식 검색과 정보 정리를 지원하고 있다. 국방부에는 기존 A.X K1을 FP8·FP4·INT4 세 형태로 양자화해 제공했으며 A.X K2 공급 계획도 세우고 있다. 보안이 필요한 특화 학습은 기관이나 기업의 폐쇄형 내부망에서 수행하고 데이터를 외부로 반출하지 않는다는 방침이다.

A.X K2 메인 모델은 Apache 2.0 라이선스로 가중치와 추론 코드를 공개한다. 다만 공개된 수치는 자체 벤치마크와 회사 설명에 기반한 결과이므로 기업 도입 전에는 실제 문서 길이, 응답 지연, 하드웨어 비용과 보안 환경에서 별도 검증이 필요하다. SK텔레콤은 후속 모델을 조 단위 매개변수로 확장하고 에이전트 강화학습과 사이버 보안 역량을 높이는 한편, 리벨리온과 국산 NPU에서 서빙 최적화와 상용 서비스 실증을 추진할 계획이다.

저작권자 © STORIUM 무단전재 및 재배포 금지

Tags: A.X K2AI 에이전트SK텔레콤김태윤소버린 AI
유지율 리포터

유지율 리포터

안녕하세요, 유지율 리포터입니다. arXiv와 학회에서 쏟아지는 AI 연구를 살펴, 논문 속 성과를 과장 없이 우리말로 풀어 드립니다. 사실관계는 발행 전 편집인이 함께 확인합니다.

관련 기사

SKT, 스타트업 3곳에 A.X K1 API 제공…연말 PoC
스타트업·투자

SKT, 스타트업 3곳에 A.X K1 API 제공…연말 PoC

2026년 08월 01일 20시 39분
정재헌 SK텔레콤 CEO가 2026 뉴 이천포럼에서 발표하는 모습
반도체·인프라

SKT가 짚은 2026년 상반기 AI 4대 흐름…인프라 병목과 수익화 과제

2026년 07월 19일 07시 10분
Gemini 3.6 Flash로 낙농 데이터를 관리하는 폴 윈드멀러
산업 적용

구글 Gemini 3.6 Flash, 낙농 데이터 자동화 활용과 한계

2026년 08월 04일 21시 19분
TECH4GOOD 해커톤 참가자들이 팀 회의를 진행하는 모습
산업 적용

SKT·하나금융 TECH4GOOD, 포용 AI 시제품 성과와 한계

2026년 08월 04일 19시 35분
Next Post
웨이모 로보택시 지붕의 자율주행 센서 장비

웨이모 달라스 로보택시 전면 개방, 이용법과 폭우 한계

답글 남기기 응답 취소

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다

  • 인기 급상승
  • 최신
Close-up of a GeForce RTX graphics card on a desk, showcasing its design and technology.

엔비디아 RTX 스파크 가격, 최소 2000달러 전망…윈도 노트북 ‘M1 모먼트’ 걸림돌

2026년 06월 02일 11시 19분
A 3D rendering of a neural network with abstract neuron connections in soft colors.

퍼플렉시티, 로컬·클라우드 AI를 자동 판단하는 하이브리드 추론 시스템 발표

2026년 06월 04일 08시 53분
Contemporary building with a glass facade and geometric patterns, low angle view.

앤트로픽·네이버 개발자 밋업 개최…서울 오피스 개소 앞두고 본사 임원 참석

2026년 06월 06일 21시 12분
책상에서 법률 문서에 서명하는 모습

클로드 ‘드리밍’ 기능 공개…앤트로픽, 법률·의료 AI 성능 대폭 향상

2026년 05월 30일 21시 11분
Close-up of a wooden gavel on a judge's desk, symbolizing justice.

AI 생성 성인 콘텐츠 유료 판매 운영자들, 법원서 잇달아 징역형

2026년 06월 05일 22시 40분
Runware Sonic Inference Pod 이동식 AI 추론 설비

Runware Sonic Inference Pod, 분산 AI 추론 비용 한계

2026년 08월 04일 23시 29분
F1 데이터 운영 책임자 맷 켐프

F1·AWS 데이터 에이전트, 8주 업무를 40분으로 단축

2026년 08월 04일 22시 42분
상벨 차량 내부에서 건강 스크리닝 결과를 상담하는 아크 담당자들

아크 상벨, 시각장애인 골프 현장 AI 건강 스크리닝 활용과 한계

2026년 08월 04일 22시 27분
레노버 Yoga Slim 7i Ultra Aura Edition의 얇은 본체와 USB-C 단자

레노버 Yoga Slim 7i Ultra, 2250달러 가격 한계

2026년 08월 04일 22시 16분
삼성전자 MX사업부 디자인팀장 이일환 부사장

삼성 AI 시대 갤럭시 디자인, 1억개 손목 데이터 활용법

2026년 08월 04일 22시 12분

검색

No Result
View All Result

인기 태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP Meta NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

카테고리

  • AI 모델·연구 (1,517)
  • AI 서비스·툴 (856)
  • 반도체·인프라 (575)
  • 빅테크·기업 (590)
  • 산업 적용 (481)
  • 스타트업·투자 (255)
  • 정책·윤리 (482)

STORIUM은 트렌드와 인사이트를 전하는 종합 뉴스 매체입니다. 정확성, 균형, 맥락의 편집 원칙으로 신뢰받는 뉴스를 전합니다.

카테고리

  • AI 모델·연구
  • AI 서비스·툴
  • 반도체·인프라
  • 빅테크·기업
  • 산업 적용
  • 스타트업·투자
  • 정책·윤리

태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP Meta NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

최근 뉴스

Runware Sonic Inference Pod 이동식 AI 추론 설비

Runware Sonic Inference Pod, 분산 AI 추론 비용 한계

2026년 08월 04일 23시 29분
F1 데이터 운영 책임자 맷 켐프

F1·AWS 데이터 에이전트, 8주 업무를 40분으로 단축

2026년 08월 04일 22시 42분
  • 소개
  • 문의
  • 광고문의
  • 개인정보처리방침
  • 이용약관
  • 청소년보호정책
  • 정정·반론 보도 안내
  • 편집·윤리강령

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.

No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.