• AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
STORIUM
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
STORIUM
No Result
View All Result

Trajectory·UC버클리, 멀티-LoRA 연속학습 스택 SkyRL 오픈소스 공개

서아라 리포터 작성: 서아라 리포터
2026년 06월 01일 17시 01분
Reading Time: 1 min read
A A
Home AI 서비스·툴
Share on FacebookShare on Twitter

AI 스타트업 Trajectory가 UC 버클리 Sky Lab, Anyscale과 공동으로 멀티-LoRA(저랭크 적응) 동시 학습 플랫폼 ‘SkyRL’을 오픈소스로 공개했다. 코드는 NovaSky-AI/SkyRL 깃허브 저장소에 공개됐으며, 단일 테넌트 강화학습(RL) 프레임워크 대비 종단 간 실험 처리량이 2.81배 향상됐다는 성과를 보고했다. 학습 보상 지표에서는 회귀가 발생하지 않았다고 Trajectory 측은 밝혔다.

SkyRL이 겨냥하는 문제는 기존 연속학습 인프라의 네 가지 비효율이다. 첫째, 대형 모델의 체크포인트 로딩과 분산 런타임 초기화에 30분 이상 소요되는 콜드스타트 지연이다. 둘째, Qwen3.5-397B처럼 1,000억 개 이상 파라미터를 가진 모델은 H200 노드 8대를 요구하는데, LoRA는 베이스 모델을 동결하고 소형 어댑터 가중치만 학습해 메모리를 한 자릿수 배수로 줄인다. 셋째, 기존 스택은 실험을 순차 처리하지만 멀티-LoRA는 실험마다 별도 어댑터를 매핑해 N배 처리량 다중화를 실현한다. 넷째, 학습기와 추론 엔진이 서로 대기하면서 GPU가 유휴 상태에 놓이는 자원 낭비다. Trajectory는 이 접근 방식을 C-LoRA(연속 멀티-LoRA 학습)라 부른다.

Abstract illustration depicting complex digital neural networks and data flow.
사진: Google DeepMind / Pexels

추론 측 성능 향상의 핵심은 vLLM에서 모든 어댑터를 GPU 메모리에 올려두고 서로 다른 어댑터의 토큰을 같은 배치에 혼합 처리하는 구조다. SGMV 디코드 커널이 어댑터별 행렬-벡터 연산을 GPU 런치 1회로 통합해 디코딩 효율을 높인다. 학습 측은 현재 단일 어댑터 순차 방식으로, 각 테넌트의 LoRA 파라미터·마스터 가중치·옵티마이저 상태·그래디언트 버퍼가 AdapterStore에 저장되고 CPU 핀드 메모리와 GPU 사이를 교체하며 처리된다. 추론은 동시 다중화되지만 학습은 아직 직렬 방식이라는 점이 현재 아키텍처의 한계다.

Trajectory는 단일 H200 노드에서 Qwen3-4B-Instruct-2507을 사용해 GSM8K 수학 문제를 도구 호출(Calculator·Final Answer) 에이전트 방식으로 푸는 실험을 수행했다. 8개 어댑터를 동시에 학습시킨 결과 총 실험 시간이 5,433초였으며, 이는 순차 방식 3회 연속 실행보다 먼저 끝났다. N=4일 때 평균 실험 시간은 1.88배 단축됐다. 모든 동시 실험에서 9번째 학습 스텝까지 보상 정확도 90% 이상에 도달했고, 직렬 기준선 대비 최종 스텝에서 ±1σ 범위 내 성능을 유지했다. 다만 동시 실행 수(N)가 늘수록 첫 번째 실험 완료 시간과 스텝당 지연이 증가해 N=8에서 롤아웃 시간이 162초에서 401초로 늘어났으며, 프런티어급 대형 모델이나 8×H100·H200 노드 및 Megatron 빌드 환경이 요구된다는 점도 진입 장벽으로 꼽힌다.

저작권자 © STORIUM 무단전재 및 재배포 금지

Tags: LoRASkyRL강화학습연속학습오픈소스
서아라 리포터

서아라 리포터

안녕하세요, 서아라 리포터입니다. 새로 나온 AI 모델과 서비스를 직접 써 보고, 무엇이 정말 달라졌는지 독자 눈높이에서 전해 드립니다. 제가 쓴 기사는 발행 전 편집인의 사실 확인을 거칩니다.

관련 기사

AI 멀티모달 모델 추상 흑백 다이어그램 — 멀티-LoRA 학습 아키텍처
AI 모델·연구

Trajectory, 멀티-LoRA 연속학습 스택 SkyRL 오픈소스 공개… 실험 처리량 2.81배

2026년 06월 01일 19시 24분
AI 훈련 인프라를 상징하는 디지털 회로 아키텍처
반도체·인프라

프라임 인텔렉트, 1.3억 달러 유치…AI 훈련 플랫폼 몸값 10억 달러

2026년 07월 11일 12시 08분
저랭크 어댑터를 재귀 통합한 연속 미세조정 기법 ReCoLoRA — arXiv 2607.07719 논문 원문 연구 도식
AI 모델·연구

저랭크 어댑터를 재귀 통합한 연속 미세조정 기법 ReCoLoRA

2026년 07월 10일 20시 15분
Laptop displaying code in a dark setting, highlighting programming concepts and digital work.
AI 모델·연구

DeepReinforce, 자체 RL 스캐폴드 학습 오픈소스 코딩 모델 Ornith-1.0 출시

2026년 06월 26일 14시 52분
Next Post
NVIDIA Dynamo Snapshot이 Kubernetes 환경에서 LLM 추론 워크로드의 빠른 시작을 지원하며 인퍼런스 인프라 배포 속도를 높인다.

NVIDIA, 쿠버네티스 LLM 추론 콜드스타트 단축하는 Dynamo Snapshot 공개

답글 남기기 응답 취소

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다

  • 인기 급상승
  • 최신
Close-up of a GeForce RTX graphics card on a desk, showcasing its design and technology.

엔비디아 RTX 스파크 가격, 최소 2000달러 전망…윈도 노트북 ‘M1 모먼트’ 걸림돌

2026년 06월 02일 11시 19분
A 3D rendering of a neural network with abstract neuron connections in soft colors.

퍼플렉시티, 로컬·클라우드 AI를 자동 판단하는 하이브리드 추론 시스템 발표

2026년 06월 04일 08시 53분
Contemporary building with a glass facade and geometric patterns, low angle view.

앤트로픽·네이버 개발자 밋업 개최…서울 오피스 개소 앞두고 본사 임원 참석

2026년 06월 06일 21시 12분
책상에서 법률 문서에 서명하는 모습

클로드 ‘드리밍’ 기능 공개…앤트로픽, 법률·의료 AI 성능 대폭 향상

2026년 05월 30일 21시 11분
Close-up of a wooden gavel on a judge's desk, symbolizing justice.

AI 생성 성인 콘텐츠 유료 판매 운영자들, 법원서 잇달아 징역형

2026년 06월 05일 22시 40분
엔비디아 미국 본사 건물

엔비디아·37개 창립 파트너, Open Secure AI Alliance 출범

2026년 07월 28일 19시 45분
미국 연방 로비가 이뤄지는 워싱턴 의사당 공식 사진

미 주요 기술·AI 기업·단체 11곳, 상반기 로비 4,180만달러

2026년 07월 28일 18시 46분
다리오 아모데이 앤트로픽 CEO의 2023년 TechCrunch 행사 자료사진

Claude 공개 공유 대화 일부 검색 노출…비공개 자동 유출과는 달라

2026년 07월 28일 17시 53분
일리야 수츠케버가 참석한 2014년 스탠퍼드 대담 자료사진

SSI, 엔비디아 Vera Rubin 도입…연산 자원 10배 확대

2026년 07월 28일 16시 20분
중국 항저우 앤트그룹 A Space 건물

앤트그룹 Ling-3.0-Flash 공개…1,240억개 중 51억개 활성

2026년 07월 28일 15시 07분

검색

No Result
View All Result

인기 태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 멀티에이전트 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

카테고리

  • AI 모델·연구 (1,482)
  • AI 서비스·툴 (826)
  • 반도체·인프라 (537)
  • 빅테크·기업 (566)
  • 산업 적용 (415)
  • 스타트업·투자 (251)
  • 정책·윤리 (455)

STORIUM은 트렌드와 인사이트를 전하는 종합 뉴스 매체입니다. 정확성, 균형, 맥락의 편집 원칙으로 신뢰받는 뉴스를 전합니다.

카테고리

  • AI 모델·연구
  • AI 서비스·툴
  • 반도체·인프라
  • 빅테크·기업
  • 산업 적용
  • 스타트업·투자
  • 정책·윤리

태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 멀티에이전트 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

최근 뉴스

엔비디아 미국 본사 건물

엔비디아·37개 창립 파트너, Open Secure AI Alliance 출범

2026년 07월 28일 19시 45분
미국 연방 로비가 이뤄지는 워싱턴 의사당 공식 사진

미 주요 기술·AI 기업·단체 11곳, 상반기 로비 4,180만달러

2026년 07월 28일 18시 46분
  • 소개
  • 문의
  • 광고문의
  • 개인정보처리방침
  • 이용약관
  • 청소년보호정책
  • 정정·반론 보도 안내
  • 편집·윤리강령

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.

No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.