• AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
STORIUM
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
STORIUM
No Result
View All Result

같은 모델·도구로 4가지 에이전트를 비교한 저널리즘 실험, 아키텍처가 정확도와 시간에 미친 영향

유지율 리포터 작성: 유지율 리포터
2026년 07월 20일 20시 00분
Reading Time: 2 mins read
A A
Home AI 모델·연구
Share on FacebookShare on Twitter

언론 작업을 자동으로 수행하는 인공지능 에이전트가 늘어나는 가운데, 아키텍처 자체가 결과를 얼마나 바꾸는지는 충분히 검증되지 않았다. 텍사스테크대 연구진의 이 arXiv 프리프린트는 같은 언어모델과 동일한 도구를 유지한 채, 단일형 Claude, 단계형 LangChain, 협업형 CrewAI, 반복형 AutoGPT를 200회의 통제 실험으로 비교했다. 과제는 난도가 다른 저널리즘 작업 50개였고, 설계상 차이는 오직 구조에만 두었다.

결과는 작업시간과 계산 전략에서 뚜렷한 차이를 보였다. 작업 지속시간은 F(3, 196)=24.54, p<.001, eta-squared=.27로 유의했고, 계산 전략은 F(3, 196)=305.63, p<.001, eta-squared=.82로 더 크게 갈렸다. 이 수치는 아키텍처가 처리 행동 분산의 82%를 설명했다는 뜻이다. 반면 정확도에서는 전체적으로 유의한 구조 효과가 나오지 않았고, one-way ANOVA는 F(3, 196)=2.43, p=.066, eta-squared=.04였다.

네 가지 AI 에이전트 아키텍처의 통제 실험 설계
Figure 1. Figure 1: Experimental design overview. Four agent architectures, all running the same base model with identical tools and an identical 50-task battery, completed 200 controlled trials evaluated through three measurement lenses corresponding to the research questions. 출처: arXiv:2607.10736

평균 정확도는 CrewAI가 84.7%로 가장 높았고, 50개 과제 중 35개에서 완전 점수를 받았다. LangChain은 76.9%와 완전 점수 29개, Claude는 75.5%와 28개, AutoGPT는 70.6%와 27개였다. 시간 비용은 평균 작업시간에서 드러났는데, LangChain 30.01초, AutoGPT 34.95초, Claude 35.51초, CrewAI 60.49초였다. 최대값은 각각 119.29초, 129.45초, 99.19초, 130.04초로 보고됐다.

세부 분석에서는 단일형 Claude의 소스 걸러내기 방식이 눈에 띄었다. 1차 탐색에서 검토한 15개 소스가 넓게 남았지만, 최종 인용은 4.2개로 줄었고 소스 거부율은 71.7%였다. 중간 단계에서는 상담한 소스의 54.7%가 전체 내용 추출까지 이어지지 않았고, 평가에서 선택으로 넘어가는 구간에서도 38.2%가 탈락했다. 이런 흐름은 인간 편집자가 하던 게이트키핑과의 평행을 시사하지만, 알고리즘은 더 일관적이면서 덜 미묘한 결정을 내린다고 정리됐다.

투명성에서는 구조별 차이가 또렷했다. Claude만 상담 추적이 가능해 전체 과정을 끝까지 볼 수 있었고, 프레임워크 기반의 LangChain·CrewAI·AutoGPT는 내부 소스 검색을 감춰 최종 인용 수만 남겼다. 인용된 출처 수는 Claude 4.2개, AutoGPT 3.5개, LangChain 3.0개, CrewAI 2.5개였고, 고유 도메인은 각각 139, 117, 104, 94개였다. 과제 난도별로는 1단계에서 모두 85%를 넘겼지만, 탐사형 5단계에서는 CrewAI가 78%로 높았고 AutoGPT는 64%로 가장 낮았다.

아키텍처 평균 정확도/완전 점수 평균 작업시간(초)/최대
CrewAI 84.7% / 35/50 60.49 / 130.04
LangChain 76.9% / 29/50 30.01 / 119.29
Claude 75.5% / 28/50 35.51 / 99.19
AutoGPT 70.6% / 27/50 34.95 / 129.45

자료: STORIUM 정리

이 연구는 저널리즘 자동화의 성과를 하나의 AI 능력치로 묶지 말고, 구조별로 나눠 봐야 한다는 점을 실험적으로 보여준다. 동시에 명시적 불확실성 표시는 모든 구조에서 0~8%에 그쳤고, 인간이 맡는 인터뷰나 비밀취재 같은 업무는 범위에 포함되지 않았다. 따라서 이 결과는 통제된 정보수집·요약 과제에 대한 내부 평가로 읽는 것이 적절하다.

저작권자 © STORIUM 무단전재 및 재배포 금지

유지율 리포터

유지율 리포터

안녕하세요, 유지율 리포터입니다. arXiv와 학회에서 쏟아지는 AI 연구를 살펴, 논문 속 성과를 과장 없이 우리말로 풀어 드립니다. 사실관계는 발행 전 편집인이 함께 확인합니다.

관련 기사

서울 국립중앙도서관 사서연수관과 국제회의장 자료사진
산업 적용

국립중앙도서관, DCMI 2026 개최…AI 메타데이터 논의

2026년 07월 29일 12시 43분
미 국토안보부 청사에서 회의 중인 앤드루 가바리노 하원 국토안보위원장
정책·윤리

미 하원, 에어비앤비·커서의 중국 AI 모델 사용 조사 착수

2026년 07월 29일 12시 24분
LG유플러스 통합관제센터 앞에서 정보보호백서 2025를 소개하는 정보보안센터 임직원
산업 적용

LG유플러스, 2028년 에이전틱 SOC 전환 추진…7000억원은 정보보호 전반

2026년 07월 29일 12시 06분
엔비디아 품질 인증을 받은 LG전자 600kW급 냉각수 분배 장치 CDU의 외관과 내부
반도체·인프라

LG전자, 600kW급 CDU로 국내 첫 엔비디아 품질 인증

2026년 07월 29일 11시 44분
Next Post
Graduate School of Comprehensive Human Sciences, University of Tsukuba 공식 로고

음성 명령으로 레트로 슈팅 게임 설정을 고쳐 쓰는 AI 편집 시스템, 21명 사용자 연구

답글 남기기 응답 취소

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다

  • 인기 급상승
  • 최신
Close-up of a GeForce RTX graphics card on a desk, showcasing its design and technology.

엔비디아 RTX 스파크 가격, 최소 2000달러 전망…윈도 노트북 ‘M1 모먼트’ 걸림돌

2026년 06월 02일 11시 19분
A 3D rendering of a neural network with abstract neuron connections in soft colors.

퍼플렉시티, 로컬·클라우드 AI를 자동 판단하는 하이브리드 추론 시스템 발표

2026년 06월 04일 08시 53분
Contemporary building with a glass facade and geometric patterns, low angle view.

앤트로픽·네이버 개발자 밋업 개최…서울 오피스 개소 앞두고 본사 임원 참석

2026년 06월 06일 21시 12분
책상에서 법률 문서에 서명하는 모습

클로드 ‘드리밍’ 기능 공개…앤트로픽, 법률·의료 AI 성능 대폭 향상

2026년 05월 30일 21시 11분
Close-up of a wooden gavel on a judge's desk, symbolizing justice.

AI 생성 성인 콘텐츠 유료 판매 운영자들, 법원서 잇달아 징역형

2026년 06월 05일 22시 40분
서울 국립중앙도서관 사서연수관과 국제회의장 자료사진

국립중앙도서관, DCMI 2026 개최…AI 메타데이터 논의

2026년 07월 29일 12시 43분
미 국토안보부 청사에서 회의 중인 앤드루 가바리노 하원 국토안보위원장

미 하원, 에어비앤비·커서의 중국 AI 모델 사용 조사 착수

2026년 07월 29일 12시 24분
LG유플러스 통합관제센터 앞에서 정보보호백서 2025를 소개하는 정보보안센터 임직원

LG유플러스, 2028년 에이전틱 SOC 전환 추진…7000억원은 정보보호 전반

2026년 07월 29일 12시 06분
엔비디아 품질 인증을 받은 LG전자 600kW급 냉각수 분배 장치 CDU의 외관과 내부

LG전자, 600kW급 CDU로 국내 첫 엔비디아 품질 인증

2026년 07월 29일 11시 44분
미국 오리건 AWS 데이터센터 단지 자료사진

AWS 주간 업데이트…Claude Opus 5와 장기 실행 Lambda 추가

2026년 07월 29일 11시 34분

검색

No Result
View All Result

인기 태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 멀티에이전트 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

카테고리

  • AI 모델·연구 (1,484)
  • AI 서비스·툴 (828)
  • 반도체·인프라 (538)
  • 빅테크·기업 (567)
  • 산업 적용 (419)
  • 스타트업·투자 (251)
  • 정책·윤리 (458)

STORIUM은 트렌드와 인사이트를 전하는 종합 뉴스 매체입니다. 정확성, 균형, 맥락의 편집 원칙으로 신뢰받는 뉴스를 전합니다.

카테고리

  • AI 모델·연구
  • AI 서비스·툴
  • 반도체·인프라
  • 빅테크·기업
  • 산업 적용
  • 스타트업·투자
  • 정책·윤리

태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 멀티에이전트 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

최근 뉴스

서울 국립중앙도서관 사서연수관과 국제회의장 자료사진

국립중앙도서관, DCMI 2026 개최…AI 메타데이터 논의

2026년 07월 29일 12시 43분
미 국토안보부 청사에서 회의 중인 앤드루 가바리노 하원 국토안보위원장

미 하원, 에어비앤비·커서의 중국 AI 모델 사용 조사 착수

2026년 07월 29일 12시 24분
  • 소개
  • 문의
  • 광고문의
  • 개인정보처리방침
  • 이용약관
  • 청소년보호정책
  • 정정·반론 보도 안내
  • 편집·윤리강령

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.

No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.