• AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
STORIUM
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의
No Result
View All Result
STORIUM
No Result
View All Result

차량 급끼어들기 장면을 읽고 감정 톤까지 고르는 비전-언어 보조체계, 108명 설문과 주행 영상으로 검증

유지율 리포터 작성: 유지율 리포터
2026년 07월 21일 21시 30분
Reading Time: 3 mins read
A A
Home AI 모델·연구
Share on FacebookShare on Twitter

위험운전 장면을 알아채고 그 상황에 맞는 감정적 응답까지 건네는 비전-언어 보조체계가 제안됐다. arXiv 프리프린트인 이 논문은 Keep Yelling Assistant(KYA)를 통해, 급끼어들기 같은 고위험 조작을 실시간으로 잡아내고 운전자 선호에 맞는 말투의 반응을 생성하는 흐름을 설계했다. 핵심은 감지와 반응을 분리하되 서로 연결하는 데 있다.

구조는 두 모듈로 나뉜다. 시각 모듈은 YOLOv8 계열을 써서 주변 차량과 위험 행동을 찾고, 상대 거리·속도·도달 예상 시간 같은 지표를 추출해 정규화한 뒤 구조화된 행동 로그를 만든다. 언어 모듈은 이 로그를 입력으로 받아 neutral, humorous, analytical 같은 감정 톤 설정에 따라 반응 문장을 생성하며, ChatGPT-4o, Claude 3, Gemini 2.5, Copilot이 여기에 쓰였다.

차량 급끼어들기 장면을 읽고 감정 톤까지 고르는 비전-언어 보조체계, 108명 설문과 주행 영상으로 검증 논문의 Figure 1
Figure 1. Figure 1: Overview of the KYA Pipeline Vision Model The vision module serves as the first stage in the KYA pipeline, transforming raw dashcam footage into structured spatiotemporal representations that can be processed by the downstream language model. It consists of two core components: vehicle detection and driving behavior recognition. 출처: arXiv:2607.16181

검증은 실제 대시캠 영상과 사용자 조사로 진행됐다. 연구진은 급끼어들기 관련 검색어로 고른 20개 영상을 사용했고, 총 5,019프레임과 그중 1,189개의 고위험 프레임을 확보했다고 적었다. 참가자 108명(남성 53명, 여성 55명)의 선호를 모아 언어 반응 스타일을 비교했으며, 모델 평가는 감정적 정합성을 기준으로 이뤄졌다.

시각 검출 성능에서는 YOLOv8l이 가장 높은 재현율 0.869, F1 0.921, mAP@0.5 0.998을 기록했고 ID switch는 1로 가장 낮았다. 평균 IoU도 0.988로 제시됐다. 반면 YOLOv8n과 YOLOv8s는 재현율 0.737과 0.762, MOTA 0.715와 0.745로 더 낮았지만, 정밀도는 각각 0.979와 0.9822로 높았고 ID switch도 3과 2에 그쳐 실시간 배치 가능성을 시사했다.

구성 요소 원문 수치/설정 근거 위치
데이터 규모 20개 영상, 5,019프레임, 1,189개 고위험 프레임 p.7, p.10
시각 모듈 성능 최상 조합 YOLOv8l: recall 0.869, F1 0.921, mAP@0.5 0.998, ID switches 1, Avg. IoU 0.988 p.8~p.9, Table 1
경량 모델 성능 YOLOv8n: precision 0.979, recall 0.737, F1 0.841, mAP@0.5 0.985, ID switches 3, MOTA 0.715 / YOLOv8s: precision 0.982, recall 0.762, F1 0.858, mAP@0.5 0.991, ID switches 1, MOTA 0.745 p.9, Table 1
사용자 평가 108명(남성 53명, 여성 55명), 5점 리커트 포함 p.7~p.8
최고 감정 정합성 점수 YOLOv8s + ChatGPT-4o, 4.29/5.00 p.2

자료: STORIUM 정리

감정 반응 평가에서는 네 개 언어모델이 모두 좋은 평을 받았고, 개인 성향에 따라 선호가 달라졌다. 그중 YOLOv8s와 ChatGPT-4o 조합이 5점 만점에 4.29로 가장 높은 점수를 얻었다. 본문은 또 차선 급변경, 추돌 유발, 과속 같은 위험운전이 인간 운전자에게 분노나 불안 같은 강한 정서를 일으킨다고 설명하며, 단순 경고를 넘어 감정까지 고려한 차량 내 AI를 목표로 삼고 있다.

저작권자 © STORIUM 무단전재 및 재배포 금지

Tags: 감정 반응대시캠비전-언어모델위험운전자율주행
유지율 리포터

유지율 리포터

안녕하세요, 유지율 리포터입니다. arXiv와 학회에서 쏟아지는 AI 연구를 살펴, 논문 속 성과를 과장 없이 우리말로 풀어 드립니다. 사실관계는 발행 전 편집인이 함께 확인합니다.

관련 기사

베이징대학교 캠퍼스 전경
AI 모델·연구

공사구간 주행에서 도로 객체를 먼저 구조화해 궤적을 다듬는 WorkDrive의 검증

2026년 07월 28일 09시 33분
Harbin Institute of Technology (Shenzhen) 공식 로고 — 텍스트 유도 의료 영상 분할용 백본 전이형 계층 어댑터 BTHA 제안 연구진 소속기관
AI 모델·연구

BTHA, 의료 영상 분할의 텍스트 가이드를 백본 간 재사용

2026년 07월 14일 10시 55분
Texas A&M University 공식 로고 — 희귀 주행 장면을 다중 시점 데이터로 바꾸는 오픈소스 생성 엔진 OpenLongTail 연구진 소속기관
AI 모델·연구

OpenLongTail, 희귀 주행 단안 영상을 다중 시점 학습 데이터로 변환

2026년 07월 14일 10시 52분
도심을 운행하는 로보택시와 안전 규제
정책·윤리

NHTSA, 자율주행 업체에 비상현장 대응책 이달 말까지 요구했다

2026년 07월 13일 09시 36분
Next Post
University of North Carolina at Chapel Hill 공식 로고

손과 휴머노이드를 한 몸에 담은 27자유도 재구성 로봇, 실제 조작·보행·장기 과제로 검증

답글 남기기 응답 취소

이메일 주소는 공개되지 않습니다. 필수 필드는 *로 표시됩니다

  • 인기 급상승
  • 최신
Close-up of a GeForce RTX graphics card on a desk, showcasing its design and technology.

엔비디아 RTX 스파크 가격, 최소 2000달러 전망…윈도 노트북 ‘M1 모먼트’ 걸림돌

2026년 06월 02일 11시 19분
A 3D rendering of a neural network with abstract neuron connections in soft colors.

퍼플렉시티, 로컬·클라우드 AI를 자동 판단하는 하이브리드 추론 시스템 발표

2026년 06월 04일 08시 53분
Contemporary building with a glass facade and geometric patterns, low angle view.

앤트로픽·네이버 개발자 밋업 개최…서울 오피스 개소 앞두고 본사 임원 참석

2026년 06월 06일 21시 12분
책상에서 법률 문서에 서명하는 모습

클로드 ‘드리밍’ 기능 공개…앤트로픽, 법률·의료 AI 성능 대폭 향상

2026년 05월 30일 21시 11분
Close-up of a wooden gavel on a judge's desk, symbolizing justice.

AI 생성 성인 콘텐츠 유료 판매 운영자들, 법원서 잇달아 징역형

2026년 06월 05일 22시 40분
엔비디아 미국 본사 건물

엔비디아·37개 창립 파트너, Open Secure AI Alliance 출범

2026년 07월 28일 19시 45분
미국 연방 로비가 이뤄지는 워싱턴 의사당 공식 사진

미 주요 기술·AI 기업·단체 11곳, 상반기 로비 4,180만달러

2026년 07월 28일 18시 46분
다리오 아모데이 앤트로픽 CEO의 2023년 TechCrunch 행사 자료사진

Claude 공개 공유 대화 일부 검색 노출…비공개 자동 유출과는 달라

2026년 07월 28일 17시 53분
일리야 수츠케버가 참석한 2014년 스탠퍼드 대담 자료사진

SSI, 엔비디아 Vera Rubin 도입…연산 자원 10배 확대

2026년 07월 28일 16시 20분
중국 항저우 앤트그룹 A Space 건물

앤트그룹 Ling-3.0-Flash 공개…1,240억개 중 51억개 활성

2026년 07월 28일 15시 07분

검색

No Result
View All Result

인기 태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 멀티에이전트 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

카테고리

  • AI 모델·연구 (1,482)
  • AI 서비스·툴 (826)
  • 반도체·인프라 (537)
  • 빅테크·기업 (566)
  • 산업 적용 (415)
  • 스타트업·투자 (251)
  • 정책·윤리 (455)

STORIUM은 트렌드와 인사이트를 전하는 종합 뉴스 매체입니다. 정확성, 균형, 맥락의 편집 원칙으로 신뢰받는 뉴스를 전합니다.

카테고리

  • AI 모델·연구
  • AI 서비스·툴
  • 반도체·인프라
  • 빅테크·기업
  • 산업 적용
  • 스타트업·투자
  • 정책·윤리

태그

AI규제 AI반도체 AI보안 AI안전 AI에이전트 AI연구 AI인프라 AI정책 Anthropic arXiv AWS ChatGPT Claude Gemini HBM IPO LLM MCP NVIDIA OpenAI RAG SK하이닉스 강화학습 구글 데이터센터 마이크로소프트 멀티모달 멀티에이전트 메타 반도체 벤치마크 사이버보안 삼성전자 생성AI 생성형AI 스타트업 앤트로픽 에이전트 에이전틱AI 엔비디아 오픈AI 오픈소스 의료AI 자율주행 피지컬AI

최근 뉴스

엔비디아 미국 본사 건물

엔비디아·37개 창립 파트너, Open Secure AI Alliance 출범

2026년 07월 28일 19시 45분
미국 연방 로비가 이뤄지는 워싱턴 의사당 공식 사진

미 주요 기술·AI 기업·단체 11곳, 상반기 로비 4,180만달러

2026년 07월 28일 18시 46분
  • 소개
  • 문의
  • 광고문의
  • 개인정보처리방침
  • 이용약관
  • 청소년보호정책
  • 정정·반론 보도 안내
  • 편집·윤리강령

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.

No Result
View All Result
  • AI 모델·연구
  • 빅테크·기업
  • 반도체·인프라
  • 산업 적용
  • AI 서비스·툴
  • 정책·윤리
  • 스타트업·투자
  • 문의

주소: 경기 고양시 덕양구 꽃마을로 66, 한일미디어타워 15층
상호: 스토리움 |  사업자등록번호: 579-27-02025 |  대표자: 이국환
발행·편집인: 이국환 |  청소년보호책임자: 이국환 |  발행일자: 2025.01.01
스토리움의 모든 콘텐츠는 저작권법의 보호를 받는 바, 무단 전재·복사·배포 등은 법적 제재를 받을 수 있습니다.
© 2026 STORIUM. All Rights Reserved.