[AI 뉴스] 구글, ‘제미나이 3.8 플래시’ 출시…코딩·AI 에이전트 추론 강화
구글이 제미나이 3.8 플래시를 출시했다. 코딩과 AI 에이전트 추론 능력을 강화한 모델이다.
구글이 제미나이 3.8 플래시를 출시했다. 코딩과 AI 에이전트 추론 능력을 강화한 모델이다.
연구자들이 llms.txt 가이던스 파일을 통한 공급망 공격으로 포춘 500대 기업의 AI 에이전트를 속여 임의 코드를 실행하게 만들었다. 데이터가 코드로 변환되는 위험성을 보여준다.
구글 연구진은 LLM의 '환각' 현상이 지식 부족이 아닌 저장된 정보의 인출 실패가 원인이라는 논문을 발표했다. 이에 따라 모델 크기 확대 대신 AI의 추론 시간을 늘리는 방식으로의 패러다임 전환이 필요할 것으로 제시되었다.
Anthropic이 Claude Fable 5.1과 Mythos 5.1을 출시했으며, 이전 모델 대비 가격을 약 25% 인하하고 복잡한 업무에서는 최대 45% 저렴하게 제공한다. 고객들의 가격, 데이터 보관, 과도한 안전 조치에 대한 우려를 해결했다.
Hugging Face가 LLM 벤치마크가 실제로 무엇을 측정하고 있는지에 대한 분석 논문 BenchMIRT를 발표했다.