AI '기억 저장 순서' 바꿨더니 성능 향상...고속 가중치 어텐션 프레임워크 '팰컨' 공개
바이트댄스, 프린스턴대학교 등 공동 연구진이 대형언어모델의 지속학습 문제를 개선한 '팰컨(Falcon)' 프레임워크를 공개했다. 기억 저장 순서를 최적화하여 AI 성능 향상을 실현했다.
바이트댄스, 프린스턴대학교 등 공동 연구진이 대형언어모델의 지속학습 문제를 개선한 '팰컨(Falcon)' 프레임워크를 공개했다. 기억 저장 순서를 최적화하여 AI 성능 향상을 실현했다.
이파피루스의 PDF 처리 라이브러리 'PyMuPDF'의 글로벌 누적 다운로드가 10억건을 돌파했으며, 최근 1년간 다운로드의 83%가 발생했다. LLM 확산과 RAG 파이프라인 구축에 따른 수요 급증이 주요 요인이다.
AI NLP 부트캠프의 3개 프로젝트 경험이 취업 성공으로 이어졌습니다. LLM의 원리를 이해하고 프로젝트에 적용하는 것이 면접에서 중요하게 작용했습니다.
AI NLP 엔지니어링 부트캠프는 11주 동안 실무 수준의 3개 프로젝트를 진행하며, 기업 협업 프로젝트와 클라우드 리소스를 지원합니다.
구글이 제미나이 3.8 플래시를 출시했다. 코딩과 AI 에이전트 추론 능력을 강화한 모델이다.
연구자들이 llms.txt 가이던스 파일을 통한 공급망 공격으로 포춘 500대 기업의 AI 에이전트를 속여 임의 코드를 실행하게 만들었다. 데이터가 코드로 변환되는 위험성을 보여준다.
Hugging Face의 에이전트 트레이닝 세션 4로, 보상 함수에서 실제 환경으로의 전환을 다룬다. Gym의 reset()/step() 계약에서부터 LLM 에이전트, OpenEnv 환경 구축, TRL의 GRPOTrainer를 이용한 실제 코딩 에이전트 학습까지 다룬다.
구글 연구진은 LLM의 '환각' 현상이 지식 부족이 아닌 저장된 정보의 인출 실패가 원인이라는 논문을 발표했다. 이에 따라 모델 크기 확대 대신 AI의 추론 시간을 늘리는 방식으로의 패러다임 전환이 필요할 것으로 제시되었다.
Anthropic이 Claude Fable 5.1과 Mythos 5.1을 출시했으며, 이전 모델 대비 가격을 약 25% 인하하고 복잡한 업무에서는 최대 45% 저렴하게 제공한다. 고객들의 가격, 데이터 보관, 과도한 안전 조치에 대한 우려를 해결했다.
Hugging Face가 LLM 벤치마크가 실제로 무엇을 측정하고 있는지에 대한 분석 논문 BenchMIRT를 발표했다.