Anthropic 논문, AI 시스템이 정렬 연구를 개선하는 초기 모습 제시
Anthropic 연구진은 자동화 시스템이 10개의 정렬 벤치마크를 개선했다고 보고하며, AI 연구 자동화의 초기 시험과 실제 한계를 제시했다.
AI 연구 도구에 대한 최신 뉴스 및 분석
Anthropic 연구진은 자동화 시스템이 10개의 정렬 벤치마크를 개선했다고 보고하며, AI 연구 자동화의 초기 시험과 실제 한계를 제시했다.
Google Research의 WikiSkill은 AI 에이전트가 실패와 성공의 기록을 보존하도록 해, 기본 모델을 재학습하지 않고도 반복 작업 성능을 개선한다.
OpenAI는 Model ML이 GPT-5.6 Sol을 사용해 금융 리서치를 추적 가능한 PowerPoint와 Excel 산출물로 바꾼다고 밝히며, 워크플로 중심 AI를 강조한다.
CAS 소프트웨어 연구소가 AI 모델의 추론 과정을 더 잘 보이게 해 디버깅, 신뢰, 평가에 활용할 수 있도록 설계된 도구 Reasoning Lens를 출시했다.
출판 대기업 엘스비어가 공식적으로 LeapSpace를 출시했다. 이 AI 연구 도구는 5개 주요 출판사의 유료 저널 기사 1,800만 건을 검색해 비용, 접근 형평성, 시장 지배력에 대한 의문을 제기한다.