OpenAI, 자동화된 AI 연구를 에이전트 전략의 중심에 두는 것으로 알려져
OpenAI의 노엄 브라운이 에이전트의 최우선 과제로 AI 연구 자동화를 꼽았다고 전해졌으며, 이는 빌더와 연구소에 큰 영향을 미칠 신호다.
AI 연구에 대한 최신 뉴스 및 분석
OpenAI의 노엄 브라운이 에이전트의 최우선 과제로 AI 연구 자동화를 꼽았다고 전해졌으며, 이는 빌더와 연구소에 큰 영향을 미칠 신호다.
OpenAI는 1만 개의 AI 에이전트가 88시간 만에 100만 달러짜리 수학 문제를 풀었다고 밝히며, 증명·검증·AI 연구에 대한 의문을 제기했다.
OpenAI는 코딩 에이전트가 AI 연구를 바꾸고 있다고 말하지만, 초기 증거는 규모, 측정, 독립적 검증에 대한 핵심 질문을 남겨 둔다.
새로운 연구는 AI 모델의 기반이 되는 수학을 재정식화하면 AI 하드웨어의 메모리 및 저장 장치 요구를 크게 줄일 수 있음을 보여준다.
Anthropic은 Claude Science를 공개했다. 이는 과학자들이 도구를 오가며 전환하지 않고도 계산 연구를 수행할 수 있는 통합 환경을 제공하는 AI 워크벤치다.
VentureBeat는 하이퍼네트워크가 추론 시점에 작업별 모델 어댑터를 생성하여, 미세 조정의 비용과 RAG의 컨텍스트 누출을 우회하는 방식을 살펴봅니다.
새로운 AI 기반 뇌-컴퓨터 인터페이스가 언어를 잃은 ALS 환자가 전일제 일자리를 유지할 수 있게 하면서, 의료 AI 분야의 중요한 이정표를 세웠다.
Anthropic은 숨겨진 제한 조치가 AI 연구를 저해할 수 있다는 비판 이후 Claude Fable 5의 보호 장치를 공개할 예정이다.
BBC는 케임브리지 연구진이 핵심 구성 요소를 인공지능이 전적으로 설계한 백신을 시험했다고 보도했다.
Google은 가설 생성, 계산적 발견, 문헌 인사이트, 과학 기술을 위한 과학용 Gemini 실험을 소개했다.
Adaption은 모델 학습과 정렬의 기반이 되는 연구 루프 일부를 자동화하는 것을 목표로 하는 AI 도구 AutoScientist를 소개했다.
Anthropic은 Claude의 내부 표현을 사람이 읽을 수 있는 텍스트로 변환하는 연구를 발표했다.
WIRED는 단 10분의 AI 사용도 사고와 문제 해결 성능에 부정적인 영향을 줄 수 있음을 시사하는 연구를 보도했다.
MIT 연구진은 일상적인 기기에서 프라이버시 보호 AI 훈련이 81% 빨라졌다고 보고했다.
Anthropic은 69개의 AI 에이전트가 참여한 1주일간의 내부 마켓플레이스를 운영했다. 더 뛰어난 모델일수록 일관되게 더 나은 결과를 협상해 냈고, 약한 모델을 쓰는 사용자들은 끝내 알아채지 못했다.
Meta는 AI 야망에 자원을 집중하기 위해 약 8,000명의 직원을 감축하는 한편, 초지능 연구 전담 랩을 출범하고 있다.
골드만삭스 연구진은 현재의 AI 시스템에 왜 근본적인 '월드 모델'이 결여되어 있는지, 그리고 이 격차를 해결하는 것이 AI 산업 전체를 어떻게 재편할 수 있는지 설명한다.
새로운 벤치마크는 최고 수준의 AI 모델조차 복잡한 차트를 분석할 때 정확도가 약 50% 떨어지며, 시각적 추론의 핵심 한계를 드러낸다고 밝혔다.
비영리 AI 조직인 METR의 차트는 대형 AI 시스템의 빠른 발전을 추적하면서 업계 전반의 집착 대상이 되었다.
한 AI 시스템이 과학 연구의 전 과정을 자동화하고 동료 심사를 통과하면서, 과학계에서 무결성과 준비 상태에 대한 논쟁이 촉발되었다.