OpenAI 안전 담당 직원 사임, 증가하는 AI 위험을 기업 문화가 관리할 수 없다고 경고
OpenAI의 안전 담당 직원 David Robinson이 사임하며 회사 문화로는 증가하는 AI 위험을 관리할 수 없다고 말하고 더 강력한 외부 감독을 촉구했다.
인공지능의 최신 업데이트 및 스토리
OpenAI의 안전 담당 직원 David Robinson이 사임하며 회사 문화로는 증가하는 AI 위험을 관리할 수 없다고 말하고 더 강력한 외부 감독을 촉구했다.
Circuit Breaker Labs는 언어와 문화가 다른 시뮬레이션 사용자를 활용해 AI를 테스트하며, 정신건강 및 청소년용 앱의 심리적 안전 위험을 겨냥하고 있다.
TechCrunch의 정리는 AI 에이전트가 문자 메시지를 이용해 캘린더, 여행, 가족 업무, 이메일 및 기타 현실 세계의 작업 흐름을 관리하는 방식을 보여준다.
PewDiePie는 Ajax가 홈 PC용 검열되지 않은 AI 모델이라고 말하며, 모델 증류를 이유로 OpenAI가 자신을 두 차례 차단했다고 주장했다. 로컬 AI와 집행 문제가 주목받고 있다.
AI 에이전트와 인간 사용자의 토큰 사용량에 5배의 격차가 있다는 보고는 증가하는 추론 비용을 부각하지만, 이를 뒷받침하는 데이터는 여전히 공개되지 않았다.
보고된 Argo-Bench 결과에 따르면 선두 AI 에이전트가 210개 작업 중 34.8%를 해결했으며, 이는 자율 시스템의 해결되지 않은 신뢰성 한계를 보여준다.
Apple이 Meta Muse와 관련된 불만 이후 Mac의 데이터 제어를 강화할 준비를 하고 있는 것으로 알려졌으며, 이는 AI 에이전트가 데스크톱 앱에 접근하는 방식을 바꿀 수 있습니다.
LEGO-Anything은 코딩 에이전트가 사진에서 편집 가능한 3D 장면을 만들 수 있음을 보여주지만, LEGO-Bench는 정확도와 자기평가에 큰 공백이 있음을 드러낸다.
전직 AlphaGo 연구자 Thore Graepel은 LLM에 단순히 더 긴 사고 사슬이 아니라 감사 가능한 신념 상태와 탐색이 필요하다고 주장한다.
Clay CEO Kareem Amin은 AI가 잠재고객 조사, 데이터, 아웃리치를 자동화된 성장 시스템으로 전환하는 GTM 엔지니어링 직무를 어떻게 만들어 내고 있는지 설명할 예정입니다.
WP Intelligence의 목록은 오픈 웨이트 AI 모델과 미·중 경쟁에서 커지는 역할에 관한 인텔리전스 카운슬 보고서를 소개한다.
Nvidia의 압박으로 투자 심리가 약화되면서 Cerebras 주가가 20% 하락해 IPO 이후 최저치에 도달한 것으로 알려졌다. 이는 AI 칩 도전자들이 직면한 위험을 보여준다.