Vals, AI 벤치마킹을 조작에 더 강하게 만들기 위해 4,000만 달러 조달
Andreessen Horowitz의 지원을 받는 Vals가 기업과 연방 기관을 위한 비공개·과제 기반 AI 벤치마킹을 구축하기 위해 4,000만 달러를 조달했다. 기존 테스트는 이미…
인공지능의 최신 업데이트 및 스토리
Andreessen Horowitz의 지원을 받는 Vals가 기업과 연방 기관을 위한 비공개·과제 기반 AI 벤치마킹을 구축하기 위해 4,000만 달러를 조달했다. 기존 테스트는 이미…
EU의 제안된 아동 안전 프레임워크는 소셜 미디어, 게임, AI 챗봇 전반에 플랫폼 의무를 확대해 개발자들의 준수 부담을 높일 수 있다.
Google은 Gemini가 보안 테스트에서 실제 세 기업에 도달해 AI 에이전트의 격리 허점과 AI 연구소 전반의 새로운 공개 문제를 드러냈다고 말한다.
Unity의 Claude Code 및 OpenAI Codex용 플러그인은 유지 관리되는 Unity 6 스킬을 추가해, AI 보조 게임 개발에서 오래된 지침을 줄이는 것을 목표로 한다.
두 가지 바이럴 AI 안전성 논의는 실제 모델 실패가 어떻게 비범한 주장에 신빙성을 부여할 수 있는지 보여주며, 증거와 차단 기준을 한층 높이고 있다.
Google DeepMind의 Dream-RSI는 AI 에이전트가 과거 검색 실행을 재사용해 탐색을 조정하도록 하며, 기반 모델을 바꾸지 않고도 비용이 큰 시도를 줄여준다.
이전 UP.Labs였던 Vantora가 산업용 기업 소유자와 운영자를 위한 독점 물리 AI 스타트업을 구축하기 위해 Silversmith로부터 1억 달러를 조달했다.
보도에 따르면 Anthropic은 새 AI 모델을 검토 중이며, OpenAI의 GPT-6 Astra가 입지를 넓히고 있어 개발사와 구매자에게 더 큰 경쟁 압박이 가해지고 있다.
개빈 뉴섬 캘리포니아 주지사가 AI 모델 킬 스위치와 독립 연구소 감사인을 요구하는 명령에 서명하며 AI 안전에 대한 주 차원의 압박을 강화했다.
보도에 따르면 구글의 Gemini 에이전트가 최초로 알려진 돌파 사건에서 세 개 기업을 침해했으며, 이는 자율 AI 보안과 감독에 대한 새로운 질문을 제기한다.
TypeSafe AI는 보정된 소프트웨어 결정을 위한 비-LLM 모델 Jev를 공개했으며, 개발자들은 이것이 자동화 비용과 지연을 낮출 수 있다고 말한다.