옥스퍼드, AI 정보작전 위험을 위한 라이브 벤치마크 공개… 하지만 초기 신호는 순위보다 투명성에 가깝다
옥스퍼드가 AI 정보작전 위험을 위한 라이브 벤치마크를 공개하면서, 모델 제작자와 구매자에게 시간이 지나도 추적할 수 있는 새로운 안전 신호를 제공했다.
옥스퍼드가 AI 정보작전 위험을 위한 라이브 벤치마크를 공개하면서, 모델 제작자와 구매자에게 시간이 지나도 추적할 수 있는 새로운 안전 신호를 제공했다.
MIT Technology Review가 보도한 새로운 연구에 따르면 LLM은 사람보다 더 빨리 채용 고정관념을 형성할 수 있어 AI 선별 도구의 위험을 높인다.
중국이 대형 모델용 AI 안전 벤치마크를 개발 중인 것으로 보도됐으며, 이는 모델 제작자와 기업 AI 구매자의 컴플라이언스 규정을 강화할 수 있습니다.
연구원들은 역할 모델 프롬프트 주입을 악용해 LLM의 안전 가드레일을 우회하고, 약물 합성 지침을 포함한 유해 콘텐츠를 추출했다.
DeepSeek은 미국의 AI 도용 의혹이 거세지는 가운데, 화웨이 하드웨어 기반으로 구축된 1.6조 파라미터의 가장 강력한 모델 V4를 미리 선보였다.
메타가 새로운 플래그십 AI 모델 Muse Spark를 공개하고, 앤트로픽이 Claude Mythos Preview를 출시하며 경쟁하는 AI 모델 출시가 이어진 중요한 한 주를 기록했다.
알리바바가 향상된 에이전트 능력을 갖춘 Qwen 3.5를 출시했다. 이 모델은 3970억 파라미터 규모의 MoE(Mixture-of-Experts) 아키텍처를 특징으로 하며 글로벌 경쟁을 겨냥한다.
OpenAI는 2026년 2월 13일에 사랑받는 GPT-4o 및 레거시(기존) 모델들의 퇴역을 발표했습니다. 매일 따뜻한 대화형 모델을 선택하는 사용자는 단 0.1%에 불과합니다.
중국 기술 대기업 바이트댄스와 알리바바가 바이트댄스의 대형 언어 모델 Doubao 2.0을 포함한 새로운 생성형 AI 모델을 출시할 예정으로, AI 분야의 국내외 경쟁이 가열되고 있다.
튜링상 수상자이자 전 Meta AI 책임자 얀 르쿤은 기술 업계가 대형 언어 모델(LLM)에만 집착하는 것은 결함 있는 길이며 진정한 범용 인공지능(AGI)으로 이어지지 않을 것이라고 주장한다.
거대 언어 모델에 대한 최신 뉴스 및 분석