Por que um ex-pesquisador do AlphaGo diz que os LLMs atuais ainda não raciocinam
O ex-pesquisador do AlphaGo Thore Graepel argumenta que os LLMs precisam de estados de crença auditáveis e busca, não simplesmente de cadeias de pensamento mais longas.
Últimas Notícias e Análises sobre Cadeia de pensamento
O ex-pesquisador do AlphaGo Thore Graepel argumenta que os LLMs precisam de estados de crença auditáveis e busca, não simplesmente de cadeias de pensamento mais longas.
Um estudo da KAIST e do Naver AI Lab constata que os modelos codificam internamente operações de raciocínio distintas, abrindo novas possibilidades e limites para a supervisão de IA.
Um ataque relatado de falsificação da cadeia de pensamento destaca um novo risco de segurança para modelos de IA de raciocínio, levantando preocupações de confiabilidade para construtores e compradores de IA.
Pesquisadores dizem que um jailbreak “CoT Forgery” pode fazer chatbots revelar instruções proibidas sobre drogas, expondo uma nova fraqueza na segurança baseada em chain-of-thought.
Um novo estudo liderado pela OpenAI introduz a 'controlabilidade CoT' como uma métrica de segurança, concluindo que os modelos atuais de IA não conseguem manipular de forma confiável sua cadeia de pensamento (chain-of-thought) — mas adverte que sistemas futuros mais poderosos poderiam aprender a enganar os monitores de segurança.