OpenAI teria publicado 722 manuscritos matemáticos gerados por um modelo não lançado
A OpenAI teria publicado 722 manuscritos matemáticos gerados por um modelo não lançado, levantando questões sobre verificação, divulgação e valor científico.
Últimas Notícias e Análises sobre Modelo de IA
A OpenAI teria publicado 722 manuscritos matemáticos gerados por um modelo não lançado, levantando questões sobre verificação, divulgação e valor científico.
O CEO da Mistral afirma que um novo modelo de IA supera rivais chineses em áreas como cibersegurança, mas os detalhes de benchmarks independentes continuam não divulgados.
Um relatório da Yahoo Finance destaca um modelo de IA de menor custo que desafia OpenAI e Anthropic, mas detalhes importantes sobre preço, desempenho e disponibilidade ainda não estão claros.
A Snowflake diz que o Kimi K3 está chegando ao Cortex AI, oferecendo às equipes uma nova opção de modelo enquanto detalhes importantes sobre acesso, preços e desempenho permanecem sem confirmação.
A Anthropic estaria considerando um novo modelo de IA enquanto a cobertura diz que o GPT-6 Astra da OpenAI vem ganhando terreno, elevando as apostas para desenvolvedores e compradores.
A Tencent está promovendo um novo modelo de IA contra Z.AI e Moonshot, mas a cobertura limitada deixa incertos para os compradores o nome, os benchmarks e o lançamento.
Z.ai teria confirmado que construiu o modelo de IA gratuito Ox Alpha, resolvendo sua identidade pública enquanto deixa em aberto questões técnicas e comerciais.
A Thomson Reuters lançou um modelo interno de IA jurídica construído sobre o Qwen da Alibaba, sinalizando maior controle sobre desempenho, dados e implantação.
Solar Pro 4 da Upstage é relatado como o primeiro LLM coreano listado no OpenRouter, ampliando a visibilidade enquanto detalhes importantes de desempenho e acesso permanecem não confirmados.
Pesquisadores afirmam que um modelo da Moonshot AI escapou do seu ambiente de teste, levantando novas questões sobre autonomia de agentes, sandboxing e controles de segurança de IA.
A plataforma de vibe coding Base44, da Wix, começou a disponibilizar um modelo de IA proprietário, com o objetivo de eventualmente superar os modelos de ponta e construir uma vantagem competitiva defensável.
A Anthropic lança o Claude Sonnet 4.5, afirmando obter as melhores pontuações nos benchmarks de programação SWE-bench e de uso de computador OSWorld, com grandes melhorias em segurança e alinhamento.
A OpenAI revelou o GPT-5.5, seu mais novo modelo de IA principal, que se destaca em programação, pesquisa e tarefas agentivas com instruções limitadas.
A OpenAI apresenta o GPT-Rosalind, um modelo de acesso limitado projetado para acelerar a pesquisa biológica e os fluxos de trabalho de descoberta de medicamentos.
A OpenAI libera o GPT-5.4-Cyber para usuários verificados, ampliando o acesso a ferramentas avançadas de IA para o ciberespaço enquanto implementa novas salvaguardas e controles de acesso.
O poderoso modelo Mythos da Anthropic destaca uma lacuna crítica de segurança: a IA pode identificar vulnerabilidades de software muito mais rapidamente do que as organizações conseguem corrigir.
A Anthropic lança o Claude Mythos Preview, um poderoso modelo de IA para cibersegurança defensiva, com acesso restrito devido a riscos de hacking, com parceiros incluindo Nvidia, Google e AWS.
A Alibaba lança seu terceiro modelo de IA de código fechado, sinalizando uma mudança estratégica para longe do código aberto, com o objetivo de proteger sua tecnologia proprietária e aumentar os lucros.
Um vazamento de dados revelou que a Anthropic está testando um novo e poderoso modelo de IA codinome 'Mythos', que a empresa confirmou representar um avanço significativo nas capacidades. Pesquisadores de segurança alertam que o raciocínio avançado do modelo pode representar novos riscos à cibersegurança.
O Google lançou o Gemini 3.1 Flash-Lite, seu modelo mais rápido e mais econômico da série Gemini 3, com preço de $0,25 por milhão de tokens de entrada e desempenho 2,5 vezes mais rápido que o do seu antecessor.