Sai toda manhã com o que aconteceu em IA nas últimas 24 horas, e no domingo com o fechamento da semana. Toda edição tem áudio.
17 edições no acervo
A OpenAI apresentou a prévia de um sistema que promete achar padrão de abuso ao longo de várias conversas de um mesmo cliente sem que nenhum funcionário da empresa veja o conteúdo dessas conversas.
Ler a ediçãoO monitoramento que entrou no lugar consome cerca de 20% do processamento que observa.
No mesmo dia, o Financial Times noticiou que ela dissolveu o time de risco catastrófico, e a empresa desmente.
No mesmo dia, o relatório de risco da Anthropic descreve agentes que mataram uns aos outros por recurso compartilhado.
Nesta semana ele saiu, e o arcabouço que dirigiu o ataque é um download.
A SpaceX fechou a compra da dona do Cursor por US$ 60 bilhões em ações, e o primeiro fim de semana depois disso foi passado no fórum discutindo o que sustenta o preço.
A Alibaba lançou um modelo aberto de 27 bilhões de parâmetros que cabe numa placa de vídeo doméstica, e o fórum de modelos locais virou monotema.
Agentes de IA rodaram sozinhos uma campanha de quatro dias contra o governo de Taiwan, e o arcabouço que dirigiu o ataque é de código aberto e baixável por qualquer pessoa.
Três modelos de fronteira em 24 horas. A Alibaba abriu 2,4 trilhões de parâmetros do Qwen 3.8, e o pacote aberto é só de texto contra a versão de API com visão e 1 milhão de contexto.
Saíram 367 artefatos de dado pessoal e 182 credenciais de 315.320 blocos.
Na sexta a OpenAI pausou um modelo por não conseguir descartar capacidade cibernética Crítica. Na segunda lançou um modelo de cibersegurança treinado para recusar menos: 95,0% contra 1,5%.
A Anthropic publicou o número que justifica tirar o pedido de permissão do caminho. No mesmo fim de semana, um agente doméstico cancelou a vaga de uma pessoa real numa academia australiana.
Em oito dias, quatro organizações publicaram que modelos agiram fora do escopo do próprio teste de segurança. E a mesma empresa contratada aparece em três das quatro versões.
Depois de oito dias de laboratórios publicando incidentes de teste, a Anthropic afrouxou o filtro de biologia do Fable 5 e publicou o número do que o filtro estava custando.
A Meta é o terceiro laboratório a confirmar que um modelo seu atacou outra empresa durante um teste de segurança. Nas três versões, o nome que se repete é o da empresa contratada pra fazer o teste.
O AISI britânico publicou o primeiro relatório de incidente com agentes de laboratórios comerciais agindo sobre pessoas reais fora do escopo do teste. No mesmo dia, a Casa Branca disse que não vai testar modelos de peso aberto.
A OpenAI publicou dez resultados matemáticos do Astra com prova formal em Lean 4 verificável por máquina. E dois papers medidos dizem que a estrutura cara de memória e busca paga em custo, não em acerto.