Digest de IA — 7 de outubro de 2026
Movimento.ai
Edição diária do Digest de IA da movimento.ai — um resumo rápido dos principais desenvolvimentos em inteligência artificial das últimas 24 horas, com vários itens curtos em vez de um ensaio único.
A OpenAI despejou no GitHub 722 manuscritos de matemática produzidos por um modelo interno ainda não lançado, com alegações de avanço em centenas de problemas em aberto, e deixou a comunidade matemática tentando entender o que tem nas mãos. No mesmo dia, a Mistral abriu a prévia do Mistral Large 4, de 1 trilhão de parâmetros e pesos prometidos para o fim do mês, e a Anthropic ampliou o acesso de equipes de segurança a seus modelos mais fortes em cibersegurança. Completam o dia o Personal Agent Protocol de Meta e Sierra para agentes pessoais negociarem com empresas, o Nano Banana 2.1 e o EmbeddingGemma 2 do Google, a posição de Singapura sobre IA agêntica no Parlamento e a rodada de US$ 40 milhões da Hadrian.
OpenAI publica 722 manuscritos de matemática de um modelo ainda não lançado
Na terça (6 out), às 19h (horário de Brasília), a OpenAI publicou no GitHub 722 manuscritos agrupados em 372 famílias de resultados, todos produzidos por um "modelo de fronteira interno" que ainda não foi lançado; a empresa diz que cada família resolve ou avança de forma substancial um problema em aberto de matemática ou ciência da computação teórica. Entre as alegações estão a conjectura de Kakeya em quatro dimensões, melhorias em algoritmos importantes e progresso em direção à hipótese de Riemann; segundo a OpenAI, quase todos os resultados saíram de um único prompt dado a um único agente, com média de cerca de três horas de computação equivalente ao ChatGPT Pro por resultado, bem diferente do enxame de 10 mil agentes usado na solução de Navier-Stokes. Boa parte dos resultados vem com formalização em Lean, mas nenhum passou por revisão por pares, e a própria OpenAI avisa que os não formalizados podem ter erros; a empresa diz que vai financiar workshops sobre resultados produzidos por IA.
Por que importa: é a demonstração mais ampla até agora de IA fazendo pesquisa matemática em escala, e reacende o debate sobre transparência, crédito a matemáticos humanos e como a área vai revisar esse volume.
Fonte: Scientific American — OpenAI unleashes hundreds more math results; The Verge — OpenAI drops another batch of mathematical breakthroughs; New Scientist — OpenAI announces 722 mathematical discoveries in one go
Mistral Large 4 entra em prévia pública com 1 trilhão de parâmetros
A Mistral lançou em 6 out a prévia pública do Mistral Large 4, modelo nativamente multimodal com 1 trilhão de parâmetros e 49 bilhões ativos, treinado do zero em 3.800 GPUs Nvidia Grace Blackwell nos data centers da própria empresa na Europa. A API de prévia já está no Mistral Studio, e os pesos abertos saem até o fim de outubro; até lá, o modelo passa por red-teaming com líderes de cibersegurança, parceiros verificados e autoridades estatais. Nos números divulgados pela Mistral, o ML4 marca 61,7% no DeepSWE v1.1 e fica entre os cinco melhores do Artificial Analysis Cyber Index, e a empresa o apresenta como o primeiro marco do roadmap financiado por sua Série D de 3 bilhões de euros.
Por que importa: se os pesos saírem como prometido, a Europa passa a ter um modelo aberto na escala dos melhores chineses, com a soberania e a cibersegurança sem recusas como argumentos de venda.
Fonte: Mistral — Introducing Mistral Large 4
Anthropic amplia o acesso de cibersegurança ao Mythos 5.1 para defensores verificados
A Anthropic reformulou em 6 out seu Cyber Verification Program, que libera capacidades avançadas de cibersegurança e bloqueios reduzidos para profissionais verificados, e o dividiu em três níveis: Defense Access (resposta a incidentes, análise de malware, validação de vulnerabilidades), Red Team Access (inclui pentest autorizado) e Specialized Access, para quem testa sistemas críticos como redes elétricas e infraestrutura bancária, com análise feita junto ao governo dos EUA. Todos os níveis dão acesso a Claude Opus 5.5, Sonnet 5.5 e Mythos 5.1, com retenção de dados obrigatória para monitorar abuso; o programa absorve o Project Glasswing, cujos parceiros, segundo a empresa, encontraram pelo menos 129 mil vulnerabilidades verificadas entre abril e julho de 2026, mais de 33 mil delas críticas ou de alta severidade.
Por que importa: os laboratórios fechados estão criando acesso escalonado para não perder defensores para modelos abertos sem recusas, como o próprio Mistral Large 4 apresentado no mesmo dia.
Fonte: Anthropic — Expanding the Cyber Verification Program
Meta e Sierra lançam o Personal Agent Protocol
Meta e Sierra anunciaram em 6 out o Personal Agent Protocol, padrão aberto desenvolvido com Genesys, Instinct, Rocket, Shopify, Stripe e Walmart para definir como agentes pessoais de IA interagem com empresas. O protocolo, baseado em OAuth, deixa o consumidor decidir que acesso o agente tem (só leitura ou escrita) e a empresa definir o que ele pode fazer, seja navegando no site, usando APIs com padrões como MCP e OpenAPI ou conversando com o agente da própria empresa; a especificação v0.1 e uma implementação de referência estão previstas para ainda este mês. Bret Taylor, cofundador da Sierra e presidente do conselho da OpenAI, disse à CNBC que hoje as empresas não conseguem distinguir um agente autorizado de um bot qualquer, e OpenAI e Anthropic ainda não aderiram.
Por que importa: com agentes pessoais como o Muse e o Dots ganhando milhões de usuários, quem definir o padrão de autenticação entre agentes e empresas vai moldar o comércio agêntico.
Fonte: Sierra — Introducing Personal Agent Protocol; CNBC — Meta joins companies to tame 'chaos' of doing business with AI bots
Google lança o Nano Banana 2.1 e o EmbeddingGemma 2 aberto
O Google começou a liberar em 6 out o Nano Banana 2.1, nova versão do seu modelo de geração e edição de imagens, com melhor qualidade visual em 1K, 2K e 4K, texto mais preciso, edição por máscara e fusão de até 14 imagens de referência; ele chega ao app Gemini, ao AI Mode, AI Studio, Flow, Stitch, Google Ads e Gemini Enterprise. No mesmo dia, o Google DeepMind lançou o EmbeddingGemma 2, modelo aberto de embeddings de 740 milhões de parâmetros sob licença Apache 2.0, baseado no Gemma 4, que coloca texto, código, imagem, áudio e vídeo num mesmo espaço vetorial, com contexto de 8K tokens e cerca de 191 MB de RAM no modo só texto quantizado num Pixel 11 Pro. Em código, o salto no MTEB Code foi de 68,76 para 78,68 pontos em relação à primeira versão.
Por que importa: o EmbeddingGemma 2 torna viável busca e RAG multimodais rodando inteiramente no aparelho, sem mandar dados para a nuvem.
Fonte: Google — EmbeddingGemma 2; Android Authority — Google launches Nano Banana 2.1
Singapura revisa suas regras para IA agêntica no Parlamento
Nesta quarta (7 out), o ministro sênior de Estado para Desenvolvimento Digital de Singapura, Tan Kiat How, disse ao Parlamento que o governo está rodando testes e experimentos para entender como implantar IA agêntica com responsabilidade, e revisando seus frameworks para dar conta da maior autonomia desses sistemas; segundo ele, as diretrizes atuais, como responsabilização humana e controles de segurança, já valem para agentes. Na véspera, em resposta escrita, a ministra Josephine Teo disse que o país estuda novas exigências para usos de alto risco, como testes mais rigorosos, evidência verificável de forma independente e supervisão regulatória mais forte, e afirmou que até agora não houve ataque a órgãos do governo envolvendo um agente de IA sem supervisão.
Por que importa: depois dos casos na Austrália e no Canadá, outros governos começam a reagir aos incidentes com agentes, ainda com cautela e sem lei nova por enquanto.
Fonte: CNA — Singapore government running trials to understand how to implement AI agents responsibly
Hadrian levanta US$ 40 milhões em segurança ofensiva agêntica
A Hadrian, plataforma de segurança ofensiva baseada em agentes de IA, levantou US$ 40 milhões numa rodada co-liderada pela Forgepoint Capital International e pela Smart Fin, com participação de HV Capital, Motive Partners, Picus Capital e Oetker Ventures, somando US$ 65 milhões captados. A empresa vai usar o dinheiro para expandir na Europa, Oriente Médio, África e EUA e ampliar seus times de engenharia e pesquisa.
Por que importa: a mesma capacidade agêntica que preocupa governos está virando produto de defesa, com investidores apostando em agentes que atacam os próprios sistemas antes dos criminosos.
Fonte: Tech.eu — Hadrian raises $40M to tackle AI-driven cyber threats
Consultoria brasileira especializada em implementação, treinamento e mentoria em IA para empresas. Conheça a movimento.ai
