🔥 Em Foco
Moderna e MSD alcançam sucesso histórico na Fase III da vacina personalizada de mRNA contra o câncer, com algoritmo de IA identificando neoantígenos com precisão : A gigante global de mRNA Moderna, em parceria com a MSD, anunciou que a primeira terapia personalizada de mRNA contra o câncer, intismeran autogene (mRNA-4157), em combinação com KEYTRUDA (também conhecido como “K”), obteve um avanço histórico no ensaio clínico global de Fase III (INTerpath-001) para melanoma de alto risco, atingindo todos os desfechos primários de sobrevida livre de recorrência (RFS) e sobrevida livre de metástase à distância (DMFS). No design, algoritmos de IA profundamente integrados avaliam até 34 neoantígenos exclusivos mais imunogênicos a partir de dados de sequenciamento genético do tumor e concluem a personalização do mRNA do paciente em até 45 dias. Os dados clínicos mostram uma redução importante de 49% no risco de recorrência ou morte, marcando a entrada oficial do “triagem de alvos por IA + mRNA personalizado” na fase de validação da Fase III e comercialização. (Fonte: MIT Technology Review)

Startup de inteligência incorporada de uso geral Generalist lança modelo GEN-1.5, permitindo aprendizado no robô com uma única demonstração e zero ajuste fino : A startup Generalist, de inteligência incorporada de uso geral, lançou oficialmente o modelo fundacional do mundo físico GEN-1.5. Após pré-treinamento em larga escala por mais de 8 meses sobre vastos dados de interações físicas reais, o GEN-1.5 demonstra forte capacidade de aprendizado em contexto físico (In-Context Learning) e prompting físico (Physical Prompting). O usuário precisa apenas fornecer ao robô um vídeo de demonstração humana de 3 a 12 segundos como prompt físico; o robô é capaz de executar novas tarefas, como abrir tampas, puxar lenços de papel e manipular ferramentas, sem qualquer ajuste fino. Nos testes, a taxa de sucesso com uma única demonstração e zero ajuste fino foi de 59%, subindo para 83% após 5 minutos de ajuste fino com dados. Isso é avaliado pelo setor como o “momento GPT-3” da robótica incorporada. (Fonte: Generalist AI)

Primeiros racks de computação da arquitetura Nvidia Vera Rubin chegam oficialmente à OpenAI para apoiar pré-treinamento de modelos de próxima geração : OpenAI e Nvidia anunciaram em conjunto que a parceria de capacidade computacional alcançou um marco importante: os primeiros racks de computação da arquitetura Nvidia Vera Rubin chegaram à OpenAI, foram montados e já foram conectados à pilha de treinamento subjacente. Este lote será usado diretamente para expandir o pool de poder computacional de pré-treinamento dos próximos grandes modelos de fronteira da OpenAI, marcando a entrada da nova plataforma de computação acelerada da Nvidia no ambiente de produção dos modelos mais avançados do mundo. (Fonte: Nvidia News)

Slack lança Slack Code e inaugura “programação em grupo via chat”, com integração de agentes como os da Anthropic, Devin e GitHub : O Slack, da Salesforce, lançou oficialmente o Slack Code, levando os agentes de programação de IA do tradicional terminal individual e IDEs para o chat colaborativo empresarial. Os membros do time podem marcar agentes diretamente em canais do Slack, que geram automaticamente um Code Channel dedicado, permitindo colaboração em tempo real e revisão de código no mesmo canal entre desenvolvedores humanos, gestores de produto e agentes de IA como Devin, Claude Code, GitHub Copilot e ChatGPT. Os agentes herdam as políticas de segurança e o sistema de permissões existentes no Slack; operações de alto risco exigem uma segunda revisão por especialistas humanos. Isso representa uma mudança de paradigma das ferramentas de programação com IA para plataformas de colaboração em grupo via chat. (Fonte: Salesforce / Slack)

🎯 Tendências
Modelo aberto Ornith-1.5 lançado, com rota de auto-evolução de ponta a ponta como destaque : A equipe de modelos abertos Ornith lançou oficialmente a série Ornith-1.5, com três arquiteturas — 9B Dense, 35B MoE e 397B MoE — sob licença MIT. O modelo realiza aprendizado por reforço propondo novas tarefas de forma autônoma, construindo scaffolds automaticamente e gerando soluções por meio de autojogo. Ele atingiu o nível mais alto entre modelos abertos do mesmo porte em benchmarks como SWE-bench Verified (86 pontos) e Terminal-Bench 2.1 (86,1 pontos), e já está nativamente integrado aos ecossistemas vLLM e Ollama. (Fonte: Ornith AI)

DeepSeek Harness lança versão preliminar v0.1.0-rc.8, com suporte multimodal e orquestração de subagentes aprimoradas : A DeepSeek atualizou seu framework de agentes de código aberto DeepSeek Harness para a versão rc.8. A nova versão adiciona suporte nativo a solicitações de imagem ao adaptador de modelos DeepSeek, e os comandos /goal e /plan passam a aceitar entrada mista de imagem e texto. Além disso, Claude Code e Codex foram integrados mais profundamente ao sistema de subagentes, com suporte para instalação sob demanda como Profile Bundle e execução concorrente de múltiplas instâncias. A experiência do terminal Windows PTY e da busca web concorrente (web_search) também foi bastante otimizada. (Fonte: DeepSeek Release)
.jpg)
Liquid AI lança modelo rascunho destilado LFM2.5-DSpark, com inferência até 3,2x mais rápida : A Liquid AI lançou um modelo rascunho DSpark de amostragem especulativa com apenas cerca de 300M de parâmetros para seus modelos LFM2.5-1.2B, 2.6B e 8B-A1B. O modelo combina backbone paralelo, cabeça de continuação de Markov e poda por confiança, mantendo 100% de consistência com a saída de decodificação gulosa do modelo alvo e acelerando a inferência local em H100 e MacBook em entre 2,1x e 3,18x. A latência de chamadas de ferramentas (tool-calling) é significativamente reduzida, e o modelo já é suportado em sincronia pelo llama.cpp e SGLang. (Fonte: Liquid AI Blog)

Meta lança versão desktop autônoma do Meta AI para Mac, com foco em ditado de voz em nível de sistema e percepção de tela entre aplicações : A Meta lançou o aplicativo de desktop Meta AI para Mac, baseado no modelo Muse Spark. O app suporta ditado de voz em tempo real de alta precisão entre aplicações por meio de um atalho global Fn, e permite ao usuário compartilhar a janela atual da tela para que a IA perceba e oriente em tempo real. O aplicativo também pode ser conectado ao Google Workspace e aos painéis comerciais do Instagram/Facebook para diagnosticar resultados de marketing e gerar documentos automaticamente. (Fonte: TechCrunch)

OpenAI lança plugin do Apple Messages para o desktop do ChatGPT e antecipa mecanismo de “processamento privado de segurança” : O plugin do Apple Messages foi adicionado ao ChatGPT desktop e ao Codex, permitindo que usuários, com autorização local, pesquisem e resumam mensagens de texto históricas e redijam respostas em linguagem natural. A OpenAI também anunciou a tecnologia “Private Safety Processing” (Processamento Privado de Segurança), que visa identificar comportamento abusivo de alto risco entre sessões por meio de sinais de segurança criptografados, mantendo retenção zero de dados (ZDR). (Fonte: OpenAI News)

🧰 Ferramentas
Superwhisper abre o modelo de normalização de texto local S1-mini, com 462 MB para correção rápida de transcrições de voz : A Superwhisper disponibilizou em código aberto o S1-mini, um modelo de normalização de texto especificamente para pós-processamento de reconhecimento de fala. O modelo, obtido por ajuste fino do Qwen3-0.6B, tem apenas 462 MB (GGUF Q4_K_M) e pode ser executado inteiramente na CPU local de um Mac/PC. Ele remove automaticamente palavras de preenchimento, corrige erros de fala, adiciona pontuação e normaliza números, e-mails e datas, com precisão de tokens de 94,8%. (Fonte: Superwhisper / Hugging Face)

Chroma lança motor de memória “Foundation” para construir memória de longo prazo auto-evolutiva para agentes : A Chroma lançou oficialmente o Foundation, uma solução de memória auto-evolutiva voltada para conversas de longo ciclo de agentes de IA. O motor extrai automaticamente experiências estruturadas, preferências estratégicas e associações contextuais dos traços de execução histórica dos agentes, e as ativa e atualiza dinamicamente em sessões posteriores. Ele resolve de forma eficaz o esquecimento de memória entre sessões e a rigidez de padrões dos agentes. (Fonte: Chroma)

Tencent abre plataforma de AI Red Teaming AI-Infra-Guard (A.I.G) : O Laboratório Zhuque da Tencent lançou em código aberto a plataforma full-stack de avaliação de segurança de IA para red team, denominada A.I.G. Ela integra Agent Scan, Skills Scan, MCP Server Scan e varredura de vulnerabilidades de infraestrutura de IA (incluindo mais de 2.000 regras CVE e 130+ componentes), além de incluir o benchmark de segurança de habilidades de agentes SkillTrustBench. A plataforma ajuda empresas a detectar abuso de privilégios de agentes, sequestro de instruções (prompt hijacking) e vulnerabilidades na cadeia de suprimentos. (Fonte: Tencent / GitHub)

📚 Aprendizagem
Terence Tao publica ensaio no ICM 2026: o “pipeline problema-solução” em cinco estágios e a crise cognitiva da pesquisa matemática na era da IA : O laureado com a Medalha Fields, Terence Tao, publicou um novo artigo apontando que a participação em larga escala da IA na pesquisa matemática desencadeará a maior crise de valores desde a era de Gödel. Ele propõe dividir a resolução de problemas matemáticos em cinco estágios — “geração, verificação, interpretação, aceitação pela comunidade e formalização da teoria” — e enfatiza que apenas uma prova correta gerada por IA não equivale a concluir o trabalho matemático. Matemáticos humanos devem assumir as responsabilidades insubstituíveis de interpretar provas e formalizar teorias. (Fonte: THE DECODER)

Tang Jie, da Zhipu AI, compartilha leis de escala do pós-treinamento: o número de parâmetros deixou de ser a única régua da inteligência : Tang Jie, cofundador da Zhipu AI, detalhou o raciocínio de pós-treinamento por trás do GLM-5.3. Sem trocar a base de 743B (com 40B ativados), apenas com aprendizado por reforço de ambiente de longo ciclo, a capacidade de codificação do GLM-5.3 aumentou 50%. Ele destacou que a capacidade de um modelo é determinada conjuntamente pelo tamanho da base, volume de dados, quantidade de computação forward e pós-treinamento; no estágio atual, o pós-treinamento que aumenta a profundidade efetiva e o comprimento da cadeia de raciocínio tem enorme potencial. (Fonte: dotey / Zhipu AI)

Google e DeepMind propõem mecanismo Recirculation: ativações profundas do Transformer podem fluir de volta às camadas rasas sem retreinar : O artigo propõe, sem modificar os gradientes do modelo pré-treinado, introduzir na fase de inferência um mecanismo recursivo (Recirculation) no qual representações profundas retornam às camadas rasas. Por meio de um pequeno MLP que prevê dinamicamente os coeficientes de recirculação, o Gemma3 reduziu a perplexidade em 23,0% em 9 conjuntos de dados de modelagem de linguagem, superando o ajuste fino completo; a precisão no GSM8K melhorou cerca de 21%. (Fonte: DeepMind / Synced)

Equipes da Tsinghua e Microsoft propõem SPADE: framework de auto-evolução de agentes de longo ciclo baseado em autojogo em ambientes executáveis : O artigo propõe o framework SPADE, no qual o mesmo LLM atua como Environment Designer e como Reasoning Agent. O Environment Designer escreve autonomamente ambientes de agente executáveis com interface Gym e tarefas progressivamente mais difíceis; utilizando sinais de arrependimento do prompt (prompt regret) para orientar o aprendizado por reforço, o framework alcança treinamento autônomo aberto e contínuo sem intervenção humana. (Fonte: HuggingFace Daily Papers)

💼 Negócios
Nvidia e Poolside fecham acordo de licenciamento de tecnologia de US$ 6 bilhões, com investimento adicional de US$ 1 bilhão : A startup de IA focada em modelos de código de grande porte Poolside chegou a um acordo não exclusivo de licenciamento de tecnologia de US$ 6 bilhões com a Nvidia, que também investiu US$ 1 bilhão na empresa. Com isso, a avaliação pré-money da Poolside alcança US$ 12 bilhões. O acordo ainda inclui ofertas de emprego da Nvidia a 109 funcionários da Poolside, marcando mais uma transação massiva nos setores de semicondutores e IA. (Fonte: Techmeme / Newcomer)

Simile levanta US$ 300 milhões e salta para avaliação de US$ 2 bilhões, focada em simulação sintética de populações completas : A Simile, fundada pela equipe de pesquisa criadora do Smallville de Stanford (experimento de vila com 25 agentes de IA), levantou mais de US$ 300 milhões em menos de 6 meses de existência, com avaliação disparando para US$ 2 bilhões. A empresa usa dados de entrevistas com grandes populações reais para construir populações sintéticas, usadas para prever reações do mercado a produtos, preços e políticas antes de um lançamento real. (Fonte: The Turing Post)

Ramp lança serviço de roteamento de modelos de IA “Router”, concorrendo diretamente com OpenRouter e Stripe : A gigante de gestão de despesas corporativas Ramp anunciou oficialmente seu serviço próprio de roteamento de modelos de IA, o Router.com. A plataforma oferece API unificada para modelos da OpenAI, Anthropic, DeepSeek, Moonshot, xAI e outros, com suporte a políticas de roteamento dinâmico baseadas em custo, latência e métricas de avaliação personalizadas. A Ramp passa a atuar diretamente na gestão de gastos com tokens de IA das empresas. (Fonte: TechCrunch / Ramp)

🌟 Comunidade
Desenvolvedores discutem a “redução da dependência de modelos de fronteira” em grandes empresas como AT&T: 40% do tráfego de IA corporativo vai para modelos abertos, com redução de 56% nos custos : A comunidade debate que grandes empresas como AT&T estão roteando 40% do tráfego de IA de seus funcionários para modelos de código aberto (com planos de chegar a 60-70%) e, com uma queda de qualidade de apenas 2%, os custos de codificação despencaram 56% (processando 45 bilhões de tokens por dia). Isso confirma a tendência mais temida pelos principais laboratórios: empresas estão migrando em larga escala tarefas não essenciais para modelos abertos de alto custo-benefício. (Fonte: TheZachMueller)

Grok Bot gera onda de “aplicativos construídos em 15 segundos” e é aclamado como mais um “momento Claude Code” da era da IA : Investidores e desenvolvedores do Vale do Silício vêm compartilhando suas experiências com o Grok Bot, afirmando que a combinação de “VM em nuvem sem configuração + múltiplos agentes colaborativos” multiplica a produtividade em cem vezes. Com apenas algumas frases em linguagem natural, o usuário pode gerar em 15 segundos um aplicativo completo e funcional com um domínio próprio, gerando ampla discussão sobre “empresas de uma pessoa” e fluxos de trabalho nativos de agentes. (Fonte: grok)

OpenAI e Anthropic lançam estratégias de retenção zero de dados / processamento privado, respondendo a preocupações de privacidade corporativa : Diante das preocupações das empresas com a privacidade e a conformidade dos modelos de fronteira, a OpenAI lançou o Private Safety Processing, e a Anthropic anunciou que introduzirá, no próximo outono, políticas de retenção zero de dados (ZDR) e de controle de dados pelos clientes para seus modelos avançados de nível Mythos. Isso evidencia a competição cada vez mais acirrada entre os laboratórios de fronteira na proteção de privacidade para conquistar clientes corporativos. (Fonte: Bloomberg / OpenAI)

Políticos de vários estados dos EUA enfrentam reação de eleitores por disputas de eletricidade e água em datacenters; infraestrutura de IA encontra resistência política local : O comitê do Partido Republicano no Senado dos EUA emitiu um alerta interno afirmando que disputas por recursos de água, eletricidade e aumento nas contas de energia causadas pela construção de datacenters têm provocado forte reação pública em Ohio, Texas e outros locais. O Texas já suspendeu até 1.800 projetos de datacenters. A implantação da infraestrutura de IA tornou-se o tema local mais politicamente sensível da temporada eleitoral. (Fonte: EERandomness / MIT Technology Review)

💡 Outros
Anthropic lança plataforma gratuita de aprendizado Claude Academy : À medida que o IPO se aproxima, a Anthropic lançou oficialmente a Claude Academy (academy.claude.com), uma plataforma gratuita de aprendizado aberta ao público. Ela oferece cursos completos, desde conceitos básicos de IA até engenharia avançada de prompts e uso do Claude Code, com certificado de conclusão. (Fonte: Claude)

Cloudflare corrige vulnerabilidade remota explorável de canal lateral Spectre na plataforma Workers : A equipe de segurança da Cloudflare divulgou e corrigiu uma vulnerabilidade de canal lateral Spectre remota na plataforma de computação de borda Cloudflare Workers. A falha poderia permitir que um atacante lesse dados de memória entre locatários (cross-tenant). Nenhuma exploração real em produção foi detectada até o momento. (Fonte: Cloudflare)
Família de modelos abertos Gemma ultrapassa 1 bilhão de downloads globais : A equipe do Google DeepMind anunciou que a família de modelos abertos Gemma ultrapassou 1 bilhão de downloads acumulados em todo o mundo. A comunidade já produziu mais de 100 mil variantes de ajuste fino do Gemma, abrangendo aplicações que vão de computação de borda em satélites a dispositivos móveis offline. (Fonte: Google DeepMind / Ollama)
