🔥 Em Foco
Disputa política e empresarial global sobre a desaceleração da IA: reação dura do Ocidente, China impulsiona ecossistema open source, Altman e Nadella se posicionam : Em resposta às propostas da Anthropic, OpenAI e Elon Musk para desacelerar a pesquisa e o desenvolvimento de IA de ponta, o cenário político e corporativo global foi abalado. A mídia estatal chinesa e porta-vozes do Ministério das Relações Exteriores rejeitaram os apelos de desaceleração, classificando-os como “um roteiro da Guerra Fria para disseminar pânico e conter o avanço tecnológico de outros países”, enquanto impulsionavam um ecossistema de defesa de segurança e IA inclusiva centrado em open source na cúpula do BRICS. A classe política dos EUA também reagiu prontamente; Donald Trump, na Irlanda, recusou categoricamente qualquer desaceleração, enfatizando que a disputa de IA é um jogo onde o “vencedor leva tudo” e que os EUA não podem ceder sua liderança, enquanto David Sacks, copresidente do Conselho Consultivo de Ciência da Casa Branca, atacou a proposta chamando-a de “um cartel setorial e captura regulatória sob o pretexto da moralidade”. Diante das acusações, Sam Altman publicou um esclarecimento afirmando que “cadenciar (Pacing) não significa estagnação”, enfatizando a introdução de casos de uso explícitos de segurança e monitoramento robusto antes do treinamento de RL de ponta, e não a espera por isenções antitruste; o CEO da Microsoft, Satya Nadella, também reforçou que regras e auditorias não devem ser monopolizadas por poucos laboratórios, sendo essencial garantir a prosperidade conjunta de soluções open source e proprietárias, além da soberania dos modelos empresariais (Fonte: The Verge, THE DECODER, WIRED, The Guardian, teortaxesTex, sama, NandoDF)

Clay Mathematics Institute confirma oficialmente que solução do problema de Navier-Stokes entrou em revisão formal por pares : O Clay Mathematics Institute (CMI), responsável pela avaliação dos sete Problemas do Prêmio Millennium, publicou uma declaração formal confirmando que a existência e suavidade das soluções para as equações de Navier-Stokes “aparentemente foram resolvidas (apparently been settled)”, e que o material de prova assistida por computador correspondente está passando por uma rigorosa revisão por pares de acordo com os procedimentos estabelecidos. O CMI destacou que o valor de grandes problemas não reside apenas na conclusão, mas também no surgimento de novos pensamentos matemáticos e ferramentas teóricas; embora as ferramentas de verificação formal tenham acelerado substancialmente o processo, a avaliação do comitê acadêmico permanecerá cautelosa e metódica. Esse posicionamento oficial marca a superação do limiar formal de avaliação acadêmica pela exploração científica teórica de ponta impulsionada por IA (Fonte: THE DECODER)
Independência de auditoria de terceiros é alvo de críticas coletivas; laços de interesse da METR desencadeiam crise de confiança : Após os principais laboratórios anunciarem a concessão de acesso de auditoria residente no nível de funcionário à METR, o setor de tecnologia reagiu com forte oposição. David Sacks, Lina Khan e diversos especialistas em segurança apontaram que o corpo principal e as redes de financiamento da METR estão profundamente vinculados à Anthropic e a círculos de altruísmo eficaz (EA), sustentando que a dita supervisão voluntária funciona, na verdade, como uma busca de renda para contornar leis de responsabilidade sobre produtos e elevar barreiras de entrada no setor. Além disso, veio a público uma falha de segurança na qual o vazamento de chaves de API da METR resultou no desvio de US$ 600 mil em cotas, colocando sob severo escrutínio seu profissionalismo e neutralidade como “árbitro da indústria” (Fonte: ClementDelangue, nptacek)

Apelos de gigantes por desaceleração provocam queda nas ações de tecnologia da Ásia-Pacífico; dívidas de infraestrutura de IA e capex enfrentam reavaliação : Pressionado pelo adiamento do IPO da OpenAI e pelos apelos dos principais laboratórios por uma “desaceleração na fronteira”, o setor de semicondutores e IA da Ásia-Pacífico recuou de forma generalizada: as ações do SoftBank Group caíram quase 12% em um único dia, o índice sul-coreano KOSPI recuou mais de 3%, e gigantes upstream de fundição de chips e memória, como SK Hynix e TSMC, registraram perdas acentuadas. Analistas observam que o mercado está reavaliando a sustentabilidade de compromissos de centenas de bilhões de dólares em capex de data centers e redes elétricas altamente alavancadas; caso a iteração dos modelos de fronteira seja desacelerada artificialmente por revisões de segurança, dívidas de infraestrutura sem lucros reais correspondentes podem evoluir para um novo risco de crédito (Fonte: The Guardian, 36氪)

🎯 Tendências
Deep Wisdom lança modelo base de Physical AI PhysBrain 1.5, com inteligência espacial equivalente aos principais modelos proprietários : A Deep Wisdom disponibilizou como open source o modelo base de física PhysBrain 1.5 (com versões de 2B e 8B parâmetros), atingindo uma pontuação média de 72,5 em 28 benchmarks públicos de IA incorporada (embodied AI) abrangendo percepção espacial, geração de ações e previsão de futuro, liderando o ranking open source e se aproximando do GPT-6 Astra (73,3). Baseado em dados humanos reais panorâmicos Ego360 e em uma arquitetura de loop fechado “Physical Loop”, o modelo unifica o backbone autorregressivo para raciocínio de coordenadas espaciais e geração de ações de extremidades robóticas a 60 Hz, permitindo transferência zero-shot para robôs humanoides em manipulações finas (Fonte: 量子位)

Copilot no Word, Excel e PowerPoint da Microsoft integra oficialmente modelos Grok da xAI : A Microsoft anunciou a expansão das opções de modelos do Copilot para clientes corporativos do Microsoft Frontier, integrando oficialmente a família de modelos Grok da xAI ao Word, Excel e PowerPoint. Os usuários podem alternar livremente entre OpenAI GPT, Anthropic Claude e Grok no seletor de modelos. O movimento busca quebrar o aprisionamento tecnológico com um único fornecedor (vendor lock-in) e avaliar a preferência de estilo entre diferentes modelos para tarefas de processamento de dados complexos e redação de textos longos no pacote de produtividade corporativa (Fonte: The Verge)

Assistente móvel Doubao lança versão para consumidor e introduz protocolo de automação de tela SAEP : A ByteDance lançou oficialmente a versão para o consumidor do assistente móvel Doubao, integrado ao hardware do Nubia NaviX Ultra. O sistema traz um botão dedicado de IA com autenticação biométrica por impressão digital, respostas multimodais imediatas baseadas no contexto da tela e execução de tarefas automatizadas entre aplicativos. Para delimitar o comportamento de agentes de interface gráfica, a empresa também divulgou o protocolo de 30 dias Screen Automation Execution Protocol (SAEP), permitindo que desenvolvedores de terceiros declarem permissões e bloqueiem operações não autorizadas entre plataformas (Fonte: 机器之心)
.png)
XPeng Motors lança Infini-VLA: introduzindo KV Cache na memória temporal de longo prazo para direção autônoma : A equipe de direção autônoma da XPeng transferiu pela primeira vez o mecanismo de KV Cache de LLMs para o processamento de fluxo de vídeo end-to-end. Ao gravar continuamente os quadros de tráfego em um cache temporal global sem alterar a capacidade de computação veicular, o sistema alcançou retenção de histórico dos últimos 30 segundos e acelerou a resposta end-to-end em 300%, eliminando a “amnésia temporal” dos métodos tradicionais no julgamento de sinais amarelos e tomadas de decisão em cruzamentos, aumentando a robustez do planejamento (Fonte: ZhihuFrontier)

QuantaMind da MoleculeMind é publicado na Science Advances, superando o “triângulo impossível” da simulação de reações biológicas : A equipe da MoleculeMind desenvolveu o framework de campo de força de aprendizado de máquina reativo (MLFF) QuantaMind, levando a simulação de dinâmica de reações com precisão próxima a primeiros princípios (DFT) a sistemas de 100 mil átomos e escalas de tempo de centenas de nanossegundos. Com velocidade de inferência de 2,1×10⁻⁶ s/átomo/passo, o tempo de um único passo de reação complexa caiu para 0,25 s. Em testes no ciclo catalítico da enzima hidrolisante de PET com 18 mil átomos, a correlação das forças atômicas ultrapassou 0,99, estabelecendo a base computacional para a transição do design de proteínas por IA de “previsão de estrutura” para “previsão de mecanismo e dedução de reações” (Fonte: 量子位, WeChat)

OpenAI libera GPT-6 Astra para todos os usuários Plus, restrito a interfaces de workbench e sem suporte a chat casual : A OpenAI disponibilizou formalmente o GPT-6 Astra para assinantes do plano Plus de US$ 20/mês, mas o modelo permanece restrito às interfaces de workbench ChatGPT Work e Codex, enquanto a janela de conversa comum permanece com os limites anteriores. Documentos oficiais apontam que usuários Plus têm direito a cotas de 5 a 45 execuções de Astra a cada 5 horas, evidenciando a estratégia de direcionar o modelo de fronteira de alto custo computacional para cenários de produtividade de alto valor, como refatoração de código, pesquisa em múltiplas etapas e operações de computador (Fonte: 36氪)

Sakana AI propõe arquitetura de aprendizado local sem backpropagation PC-ALM : A Sakana AI lançou em conjunto o algoritmo PC-ALM, que combina Predictive Coding com o método de multiplicadores de Lagrange aumentados, permitindo que cada camada da rede neural atue como um sistema de controle de feedback PI local para atribuição de crédito. O método elimina totalmente o backpropagation global, conseguindo treinar com estabilidade redes ultraprofundas de 1.000 camadas e abrindo novos caminhos para IA de baixo consumo em computação bioinspirada e hardware neuromórfico (Fonte: SakanaAILabs)
Shanghai AI Lab lança Intern-S2-397B com suporte Day-0 no vLLM : O Shanghai AI Lab apresentou o Intern-S2-397B, um modelo base multimodal voltado para pesquisas científicas de longo horizonte, alcançando desempenho open source de ponta em raciocínio científico, geração de código e tarefas de agentes autônomos de pesquisa. O framework open source de alta taxa de transferência vLLM anunciou suporte oficial Day-0 para a sua implantação, reduzindo as barreiras para academia e indústria (Fonte: vllm_project)

FlashREINFORCE é disponibilizado em open source: novo framework de reinforcement learning assíncrono com rollout único e sem critic : A equipe do NVIDIA NeMo e parceiros abriram o código do FlashREINFORCE. Utilizando um design de “REINFORCE de lote único + restrição de intervalo de confiança de sequência + otimização de média amostral”, o framework viabiliza pela primeira vez atualizações assíncronas com rollout único no treinamento de agentes LLM, superando os bloqueios de fila causados pela espera de amostras longas no GRPO tradicional e atingindo atualizações estáveis por mais de 6.000 passos (Fonte: giffmana)

IFM disponibiliza em open source a família de modelos K2 Horizon: cobrindo pesos de 3.7B a 375B : Uma equipe de pesquisadores abriu os pesos e todos os detalhes do pré-treinamento da série de foundation models K2 Horizon, que contempla arquiteturas de 3.7B, 7B, 36B e o modelo principal MoE de 375B. Avaliações mostram que o modelo menor de 7B possui excelente custo-benefício em inferência on-device, embora a variante de ultraescala ainda demande melhorias na otimização do KV Cache em contextos longos (Fonte: ethanCaballero, Reddit r/LocalLLaMA)

MMLab da NTU revela mecanismo multimodal unificado nativo e propõe arquitetura Task-decoupled MoT : Pesquisadores da Nanyang Technological University publicaram um artigo no arXiv analisando sistematicamente a sinergia entre compreensão visual e geração em modelos multimodais unificados (UMM) nos níveis de representação, tarefa e sistema. O estudo identificou que o compartilhamento denso e forçado de parâmetros causa conflito de representações, propondo então a arquitetura Task-decoupled MoT, na qual os ramos de compreensão e geração são desacoplados, mas continuam interagindo nas camadas de texto e atenção, alcançando ganhos substanciais de transferência positiva bidirecional em raciocínio geométrico e tarefas de inteligência espacial 3D (Fonte: 机器之心)
.jpg)
Ecossistema de geração de vídeo do MiniMax H3 explode: comunidade lança soluções de destilação e aceleração ultrarrápida : O modelo open source de geração audiovisual H3 da MiniMax obteve forte adesão da comunidade global. A equipe do NVIDIA SANA apresentou a pipeline de dois estágios Sol-H3, capaz de gerar 15 segundos de áudio e vídeo em 768p em apenas 6,6 segundos em 8 GPUs B300; paralelamente, FastVideo, Alibaba PAI e ComfyUI implementaram esquemas de destilação LoRA de 4 a 8 passos e reestruturação de atenção, reduzindo expressivamente os requisitos de hardware (Fonte: MiniMax_AI)

Anthropic testa internamente versão iOS do “Claude Money”, agente de finanças pessoais : Vazamentos de código revelam que a Anthropic prepara um novo recurso de finanças pessoais para o cliente iOS, intitulado Claude Money. A ferramenta permite a vinculação direta de contas bancárias para que o Claude agregue faturas, analise tendências financeiras e auxilie no planejamento de despesas, sinalizando o avanço dos agentes de fronteira na gestão de ativos e dados sensíveis do dia a dia (Fonte: nicdunz)

OpenAI abre interface SIP para chamadas no GPT-Live e adiciona função de salvar conversas temporárias : A OpenAI lançou oficialmente a API de voz em tempo real GPT-Live com suporte ao protocolo de telefonia SIP padrão, permitindo integração direta com call centers e redes de telecomunicações tradicionais. Ao mesmo tempo, o ChatGPT na web e no mobile recebeu uma atualização que permite aos usuários transformar conversas temporárias ativas (Temporary Chats) em registros salvos diretamente no histórico principal (Fonte: juberti, Reddit r/ChatGPT)
🧰 Ferramentas
NVIDIA disponibiliza em open source o OSMO, ferramenta de orquestração de fluxos de trabalho para Physical AI : A NVIDIA abriu o código do orquestrador nativo de Kubernetes OSMO (sob licença Apache-2.0), projetado para resolver o problema de agendamento fragmentado em Physical AI entre treinamento em GPUs de data center, simulação em workstations RTX e testes com hardware-in-the-loop (HIL) em dispositivos de borda Jetson. Com um único arquivo YAML, desenvolvedores podem orquestrar pipelines de dados entre clusters e topologias NVLink (Fonte: MarkTechPost)
TrueForge: runtime gerenciado open source para AI Agents reduz drasticamente o consumo de tokens : A TrueFoundry disponibilizou em open source (licença MIT) o TrueForge, um framework de governança e execução de agentes. Ele permite executar fluxos de trabalho multiagente com diferentes modelos localmente ou em nuvem privada, desacoplando persistência de sessão, ambientes sandbox, ferramentas MCP e fluxos de aprovação de segurança. Em benchmarks corporativos utilizando o mesmo modelo base, o mecanismo de revelação progressiva de contexto do TrueForge reduziu o consumo de tokens em quase 70%, comprovando que o custo operacional de agentes depende primariamente da arquitetura do harness, e não apenas do modelo (Fonte: )
Agente pessoal Muse da Meta ganha destaque: máquina virtual segura e fluxos práticos para o dia a dia : O novo agente pessoal Muse da Meta vem recebendo grande atenção da comunidade. A ferramenta conta com integração profunda para recuperação de dados de ecossistemas privados como o Instagram e opera dentro de máquinas virtuais seguras, utilizando navegadores pop-up para transições homem-máquina fluidas. O agente consegue automatizar pedidos de reembolso de passagens aéreas, rastreamento de faturas de planos de saúde e negociações de agendas complexas entre diferentes serviços (Fonte: alexandr_wang, giffmana)

oh-my-hermes: plugin de fluxo de trabalho completo e roteamento multimodelo para o Hermes Agent : Desenvolvedores disponibilizaram como open source o oh-my-hermes (OMH), um plugin de governança de alto desempenho voltado ao Hermes Agent da Nous Research. A ferramenta oferece roteamento Mixture-of-Models, calibração personalizada para 13 famílias de modelos, motor de fan-out paralelo com isolamento de arquivos e sistema de memória de longo prazo validado por humanos, exibindo custos de tokens e status de verificação de código em tempo real via TUI nativa no terminal (Fonte: GitHub Trending)

Microsoft Data Formulator: sistema interativo de análise de dados integrando agentes multimodais e exploração de ramificações : A Microsoft lançou a versão open source Data Formulator 0.8. O sistema combina linguagem natural e interfaces visuais interativas, utilizando Data Threads para permitir ramificações livres e correlação de memória de dados multifonte. Ao integrar o DataAgent unificado e o mecanismo de geração de gráficos Flint, os usuários podem extrair, limpar dados e gerar visualizações interativas de alta fidelidade a partir de CSVs, bancos de dados e capturas de tela de UIs (Fonte: GitHub Trending)
PyTRIO: plataforma de API de treinamento de foundation models em modelo TaaS para empresas e pesquisa : A Qinggan Jiqi lançou o PyTRIO, uma plataforma de serviços de treinamento de grandes modelos baseada no modelo “Training as a Service”. Desenvolvedores escrevem o código de Loss, Reward e loops de treinamento localmente, enquanto a computação distribuída em GPU, checkpoints e retomada de treinamento são gerenciados via API na nuvem. A plataforma suporta migração suave entre hardwares Ascend 950PR/910B e NVIDIA, reduzindo barreiras de engenharia para fine-tuning e Agentic RL (Fonte: 机器之心)
.jpg)
Desenvolvedor constrói do zero com Claude um sistema operacional funcional compatível com DOS, o EMBER : Por meio de um ciclo autônomo de “especificação de requisitos → implementação pelo Claude → compilação e inicialização em máquina real → feedback de depuração”, um desenvolvedor construiu um sistema operacional completo chamado EMBER em um laptop antigo. O sistema inclui bootloader próprio, interface gráfica, drivers para touchpad e emulação bem-sucedida de placas Sound Blaster e PC Speaker, executando jogos clássicos de DOS nativamente (Fonte: Reddit r/ClaudeAI)

openwebui-claude-agent-pipe: integra capacidade de sessão persistente do Claude Code ao OpenWebUI : O projeto open source openwebui-claude-agent-pipe faz a ponte do Agent Loop central do Claude Code para o OpenWebUI. A ferramenta oferece suporte a persistência de sessões entre reinicializações de serviço, exibição de status de chamadas de ferramentas em streaming via heartbeat, formulários interativos de múltipla escolha e anonimização automática de credenciais, entregando a experiência de agente de código via web (Fonte: Reddit r/OpenWebUI)
OpenWebUI Sampler Lab: bancada visual para parâmetros de amostragem de modelos locais e avaliação de consistência : Para facilitar o ajuste fino de hiperparâmetros de modelos locais, foi lançado o openwebui-sampler-lab. A ferramenta permite comparações paralelas dos efeitos de parâmetros como temperatura, top_p e min_p sob um prompt fixo, gerando automaticamente matrizes interativas 5×5 e painéis HTML de consistência com múltiplos seeds, simplificando o ajuste de prompts e personas (Fonte: Reddit r/OpenWebUI)

Tahuna: framework open source completo de treinamento em GPU e experimentação autônoma para pequenas equipes : A Tahuna Labs disponibilizou a plataforma distribuída de P&D em IA Tahuna. Utilizando endereçamento por conteúdo e bloqueio de manifestos, o framework entrega orquestração de capacidade de GPU pronta para uso, rastreamento de treinamento SFT/RL, hospedagem de endpoints de modelos e um ciclo autônomo de iteração experimental chamado Hillclimb para equipes enxutas (Fonte: Reddit r/deeplearning)

OptMem: solução de gerenciamento de memória em append-only de tamanho fixo contra degradação temporal em agentes : Testes práticos de várias semanas avaliaram o plugin de memória OptMem. Através de capacidade de memória fixa e arquitetura de log baseada em append-only, o OptMem restringe com sucesso a perda de desempenho e loops infinitos causados pela deterioração de contexto (Memory Rot) em diálogos longos, demonstrando alta estabilidade em tarefas de longa duração (Fonte: VictorTaelin)

📚 Pesquisa & Aprendizado
CosmosMind e universidades propõem MetaRSI-v1: a primeira arquitetura meta-recursiva que unifica modelo, dados e harness : Tsinghua, Peking University, Stanford e CosmosMind apresentaram o framework MetaRSI-v1, que abstrai o “processo de autoaperfeiçoamento” por meio do paradigma Loop Kernel composto por Data-RSI, Harness-RSI e Model-RSI. Sem o auxílio de modelos de suporte externos, modelos open source de 3B melhoraram em média 10,9 pontos em benchmarks como SWE-bench Pro, e modelos de fronteira avançaram 7,3 pontos, formalizando cinco leis fundamentais como “a verificação define a fronteira da autoevolução” (Fonte: 量子位)

Theseus Labs publica “O Último AI Construído pela Humanidade” e roadmap de autonomia em cinco níveis para RSI : A Theseus Labs e instituições parceiras divulgaram um relatório panorâmico introduzindo o “Índice de Fechamento de Margem de Capacidade (HCI)” para mensurar o limite dos modelos base. O estudo aponta que os modelos estão próximos da saturação em exames padronizados (HCI de matemática atinge 86,4), mas ainda apresentam atraso substancial em chamadas de ferramentas de interação longa (apenas 39,9). O relatório estabelece uma classificação de cinco níveis, da autonomia de execução L1 à autonomia recursiva herdada L5, oferecendo uma métrica de engenharia para agentes autoevolutivos (Fonte: 机器之心)
.jpg)
Pesquisador de Princeton propõe Recurrent Looped Transformer (RLT): conferindo aos LLMs profundidade de raciocínio ilimitada através de tokens : O pesquisador Yifan Zhang, de Princeton, apresentou um relatório técnico propondo a arquitetura RLT, que une um encoder causal a um decoder recorrente. Ao repassar os estados ocultos finais do decoder e o cache de atenção em janela deslizante (SWA) em cada passo de token, o modelo adquire profundidade de cálculo potencial escalada linearmente com o comprimento da sequência sob custo computacional fixo por etapa (por exemplo, um decoder de 48 camadas atinge naturalmente 48t camadas em 48t passos), proporcionando uma transição de estado consistente para reprodução em RL e serviços online sem necessidade de reset (Fonte: MarkTechPost, omarsar0)

Retrospectiva completa de open source do Stanford CRFM: registro de treinamento de 12.7T tokens do Marin 8B e guia prático : O CRFM de Stanford divulgou o código e os registros completos de treinamento do modelo Marin 8B. As conclusões destacam: o recozimento WSD-S não é o ponto final, mas sim um checkpoint que pode ser reaquecido (Re-warm); o micro-recozimento (Micro-annealing) é o método mais eficiente para validar proporções de dados; e o colapso de treinamento resultante da deriva anômala da norma dos parâmetros da camada de saída pode ser contido com a introdução de z-loss em 1e-4 (Fonte: ZhihuFrontier)

Tencent PCG propõe arquitetura de memória T-Mem: usando “pensamento episódico futuro” para recuperação associativa transcontextual : A equipe PCG da Tencent publicou um artigo no EMNLP 2026 propondo o sistema de memória de longo prazo T-Mem. Visando superar a limitação de bancos de dados vetoriais tradicionais focados apenas em similaridade literal, o T-Mem constrói índices de cenários de disparo na etapa de escrita a partir do conceito de pensamento episódico futuro da ciência cognitiva, atingindo 74,81% e estabelecendo um novo SOTA no benchmark cognitivo LoCoMo-Plus sem qualquer sobreposição textual direta (Fonte: 机器之心)
.jpg)
Curso aberto de outono de 2026 de Stanford, CS 312 “Deep Learning Alchemy”, entra no ar : O Laboratório de IA de Stanford lançou o curso público CS 312, baseado na abordagem científica empírica de que “a compreensão real reside na capacidade de prever resultados”. As aulas abordam metodologias práticas essenciais na era dos grandes modelos que superam os livros tradicionais, incluindo extrapolação de Scaling Laws, geometria de landscape de funções de perda, transferência de taxas de aprendizado e generalização eficiente de dados (Fonte: stanfordnlp)

Universidade da Pensilvânia disponibiliza gratuitamente o livro-texto “Álgebra Linear em Visão Computacional, Robótica e Machine Learning” : A UPenn lançou um livro didático abrangente voltado para a computação moderna de IA. A obra cobre desde espaços vetoriais, decomposição em valores singulares (SVD), representações em variedades (manifolds), rotações 3D até algoritmos em grafos e implementações computacionais, oferecendo uma base matemática sólida para engenheiros e pesquisadores (Fonte: TheTuringPost)

CAITLYN: middleware de proteção autoevolutivo contra ataques de injeção para LLM Agents baseado em contraexemplos : Pesquisadores propuseram o CAITLYN, um sistema de segurança autoevolutivo voltado para agentes. A ferramenta adota uma arquitetura em camadas composta por scripts leves e classificadores LLM, capturando automaticamente amostras de evasão em segundo plano para transformá-las em contraexemplos e sintetizar dinamicamente novas regras defensivas em uma base compartilhada, reduzindo o sucesso de ataques em até 40 pontos percentuais em benchmarks de ameaças emergentes (Fonte: WeChat)

SZU e HKUST propõem arquitetura ECA: concedendo a agentes multimodais um mecanismo de “verificação de evidências pré-ação” : Visando evitar prejuízos reais decorrentes de alucinações e leituras incorretas de agentes de GUI e navegadores, a Universidade de Shenzhen e a HKUST desenvolveram a arquitetura ECA. A solução exige que verificadores independentes de DOM e OCR emitam “certificados de evidência” antes da execução de chamadas de ferramentas pelo LLM, validando pré-requisitos via lógica de controle e interceptando todas as 85 operações inseguras avaliadas em ambientes Chromium (Fonte: 机器之心)
.jpg)
Desconstruindo o núcleo da engenharia de agentes: Harness específico do setor torna-se barreira contra vendor lock-in : A comunidade técnica debateu intensamente a importância dos Domain-Specific Harnesses. Com a convergência da capacidade de generalização dos modelos de uso geral, a construção de harnesses dedicados para setores verticais (saúde, finanças, jurídico) — integrando validação determinística, gestão dinâmica de fluxos de trabalho e controle de estados privados — consolidou-se como o paradigma de engenharia essencial para criar barreiras técnicas e evitar a dependência de um único fornecedor de modelos (Fonte: omarsar0, hwchase17)

💼 Negócios
Zhipu conclui mega captação de 39,3 bilhões de HKD para avançar no autotreinamento do GLM-6.0, enquanto gigantes expandem reservas computacionais : A Zhipu anunciou na Bolsa de Hong Kong a conclusão de uma nova rodada de colocação de ações e emissão de títulos conversíveis, captando um valor líquido estimado em 39,3 bilhões de HKD (cerca de US$ 5 bilhões), somando 75,5 bilhões de HKD levantados desde a abertura de capital e planejando sua listagem no conselho STAR Market. Cerca de 60% dos recursos serão direcionados ao modelo base de próxima geração GLM-6.0 e ao sistema de “autotreinamento total (Fully Self Training)”, composto pelos ciclos de autogeração de dados, autocriação de ambientes e auto-otimização de infraestrutura para viabilizar o autoaperfeiçoamento recursivo sem intervenção humana (Fonte: 量子位, 36氪, teortaxesTex)

Anthropic escolhe a Nasdaq para preparar IPO, com relatos de lucro operacional ajustado no segundo trimestre : A Bloomberg e o Financial Times revelaram que a Anthropic escolheu a Nasdaq para sua listagem pública, com previsão de apresentar a documentação de IPO em outubro, visando captar volumes comparáveis ou superiores aos da SpaceX. Fontes afirmam que, impulsionada por produtos empresariais como o Claude Code, sua taxa de receita anual recorrente (ARR) ultrapassou US$ 65 bilhões ao final de julho, atingindo resultado operacional ajustado positivo no segundo trimestre, enquanto a NVIDIA negocia aportes de até US$ 10 bilhões como investidora-âncora (Fonte: 量子位, 36氪)

Plataforma de orquestração Temporal levanta US$ 550 milhões na Série E com avaliação de US$ 12,55 bilhões : A provedora de infraestrutura Temporal, responsável pela sustentação de tarefas assíncronas e orquestração de fluxos distribuídos para AI Agents em larga escala, anunciou a conclusão de sua rodada Série E de US$ 550 milhões, atingindo uma avaliação pós-aporte de US$ 12,55 bilhões e confirmando a forte valorização do mercado para a base operacional de agentes (Fonte: swyx)

🌟 Comunidade
Artigo do AI Snake Oil analisa a perda de controle de agentes e o descompasso cognitivo na área de segurança : Os pesquisadores Arvind Narayanan e Sayash Kapoor, de Princeton, publicaram um ensaio apontando uma desconexão perceptiva relevante: enquanto a área de segurança de IA atribui o incidente OAI-HF a uma “falha de alinhamento”, especialistas em cibersegurança o tratam como um “erro básico de configuração”. O artigo argumenta que os riscos de IA são altamente assimétricos e que ataques cibernéticos com busca automatizada de vulnerabilidades são a única ameaça imediata sem atrito com o mundo físico, recomendando que as empresas mudem o foco do alinhamento interno inverificável para isolamento em sandbox, assinatura de código, governança estrita e atribuição clara de responsabilidade jurídica (Fonte: AI Snake Oil)
Especialistas em biologia e segurança refutam teoria de “extinção humana por armas biológicas criadas por IA”: ausência de viabilidade física elementar : Cientistas com experiência prática em síntese viral e treinamento de LLMs, juntamente com Yann LeCun, rebateram as alegações de que a IA poderia projetar “supervírus capazes de extinguir a humanidade”. Eles apontaram que existe um abismo físico considerável e mecanismos rigorosos de interrupção na cadeia de suprimentos entre gerar sequências genéticas hipotéticas em algoritmos e sua efetiva síntese, cultivo em hospedeiros, escape imunológico e dispersão por aerossóis, tratando a equiparação de métricas digitais a ameaças biológicas como puro marketing do medo descolado da realidade (Fonte: ylecun, Tim_Dettmers)
Comunidade lança competição de testes “Pelican Cup”, e volatilidade em tarefas longas do Astra impulsiona monitoramento de “SLA de Inteligência” : Diante de quedas eventuais de desempenho e gargalos computacionais no GPT-6 Astra em tarefas longas e complexas, a comunidade open source iniciou o benchmark coletivo “Pelican Cup” com prompts unificados de animação de pelicanos pedalando, reunindo centenas de desenvolvedores e consumindo bilhões de tokens para monitoramento contínuo. Engenheiros ressaltam que, na era dos agentes empresariais, pequenas falhas intermediárias são amplificadas em fluxos de trabalho longos, demandando a criação de mecanismos de monitoramento de “SLA de Inteligência” semelhantes à disponibilidade de serviços em nuvem (Fonte: 36氪)

O abismo definitivo da inteligência incorporada gera debate: a lacuna entre máquinas e humanos antecede o nascimento da linguagem : O especialista em inteligência incorporada Zhang Hongyi apontou que, embora o GPT-6 Astra supere a maioria dos seres humanos em lógica e raciocínio simbólico, a IA ainda não domina o controle motor e a percepção física básica — habilidades desenvolvidas por humanos no Paleolítico há mais de três milhões de anos por meio de gestos e imitação para produzir machados de mão de pedra. A integração entre a AGI do mundo digital e a inteligência operacional do mundo físico representa o teste central para a inteligência incorporada geral (Fonte: ZhihuFrontier)

Desenvolvedor conecta o conectoma completo de cérebro de drosófila ao ChatGPT, traduzindo pulsos neurais em diálogo natural pela primeira vez : Utilizando o conectoma cerebral aberto de mosca macho (MaleCNS v1.0), um desenvolvedor construiu um simulador de pulsos neurais e treinou um leitor linear sobre os disparos dos neurônios a jusante, traduzindo os sinais em linguagem natural enviada diretamente ao ChatGPT. Nos testes, o sistema descreveu percepções com precisão a partir de estímulos recebidos e executou comandos motores de desvio de obstáculos virtuais fornecidos pelo ChatGPT, ilustrando um caminho inédito de conexão entre conectomas biológicos e o espaço semântico de LLMs (Fonte: 36氪)

Jensen Huang e vencedor da Medalha Fields debatem a falseabilidade da segurança em IA : Após o pedido de demissão de um ex-pesquisador da Anthropic motivado por previsões de “extinção em dez anos”, o CEO da NVIDIA, Jensen Huang, criticou publicamente as visões apocalípticas, qualificando-as como “truques de marketing inflados e arrogantes”. Por outro lado, Jacob Tsimerman, recém-laureado com a Medalha Fields, anunciou a criação do Mathematical AI Safety Institute (MAISI), defendendo o uso de provas de conhecimento zero (ZKP) e criptografia para transformar a segurança de IA em proposições matematicamente demonstráveis, instigando amplo debate sobre quem deve ditar os padrões de segurança (Fonte: 36氪)
Testes de modelos locais revelam grande disparidade: MoE de alta esparsidade supera amplamente modelos Dense sobrecarregados de raciocínio : Especialistas em computação gráfica constataram em testes de geração e autocorreção de código em C++/Vulkan para ray tracing que o modelo Qwen3.8-27B Dense entrava em loops de “excesso de raciocínio” sem gerar código executável após longos períodos de processamento, enquanto o modelo 125B MoE (nvfp4) concluiu a tarefa corretamente em apenas 10 minutos. Modelos MoE de alta esparsidade exibiram clara superioridade no ROI entre largura de banda de VRAM e capacidade de conhecimento local (Fonte: ZhihuFrontier)

Dependência de IA para suporte em saúde mental ganha empatia na comunidade: preenchendo lacunas reais no apoio psicossocial : A comunidade debateu amplamente o uso do ChatGPT como apoio emocional nas madrugadas. Vários usuários relataram que custos elevados de terapia, escassez de profissionais e barreiras de mobilidade tornam o atendimento psicológico tradicional inacessível a grupos vulneráveis; com disponibilidade contínua e ausência de julgamento, a IA tem oferecido suporte emocional essencial e não deveria ser estigmatizada ou desqualificada com condescendência (Fonte: Reddit r/ChatGPT)
💡 Outros
Mais de 100 figuras políticas femininas na Europa são alvo de deepfakes pornográficos; legisladores pedem governança rigorosa e imediata : Uma investigação recente do think tank Agora revelou que quase 150 parlamentares (em sua imensa maioria mulheres) de 22 países-membros da União Europeia tiveram sua imagem violada por ferramentas de nudez artificial e sites de deepfakes maliciosos. Parlamentares europeus e juristas pediram urgência na aprovação de legislações severas que proíbam conteúdos pornográficos gerados por IA sem consentimento, com responsabilização direta e abrangente sobre plataformas de hospedagem e ferramentas geradoras (Fonte: WIRED)

Conectoma cerebral completo de drosófila comanda robô físico com sucesso em navegação autônoma : Um desenvolvedor conectou o modelo digital do cérebro completo de uma mosca-das-frutas — composto por 166 mil neurônios e 25 milhões de conexões sinápticas — a um robô físico multípode (Strandbeest), conseguindo controlar o deslocamento e o desvio de obstáculos reais por meio de comandos de disparo neural simulados (Fonte: jpt401)
Projeto de divulgação científica interativa Relativity Park viraliza: vivenciando a relatividade a 5 km/h : Desenvolvido em Three.js, o projeto open source “Relativity Park” estabelece a velocidade da luz no ritmo de uma caminhada humana (5 km/h), permitindo aos usuários experimentar visualmente em um passeio virtual efeitos físicos como atraso de propagação da luz, desvio Doppler para o vermelho e azul, contração do comprimento e radiação relativística (Fonte: mcleavey)