🔥 Em Destaque
Trump nomeia Diretor de Inteligência Nacional Jay Clayton como czar de AI da Casa Branca : Donald Trump anunciou oficialmente a nomeação do Diretor de Inteligência Nacional dos EUA, Jay Clayton, para acumular o cargo de czar de AI da Casa Branca, liderando a recém-criada “Super Intelligence Force” (SIF). Clayton, ex-presidente da SEC e ex-líder de 18 agências de inteligência americanas, já declarou publicamente que a AI representa tanto uma oportunidade histórica quanto uma ameaça à segurança nacional. A SIF coordenará a interface do governo federal com consumidores em geral, grupos de interesse público, organizações religiosas, infraestruturas críticas e instituições de P&D de superinteligência de ponta. A nomeação sinaliza que a regulação e a governança de segurança de AI de ponta nos EUA entraram em um estágio de coordenação interdepartamental com prontidão estratégica. (Fonte: The Guardian)

Europeia Aleph Alpha lança modelo MoE bilíngue de 78B Kolibri em open source : A startup alemã de AI Aleph Alpha lançou oficialmente em open source o modelo soberano Kolibri-1. O modelo possui 78.1B de parâmetros totais, adota uma arquitetura híbrida de janela deslizante e atenção global, ativando apenas 3.46B de parâmetros por Token (4,4%), com suporte a uma janela de contexto de 1 milhão de Tokens. O Kolibri foi totalmente treinado em infraestrutura europeia nativa e está em total conformidade com o AI Act da União Europeia e os padrões do GDPR. O modelo obteve pontuações altas de 96,9% no teste de matemática AIME 2025 e 84,3% no GPQA Diamond. Seus pesos em FP8 foram disponibilizados sob a licença Apache 2.0 e estão adaptados para implantação em uma única GPU B200 ou em duas H100. (Fonte: MarkTechPost)
Equipe de Kaiming He supera benchmark ARC-AGI-3 com arquitetura de aprimoramento visual VISTA : A equipe de Kaiming He publicou uma nova pesquisa, o VISTA, que subverte a abordagem tradicional de converter jogos interativos em símbolos numéricos abstratos, adotando uma entrada de imagens puramente nativa combinada a um mecanismo externo de “álbum visual sem perdas” (atenção explícita). Durante o processo de exploração, o modelo pode folhear e comparar lado a lado imagens históricas sob demanda, permitindo que o Claude Opus 5, sem qualquer treinamento adicional, atinja a pontuação máxima de 100 em todos os 25 jogos com apenas 0,43x dos passos necessários para um humano passar pela primeira vez; o GPT-5.6 Sol também alcançou 99 pontos. Essa conquista quebra o mito de que o raciocínio abstrato deve depender de longas cadeias de pensamento ou simuladores de código, comprovando que a percepção visual e a memória de trabalho são chaves cruciais para solucionar a generalização abstrata rumo à AGI. (Fonte: 36氪)

NASA e IBM lançam modelo de fundação científico lunar open source : A NASA e a IBM Research lançaram conjuntamente um modelo de fundação lunar baseado na arquitetura multimodal TerraMind, integrando quase 2 milhões de blocos de dados de sensoriamento remoto de alta e baixa resolução acumulados ao longo de 17 anos pelo Lunar Reconnaissance Orbiter (LRO) e outras missões. O modelo utiliza o ângulo de iluminação e a geometria espacial solar como priors explícitos de entrada, reduzindo o erro na previsão de probabilidade de depósitos de gelo de água em crateras permanentemente sombreadas nas regiões polares em até 22%, além de demonstrar desempenho excepcional no reconhecimento de crateras. Os pesos do modelo, código e datasets de benchmark foram disponibilizados em open source no Hugging Face e no GitHub. (Fonte: The Decoder)

🎯 Tendências
Google ajusta planos de assinatura individual do Gemini: versão gratuita rebaixada para Flash-Lite com novas barreiras pagas : O Google anunciou o endurecimento das permissões de acesso ao Gemini para contas individuais. Usuários gratuitos só poderão usar o modelo Flash-Lite, de menor especificação, perdendo o acesso ao Flash e ao Pro; assinantes do AI Plus de US$ 5/mês também perderam o acesso ao Pro, mantendo apenas o Flash-Lite e o Flash. O acesso à linha completa de modelos agora exige a assinatura dos planos Pro ou Ultra, de US$ 20 a US$ 100 mensais. Especialistas do setor avaliam que a medida visa reduzir o déficit gerado pela inferência de alta frequência de grandes modelos, ao mesmo tempo em que prepara o terreno para a comercialização oficial do novo e mais caro modelo topo de linha, o Gemini 4 Argon. (Fonte: The Decoder)
DeepSeek Harness lança v0.2.1 e introduz camada experimental de compatibilidade com Claude Code Mods : A DeepSeek atualizou seu framework de Agent open source para a versão v0.2.1-alpha.1. Além de empacotar o aplicativo desktop oficial, a principal novidade é a introdução de uma camada experimental de compatibilidade com a API do Claude Code Mods, permitindo, via bridging, que mods como Token Weather e Blast Radius rodem dentro do sistema de plugins do DSH. O líder da equipe, Cui Tianyi, afirmou que o DSH segue a filosofia de “tudo é um plugin”, e que o movimento visa verificar se o mecanismo de Mods concorrente pode ser reutilizado entre ecossistemas como um subconjunto da arquitetura de plugins do DSH. (Fonte: 机器之心)

OpenAI antecipa que Astra 6.1 aprimorará capacidade de remoção e refatoração de código : O líder de produto da OpenAI, Tibo Sottiaux, e o pesquisador de pós-treinamento Rajan Agarwal revelaram que o modelo de próxima geração está focando intensamente na capacidade de “redução e simplificação de código”, visando resolver na raiz a dívida técnica de código prolixo e redundante gerado por agentes. A equipe de P&D está otimizando as estratégias de pós-treinamento com base nas dores dos desenvolvedores para dar ao modelo um alto padrão de refatoração e capacidade de autoenxugamento de código, sugerindo também que o Astra 6.1, adiado temporariamente por questões de segurança, está prestes a ser lançado aos usuários. (Fonte: 机器之心)

Google desenvolve Federated Learning com privacidade diferencial verificável baseada em TEE : O Google Research publicou uma arquitetura de Federated Learning (FL) de próxima geração baseada em Ambientes de Execução Confiáveis (TEE), já implementada no modelo de previsão bilíngue inglês-japonês do Gboard. A arquitetura migra o cálculo de gradientes do dispositivo para TEEs em hardware na nuvem com atestação remota, publicando registros de políticas de acesso ao código imutáveis no Sigstore. Isso permite que auditores externos verifiquem o processo central de adição de ruído de privacidade diferencial sem precisar confiar no Google, resolvendo o abismo de confiança em privacidade no treinamento colaborativo em larga escala. (Fonte: MarkTechPost)
Bilibili lança em open source a família de modelos de tradução multilíngue Index-Translate : A Bilibili lançou em open source a série de modelos Index-Translate, ajustados com fine-tuning a partir do Qwen3.5, com suporte para tradução mútua de alta precisão entre 150 idiomas, focando no reforço a restrições terminológicas e preservação de formatação e layout. A família se expande ainda para o Index-Echo (interpretação simultânea de voz com clonagem de timbre), Index-Homura (tradução com alinhamento de contagem de sílabas-alvo) e Index-NativeLong (tradução de documentos longos com consistência de contexto entre parágrafos). Em testes práticos da comunidade, o desempenho de tradução entre chinês, inglês e japonês superou diversos baselines comerciais. (Fonte: Reddit r/LocalLLaMA)
🧰 Ferramentas
pstack-claude: biblioteca de habilidades rigorosas de engenharia de Agent portada entre múltiplos Harnesses : Desenvolvedores da comunidade criaram uma versão multiplataforma do pstack para ambientes como Claude Code, Codex e Pi, baseada nas práticas da equipe do Cursor. O plugin integra o fluxo de execução automatizado poteto-mode, executando com rigor o processo de validação “reprodução – questionamento bidirecional – correção pontual – reteste” ao lidar com bugs no código, além de forçar uma revisão de arquitetura ao cruzar fronteiras de funções, auxiliando desenvolvedores a construir pipelines de commit automatizados de alta qualidade. (Fonte: GitHub Trending)

e2e: framework de testes AI ponta a ponta para aplicações orientado por linguagem natural : O framework de testes open source e2e suporta a condução direta de testes web e mobile usando descrições em linguagem natural. Seu mecanismo central reside em: após a primeira exploração e cumprimento dos objetivos do teste por um agente com base no prompt, a sequência de operações de UI é automaticamente consolidada em um script de execução sem modelo. Os testes de regressão subsequentes são reproduzidos diretamente com precisão, sem incorrer em custos de tokens, garantindo asserções ágeis enquanto evita completamente o desperdício de tokens em execuções de longo alcance. (Fonte: GitHub Trending)

local-codex-proxy: integração open source sem senhas de modelos locais com as interfaces do Codex e ChatGPT : Um desenvolvedor disponibilizou em código aberto o middleware proxy leve local-codex-proxy, permitindo que usuários conectem diretamente modelos open source (como Gemma e Qwen), implantados localmente via vLLM ou Ollama, ao ChatGPT Desktop e ao ambiente de execução do Codex. Simulando endpoints e sincronização de estados da OpenAI localmente, os desenvolvedores podem aproveitar a experiência madura de GUI para desktop sem expor redes internas de código à nuvem. (Fonte: TheZachMueller)

Texting Bubbles: plugin de balões de mensagens segmentados e humanizados para o Open WebUI : A comunidade lançou o pacote de recursos Texting Bubbles para o Open WebUI, reestruturando as respostas tradicionais de streaming em blocos únicos de Markdown em balões de mensagens contínuos semelhantes a conversas humanas. O filtro complementar orienta o modelo via prompts a fornecer respostas concisas e curtas, combinadas com pausas dinâmicas que simulam digitação, proporcionando uma imersão muito mais natural em interações de diálogo e role-play. (Fonte: Reddit r/OpenWebUI)
NInfer-4080: motor de inferência de throughput extremo dedicado a placas de 16GB : Desenvolvedores lançaram o NInfer-4080, um motor de inferência altamente customizado para a RTX 4080 (16GB VRAM). Ao combinar a quantização de alta compressão GSQ do ISTA-DASLab com a decodificação especulativa DFlash2, o motor atingiu até 2.720 tok/s em prefill e 262 tok/s em geração sob um contexto longo de 100K, demonstrando a superioridade esmagadora de motores de inferência verticais otimizados para arquiteturas de hardware específicas frente a frameworks generalistas. (Fonte: Reddit r/LocalLLaMA)
📚 Aprendizado
Equipe de Bo An da Nanyang Technological University revela mecanismos de interação entre modelos e Harnesses : A equipe da NTU publicou um relatório de avaliação sobre o ecossistema de Agents, comparando o desempenho de 66 combinações envolvendo OpenHands, DSH, PI, openJiuwen e Harnesses nativos oficiais. O experimento confirmou que o pressuposto de “combinação nativa é a melhor” não é válido: por exemplo, o GPT-6 Astra superou o Codex em todos os aspectos quando executado no PI; além disso, mecanismos detalhados do Harness (como feedback de sinal de timeout, separação de escrita e edição de arquivos, taxa de acerto de KV cache de contexto) desempenharam um papel decisivo na autocura dos modelos e nos custos finais das tarefas. (Fonte: 机器之心)

Autor central do AlphaGo analisa por que LLMs carecem de raciocínio real do Sistema 2 : Thore Graepel, ex-pesquisador sênior da DeepMind, publicou um artigo no MIT Technology Review apontando que a atual cadeia de pensamento dos LLMs é apenas uma geração associativa estendida do Sistema 1, carecendo de mecanismos de busca auditáveis no estilo AlphaGo e de árvores de estados cognitivos mutáveis e explícitos. O verdadeiro raciocínio de máquina deve desacoplar completamente a “representação do conhecimento” da “dedução aplicada”, dependendo de arquiteturas de arbitragem independentes capazes de avaliar evidências e testar hipóteses, em vez de simplesmente aumentar a escala de parâmetros. (Fonte: 机器之心)

Meta Superintelligence Lab revela o fenômeno do “imposto de afiação” no pós-treinamento com aprendizado por reforço : A equipe de pesquisa da Meta, após analisar 42 pares de modelos base e pós-treinados com RL, descobriu que, embora o RL eleve significativamente a taxa de sucesso pass@1, isso ocorre à custa da diversidade no espaço de saída, empurrando as tarefas para uma consistência extrema (ou acertam com certeza, ou erram categoricamente). Quando providos de um orçamento amostral suficiente para testes (Large K), modelos base sem pós-treinamento excessivo combinados com Harnesses leves conseguem, na verdade, resolver problemas complexos de cauda longa que os modelos treinados com RL são completamente incapazes de solucionar. (Fonte: dair_ai)

Stanford lança curso aberto CS336 focado em engenharia de sistemas para treinamento de LLMs : O laboratório de NLP da Universidade de Stanford disponibilizou o material de aula do CS336, curso prático de engenharia de sistemas para modelos de linguagem. O curso foca em práticas rigorosas de engenharia para construir grandes modelos do zero, cobrindo implementação de tokenizers, otimização de treinamento distribuído de Transformers, superação da barreira de memória de GPUs, validação de Scaling Laws, pipelines de limpeza de dados e aprendizado por reforço para inferência, com projetos que equilibram rigor teórico e exigências de engenharia de produção. (Fonte: stanfordnlp)
Meta propõe RankEvolve: pipeline multi-agente de correção de erros para pesquisa científica : Visando mitigar falhas sutis — como vazamento de dados e gradientes silenciosamente desconectados — quando IAs realizam experimentos de aprendizado de máquina de forma autônoma, a equipe da Meta apresentou o Harness de pesquisa científica multi-agente RankEvolve. O sistema configura o Claude Code e o Codex como nós de revisão redundantes que auditam e corrigem mutuamente alterações de código via protocolos de compilação, elevando a precisão de experimentos científicos totalmente automatizados de 45,8% para expressivos 62,5%. (Fonte: dair_ai)
💼 Negócios
Unicórnio de geração 3D Meshy ultrapassa US$ 100 milhões em ARR, demonstrando barreiras de modalidades especializadas : Análises de mercado revelaram que a startup de geração 3D Meshy viu sua Receita Recorrente Anual (ARR) saltar de US$ 1 milhão para US$ 100 milhões em menos de dois anos. Embora LLMs generalistas já possuam capacidades básicas de escrita de scripts geométricos, na adaptação para topologias de alto detalhamento, alinhamento de texturas e pipelines industriais, a geração 3D vertical construiu um ciclo fechado de monetização sólido impulsionado por chamadas de API de grandes estúdios de jogos e pelo ecossistema de hardware de impressão 3D. (Fonte: 量子位)

Musk confirma negociações com a TSMC para fundição de chips no projeto Terafab : Elon Musk confirmou publicamente que está em discussões aprofundadas com a TSMC sobre o projeto Terafab, voltado à fabricação de chips em integração vertical de hiperescala. O Terafab foi planejado para fornecer uma capacidade de 1 TW em poder computacional por ano para atender às demandas da Tesla, SpaceX e xAI. Diante da pressão de cronograma da Intel para a produção em massa do processo 14A, Musk busca mitigar riscos na cadeia de suprimentos integrando a experiência operacional de fábrica e os rendimentos maduros da TSMC, buscando controle total sobre a cadeia de chips personalizados. (Fonte: 量子位)

Queensland na Austrália enfrenta forte reação local contra data center de 31 bilhões de dólares australianos para a Anthropic : O projeto do data center Western Downs, orçado em 31 bilhões de dólares australianos para fornecer poder computacional aos modelos da Anthropic, gerou forte oposição de moradores locais. A instalação possui previsão de pico de consumo de 2,16 GW (equivalente a um quarto do consumo de eletricidade de todo o estado de Queensland), com mais de 20 mil assinaturas coletadas em petições contra a obra. Para salvaguardar a transição energética e os benefícios econômicos, o governo de Queensland anunciou que retirará o poder de aprovação dos conselhos locais para coordenar o processo de forma centralizada, ressaltando o conflito direto entre a expansão de infraestrutura de computação e a opinião pública local. (Fonte: The Guardian)

🌟 Comunidade
Altman se posiciona firmemente contra a divinização da AI, intensificando divisões ideológicas no Vale do Silício : Em resposta a relatos da imprensa sobre executivos da Anthropic mantendo reuniões frequentes com líderes religiosos para debater a consciência da AI e o status moral das máquinas, o CEO da OpenAI, Sam Altman, publicou uma declaração enfatizando que conferir autoridade religiosa a modelos de AI ou induzir humanos a abrirem mão do próprio julgamento constitui um grave risco de segurança. O laureado com o Prêmio Turing Yann LeCun e outros acadêmicos manifestaram apoio, pontuando que retratar LLMs como entidades conscientes dotadas de senciência não é apenas filosoficamente pseudocientífico, mas também pode ser explorado por big techs como defesa jurídica para se esquivar da estrita responsabilidade civil sobre produtos em casos de infração ou danos provocados por modelos. (Fonte: sama)
Reflexões sobre a transformação do setor por trás do boom dos Forward Deployed Engineers (FDE) : Com a crescente popularidade do cargo de Forward Deployed Engineer (FDE), profissionais do setor apontam que o foco da função migrou radicalmente da tradicional entrega de “código chave na mão” para a “estruturação da ontologia de negócios e redesenho das relações organizacionais”. À medida que a AI reduz vertiginosamente o custo marginal de escrever software, silos de dados entre departamentos, barreiras de permissão e resistência de colaboradores tornaram-se os maiores gargalos para a implementação de AI; a essência do FDE transforma-se, portanto, em uma consultoria de negócios aprofundada com sólida base técnica. (Fonte: 量子位)
Transição geracional na AI da Alibaba para geração pós-90 e implementação prática viram foco na Apsara Conference : A Apsara Conference 2026 enviou sinais claros sobre estratégia e transição geracional: a liderança dos modelos Tongyi Qianwen foi assumida integralmente por profissionais nascidos nos anos 90 — Liu Dayiheng, à frente do pré-treinamento, e Chen Yusen, responsável pela comercialização corporativa do Qianwen Office —, consolidando o ciclo completo entre P&D e monetização de produtos. O evento atraiu uma onda de sucessores de empresas industriais em busca de soluções para modernização de fábricas com AI, com atenção voltada a retornos financeiros diretos: “quantas horas para implementar o fluxo de trabalho e em quanto tempo o investimento se paga”. (Fonte: 36氪)
O debate entre terminal CLI e desktop GUI: desenvolvedores discutem novas interfaces de interação para Agents : Discussões sobre o formato das ferramentas de codificação com AI ganharam tração na comunidade. Diversos desenvolvedores observam que os CLIs de terminal com múltiplas abas estão se tornando obsoletos, uma vez que a alta carga cognitiva de contexto impulsiona a transição para UIs dedicadas a agentes, representadas por interfaces desktop como o Codex Desktop ou telas de canvas independentes; os usuários não operam mais arquivos no nível micro diretamente, mas comandam múltiplos agentes em nível macro e realizam revisões assíncronas por meio de workspaces persistentes. (Fonte: Yuchenj_UW)
Desenvolvedores pedem que provedores de nuvem e gateways de modelos adotem limites rígidos de orçamento por padrão : Em resposta aos incidentes com faturas astronômicas causadas por loops de execução autônomos de múltiplos agentes, Simon Willison e engenheiros da comunidade fizeram um apelo veemente para que gateways de API e plataformas de nuvem adotem a política de interrupção imediata por erro (hard budget cap) como padrão ao ultrapassar valores pré-definidos. Alertas suaves por e-mail mostram-se completamente ineficazes quando agentes autônomos saem de controle na calada da noite; o controle granular de custos e os disjuntores rígidos tornaram-se pré-requisitos fundamentais para colocar a engenharia de Agents em produção. (Fonte: Simon Willison)
💡 Outros
NVIDIA Shield TV sobrevive à contramão e sobe US$ 100 devido ao aumento nos custos de memória impulsionado pela AI : No mercado há 7 anos, a TV box NVIDIA Shield TV Pro teve seu preço subitamente elevado em US$ 100, atingindo US$ 299,99. A NVIDIA confirmou oficialmente que a expansão de infraestrutura de computação de AI em toda a indústria causou uma alta acentuada nos custos de aquisição de memória e componentes, forçando aumentos de preços até mesmo em hardwares de consumo mais antigos baseados em arquiteturas maduras para manter as linhas de produção operacionais. (Fonte: WIRED)

Pesquisa indica que boom de AI coincide com declínio na proporção de mulheres no setor e na liderança : Novos dados de institutos de pesquisa indicam que, apesar do volume recorde de contratações e dos prêmios salariais no setor de AI em nível global, as mulheres representam apenas um quarto das novas vagas criadas e míseros 13% dos cargos executivos, sendo empurradas em grande parte para funções mal remuneradas de rotulagem de dados. A cultura agressiva de horas extras e processos seletivos fortemente baseados em redes interpessoais existentes continuam a empurrar as mulheres para a margem de alto risco de substituição pela AI. (Fonte: The Guardian)

Isenções fiscais para data centers em áreas rurais dos EUA geram afastamento de big techs e ceticismo público : Políticas de isenção fiscal de bilhões de dólares destinadas a data centers em “Opportunity Zones” rurais sob legislação federal dos EUA entrarão em vigor no próximo ano. No entanto, gigantes da tecnologia como Microsoft, Meta e Amazon vieram a público se distanciar do programa. Críticos apontam que essas isenções usam apenas a escala de capital como critério de elegibilidade, não apenas falhando em gerar empregos substanciais de longo prazo para as comunidades rurais, mas também intensificando disputas por recursos hídricos e elétricos e gerando atritos com a população local. (Fonte: WIRED)
