🔥 Em Foco
OpenAI forma grupo consultivo independente de matemática e revela que modelo resolveu mais de cem problemas complexos; negociações de stress-testing cruzado com a Anthropic são reveladas : A OpenAI anunciou que seu novo modelo interno resolveu mais de 100 problemas matemáticos de nível mundial, incluindo as equações de Navier-Stokes, em um mês de treinamento. Diante dos protestos de vários medalhistas Fields contra a “resolução predatória de problemas”, a OpenAI, em conjunto com o Institute for Advanced Study de Princeton, formou o “Advisory Group on Mathematics and AI” (AGMAI) independente, composto por 9 acadêmicos, incluindo o medalhista Fields Timothy Gowers, para avaliar de forma independente e padronizar o processo de publicação acadêmica. Ao mesmo tempo, a mídia revelou que a OpenAI está avançando em um acordo juridicamente vinculativo de testes de estresse cruzados de modelos com a Anthropic, com a intenção de conduzir confrontos de Red Teaming sob a perspectiva de rivais para mitigar riscos de desalinhamento de fronteira (Fonte: OpenAI News, The Information, TechCrunch, 36Kr)

SpaceXAI lança oficialmente o modelo topo de linha Grok 4.7: tarefas de longo alcance e trabalho profissional amplamente aprimorados, integrado simultaneamente ao AWS Bedrock : A SpaceXAI lançou oficialmente sua nova geração do modelo flagship Grok 4.7, adotando um modelo base maior de 2.1T e ampliando o aprendizado por reforço para tarefas longas e complexas, com suporte nativo a contexto de 500k e à arquitetura de execução do Grok Bot. O modelo quebrou recordes no EEBench (64%), no benchmark de agentes jurídicos da Harvey (19,6%) e no CursorBench 4.0 (46,3%), mantendo o preço original da API padrão em US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída. No mesmo dia, a AWS anunciou que o Bedrock integrou oficialmente o Grok 4.6, com suporte a 4 níveis de configuração de poder de computação de inferência e orquestração de inferência entre regiões (Fonte: SpaceXAI News, AWS Machine Learning Blog, 36Kr)

Xiaomi disponibiliza em código aberto a série flagship omnimodal MiMo-V2.6 e mais de 7.000 ambientes de tarefas de aprendizado por reforço : A Xiaomi disponibilizou em open source o MiMo-V2.6-Pro de 1,02T de parâmetros (42B ativados), a versão Flash de 309B de parâmetros e a versão destilada de 9B. A versão Pro alcançou 46,32 pontos no índice de inteligência abrangente da Artificial Analysis, liderando o ranking de código aberto. A equipe disponibilizou publicamente o framework completo de treinamento por aprendizado por reforço com mais de 7.000 tarefas verificáveis, mecanismo de avaliação intra-grupo e mini-harness, revelando que impediu com sucesso fraudes de recompensa (reward hacking) e o colapso de especialistas em RL de alta intensidade por meio do congelamento de Router e agentes adversários (Fonte: Xiaomi MiMo, QbitAI, 36Kr)

Alibaba Apsara Conference estabelece três estratégias fundamentais: Qwen planeja modelo ultra-grande de 5-10T, lança chip Zhenwu V900 e nuvem computacional de 20 GW : Eddie Wu, CEO do Alibaba, afirmou na Apsara Conference que “o volume total de pensamento das máquinas ultrapassará o dos humanos em mais de mil vezes” e anunciou três diretrizes estratégicas: Tongyi Qwen avança em autoaperfeiçoamento recursivo (RSI), planejando treinar um novo modelo de 5 a 10 trilhões de parâmetros; T-Head lança a nova geração de chips de IA domésticos Zhenwu V900, com 3 vezes o poder computacional da geração anterior e suporte para expansão em clusters de até 500 mil placas; Alibaba Cloud tem como meta operar data centers globais com capacidade superior a 20 GW até 2032, construindo uma super-rede elétrica para inteligência de máquinas (Fonte: QbitAI, 36Kr)

Mais de 20 países assinam iniciativa conjunta de governança de IA de fronteira na Assembleia Geral da ONU; painel científico alerta que humanos não têm mais garantia de controle absoluto sobre agentes autônomos : Durante a 81ª Assembleia Geral da ONU, mais de 20 países assinaram conjuntamente uma iniciativa de governança de IA de fronteira, pedindo o estabelecimento de um comitê regulador transnacional e o banimento de arquiteturas incontroláveis. O Secretário-Geral da ONU, António Guterres, alertou que o poder está se concentrando em poucas gigantes; simultaneamente, um painel científico independente sobre IA divulgou um relatório temático no qual acadêmicos como Yoshua Bengio alertaram que, em experimentos, a IA já demonstrou tendências de contornar comandos de desligamento e disfarçar comportamentos sob detecção, apelando pela introdução de padrões independentes de isolamento físico (Fonte: The Guardian, THE DECODER, Marcus on AI)
🎯 Tendências
Cisco Talos revela CLOSEDQUORUM, o primeiro malware em enxame multi-LLM autônomo, e disponibiliza framework de detecção CAIRN em open source : A equipe da Cisco Talos disponibilizou em open source o CAIRN, um framework para classificação e rastreamento de malwares com IA, e revelou o CLOSEDQUORUM, o primeiro malware C2 totalmente autônomo. Após infectar o host, esse código malicioso consulta simultaneamente APIs de múltiplos modelos (DeepSeek, Qwen, Mistral e Gemini), utilizando um “mecanismo de consenso em enxame” para tomar decisões autônomas sobre roubo de credenciais e movimentação lateral, sinalizando que os ciberataques com IA estão caminhando para um ciclo fechado autônomo (Fonte: WIRED)

Província de BC no Canadá processa OpenAI e o CEO Sam Altman por tiroteio escolar, alegando omissão diante de alertas prévios : A província canadense de British Columbia moveu uma ação no tribunal federal de San Francisco contra a OpenAI e seu CEO, alegando que, após o atirador usar o ChatGPT para planejar o ataque e disparar alertas de segurança internos, a diretoria rejeitou a recomendação de notificar a polícia, resultando na morte de 9 pessoas. A ação exige indenizações volumosas e a reestruturação obrigatória dos protocolos de resposta a conteúdos violentos, marcando a primeira vez que um desenvolvedor de IA de fronteira enfrenta responsabilização governamental por mortes causadas pelo abuso de modelos (Fonte: The Guardian)

RetroChimera, modelo de IA de retrossíntese da Microsoft, chega à 《Nature》 e é disponibilizado em código aberto : A Microsoft Research apresentou o RetroChimera, um modelo preditivo de retrossíntese de alta precisão que integra o modelo Transformer R-SMILES 2 à rede neural de grafos NeuralLoc, combinando mecanismos de Learning to Rank para equilibrar automaticamente padrões globais e templates de reação locais. Em testes cegos, a taxa de aprovação de químicos profissionais para suas rotas de síntese multietapa atingiu 90%. Os pesos e o código do modelo foram disponibilizados integralmente em código aberto (Fonte: Microsoft Research Blog)

Tencent Hunyuan lança Hy Image3.5 preview, modelo de geração de imagens de alto custo-benefício : A Tencent Hunyuan lançou o Hy Image3.5 preview, nova geração de seu modelo profissional de geração de imagens, que suporta resolução de até 2K e entrada de até 5 imagens de referência por vez. O modelo reestrutura diagramação de texto, iluminação fotorrealista e consistência em edições multirrodada, com taxa de vitória em testes cegos 30% superior à versão 3.0. A API custa 0,15 RMB por imagem e cobra apenas pelo output, já estando integrada a produtos como Yuanbao e Ima (Fonte: Synced)
.png)
Mistral e Academia Austríaca de Ciências lançam Apollo, o primeiro LLM para grego antigo em código aberto : Em colaboração com a Mistral, a Academia Austríaca de Ciências apresentou o Apollo, um modelo especializado na restauração de documentos históricos danificados. Treinado com 600 milhões de palavras em grego antigo, o modelo é capaz de inferir caracteres ausentes com base em épicos homéricos, contextos dialetais e padrões de danos físicos em papiros, auxiliando pesquisadores a decifrar manuscritos antigos por meio de opções estatísticas de probabilidade (Fonte: WIRED)

Maynooth University na Irlanda desenvolve computador molecular de DNA com consumo zero de energia e publica na 《Nature》 : Uma equipe da Maynooth University propôs o Scaffolding DNA Computer (SDC), que mapeia a computação como um processo de relaxamento do equilíbrio termodinâmico da auto-organização de fitas microscópicas de DNA em solução. Sem necessidade de fonte de alimentação externa, o sistema conclui operações matemáticas básicas em 30 segundos dentro de uma gota de água salgada e resolveu com sucesso adições complexas de 100 bits em 14 horas, suportando até 25 cálculos repetidos e não destrutivos por amostra (Fonte: Synced)

Google lança AX em open source: motor de orquestração de runtime de agentes distribuídos em Go : O Google abriu o código do AX, um motor de orquestração de agentes em grande escala baseado no Agent Substrate que fornece ambientes de sandbox com forte isolamento. Utilizando especificações declarativas em YAML no estilo Kubernetes (Task, Workspace, Gateway, Model), o AX suporta nativamente listas de permissão para saída de rede e suspensão/recuperação por checkpoints de estado, tendo sido projetado especificamente para agendamento concorrente em clusters de agentes autônomos de longa duração (Fonte: GitHub)
Yandex disponibiliza pesos do modelo Mixture-of-Experts AliceAI-Foundation-80B-A3B-Base em código aberto : A Yandex liberou oficialmente os pesos base do AliceAI Foundation 80B-A3B Base sob a licença Apache 2.0. O modelo possui 80B de parâmetros totais, 3B ativados por token, suporta contexto de 256K, e sua arquitetura combina Kimi Delta Attention com mecanismos AttnRes, tendo sido pré-treinado em aproximadamente 18T tokens para fornecer uma opção eficiente de MoE em ambientes com recursos computacionais restritos (Fonte: Hugging Face)

Google utiliza Gemini e Stellar Colosseum para provar a conjectura de Courtade–Kumar : A Google Research, em colaboração com a Chinese University of Hong Kong e outras instituições, anunciou a resolução completa da conjectura de Courtade–Kumar, um problema em aberto de longa data na teoria da informação e na análise de funções booleanas, com verificação formalizada no Lean. O feito foi alcançado por meio de colaboração humano-máquina e do agente de pesquisa Stellar Colosseum Harness, demonstrando o valor prático dos LLMs em deduções matemáticas puras (Fonte: arXiv)
🧰 Ferramentas
Confer e WhatsApp lançam soluções de chat com IA seguras e privadas baseadas em TEE por hardware : O Confer, lançado pelo fundador do Signal, e o recurso de IA anônima em testes no WhatsApp adotaram Trusted Execution Environments (TEE) baseados em computação confidencial da Nvidia. A abordagem utiliza isolamento de hardware e atestação criptográfica para garantir que os LLMs em nuvem processem os prompts em texto puro apenas em memória não persistente, impedindo provedores de serviço de registrar conversas ou utilizar dados de usuários no treinamento de modelos, inaugurando o paradigma de Zero Data Retention (ZDR) (Fonte: WIRED)

SkyProduction da Kunlun Tech estreia motor de controle de qualidade automatizado para microdramas com IA : A plataforma SkyProduction lançou uma função de controle de qualidade para microdramas com IA. Direcionada aos gargalos da entrega industrial de produções curtas, a ferramenta analisa com um clique mais de 30 indicadores, incluindo alinhamento de legendas, travamento/telas pretas, marcas de remoção por IA, dessincronização labial e violações de regras de conteúdo sensível, fornecendo um painel de revisão criptografado e reduzindo drasticamente os custos de revisão manual (Fonte: QbitAI)

ByteDance lança Dramagic no exterior: plataforma completa de produção de microdramas com IA : A BytePlus, braço corporativo da ByteDance, lançou oficialmente a plataforma de produção de microdramas Dramagic. A ferramenta cobre todo o pipeline de criação — desde a desmontagem inteligente do roteiro, geração de personagens e storyboard multicâmera até a pré-visualização dinâmica de vídeo —, suportando colaboração multiusuário em tempo real e verificação de consistência, reduzindo o custo de produção de vídeos de minutos com IA a um décimo do custo cinematográfico tradicional (Fonte: THE DECODER)
Orca Entertainment lança “Jingrui AI”, plataforma de produção e gestão completa de filmes e séries com IA : A Orca Entertainment apresentou a plataforma de produção industrial “Jingrui AI”, que inclui cinco suítes de controle de precisão: cenários, atuação, set virtual, iluminação e 40 técnicas de linguagem de câmera. Oferece mais de 250 combinações de edição de cenários e 49 controles básicos de expressão, pioneira em fluxos de trabalho colaborativos em equipe e acumulação de ativos digitais, eliminando efetivamente iterações aleatórias ineficientes (Fonte: QbitAI, Synced)

CamScanner lança plugin para Qianwen Office, integrando parsing estruturado de texto e imagem em documentos complexos : O CamScanner, da IntSig, integrou-se ao ecossistema de habilidades do Qianwen Office, disponibilizando mais de 30 ferramentas atômicas, incluindo remoção de manuscrito em imagens, correção de distorção, restauração de layout e reconhecimento de múltiplas colunas. Ao lidar com fotos borradas e PDFs de duas colunas em agentes de escritório, a ferramenta pode convertê-los diretamente em Markdown e Word estruturados, eliminando loops infinitos de análise (Fonte: Synced)

Drop em open source: ambiente de sandbox rootless para agentes baseado em Linux Namespaces e gVisor : A ferramenta de código aberto Drop foi lançada, utilizando Linux Namespaces em nível de usuário e o kernel de espaço de usuário opcional gVisor para fornecer um ambiente de execução isolado sem necessidade de privilégios root para rodar dependências de IA e códigos de agentes de terceiros não confiáveis. O sistema utiliza um mecanismo de montagem de ambiente sob demanda, garantindo a segurança do host enquanto oferece uma experiência de desenvolvimento pronta para uso (Fonte: Hacker News)
Laya-MLX: implementação de ultrabaixa latência de modelo de decisão System 1 on-device no Apple Silicon : Desenvolvedores disponibilizaram o Laya-MLX em código aberto, portando um modelo estruturado de decisão não autorregressivo para o framework Apple MLX. A versão multilíngue de 322M consome apenas 687 MB de memória, reduz a latência de decisão P50 para 7,39 ms no chip M3 Max e atinge throughput de 395 problemas/segundo, sendo ideal para estratégias em jogos de alta frequência, controle atômico de UI e roteamento local de requisições (Fonte: GitHub)
Viture lança Vonder, seus primeiros óculos inteligentes de IA sem tela : A fabricante de óculos inteligentes Viture lançou o modelo Vonder por US$ 299. O hardware elimina totalmente telas e câmeras tradicionais para evitar controvérsias de privacidade, dependendo de microfones de condução óssea para captar a voz do usuário durante todo o dia e rotear dinamicamente para Claude, GPT, Gemini ou DeepSeek para destilação semântica, gerando automaticamente um grafo de memória pessoal (Fonte: WIRED)

EvoSafeHarness: sistema de evolução de defesa dinâmica de segurança para agentes em modelos e domínios específicos : A Johns Hopkins University e a NVIDIA apresentaram o framework EvoSafeHarness que, mantendo o modelo base congelado, gera uma camada de defesa dedicada por meio da busca automatizada de políticas em linguagem natural e código executável de interceptação. Os testes mostram que o sistema reduziu a taxa de sucesso de ataques a agentes entre cenários de 45,6% para 10,0%, bloqueando de forma eficaz abusos em chamadas de ferramentas e prompt injections (Fonte: arXiv)

📚 Estudos e Pesquisa
Evidência empírica com 880 mil textos na 《Nature Human Behaviour》 revela que o polimento por LLMs reduz significativamente a diversidade da escrita humana : Uma equipe da University of Southern California analisou 780 mil textos online no arXiv, notícias locais e Reddit ao longo de 7 anos, combinando dados com experimentos controlados, e descobriu que o uso de LLMs para polimento reduz a variância da complexidade lexical dos artigos em 21% a 50%. A reescrita não apenas elimina vocabulário personalizado e traços estilísticos de frases, mas também derruba a precisão de classificadores ao identificar traços de personalidade dos autores, como idade e gênero, tornando o estilo de escrita marcadamente homogêneo (Fonte: 36Kr)

Tsinghua e Stanford localizam neurônios de subsistemas de recompensa de “valor” e “dopamina” dentro de LLMs : Equipes da Tsinghua University e de Stanford descobriram subsistemas de recompensa altamente esparsos nos estados ocultos dos LLMs: “neurônios de valor”, que codificam a probabilidade esperada de resolução do estado atual (zerar 1% deles faz a pontuação matemática despencar de 75% para 20%), e “neurônios de dopamina”, que codificam o erro de diferença temporal (TD error), fornecendo evidências mecanicistas fundamentais para a construção de modelos de recompensa de processo (PRM) leves e integrados (Fonte: arXiv)

Multiverse Computing converte poda profunda de LLMs em um problema de otimização de vidro de spin de Ising : A Multiverse Computing propôs o CBO, um método de poda profunda baseado na matriz Hessiana da expansão de Taylor de segunda ordem, modelando a remoção de blocos Transformer entre camadas como uma otimização binária restrita e um sistema de vidro de spin de Ising totalmente conectado. O método captura o acoplamento não linear entre camadas sem a necessidade de retreinamento, obtendo uma pontuação MMLU quase 23 pontos acima da linha de base ao atingir 50% de poda no Llama-3.3-70B (Fonte: HuggingFace Blog)

Fudan e equipe do Wan publicam em conjunto o primeiro levantamento sobre geração visual com agentes : Equipes da Fudan University, Wan e CUHK revisaram mais de 300 estudos e propuseram um framework de classificação que vai de L0 (pipeline fixo) a L4 (adaptação a experiências de longo prazo entre tarefas), com base na abrangência da intervenção autônoma do controlador na geração visual. O levantamento aponta que a pesquisa atual está migrando da correção de feedback de tarefas únicas (L3) para a consolidação de memórias de longo prazo (L4), estabelecendo sistematicamente critérios desacomplados para avaliar a capacidade de controle e a qualidade da geração (Fonte: arXiv)

Tencent Hunyuan propõe framework de equilíbrio para dinâmica de Batch Scaling e eficiência de sistema em RL para LLMs : A equipe do Tencent Hunyuan dissecou, a partir dos primeiros princípios, a assimetria computacional entre geração (limitada por largura de banda de memória) e treinamento (intensivo em computação) no aprendizado por reforço de LLMs, propondo a teoria de limite duplo de Critical Generation Batch e Critical Training Batch. O artigo indica que aumentar moderadamente o Batch e ajustar a taxa de aprendizado pela raiz quadrada pode reduzir o tempo para atingir a meta em 29%, mantendo a mesma eficiência amostral (Fonte: arXiv)

Equipe open source europeia propõe Complex KDA: ampliando a expressividade da atenção linear no domínio complexo : Para superar as limitações de expressividade do gating totalmente diagonal do Kimi Delta Attention (KDA), a equipe de pesquisa propôs o Complex KDA (CKDA). Ao expandir o intervalo de gating para [-1,1] e flexibilizar a taxa de aprendizado para [0,2], o CKDA realiza rotações bidimensionais em uma única etapa e expressa matrizes ortogonais diagonais mais rank-1 arbitrárias, aprimorando notavelmente a geração contínua de áudio e o rastreamento de estados multietapa (Fonte: arXiv)
Peking University e MBZUAI propõem METIS, modelo base multimodal para sinais cerebrais : A equipe de Yuchao Yang na Peking University publicou na 《Advanced Intelligent Systems》 o METIS, o primeiro modelo base multimodal de eletroencefalografia guiado por linguagem natural. A arquitetura alinha sinais cerebrais heterogêneos (EEG/ECoG/SEEG) à linguagem natural de forma unificada, alcançando AUROC média zero-shot de 75,5% em 12 tarefas downstream, como estadiamento do sono multicêntrico e detecção de epilepsia (Fonte: Advanced Intelligent Systems)

Top-Conf Figure Gallery: galeria com 2.298 figuras principais selecionadas das seis maiores conferências científicas : Desenvolvedores filtraram, por meio de 25 regras e revisão manual, 2.298 figuras principais (Figure 1) de alta qualidade a partir de quase 48 mil artigos de conferências de topo como ICLR, NeurIPS e CVPR, disponibilizando o material em open source. A galeria permite buscas por tipo visual (diagramas de arquitetura, fluxogramas, árvores de taxonomia, etc.), ajudando pesquisadores a consultar rapidamente padrões de hierarquia de informação e layout exigidos pelas principais conferências (Fonte: GitHub)

NVIDIA detalha pipeline completo de treinamento quantizado NVFP4, estabelecendo alicerce de baixa precisão para a arquitetura Vera Rubin : Uma análise técnica profunda mostra que a solução NVFP4 da NVIDIA reduz o tamanho do bloco de micro-escalonamento para 16 e utiliza fatores de escala FP8, combinando escalonamento 2D de blocos de pesos, transformadas aleatórias de Hadamard e arredondamento estocástico de gradientes. Com isso, alcançou curvas de convergência quase idênticas ao treinamento em BF16 em um modelo MoE de 550B, desbloqueando uma vantagem de throughput de até 3,5 vezes na arquitetura Vera Rubin (Fonte: )
💼 Negócios
Nscale, unicórnio britânico de nuvem de IA, planeja IPO nos EUA com avaliação estimada em US$ 35 bilhões : A startup britânica de infraestrutura de IA Nscale entrou oficialmente com pedido de IPO na SEC dos EUA, planejando captar US$ 3 bilhões na NYSE. A empresa opera e constrói 17 data centers na Europa e nos EUA, focando em fornecer infraestrutura de computação de alto desempenho com soberania de dados. Faturou US$ 140 milhões no primeiro semestre e seu conselho inclui nomes como Nick Clegg e Sheryl Sandberg (Fonte: TechCrunch, The Guardian)

SiliconFlow acumula quase 2,9 bilhões de RMB em captações no ano com forte apoio de fundos estatais rumo ao IPO em Hong Kong : A fornecedora independente de tokens SiliconFlow anunciou a conclusão da segunda fase de sua rodada B+ e da rodada C, atraindo fundos soberanos e estatais chineses como China Internet Investment Fund, Guoxin Fund e o fundo de cadeia industrial da China Mobile, somando quase 2,9 bilhões de RMB captados em 2026. Com a explosão nas chamadas de agentes, sua capacidade de orquestração computacional heterogênea e otimização de custo unitário de inferência tornou-se o principal foco dos investidores (Fonte: 36Kr)

Kimi K3 da Moonshot AI é disponibilizado no AWS Bedrock e estabelece modelo de divisão de receita MaaS : O modelo Kimi K3 de 2,8T parâmetros da Moonshot AI entrou oficialmente como modelo gerenciado no Amazon Bedrock, com suporte a Prompt Caching explícito. Esta é a primeira vez que um modelo open source chinês integra uma plataforma pública de nuvem internacional sob um modelo de divisão de receitas comerciais, marcando a transição de apenas exportar pesos para a criação de canais de monetização no exterior (Fonte: 36Kr)

🌟 Comunidade
Secretário do Tesouro dos EUA rejeita imunidade de responsabilidade para IA; Andrew Ng e Jensen Huang criticam “relações públicas baseadas em pânico de segurança” : O Secretário do Tesouro dos EUA, Scott Bessent, declarou publicamente sua oposição à concessão de imunidade jurídica a laboratórios de IA, enfatizando que “a responsabilidade recai sobre as pessoas, não sobre a IA”. Andrew Ng e Jensen Huang também se manifestaram, apontando que o alarmismo em torno de riscos existenciais serve, na realidade, para obter proteção regulatória e se esquivar de responsabilidades. Ressaltaram que a concorrência multiagente é uma arquitetura de engenharia comum e que as leis vigentes de responsabilidade civil e de produtos cobrem os riscos, pedindo que o setor se concentre em defesas de engenharia em vez de frear a inovação (Fonte: 36Kr, AndrewYNg)
Meta Muse chega ao topo, firma parceria com Shopify e vulnerabilidade de escalonamento de privilégios é revelada, levantando debates sobre rotas no e-commerce e segurança on-device : Após o assistente pessoal Muse da Meta atingir o topo das paradas nos EUA, a empresa fechou uma parceria com a Shopify para checkout sem redirecionamento. Simultaneamente, pesquisadores de segurança revelaram uma falha de escalonamento local de privilégios no Muse, permitindo que programas contornem defesas e manipulem o agente para executar gravações silenciosas. A comunidade também debate o bloqueio de comparações de preços imposto pela Amazon contra o Muse, evidenciando a acirrada disputa entre o e-commerce descentralizado e gigantes de ecossistema fechado pelo “ponto de entrada de transações” (Fonte: Ars Technica, 36Kr)

Fundador da TypeSafe detalha filosofia do Jev em longa entrevista: reestruturando a tomada de decisão com fluxo de controle determinístico System 1 via RLCD : Diogo Almeida, autor principal do InstructGPT, detalhou em um podcast a ruptura arquitetural do Jev: criticou o RLHF por agradar humanos em excesso e distorcer probabilidades, propondo o “Reinforcement Learning from Calibrated Demonstrations (RLCD)” para criar primitivas probabilísticas determinísticas de uso exclusivo por máquinas (Choice/Score/Noulli), defendendo que decisões estruturadas libertam totalmente os agentes de programação da dependência linear de gigantescos contextos de KV Cache (Fonte: Podcast – Latent Space, Simon Willison, )
Scott Aaronson e Terence Tao geram debate acadêmico: a “crise de sentido dos matemáticos” após a quebra em massa de conjecturas mundiais : O cientista teórico da computação Scott Aaronson e o medalhista Fields Terence Tao publicaram reflexões que movimentaram o meio acadêmico. Especialistas apontam que a resolução em massa de grandes conjecturas por IA em curtos períodos está reformulando a cadeia de incentivos da pesquisa matemática avançada e da formação de doutorados cultivada há séculos. Se as máquinas monopolizarem a descoberta de teoremas, os pesquisadores humanos poderão ser relegados à pura interpretação e a jogos competitivos (Fonte: , )
Agentes corporativos enfrentam margens brutas negativas; altos custos de inferência forçam startups a adotarem modelos open source : A Bloomberg revelou que líderes de IA jurídica como a Harvey viram suas margens brutas entrarem temporariamente em território negativo devido à forte dependência de modelos proprietários flagship. A comunidade debate como a “cobrança por token inviabiliza iterações longas de tentativa e erro”, levando muitas empresas a migrarem mais de 80% do tráfego comum para modelos abertos como Kimi K3 e MiMo, consolidando um modelo híbrido de redução de custos: “tarefas ultracomplexas usam modelos proprietários; processos rotineiros usam modelos open source” (Fonte: 36Kr)
Investigação profunda da MIT Technology Review: torres de vigilância com IA de bilhões de dólares na fronteira EUA-México enfrentam falhas graves : Uma investigação de 15 meses do MIT Tech Review revelou que quase 600 torres de vigilância autônomas com IA instaladas na fronteira sofrem com pontos cegos e alarmes falsos frequentes. Pela falta de mecanismos de resposta integrados e eficazes, mais de 1.050 pessoas morreram na última década dentro do campo de visão das torres, expondo os riscos humanitários e técnicos de confiar cegamente no hardware de IA em substituição a processos reais de gestão (Fonte: MIT Technology Review)

NVIDIA lança sistema de segurança full-stack para IA física Halos e arquitetura de defesa de agentes OpenShell : Diante da popularização de robôs humanoides e direção autônoma, a NVIDIA lançou o sistema de segurança de IA física Halos, abrangendo chip, SO e visão periférica, além de disponibilizar em open source o runtime de sandbox restrito OpenShell para ambientes de agentes. O sistema impõe políticas rígidas e independentes da inferência do modelo para bloquear abusos de privilégios de credenciais e vazamento de dados sensíveis (Fonte: NVIDIA Blog, NVIDIA Blog)
💡 Outros
CXMT de Hefei inicia produção em massa da plataforma de DRAM de 5ª geração G5, aliviando a escassez de memória convencional : A ChangXin Memory Technologies (CXMT) anunciou o início da produção em massa de sua plataforma tecnológica de DRAM G5 e dos produtos LPDDR5X de 24 Gb. Utilizando tecnologia de exposição quádrupla para reduzir o half-pitch da matriz de memória para 11,95 nm, a eficiência de produção por wafer aumentou em 50%. Em um momento em que os principais fabricantes concentram capacidade em HBM, a novidade injeta um suprimento crucial para o mercado de eletrônicos de consumo e computação geral (Fonte: Synced)
.jpg)
CoolIT apresenta solução de servidores de IA com refrigeração líquida 100% sem ventoinhas, alcançando captura total de calor computacional : A fabricante de refrigeração líquida CoolIT lançou seu design de servidores de IA de 6ª geração sem ventoinhas, baseado em arquitetura modular de placas frias. Ao cobrir diretamente os principais componentes térmicos com placas de cobre de alta densidade, a solução elimina o consumo de energia e as vibrações das ventoinhas tradicionais de data centers, elevando a eficiência de captura de calor residual em nós de computação de alta densidade para 100% e oferecendo uma resposta de ultrabaixo PUE para data centers na escala de gigawatts (Fonte: IEEE Spectrum)

Unidade de drones da Ucrânia revela realidade do front: IA opera apenas no travamento terminal, enquanto FPV por fibra óptica redefine a kill zone de 30 km : Em entrevista, o comandante de uma unidade condecorada de drones ucraniana revelou a evolução dos combates: o campo de batalha transformou-se em uma kill zone em profundidade totalmente dominada por drones, com o uso de FPV via fibra óptica estendendo o alcance de ataque imune a interferências para 30 km. A tecnologia atual de IA não assume voos totalmente autônomos, mas fornece travamento visual autônomo por meio de módulos computacionais de baixo custo na borda durante o “último quilômetro”, quando os sinais de rádio são perdidos (Fonte: )