OpenAI publica oficialmente artigo de 249 páginas e código… | Diário de IA 2026-08-03

🔥 Destaques

OpenAI publica oficialmente artigo de 249 páginas e código de verificação do modelo Astra resolvendo 10 grandes problemas matemáticos : A OpenAI publicou oficialmente um artigo técnico de 249 páginas detalhando como o seu modelo de raciocínio de próxima geração, Astra, resolveu 10 problemas matemáticos do nível da Fields Medal, e disponibilizou em código aberto no GitHub o código de verificação formal em Lean 4. O Astra construiu pela primeira vez um contraexemplo para grupos não-sofic e superou o limite da taxa de decaimento para o problema do empacotamento de esferas em dimensões elevadas, que persistia desde 1978. Este avanço demonstra a profunda capacidade construtiva da AI no campo da matemática pura, com um custo médio de Token de apenas 200 dólares por demonstração, sinalizando a chegada da era de “comprar teoremas matemáticos com poder computacional” (Fonte: OpenAI News)

OpenAI publica oficialmente artigo de 249 páginas e código de verificação do modelo Astra resolvendo 10 grandes problemas matemáticos

Andrej Karpathy repercute Claude Opus 5 gerando mundo de jogo 3D físico completo com um único prompt : O ex-diretor de AI da Tesla, Andrej Karpathy, fez sua primeira publicação após se juntar à Anthropic, demonstrando que o Claude Opus 5, com um orçamento de 1 milhão de Tokens, gerou um mundo de jogo 3D de “O Senhor dos Anéis” contendo física complexa, texturas e música a partir de um único prompt. Este avanço marca uma mudança de paradigma da AI, passando de simples desenhos 2D em SVG para a geração procedural de protótipos 3D. No entanto, Karpathy também apontou que, devido à falta de percepção de vídeo em tempo real e capacidade de auditoria de jogos, o modelo ainda apresenta limitações, como problemas de colisão (“clipping”) nas imagens geradas (Fonte: THE DECODER)

Andrej Karpathy repercute Claude Opus 5 gerando mundo de jogo 3D físico completo com um único prompt

Sistema de cibersegurança MDASH da Microsoft alcança resultado inovador de 95,95% no benchmark CyberGym : A Microsoft anunciou os resultados mais recentes do seu sistema de cibersegurança multiagente MDASH no benchmark CyberGym, liderando o setor com uma taxa de reprodução de vulnerabilidades de 95,95%. O sistema adota uma arquitetura de roteamento híbrido altamente econômica: o modelo leve MAI-Cyber-1-Flash, com apenas 5B de parâmetros ativos, processa 90% das consultas de segurança rotineiras, direcionando apenas os 10% de tarefas mais difíceis para o GPT-5.4. Isso reduz os custos de inferência pela metade enquanto mantém um desempenho de defesa de ponta, demonstrando a evolução da cibersegurança com AI de “empilhamento de grandes modelos” para a “redução sistemática de custos” (Fonte: 36氪)

Sistema de cibersegurança MDASH da Microsoft alcança resultado inovador de 95,95% no benchmark CyberGym

Intermediários de dados de AI são expostos por comprar em massa e escanear destrutivamente livros raros anteriores a 2022 : Livreiros australianos e investigações do setor revelaram novos detalhes sobre as fontes de dados de treinamento de AI: intermediários de dados como o ISBNdb estão comprando anonimamente em massa, através de plataformas de segunda mão, livros raros e fora de catálogo publicados antes de 2022, pois essas obras não foram “poluídas” por conteúdo gerado por AI. Para aumentar a eficiência da digitalização, as instituições de escaneamento cortam as lombadas dos livros e destroem as cópias físicas, gerando debates éticos no meio cultural sobre a perda do patrimônio cultural da humanidade devido ao treinamento de AI (Fonte: The Guardian)

Intermediários de dados de AI são expostos por comprar em massa e escanear destrutivamente livros raros anteriores a 2022

🎯 Tendências

Gemini Robotics 2 da Google foca no controle de “coordenação de corpo inteiro de ponta a ponta” : A Google DeepMind lançou o Gemini Robotics 2, um modelo de robótica geral cujo núcleo consiste em romper com o controle passo a passo tradicional de “primeiro estabilizar e depois esticar o braço”, alcançando uma coordenação de corpo inteiro que integra pernas, tronco e mãos destras multidedos. Testes mostram que o modelo alcançou adaptação entre diferentes corpos robóticos no Franka Duo e no Apollo 2, embora a taxa de sucesso para operações finas nos “últimos centímetros”, como rosquear lâmpadas ou fechar sacos zip-lock, ainda precise ser aprimorada (Fonte: 36氪)

NVIDIA disponibiliza em código aberto o Molt, um framework minimalista de aprendizado por reforço agentivo : A equipe do NVIDIA NeMo disponibilizou em código aberto o Molt, um framework nativo de PyTorch para aprendizado por reforço agentivo. O framework destaca-se pelo design minimalista, com apenas cerca de 8,6 mil linhas de código, sendo extremamente fácil de entender e modificar por assistentes de programação de AI. O Molt utiliza Ray e vLLM para alcançar uma colaboração assíncrona eficiente entre treinamento e rollout, e introduz a tecnologia de “reprodução de rota de rollout”, resolvendo o problema de inconsistência na seleção de especialistas em modelos MoE entre as etapas de treinamento e inferência (Fonte: MarkTechPost)

AMD lança modelo de mistura de especialistas totalmente de código aberto Instella-MoE-16B-A3B : A AMD lançou o Instella-MoE-16B-A3B (com 2,8B de parâmetros ativos), um modelo de mistura de especialistas de código aberto treinado em GPUs Instinct MI300X/MI325X. O modelo introduz as tecnologias Gated MLA (Gated Multi-head Latent Attention) e comunicação assíncrona FarSkip-Collective, aumentando a velocidade de pré-treinamento em 12,7% e reduzindo a latência do primeiro token em 39,2%, liderando modelos de código aberto de tamanho semelhante em vários benchmarks (Fonte: MarkTechPost)

AMD lança modelo de mistura de especialistas totalmente de código aberto Instella-MoE-16B-A3B

Meta AI propõe arquitetura de agente com memória activa para resolver o “declínio do estado de comportamento” : Pesquisadores da Meta AI propuseram uma arquitetura de “agente com memória ativa” ao introduzir um agente independente como “treinador de memória” para manter um banco de memória estruturado contendo estados, conhecimentos e processos. Este agente treinador pode determinar ativamente quando enviar prompts para o agente executor, melhorando significativamente a taxa de sucesso de tarefas longas em testes como o Terminal-Bench, evitando efetivamente que o agente esqueça restrições e repita tentativas fracassadas em contextos longos (Fonte: THE DECODER)

Meta AI propõe arquitetura de agente com memória activa para resolver o "declínio do estado de comportamento"

OpenAI lança Presence, plataforma corporativa de implantação e integração de agentes : A OpenAI lançou o serviço Presence voltado para clientes corporativos, com o objetivo de transformar os agentes do ChatGPT Workspace em aplicações prontas para produção que podem ser usadas diretamente no atendimento ao cliente e em fluxos de trabalho internos. A OpenAI enviará engenheiros de implantação de ponta para auxiliar os clientes corporativos na integração de sistemas, definição de limites de segurança e gerenciamento de testes, sinalizando que os desenvolvedores de grandes modelos estão acelerando a introdução de agentes de AI nos cenários de negócios principais das empresas (Fonte: THE DECODER)

Entrada em vigor da Lei de IA da União Europeia gera preocupações sobre “fadiga de divulgação” : A Lei de IA da União Europeia (EU AI Act) entrou oficialmente em vigor em 2 de agosto. As novas regras exigem obrigatoriamente a identificação de qualquer interação com sistemas de AI ou conteúdo de mídia gerado/editado por AI, sob pena de multas de até 15 milhões de euros ou 3% do faturamento global. Analistas do setor temem que os rótulos de AI onipresentes possam, assim como os pop-ups de cookies do GDPR, causar “fadiga de divulgação” e pontos cegos estéticos no público (Fonte: WIRED)

Entrada em vigor da Lei de IA da União Europeia gera preocupações sobre "fadiga de divulgação"

🧰 Ferramentas

DwarfStar: motor de inferência local em C otimizado para DeepSeek V4 : O desenvolvedor antirez disponibilizou em código aberto o DwarfStar, um motor de inferência local escrito em C e profundamente otimizado para o DeepSeek V4 Flash. O motor é totalmente autônomo, suporta backends Metal, CUDA e ROCm, e foi especialmente projetado com um modo de streaming de especialistas em SSD, permitindo rodar modelos MoE de grandes parâmetros a velocidades aceitáveis em dispositivos de consumo com memória limitada (como um Mac de 96GB) (Fonte: GitHub)

DwarfStar: motor de inferência local em C otimizado para DeepSeek V4

Xberg v1: framework em Rust para extração inteligente de conteúdo sensível à diagramação : Desenvolvedores disponibilizaram em código aberto o Xberg v1 (anteriormente Kreuzberg), um framework eficiente para extração inteligente de conteúdo. Escrito inteiramente em Rust, ele suporta análise profunda de 101 formatos de documentos e 367 formatos de código. O framework introduz detecção de layout baseada em ONNX e reconstrução da ordem de leitura no estilo Docling, superando significativamente ferramentas semelhantes como docling e mineru na qualidade de extração de PDFs nativos e na restauração de tabelas (Fonte: Reddit)

Xberg v1: framework em Rust para extração inteligente de conteúdo sensível à diagramação

mem-port: servidor de memória local para eliminar o desvio de contexto na colaboração com AI : Desenvolvedores disponibilizaram em código aberto o mem-port, um servidor de memória MCP local. A ferramenta utiliza o SurrealDB incorporado para armazenamento de grafos e vetores, dispensando a configuração de bancos de dados externos complexos. O mem-port fornece uma memória compartilhada de longo prazo unificada para várias ferramentas de programação de AI, como ChatGPT, Claude Code e Cursor, registrando escolhas de arquitetura e tentativas anteriores, resolvendo efetivamente o problema de perda de contexto ao alternar entre múltiplas ferramentas (Fonte: Reddit)

📚 Aprendizado

Tutorial de treinamento com precisão mista automática FP8 no NVIDIA Transformer Engine : Este tutorial detalha como acelerar o processo de treinamento de modelos Transformer usando o NVIDIA Transformer Engine. O conteúdo abrange o uso de operadores fundidos como te.Linear, configuração de Autocast baseada em precisão mista automática FP8, e como estabilizar cálculos de tensores de baixa precisão por meio de escala atrasada (Delayed Scaling) e histórico de amax, fornecendo também benchmarks comparativos com implementações nativas em PyTorch (Fonte: MarkTechPost)

Prática de previsão de séries temporais de ponta a ponta e backtesting baseado no TimesFM 2.5 : Este tutorial demonstra um fluxo de trabalho de previsão de séries temporais de ponta a ponta baseado no modelo de código aberto da Google, google/timesfm-2.5-200m-pytorch. O tutorial aborda previsão probabilística zero-shot, backtesting de rolling origin, detecção de anomalias baseada em intervalos de previsão e como integrar covariáveis numéricas e categóricas, como preços e promoções, ao modelo TimesFM por meio do módulo XReg, fornecendo previsões de alta precisão para cenários como o varejo (Fonte: MarkTechPost)

💼 Negócios

CuspAI conclui rodada de financiamento Série B de 450 milhões de dólares, com avaliação atingindo 2,6 bilhões de dólares : A empresa britânica de design de materiais por AI, CuspAI, anunciou a conclusão de uma rodada de financiamento Série B de 450 milhões de dólares, elevando sua avaliação para 2,6 bilhões de dólares. A rodada foi liderada por Kleiner Perkins e NEA, com a participação do fundo de Jeff Bezos. A CuspAI foca na abordagem de “design reverso”, gerando estruturas de materiais a partir do desempenho desejado. A empresa já fez parcerias com a NVIDIA, Hyundai Motor, entre outras, para estabelecer oficinas de materiais de AI, visando acelerar o desenvolvimento de semicondutores, baterias e materiais de captura de carbono (Fonte: 36氪)

CuspAI conclui rodada de financiamento Série B de 450 milhões de dólares, com avaliação atingindo 2,6 bilhões de dólares

RadixArk, equipe do SGLang, capta mais de 100 milhões de dólares e lança o framework Miles : A RadixArk, incubada pela equipe principal do motor de inferência de código aberto SGLang, concluiu uma rodada de semente (seed) de mais de 100 milhões de dólares, com a participação da NVIDIA, AMD e do criador do PyTorch. A RadixArk visa extrair o limite máximo de desempenho das GPUs e lançou o Miles, um framework de pós-treinamento de código aberto. O framework coordena profundamente a inferência, avaliação e atualização de parâmetros no aprendizado por reforço ao nível do sistema, reduzindo drasticamente o desperdício de poder computacional durante o processo de pós-treinamento (Fonte: 36氪)

RadixArk, equipe do SGLang, capta mais de 100 milhões de dólares e lança o framework Miles

🌟 Comunidade

Resolução de problemas matemáticos por AI gera crise existencial na comunidade matemática sobre “máquinas substituindo humanos” : Com o OpenAI Astra resolvendo 10 grandes problemas matemáticos, como os grupos não-sofic, gastando apenas 2.000 dólares, a comunidade matemática mergulhou em sentimentos complexos. Enquanto alguns matemáticos adotam ativamente a AI para aumentar a eficiência de suas pesquisas, outros acadêmicos, como Kirwin Hampshire, apontam que a geração em massa de demonstrações verificáveis por máquinas, mas difíceis de serem compreendidas intuitivamente por humanos, está privando a humanidade do prazer espiritual de explorar o desconhecido, desencadeando uma profunda “crise existencial” na matemática (Fonte: THE DECODER)

Sam Altman defende “criação de filhos com ChatGPT” e é ridicularizado nas redes sociais : O CEO da OpenAI, Sam Altman, sugeriu em uma publicação que os pais usem o ChatGPT Work para gerar automaticamente um “podcast de trajeto” baseado no calendário familiar e nos interesses dos filhos para tocar no caminho para a escola. A sugestão recebeu uma resposta fria do criador de “Gravity Falls”, Alex Hirsch: “Por que você simplesmente não conversa com seu filho?”. A resposta obteve mais de 120 mil curtidas, gerando protestos generalizados na comunidade contra a intrusão excessiva da tecnologia nas relações entre pais e filhos e o enfraquecimento das conexões emocionais humanas reais (Fonte: TechCrunch)

Divulgador científico Hank Green pede desculpas publicamente e pausa atualizações por dependência excessiva de AI para pesquisa : O conhecido divulgador científico Hank Green foi questionado pelos espectadores sobre o uso de AI para escrever seus roteiros após usar transições com marcas evidentes de AI em seus vídeos. Green posteriormente publicou um longo pedido de desculpas no Reddit, admitindo que desenvolveu uma dependência “pouco saudável” da AI na busca por alta produtividade, o que diluiu a pureza de sua criação pessoal. Ele pausará ou reduzirá as atualizações do canal para reestruturar seu processo de pesquisa e escrita pessoal sem depender de AI (Fonte: TechCrunch)

Plataformas iniciam batalha de defesa contra “conteúdo de lixo de AI (Slop)” e sofrem efeitos colaterais : Com a popularização da AI generativa, o conteúdo de baixa qualidade inundou a internet. O LinkedIn lançou um botão de denúncia com um clique para “AI Slop”, independente do sistema de denúncia tradicional, enquanto o Snapchat anunciou que o algoritmo de recomendação de vídeos curtos do Spotlight não recomendará mais vídeos gerados puramente por AI. Ao mesmo tempo, relatórios de vulnerabilidades de baixa qualidade gerados automaticamente por AI lotaram a caixa de entrada de segurança da Apple, impedindo o relato oportuno de uma vulnerabilidade real do macOS avaliada em 200 mil dólares, destacando o impacto destrutivo do spam de AI no ecossistema de defesa (Fonte: THE DECODER)

💡 Outros

Autonomous Key lança bloqueador físico de aplicativos NFC de 9 dólares para combater o vício em telas : Para resolver o problema de aplicativos de limitação de software que são facilmente burlados pelos próprios usuários, a Autonomous Key lançou uma chave física NFC que custa apenas 9 dólares. Os usuários devem escanear fisicamente a chave para desbloquear aplicativos restritos, com cada desbloqueio limitado a 60 minutos. Ao colocar a chave em outro cômodo para aumentar a fricção física, combinada com análises de hábitos sarcásticas fornecidas por AI, o dispositivo ajuda os usuários a combater o vício em redes sociais (Fonte: TechCrunch)

Autonomous Key lança bloqueador físico de aplicativos NFC de 9 dólares para combater o vício em telas

Juiz rejeita pedido da xAI para suspender proibição de aplicativos de “nudez por AI” em Minnesota : A proibição de Minnesota contra aplicativos de “nudez por AI” (nudify) não consensual entrou oficialmente em vigor. A xAI processou a proibição alegando que ela era “excessivamente restritiva” e solicitou uma liminar para suspender sua execução, mas o juiz federal Don Donovan rejeitou o pedido, apontando que a xAI entrou com a ação de emergência quase três meses após a assinatura da lei e apenas três dias antes de sua entrada em vigor, demonstrando que o alegado “dano iminente” não se sustentava logicamente (Fonte: TechCrunch)

Desenvolvedor disponibiliza em código aberto o modelo de parâmetros vazios Vacuum 16T de 16,5T para ironizar a corrida armamentista de grandes modelos : Em resposta à competição cega de parâmetros entre os principais laboratórios de código fechado, um desenvolvedor disponibilizou em código aberto no Hugging Face o Vacuum 16T, um modelo vazio com 16,5 trilhões de parâmetros. Ao declarar uma quantidade massiva de tensores de valor zero no cabeçalho safetensors, o modelo alcançou com sucesso o primeiro lugar em número de parâmetros no Hugging Face, mas consome menos de 1MB de largura de banda na transmissão real devido à desduplicação, ironizando a adoração cega do setor por “grandes parâmetros” (Fonte: Reddit)

Desenvolvedor disponibiliza em código aberto o modelo de parâmetros vazios Vacuum 16T de 16,5T para ironizar a corrida armamentista de grandes modelos

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *