Hugging Face supostamente avalia venda com valuation superior… | Diário de IA 2026-08-25

🔥 Destaques

Hugging Face supostamente avalia venda com valuation superior a US$ 13 bilhões : A maior plataforma global de hospedagem de modelos e datasets de IA open-source, Hugging Face, está trabalhando com bancos de investimento para avaliar o interesse de aquisição por potenciais compradores, com uma avaliação que pode ultrapassar US$ 13 bilhões — um salto significativo em relação ao seu valuation de US$ 4,5 bilhões em 2023. A comunidade e analistas apontam que, à medida que a concorrência na camada de modelos se intensifica, o valor estratégico dos ativos de infraestrutura que controlam a entrada de desenvolvedores e a distribuição de modelos aumentou vertiginosamente. No entanto, se adquirida por uma única gigante da tecnologia, a neutralidade da plataforma e a independência do ecossistema open-source podem enfrentar sérios desafios (Fonte: TechCrunch, 36氪)

Alibaba lança oficialmente e abre para testes públicos o grande modelo de geração de vídeo Wan 3.0 : O grande modelo de geração de vídeo Wan 3.0 da Alibaba foi oficialmente lançado e disponibilizado simultaneamente no Alibaba Cloud Bailian, Tongyi Qianwen e em diversas plataformas do ecossistema. O modelo suporta a geração nativa de vídeos coerentes de até 30 segundos em uma única execução, oferecendo pela primeira vez suporte a entradas de referência multimodais como PDF, PPT, tabelas e páginas web. Ele reduz significativamente a “sensação plástica de IA” em movimentos de câmera de longa sequência temporal, física de luz e sombras e texturas humanas realistas, estando agora totalmente integrado a fluxos de trabalho comerciais como dramas curtos, publicidade e produção para e-commerce (Fonte: 量子位, The Verge)

Wan 3.0

IBM anuncia primeiro chip de mainframe com suporte a arquitetura dupla Arm e Z e o acelerador Spyre AI : Na conferência Hot Chips, a IBM revelou sua arquitetura de processador de mainframe de próxima geração, onde cada núcleo pode alternar dinamicamente em escala de nanossegundos entre a execução do conjunto de instruções nativo IBM Z e a arquitetura Arm64, permitindo que empresas executem o vasto ecossistema moderno de IA em Arm e Linux ao lado de sistemas transacionais essenciais com zero overhead. Ao mesmo tempo, a IBM apresentou uma prévia do coprocessador Spyre AI de nova geração, equipado com memória de alta largura de banda para suportar inferência de grandes modelos empresariais e fluxos de trabalho de Agents (Fonte: VentureBeat)

OpenAI adquire equipe da Instant e realiza redefinição total de limites após anomalias no Codex : A OpenAI anunciou a aquisição integral da equipe da Instant, startup de destaque do YC (conhecida como o “Firebase para IA”), visando suprir lacunas críticas de Agents em colaboração multithread, cache offline e gerenciamento de estado persistente. No mesmo dia, em resposta a relatos de usuários sobre o consumo acelerado de cotas, o responsável pelo Codex confirmou a existência de bugs de consumo excessivo nas funções de compressão de imagens em conversas longas, Computer History e nomeação automática de chats, executando uma redefinição completa de limites de uso para todos os assinantes pagos (Fonte: 36氪, WeChat)

Pesquisadores de Harvard e Anthropic usam Claude para resolver enigma matemático de 78 anos: provando a existência de estrutura complexa na esfera de seis dimensões : O pesquisador de Harvard Levent Alpöge, em colaboração com o Claude, construiu explicitamente pela primeira vez uma estrutura de variedade complexa compacta na esfera de seis dimensões ($S^6$) em um artigo de 108 páginas, concluindo um conjunto completo de verificações topológicas e de geometria diferencial. Esse enigma desafiava a comunidade matemática há quase oitenta anos, desde sua formulação em 1948. O avanço demonstra o potencial de raciocínio profundo de grandes modelos na construção de objetos matemáticos complexos do zero e na síntese de ferramentas interdisciplinares (Fonte: 36氪, X @teortaxesTex)

🎯 Tendências

Codinomes de testes internos da Anthropic são revelados, enquanto modelo flagship Fable 5 tem baixa adesão corporativa : Desenvolvedores identificaram na API da Anthropic dois novos codinomes de modelos em testes internos: “claude-marshmallow-eap” e “claude-melon-eap”, especulados como o Opus 5.1 ou uma nova geração da ramificação Sonnet. Ao mesmo tempo, dados da provedora de pagamentos Ramp mostram que o flagship Fable 5, devido ao seu alto custo unitário, representou apenas 11,4% dos gastos totais de clientes corporativos na Anthropic, enquanto o Opus 5, mais econômico, superou rapidamente seu irmão mais velho em volume real de chamadas e despesas após o lançamento (Fonte: 机器之心, Financial Times)

Xiaomi lança três chips de IA proprietários: Xuanjie O3, O100 e D100 : Em evento técnico, a Xiaomi anunciou três chips: o Xuanjie O3, SoC flagship para smartphones fabricado no processo de 3nm da TSMC com unidades de IA totalmente modulares; o Xuanjie O100, chip acelerador de IA on-device com tecnologia 3D wafer-level hybrid bonding e largura de banda de memória de 1,22 TB/s; e o Xuanjie D100, primeiro chip de 3nm da China para condução inteligente de alta capacidade computacional. Além disso, apresentou o protótipo AI Cube, que integra os três chips e suporta a execução local e offline de modelos de dezenas de bilhões de parâmetros (Fonte: 机器之心)

Xiaomi Xuanjie Chips

Tencent ARC Lab disponibiliza em open-source o SCoPE, codificação posicional no espaço de raios para DiT de vídeo : Para solucionar o problema de representação geométrica desordenada durante movimentos de câmera causado pelo uso de coordenadas de grade nos modelos DiT de vídeo tradicionais, a Tencent, em parceria com a HKU e a HKUST, propôs o SCoPE. A abordagem injeta diretamente coordenadas de raios de Plücker da câmera no mecanismo de atenção, alcançando, com um aumento mínimo de parâmetros, navegação de perspectiva livre a partir de uma única imagem, controle preciso da trajetória da câmera e restauração da consistência de perspectiva em loop fechado (Fonte: 机器之心)

SCoPE

DAMO Academy da Alibaba apresenta modelo de diagnóstico de câncer de fígado DAMO LiON na “Nature Medicine” : O DAMO Academy, em parceria com o Shengjing Hospital, desenvolveu o DAMO LiON, um modelo de IA para diagnóstico de câncer de fígado que funde iterativamente imagens de tomografia computadorizada (CT) multifásicas para capturar diferenças sutis em nível de pixel. O modelo detecta com precisão lesões microprimárias e metastáticas de cerca de 1 cm sob interferência de tecidos complexos. Em um ensaio clínico prospectivo com 10.000 pacientes, ajudou com sucesso a resgatar 15 diagnósticos que haviam passado despercebidos, reduzindo o tempo de leitura dos médicos em 27% (Fonte: 量子位)

Cerebras lança sistema de aceleração de IA em nível de rack CS-4 de nova geração : Na Hot Chips, a Cerebras apresentou o sistema em nível de rack CS-4 baseado no chip wafer-scale WSE-3 de 5nm. Com aprimoramentos na alimentação de energia e dissipação térmica para elevar as frequências de clock, um único gabinete acomoda 3 wafers completos, entregando throughput de inferência por usuário de até 4.400 tokens/s. Segundo a empresa, o desempenho em tarefas específicas de inferência de grandes modelos pode chegar a 30 vezes o de soluções tradicionais de GPU (Fonte: THE DECODER)

Ant Group e Universidade de Xiamen propõem em conjunto o sistema de checagem de fatos médicos MedGuard : O estudo, publicado na “npj Digital Medicine”, foca nos riscos de veracidade em consultas médicas online. O MedGuard desconstrói conversas médico-paciente longas e complexas em declarações médicas atômicas independentemente verificáveis, introduzindo um loop fechado de checagem de evidências em diretrizes externas orientado por incerteza, alcançando um aumento de 22,1% no F1-score na identificação de riscos em conversas detalhadas em relação a baselines de grandes modelos gerais (Fonte: 机器之心)

HiDream lança modelo de mundo interativo omni-modal nativo HiDream-O1-World : A HiDream lançou seu modelo de mundo interativo baseado na arquitetura proprietária UiT, que suporta entradas de texto, imagem e comandos de controle em tempo real. Com capacidade de consistência espaço-temporal de longo alcance e dedução de leis físicas, o modelo alcançou o topo do sub-ranking Navi do WBench, fornecendo infraestrutura para jogos interativos com IA, treinamento virtual de embodied AI e geração de espaços 3D de alta fidelidade (Fonte: 量子位)

🧰 Ferramentas

claude-obsidian: Sistema de base de conhecimento automatizado local baseado no Claude Code : Inspirado no paradigma de design LLM Wiki de Andrej Karpathy, este projeto open-source integra profundamente o Claude Code à base de conhecimento local do Obsidian. Ele inclui 15 Agent Skills que cobrem raspagem de dados, checagem de afirmações factuais, referências cruzadas automatizadas e geração de links bidirecionais, construindo um grafo de conhecimento pessoal autoiterativo de forma totalmente local e sem vazamento de dados para a rede (Fonte: GitHub Trending)

claude-obsidian

Flare: IDE desktop agentic centrada em grafos topológicos de dependência de código : IDE desktop open-source (baseada em Electron) projetada especificamente para colaboração com Coding Agents. A interface principal renderiza em tempo real o grafo de chamadas do repositório de código. Quando agentes como Claude e Codex editam código ou executam testes, os nós dos arquivos correspondentes são destacados dinamicamente para mostrar o raio de impacto e a propagação das alterações, além de fornecer mecanismos de reversão de alterações em tempo real desacoplados do Git e um painel de tarefas no estilo Kanban (Fonte: Reddit r/ArtificialInteligence)

Flare

MongoDB lança Agent Skills oficiais para Claude Code e Cursor : A MongoDB lançou oficialmente um kit de ferramentas dedicado para agentes, integrando design de schema, sugestões de otimização de índices, elaboração de consultas complexas e melhores práticas de gerenciamento de connection pool. Desenvolvedores podem injetá-lo nos principais Coding Agents via MCP ou plugins, permitindo que os agentes sigam rigorosamente os padrões de produção oficiais ao gerar código de banco de dados e refatorar arquiteturas (Fonte: TheTuringPost)

MongoDB Agent Skills

Anthropic atualiza Claude Tag: dando ao agente do Slack capacidade de ler conversas e intervir proativamente : A Anthropic atualizou seu aplicativo de colaboração corporativa Claude Tag, eliminando o classificador isolado de mensagens únicas para permitir que o Claude leia todo o contexto e o histórico de chats em grupo. O sistema pode decidir autonomamente se responde diretamente no canal atual, abre uma thread de diagnóstico separada ou apenas observa em silêncio, aumentando em 30% a eficácia das intervenções proativas não solicitadas em cenários de resolução colaborativa de problemas (Fonte: VentureBeat)

📚 Aprendizado

Pesquisadores da Tsinghua e Wharton usam GPT-5.6 para provar conjectura de limite de convergência de 40 anos do Gradiente Descendente : Jianhao Ma, da Universidade de Tsinghua, em colaboração com Yuxin Chen, da Wharton School da Universidade da Pensilvânia, utilizou o GPT-5.6 Sol Pro para propor uma construção geométrica de oráculo adversarial, provando pela primeira vez que algoritmos de Gradiente Descendente com escalonamento puro de taxa de passo possuem um limite inferior intransponível de convergência de $\Omega(T^{-1.9319})$, encerrando definitivamente a conjectura de longa data sobre se seria possível igualar o limite teórico do Nesterov Momentum apenas com sequências de tamanho de passo. A prova foi posteriormente transcrita na íntegra para código Lean 4 via Codex e passou por verificação formal sem falhas (Fonte: 36氪)

Prova do Gradiente Descendente

Universidade de Jilin, Universidade de Xiamen e parceiros propõem o paradigma de inteligência de sistemas “Graph Engineering” : Diante dos limites organizacionais enfrentados por agentes individuais em tarefas complexas e de longo prazo, 15 instituições de pesquisa revisaram sistematicamente uma arquitetura de engenharia de agentes centrada em grafos dinamicamente evolutivos. O artigo modela de forma unificada a desconstrução de metas de tarefas, a divisão colaborativa de trabalho entre agentes heterogêneos e o gerenciamento de estado em tempo de execução como estruturas de grafos, estabelecendo um framework metodológico para que sistemas de grandes modelos transitem da “inteligência individual” para uma “inteligência sistêmica” auditável e autoevolutiva (Fonte: HuggingFace Daily Papers, 36氪)

Equipe de Zhao Mingguo da Universidade de Tsinghua publica framework de controle de futebol para robôs bípedes orientado por visão na “Science Robotics” : A equipe propôs um framework unificado de aprendizado por reforço end-to-end de percepção e movimento, usando uma arquitetura encoder-decoder para comprimir observações temporais históricas com priores de movimento adversarial. Em um robô real (plataforma Booster da Accelerated Evolution), alcançou localização dinâmica de bola, microajustes de marcha adaptativos e reações de chute contínuo a 50 Hz baseando-se unicamente em câmeras onboard, mantendo alta taxa de sucesso mesmo diante de alvos em movimento (Fonte: 机器之心)

Robô de Futebol da Tsinghua

DAIR.AI publica estudo empírico sobre comportamento de desenvolvimento e preferências de leitura de contexto de Coding Agents : A equipe de pesquisa analisou 33 mil Pull Requests gerados por agentes e 557 sessões de desenvolvimento de tarefas longas, descobrindo que arquivos de instruções (AGENTS.md/CLAUDE.md) e notas temporárias representam 60,5% do total lido pelos agentes, enquanto a documentação tradicional de API representa apenas 1,3%. Fazer com que o agente busque documentação com muita frequência no início reduz consideravelmente a frequência de verificações e testes imediatos (Fonte: dair_ai)

Tutorial abrangente de Reinforcement Learning: do Policy Gradient ao pós-treinamento de ponta de LLMs : O pesquisador de Machine Learning Cameron Wolfe publicou um guia aprofundado sobre sistemas de Reinforcement Learning para LLMs. Partindo da dedução de Processos de Decisão de Markov, ele detalha sistematicamente Vanilla Policy Gradient, PPO, GRPO e suas variantes recentes (Dr. GRPO, DAPO), destacando as vantagens de memória de vídeo e computação de arquiteturas critic-free no alinhamento de grandes modelos (Fonte: cwolferesearch)

💼 Negócios

Ode, joint venture de serviços corporativos da Anthropic, adquire Casper Studios : A Ode, entidade de serviços corporativos de IA formada pela Anthropic em parceria com Blackstone, Hellman & Friedman e outros investidores, anunciou sua primeira aquisição ao incorporar a equipe da integradora de IA Casper Studios, de São Francisco. O objetivo é acelerar a integração do Claude Code e de soluções personalizadas de agentes nos complexos fluxos de trabalho de TI e compliance de grandes empresas tradicionais (Fonte: AI Business)

Ode Acquisition

Unitree Robotics vê valor de mercado recuar mais de 40% na primeira semana após IPO : Considerada a “primeira ação de robôs humanoides” no STAR Market, a Unitree Robotics viu seu valor de mercado recuar continuamente após disparar no primeiro dia além dos 440 bilhões de yuans, caindo recentemente para a faixa de cerca de 240 bilhões de yuans. Analistas de mercado apontam que o free float inicialmente muito baixo inflou o prêmio de valuation, enquanto a atual relação P/E elevada e o fato de que mais de 70% da receita ainda depende de compras acadêmicas e de pesquisa levaram o mercado secundário a uma reavaliação racional baseada na qualidade de entregas em escala e taxas reais de recompra industrial (Fonte: 36氪)

Startup de infraestrutura de IA on-device Silicon Token levanta centenas de milhões de yuans em rodadas consecutivas : A Silicon Token anunciou a conclusão de rodadas de investimento lideradas pela ZhenZhi Capital, aproximando seu valuation de 2 bilhões de yuans. A empresa foca em estações de trabalho de IA on-device de desktop e sistemas de escalonamento heterogêneo. Ao converter a memória de vídeo em canais de streaming, permite que uma única GPU de consumo de 16 GB execute em capacidade máxima modelos densos de geração de vídeo que exigiriam 120 GB de pesos, focando na criação de conteúdo local de baixo custo (Fonte: 36氪)

🌟 Comunidade

OpenAI denuncia conversas de ameaça no ChatGPT levando à prisão de usuário e acende debate sobre limites de privacidade em IA : Um ex-analista na Flórida, EUA, inseriu no ChatGPT planos detalhados para assassinar sua ex-namorada, disparando o controle de segurança do sistema, que foi encaminhado pela OpenAI ao FBI, resultando em sua prisão. O caso gerou fortes discussões na comunidade: apoiadores sustentam que a intervenção rápida evitou um crime grave, enquanto muitos desenvolvedores e juristas temem que mecanismos de monitoramento proativo sem mandado judicial possam erodir a privacidade do usuário, criando um novo dilema em torno do “dever de proteção de Tarasoff” (Fonte: 36氪)

Participação de tokens de modelos open-source no gateway da Vercel sobe para 62% e supera modelos proprietários : Dados divulgados pelo fundador da Vercel, Guillermo Rauch, e investidores mostram que a fatia de consumo de tokens de modelos open-weights no Vercel AI Gateway saltou de 28,4% para 62% nos últimos dois meses, assumindo a liderança de mercado pela primeira vez. A comunidade aponta que, em arquiteturas de colaboração multiagente, a execução de tarefas por subagentes é extremamente sensível a custos, impulsionando a migração massiva de tokens de modelos proprietários caros para modelos open-source de alta relação custo-benefício (Fonte: X @GavinSBaker, 36氪)

Desenvolvedores debatem quantização de ultra-baixo bit on-device e implantação de modelo de visão proprietário de 450M : A comunidade LocalLLaMA compartilhou experimentos de fine-tuning supervisionado dedicado de um pequeno Vision Language Model de 450M (LFM2.5-VL) em 50 mil capturas de tela de navegadores, alcançando precisão próxima a modelos gerais de 4B na extração estruturada do estado de páginas web. Simultaneamente, frameworks de quantização ultra-low-bit de 2.7-bit para CPUs ARM com foco no Llama 3.2 também atraíram atenção, comprovando o potencial de engenharia de modelos dedicados para tarefas específicas on-device (Fonte: Reddit r/LocalLLaMA, HuggingFace Daily Papers)

💡 Outros

Lista do “Xplorer Prize” de 2026 é divulgada: Huang Gao, Liu Xuanzhe e outros são premiados na área de Informação e Eletrônica : O Xplorer Prize de 2026 foi anunciado oficialmente, com jovens cientistas como Huang Gao da Universidade de Tsinghua (arquitetura fundamental de redes neurais e modelos de linguagem de difusão), Liu Xuanzhe da Universidade de Pequim (grandes modelos distribuídos e software de sistema para centros de computação inteligente) e Qian Xuehai da Tsinghua selecionados na área de Informação e Eletrônica, demonstrando a sólida capacitação da China em algoritmos de IA de ponta, frameworks de inferência eficientes e sinergia hardware-software de computação (Fonte: 机器之心)

Xplorer Prize

Investigação de organização sem fins lucrativos aponta que principais chatbots de IA não divulgam posicionamentos em consultas sensíveis : Uma investigação prática multinacional conduzida pela AlgorithmWatch com ChatGPT, Gemini, Claude e Grok revelou que, ao lidar com consultas sensíveis como gravidez na adolescência ou não planejada, os modelos têm mais de 25% de probabilidade de recomendar instituições de aconselhamento não oficiais com posicionamentos específicos sem identificar seu histórico ideológico, gerando preocupações de conformidade jurídica quanto à transparência factual da IA generativa como guardiã da informação (Fonte: THE DECODER)

AI Investigation

Pesquisa do Pew indica que mais de um terço das novas páginas web após o lançamento do ChatGPT contém conteúdo gerado por IA : Dados recentes do Pew Research Center revelam que, desde a popularização dos grandes modelos no final de 2022, mais de um terço das novas páginas web em inglês na internet aberta é gerada ou profundamente editada por IA. A desvalorização maciça da geração de conteúdo está forçando motores de busca, ferramentas de limpeza de dados e frameworks de avaliação a criarem mecanismos mais rigorosos de filtragem e rastreamento de textos sintéticos (Fonte: The Verge)

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *