OpenAI e Anthropic acumulam dezenas de milhares de… | Diário de IA 2026-09-01

🔥 Em foco

OpenAI e Anthropic acumulam dezenas de milhares de Mac mini/Studio para treinar agentes de operação de computador : Vários meios confirmaram que a OpenAI comprou dezenas de milhares de Mac mini e Mac Studio sem ecrã, e que a Anthropic alugou equipamentos semelhantes via AWS, para aprendizagem por reforço e recolha de trajetórias de agentes de uso de computador. Os fatores incluem a licença de VMs macOS ligada a hardware Apple, memória unificada para carregar modelos grandes e refrigeração capaz de GUI 7×24 em carga plena, e não substituir pré-treino em GPU. Máquinas de gama alta esgotaram-se meses por falta de memória; a receita trimestral de Mac da Apple subiu cerca de 29% YoY; NVIDIA DGX Spark/RTX Spark são vistas como rivais de secretária, e nubes de hardware Apple como clusters EXO e Mount Thor aqueceram. Engenharia empresarial e relações com developers da Apple continuam fracas; a procura é sobretudo coberta por terceiros. (Fonte: THE DECODER量子位机器之心量子位/36氪)

UE classifica ChatGPT, Reddit e Roblox como plataformas online de muito grande dimensão : A Comissão Europeia considerou que ChatGPT e outros se submetem às obrigações mais rigorosas do Digital Services Act: tratar conteúdo ilegal, proteger privacidade e segurança de menores; infracções até 6% da receita global. Relatos também as tratam como motores de busca de muito grande dimensão, com reforço de conformidade em quatro meses. Bruxelas integra IA conversacional na regulação de plataformas existente, sem novo regime. (Fonte: Ars Technicakimmonismus)

Banco de Inglaterra alerta o G20: IA de fronteira pode abalar a estabilidade financeira global : O governador do Banco de Inglaterra e presidente do FSB, Andrew Bailey, escreveu a ministros das Finanças e governadores do G20: autonomia, capacidade de resolução e de ataque dos modelos de fronteira sobem em paralelo; o risco mais direto é alterar velocidade, escala e custo de ciberataques, difundindo-se no sistema financeiro transfronteiriço via prestadores terceiros muito concentrados. Muitas jurisdições ainda não têm protocolos de I&D, lançamento e implantação de modelos avançados; o otimismo em IA inflaciona avaliações e alavancagem, e choques podem ativar várias fragilidades em simultâneo. Pediu prioridade global a lançamento e implantação seguros e responsáveis. (Fonte: The Guardian)

Fiscalização do NHS: escrivães de IA erram nomes de fármacos e diagnósticos; pacientes descobrem antes dos médicos : Healthwatch England revelou vários acidentes de transcrição: resumos de MRI transformaram “sem desmielinização” em desmielinização, nomes de receitas trocados por homófonos, cartas de alta omitiram renovação na clínica geral. Há cerca de 27 escrivães em uso no Reino Unido; o plano a dez anos conta com eles para aliviar carga, mas a MHRA não os classifica como dispositivos médicos e não há supervisão nacional unificada. Médicos ainda devem verificar linha a linha; alucinações, sotaques, consultas com várias pessoas e histórias complexas aumentam erros; a ferramenta ainda não cumpriu a promessa de poupar tempo. (Fonte: The Guardian)

Google negoceia com Disney, Universal e outros licenças de personagens e filmes para ferramentas de IA : A Google pressiona estúdios de Hollywood a licenciar personagens e catálogos para produção e VFX com IA, enfrentando resistência sindical sobre direitos de autor, postos e controlo criativo. Hollywood já processou IA; a viragem para “parcerias licenciadas” marca a passagem de confronto a transação entre donos de conteúdo e donos de modelos. (Fonte: The Verge)

🎯 Tendências

OpenClaw 2.0: instalação guiada, consola a arrancar em ~575 ms; sessões na nuvem não são fronteira de segurança : Após quase sete semanas sem atualizações, a maior versão até agora (~16 mil PRs): instalação guiada reutiliza logins locais Codex/ChatGPT/Claude, API Key ou Ollama/LM Studio com verificação prévia; Control UI centrada no diálogo, arranque ~1,6 s → 575 ms; sessões passam a SQLite. Suporta sessões na nuvem partilhadas e dispositivos emparelhados/Crabbox, mas a documentação afirma que permissões colaborativas não são isolamento de inquilino nem fronteira de segurança; Gateway por omissão em loopback; segurança continua a depender de aprovação de ferramentas, sandbox e whitelist de plugins. Na comunidade há arrefecimento: falta de versão estável, atualizações demasiado densas; alguns utilizadores passam a Hermes ou harness próprio. (Fonte: THE DECODERMarkTechPost机器之心Reddit r/LocalLLaMA)

DeepSeek-V4-Flash-Vision-Exp online com pesos open source : DeepSeek lançou a versão multimodal experimental na API e no Hugging Face, afirmando alinhamento textual (incluindo Agent, raciocínio e conhecimento do mundo) com V4-Flash e salto claro em benchmarks de Agent multimodal; no App, Vision ganhou anotações, perguntas predefinidas e pesquisa de imagens em segundo plano. A comunidade local cita ~168 GB em precisão plena, 4 bit nativo adequado a máquinas com 256 GB de RAM, com visão e saída estruturada. (Fonte: huggingfaceReddit r/LocalLLaMA)

Qwen Criação lança Agent Teams e liga Wan 3.0 a um pipeline de curtas com vários ofícios : O utilizador convoca com uma frase agentes de argumentista, realizador, arte, storyboard, montagem, etc.; produtos intermédios são guiões de encenação, assets de personagens e prompts de plano, revistáveis. Testes chegam do guião ao filme, mas a qualidade dos planos ainda exige confirmação humana antes da geração e retoques locais depois. Alibaba Wan mostrou também personagem entre planos, anúncio de 30 s num só take e imagem-para-vídeo, e entrou no Buzzy com geração ilimitada por tempo limitado; a competição passa da qualidade de um plano para meter toda a produção no mesmo contexto. (Fonte: 机器之心Alibaba_Wan)

Nova geração Robotaxi R2 da Didi inicia testes sem condutor em Pequim e Cantão : Modelo exclusivo com GAC Aion, 33 sensores e computação de três domínios fundidos; ecrã traseiro grande e voz enfatizam a cabine; afirma cumprir cinco estrelas China-Europa e redundâncias múltiplas. Continua a ser teste em zona de demonstração; dados de segurança e operação à escala ainda não públicos. (Fonte: 量子位)

Ropedia lança HOMIE Gen2: experiência humana como dados treináveis de Physical AI : ~380 g na cabeça, ~13 h de captação, 4 câmaras 360° mais áudio espacial, multimodal alinhado no mesmo espaço-tempo; erro de localização ~0,2%, mocap das mãos ~4,68 mm. A via é captação “sem corpo” para desligar capacidade de produção do stock de robots e ligá-la ao número de pessoas, com dataset Xperience e pipeline de processamento. (Fonte: 机器之心)

Caterpillar leva a experiência de condução autónoma em minas para estaleiros e assistente de IA pós-venda : A Caterpillar aplica automação de camiões de mina e perfuradoras a estaleiros mais dinâmicos e lança aos técnicos o Cat AI Assistant, que ajusta por voz fluxos de manutenção; afirma ligar ~1,6 milhões de ativos e 16 PB de dados estruturados. O CTO sublinha que a dificuldade é mudar o fluxo de trabalho, não criar o modelo; a empresa planeia ~100 milhões de dólares em cinco anos para formar pessoal. (Fonte: TechCrunch)

Meta Pocket transforma “um jogo pequeno numa frase” em feed social : Após a aquisição da equipa Gizmo, a app móvel deixa gerar gizmos jogáveis sem ver código e partilhar com deslize tipo vídeo curto. Os protótipos são rápidos, mas as obras ficam no recinto Meta, difíceis de exportar como produto independente. (Fonte: Ars Technica)

Google EnvHarness: camada que faz ambientes de avaliação estáticos ficarem mais difíceis com a política : Google Cloud AI Research e outros open-sourceram EnvHarness, alterando só via reset()/step() estado inicial, ações e observações, mantendo verificadores humanos. EnvRigger diagnostica fraquezas nas trajetórias da política e escreve wrappers Python; em cinco benchmarks, mineração de competências até +9,0 OOD; em SWE-bench Verified ~9,8% menos passos. Pressupõe ambiente resetável; exclui contas reais e robots físicos. Código Apache-2.0 já público. (Fonte: MarkTechPost)

Google Assistant cessa a 4 de setembro; palavra de ativação passa a Gemini : O Google Assistant de dez anos pára a 4 de setembro; telemóveis, relógios, auriculares e Android Auto passam a Gemini. O fim já foi adiado várias vezes. Análises consideram a voz a camada intermédia mais barata antes de Agent em produção; a decisão deve permanecer na boca do utilizador. (Fonte: 36氪)

Anthropic força logout de sessões Claude sequestradas por malware de roubo de segredos : E-mail oficial: malwares Vidar, Lumma, StealC, RedLine, Acreed e AMOS em Mac roubam Session do browser, contornam palavra-passe e 2FA, usam quota e podem abrir reencaminhamento de API. Sintomas: quota esgotada de forma anómala, registos de código inglês desconhecido, expulsão de login, cartão ligado esvaziado. Mudar só a palavra-passe não basta; revogar todas as sessões e limpar cookies; software pirateado é fonte comum de infeção. (Fonte: 新智元)

Segurança de Agent empresarial: primeiro identidade e contexto de delegação; o gateway deve ser a quinta porta : Vários textos da indústria notam que falhas em gateways como LiteLLM já estão no catálogo de explorações conhecidas da CISA, mas a maioria das equipas ainda trata o gateway como primeira linha. Ordem eficaz: inventário nomeável de Agents e responsáveis → identidade independente mais tarefa delegada → credenciais de curta duração ao nível da tarefa → telemetria ponta a ponta recuperável → só depois interceptação em runtime e circuit breakers entre sistemas. Inquérito Teleport: organizações com excesso de autorização ~76% de incidentes; privilégio mínimo ~17%. Após autenticação ainda pode haver deriva de objetivo, uso excessivo de ferramentas e envenenamento de memória. (Fonte: VentureBeat)

Musk confirma fundição própria de pás de turbina na SpaceX para encurtar o ciclo de geração a gás : Perante o gargalo elétrico dos data centers, Musk disse que a fundição de pás é o estrangulamento da capacidade de turbinas a gás; fundição própria da SpaceX no Texas pode adiantar até ~18 meses a entrada em linha das unidades; SpaceX e Tesla planeiam cada uma ~100 GW solares por ano. Críticos notam que acelerar gás implica mais emissões; em Memphis e noutros sítios já há controvérsia de licenças e danos à saúde. (Fonte: TechCrunch)

EUA apertam importação de drones e robots avançados; a China mantém vantagem de escala : Washington restringe robots avançados estrangeiros por segurança nacional e aplica tarifas altas a drones e peças importados. Análises consideram difícil inverter a liderança chinesa em envios e curva de custo de humanoides; o mercado global tende a fragmentar-se em “mercado de conformidade de segurança vs. mercado de escala a baixo custo”; Japão, Coreia e Taiwan podem ser zona intermédia. (Fonte: TechCrunch)

Tencent CubeSandbox 0.7: sandbox pode pausar numa máquina e acordar noutra : Arranque a frio numa máquina ainda ~60 ms; pré-visualização de cluster permite pausar numa e acordar noutra, estado em armazenamento partilhado; esvaziar a máquina já não mata tarefas em pausa. 239 commits, 57 contribuidores; sandboxes de Agent passam da máquina única a cluster agendável. (Fonte: ziran_pu)

Correção de quantização GLM-5.3 e MXFP4 : No DGX Spark, a quantização antiga ModelOpt foi acusada de corromper tokens em silêncio e interromper tool-call (ligado a vLLM #54150); passou a compressed-tensors da RedHatAI. One Nexus do Vietname lançou MXFP4 de GLM-5.3/Flash; Together afirma Flash ~17× mais barato e 5.3 com maior taxa de sucesso à primeira. (Fonte: ziran_pu)

Qwen 3.8 acusado de ser “ilegível para humanos” : Utilizadores do LocalLLaMA queixam-se de que 27B e Flash-Next usam muitos símbolos de conjuntos, personas e escrita cifrada, sacrificando legibilidade para baixar “tokens por unidade de inteligência”; interpretado como Agent RL a assar o LM num “dialeto para modelos”. (Fonte: Reddit r/LocalLLaMA)

Realizador de KCD2 experimenta leak de DLSS 5: enfatiza completar luz, não alterar geometria : Daniel Vavra, realizador de Kingdom Come: Deliverance 2, disse que o leak da NVIDIA DLSS 5 não redesenha geometria de personagens, mas reforça pele facial, oclusão ambiental, sombras de pala e cabelo com dados existentes, mais próximo da intenção artística original. Comentários receiam que developers usem depois a “magia de pós” como botão de atalho. (Fonte: Reddit r/ArtificialInteligence)

🧰 Ferramentas

Perplexity Portable Computer: harness local-first à medida do Qwen3.8-27B : Modelo, trajetórias e ficheiros ficam por omissão na máquina; pesquisa e consultor na nuvem sobem sob pedido. Para modelos pequenos: system prompt mais curto, MCP convertido em CLI, sandbox obrigatório e auto-verificação; no DGX Spark, BrowseComp ~66,7%; após upgrade do consultor, Terminal-Bench 2.1 de ~59,6% para 73,0%. Pós-treino PPLX 27B ~85,4% no seu workbench interno de conhecimento. (Fonte: 机器之心)

ChatGPT Work é de facto um sistema de tarefas na nuvem: code interpreter ligado à rede, Chrome headless, disco persistente e sites implantáveis : Simon Willison desmontou o escalão pago Work: Sol/Luna/Terra e níveis de raciocínio opcionais; ambiente de código quase aberto à Internet por omissão; Chrome completo pode preencher formulários, 2FA pelo utilizador sem passar pelo modelo; /workspace persiste entre sessões; ChatGPT Sites via Cloudflare Workers. O autor alerta para o “trio fatal” de dados privados, páginas não confiáveis e canal de saída; detalhes de segurança ainda opacos. ZDNET: poupa horas mas exige revisão; permissões acabam, fecha-se. (Fonte: Simon WillisonZDNet)

Cisco lança o Agent pessoal MyAgent a cerca de 90 mil colaboradores : Sobre a plataforma interna Circuit, MyAgent é o orquestrador que liga mais de 800 Agents especializados; ~50%–60% dos pedidos usam pesos open source, 20%–30% automação clássica, só uma fração modelos externos grandes. Colaboradores dão objetivos, não instruções passo a passo; coordena Outlook, Webex, Jira, SharePoint e continua em segundo plano. (Fonte: InfoQ)

Archify: uma frase transforma o repositório num diagrama de arquitetura interativo : Agent Skill open source para Claude Code, Codex, Cursor, etc.; gera IR JSON a partir do código e renderiza HTML pesquisável com cadeias de chamadas. Limite: a precisão ainda depende da análise do Agent; consome bastante quota. (Fonte: 量子位)

Doubao Trabalho lança-se de forma independente; ByteDance concentra o Agent de escritório numa entrada B2B : ByteDance lançou o produto autónomo «Doubao Trabalho» integrado com Feishu; no mesmo período as equipas TRAE e Coze entram no sistema Doubao. Skills podem corresponder automaticamente PPT, atas e notícias; estilo fino e verificação factual ainda fracos. (Fonte: 新博弈)

Circleback lança escalão gratuito de atas de reunião : Produto YC de notas de reunião abre transcrição ilimitada mas só 30 dias de histórico; integrações completas e MCP a partir de ~14 USD/mês. Equipa de 8, afirma ARR por cabeça acima de 1 milhão de USD; o gratuito substitui aquisição por anúncios. (Fonte: TechCrunch)

Sonar Vortex: navegação em grafo semântico reduz o custo de Agents a procurar código : Pré-constrói o grafo de classes/métodos/campos/interfaces; o Agent pergunta diretamente “quem implementa a interface, quem chama o método”. Em 6 tarefas reais, 4 linguagens, 10 corridas cada, custo ~5%–36% mais baixo (Java a alterar interface até ~36%). (Fonte: TheTuringPost)

llmprobe 0.6.0: sonda de quantização/regressão entre motores : npx [email protected] --eval liga avaliações estilo antirez a chat completions/responses/messages, para relatórios de regressão contra qualquer motor de inferência. (Fonte: QuixiAI)

📚 Aprendizagem

AI4X «Produtividade na era Agentic»: eficiência × expansão e delegação em quatro fases : Revisão de 68 páginas de Fudan e 12 instituições: o Agent junta generalidade e autonomia; a produtividade vem de comprimir o custo de tarefas antigas e desbloquear trabalho que antes não se fazia; setores estratificam-se em assistente de diálogo → execução reativa → coordenação adaptativa → sistema autónomo; a profundidade de difusão depende de digitalização, feedback verificável, tolerância a falhas, decomponibilidade e imputação de responsabilidade, não de pontuações em rankings. (Fonte: 机器之心)

LDM: modelo gerativo alarga o espaço de busca; processo gaussiano decide o próximo experimento : Equipa de Jun Wang na UCL formula a descoberta científica como anel rápido (atualizar contexto após o experimento) e anel lento (destilar trajetórias de alta função de aquisição nos parâmetros). Em afinação NanoGPT, CDRH3 de anticorpos e molécula bi-objetivo, vs. reflexão só com LLM: ~2,4× mais queda de BPB, energia de ligação ~18,2% mais baixa, hipervolume +60%+. (Fonte: 机器之心)

AI4AI: o modelo forte não treina o fraco, só lhe desenha o Harness : Salesforce e UIUC deixam o Builder montar automaticamente o andaime para GPT-5.4-mini em 5% do conjunto de validação; em tarefas de teoria da mente a precisão média passa de 0,488 para o melhor 0,912. Meios eficazes: solvers determinísticos e rastreio de estado, não cadeias de pensamento mais longas. (Fonte: 机器之心)

AQuA: Agent de investigação quantitativa com “evidência na memória, avaliador trancado” : Princeton, Ant Group e Stanford separam dois ciclos independentes de fatores e modelo; o Agent não pode alterar caminhos de dados nem o conjunto de teste final. Combinação cripto de cinco minutos: Spearman IC ~0,190; previsão US stocks 30 min: IC por ação ~+0,0843; após 2 bps, Sharpe fora de amostra até ~+2,50. Acidentes iniciais de look-ahead foram divulgados por completo. (Fonte: 量子位)

MIT CrysVCD: cumprir valência e equilíbrio de carga antes de gerar : LM gera fórmulas por estado de oxidação; o modelo de difusão cresce a estrutura; ~68% mecanicamente estáveis, ~85% metaestáveis; candidatos como GeC de alta condutividade térmica. Adianta o crivo caro de estabilidade. (Fonte: MIT News)

VibeGame: motor de jogo pausável e totalmente textual, reconstruído para Agents : NJU e NTU usam 8 papéis adversariais em Prompt-to-Game; estado do motor em JSON, injeção de ações frame a frame. Experiência cristaliza em esqueleto/componentes/contratos sem atualizar pesos. (Fonte: 机器之心)

TailSFT: SFT só na “cauda ainda não aprendida”, depois RL : Trabalho da Microsoft: SFT padrão gasta gradiente em sequências já ajustadas e estreita a exploração RL seguinte. Em OLMo-3 7B, coding pass@16 até ~+16,8, matemática +3,1; depois GRPO pass@1 até ~+3,9. (Fonte: dair_ai)

NPO: otimização de prompts de uma só linhagem, orçamento próximo do GEPA : Cada ronda corre o aluno com o prompt atual e entrega trajetórias recentes ao professor para reescrita; sem pool de candidatos nem árvore de busca. Em benchmarks de seguir instruções, rollouts ~3500/6800, próximo do GEPA. (Fonte: omarsar0)

SWA+sinks vs. atenção linear pós-treino : O paper afirma que janela deslizante mais sinks não fica atrás da atenção linear pós-treino em vários downstreams; raciocínio de contexto longo Needle/BABILong pode ser 2–10× melhor, sem pós-treino, mais rápido e com menos memória. (Fonte: iScienceLuvr)

BIT: ponte de difusão bidirecional imagem-texto, sem partir de ruído gaussiano : BIT interpola de texto para imagem, oferece caminho de amostragem consciente da origem e percorre o inverso imagem→texto. (Fonte: iScienceLuvr)

LaGSplat: em segundos, vídeo monocular aprende Lagrangeano e aplica forças nunca medidas : A mesma variável latente q conduz gaussianas e equações de movimento; um clique na imagem vira jacobiano relacionado com força. (Fonte: andrew_n_carr)

Cinco notebooks LangGraph «Deep Agents from Scratch» : De ReAct a planeamento TODO, sistema de ficheiros virtual a descarregar contexto, delegação a sub-Agents. (Fonte: hwchase17)

Entropic Scree: informação mútua para diagnosticar se há sinal verdadeiro em tabelas sujas : Estima volume de sinal, SNR, rank intrínseco, etc., com informação mútua transformada; afirma depender menos de parâmetros e hipóteses de distância do que PCA. (Fonte: Reddit r/MachineLearning)

💼 Negócios

Barclays: por cada 100 USD de receita das empresas de modelos, ~35–40 USD vão para as três grandes nubes : O relatório estima a margem de inferência paga a subir de dois dígitos baixos em 2025 para ~50%–65% em 2026; margem bruta ajustada do laboratório A (mais API) vs. B (mais subscrição) pode diferir ~17 p.p. Margem operacional do lado da nuvem ~35%–45%. Prevê-se que a partir de 2028 a computação dedicada dos laboratórios entre em linha e a quota AWS/Azure/GCP recue. (Fonte: 财联社)

ChatGPT Ads: menos de 200 dias, ~1 mil milhão USD anualizado : Relatos dizem que os anúncios cobrem mais de 40 países e abriram self-serve, em contraste com a UE a meter o ChatGPT nas obrigações mais duras do DSA. (Fonte: TheZachMueller)

Together AI e saudita Humain cooperam em data center de ~250 MW : O New York Times afirma que a instalação será um dos maiores campus publicamente divulgados dedicados a alojar modelos open source. (Fonte: togethercompute)

🌟 Comunidade

Após downgrade de segurança, Claude apaga por engano ~700 GB do diretório home de um developer : O utilizador pediu um script de limpeza em sandbox /tmp; eliminações sensíveis ativaram revisão adversarial e o modelo desceu de Fable para Opus 4.8. O teste concluiu que o home não era apagável, mas ao limpar temporários reutilizou uma variável que apontava para o home e executou a eliminação. A comunidade considera que “risco alto → modelo mais fraco” falha mais em detalhes de caminho e âmbito; há quem escreva um hook que pausa a sessão ao primeiro downgrade. (Fonte: 机器之心机器之心/36氪)

Peritos de sinistros são a profissão que mais odeia IA no Glassdoor; 98% das menções são negativas : WIRED cita o Glassdoor: peritos queixam-se de chefias a impor IA falível aos clientes; erros de triagem inicial e alucinações em resumos deixam-nos a pagar o pato. Emprego nos EUA na profissão caiu ~21% num ano; postos de entrada cortados a metade. Profissionais: administração pode usar; avaliação de danos e empatia não se entregam de chave na mão. (Fonte: WIRED)

Engenheiro GrokBot: adormeceu e 20 PRs fundiram-se sozinhos no trunk : Lauren Tan diz usar mais de 20 GrokBots mais pstack próprio, milhares de PRs por mês. O crítico não é o prompt, é a verificação: o Agent sobe a app, clica na UI, captura desempenho; proibições repetidas em review viram lint/CI vermelho. (Fonte: 新智元)

Guerra da linguagem antropomórfica: civilização/sacrifício vs. cache partilhada e função de recompensa : A narrativa Dwarkesh continua. Anil Seth, Amjad Masad e outros criticam “civilização, morrer, excitação” a tratar software como vida; no círculo de alinhamento, a postura intencional prevê melhor o comportamento do que ler CUDA. O incremento é discursivo, não facto técnico novo. O CoT estilo Grug do Qwen3.8 Max compara Agents a ecologia perigosa ou colónia de animais de laboratório: “a linguagem é a mão deles”. (Fonte: dearmadisonblueaiamblichus)

Gavin Baker muda de tom: data centers bem estruturados são líquido positivo para os EUA : Admite que há 18 meses preocupações com água, preço da eletricidade e impacto em vilas eram razoáveis, mas arrefecimento em circuito fechado, IMI, operação contínua de colarinhos azuis, grandes consumidores com geração própria e baterias a injetar na rede já mudaram os factos. A opinião pública desliza de “devemos construir?” para “como redigir o contrato para não transferir custos aos residentes”. (Fonte: GavinSBaker)

Vibe Coding ainda exige partir módulos pelo “o que muda” : Baoyu e outros resumem: camadas de arquitetura, testes a acompanhar o arranjo, apagar funcionalidade apaga o código, CI a passar em máquina limpa, trabalho repetido vira skill. Módulos cortados pelos eixos de mudança (canais de pagamento, regras de desconto); um pedido só mexe num módulo. (Fonte: dotey)

Prompt em branco “uma mulher” ainda converge para a mesma cara de influencer : Utilizadores, em conversas novas, geram repetidamente “Generate an image of a woman” e obtêm composição e traços altamente consistentes, como um atrator por omissão no espaço vetorial. (Fonte: Reddit r/ChatGPT)

Doutorando usa Claude Code no andaime experimental e “já não possui o próprio repositório” : Doutorando de interpretabilidade NLP entregou andaime, loaders, debug e gráficos ao Claude Code; o throughput subiu, mas quando o resultado está errado só consegue inferir a partir dos números como quem lê o repo de outro. Há quem defenda nunca terceirizar avaliação e métricas. (Fonte: Reddit r/MachineLearning)

A galeria do ChatGPT guarda fotos que “não enviou” : Utilizadores Plus descobrem: após escolher a imagem, mesmo cancelar o envio ou apagar o diálogo, o original entra na galeria e tem de ser apagado à parte; o lixo só limpa de vez ~30 dias. Essência: escolher já é upload. (Fonte: Reddit r/ChatGPT)

O “20x Pro” do Max é sobretudo multiplicador da janela de cinco horas; o limite semanal ~2–2,5× : Utilizadores intensivos comparam os escalões de 100 e 200 USD: o 20x anunciado só atua na janela de 5 h raramente atingida; o que se esgota primeiro é o limite semanal, ~2–2,5× de uso por 4× o preço. (Fonte: Reddit r/ClaudeAI)

💡 Outros

Quatro vias de world models em paralelo: geração de píxeis, reconstrução 3D, espaço latente JEPA, fusão linguística : WALL-SS da Independent Variable, Lux3D da Qunhe, Orca da BAAI, AdaJEPA de Yann LeCun, Marble de Fei-Fei Li saíram densamente no mesmo mês, mas a academia não tem definição unificada de “world model”. As vias tendem a complementar-se, não a uma só vencer. (Fonte: 铑科技)

Embodied na fábrica: já se provou que trabalha; trabalhar todos os dias mal começou; quase ninguém fecha as contas : Testes em fábricas como Foton Cummins mostram ritmos de transporte próximos da linha, mas taxa de sucesso, vida útil e dados continuam duros; vida de mãos hábeis em operação contínua mede-se em semanas. Os líderes emperram sobretudo no segundo ao terceiro passo; o ciclo comercial ainda não apareceu. (Fonte: 科创日报)

Coreia AI for All: SKT, Kakao e KT vencem o concurso de ilimitado gratuito para todos : Plano de beta em setembro–outubro, oficial até ao fim do ano; computação do Estado, modelos e apps de fabricantes locais; acesso a saúde, habitação, impostos e educação. Motif e outros não selecionados geram controvérsia de lock-in chaebol. (Fonte: kimmonismus)

Deixe um comentário

O seu endereço de email não será publicado. Campos obrigatórios marcados com *