🔥 Fokus
Lilian Weng kündigt Rücktritt bei Thinking Machines wegen körperlicher Erschöpfung an : Lilian Weng, Mitgründerin von Thinking Machines, hat ihren Rücktritt aufgrund von körperlicher Erschöpfung angekündigt. In ihrem Abschiedsbrief erklärte sie, dass die 20 Monate unter hohem Druck im Unternehmen ihre Gesundheit ernsthaft beeinträchtigt haben. Künftig werde sie nach einer Arbeit mit klareren Grenzen und besserer Vorhersehbarkeit suchen und nicht mehr als Mitgründerin tätig sein. Dieser Schritt hat im Silicon Valley eine breite Diskussion über den intensiven Wettbewerb in AI-Startups und den Abfluss von Talenten ausgöst (Quelle: Qbitai)

Huawei und Partner veröffentlichen multimodale Modellfamilie Boogu-Image-0.1 : Das Xiaoyi-Team des Huawei Leibniz Research Center in Hongkong hat in Zusammenarbeit mit der University of Hong Kong (HKU), der Hong Kong University of Science and Technology (HKUST) und anderen Partnern Boogu-Image-0.1 veröffentlicht. Es nutzt Qwen3-VL-8B als Instruction Encoder und unterstützt die native Generierung in 2K-Auflösung. Das Modell wurde mit nur 208 Millionen unabhängigen Bildern vortrainiert, wobei die theoretischen Trainingskosten bei etwa 400.000 US-Dollar lagen. In mehreren Benchmarks nähert es sich dem Niveau von Closed-Source-Modellen an und wurde unter der Apache 2.0-Lizenz als Open Source bereitgestellt (Quelle: JiQiZhiXin)
.jpg)
BeingBeyond veröffentlicht erstes implizites taktiles Welt-Aktionsmodell Being-H0.8 : BeingBeyond hat das Modell Being-H0.8 veröffentlicht. Dieses Modell integriert erstmals taktile Modalitäten in eine latente Raumrepräsentation. Dafür wurde ein über 500.000 Stunden umfassender UniHand-3.0-Videodatensatz erstellt und Kontaktannotationen über TactoHand generiert. Dies ermöglicht es Robotern, ihre Bewegungen während der Ausführung basierend auf taktilem Feedback in Echtzeit anzupassen, wodurch feine Operationen wie das Greifen von Objekten aus einer Tasche erfolgreich durchgeführt werden konnten (Quelle: Qbitai)

🎯 Entwicklungen
Microsoft veröffentlicht Sicherheitsmodell MAI-Cyber-1-Flash und Perception-Plattform : Nach der Gründung der Open Source Security Alliance hat Microsoft offiziell das Modell MAI-Cyber-1-Flash (137B Parameter, 5B aktiv) vorgestellt, das in sein MDASH-Agenten-Sicherheitssystem eingebettet ist. Im CyberGym-Test schlug diese Kombination Modelle wie Mythos 5 von Anthropic mit einer Punktzahl von 95,95 % bei halbierten Kosten. Gleichzeitig wurde die Perception-Plattform eingeführt, die einen Multi-Agenten-Red-Blue-Green-Team-Mechanismus nutzt, um die Erkennung und Behebung von Schwachstellen zu automatisieren (Quelle: THE DECODER)

Volcengine öffnet Doubao-Suchfunktionen für Unternehmen und Entwickler : Volcengine hat die Suchfunktionen hinter der Doubao-App offiziell über APIs, MCP, Skills und andere Formate für Unternehmen und Entwickler freigegeben. Der Dienst bietet umfangreiche Felder wie Autoritäts-Klassifizierung, Veröffentlichungszeit, Textzusammenfassung und Markdown-Auszüge des Originaltextes. Dies hilft AI Agents, externe Echtzeitinformationen effizienter zu erfassen und zu filtern, wodurch der Verbrauch irrelevanter Tokens reduziert wird (Quelle: Qbitai)

🧰 Tools
Perplexity veröffentlicht offizielles Single-File-CLI-Tool pplx : Perplexity hat das offizielle Kommandozeilen-Tool pplx veröffentlicht, das Websuchen und Content-Scraping im Terminal unterstützt und Ergebnisse im Standard-JSON-Format zurückgibt. Das Tool wurde speziell für menschliche Entwickler und AI Coding Agents entwickelt. Es unterstützt die Kontrolle des Token-Budgets und die lokale Dateispeicherung über die Umgebungsvariable PPLX_OUTPUT_DIR und den Parameter --stdout-preview (Quelle: MarkTechPost)
Kando AI stellt selbst-evolutionäres Entscheidungssystem vor : Das von Teams der Tsinghua- und Peking-Universität gegründete Startup Kando AI hat ein selbst-evolutionäres Entscheidungssystem für hochwertige Entscheidungsszenarien (wie Finanz-Research und wissenschaftliche Forschung) vorgestellt. Durch die Aufzeichnung und Analyse der Entscheidungswege und des Feedbacks der Nutzer ermöglicht das System die Digitalisierung und Selbst-Evolution von Kognition. Es positioniert sich als „Cursor im Bereich der Entscheidungsfindung“ und hat eine Seed-Finanzierungsrunde in Höhe von mehreren zehn Millionen Yuan abgeschlossen (Quelle: 36kr)

📚 Forschung
CausalGame-Paper: Keines von 30 führenden Modellen besteht den Test auf kausales Denken : Das ICML 2026 Oral Paper „CausalGame“, das gemeinsam von MBZUAI, CMU, der Tsinghua-Universität und anderen veröffentlicht wurde, stellt einen neuen interaktiven Gaming-Benchmark vor, um das kausale Denken von 30 führenden LLM Agents zu testen. Die Ergebnisse zeigen, dass es allen Modellen bei Selektionsbias und verborgenen Confoundern nach wie vor schwerfällt, reale physikalische Kausalmechanismen zu erkennen. Die durchschnittliche Überlebensrate erreichte bei keinem Modell die Gewinnschwelle von 75 % (Quelle: causalgame.github.io)
VISReg-Paper: Lösung des Problems des „Repräsentationskollapses“ in JEPA-Weltmodellen : Eine neue Studie zum selbstüberwachten Lernen namens VISReg löst das Problem des verschwindenden Gradienten bei einem Kollaps früherer Methoden, indem sie den Regularisierungsterm zur Vermeidung von Kollaps in zwei unabhängige Komponenten – „Skala“ und „Form“ – entkoppelt. Die Methode zeigt auf 15 Datensätzen eine hervorragende Leistung und zieht mit nur einem Zehntel der Daten auf Out-of-Distribution (OOD)-Benchmarks mit DINOv2 gleich. Sie wurde von Yann LeCun mehrfach geteilt und empfohlen (Quelle: 36kr)

RepLLM-Paper: Automatische Konvertierung von Netzwerk-Forschungspapieren in ausführbaren Code : Das Team von Professor Xiang Qiao an der Xiamen-Universität hat in Zusammenarbeit mit der Shanghai Jiao Tong University, der Tsinghua-Universität und anderen Partnern ein Paper auf der SIGCOMM 2026 veröffentlicht, in dem das Multi-Agenten-Framework RepLLM zur Reproduktion von Netzwerkforschung vorgestellt wird. Durch die Zusammenarbeit von vier Agenten (Inhaltsanalyse, Architekturdesign, Codegenerierung und Audit-Fehlerbehebung) kann das Framework Netzwerk-Paper automatisch in ausführbaren Systemcode umwandeln und die Reproduktion in nur zwei Stunden abschließen (Quelle: 机器之心)

ABBEL-Paper: Steigerung der Lerneffizienz durch Selbstzusammenfassung in langandauernden Interaktionen : Das Berkeley AI Research Lab (BAIR) hat das Paper „ABBEL: Learning Natural-Language Belief States for Memory-Efficient Interaction“ veröffentlicht und stellt das ABBEL-Framework vor, das natürliche Sprache als „Belief States“ zur Informationsbegrenzung nutzt. Durch die Einführung einer Autoencoder-artigen Belief-Bewertung verbessert das Framework die Gedächtnis- und Lerneffizienz von Agenten bei langandauernden Interaktionen erheblich (Quelle: BAIR Blog)

💼 Business
Delta Intelligence schließt Angel++-Finanzierungsrunde über fast 500 Millionen Yuan ab : Delta Intelligence, ein auf die Entwicklung von Foundation-Modellen für native, universelle humanoide Roboter spezialisiertes Unternehmen, hat den Abschluss einer Angel++-Finanzierungsrunde über fast 500 Millionen Yuan bekannt gegeben. Zu den Investoren gehören mehrere börsennotierte Unternehmen und führende Finanzinstitute. Die Mittel werden für die Modelliteration, die Massenproduktion selbst entwickelter Datenerfassungsgeräte und den Aufbau von Datenkreisläufen verwendet, um den Einsatz humanoider Roboter in industriellen Szenarien voranzutreiben (Quelle: 36kr)

Fish Audio schließt Seed-Finanzierungsrunde über 50 Millionen US-Dollar ab : Das AI-Sprachmodell-Startup Fish Audio hat den Abschluss einer Seed-Finanzierungsrunde über 50 Millionen US-Dollar bekannt gegeben, angeführt von Coreline Ventures und Capital Today. Das Unternehmen hat bereits das Open-Source-Sprachgenerierungsmodell Fish Speech auf den Markt gebracht, das über 15.000 Steuerungsbefehle in natürlicher Sprache verfügt. Ziel ist es, Entwicklern und Unternehmen Dienste zur Stimmenklonung mit geringer Latenz und hoher Ausdruckskraft anzubieten (Quelle: TechCrunch)

Recursive Superintelligence unterzeichnet Rechenleistungsvereinbarung über 400 Millionen US-Dollar mit Amazon AWS : Das auf die Entwicklung selbstverbessernder AI-Systeme spezialisierte Unternehmen Recursive Superintelligence hat die Unterzeichnung einer mehrjährigen Rechenleistungsvereinbarung im Wert von 400 Millionen US-Dollar mit Amazon AWS bekannt gegeben. Die Vereinbarung wird Rechenleistung für das Training groß angelegter selbstverbessernder AI-Systeme von Recursive bereitstellen und dem Unternehmen helfen, noch in diesem Jahr seine ersten praktischen Agenten-Produkte auf den Markt zu bringen (Quelle: TechCrunch)
🌟 Community
„Konsum-Downgrade“ auf Unternehmensebene und der Aufstieg der Tokenomics : In den sozialen Medien wird intensiv darüber diskutiert, dass US-Unternehmen kollektiv aufhören, Geld für den Aufruf großer Modelle zu verschwenden, und sich stattdessen der „Tokenomics“ zuwenden, um die Kosten präzise zu kontrollieren. Unternehmen neigen dazu, einfache Aufgaben an kleinere oder Open-Source-Modelle weiterzuleiten und nur die Kernplanung teuren, geschlossenen Flaggschiff-Modellen zu überlassen. Hybride Implementierungen werden zum Mainstream, was die Anbieter großer Modelle dazu zwingt, die Preise zu senken und die Aufgabeneffizienz zu optimieren (Quelle: 36kr)
AI-Programmierassistenten formen Softwareentwicklungsprozesse und Talentstrukturen neu : Diskussionen in der Community weisen darauf hin, dass die Verbreitung von AI-Programmierung und Agent-Assistenten die Grenzen zwischen Produkt, Design und Engineering verwischt und „Full-Stack“- und „Generalisten“-Talente hervorbringt. Im traditionellen Softwareentwicklungsprozess senkt die Einführung von AI die Hürde für das Schreiben von Code, während produktspezifische Definitionen, Ästhetik und das menschliche Urteilsvermögen („Geschmack“) zu den neuen zentralen Engpässen werden (Quelle: 36kr)
Neue Vorschriften zur Regulierung anthropomorpher Interaktionen lösen Diskussionen über die Abschaltung von AI-Agents und emotionale Abhängigkeit aus : Mit dem offiziellen Inkrafttreten neuer inländischer Vorschriften zur Regulierung anthropomorpher Interaktionen haben einige Mainstream-Plattformen die Funktion für benutzerdefinierte AI-Agents abgeschaltet. Dies löste unter den Nutzern eine breite Diskussion über das „Herunterladen von Cyber-Liebhabern“ und virtuelle emotionale Abhängigkeit aus. Nutzer und Plattformen gerieten in tiefgreifende Meinungsverschiedenheiten über die Definition von virtuellem Eigentum, emotionaler Bindung und Compliance-Grenzen, was die Komplexität der emotionalen Bindung zwischen Mensch und Maschine im AI-Zeitalter verdeutlicht (Quelle: 36kr)
💡 Sonstiges
BYD stellt seinen ersten humanoiden Roboter im August offiziell vor : BYD hat offiziell bestätigt, dass sein erstes humanoid-robotisches Produkt Anfang August in der Zhengzhou-Halle des „Di Space“ offiziell vorgestellt wird. Es ist geplant, den Roboter im Händlernetzwerk für den Kundenempfang und Fahrzeugerklärungen einzusetzen. Eine kommerzielle Markteinführung wird in den nächsten ein bis zwei Jahren angestrebt (Quelle: 36kr)
SigmaStar beschleunigt Transformation hin zu Edge-AI-Chips mit hoher Rechenleistung : SigmaStar, ein weltweit führender Anbieter von Vision-AI-SoCs, beschleunigt seine Transformation hin zu Edge-Chips mit hoher Rechenleistung. Die Auslieferungen seiner Roboter-Vision-Chips haben bereits die 10-Millionen-Marke überschritten. Das Unternehmen hat einen 8-TOPS-Chip auf den Markt gebracht, der das lokale Ausführen großer Modelle unterstützt, sowie einen 32-TOPS-Chip für den Automobilbereich. Zudem plant das Unternehmen, noch in diesem Jahr die zweite Generation von AI-Brillen-Chips im Tape-out-Verfahren herzustellen (Quelle: 36kr)

Nvidia und OpenAI diskutieren über eine Finanzierungsgarantie in Höhe von 250 Milliarden US-Dollar für Supercomputer : Ausländischen Medienberichten zufolge verhandelt Nvidia mit OpenAI über die Bereitstellung einer Finanzierungsgarantie von bis zu 250 Milliarden US-Dollar für ein in Ohio geplantes 10-Gigawatt-Supercomputing-Zentrum mit Gesamtkosten von über 500 Milliarden US-Dollar. Das Projekt soll von einer Tochtergesellschaft von SoftBank Energy entwickelt werden und zielt darauf ab, durch die Bonitätsunterstützung von Nvidia den weltweit größten Kunden für Rechenleistungsbedarf zu sichern (Quelle: 36kr)
