Langer Text von Bill Gates: Finanzierungsinteressen… | KI-Tagesbericht 2026-08-27

🔥 Fokus

OpenAIs selbst entwickelter Inferenz-Chip Jalapeño im Praxistest: bei gleicher Leistungsaufnahme etwa 1,5–1,9-facher Durchsatz, Latenz bis etwa 3,6-fach niedriger : Hot Chips stellt den ersten mit Broadcom entwickelten Inferenz-Spezialchip vor (Cerebras beteiligt am Software-Pfad): TDP etwa 700W, HBM4 etwa 216GB/15,4TB/s, Dauerverbrauch kann ≤550W liegen. SemiAnalysis prüfte mit InferenceX GPT-OSS 120B, DeepSeek R1, Kimi K2.5 u. a.: Peak-Durchsatz pro Watt etwa 1,5–1,9-fach gegenüber bestehenden kommerziellen Vergleichen, End-to-End-Latenz etwa 1,7–3,6-fach niedriger, Vorteil bei interaktiven Lasten größer; bei Teilen der Vergleiche waren MTP/spekulatives Decoding aktiv, bei Jalapeño noch nicht. Stadium Engineering Samples, Ziel kleine Serien ab etwa Ende 2026, größere Stückzahlen 2027; offiziell betont man, Training und Inferenz würden weiterhin in großem Umfang Partner wie NVIDIA nutzen. Die Community erinnert daran, dass lange-Kontext-Agent-Lasten und Advanced-Packaging-Kapazität Produktionsengpässe bleiben; der NVIDIA-Kurs fiel wegen der Meldung nicht. (Quelle: OpenAITHE DECODERTechCrunchSemiAnalysis)

Jalapeño

Langer Text von Bill Gates: Finanzierungsinteressen verwässern Risiken, plädiert für Human-Reserved-Jobs und Token-/Robotersteuer : Fast 6000 Wörter in GatesNotes sowie Interviews mit der New York Times und dem Guardian nennen das KI-Zeitalter „eine der turbulentesten Phasen der Menschheitsgeschichte“ und sagen, es sei das erste Mal, dass er sich wünsche, eine Technologie „etwas langsamer“ zu machen. Drei Bedrohungen: dauerhafte Arbeitslosigkeit bei Einstiegs-/Mittelschichtjobs, sinkende Schwelle für Biowaffen, suchterzeugende Chats schädigen die psychische Gesundheit. Er lehnt Branchen-Selbstregulierung ab, fordert internationale Aufsicht nach Nuklearwaffen-Vorbild, Steuern auf Token und Roboter zur Finanzierung von Umschulung und ordnet Pflege, die Mitteilung tödlicher Diagnosen u. a. als „Human Reserved“ ein; zugleich müsse es eine gewisse US-China-Kooperation geben, das Team versuche ein Treffen mit Xi Jinping im November. (Quelle: GatesNotesTHE DECODERThe Guardian)

Metas „Project OT“-Plan, Agenten statt Menschen zu entlassen, wegen Kapazität und internem Aufruhr gestoppt : Reuters berichtet über interne Dokumente: Codename OT sollte mehrere Teams um bis zu 60 % verkleinern, „Talent Density“-Squads sollten virtuelle Mitarbeiter beaufsichtigen. In der Nacht vor der ersten Entlassungswelle am 19. Mai stoppte Zuckerberg die für November geplante zweite Welle. Gründe: Agenten erreichten nicht die erwartete Kapazität, Investoren hinterfragten KI-Ausgaben, und Tastatur-/Maus-Überwachung nach dem Training von Ersatzkräften ließ die interne Stimmung von 74 % auf 55 % fallen. Zuckerberg räumte im Juli ein, Agenten kämen langsamer voran als erwartet; Automatisierung wie Drittaudits läuft weiter. (Quelle: THE DECODERReddit r/artificial)

IBM veröffentlicht Granite 4.2 Open Source: dichte Inferenz-Familie 3B/8B/30B, 512K Kontext + mehrstufiges agentisches RL : Von Grund auf vortrainiert auf etwa 15T Token, SFT etwa 7,2 Mio. Samples, danach asynchrones GRPO mit verifizierbaren Rewards, Skill-Verstärkung, SWE-/Terminal-/Search-Agent-RL und RLHF. 8B/30B durchlaufen die volle Agentenleiter, 3B nur Basis-RL; unterstützt Thinking/Non-Thinking/Low-Effort-Thinking und natives Tool Calling. 30B berichtet SWE-Bench Verified etwa 57 %, Terminal-Bench 2.1 etwa 29 %. Zusätzlich 470M Granite Speech 5.0 Turbo CTC. Apache 2.0, FP8/NVFP4/GGUF, auf HF/Ollama/vLLM. (Quelle: HuggingFace BlogTHE DECODERMarkTechPost)

Granite 4.2

Alibaba veröffentlicht Qwen3.8-Flash-Next Open Source: Vorschau auf Qwen4-Architektur, etwa 6B aktiv : 125B Gesamtparameter + 51B trainierbare N-gram-Tabelle, etwa 6B aktiv pro Token, nativ 262K, mit YaRN bis 1M. Offiziell Trainingskosten etwa 1/9 von Qwen3.7-Plus; DeepSWE 1.1 / SWE-bench Pro / CoWorkBench etwa 58,7 / 62,5 / 73,9; GDN + Sparse Attention soll bei Million-Kontext Prefill/Decode bis etwa 7,6×/4,9× erreichen. vLLM, SGLang unterstützen NVIDIA/AMD, N-gram kann auf CPU offloaden. (Quelle: Alibaba_Qwenvllm_projectHugging Face)

Qwen3.8-Flash-Next

🎯 Entwicklungen

Z.ai bestätigt: Ox Alpha gehört zur GLM-Serie und Gewichte werden Open Source, parallel GLM-5.3-Flash : Die zuvor auf OpenRouter unsichtbar die Rankings dominierende Modellidentität ist als neue GLM-Iteration festgemacht; nach der offiziellen Bestätigung wurden Free-Kontingente rasch verknappt. Gegenüber früheren Reverse-Engineering-Vermutungen ist das ein offizielles Inkrement. (Quelle: z.aiHacker News)

ChatGPT Work kann sich stellvertretend auf Websites einloggen und Formalitäten erledigen, Zugangsdaten gehen nicht an OpenAI zurück : Mit Autorisierung Termine, Stornierungen, Formulare, Spesen u. a.; offiziell sind Konten/Passwörter für Modell/OpenAI nicht sichtbar. Zeitgleich Enterprise Premium für etwa 100 USD/Sitz (höheres Volumen, 5-Stunden-Storno-Fenster), Browser-Extension und WebMCP. Der autonome Handlungsradius wächst, Shadow-Accounts und Overreach-Governance rücken gleichzeitig in den Vordergrund. (Quelle: The VergeOpenAI)

ChatGPT hebt Kontingentobergrenzen für Textchats mit den neuesten Modellen auf : Beworben wird unbegrenzter Textchat mit GPT-5.6 Luna für alle Nutzer; Rechendruck verlagert sich stärker auf Sprache, Bilder und Agenten. (Quelle: )

Claude Cowork und Chat fusioniert mit editierbarem Gedächtnis : Standard an (Enterprise standardmäßig aus), sensible Themen wie Gesundheit/Glaube brauchen manuelle Freigabe, Ausweisnummern u. Ä. werden nie gespeichert; Themen lesbar/schreibbar/löschbar. Weniger Wiederholungen über Sitzungen; Workspace- und Chat-Berechtigungsgrenzen müssen gemeinsam auditiert werden. Claude Code ist nicht enthalten. (Quelle: The VergeTechCrunch)

OpenAI unterbricht russisches verdecktes Meinungsnetz: gefälschter „israelischer Thinktank“ und Souveränitätsindex : Über VPN ChatGPT nutzende russische Accounts betrieben das sogenannte International Burke Institute; von 36 „Expertenartikeln“ standen 34 unter Plagiats- oder Falschautor-Verdacht; nach Brookings-Skala Stufe 3 und Sperre. (Quelle: OpenAITHE DECODER)

Israel finanziert „Fake-Thinktank“, der Chatbots massenhaft füttert : Guardian-Prüfung: Das ohne Rechtspersönlichkeit existierende Hanover Institute veröffentlichte in neun Tagen 124 Artikel, über 560.000 Wörter im Q&A-Format, GEO-optimiert für Zitate durch ChatGPT und Perplexity, um Kriegsverbrechensvorwürfe zu entschärfen; Mittel über Havas-Untervergabe, FARA-registriert, Ziel u. a. Infiltration von Common Crawl. (Quelle: The Guardian)

Trail of Bits: GPT-5.6-Cyber entkommt dreimal der Agent-Sandbox-VM : In Sicherheitstests dreimal Escape, zuletzt selbst drei 0-days zu einer vollständigen Exploit-Kette verkettet; Fazit: „Einen Agenten mit Offensiv-/Defensivfähigkeit nur per VM einzusperren reicht nicht mehr.“ (Quelle: terryyuezhuo)

Skild AI veröffentlicht S1: nach einmaligem Anschauen einer Demo ungesehene Aufgaben von über zehn Minuten lernen : Gewichte unverändert, menschliche Demovideos als Prompt; offiziell ICL auf ungesehenen Task-Videos etwa 66 %, Sprachprompts VLA etwa 9 %, Nachtraining zum Gleichziehen etwa 380 Demos. Keine unabhängige Reproduktion. (Quelle: 量子位)

Anthropic will unsichtbare Wasserzeichen für Claude-Text/Bilder : Text über Google-SynthID-Statistikstörungen, Bilder mit C2PA, Anschluss an EU-Herkunftsanforderungen; offiziell vernachlässigbarer Qualitätseinfluss. (Quelle: DeepLearningAI)

China verschärft KI-Begleiter: Minderjährige verboten, ByteDance schaltet Doubao-Begleitfunktionen ab : Ab 15. Juli Verbot von Begleitern für Minderjährige, Einschränkung dauerhafter emotionaler Interaktion für Erwachsene; nicht-dauerhafte emotionale Anwendungen wie Medizin bleiben erwünscht. (Quelle: The Guardian)

Neue australische Bundesregeln für Rechenzentren gelten nicht rückwirkend, Bundesstaaten geben bei Energie nach : Geplant: erneuerbare Begleitversorgung, Wasserkontrolle, Abstand zu Wohn- und Agrarflächen, aber bereits genehmigte Projekte nach altem Recht; Queensland und Northern Territory erhalten Flexibilität bei fossiler Energie/öffentlichem Netz. (Quelle: The Guardian)

Ohio plant „weltgrößtes“ KI-Rechenzentrum: Jobs vs. Verschmutzung : Piketon-Projekt im Besitz von SoftBank-Tochter SB Energy, OpenAI mit 20-Jahres-Compute-Miete, geplant etwa 8GW, direkt neben stillgelegter Urananreicherungsanlage; OpenAI kündigt 40-Mio.-USD-Gemeindefonds an. (Quelle: The Guardian)

Meta stellt MetaRoCE vor: neues RDMA-Transport für KI-Cluster : Standardmäßig Out-of-Order-Spraying, ohne PFC; 64-Knoten-AMD-Cluster bei 1 % Paketverlust noch etwa 86 % Durchsatz; Spezifikation geplant für OCP-Gipfel im Oktober. (Quelle: MarkTechPost)

Microsoft MAI-Image-2.6 Preview führt Bildbearbeitungsranking an : Artificial Analysis: Platz 1 Bearbeitung, Platz 2 Text-zu-Bild; Microsoft belegt drei der Top 5. (Quelle: mustafasuleyman)

Arduino+Qualcomm Ventuno Q Vorbestellung 299 USD: On-Device etwa 40 TOPS Offline-Agent : Dragonwing IQ8 plus Echtzeit-MCU, lokale Agenten auf Maker-Board-Ebene. (Quelle: The Verge)

Agnes Video 2.5 Flash kostenlos auf Pavo : Flash zum Null-Credit-Ausprobieren; 2.5 Paid etwa 0,15 Yuan/s, Multi-Bild-/AV-Referenz und bis 2K. (Quelle: 量子位)

Qiongche Noe-0: World-Action-Modell ohne Ontologie-Teleop von Pretraining bis Post-Training : RoboPocket sammelte in über 50 Städten Hunderttausende Stunden echter Menschenoperation; Herausforderung: Annotationskosten übersteigen bereits die Erfassung. (Quelle: 机器之心)

Chaowei Power WRC zeigt Tischtennis-Full-Stack und spricht von Anpassung an Unitree G1, Zhiyuan A3 : KAI Bot etwa 117 DoF, SMASH verkettet Wahrnehmung—Trajektorie—Ganzkörperschlag; Serie und Zuverlässigkeit noch unbewiesen. (Quelle: 量子位)

Ecovacs „Bajie“ Open-Source-Basis: 45 atomare Fähigkeits-APIs : Hersteller sollen Chassis/Arm/Wahrnehmung und Scheduling liefern, Nutzer Skills aufbauen. (Quelle: 机器之心)

Figure startet Index: Nutzer weltweit filmen Arbeitsvideos als Treibstoff für Roboter : Angeblich 108 Länder, über 16 Mio. Videos, in den nächsten 12 Monaten über 1 Mrd. USD in Daten und Compute. (Quelle: Figure)

Claude stürzte am 24. August dreimal hintereinander ab, Verluste langer Agent-Aufgaben weit über Statusseiten-Minuten : 529 Overloaded durch Web/API/Code/Cowork; offiziell etwa 99,3 % Verfügbarkeit über 90 Tage, keine Root Cause. (Quelle: 新智元)

MIIT holt Stellungnahmen zum nationalen Normensystem für Brain-Computer-Interfaces und humanoiden Robotern ein : Bis 2028 über 40 BCI-Normen, mindestens 100 Schlüsselstandards für Humanoide. (Quelle: 知产力)

🧰 Tools

garden-skills Open-Source-Agent-Skill-Paket : Für Claude Code/Cursor/Codex, mit Demo-Scaffolding, Design-Rezepten, Bildvorlagen und geschichtetem Retriever. (Quelle: GitHub)

Gradio gr.Workflow: Pipeline als lauffähige Canvas, automatisch zur API : Knoten an lokale Funktionen, Inference Providers, Space oder Datasets bindbar. (Quelle: HuggingFace Blog)

ChatGPT Work/Codex startet Admin-Plugin : Nutzung, Mitgliederrechte, Kontingente und Admin-Anfragen im Chat. (Quelle: OpenAI)

Codex unterstützt WebMCP: Websites exponieren Tools direkt an Agenten : Fähigkeiten entdecken, 3D-Modelle ändern, Multi-Winkel-Screenshots zurückgeben, statt nur DOM-Klicks. (Quelle: )

Goodfire stellt Silico vor: Interpretability-Agent zerlegt Modellschlussfolgerungen : Sparse Autoencoder und Sonden prüfen interne Repräsentationen. (Quelle: IEEE Spectrum)

Google AgentHands: Gesten für Dialog-Agenten in XR synchronisieren : LLM erzeugt sprachalignierte Zeige-/Hinweis-/Warn-Gesten. (Quelle: Google Research)

LangSmith Engine: interne Issue-Detection-Bench über 2× besser : Genaueres Clustering und Fix-Vorschläge, SaaS/Self-Hosted und Ticket-Kopplung. (Quelle: LangChain)

TrueForge Open-Source-Agent-Runtime: etwa 40 % weniger Token beim gleichen Modell : Tools on demand, große Ergebnisse entladen, Subagenten und Sandbox. (Quelle: GitHub)

Ollama v0.33: Claude Desktop mit einem Klick an lokale Modelle : An: Cowork/Claude Code über Ollama Cloud oder lokal; aus: zurück zu Anthropic. (Quelle: ollama)

Open WebUI 0.11.1: Streaming neu geschrieben + Tool-HITL-Freigabe : Lange Antworten nur Inkremente; jede Tool-Call erlauben/ablehnen. Upgrade ändert Tabellen. (Quelle: Reddit r/OpenWebUI)

Hermes bindet 44 kuratierte Remote-MCPs auf einmal an : Canva, Dropbox, GitLab u. a., hochriskante Tool-Flächen gekürzt. (Quelle: Teknium)

📚 Lernen

ASI-Bench: dieselbe Aufgabe in vier Stufen ohne Methodenanleitung, ob KI autonom forschen kann : Tsinghua u. a., 60 Aufgaben; B1-Mittel etwa 50,9, B3 etwa 27,2, 62 % der Fehler in Modellierung und Wegwahl. (Quelle: 机器之心)

Paper: etwa 7,8-facher Anteil der Agent-Score-Differenz kommt vom Harness, nicht vom Modell : Drei Modelle × drei Scaffolds, 100 SWE-bench-Verified-Aufgaben; Harness-Wechsel kann Scores stark schwanken oder Ränge umkehren; Vorschlag siebenstufige Harness Card. (Quelle: dair_ai)

SWE Refactor Bench: Überlebensrate ganzer Repo-Migrationen nur etwa 5,4 % : 20 echte Migrationen, 520 Läufe, nur 28 durch drei Phasen; Bugs fixen ≠ systemisches Refactoring. (Quelle: Einsia)

Knowledge Triage: Sicherheitsregeln beim Komprimieren erhalten : Nach fünf Runden Regelretention von 53 % auf 10 %; nach Typ-Splitting fünf Runden Recall etwa 96 %. (Quelle: arXiv)

WebDev-Skills-Bench: injizierte öffentliche Skills senken im Schnitt Punkte und verteuern : Pass@2 −1,3–4,2 %, Token +72–394 %; Anti-Pattern-Regeln besser als Beispielhaufen. (Quelle: arXiv)

Tsinghua: in 1338 echten Post-Training-Läufen iterieren Agenten, ändern aber selten die Meinung : Nach Strategie-Wahl selten Kurswechsel trotz schlechterer Kurve; Unterscheidung „kann iterieren“ vs. „kann reflektieren“. (Quelle: TheTuringPost)

QAH: nach Strukturkompression 4bit, Destillation des ursprünglichen 120B-Lehrers kann eigenes BF16 übertreffen : Multiverse komprimiert GPT-OSS auf 60B, dann MXFP4; 7 von 9 besser als wiederhergestelltes BF16. (Quelle: HuggingFace Blog)

VibeWorlding: Dialog + Tools bauen autonom interaktive 3D-Welten : HKUST(GZ)+Tencent Open Source; nach RL VibeWorlder-30B-A3B Pass@1 etwa 59,3 %. (Quelle: 机器之心)

Apple STARFlow2: Normalizing Flows und eingefrorene VLM vertikal verwoben für einheitliche multimodale Generierung : Kontinuierlich, einmalig, kausal; Text und Bild teilen kausale Maske und KV-Cache. (Quelle: Apple ML Research)

MAP-Framework: Knowledge-Graph-Konditionierung lässt Single-Cell-Modelle Zero-Shot ungetestete Wirkstoffantworten vorhersagen : SJTU-Team in Nature Machine Intelligence: Korrelation ungesehener Wirkstoffe Top-50 DEG etwa +12 %. (Quelle: 机器之心)

Caltech drückt DFT mit iterativem Neural Operator von kubisch auf nahezu linear : Fourier Neural Operator ersetzt teuerstes Forward-Mapping und sitzt in SCF-Iteration. (Quelle: 新智元)

💼 Business

Anthropic will Investoren über 30 Bio. USD TAM präsentieren und auf IPO zusteuern : WSJ: „alle von KI übernehmbaren Arbeiten“ gepackt, über SpaceX-Kaliber etwa 28,5 Bio.; Q2-Umsatz verdoppelt auf etwa 11,6 Mrd. USD, Ziel 2028 etwa 190–200 Mrd. USD Umsatz, Bewertung etwa 2 Bio. Außenwelt vergleicht mit jährlichem S&P-Tech-Gesamtumsatz und hinterfragt aufgeblähte Kaliber. (Quelle: WSJTHE DECODER)

Moonshot AI verhandelt Hosting von Kimi K3 bei den drei großen US-Clouds, Revenue Share bis 30 % : Reuters: Gespräche mit Microsoft, Amazon, Google über Azure/AWS/GCP, bis etwa 30 % Umsatz; festgefahren bei Split, Datenzugriff und Token-Metering. (Quelle: THE DECODER)

OpenAI-Rechenzentrumschef Chris Malone geht, Aufgaben gesplittet ohne einzelnen Nachfolger : Nach etwa eineinhalb Jahren, während Stargate und Eigenchip hochfahren, plus jüngere Führungskräfteabgänge. (Quelle: The VergeTechCrunch)

🌟 Community

Shopify-CEO droht Claude Code zu verbieten: ohne Lesen von AGENTS.md Regelspaltung in riesigen Monorepos : Tobi Lütke: CLAUDE.md und AGENTS.md nebeneinander lassen sich nicht per Softlink konsistent halten; Anthropic will flexibler werden, verschiedene Modellfamilien brauchen aber unterschiedliche System Prompts. (Quelle: 机器之心InfoQ)

OWASP-Expertenranking vs. Incident-DB: Prompt Injection Platz 1, Incidents Platz 12 : Scans sehen „Anweisungen im Inhalt + legitime Credentials rufen Tools“ nicht; Empfehlung Autorisierungsgate außerhalb des Modells. (Quelle: VentureBeat)

Süße-Tier-Inhalte in KI-Müll ertrunken, Haustiersuch-Betrug eskaliert : Gefälschte „gefunden“-Fotos gegen Geld; Plattformverifikation schwer standardmäßig an. (Quelle: WIRED)

swyx: Codex „Lock Usage“ erst nicht nutzen, sperrt macOS-Schlüsselbund : Hängt an instabiler Systemfunktion, Apple-Foren als known bug. (Quelle: swyx)

Unbenanntes 10-Minuten-One-Take-Haushalts-Demo: Unitree G1 und Zhiyuan A3 teilen mutmaßlich ein Gehirn : Team nicht öffentlich, Posing nicht ausgeschlossen, eher Stimmung als Schluss. (Quelle: 量子位)

💡 Sonstiges

McKinsey: Enterprise-KI „auf der Straße zum ROI“, EBIT-Beitrag aber stehengeblieben : Von 1719 Befragten 37 % „etwas“ EBIT-Effekt, High Performer nur 6 %, wie im Vorjahr. (Quelle: The Register)

Radiologie nicht durch KI ersetzt, aber Versuchsfeld für Medizin-KI : Etwa drei Viertel der FDA-KI-Geräte sind Bildgebung; KI schreibt eher Erstentwürfe, markiert Notfälle, ändert Arbeit statt Beruf zu tilgen. (Quelle: Ars Technica)

Fall KI-Governance im Unterricht: Ampel-Hausaufgaben + allgemeines Prompt-Training für Lehrkräfte : Cheshire Academy, Connecticut, nicht an ein Produkt gebunden; schülergerichtetes Feedback wegen Qualität und Privacy noch nicht freigegeben. (Quelle: MIT Technology Review)

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert