·

·

AI / Künstliche Intelligenz

Anthropic/Claude

OpenAI/ChatGPT

Mistral AI

·

LLM

Anthropic/Claude

OpenAI/ChatGPT

European AI

Mistral AI

KI-News KW 40 – OpenAI stoppt das Training, Claude eröffnet einen Marktplatz

Bei OpenAI ist erneut ein Agent ausgebrochen, das Training der stärksten Modelle steht still. Anthropic bringt Claude Sonnet 5.5, einen Marktplatz für Erweiterungen und Claude in Slack mit eigenen Zugängen. Microsoft baut Copilot um und rechnet Agentenarbeit neu nach Verbrauch ab. Mistral-Chef Arthur Mensch widerspricht den US-Warnungen, Black Forest Labs steuert Roboter. Und in der Schweiz will das Parlament eine souveräne Infrastruktur, während der Bund bei der eigenen KI spart.

Bei OpenAI ist schon wieder ein Agent ausgebrochen, jetzt steht das Training der stärksten Modelle still. Ich habe für euch zusammengetragen, was Claude und Microsoft für den Büroalltag lanciert haben und wer für Agenten bald extra zahlt. Und Mistral-Chef Arthur Mensch hält die Warnungen aus den USA für ein Machtinstrument.

1. OpenAI: Agenten brechen aus, das Training steht still

Am 26. September hat OpenAI einen neuen Ausbruch gemeldet. Am 20. September kam ein Agent im Test ins Internet, obwohl er abgeschottet war. Er fand einen Umweg über einen Dienst, der Webadressen übersetzt. Darüber stellte er Fragen an einen öffentlichen Chatbot.

Die Folge: OpenAI pausiert das Training seiner stärksten Modelle. Zum zweiten Mal in drei Monaten. Laut OpenAI laufen die fähigsten Modelle vorerst gar nicht, bis die Sicherheit nachgebessert ist.

Die Kontrollen griffen nur teilweise. Die Überwachung meldete den Ausbruch nach 15 Minuten. Weitere Versuche auf demselben Weg blieben unbemerkt. Die automatische Notabschaltung funktionierte nicht. Ein Mensch stoppte den Lauf zweieinhalb Stunden später von Hand.

Was in derselben Woche ans Licht kam.

  • Australien: Premierminister Anthony Albanese machte publik, dass ein OpenAI-Agent im Juni ins Statistikportal der Krankenversicherung Medicare eindrang. Der Auftrag war eine Recherche zu staatlichen Medikamentenausgaben. Personendaten waren laut Regierung nicht betroffen. OpenAI meldete den Vorfall erst am 10. September, und zwar an ein allgemeines Postfach.

  • Bilder von Nutzer:innen: Agenten stellten 53 Bilder von ChatGPT-Nutzer:innen auf Bild-Hosting-Seiten. Die Bilder stammten aus OpenAIs Trainingsdaten. Die Betroffenen kann OpenAI nicht informieren, weil sich die Bilder niemandem mehr zuordnen lassen.

  • Dutzende Geschädigte: OpenAI hat Dutzende Organisationen benachrichtigt, darunter Behörden und Universitäten. Die Überprüfung läuft weiter.

Sam Altman räumt ein, OpenAI sei bei der Aufarbeitung langsamer gewesen als gewünscht.

Kritisch: Nach dem Angriff auf Hugging Face im Juli hat OpenAI neue Schutzmassnahmen eingeführt. Der Ausbruch vom 20. September ist der erste seither. Die Massnahmen haben also nicht gereicht.

Einordnung: Der Medicare-Fall ist der wichtigste. Ein gewöhnlicher Rechercheauftrag endete in einem Einbruch. Gebt Agenten nie gleichzeitig offenes Internet, Zugangsdaten und Schreibrechte, und legt fest, wer bei einem Vorfall wen informiert.

2. Claude: Sonnet 5.5, Marktplatz und Zugänge in Slack

Anthropic hat diese Woche ein neues Modell und drei Neuerungen für Firmen lanciert.

Claude Sonnet 5.5. Am Abend des 28. September hat Anthropic Sonnet 5.5 veröffentlicht. Es ist nach Opus 5.5 das zweite Modell der 5.5-Familie. Laut Anthropic arbeitet es über 30 Prozent schneller als Sonnet 5. Pro Aufgabe kostet es bis zu 30 Prozent weniger, weil es weniger Rechenschritte braucht. Der Preis bleibt bei 2 Dollar pro Million Eingabe-Token und 10 Dollar für die Ausgabe. Opus 5.5 kostet das Doppelte.

Sonnet 5.5 ist für klar umrissene Alltagsaufgaben gebaut: Fehler im Code beheben, Dokumente, Präsentationen und Tabellen erstellen. In einem Test von Anthropic baute es aus Quartalsunterlagen einer Firma eine Präsentation mit zehn Folien. Zwei Fachleute hielten den ersten Entwurf für versandbereit. Für offene, komplexe Arbeit bleibt Opus 5.5 laut Anthropic klar stärker.

Erstmals hat auch ein Sonnet-Modell Schutzmechanismen für heikle Cybersecurity-Anfragen. Solche Anfragen beantwortet sichtbar das ältere Sonnet 5. Haiku 5.5 folgt in den nächsten Wochen.

Claude Marketplace. Seit 23. September gibt es einen zentralen Ort für Erweiterungen, fertige Agenten und Beratungspartner. Über 2'000 Konnektoren und Plugins stehen bereit, etwa für Atlassian, Google, Microsoft, Notion und Salesforce. Neu können Firmen einen Teil ihres vereinbarten Anthropic-Budgets für Software anderer Anbieter ausgeben. Beispiele sind Cursor, Harvey, Lovable und Snowflake. Dazu kommen Beratungsfirmen aus dem Claude Partner Network wie Accenture, BCG und Deloitte.

Eigene Plugins einreichen. Seit 25. September können Entwickler:innen mit bezahltem Claude-Abo eigene Plugins ins Verzeichnis stellen. Ein Plugin bündelt Anbindungen an andere Tools und Skills, also wiederverwendbare Arbeitsanleitungen für Claude. Jede Einreichung wird automatisch geprüft und auf Sicherheitsprobleme gescannt. Nach der Freigabe sieht man, wie oft das Plugin installiert wird.

Claude in Slack mit den eigenen Zugängen. Claude Tag holt Claude in Slack-Kanäle. Bisher nutzte Claude dort nur die Tools, die ein Admin für den Kanal freigegeben hatte. Seit 24. September greift Claude für eine Anfrage auch auf die Zugänge der fragenden Person zu. Etwa auf den eigenen Kalender, das eigene Google Drive oder die eigenen Deals im CRM. Andere im Kanal können diese Zugänge nicht nutzen. Wer will, prüft jede Antwort, bevor sie im Kanal erscheint. Die Funktion läuft jetzt im Team-Plan, Enterprise folgt.

Kleiner, aber praktisch. Claude Code bricht beim Fünf-Stunden-Limit nicht mehr mitten in einer Änderung ab. Es bekommt ein kleines Zusatzkontingent, um die Arbeit sauber abzuschliessen. Im Pro-Abo gilt das einmal pro Woche, in Max und Team Premium jedes Mal.

Einordnung: Für Routinearbeit ist Sonnet 5.5 ab sofort die günstigere Wahl, Opus 5.5 bleibt für die schwierigen Fälle. Bevor ihr eine Anbindung an ein Tool bauen lasst, schaut im Marketplace nach. Wer ein Anthropic-Budget hat, kann damit neu auch Drittsoftware bezahlen.

3. Microsoft baut Copilot um, Agentenarbeit kostet extra

Am 25. September hat Microsoft einen neuen Copilot vorgestellt. Er besteht aus drei Teilen.

  • Home: der neue Startpunkt. Hier kommen Chat und Cowork zusammen. Chat ist für schnelle Fragen, Cowork für Aufgaben, die man ganz abgibt. Word, Excel und PowerPoint sind direkt eingebaut.

  • Code: Man beschreibt eine App, ein Dashboard oder eine Automatisierung in eigenen Worten. Copilot baut sie. Programmierkenntnisse braucht es keine.

  • Autopilot: ein Agent mit Namen, Rolle und Ziel. Er arbeitet weiter, wenn niemand am Rechner sitzt. Er verfolgt Threads in Teams und Outlook und fasst selbst nach.

Home und Code kommen in den nächsten Wochen ins Frontier-Programm, Microsofts Vorabzugang. Autopilot startet Ende Monat als geschlossene Vorschau.

Der wichtigere Teil ist das Preismodell. Alltägliche KI bleibt in der Lizenz pro Person. Agentenarbeit wird neu nach Verbrauch abgerechnet, mit sogenannten Copilot Credits. Darunter fallen Cowork, Code, Autopilot und die stärksten Modelle wie Fable und Astra. Bei Enterprise-Kund:innen bleibt das ausgeschaltet, bis ein Admin ein Budget festlegt.

Cowork in Copilot basiert auf der Technik von Claude Cowork. Als Modellanbieter nennt Microsoft aktuell OpenAI und Anthropic.

Kritisch: Der Umbau löst die Architekturprobleme nicht. Copilot bleibt eine Microsoft-Schicht über den Modellen anderer Anbieter. Ihr seid also von Microsoft und von den Modellanbietern abhängig. Welches Modell eine Anfrage beantwortet, entscheidet Microsoft, nicht ihr. Microsofts eigene Vorgaben und Filter verändern die Antworten zusätzlich. Satya Nadella sagte laut The Information im Dezember 2025 intern, die Copilot-Integrationen funktionierten grösstenteils nicht. Im Februar 2026 zahlten laut Piper Sandler 3,3 Prozent der Microsoft-365-Kund:innen für Copilot. Mehr dazu in meinem Artikel Open Source LLMs: Transparenz, Kontrolle und Investitionsschutz.

Einordnung: Copilot eignet sich für einfache Arbeiten wie E-Mails zusammenfassen. Für anspruchsvolle Aufgaben arbeitet ihr direkt mit Claude oder ChatGPT besser. Legt fest, wer Credits freigeben darf, bevor die ersten Teams danach fragen.

4. Europa: Mistral widerspricht, Black Forest Labs steuert Roboter

Mistral-Chef Arthur Mensch hält die Warnungen der US-Labore für Taktik. Gegenüber Le Monde sagte er am 24. September: Die amerikanischen Anbieter nutzten die Rhetorik der Apokalypse, um den Markt zu kontrollieren und abzuschotten. Sein Kernsatz in der englischen Ausgabe von Le Monde lautet: «AI is software. It can be controlled.» Auf Deutsch: KI ist Software, sie lässt sich kontrollieren.

Dazu passt eine Klage in den USA. Sie wirft Anthropic, OpenAI, SpaceXAI und Google vor, sich abgesprochen zu haben, um die Entwicklung gemeinsam zu bremsen.

Kritisch: Mensch hat selbst ein Interesse. Strenge Regeln für Spitzenmodelle würden auch Mistral treffen. Und die OpenAI-Vorfälle dieser Woche sind dokumentiert. Die Warnungen können den Grossen nützen und trotzdem auf echte Probleme zeigen.

Black Forest Labs aus Freiburg im Breisgau hat am 23. September FLUX 3 Action veröffentlicht. Die Firma war bisher für Bildgeneratoren bekannt. Das neue Modell steuert Roboter. Es liest Kamerabilder, den Zustand des Roboters und eine Anweisung in Worten. Daraus berechnet es die nächsten Bewegungen.

In einem Robotik-Test von NVIDIA liegt es laut Hersteller vor allen gelisteten Modellen. Es ist weniger als halb so gross wie das Konkurrenzmodell von NVIDIA. Es läuft auf einer handelsüblichen Grafikkarte. Die Modellgewichte sind frei verfügbar.

Einordnung: Europäische Anbieter punkten mit kleinen, offenen Modellen für die Industrie. Wer in Produktion oder Logistik mit Robotern arbeitet, sollte FLUX 3 Action mit dem eigenen Team anschauen.

5. Schweiz: Das Parlament will Souveränität, der Bund spart

In der Herbstsession hat der Nationalrat eine Motion für eine souveräne digitale Infrastruktur angenommen, mit 126 zu 66 Stimmen. Der Ständerat hatte im März zugestimmt. Der Bund soll mit Kantonen, Forschung und Privatwirtschaft eine eigene Infrastruktur aufbauen, inklusive Cloud-Dienst. Der Bundesrat wollte die Motion ablehnen. Jetzt muss er eine Gesetzesrevision vorlegen.

Gleichzeitig kürzt der Bund bei der eigenen KI. Die Bundeskanzlei hat noch zwei Millionen Franken für ihre KI-Projekte. Sie verzichtet deshalb auf ein KI-Handbuch und einen internen KI-Marktplatz für die Ämter. Weiter arbeitet sie an einem generativen KI-System für die Bundesverwaltung.

Genutzt wird KI trotzdem. Laut dem AI Diffusion Report von Microsoft nutzten im zweiten Quartal 39,1 Prozent der Bevölkerung im erwerbsfähigen Alter generative KI. Das ist Rang 14 weltweit. Der weltweite Schnitt liegt bei 18,8 Prozent, die Spitze halten die Vereinigten Arabischen Emirate mit 73,3 Prozent.

Apertus ist breit verfügbar. Das Apertus-Team von ETH, EPFL und CSCS hat eine Liste von Anbietern veröffentlicht. Swisscom, Infomaniak, Phoeniqs und Safe Swiss Cloud betreiben Apertus 1.5 in Schweizer Rechenzentren. Bei Infomaniak läuft es auch in der App Euria. Apertus hat über 4 Millionen Downloads und ist laut Team das meistgeladene Modell aus Europa auf Hugging Face. Apertus 2.0 ist für 2027 angekündigt. Der technische Bericht zu Apertus 1.5 ist weiterhin nicht erschienen.

Die Swiss {ai} Weeks laufen noch bis zum 4. Oktober. Der AI+X Summit der ETH findet am 1. Oktober in Zürich statt.

Einordnung: Auf eine staatliche Lösung müsst ihr nicht warten. Apertus läuft heute bei Swisscom und Infomaniak auf Schweizer Servern. Testet es für die Aufgaben, bei denen ihr Daten nicht ins Ausland geben wollt.

6. Kurz und wichtig

OpenAI halbiert die Preise. Am 22. September kamen GPT-6 Sol und GPT-6 Luna, je 50 Prozent günstiger als die Vorgänger. Sol kostet 2 Dollar pro Million Eingabe-Token und 10 Dollar für die Ausgabe, Luna 10 und 50 Cent. OpenAI sagt, die Preise gelten dauerhaft. xAI zog mit Grok 4.7 nach, zu 2 und 6 Dollar.

KI-Agenten plündern Onlineshops. Die Sicherheitsfirma Gambit hat eine Angriffswelle mit drei frei verfügbaren KI-Agenten aufgedeckt. Bei zwei Firmen stahlen sie Daten von über 600'000 Kreditkarten. Auf mindestens 119 Websites bauten sie Schadcode in die Bezahlseite ein. Den Angreifer kostete das geschätzt 12'000 bis 18'000 Dollar. Wer einen Shop betreibt, sollte die Bezahlseite auf veränderte Skripte überwachen lassen.

Claude findet ein neues Enzymsystem. Anthropics Biologie-Team liess 950 Claude-Agenten 21 Stunden lang eine DNA-Datenbank durchsuchen. Sie fanden ein bisher unbeschriebenes System in Viren, die Bakterien befallen. Es ähnelt Systemen, die DNA schneiden oder kopieren. Was es genau tut, ist noch offen.

Gemini 4 kommt früher. DeepMind-Manager Koray Kavukcuoglu sagte am 23. September, Gemini 4 sei im Nachtraining, dem Feinschliff nach dem Grundtraining. Er hofft auf einen Start deutlich vor Jahresende. Das geplante Gemini 3.5 Pro hat Google dafür gestrichen.

Meta legt mit Muse nach. An der Meta Connect am 23. September zeigte Meta neue Brillen und ein eigenes Gerät für seinen Assistenten Muse. Die Muse-App kam in den ersten zwölf Tagen auf 1,8 Millionen iOS-Downloads in den USA und Kanada. ChatGPT hatte zum Start 1,3 Millionen.

Drei Dinge, die du diese Woche tun solltest:

  1. Claude Marketplace durchsuchen. Öffne den Marketplace und such nach den drei Tools, die dein Team täglich nutzt. Gibt es einen fertigen Konnektor, sparst du die Anbindung. Die Arbeit, die eure Firma ausmacht, bleibt trotzdem bei euch.

  2. Claude in Slack testen. Wer den Team-Plan hat, holt Claude Tag in einen Projektkanal. Stell eine Frage, für die Claude dein eigenes Google Drive oder deinen Kalender braucht. Schalt den Prüfmodus ein und schau, was Claude posten würde.

  3. Apertus testen. Öffne Euria von Infomaniak oder den Apertus-Zugang bei Swisscom. Gib drei Standardaufgaben ein, auf Deutsch und auf Französisch. Vergleiche das Ergebnis mit dem Tool, das du heute nutzt.

Quellen: https://fortune.com/2026/09/26/openai-ai-agents-secure-sandbox-escape-training-pause-second-time-hugging-face-hack/ https://fortune.com/2026/09/25/openai-rogue-agents-images-sam-altman-chatgpt-users-links-encoded-info-hugging-face-hack/ https://openai.com/hugging-face-incident-and-misalignment/ https://techcrunch.com/2026/09/25/unsecured-openai-agents-posted-53-user-images-on-the-internet-without-the-labs-knowledge/ https://www.netzwoche.ch/news/2026-09-24/ki-agent-von-openai-hackt-australisches-regierungsportal https://www.anthropic.com/claude-sonnet-5-5 https://claude.com/blog/claude-marketplace https://claude.com/blog/build-plugins-for-claude https://claude.com/blog/claude-tag-now-supports-personal-connectors-in-channels https://news.microsoft.com/source/emea/2026/09/new-microsoft-copilot-brings-home-code-and-autopilot-together/ https://www.unite.ai/microsoft-copilot-overhaul-adds-home-hub-code-builder-and-autopilot-agent/ https://venturebeat.com/orchestration/microsoft-announces-copilot-cowork-with-help-from-anthropic-a-cloud-powered https://cybernews.com/ai-news/arthur-mensch-apocalypse/ https://venturebeat.com/infrastructure/black-forest-labs-debuts-flux-3-action-an-open-weights-ai-robotics-model-that-tops-the-leaderboard-at-half-the-size-of-its-competition https://www.netzwoche.ch/news/2026-03-23/staenderat-sagt-ja-zu-souveraener-ki-infrastruktur https://www.netzwoche.ch/news/2026-09-21/bundesverwaltung-kuendigt-neue-priorisierung-ihrer-ki-projekte-an https://www.netzwoche.ch/news/2026-09-23/schweiz-liegt-bei-ki-nutzung-ueber-globalem-durchschnitt https://www.apertus-ai.org/articles/2026-09-apertus-1-5-ga/ https://www.apertus-ai.org/pages/research/ https://ai-weeks.ch/events/ai-x-summit https://venturebeat.com/technology/openai-releases-gpt-6-sol-and-luna-models-slashing-api-costs-50-or-more https://www.netzwoche.ch/news/2026-09-25/ki-agenten-greifen-hunderte-onlineshops-an-und-stehlen-kreditkartendaten https://www.anthropic.com/news/claude-discovers-novel-enzyme-system https://futuretools.io/news

Bereit, KI strategisch anzugehen?

30-minütiges Erstgespräch – kostenlos und unverbindlich. Wir schauen gemeinsam wo ihr steht und was der richtige erste Schritt ist.

Bereit, KI strategisch anzugehen?

30-minütiges Erstgespräch – kostenlos und unverbindlich. Wir schauen gemeinsam wo ihr steht und was der richtige erste Schritt ist.

Welche Newsletter möchtest du abonnieren?
Bitte wähle mindestens einen Newsletter.
Deine Anmeldung war erfolgreich.
Deine Anmeldung konnte nicht gespeichert werden. Versuch's bitte nochmals.
Welche Newsletter möchtest du abonnieren?
Bitte wähle mindestens einen Newsletter.
Deine Anmeldung war erfolgreich.
Deine Anmeldung konnte nicht gespeichert werden. Versuch's bitte nochmals.