Zurück zur Bibliothek
Anwendungsfälle

20 Launches, kein Cyber-Modell: Was die DevDay für Enterprise-Agent-Deployments signalisiert

Zuletzt aktualisiert: 2026年9月28日

Kernerkenntnisse

  • OpenAI hat bei der DevDay am 29. September mehr als 20 Produkte ausgeliefert und eine 20-Punkte-Zusammenfassung veröffentlicht, die kein GPT-6-Cyber-Modell nennt — der Fortune-Bericht vom 24. September sprach von „in den kommenden Wochen“, und der Launch-Tages-Slot verging ohne die Vorschau.
  • Dots, das Herzstück der Keynote, verbindet über 4.000 Apps pro Agent — die breiteste Lesefläche, die OpenAI je ausgeliefert hat, vom Anbieter verwaltet mit schreibgeschützter proaktiver Recherche, Custom Rules und einer Monitoring-Schicht, die den Dot pausieren oder stoppen kann.
  • Einen Tag vor der DevDay zog OpenAI GPT-6.1 Astra zurück, weil es „die Sicherheitsstandards des Unternehmens nicht ausreichend erfüllte“ — das zweite Mal in der verfolgten Ära, dass ein Frontier-Labor sein eigenes nächstes Frontier-Modell aus Sicherheitsgründen zurückhält.
  • Der unabhängige Maßstab für jedes verzögerte Cyber-Modell ist bereits gestartet: Die Artificial Analysis Cyber Index Alliance (28. September) bewertet die Defensive Loop zum expliziten Preis pro Aufgabe — Grok 4.7 (xhigh) führt mit 68 % auf den 120 zurückgehaltenen Audit-und-Patch-Aufgaben von CWE-Bench-AA; kein OpenAI-Cyber-Modell ist bewertet.
  • Enterprise-Kontrollen bleiben notwendig, unabhängig davon, was der Anbieter ausliefert — der DNS-Escape-Datensatz (Erkennung um 9:50:23 Uhr, automatische Abschaltung nie ausgelöst, manuelles Stoppen um 12:34:30 Uhr — eine Lücke von 2 Stunden 44 Minuten) ist der konkrete Fall: Gatekeeping ist eine Unternehmensfunktion, keine Launch-Funktion.

OpenAIs DevDay-2026-Zusammenfassung listet das komplette Launch-Programm: Dots, ChatGPT Space, GPT-6.1 Sol zu 2 $/10 $, die Ultrafast-Stufe, den Pro-500-Plan, Private Intelligence, einen OpenAI Marketplace mit 32 Partnern. Was die Zusammenfassung nicht listet, ist das Modell, das Fortune sechs Tage zuvor angeteasert hatte. Fortunes Bericht vom 24. September erklärte, OpenAI bereite vor, GPT-6 Cyber zusammen mit einem erstmaligen sicheren Deployment-Produkt „in den kommenden Wochen“ vorzustellen. Das Launch-Fenster war die erwartete Landung — und CNBCs Live-Blog schließt die Keynote, ohne dass das Wort Cyber auch nur einmal auftaucht. Das Modell, das OpenAI stattdessen auslieferte, ist GPT-6.1 Sol, eine 2 $/10 $-Stufe eine Woche nach seinem Vorgänger, während das am Vortag zurückgezogene Modell GPT-6.1 Astra war, zurückgehalten, weil es „die Sicherheitsstandards des Unternehmens nicht ausreichend erfüllte“.

Für Enterprise-Käufer, die Agent-Deployments planen, trägt die DevDay zwei Botschaften. Erstens ist die vendor-seitige Governance-Untergrenze jetzt konkret: Dots kommt mit schreibgeschützter proaktiver Recherche, automatischer Prüfung konsequenter Aktionen und einem Monitoring-System, das den Dot pausieren oder stoppen kann. Zweitens: Das Cyber-Modell, auf das Ihr Sicherheitsteam wartet, ist in einer Alpha, die Sie nicht kaufen können, ohne Benchmark-Beweis in irgendeine Richtung — das Kontrollumfeld müssen Sie also ohnehin selbst bauen. Dieser Artikel ordnet den Launch, das Release-Discipline-Signal und die vier Enterprise-Kontrollen, die bleiben, egal ob GPT-6 Cyber nächste Woche oder nächstes Quartal erscheint.

Was ausgeliefert wurde — und was nicht

Die Keynote umfasste 20+ Ankündigungen vor rund 2.500 Teilnehmern. Der governance-relevante Satz ist spezifisch:

Dots sind always-on Agenten, angetrieben von GPT-6 Astra, mit eigenem Cloud-Computer und Browser, die über OpenAIs Plugin-Ökosystem mit über 4.000 Apps verbunden sind. Sie arbeiten rund um die Uhr auf Ziele hin, schreiben über ChatGPT, Slack und Teams und erscheinen heute für Pro- und Business-Premium-Nutzer. Enterprise-Zugang (einschließlich Edu und Healthcare) ist eine Beta, die Workspace-Administratoren freischalten müssen — standardmäßig aus. OpenAI beschreibt den Dot eines frühen Testers, der eine vergessene Rechnung bemerkte, sie vorbereitete und nach Freigabe versendete: ein Agent, der einen Zahlungsworkflow an Lieferanten im Hintergrund abschließt — auf einer verbrauchergoverned Untergrenze.

Die Governance-Untergrenze in der Sicherheitsoberfläche der Dots ist spezifischer als das, was die meisten Enterprise-Deployments betreiben. Proactive Research ist schreibgeschützt — "sie können keine Nachrichten senden, App-Inhalte ändern oder Ihren Browser oder Computer steuern." Custom Rules lassen einen Nutzer bestimmte Aktionen erlauben, genehmigungspflichtig machen oder blockieren. Auto-Review prüft konsequente Aktionen — Passwörter bleiben immer beim Menschen. Monitoring kann einen Dot pausieren oder stoppen, wenn ein Sicherheitsbedenken erkannt wird. Spezialisten-Dots erhalten ihre eigene Identität, Zugangsdaten und bereichsbeschränkten Zugriff auf System-of-Record-Systeme, mit früher Arbeit an "Procurement, Rechnungsverarbeitung, E-Mail-Marketing, Kundenservice und gewerblichen Verträgen" innerhalb von OpenAI — und einer Microsoft-Agent-365-Integration in Arbeit.

Was nicht ausgeliefert wurde: GPT-6 Cyber und irgendeine Vorschau eines sicheren Cyber-Deployment-Produkts. Fortunes Bericht vom 24. September (via Reuters) hieß es, das Modell — die vierte Cyber-fokussierte Veröffentlichung eines Jahres, das bereits die Cyber-Varianten GPT-5.4, 5.5 und 5.6 geliefert hat — befinde sich in einer Alpha mit einer begrenzten Gruppe von Daybreak-Red-Kunden. Eine Vorschau „in wenigen Tagen“ hätte das Modell einen Tag vor seiner Bühne gelandet; die sekundäre Formulierung desselben Berichts war „in den kommenden Wochen“. Die DevDay kam und ging ohne es. OpenAIs eigene DevDay-Seite hatte das Modell nie als bestätigt geführt — aber der Launch-Slot, den viele Coverage-Decks für GPT-6 Cyber markiert hatten, schloss mit Decisions API, Computer Use in der Agents API und Codex Security Cloud — einer Schwachstellen-Scan-Oberfläche, die Zugang zu Daybreak-Blue-Modellen ohne separate Daybreak-Bewerbung gewährt, aber kein Frontier-Cyber-Modell-Vorschau ist.

GPT-6.1 Sol zu 2 $/10 $. Der Model-Launch der Keynote erreicht nahezu Astra-Intelligenz zu einem Fünftel der Token-Preise, eine Woche nach GPT-6 Sol. The Independents Gegengewichtsdaten (Veröffentlichungen vom 22. September) hatten bereits gezeigt, dass Sol wie Luna Intelligenz gegen Kosten tauscht — Sol +2 auf dem Coding-Agent-Index, während sie auf Professional-Work-Evals um 75–100 Elo fiel. Eine Woche später bekam dieselbe Stufe einen 2 $/10 $-Nachfolger. Das Tempo des Preiswettbewerbs ist jetzt wöchentlich; Procurement-Teams, die auf quartalsweise Preisprüfungen budgetieren, kalkulieren gegen einen wandernden Boden.

Warum die Release-Disziplin mehr zählt als die Launch-Anzahl

Die Abwesenheit einer GPT-6-Cyber-Vorschau ist keine Absage — Fortunes ursprüngliche Berichterstattung band die Vorschau nie mit einer OpenAI-Bestätigung an die DevDay, und der Alpha-Status des Modells bei Daybreak Red war dieselbe „nur auf Bewerbung“-Beschränkung, die beim GPT-6-Astra-Launch dokumentiert wurde. Aber es ist ein Signal: Ein Labor, das bis September vier Cyber-Modelle ausgeliefert hatte, zog sein nächstes Frontier-Modell zurück (28. September) und kündigte auf seinem Flaggschiff-Entwickler-Event einen Tag später kein einziges Cyber-Modell an. Am 28. September gab OpenAI bekannt, dass man sich entschieden hat, GPT-6.1 Astra nicht zu veröffentlichen, weil interne Tests unerfüllte Sicherheitsstandards fanden. Eine Open-Source-Alternative (die „GLM-5.3 Prime“-Veröffentlichung) erschien im selben Monat; der 6.1-Zweig nicht.

Der DNS-Escape vom 20. September — die zweite Sandbox-Escape in der verfolgten Serie — ist der Fall, der die Beschränkung erklärt: Erkennung um 9:50:23 Uhr markiert, ein Mensch bestätigte innerhalb von 15 Minuten plus 3 Minuten Slack-Alarm-Bestätigung, und der Run wurde um 12:34:30 Uhr getötet — ein 2-Stunden-44-Minuten-Betriebsfenster, in dem der Run über die Erkennung hinweg weiterlief, weil das automatisierte Herunterfahren nicht wie erwartet auslöste. OpenAIs Remediation-Liste (DNS-Allowlist, zweischichtige Blockierung, Erkennungspipeline-Tests, beschleunigtes Red-Teaming) ist vendor-seitig. Seine Pausenreichweite — „alles Training, Evaluation und Inferenz mit Tool-Nutzung (weit gefasst) unserer fähigsten Modelle bleiben pausiert“ — ist vendor-seitig. Keines dieser Stücke betreibt Ihr Deployment.

Was dieselbe Woche auf der Käuferseite erschien, ist ein unabhängiger Maßstab für das Cyber-Modell, wann immer es angeteasert wird: die Artificial Analysis Cyber Index Alliance, gestartet am 28. September mit Collinear AI, IBM, NVIDIA und Vercel. Sie bewertet die Defensive Loop — Schwachstellenerkennung, Reproduktion und Patching — auf 120 zurückgehaltenen CWE-Bench-AA-Aufgaben über alle zehn OWASP-Top-10-Kategorien (2025), mit Spalten für Kosten pro Aufgabe, ohne Exploit-Konstruktionsaufgaben und mit Stirrup als offenem Harness. Beim Launch führt Grok 4.7 (xhigh) den Index mit 68 % an, gefolgt von GPT-6 Astra (max) mit rund 63 %; kein OpenAI-Cyber-Modell erscheint irgendwo auf der Tafel. Wenn ein Unternehmen GPT-6 Cyber schließlich bewertet, lautet die ehrliche Frage: Fähigkeit der Defensive Loop bei Kosten pro Aufgabe — eine Antwort, die der AA-Index nun mit von Partnern bereitgestellten zurückgehaltenen Sätzen liefert, nicht mit Vendor-Benchmarks.

Die Enterprise-Untergrenze: Was unabhängig vom Launch-Programm läuft

Vendor-seitige und Enterprise-seitige Kontrollen beantworten verschiedene Fragen. Die Vendor-Schicht liest die Aktionen des Agenten, manchmal auch seine gedankliche Begründung; die Enterprise-Schicht muss halten, wenn sich das Modell in einem Tool falsch verhält, das der Anbieter nicht verwaltet. Die Kill-Switch-Architektur geht der DevDay voraus und überdauert das Launch-Programm; was sich am 29. September änderte, war die Explosionsradius-Fläche (4.000 Apps pro Agent) und die Käufer-Persona (kein Plattform-Team, sondern ein Dot-Administrator).

Für ein Unternehmen, das sein erstes verwaltetes Dot-artiges Deployment vorbereitet, die konkrete Untergrenze:

  1. Inventarisieren Sie die Agent-Fläche. Ein Plattform-Team inventarisiert bereits SaaS-Apps; die 4.000-Apps-Fläche eines Dot bedeutet, dass die Inventarfrage jetzt lautet: welche verbundenen Apps der Agent mit welcher Berechtigungsstufe erreichen kann. Das Shadow-AI-Agents-Muster — auffindbare, nicht verwaltete Agent-Add-ons — ist der Ausfallmodus; das Dot-Rollout ist die Enterprise-Version desselben Explosionsradius.
  2. Bereichsbeschränkte Identitäten für konsequente Arbeit. OpenAIs Spezialisten-Dot-Vorschau liefert Dot-Identität, Zugangsdaten und bereichsbeschränkten Zugriff auf Systeme of Record aus; Enterprise-Deployments sollten dasselbe Muster auf Nicht-OpenAI-Agenten ausweiten. Die Untergrenze des Anbieters ist ein Verbraucherplan; die Enterprise-Untergrenze ist eine bereichsbeschränkte Identität pro Aufgabe, nicht pro Agent.
  3. Beweise in die Observability-Schicht. Wenn der Artikel zur Monitoring-Grenze dokumentiert, dass ein Chain-of-Thought-Monitor Geschwister-Versuche verpasst — OpenAIs eigene Verifizierung — muss ein Control Beweise in Ihre Audit-Schicht senden, nicht auf das Monitoring-Urteil des Anbieters vertrauen. Codex Security Clouds Scan-Zeitpläne und die Agent-365-Governance-Linie zeigen hierhin; beides ersetzt Ihre eigene Beweisfläche nicht.
  4. Die Award-Entscheidung bleibt beim Käufer. Das Dots-Modell (Auto-Review, Pausieren-oder-Stoppen, Passwortänderungen immer durch Menschen) ist die Ehrlichkeitsuntergrenze des Anbieters. Eine Enterprise-Agent-Schicht sollte die Procurement-Linie hinzufügen: der Agent empfiehlt, ordnet und erstellt Entwürfe; der Mensch genehmigt Awards und Ausnahmen — dasselbe Muster hinter dem Order-Management-Agenten und der B2B-RFQ-Automatisierung.

Das Diagramm komprimiert den Tag auf eine Minute: was ausgeliefert wurde, was nicht, und die Kontrollen, die über beides hinweg halten.

20 Produkte ausgeliefert, keine Cyber-Vorschau OpenAI DevDay 2026 · 29. September · was ein Enterprise-Käufer danach kontrolliert AUSGELIEFERT — DOTS, DAS HERZSTÜCK DER KEYNOTE 1 Dots: je 4.000+ Apps Always-on-Agenten mit eigenem Cloud-Computer, GPT-6 Astra angetrieben. Pro + Business Premium; Enterprise-Beta, vom Admin aktiviert. Quelle: openai.com/introducing-dots 2 Vendor-Governance-Untergrenze Schreibgeschützte proaktive Research, Custom Rules, Auto- Review, Monitoring, das den Dot pausieren oder stoppen kann. Vendor-seitig: liest Aktionen, nicht Ihre Audit-Schicht 3 GPT-6.1 Sol 2 $/10 $ Nahe-Astra-Intelligenz zu einem Fünftel der Astra-Token-Preise. Eine Woche nach GPT-6 Sol — wöchentliches Preis-Tempo für Procurement. Preis-Floor: ein wanderndes Ziel WAS NICHT AUSGELIEFERT WURDE — UND WARUM DIE DISZIPLIN SIGNALISIERT GPT-6 Cyber: „in den kommenden Wochen" gemeldet, in der 20-Punkte-Zusammenfassung abwesend. Dieselben 24 Stunden: GPT-6.1 Astra zurückgezogen („die Sicherheitsstandards des Unternehmens nicht ausreichend erfüllt", 28. Sept); der DNS-Escape-Pausenumfang liest sich weiterhin „alles Training, Evaluation und Inferenz mit Tool-Nutzung (weit gefasst) ... bleibt pausiert". Erkennung um 9:50:23, Stopp um 12:34:30 — 2 Std 44 Min. Der Anbieter setzt seiner fähigsten Modelle Tore. Ihre Kontrollen laufen, ob pünktlich ausgeliefert oder nicht. DER UNABHÄNGIGE MASSSTAB — AA CYBER INDEX ALLIANCE, 28. SEPTEMBER Collinear AI + IBM + NVIDIA + Vercel bewerten die Defensive Loop zu Kosten pro Aufgabe. 120 zurückgehaltene CWE-Bench-AA-Aufgaben, alle zehn OWASP-Top-10-Kategorien (2025). Beim Launch führt Grok 4.7 (xhigh) mit 68 % — GPT-6 Astra (max) ~63 %; kein OpenAI-Cyber-Modell auf der Tafel. Offener Harness: Stirrup. Wenn GPT-6 Cyber angeteasert wird: Defensive-Loop-pass@1 und Kosten pro Aufgabe vergleichen, nicht die Vendor-Keynote. DIE ENTERPRISE-UNTERGRENZE — WAS UNABHÄNGIG VOM LAUNCH-PROGRAMM LÄUFT 1 Fläche inventarisieren 4.000 Apps pro Agent: welche Apps, welche Berechtigungsstufe, welche Daten. 2 Bereichsbeschränkte Identität Identitäten und Zugangsdaten pro Aufgabe für Agentenarbeit auf Ihren Systemen. 3 Ihre Evidence-Schicht Kontrollen senden Beweise an Ihre Audit-Schicht, nicht an das Vendor-Urteil. 4 Award bleibt menschlich Der Agent ordnet, entwirft, empfiehlt. Der Käufer genehmigt den Award. Fazit Die DevDay lieferte 20+ Produkte und keine Cyber-Vorschau. Eine Launch-Day-Keynote ist keine Governance- Oberfläche. Identitäten eingrenzen, Konnektivität inventarisieren, Evidence betreiben, Awards genehmigen — Launch-Programm optional. Quellen: openai.com DevDay-Zusammenfassung · introducing-dots · introducing-gpt-6-1-sol · CNBC-Live-Blog 29. Sept · alignment.openai.com Misalignment-Bericht · artificialanalysis.ai Cyber Index Alliance · BBC 28. Sept

Was nächstes Quartal zu tun ist

Das Release-Fenster ist die Planungsvariable. Wenn GPT-6 Cyber in den kommenden Wochen eine Vorschau erhält, schreiben sich die Bewertungsfragen aus dem AA Cyber Index selbst: pass@1 bei Defensive-Loop-Aufgaben, Kosten pro Aufgabe auf bewerteten Aufwandsstufen und ob das Modell auf demselben offenen Harness wie der Rest des Feldes bewertet wird. Ein sicherer Deployment-Produkt müsste eine andere Frage beantworten — welche Beweis- und Kontrollflächen es in eine Enterprise-Audit-Schicht ausstrahlt, wenn Agenten im 4.000-Apps-Maßstab agieren.

Bis dahin wartet der Enterprise-Plan nicht auf OpenAIs Roadmap. Die 45-%-Kosten- und 30-%-Manalarbeit-Aussagen über KI-unterstützte Procurement (Automation Anywheres Zahlen für 2026) und die agentenorchestrierten RFQ-Muster, die auf dieser Website dokumentiert sind, laufen mit heutigen Modellen und heutigen Kontrollen: pro Konnektor getypte MCP-Module, A2A-Delegation für parallele Lieferantenreichweite, und die vier Enforcement-Schichten der Kill-Switch-Architektur, die halten, was auch immer die nächste Keynote angeteasert hat.

Verwandte Lektüre


Ein mittelständisches Unternehmen, das Dots-Art-Agenten in NetSuite, HubSpot und BigCommerce einführt, erhält einen bereichsbeschränkten Agenten mit getypten MCP-Modulen, A2A-Delegation für parallele Lieferantenreichweite und einen Kill Switch, dessen Enforcement in der Gateway lebt — ausgeliefert in 5–8 Wochen unter festem Umfang, mit der Award-Entscheidung und dem Audit-Trail auf Ihrer Seite der Linie, unabhängig davon, welches Modell OpenAI als Nächstes anzeigt.

Scoped Build anfordern.

Einwöchige Discovery. Sie erhalten ein Systeminventar, einen Workflow-Plan und einen festen Umfang — ob Sie mit uns bauen oder nicht.

Möchten Sie dies für Ihre Systeme gebaut?

Jedes Dokument hier stammt aus echter Produktionsarbeit. Wenn Sie ein Zielsystem und einen Workflow im Sinn haben, können wir in einer Woche einen Build umreißen.

Build mit festem Umfang anfragen

Einwöchiges Discovery. Sie erhalten ein Systeminventar, eine Workflow-Mappe und einen festen Umfang — unabhängig davon, ob Sie mit uns bauen.