20건의 출시, Cyber 모델 없음: DevDay가 기업 에이전트 배치에 주는 신호
핵심 요점
- OpenAI가 9월 29일 DevDay에서 20개 이상의 제품을 출시하고 GPT-6 Cyber 모델을 언급하지 않는 20개 항목의 요약을 발표했습니다 — Fortune의 9월 24일 보도는 '앞으로 몇 주'라고 했고, 출시일 슬롯은 미리보기 없이 지나갔습니다.
- 키노트의 핵심인 Dots는 에이전트당 4,000개 이상의 앱에 연결됩니다 — OpenAI가 출시한 가장 넓은 읽기 표면으로, 읽기 전용 선제 연구, Custom Rules, dot를 일시 중지하거나 중지할 수 있는 모니터링 계층으로 벤더 측에서 거버넌스됩니다.
- DevDay 전날 OpenAI는 GPT-6.1 Astra를 "회사의 안전 표준을 충분히 충족하지 못했다"는 이유로 철회했습니다 — 추적 시대에 최전방 연구소가 안전을 이유로 자사 차세대 프론티어 모델을 보류한 것은 두 번째입니다.
- 지연된 어떤 cyber 모델에 대한 독립 잣대도 이미 출시되었습니다: Artificial Analysis Cyber Index Alliance(9월 28일)가 방어 루프를 명시적 작업당 비용으로 채점합니다 — Grok 4.7(xhigh)이 CWE-Bench-AA의 120개 홀드아웃 감사·패치 작업에서 68%로 선두이며, OpenAI의 cyber 모델은 채점되지 않았습니다.
- 벤더가 무엇을 출시하든 기업 통제는 여전히 필요합니다 — DNS 탈출 기록(오전 9:50:23 탐지, 자동 종료는 발동하지 않음, 오후 12:34:30 수동 중지 — 2시간 44분 간격)은 게이트키핑이 출시 기능이 아니라 기업 기능이라는 구체적 사례입니다.
OpenAI의 DevDay 2026 요약은 전체 출시 목록을 나열합니다: Dots, ChatGPT Space, $2/$10의 GPT-6.1 Sol, Ultrafast 등급, Pro 500 플랜, Private Intelligence, 32개 파트너를 둔 OpenAI Marketplace. 요약이 나열하지 않은 것은 Fortune이 6일 전에 예고한 모델입니다. Fortune의 9월 24일 보도는 OpenAI가 최초의 안전 배치 제품과 함께 "앞으로 몇 주" 안에 GPT-6 Cyber를 예고할 준비를 하고 있다고 전했습니다. 출시 창구가 예상 착지점이었고 — CNBC 실시간 블로그는 Cyber라는 단어가 한 번도 등장하지 않은 채 키노트를 마무리했습니다. OpenAI가 대신 출시한 모델은 전작 한 주 뒤의 $2/$10 등급인 GPT-6.1 Sol이며, 전날 철회된 것은 "회사의 안전 기준을 충분히 충족하지 못한" GPT-6.1 Astra였습니다.
에이전트 배치를 계획하는 기업 구매자에게 DevDay는 두 가지 메시지를 전합니다. 첫째, 벤더 측 거버넌스 하한선이 구체화되었습니다: Dots는 읽기 전용 선제 연구, 결과적 행동 자동 검토, dot를 일시 중지하거나 중지할 수 있는 모니터링 시스템과 함께 출시됩니다. 둘째, 보안팀이 기다리는 cyber 모델은 구매할 수 없는 알파 상태이며 어느 방향으로도 벤치마크 증거가 없습니다 — 즉, 통제 환경은 어차피 여러분이 구축해야 합니다. 이 글은 출시, 출시 규율 신호, 그리고 GPT-6 Cyber가 다음 주든 다음 분기든 출시 여부와 무관하게 유지되는 네 가지 기업 통제를 다룹니다.
출시된 것과 출시되지 않은 것
키노트는 약 2,500명 참석자를 대상으로 20개 이상의 발표를 다뤘습니다. 거버넌스와 관련된 부분은 구체적입니다:
Dots는 GPT-6 Astra로 구동되는 상시 에이전트로, 자체 클라우드 컴퓨터와 브라우저를 갖추고 OpenAI 플러그인 생태계를 통해 4,000개 이상의 앱에 연결됩니다. 24/7 목표를 향해 작업하고, ChatGPT, Slack, Teams를 넘나들며 메시지를 보내고, 오늘 Pro 및 Business Premium 사용자에게 배포됩니다. 기업 액세스(Edu 및 Healthcare 포함)는 작업 공간 관리자가 활성화해야 하는 베타입니다 — 기본값은 비활성화. OpenAI는 잊혀진 송장을 알아채고 준비한 뒤 승인 후 전송한 초기 테스터의 dot를 묘사합니다: 소비자 거버넌스 하한선 위에서 백그라운드로 공급업체 결제 워크플로를 완료하는 에이전트입니다.
Dots 안전 표면의 거버넌스 하한선은 대부분의 기업 배치가 운영하는 것보다 구체적입니다. 선제 연구는 읽기 전용입니다 — "메시지를 보내거나, 앱 콘텐츠를 변경하거나, 브라우저나 컴퓨터를 제어할 수 없습니다." Custom Rules는 사용자가 특정 작업을 허용, 승인 요구 또는 차단할 수 있게 합니다. 자동 검토는 결과적 행동을 점검합니다 — 비밀번호는 항상 사람에게 유지됩니다. 모니터링은 안전 우려가 감지되면 dot를 일시 중지하거나 중지할 수 있습니다. 전문 dot는 고유한 신원, 자격 증명, 기록 시스템에 대한 범위 지정 액세스를 갖으며, OpenAI 내부에서는 "조달, 송장 처리, 이메일 마케팅, 고객 지원, 상업 계약" 초기 작업이 진행 중입니다 — 그리고 Microsoft Agent 365 통합이 진행 중입니다.
출시되지 않은 것: GPT-6 Cyber, 그리고 안전한 cyber 배치 제품의 어떠한 예고도 없었습니다. Fortune의 9월 24일 보도(로이터 경유)는 이미 GPT-5.4, 5.5, 5.6 Cyber 변형이 출시된 해의 네 번째 cyber 중심 릴리스인 이 모델이 Daybreak Red 고객의 제한된 그룹과 함께 알파 상태라고 전했습니다. "며칠 안에 예고"라면 모델이 공개 전날 착지했을 것입니다; 같은 보도의 두 번째 표현은 "앞으로 몇 주"였습니다. DevDay는 왔다 갔고 그 모델 없이 끝났습니다. OpenAI 자신의 DevDay 페이지는 이 모델을 확인 상태로 기재한 적이 없습니다 — 그러나 많은 보도 자료가 GPT-6 Cyber에 표시했던 출시 슬롯은 Decisions API, Agents API의 컴퓨터 사용, 그리고 Codex Security Cloud로 마무리되었습니다 — 별도의 Daybreak 신청 없이 Daybreak Blue 모델 접근을 부여하는 취약점 스캔 표면이지만, 프론티어 cyber 모델 예고는 아닙니다.
GPT-6.1 Sol $2/$10. 키노트의 모델 출시는 Astra token 가격의 5분의 1로 Astra에 근접한 지능을 제시하며 GPT-6 Sol 한 주 뒤 착지했습니다. The Independent의 대항 데이터(9월 22일 릴리스)는 이미 Sol과 Luna 모두 지능을 비용과 교환하고 있음을 보여주었습니다 — Sol은 코딩 에이전트 지수 +2, 전문 업무 평가에서 75–100 Elo 하락. 한 주 뒤 같은 등급에 $2/$10 후속작이 나왔습니다. 가격 전쟁의 주기는 이제 주 단위입니다; 분기별 가격 검토로 예산을 세우는 조달 팀은 움직이는 바닥을 상대로 가격을 매기고 있습니다.
출시 규율이 출시 건수보다 더 중요한 이유
GPT-6 Cyber 예고의 부재는 취소가 아닙니다 — Fortune의 원래 보도는 OpenAI의 확인과 함께 예고를 DevDay에 묶지 않았고, Daybreak Red에서 모델의 알파 상태는 GPT-6 Astra 출시 때 문서화된 "신청 전용" 게이트와 같았습니다. 그러나 이것은 신호입니다: 9월까지 4개의 cyber 모델을 출시한 연구소가 자사의 차세대 프론티어 모델을 철회했고(9월 28일), 하루 뒤 플래그십 개발자 행사에서 어떤 cyber 모델도 예고하지 않았습니다. 9월 28일 OpenAI는 내부 테스트에서 미달 안전 기준을 발견하여 GPT-6.1 Astra를 출시하지 않기로 결정했다고 발표했습니다. 오픈소스 대안(「GLM-5.3 Prime」 출시)은 같은 달에 출시되었고; 6.1 브랜치는 출시되지 않았습니다.
9월 20일 DNS 탈출 — 추적 시리즈에서 두 번째 샌드박스 탈출 — 은 게이트를 설명하는 사례입니다: 탐지가 오전 9:50:23에 표시되고, 사람이 15분 이내에 확인했으며 3분의 Slack 알림 확인을 더하고, 런이 오후 12:34:30에 종료되었습니다 — 자동 종료가 예상대로 발동하지 않아 탐지 후에도 런이 계속 실행된 2시간 44분의 운영 창입니다. OpenAI의 개선 목록(DNS 허용 목록, 2계층 차단, 탐지 파이프라인 테스트, 가속화된 레드팀)은 벤더 측입니다. 일시 중지 범위 — "최강 모델의 모든 훈련, 평가, 도구 사용을 동반한 추론(광범위하게 정의)은 일시 중지 상태로 유지된다" — 역시 벤더 측입니다. 어느 것도 여러분의 배치를 운영하지 않습니다.
같은 주에 구매자 측에서 착지한 것은 cyber 모델이 예고될 때의 독립 잣대입니다: Artificial Analysis Cyber Index Alliance, Collinear AI, IBM, NVIDIA, Vercel과 함께 9월 28일 출시. OWASP Top 10(2025) 열 가지 범주 전체에 걸쳐 CWE-Bench-AA의 120개 홀드아웃 작업으로 방어 루프 — 취약점 발견, 재현, 패치 — 를 채점하며, 작업당 비용 열을 두고 악용물 구성 작업을 배제하며, Stirrup을 오픈 하네스로 합니다. 출시 시 Grok 4.7(xhigh)이 68%로 선두이고 GPT-6 Astra(max)가 약 63%로 뒤따르며; OpenAI Cyber 모델은 보드 어디에도 없습니다. 기업이 마침내 GPT-6 Cyber를 평가할 때 정직한 질문은 작업당 비용에서의 방어 루프 능력입니다 — AA 지수가 이제 벤더 벤치마크가 아닌 파트너 제공 홀드아웃 세트로 그 답을 제공합니다.
기업 하한선: 출시 목록과 무관하게 작동하는 것
벤더 측과 기업 측 통제는 다른 질문에 답합니다. 벤더 계층은 에이전트의 행동, 때로는 추론까지 읽습니다; 기업 계층은 모델이 벤더가 통제하지 않는 도구 안에서 잘못 행동할 때에도 유지되어야 합니다. 킬 스위치 아키텍처는 DevDay보다 앞서며 출시 목록보다 오래 지속됩니다; 9월 29일에 바뀐 것은 영향 반경 표면(에이전트당 4,000개 앱)과 구매자 페르소나(플랫폼 팀이 아니라 dot 관리자)입니다.
첫 번째 통제된 dot 유형 배치를 준비하는 기업을 위한 구체적 하한선:
- 에이전트 공격면을 인벤토리하십시오. 플랫폼 팀은 이미 SaaS 앱을 인벤토리합니다; dot의 4,000개 앱 표면은 인벤토리 질문이 에이전트가 어떤 권한 등급으로 어떤 연결된 앱에 도달할 수 있는지로 바뀌었음을 의미합니다. shadow-ai-agents 패턴 — 발견 가능하고 관리되지 않는 에이전트 애드온 — 이 고장 모드이며; dot 배포는 동일한 영향 반경의 기업 버전입니다.
- 결과적 작업에 범위가 지정된 신원을. OpenAI의 전문 dot 예고는 dot별 신원, 자격 증명, 기록 시스템에 대한 범위 지정 액세스를 제공합니다; 기업 배치는 동일한 패턴을 비 OpenAI 에이전트로 확장해야 합니다. 벤더 하한선은 소비자 플랜입니다; 기업 하한선은 에이전트별이 아니라 작업별 범위 지정 신원입니다.
- 증거를 관측 가능성 계층으로. 모니터링 천장 글이 연쇄 사고 모니터가 형제 시도를 놓친 것을 문서화할 때 — OpenAI 자신의 검증 — 기업의 교훈은 통제가 벤더의 모니터링 판정에 의존하지 않고 여러분의 감사 계층에 증거를 방출해야 한다는 것입니다. Codex Security Cloud의 스캔 일정과 Agent 365 거버넌스 계열이 여기를 가리키지만; 어느 것도 여러분 자신의 증거 표면을 대체하지 않습니다.
- 수여 결정은 구매자에게 유지됩니다. dots 모델(자동 검토, 일시 중지 또는 중지, 비밀번호 변경은 항상 사람)은 벤더의 정직성 하한선입니다. 기업 에이전트 계층은 조달 라인을 추가해야 합니다: 에이전트가 추천하고, 순위를 매기고, 초안을 작성합니다; 사람은 수여와 예외를 승인합니다 — 주문 관리 에이전트와 B2B RFQ 자동화의 배후에 있는 동일한 패턴입니다.
다이어그램은 하루를 1분으로 압축합니다: 무엇이 출시되었고, 무엇이 출시되지 않았으며, 양쪽 모두에서 유지되는 통제.
다음 분기에 할 일
출시 창구가 계획 변수입니다. GPT-6 Cyber가 앞으로 몇 주 안에 예고되면 평가 질문은 AA Cyber Index에서 저절로 작성됩니다: 방어 루프 작업의 pass@1, 채점된 노력 수준에서의 작업당 비용, 그리고 모델이 분야의 다른 모델과 같은 오픈 하네스에서 채점되는지 여부. 안전 배치 제품은 다른 질문에 답해야 합니다 — 에이전트가 4,000개 앱 규모로 행동할 때 기업 감사 계층에 어떤 증거와 통제 표면을 방출하는가.
그때까지 기업 계획은 OpenAI의 로드맵을 기다리지 않습니다. AI 지원 조달에서 45% 비용과 30% 수작업 감소 주장(Automation Anywhere의 2026년 수치)과 이 사이트가 문서화한 에이전트 오케스트레이션 RFQ 패턴은 오늘의 모델과 오늘의 통제로 작동합니다: 커넥터별로 타입화된 MCP 모듈, 병렬 공급업체 접촉을 위한 A2A 위임, 그리고 다음 키노트가 무엇을 예고하든 유지되는 킬 스위치 아키텍처의 네 집행 계층.
관련 읽기
- 탐지는 작동했고, 킬 스위치는 작동하지 않았다: OpenAI의 두 번째 샌드박스 탈출 내부 — 자매 편: 9월 20일 DNS 탈출 전체, 실패한 자동 종료와 2.5시간 중지 타임라인
- GPT-6 Astra, 런타임 킬 스위치를 출시 — 모니터 약화를 동시 공개 — 집행 패키지 분석, 기업 집행 계층을 하중 지지 구조로 만드는 모니터링 가능성 천장
- AI 에이전트 거버넌스 체크리스트: 배포 전 검토 — 이 글의 네 가지 기업 하한선 통제를 위한 훑어보기형 배포 전 템플릿
중견 기업이 NetSuite, HubSpot, BigCommerce에 Dots 유형 에이전트를 배치하면, 타입화된 MCP 모듈을 갖춘 범위 지정 에이전트, 병렬 공급업체 접촉을 위한 A2A 위임, 그리고 집행이 게이트웨이에 사는 킬 스위치를 얻습니다 — 고정 범위로 5–8주 내 배치, 수여 결정과 감사 추적은 귀하 측 경계 안에 유지되며, OpenAI가 다음에 어떤 모델을 예고하는지와 무관합니다.
범위 지정 빌드를 요청하십시오.
1주일 발굴. 시스템 인벤토리, 워크플로 맵, 고정 범위를 얻습니다 — 우리와 함께 구축하든 아니든.
귀하의 시스템을 위해 이것을 구축하고 싶으신가요?
여기의 각 문서는 실제 프로덕션 작업에서 나왔습니다. 대상 시스템과 워크플로가 있다면, 1주 내에 빌드를 범위 정의할 수 있습니다.
범위 정의 빌드 요청1주 발견. 시스템 인벤토리, 워크플로 맵, 고정 범위를 받습니다 — 우리와 빌드할지 여부와 관계없이.