라이브러리로 돌아가기
전략

Qwen3.8-27B와 DeepSeek Harness: 진정으로 오픈된 에이전트 스택의 도래

최종 업데이트: 2026年8月14日

8월 13일에 공개된 Qwen3.8-2.4T 오픈 웨이트는 축소版이었습니다——텍스트 전용, 비전 없음, thinking 고정 켜짐, 1M이 아닌 262K 컨텍스트. 커뮤니티는 이를 프론티어의 페이월화라고 불렀습니다. 이틀 후, Alibaba는 Qwen3.8-27B를 공개했습니다——2.4T 버전이 제거한 모든 것을 포함: 네이티브 비전-언어 이해(이미지 및 비디오), 유연한 사고 제어(요청별 비활성화, 추론 깊이 조정, 메시지 간 사고 유지), 262K 컨텍스트(1M로 확장 가능). 그리고 같은 날, DeepSeek는 Harness를 오픈소스화했습니다——MIT 라이선스의 에이전트 런타임으로 "모든 것이 플러그인"이며, 몇 시간 만에 33,000+ GitHub 스타를 획득했습니다. 본 문서는 Open-Weight Models Crossed the Agentic Frontier를 기반으로 구축되었으며, 해당 문서는 2026년 7월까지의 능력 격차를 매핑했습니다. 여기서는 진정으로 오픈된 에이전트 스택을 완성하는 두 가지 발전을 다룹니다: 아무것도 보류하지 않는 모델과 모든 능력을 교환 가능으로 취급하는 런타임.

핵심 요점

  • Qwen3.8-27B는 비전, 유연한 사고 제어, 262K 컨텍스트(1M로 확장 가능)를 포함——축소된 2.4T의 진정으로 오픈된 형제 모델——Terminal-Bench 2.1에서 73.0은 Muse Glimmer 30B의 51.7을 상회하고, SWE-bench Pro에서 61.7은 Muse Glimmer의 51.2를 상회합니다. 27B는 대부분의 팀이 실제로 로컬에서 실행할 모델입니다(Hugging Face).
  • DeepSeek Harness: MIT 라이선스, "모든 것이 플러그인", 몇 시간 만에 33,000+ GitHub 스타——모델, 도구, 스킬, 세션, 샌드박스, 스토리지, 루프, 스케줄링, UI는 모두 "패치할 특권 코어 없음"의 교환 가능 플러그인입니다(DeepSeek; The New Stack).
  • 4가지 오픈 웨이트 전략 가시화: Z.ai(안전 강화 후 웨이트), Qwen 축소 2.4T(능력 페이월화), Qwen 27B(진정으로 오픈), Kimi K3(비전 포함 전체 웨이트)——오픈 웨이트 프론티어는 릴리스 철학의 포트폴리오이며, 단일 전략이 아닙니다. 각각 다른 능력을 보류하거나 노출합니다.
  • 추가 전용 세션 로그는 발견된 가장 구체적인 관측 가능성 패턴: 모델 가시 입력이 단일 이벤트 스트림에서 재구성 가능——재개, 포크, 리플레이, 트랜스크립트, 텔레메트리, 웹 UI가 모두 동일한 로그에서 작동합니다(DeepSeek).
  • OS 수준 샌드박싱(Linux Landlock, macOS Seatbelt, Windows ACL)이 harness에 내장——별도의 보안 제품 없이 kill-switch 아키텍처를 검증하는 구체적인 컨테인먼트 패턴.

Qwen3.8-27B: 진정으로 오픈된 모델

Hugging Face 모델 카드가 아키텍처를 확인합니다: 27B 파라미터, 64 레이어, Gated DeltaNet + Gated Attention 하이브리드(3 DeltaNet 레이어 후 1 Attention 레이어가 따르는 16개의 반복 블록), 262,144 컨텍스트(네이티브로 1,000,000까지 확장 가능). 네이티브 비전-언어 모델입니다——STEM 다이어그램과 문서에서 시간 단위 비디오까지 이미지와 비디오를 이해합니다. thinking 모드는 기본적으로 켜져 있지만 요청별로 비활성화 가능; 추론 깊이는 reasoning_effort로 조정 가능; 과거 메시지의 추론 컨텍스트는 preserve_thinking으로 유지됩니다. 이것은 축소版 2.4T가 페이월화한 정확한 기능입니다: 비전, 비-thinking 모드, 유연한 컨텍스트는 27B에서 오픈이고 Max에서는 클라우드 전용입니다.

27B 밀집 모델로서 벤치마크 테이블은 강력합니다. Terminal-Bench 2.1에서 73.0——Muse Glimmer의 51.7보다 21 포인트 높음. SWE-bench Pro에서 61.7, DeepSWE 1.1에서 42.2, QwenSWEBench에서 79.0, CoWorkBench에서 70.7. 비전-언어 벤치마크에서: OSWorld-Verified 84.3, WebArena-Verified 64.8, AndroidWorld 81.9. 27B는 둘 다 점수가 매겨지는 모든 코딩 벤치마크에서 30B Muse Glimmer를 상회합니다——비전을 가진 27B 밀집 모델은 비전이 없는 30B 밀집 모델과 다른 배포 카테고리입니다.

커뮤니티 반응은 즉각적이었습니다. 27B는 "2026년 가장 중요한 로컬 AI 릴리스"로 불렸습니다——대부분의 팀이 소비자 하드웨어에서 낮은 지연 시간과 완전한 프라이버시로 실제로 로컬 실행할 모델. 2.4T Max는 기술적 스펙터클; 27B는 배포 대상입니다. 2.4T 모델의 4비트 표현은 웨이트만 약 1.2 테라바이트가 필요합니다——클러스터 배포. 27B는 워크스테이션급 하드웨어에 맞습니다.

4전략 오픈 웨이트 스펙트럼

27B는 부모 문서가 3가지 전략으로 문서화한 것을 4방향 비교로 완성합니다. 각 중국 랩은 이제 고유한 오픈 웨이트 릴리스 철학을 대표합니다:

전략 모델 오픈한 것 보류한 것
안전 강화 후 웨이트 Z.ai GLM-5.3 전체 웨이트(안전 평가 후 2주 보류) 없음(강화 후 웨이트 공개)
축소, 능력 페이월화 Alibaba Qwen3.8-2.4T-A95B 텍스트 전용 웨이트, 262K 컨텍스트, thinking 고정 비전, 비-thinking 모드, 1M 컨텍스트, 내장 도구
진정으로 오픈, 로컬 실행 가능 Alibaba Qwen3.8-27B 비전, 유연한 사고, 262K 컨텍스트, 로컬 배포 없음(전체 기능 세트가 오픈 웨이트에 포함)
비전 포함 전체 웨이트 Moonshot Kimi K3 비전 포함 전체 웨이트(594GB MXFP4) 없음(단, 최소 8x H100——클러스터 규모)

스펙트럼은 "클라우드로 밀기 위한 축소"(Qwen 2.4T)에서 "진정으로 오픈, 워크스테이션에서 실행 가능"(Qwen 27B)에서 "전체 웨이트지만 클러스터 규모"(Kimi K3)까지 이어집니다. 모델 유연 빌드의 존재는 정확히 조달 팀이 Z.ai의 강화 후 사이버 능력, Qwen 27B의 로컬 실행 가능 비전, Kimi K3의 전체 웨이트 멀티모달 능력을 비교 검토하고——코드 배포 없이 태스크별로 라우팅——할 수 있도록 하기 위함입니다.

The Genuinely-Open Agent Stack Four open-weight strategies + plugin-first runtime = production agent with no vendor lock-in FOUR OPEN-WEIGHT STRATEGIES Z.ai GLM-5.3 Weights after hardening Open: full weights (pending 2wk) Withheld: nothing CyberGym 84.5% (leading) 2,436 vulns disclosed Qwen 2.4T-A95B Stripped, paywalled Open: text-only, 262K ctx Withheld: vision, 1M ctx, thinking off Community backlash Cluster-scale deployment Qwen 3.8-27B Genuinely open Open: vision, thinking ctrl, 262K+ Withheld: nothing Terminal-Bench 73.0 Workstation-deployable Kimi K3 Full weights, cluster-scale Open: full weights + vision Withheld: nothing 594GB MXFP4 8x H100 minimum GENUINELY-OPEN AGENT STACK Model Layer Qwen3.8-27B (27B, vision, flexible thinking) or Muse Glimmer (30B, Apache 2.0, 24GB VRAM) Genuinely open, workstation-deployable, no per-token charge, no vendor can strip capabilities Runtime Layer DeepSeek Harness (MIT, plugin-first, append-only session log, OS-level sandboxing) 33K+ GitHub stars, provider-agnostic, MCP client built in, Landlock/Seatbelt/Windows ACL Integration Layer MCP modules (NetSuite, HubSpot, BigCommerce, ShipStation) following the code standard Open standard, swappable plugins, same directory structure and error contract across connectors Governance Layer Append-only session log (observability) + OS-level sandboxing (containment) + per-plugin scoping Ships in the runtime, not as a separate product. Resume, fork, replay from a single event stream. No managed API required. No per-token charge. No vendor permission to modify. The binding constraint is the integration layer — where the build effort concentrates. Sources: Hugging Face Qwen3.8-27B model card, DeepSeek Harness, The New Stack, The Register

DeepSeek Harness: 플러그인 우선 런타임

진정으로 오픈된 모델에는 진정으로 오픈된 런타임이 필요합니다. DeepSeek Harness는 8월 13-14일 MIT 라이선스로 개발자 프리뷰로 공개되었습니다——Claude Code와 Codex 이후 가장 중요한 오픈소스 에이전트 런타임 릴리스입니다.

핵심 설계 원칙은 "모든 것이 플러그인"입니다. "시공간 컴포저빌리티"를 위한 Cordis 메타프레임워크 위에 구축되어, harness는 모델 어댑터, 도구 레지스트리, 세션 로그, 샌드박스, 파일 시스템, 에이전트 루프, 스케줄링, UI를 교환 가능 플러그인으로 취급합니다. 패치할 특권 코어가 없습니다——harness를 확장하는 것은 다른 플러그인 옆에 플러그인을 마운트하는 것을 의미합니다. Cordis 커널이 플러그인 마운트, 언마운트, 의존성을 관리; 에이전트 능력은 플러그인에 존재; 개발자는 harness 소스 코드를 변경하지 않고 설정에서 모든 능력을 선택, 교체, 확장할 수 있습니다(The New Stack).

4개의 프리셋이 포함: Standard(파일 시스템 도구, 셸 액세스, 웹 검색, 서브에이전트, 플랜 모드를 포함한 전체 코딩 에이전트), Minimal(두 도구만——bashstr_replace_editor), Code(TypeScript SDK를 생성하여 모델이 다중 단계 작업을 하나의 프로그램에서 결합할 수 있게 함——5번의 왕복이 필요한 시퀀스가 단일 호출로 실행), Creator(런타임 검사, 플러그인 실험, 프리셋 작성).

추가 전용 세션 로그

모델이 보는 모든 것이 추가 전용 세션 로그에 기록됩니다: 시스템 프롬프트, 추론, 도구 호출 및 결과, 서브에이전트 스케줄링, 모든 컨텍스트 인젝션. 재개, 포크, 검색, 리플레이는 모두 동일한 이벤트 스트림에서 작동합니다. 새로운 모델 가시 입력을 추가하는 것은 새로운 세션 이벤트를 추가하는 것을 의미합니다. 이것은 모든 오픈소스 에이전트 런타임에서 발견된 가장 구체적인 관측 가능성 패턴입니다——모델 요청에 도달하는 모든 것은 로그에서 재구성 가능해야 합니다. 장기 실행 에이전트 패턴 아키텍처를 위해, 추가 전용 로그는 체크포인트/재개 패턴의 프로덕션 구현입니다: 수 시간 또는 수 일간 실행되는 에이전트는 단일 이벤트 스트림에서 일시 정지, 검사, 포크, 리플레이할 수 있습니다.

OS 수준 샌드박싱

harness는 서브프로세스를 Linux Landlock(Node 애드온을 통해), macOS Seatbelt, 또는 Windows ACL 제한 토큰 러너로 래핑합니다. 이것은 구체적인 컨테인먼트 패턴입니다——정책 레이어나 프롬프트 수준 가드레일이 아니라, 에이전트의 도구 호출이 액세스할 수 있는 것을 제한하는 운영체제 강제 경계입니다. kill-switch 아키텍처를 위해, OS 수준 샌드박싱은 런타임 서킷 브레이커의 기반입니다: 모델이 악의적인 도구 호출을 생성하더라도 운영체제가 경계를 강제하므로 에이전트는 샌드박스에서 탈출할 수 없습니다.

프로바이더 무관 + MCP 클라이언트 내장

프로바이더 카탈로그는 Anthropic, OpenAI, AWS Bedrock, Microsoft Azure, Google Gemini Enterprise Agent Platform, DeepSeek 자체 엔드포인트를 다룹니다. 커스텀 OpenAI 호환 게이트웨이가 지원됩니다. 두 서브에이전트 프로바이더가 Claude Code와 Codex에 위임합니다. MCP 클라이언트가 내장되어 있으며, Agent Client Protocol 지원도 포함됩니다. harness는 AGENTS.mdCLAUDE.md 파일을 읽습니다. The Register는 이 릴리스를 "중국 AI 랩은 계속 전진하는 반면 미국 랩은 수비에 몰두하고 있다"고 표현했습니다.

프로바이더 무관 설계는 부모 문서의 모델 유연 빌드 테제를 검증합니다: harness는 DeepSeek의 모델에 묶지 않습니다. 팀은 계획을 프론티어 모델에, 실행을 Qwen3.8-27B나 Muse Glimmer 같은 로컬 우선 오픈 웨이트 모델에, 도구 호출을 MCP 모듈을 통해 라우팅할 수 있습니다——모두 동일한 런타임 내에서, 모두 플러그인 스왑으로.

플러그인 아키텍처가 검증하는 것

"모든 것이 플러그인" 설계는 MCP Module Code Standard에 대한 지금까지 가장 강력한 업계 검증입니다. 코드 표준은 디렉토리 구조, 도구 등록 패턴, 에러 처리 계약, 레이트 리미팅, 감사 로깅, PII 경계 규칙을 정의하여 모든 커넥터가 동일하게 보이도록 합니다. DeepSeek Harness는 동일한 원칙을 런타임 수준에서 적용합니다: 모델, 도구, 스킬, 세션, 샌드박스, 루프는 모두 동일한 플러그인 계약을 따릅니다. 코드 표준에 따라 MCP 모듈을 구축하는 팀은 그것들을 harness의 MCP 클라이언트에 플러그인으로 마운트할 수 있습니다——모듈 패턴과 harness 패턴은 보완적이며 경쟁하지 않습니다.

진정으로 오픈된 에이전트 스택

두 가지 발전이 함께 일주일 전에는 불가능했던 스택을 완성합니다. 중견 B2B 팀은 이제 다음에서 프로덕션 에이전트를 조립할 수 있습니다:

  1. 모델 레이어: Qwen3.8-27B(27B, 비전, 유연한 사고, 262K 컨텍스트, 로컬 실행 가능) 또는 Muse Glimmer(30B, Apache 2.0, 24GB VRAM, Hermes Agent 호환)——둘 다 진정으로 오픈, 둘 다 워크스테이션 배포 가능
  2. 런타임 레이어: DeepSeek Harness(MIT, 플러그인 우선, 추가 전용 세션 로그, OS 수준 샌드박싱, 프로바이더 무관, MCP 클라이언트 내장)
  3. 인테그레이션 레이어: 코드 표준을 따르는 MCP 모듈——NetSuite, HubSpot, BigCommerce, ShipStation 커넥터를 교환 가능 플러그인으로
  4. 거버넌스 레이어: 관측 가능성을 위한 추가 전용 세션 로그, 컨테인먼트를 위한 OS 수준 샌드박싱, 비례 거버넌스를 위한 플러그인별 능력 스코핑

이 스택의 어떤 컴포넌트도 매니지드 API, 토큰당 과금, 또는 벤더의 수정 허가를 필요로 하지 않습니다. 모델 웨이트는 다운로드 가능합니다. 런타임은 MIT 라이선스입니다. MCP 모듈은 오픈 표준을 따릅니다. 거버넌스 패턴은 런타임에 내장되어 있으며 별도 제품이 아닙니다.

제약은 부모 문서가 식별한 것과 동일합니다: 모델이 아니라 인테그레이션 레이어입니다. 진정으로 오픈된 에이전트 스택은 NetSuite, HubSpot, BigCommerce에 연결하는 MCP 모듈의 필요성을 제거하지 않습니다——모델과 런타임 레이어를 오픈으로 만들어 인테그레이션 레이어가 빌드 노력이 집중되는 곳이 되게 합니다. 자체 MCP 모듈을 소유하고, 그것들을 플러그인 우선 런타임에 마운트하고, 로컬 27B 모델과 프론티어 API 사이를 태스크별로 라우팅하는 팀은, 어떤 벤더도 취소, 계량, 또는 축소할 수 없는 프로덕션 에이전트를 갖습니다.

관련 독서

  • Open-Weight Models Crossed the Agentic Frontier——부모 문서, 2026년 7월까지의 오픈 웨이트 모델과 클로즈드 프론티어 모델 간의 능력 격차를 매핑, 모델 유연 빌드 테제와 본 문서가 4개로 확장하는 3전략 오픈 웨이트 비교를 포함
  • Qwen3.8 Open Weights Arrived Stripped——축소版 2.4T로, Qwen3.8-27B는 그것의 진정으로 오픈된 대응 서사입니다. 커뮤니티 반발과 페이월화된 기능 세트를 다룹니다
  • MCP Module Code Standard——DeepSeek Harness 플러그인 아키텍처가 런타임 수준에서 검증하는 구조 패턴——모든 플러그인이 동일한 계약을 따르므로 모든 커넥터가 동일하게 보임

NetSuite와 BigCommerce를 운영하는 중견 유통업체는 공급업체 PDF를 읽고(비전), 가격 티어를 추출하고, 재고를 확인하고, RFQ 응답을 작성하는 에이전트가 필요합니다. 축소版 Qwen3.8 2.4T는 PDF를 읽을 수 없습니다. 27B는 가능합니다——오픈 웨이트에 비전이 포함되어 있습니다. 에이전트 런타임에는 감사 추적을 위한 추가 전용 세션 로그와 컨테인먼트를 위한 OS 수준 샌드박싱이 필요합니다. DeepSeek Harness가 둘 다 제공합니다. NetSuite와 BigCommerce에 연결하는 MCP 모듈은 코드 표준을 따르고 플러그인으로 마운트됩니다. 모델은 PDF 파싱과 로컬 실행을 위해 Qwen3.8-27B로, 전략적 협상을 위해 프론티어 모델로 라우팅됩니다——모두 동일한 harness 내에서, 모두 코드 배포가 아닌 설정으로. 어떤 벤더도 비전 능력을 축소, 추론을 계량, 또는 런타임을 취소할 수 없습니다.

귀하의 시스템을 위해 이것을 구축하고 싶으신가요?

여기의 각 문서는 실제 프로덕션 작업에서 나왔습니다. 대상 시스템과 워크플로가 있다면, 1주 내에 빌드를 범위 정의할 수 있습니다.

범위 정의 빌드 요청

1주 발견. 시스템 인벤토리, 워크플로 맵, 고정 범위를 받습니다 — 우리와 빌드할지 여부와 관계없이.