TL;DR

  • Metis는 동일한 DeepSeek V4 Flash 모델·예산·환경에서 Terminal-Bench 2.1 89개 과제 중 73개(82.02%)를 해결해 OpenCode의 60개(67.42%)보다 높은 성능을 보이며, 모델보다 에이전트 하네스·메모리·검증 구조의 영향이 큼
  • 재귀형 5역할 에이전트, SQLite 메모리, Plan/Build 이중 워크플로를 결합한 코딩 에이전트임
  • 터미널의 대화형 TUI와 macOS·Windows용 React/Vite 데스크톱 앱을 함께 제공함
  • OpenAI, Anthropic, DeepSeek, OrcaRouter, Gemini, Groq, Ollama, vLLM 등 다양한 모델 제공자와 TypeScript 플러그인·Agent Skills·MCP를 지원함
  • 자동화된 검증 게이트·비디오 증거 검사·Terminal-Bench 및 Harbor 평가 환경을 제공하며 MIT 라이선스로 배포됨

빠른 시작

데스크톱

  • 내장 Metis CLI와 서버 런타임을 포함한 독립 실행형 애플리케이션이며 Node.js가 필요하지 않음.
  • macOS Apple Silicon에서는 최신 GitHub Release에서 Metis-*-macos-arm64.dmg를 내려받아 Applications로 드래그함.
  • Windows x64에서는 최신 GitHub Release에서 Metis-*-win-x64-setup.exe 또는 .zip을 내려받음.

CLI 설치

  • Node.js 22.19.0 이상이 필요함.
  • @wholiver_hu/metis를 전역 설치한 뒤 metis 명령으로 실행함.
  • 임의의 저장소나 디렉터리에서 저장소 설명 요청, 특정 파일 검토, git diff 결과 검토 등을 수행함.
  • /login으로 구독형 제공자를 사용하거나 API 키를 설정함.
  • 전체 안내는 Quickstart에서 확인함.

벤치마크 및 비교

Terminal-Bench 2.1 벤치마크 결과

  • 동일한 DeepSeek V4 Flash 모델, 동일한 실제 작업 89개, 동일한 예산과 환경을 사용한 통제 벤치마크임.
  • Metis73/89개(82.02%)를 해결하며, 재귀형 5역할 에이전트 + SQLite 메모리 + Plan/Build 아키텍처를 사용함.
  • OpenCode60/89개(67.42%)를 해결하며, 단일 스레드의 평면형 도구 실행 구조를 사용함.
  • 동일 모델·예산·환경에서 Metis가 13개 과제, 14.6%포인트 앞서며, 차이는 하네스·메모리·검증 게이트만으로 발생함.

기능 비교 매트릭스

  • 라이선스 및 가격: Metis는 MIT·무료, Claude Code는 독점 소프트웨어, OpenCode는 MIT·무료, Cursor/Cline은 상용 제품임.
  • 모델 선택의 자유: Metis는 모든 모델과 OrcaRouter를 지원하고, Claude Code는 Anthropic만 지원하며, OpenCode는 다중 제공자를 지원하고, Cursor/Cline은 제한적이거나 BYOK 방식임.
  • 사용자 인터페이스: Metis는 TUI + React 데스크톱, Claude Code와 OpenCode는 터미널 전용, Cursor/Cline은 IDE 전용임.
  • 워크플로 모드: Metis는 Plan ↔ Build 이중 모드, Claude Code와 OpenCode는 단일 흐름, Cursor/Cline은 채팅·인라인 방식임.
  • 다중 에이전트 시스템: Metis는 L0→L4 재귀 위임과 5개 역할, Claude Code는 평면형 서브에이전트, OpenCode는 기본형 구조, Cursor/Cline은 다중 에이전트 시스템이 없음.
  • 지속형 메모리: Metis는 SQLite + 벡터 검색, Claude Code와 OpenCode는 일시적 메모리, Cursor/Cline은 코드 임베딩을 사용함.
  • 검증 게이트: Metis는 테스트 게이트 + 비디오 증거, Claude Code와 OpenCode는 수동 Bash, Cursor/Cline은 기본 린터를 사용함.
  • 헤드리스 벤치마크: Metis는 Python 어댑터 + 추적 기능, Claude Code와 Cursor/Cline은 지원하지 않으며 OpenCode는 부분 지원함.

핵심 기능

  • Plan 및 Build 이중 워크플로: 읽기 전용 Plan 모드에서 안전하게 조사한 뒤, 승인된 계획을 Build 모드에서 실시간 갱신 체크리스트와 함께 실행함.
  • 터미널 및 데스크톱 이중 인터페이스: 대화형 TUI를 통해 터미널에서 직접 작업하거나, macOS·Windows의 전용 React/Vite 데스크톱 작업 공간을 사용함.
  • 재귀형 다중 에이전트 시스템: 코디네이터·플래너·구현자·리뷰어·검증자로 구성된 명명형 에이전트와 L0→L4 재귀 위임, Git Worktree 격리를 제공함.
  • 지속형 메모리 및 재개 가능한 세션: 프로젝트 지식과 의사결정을 SQLite에 저장해 재시작, 컨텍스트 압축, 세션 분기 이후에도 유지함.
  • 확장 가능하고 모델에 종속되지 않는 구조: OpenAI, Anthropic, DeepSeek, OrcaRouter, Gemini, Groq, Ollama, vLLM 등 임의의 LLM 제공자를 사용하며 TypeScript 플러그인, Agent Skills, MCP로 확장함.
  • 벤치마크 수준의 신뢰성: 자동화된 검증 게이트, 비디오 증거 검사, 전체 Terminal-Bench 및 Harbor 평가 준비 환경을 제공함.

문서

  • 설치·인증·시작: Quickstart
  • 명령어 및 터미널 UI: Using Metis · TUI
  • 제공자 및 사용자 지정 모델: Providers · Custom models · Custom providers
  • 다중 에이전트 시스템: Named Agents & Delegation
  • 벤치마크 및 평가: TerminalBench & Harbor
  • 세션 및 압축: Sessions · Compaction
  • 확장 기능·스킬·패키지: Extensions · Skills · Packages
  • 프롬프트 및 인터페이스 사용자 지정: Prompt templates · Themes · Keybindings
  • 프로그래밍 방식 통합: SDK · RPC · JSON
  • 비디오 검사: Video tool
  • 보안 및 설정: Security · Settings
  • 플랫폼 및 격리: Windows · Termux · tmux · Containers
  • 모든 가이드는 문서 색인에서 확인함.

개발자 정보

  • npm run build는 TypeScript를 컴파일하고 런타임 자산을 복사함.
  • npm test는 Vitest 테스트 모음을 실행함.
  • npm run clean은 컴파일된 출력을 제거함.
  • npm run build:binary는 독립 실행형 바이너리를 빌드함.
  • npm --prefix desktop run dev는 React/Vite 데스크톱 앱을 개발 모드로 시작함.
  • npm --prefix desktop run build는 렌더러와 Electron 산출물을 빌드함.
  • 패키지는 @wholiver_hu/metis에서 Node.js SDK를, @wholiver_hu/metis/rpc-entry에서 RPC 진입점을 내보냄.

기여

  • 기여를 환영하며, 개발·확장 기능 및 패키지 통합·테스트·AI 지원 기여 지침은 CONTRIBUTING.md에서 확인함.

라이선스

  • MIT 라이선스로 배포됨.