Back to Projects

WIGTN Plugin for Codex

Selective, evidence-first lifecycle skills

Codex의 기본 자율성은 그대로 두고, PRD·WorkGraph·인수 검증·릴리스 권한처럼 결과가 명확해야 하는 순간에만 Evidence Contract를 더하는 선택적 플러그인입니다. v0.4.0 기준 10개 스킬을 제공합니다.

개요

Claude Code 플러그인을 그대로 Codex로 옮기면 플랫폼의 강점을 오히려 가릴 수 있었습니다. Codex는 저장소 탐색, 구현 판단, 기본 검증을 이미 자율적으로 수행하므로 고정된 에이전트 fan-out과 긴 절차를 항상 강제할 이유가 없었습니다. 반면 PRD의 필수 항목, 요구사항과 테스트 증거의 연결, source drift 이후 상태 무효화, commit·push·PR 권한처럼 틀리면 위험한 경계는 모델의 재량만으로 두기 어려웠습니다. 그래서 포팅이 아니라 Codex에 맞는 얇은 제품 개발 계약으로 다시 설계했습니다.

도전

AI 개발 하네스는 많이 넣을수록 좋아 보이지만, 실제 평가에서는 일반 구현에 무거운 절차를 씌울수록 같은 결과에 더 많은 token과 시간이 들 수 있었습니다. 또 “검증됨”이라는 말이 실행 테스트 없이 만들어지거나, 사용자의 “확인해줘”를 commit·push 권한으로 확대 해석하는 문제가 있었습니다. 핵심은 모델을 더 통제하는 것이 아니라, 필요한 순간에만 결과 형태·상태 전이·증거·권한을 정확히 고정하는 일이었습니다.

  • Heavy workflow 비용 — 일반 구현까지 긴 절차로 감싸면 token·latency 증가
  • Evidence integrity — 실행 검사 없이 `verified`를 주장할 위험
  • Authority ambiguity — 검토 요청을 commit·push·PR 권한으로 확대할 위험

접근

일반 코딩은 Codex에 맡기고, 사용자의 의도가 PRD·화면정의·계획·검증·릴리스와 일치할 때만 가장 작은 스킬을 자연어로 선택하게 하면 자율성과 재현성을 함께 얻을 수 있다고 봤습니다. 요구사항에는 안정적인 ID를 붙이고, WorkGraph가 requirement → artifact → task → executable check → release gate 연결을 보존하며, source hash가 바뀌면 downstream 상태를 stale로 전파하도록 했습니다.

구조

10개 스킬을 네 층으로 나눴습니다. 제품 계약은 product-spec·screen-spec·work-planner, 증거와 전달은 acceptance-verifier·verified-delivery·release-readiness, 프로젝트 네이티브 산출물은 design-direction·handdrawn-diagram·wigtn-presentation, 지식 축적은 knowledge-wiki가 담당합니다. 대부분 자연어로 자동 선택되지만 전체 구현·검증 루프인 `verified-delivery`는 qualified skill name을 명시해야 하며, Knowledge Wiki도 설치만으로는 켜지지 않습니다.

실행

Evidence Contract validator가 거짓 `verified`, 누락 gap, 존재하지 않는 코드 근거, source drift, 권한 없는 외부 작업을 결정론적으로 차단합니다. WorkGraph의 mutation 명령은 `--apply`가 없으면 dry-run이고 동일 import·plan·drift 적용은 revision을 올리지 않습니다. release-readiness는 review·prepare·commit·push·PR 권한을 사용자 문장 그대로 분리합니다. v0.4.0의 Knowledge Wiki는 허용된 저장소에서만 동작하고, 결정론 검사와 독립 LLM 감사를 통과한 일반화 지식만 `per-user/`에 게시하며 `shared/` 자동 게시와 미push 커밋이 있는 상태의 push를 차단합니다.

  • 일반 코딩은 기본 Codex가 처리
  • PRD·WorkGraph·화면정의·인수검증은 의도에 맞는 최소 스킬만 선택
  • `verified-delivery`와 Knowledge Wiki는 명시적 opt-in
  • release-readiness가 commit·push·PR 권한을 각각 보존

결과 & 성과

Codex용 개인 마켓플레이스에서 설치 가능한 v0.4.0으로 공개했습니다. 10개 스킬과 trigger/evidence 정적 계약, 자연어 trigger 세트, 공식 manifest·skill validator, 저장소 테스트를 함께 제공합니다. 평가 결과 일반 구현의 성공률을 높인다는 과장된 주장은 제거하고, PRD 계약 충족·Evidence status 일관성·Git 권한 경계처럼 실제 근거가 확인된 범위만 제품 설명에 남겼습니다.

v0.4.0
Codex 개인 마켓플레이스 릴리스
10 skills
제품 계약·증거·전달·시각화·위키
opt-in
전체 전달 루프와 지식 축적
OpenAI Codex10 SkillsEvidence ContractWorkGraphKnowledge Wiki

다른 프로젝트

WIGTN Plugin for Claude Code

Claude Code용 오픈소스 개발 워크플로우 플러그인입니다. v0.1.16 기준 11개 전문 에이전트·5개 커맨드·7개 스킬이 PRD, 화면정의, 병렬 구현, 근거 기반 리뷰, 안전한 커밋·PR을 하나의 계약으로 연결합니다. 세션의 재사용 가능한 학습만 4단 게이트로 일반화해 축적하는 Knowledge Wiki도 포함합니다.

WIGENT1st Place

Wigent는 사용자가 주제를 입력하면 AI 에이전트들이 실시간으로 토론하는 멀티 에이전트 플랫폼입니다. PM 에이전트가 주제를 분석해 전문가 에이전트를 동적 생성/퇴장시키며, 7가지 에이전틱 패턴을 적용했습니다. Build with TRAE 해커톤 1등 수상작.

WIGTN FLAKE2nd Place

WIGTN FLAKE는 창업·투자·이사처럼 수억 원이 걸린 결정을 멀티 에이전트 토론으로 풀어내는 동네 인텔리전스 플랫폼입니다. "무엇을 하고 싶은지" 목적을 선택하면 GPT-4o 오케스트레이터가 5명의 Cortex 전문가를 소환해 부동산·유동인구·카드매출·통신계약 4개 데이터셋을 교차 토론하고, Top 3 동네 + 6개월 예측 + 이상 시그널 + 실행 액션을 자동 생성합니다. Snowflake AI & Data Hackathon Korea 2026 Tech Track 2등 수상작.

WIGVOACL 2026

WIGVO는 일반 전화선 위에서 동작하는 실시간 음성 통역 시스템입니다. 방향별로 OpenAI Realtime 세션을 두 개 병렬로 돌리는 듀얼 세션 아키텍처와 소프트웨어 전용 에코 캔슬레이션 파이프라인으로 평균 557ms 지연, 148건 실통화 0건의 에코 루프를 달성했습니다. 수신자는 앱 설치 없이 일반 전화로 받기만 하면 됩니다. ACL 2026 System Demonstrations 채택.

면지 (Myunzy)Top 6

면지는 내 이력서와 실제 채용공고로 AI 면접관을 자동으로 만들어 음성으로 모의면접을 진행하는 플랫폼입니다. LG의 한국어 특화 오픈 모델 EXAONE-4.5를 도구호출 하네스 위에서 굴려, GPT급 자유연기 없이도 끝까지 일관되게 압박·평가하고 한국어 답변의 머뭇거림·표현까지 분석하며 세션 안에서 약점을 학습(자가진화)합니다. mock만으로 전 기능이 동작하고, env만 켜면 EXAONE·음성·외부 API로 무중단 승격됩니다. OBA Weekendthon S1 전체 메인 프라이즈 Top 6 · LG U+ Voice AI 트랙(EXAONE).

WIGTN-CUSTOS

WIGTN-CUSTOS는 GitLab 리포에 상주하며 MR 리뷰부터 머지된 코드 감시, 이슈 발급까지 24/7 스스로 돌보는 자가진화 리포 커스토디언입니다. 핵심은 자가발전입니다. 봇은 "팀이 머지했는가"가 아니라 "머지된 뒤 실제로 사고가 났는가"(Truth ≠ Consent)를 진실 신호로 삼아, 그 신호로 스킬 confidence를 재보정하고 사고에서 새 탐지 규칙을 합성해 점점 우리 팀 시니어가 되어갑니다. 라이브 trajectory 기준 도구 선택의 77%가 에이전트 주도이고 Senior Score 91/100을 골든셋으로 측정합니다. Google Cloud Rapid Agent Hackathon 2026 · GitLab Track (심사 중).