Skip to content

Latest commit

 

History

History
381 lines (303 loc) · 25.5 KB

File metadata and controls

381 lines (303 loc) · 25.5 KB

oh-my-agent: Bộ khung đa tác nhân biết kiểm chứng công việc

npm version npm downloads GitHub stars License Last Updated

English | 한국어 | 中文 | Português | 日本語 | Français | Español | Nederlands | Polski | Русский | Deutsch | ภาษาไทย

Agent kể chuyện thành công. oh-my-agent kiểm chứng artifact.

Chạy song song nhiều agent là phần dễ. Phần khó là biết được chúng có thực sự làm việc hay không. Câu "test đã pass, mọi tiêu chí đều đạt" chẳng tốn gì của một agent, và không có gì bên trong chính phiên đó phản bác lại được.

oh-my-agent làm cho tuyên bố ấy có thể bị bác bỏ. Một Stop hook không cho kết thúc phiên làm việc cho đến khi script typecheck / test / lint của chính dự án bạn thoát với mã 0. Một lệnh gate quyết định workflow có thực sự chạy hay không bằng cách tìm những artifact mà nó bắt buộc phải để lại — và kết quả chính là phán quyết JSON của lệnh đó, không phải bản tóm tắt của agent. Một trọng tài độc lập với ngữ cảnh hoàn toàn mới kiểm chứng lại mọi tiêu chí ở từng vòng, kể cả những tiêu chí đã đạt. Mọi quyết định của gate đều được ghi vào một nhật ký sự kiện chỉ-thêm mà bạn có thể đọc lại sau. Rồi oh-my-agent áp dụng đúng kỷ luật đó trên cả chục agent runtime, từ một thư mục .agents/ di động duy nhất.

Hãy bắt đầu với Bắt đầu nhanh có sẵn để chọn đường cài đặt, yêu cầu một skill có tên cụ thể thực hiện một thay đổi có phạm vi, rồi ghi lại file, lệnh kiểm tra và exit status. Đường full harness có bao gồm oma doctor.

oh-my-agent explainer

Watch the full video (35s)

Bắt đầu nhanh

Đường nhanh nhất — đưa skills vào agents (Claude Code, Cursor, Codex, …):

npx skills add first-fluke/oh-my-agent

Lệnh này cài gói skills OMA vào các runtime agent được phát hiện. Skills dạy agent cách làm việc; full harness (bên dưới) kiểm tra việc đó đã thực sự xảy ra chưa — stop-hook gate, kiểm chứng artifact, judge độc lập và event log append-only.

Full harness (gates, hooks, CLI)

Dùng khi bạn cần workflow, rule, oma-config.yaml, hook phát hiện từ khóa và oma agent spawn — không chỉ skills.

Script cài đặt sẽ tự cài bun, uv và serena nếu thiếu.

# macOS / Linux — tự cài bun, uv & serena nếu thiếu
curl -fsSL https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.sh | bash
# Windows (PowerShell) — tự cài bun, uv & serena nếu thiếu
irm https://raw.githubusercontent.com/first-fluke/oh-my-agent/main/cli/install.ps1 | iex
# Hoặc thủ công (mọi OS, cần bun + uv + serena)
bunx oh-my-agent@latest
Hoặc cài skills bằng Agent Package Manager (APM) của Microsoft. Mở rộng.

Đừng nhầm với APM (Application Performance Monitoring) của oma-observability.

# Mọi skills, tới mọi runtime được phát hiện
# (.claude, .cursor, .codex, .opencode, .github, .agents)
apm install first-fluke/oh-my-agent

# Một skill
apm install first-fluke/oh-my-agent/.agents/skills/oma-frontend

APM chỉ phân phối skills. Với full harness dùng bunx oh-my-agent@latest (hoặc script trên). Một cách phân phối mỗi dự án — nếu đã dùng npx skills add, giữ skills-only cho tới khi cần gates/hooks/CLI.

Chọn preset là xong:

Preset Bạn nhận được
All Tất cả agent và skill
Backend architecture + backend + brainstorm + db + debug + dev-workflow + pm + qa + scm
Content academic-writer + design + image + scm + translator + voice
DevOps architecture + brainstorm + debug + dev-workflow + observability + pm + qa + scm + tf-infra
Frontend architecture + brainstorm + debug + design + frontend + pm + qa + scm
Fullstack architecture + backend + brainstorm + db + debug + design + dev-workflow + frontend + mobile + pm + qa + scm + tf-infra
Fullstack Mobile architecture + backend + brainstorm + db + debug + design + dev-workflow + mobile + pm + qa + scm
Fullstack Web architecture + backend + brainstorm + db + debug + design + dev-workflow + frontend + pm + qa + scm
Mobile architecture + brainstorm + debug + mobile + pm + qa + scm
Research academic-writer + hwp + market + pdf + scholar + scm + search + translator

Tích hợp Agent

oh-my-agent dùng .agents/ làm nguồn chung cho skills, workflows, rules và cổng xác minh của agent.

Claude Code
Claude Code
nguyên bản + adapter
Codex CLI
Codex CLI
nguyên bản + adapter
Antigravity
Antigravity
SSOT nguyên bản
Cursor
Cursor
nguyên bản + adapter
Qwen Code
Qwen Code
dispatch nguyên bản
DeepSeek Harness
DeepSeek Harness
Cordis plugin
Pi
Pi
tương thích nguyên bản
OpenCode
OpenCode
tương thích nguyên bản
Amp
Amp
tương thích nguyên bản
GitHub Copilot
GitHub Copilot
skills qua symlink
Grok Build
Grok Build
native hooks
Kiro CLI
Kiro CLI
native hooks + agents

& thêm

Đội ngũ kỹ thuật của bạn

Thay vì một AI làm tất cả mọi thứ (rồi bị lạc hướng giữa chừng), oh-my-agent phân chia công việc cho các agent chuyên biệt. Mỗi agent hiểu sâu lĩnh vực của mình, có công cụ và checklist riêng, và chỉ tập trung vào phần việc được giao.

Agent Chức năng
oma-architecture Phân tích đánh đổi kiến trúc và vạch ranh giới module theo hướng ADR/ATAM/CBAM
oma-backend Xây dựng và bảo mật API bằng Python, Node.js hoặc Rust
oma-brainstorm Cùng bạn khám phá ý tưởng trước khi bắt tay vào xây dựng
oma-db Thiết kế schema, migration, index và vector store cho dự án của bạn
oma-debug Tìm nguyên nhân gốc rễ, sửa lỗi và viết regression test
oma-deepsec Quét lỗ hổng bảo mật trong code và chặn pull request rủi ro
oma-design Xây dựng hệ thống thiết kế với token, accessibility và responsive layout
oma-dev-workflow Tự động hóa CI/CD, release và các tác vụ monorepo
oma-docs Kiểm tra tài liệu có tham chiếu bị hỏng và đánh dấu những tài liệu bị ảnh hưởng bởi thay đổi code
oma-explanation Chuyển diff, PR hoặc nhánh thành tài liệu giải thích HTML tương tác độc lập kèm quiz
oma-frontend Xây dựng giao diện với React/Next.js, TypeScript, Tailwind CSS v4 và shadcn/ui
oma-mobile Xây dựng ứng dụng di động đa nền tảng với Flutter
oma-observability Định tuyến công việc observability qua metrics, logs, traces, SLO và điều tra sự cố
oma-orchestration Chạy nhiều agent song song từ CLI
oma-pm Lập kế hoạch tác vụ, phân tích yêu cầu và định nghĩa API contract
oma-qa Rà soát code theo tiêu chuẩn bảo mật OWASP, hiệu suất và accessibility
oma-refactor Tái cấu trúc mã mà không đổi hành vi, dùng hotspot, characterization test làm lưới an toàn và commit chỉ chứa refactor
oma-scm Quản lý nhánh, merge, worktree và Conventional Commits
oma-search Định tuyến mỗi truy vấn đến nguồn tốt nhất và chấm điểm độ tin cậy của kết quả
oma-tf-infra Triển khai hạ tầng đa đám mây bằng Terraform
Công cụ nội bộ & meta
Agent Chức năng
oma-coordination Hướng dẫn phối hợp thủ công từng bước các agent PM, frontend, backend, mobile và QA
oma-skill-creation Soạn và kiểm tra skill OMA mới theo định dạng SSL-lite

Ngoài code: Pipeline nội dung & nghiên cứu

Tách khỏi đội ngũ kỹ thuật, oma còn cung cấp các pipeline nội dung và nghiên cứu được xây theo đúng kỷ luật kỹ thuật đó: chạy lại xác định từ fixture, manifest để tái lập kết quả, và báo cáo suy giảm một cách trung thực khi thiếu nguồn dữ liệu hoặc khóa nhà cung cấp, thay vì âm thầm trả về kết quả mỏng hơn.

Agent Chức năng
oma-academic-writing Soạn, chỉnh sửa và kiểm tra văn xuôi học thuật đạt chuẩn xuất bản
oma-hwp Chuyển đổi file HWP, HWPX và HWPML sang Markdown
oma-image Tạo ảnh qua nhiều nhà cung cấp AI cùng lúc
oma-market Nghiên cứu thị trường từ tín hiệu cộng đồng và trình bày theo khung SWOT, Porter's 5F và PESTEL
oma-pdf Chuyển đổi file PDF sang Markdown
oma-recap Tóm tắt lịch sử hội thoại thành báo cáo công việc theo chủ đề
oma-scholar Tìm kiếm tài liệu học thuật và hỗ trợ bình duyệt khoa học
oma-slide Tạo các deck trình bày HTML đặc trưng giàu hoạt hình và xuất sang PDF/PNG/PPTX
oma-translation Dịch giữa các ngôn ngữ tự nhiên như thể bản ngữ viết
oma-video Tạo video ngắn, video giải thích và video demo qua pipeline HyperFrames dùng được cả khi không có khóa
oma-voice Tạo lồng tiếng và gỡ băng âm thanh ngay trên thiết bị, không cần đám mây

Orca IDE

OMA for Orca bổ sung một sidebar panel và các action trên command palette cho việc thiết lập dự án, review, debug, xác minh và xem kết quả cục bộ. Nó dùng terminal agent Orca hiện có và bản cài OMA của dự án. Yêu cầu Orca 1.4.197+ đã bật plugin thử nghiệm.

Cách hoạt động

Chỉ cần trò chuyện. Mô tả điều bạn muốn và oh-my-agent sẽ tự tìm ra agent phù hợp.

You: "Xây dựng ứng dụng TODO có xác thực người dùng"
→ PM lập kế hoạch công việc
→ Backend xây dựng API xác thực
→ Frontend xây dựng giao diện React
→ DB thiết kế schema
→ QA đánh giá toàn bộ
→ Hoàn thành: mã nguồn được phối hợp và đánh giá

Hoặc sử dụng slash command cho các workflow có cấu trúc:

Bước Lệnh Chức năng
0 /deepinit Lập bản đồ codebase hiện có của bạn vào AGENTS.md, ARCHITECTURE.md và docs
1 /brainstorm Cùng bạn khám phá ý tưởng trước khi bắt tay xây dựng
2 /architecture Cân nhắc trade-off thiết kế và vạch ranh giới module gọn gàng cho bạn
2 /design Dựng hệ thống thiết kế cho bạn với token, accessibility và layout responsive
2 /plan Phân tách tính năng của bạn thành các task được ưu tiên
3 /work Xây dựng tính năng của bạn từng bước qua nhiều agent
3 /orchestrate Chạy nhiều agent song song để xây tính năng của bạn nhanh hơn
3 /ultrawork Xây dựng tính năng của bạn qua năm giai đoạn chất lượng có cổng kiểm soát; mọi lượt đánh giá đều chạy trong một phiên đánh giá mới, tách biệt (cross-context review)
3 /ralph Lặp lại /ultrawork cho đến khi một trình kiểm chứng độc lập đạt mọi tiêu chí
4 /review Rà soát code của bạn về các vấn đề bảo mật, hiệu suất và accessibility
4 /deepsec Quét bảo mật chuyên sâu và chặn các pull request rủi ro
5 /debug Tìm nguyên nhân gốc, sửa lỗi và viết regression test
5 /docs Kiểm tra tài liệu của bạn về tham chiếu hỏng và vá những phần mà thay đổi code chạm tới
6 /scm Quản lý branch, merge và Conventional Commits của bạn
- /schedule Lên lịch một job agent chạy theo chu kỳ lặp lại

Tự động phát hiện: Bạn không nhất thiết cần slash command. Các từ khóa như "kiến trúc", "kế hoạch", "đánh giá", "debug" trong tin nhắn (hỗ trợ 11 ngôn ngữ!) sẽ tự động kích hoạt workflow phù hợp. Độ chính xác phát hiện được đo lường chứ không phải phỏng đoán: oma verify triggers chấm điểm bộ phát hiện dựa trên một corpus 171 prompt đã gán nhãn (hiện tại 0% bỏ sót, dưới 10% kích hoạt nhầm) và dùng nó làm cổng gác CI.

Model theo từng agent

Đặt model_preset trong .agents/oma-config.yaml để chọn AI model mà mỗi agent sẽ dùng:

language: en
model_preset: mixed   # antigravity | claude | codex | cursor | kiro | mixed | qwen

# Optional per-agent overrides
agents:
  backend: { model: openai/gpt-5.5, effort: high }

Kiểm chứng, không phải kể chuyện

Mọi cơ chế dưới đây đều mang tính máy móc: một lệnh hoặc thoát với mã 0 hoặc không, một file hoặc có trên đĩa hoặc không. Không LLM nào bị hỏi rằng công việc "trông có vẻ đúng" hay chưa.

Cơ chế Kiểm tra máy móc điều gì Nằm ở đâu
Stop-hook gate Chặn việc kết thúc phiên khi còn một persistent workflow đang chạy, và chạy gate script đã cấu hình trước khi cho phép dừng. Chỉ typecheck, test và lint mới được thực thi — agent ghi bất cứ thứ gì khác vào file trạng thái thì thứ đó bị bỏ qua, không bao giờ được chạy. Giới hạn 5 lần nhắc lại để một gate đỏ vĩnh viễn không giam bạn lại. .agents/hooks/core/persistent-mode.ts
Anti-Circumvention Gate oma ralph verify --json kiểm tra bốn artifact mà việc đi tắt không thể giả mạo: bản ghi các phase của ultrawork, file JSON kế hoạch, file kết quả của một QA agent riêng biệt và file kết quả của một refactor agent riêng biệt. Thiếu artifact nghĩa là phase đó không hề chạy, bất kể lời kể ra sao. .agents/workflows/ralph.md
Trọng tài độc lập Được spawn như một agent riêng với ngữ cảnh mới tinh, chỉ biết các tiêu chí — không bao giờ biết bên thực thi tuyên bố đã sửa những gì. Kiểm chứng lại mọi tiêu chí ở từng iteration, kể cả những tiêu chí đã PASS, vì sửa C2 chính là cách C1 âm thầm regression. judge-protocol.md
Trạng thái event-sourced Mỗi lần gate pass, gate fail và mỗi quyết định đều thêm một dòng JSON vào ~/.oma/u/0/sessions/{sid}/events.jsonl, kèm dấu vendor và session id của runtime. Chỉ-thêm, xuyên vendor, kiểm toán được sau khi chạy xong. event-spec.md
Bộ kiểm tra theo từng agent oma verify <agent> chạy phần core dùng chung (scope violation, charter alignment, secret hardcode, quét TODO, declared outputs) cộng thêm các kiểm tra theo loại (TypeScript strict, tests, raw SQL, Flutter analyze, inline styles). oma verify <agent>
Bộ đo hiệu quả skill oma skill eval đo mức cải thiện hữu ích trên các task giữ riêng — treatment so với baseline — thay vì mặc định tin rằng một skill có ích. oma skill optimize chỉ giữ lại những chỉnh sửa làm tăng mức cải thiện đo được. hướng dẫn skill-eval

Ngân sách cũng được thực thi theo đúng cách đó. session.quota_cap giới hạn token, số lần spawn và chi phí theo từng vendor; orchestrator từ chối lần spawn kế tiếp khi một chiều vượt hạn mức. Khi hết ngân sách thời gian thực, Stop hook dừng một cách trung thực và ghi trạng thái dở dang vào nhật ký sự kiện, thay vì giả vờ đã hoàn thành.

Ranh giới kiểm soát

oh-my-agent để việc lập kế hoạch tự do và việc chọn hành động tiếp theo cho host LLM. Nó không thay phán đoán đó bằng một đồ thị workflow hay policy engine phổ quát. Thay vào đó, nó đưa ra bên ngoài những bất biến phải luôn đúng bất kể model nào: guardrail của tool, quyền hạn, ngân sách, giới hạn retry và dừng, event bền vững, và việc hoàn thành được kiểm chứng máy móc. Các event có cấu trúc ghi lại quyết định và kết quả của gate; chúng không đóng vai trò một bộ lập kế hoạch thứ hai.

Vì vậy, thực thi SLM xác định là một hướng sản phẩm riêng, tùy chọn, chứ không phải hạ tầng còn thiếu trong harness hiện tại.

Tại sao chọn oh-my-agent?

  • Dựa trên vai trò: agent được mô hình hóa như đội kỹ thuật thực, không phải một đống prompt
  • Ngữ cảnh có điều kiện: dispatch chỉ tải skill sở hữu task và hoãn các tham chiếu hỗ trợ cho đến khi task cần đến. Kịch bản kích thước file và việc tải lúc runtime được báo cáo riêng (hướng dẫn đo lường)
  • Phục hồi được: sau 2 lần retry thất bại, orchestrate spawn các biến thể hypothesis song song và giữ kết quả điểm cao nhất, thay vì lặp mãi một hướng đi sai
  • Hiểu monorepo: detectWorkspace đọc pnpm / nx / turbo / lerna và route mỗi agent đến workspace của nó
  • Đa nhà cung cấp: kết hợp Antigravity, Claude, Codex, Cursor, Kiro và Qwen theo loại agent
  • Có thể quan sát: dashboard terminal và web để giám sát thời gian thực

Kiến trúc

flowchart TD
    subgraph Workflows["Workflows"]
        direction TB
        W0["/brainstorm"]
        W1["/work"]
        W1b["/ultrawork"]
        W2["/orchestrate"]
        W3["/architecture"]
        W4["/plan"]
        W5["/review"]
        W6["/debug"]
        W7["/deepinit"]
        W8["/design"]
    end

    subgraph Orchestration["Orchestration"]
        direction TB
        PM[oma-pm]
        ORC[oma-orchestration]
    end

    subgraph Domain["Domain Agents"]
        direction TB
        ARC[oma-architecture]
        FE[oma-frontend]
        BE[oma-backend]
        DB[oma-db]
        MB[oma-mobile]
        DES[oma-design]
        TF[oma-tf-infra]
    end

    subgraph Quality["Quality"]
        direction TB
        QA[oma-qa]
        DBG[oma-debug]
    end

    Workflows --> Orchestration
    Orchestration --> Domain
    Domain --> Quality
    Quality --> SCM([oma-scm])
Loading

Tìm hiểu thêm

Thích dự án này? Hãy tặng một ngôi sao!

gh api --method PUT /user/starred/first-fluke/oh-my-agent

Thử template starter tối ưu của chúng tôi: fullstack-starter

Star History

Star History Chart

Tài liệu tham khảo

  • Li, X., Liu, Y., Chen, W., You, B., Di, Z., He, Y., Zheng, S., Choe, K. W., Sun, J., Wang, S., Tao, C., Li, B., Zhao, X., Geng, H., Wu, X., Zhou, J., Chen, X., Xing, H., Li, Y., … Song, D. (2026). SkillsBench: Benchmarking how well agent skills work across diverse tasks (Version 4) [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2602.12670
  • Yu, G., & Wang, X. (2026). Knows: Agent-native structured research representations (Version 1) [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2604.17309
  • Liang, Q., Wang, H., Liang, Z., & Liu, Y. (2026). From skill text to skill structure: The scheduling-structural-logical representation for agent skills (Version 4) [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2604.24026
  • Chen, C., Yu, Q., Gu, Y., Huang, Z., Li, H., Liu, H., Liu, S., Liu, J., Peng, D., Wang, J., Yan, Z., Meng, F., Qin, E., Che, C., & Hu, M. (2026). The scaling laws of skills in LLM agent systems (Version 1) [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2605.16508
  • Tang, L., Rashtchian, C., Ferng, C.-S., Tomkins, A., Juan, D.-C., & Vu, T. (2026). WikiSkill: Compiling agent experience into persistent knowledge for skill evolution [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2608.27454
  • Huang, Z., Xu, J., Yang, Y., Gong, Z., Yang, Q., Tian, M., Wang, X., Lv, C., Gao, X., Dai, Q., Liu, B., Qiu, K., Yang, X., Chen, D., Zheng, X., & Luo, C. (2026). From raw experience to skill consumption: A systematic study of model-generated agent skills [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2605.23899
  • Hong, D. B., Imani, A., & Ahmed, I. (2026). From anatomy to smells: An empirical study of SKILL.md in agent skills (Version 2) [Preprint]. arXiv. https://doi.org/10.48550/arXiv.2607.01456

Giấy phép

MIT