真实配置 · 真实踩坑 · 真实成本
vercel-labs 今年 1 月建仓,Rust + Apache-2.0,43,263 Star / 2,904 fork / 823 open issues,昨天还在推 main。它跟 Playwright MCP 的分歧在交付形态:不是 stdio 服务,是「18 MB 静态二进制 + 常驻 Rust daemon 直连 CDP」,任何能跑 bash 的 Agent 都能用。我把同一份 Chrome 154 二进制喂给两个工具做对照:HN 首页 agent-browser snapshot -i 是 4,740 token、Playwright MCP browser_snapshot 是 12,402,read 只要 1,120(−90.5%);延迟上常驻 daemon 单命令 4ms、batch 20 条 13ms、冷启 2,295ms,九步登录流程工具有效载荷合计 396 token。反面同样实测:完整 a11y 树在复杂页面上比原始 HTML 还大 13.3%;-i 会把「Invalid credentials」这种纯文本提示整段藏起来;--delta 基线给纯文本、更新给 JSON 补丁且与 -i 同用时报 unchanged;默认 MCP 档 29 个工具的 schema 自己就占 66,722 字节 / 15,873 token(Playwright MCP 是 5,209);--tools all 的分页游标永远返回 64,翻十页是同一份内容;--allowed-domains 拦得住 open 和 fetch(SecurityError),一句 eval "location.href=..." 直接跳过去。安装坑也踩了:容器里必须 --no-sandbox 且只在启动 daemon 那条命令生效、配置文件里 args 必须是字符串、npm 全局装出来 0.27.0 而 latest 是 0.38.1(read 直接不存在)、114 MB 里塞了七个平台的二进制。
2026 年 4 月从一个梗开场、一周 4,000 Star,现在 106,922 Star / 6,186 fork / 130 open issues(Go,skill 是 MIT、引擎是 BSL-1.1)。三层设计——skill 管模型「嘴上说什么」,proxy 管 Agent「眼里读到什么」,middleware 管你自己写的 Agent。我用真实负载实测:400 行 JSON 事件 31,446 → 2,135 token(-93.2%)、3,000 行重复日志 74,182 → 430(-99.4%)、shrink 包住的终端输出 4,011 → 95(-97.6%),三次都用 cmp 验过字节级还原;异构日志、代码、HTML 一律 0%——代码横跨 538 到 200,750 token 七个档位一次没压动,--force / -t 这类 flag 被静默吞掉。最关键的一条:它自己的 docs/HONEST-NUMBERS.md 承认早期统计按固定 65% 输出系数估算、无可复核数据,现在已经撤掉——README 首页还在喊 65%。另有 JetBrains 实测(86 任务、仅 skill)输出 token 只少 8.5%、Adobe 论文发现「压缩人写的 prompt」是净亏(平均 1.15 倍)、issue #550 一次 Cursor A/B 反而是 4.3M vs 1M token 且墙钟翻倍。踩坑也实测了:caveman learn 报 spawnSync caveman-proxy ENOENT 且退出码 0、npm 包 1.3.4 而文档描述 2.7.0、流式请求与 Claude Pro/Max 会话因 MCP 恢复工具缺失整段绕过压缩、安装包 171.4 MB 六个二进制。
NVIDIA 下场做的 agent skill 供应链扫描器:Apache-2.0、Python 3.12+,把「装 skill 前先验货」做成可进 CI 的契约——0–100 分 + SAFE/CAUTION/DO_NOT_INSTALL 三档判定 + SARIF/退出码。它是 NVIDIA Verified Skills 流水线的一环(扫描→评估→OpenSSF Model Signing 签名→发布到官方 skills catalog),内置 27 个分析器扇出的 LangGraph 流水线、至少 90 条规则(README 只列 71 条)、YARA+AST+污点追踪+可选 LLM 语义精修。实测:恶意样本 29 条发现拿满 100 分;干净 skill 里提一个不存在的文件名就让判定从 SAFE 掉成 CAUTION(源码 fail-closed);--no-llm 永远拿不到 SAFE;符号链接目录被静默跳过并报「0 组件 SAFE」;Anthropic 官方仓库整仓扫 5 分 03 秒、238 条、90.4% 覆盖;官方 19 个 skill 批量扫出 6 个满分 CRITICAL(claude-api 55 条发现,51 条是文档里的 URL);我本机 109 个 skill 只扫完 32 个(77 个被总量预算省略),其中纯文档型 skill 也拿 100/100。自建 mock 打穿 LLM 层:走 json_schema strict、三条 prompt 里没有「不可信数据」隔离声明、一条 LLM finding 被复制成 9 条。
前身是 DeepSeek 生态的 deepseek-tui,2026 年 1 月独立改名后主动去中心化:38 个 provider 内置(DeepSeek 只是默认项)、本地模型走 Ollama/vLLM/SGLang、approval 四姿态 + 9 层授权流水线(permissions.toml 类型化规则、项目 overlay 只能收紧)、fleet 耐久多 agent 跑批(ledger 可幂等 resume)、价格未知不报免费。MIT,Rust 单二进制 ~66MiB,2026-01-19 建仓,不到 8 个月 40,913 Star / 3,545 fork,周更节奏(9/4 刚发 v0.9.12,昨天 main 还在推)。实测安装、doctor、坏 key、裸 exec、exec --auto + SSE mock 全链路(本地真执行 read 工具带 content_hash,扒到 10,729 字符系统提示词和 7 个工具 schema)——坑也踩实了:裸 exec 根本不是 agent(收到 tool_call 静默吞掉、exit 0)、--auto 只认 SSE 流(普通 JSON 报 "stream closed before [DONE]"、重试 12 次后失败)、0.9.12 起匿名统计默认开启、离线模型目录只有 3 个 DeepSeek id。
「AI 结对编程」的开山鼻祖,比 Claude Code / Codex CLI 早一两年定义 terminal coding agent 的两大范式:tree-sitter + PageRank 的 repo map、SEARCH/REPLACE 编辑块,外加「每次改动自动 git commit」。Apache-2.0,Python,2023-05-09 建仓,3 年多 48,605 Star / 4,901 fork,PyPI 6.8M 安装、周 15B token、OpenRouter Top 20、Singularity 88%。实测安装、坏 key(litellm 报错清晰)、--show-repo-map、mock 全链路(编辑应用 + 自动 commit 737c9a4)——坑也踩实了:gpt-4o-mini 默认走 whole 格式,喂 SEARCH/REPLACE 块把整个文件写坏(add() 函数直接消失)、editblock 在 v0.86 改名 diff(老教程全过期)、非交互模式 gitignore / release-notes 提示自动默认 Yes、开发休眠期生态风险。
全网最全的 AI 工具「提示词档案馆」:30+ 款主流 Coding Agent / IDE / 通用 agent 的真实 system prompt + tools.json 被提取归档。文本 + JSON,GPL-3.0,2025 年 3 月建仓,143,144 Star / 34,846 fork,最近更新 2026-08-11。实测 clone 全仓:140 个文件 3.8MB、83 个提示词 txt、17 份工具定义。逐行读完三份核心:Claude Code v1 191 行(安全边界 + WebFetch 自我文档化)、Cursor Agent 2.0 772 行(codebase_search 带 When NOT to Use + 好坏例子,2025-09-03 版砍到 229 行)、Codex CLI 46 行(keep going until resolved + 防自我认知错乱声明)。三个玩法:读懂 Agent 行为、抄结构改进自己的 AGENTS.md、版本考古看行业进化——坑也踩实了:提示词两周就过期、Claude Code 2.0.txt 里夹着「Write a haiku about it」注入样本(抓包文件不是官方文档)、提取性质处于灰色地带、脱离环境照抄原文就是废纸。
charmbracelet(Bubble Tea / Lip Gloss 母公司,25k+ 应用跑在它家 TUI 生态上)下场做 terminal coding agent。Go,FSL-1.1-MIT,2025-05-21 建仓,15 个月 27,677 Star / 2,184 fork,8/22 发 v0.91.0,nightly 日更。默认目录 40 家 provider / 1,547 个模型(Catwalk 社区库自动更新);crushrc 是「带内置命令的可执行 Bash」,配置即 trusted code;26 个工具里 8 个是 LSP 工具(定义/引用/诊断/重命名),MCP 内置 OAuth 授权码流程,技能目录通吃 ~/.claude/skills 等 8 处。实测 release 二进制安装、无 key 裸跑、自定义 provider + mock 全链路、工具循环(tool_call→本地真执行→回传)、坏 key 401、会话落盘结构、请求扒包(system prompt 22,337 字符、每会话两段式调用)——坑也踩实了:FSL 两年内禁止竞争性商用、非交互跑会话标题偶发丢失(sql: database is closed 竞态)、技能 frontmatter 解析严格 WARN 刷屏、PostHog 遥测退出丢消息、--continue 续失败会话。
Claw Code(195,111 Star)README 第一屏自己承认是「agent 管理的博物馆展品」、别用它——扒提交历史全是真人 + 4.5 个月 3200+ PR,Star 通胀味道冲。它背后真正能跑的是 Gajae-Code(gjc):MIT,TypeScript,2,587 Star,8/22 发 v0.15.0。/login 直接 OAuth 登录 Claude Pro/Max、ChatGPT Plus、Cursor、Copilot、Kimi、GLM、MiniMax、Grok、Qwen 等订阅,不碰 API 计费;deep-interview→ralplan→ultragoal 计划先行 + 批准门;agent 卡住推到 Telegram/Discord/Slack 手机应答;SDK session CLI 让 Hermes/OpenClaw 都能驱动它。实测安装、无 key 裸跑、自定义 provider + mock 全链路跑通——坑也踩实了:npm 包装完还要 bun(#!/usr/bin/env bun)、双包名混乱、自建网关不实现 SSE 被静默误判成 context overflow(报错误导且 exit 0)。
小米官方下场做的终端原生 Coding Agent,把 200K Star 的 OpenCode fork 成自家闭环。MIT,TypeScript,npm @mimo-ai/cli,2026 年 6 月建仓,2 个半月 12,851 Star / 1,320 fork,8/19 刚发 v0.1.13,周更节奏。保留 OpenCode 全部底座(多 provider/TUI/LSP/MCP/插件),叠了四层自家东西:SQLite FTS5 持久记忆(memory_fts/history_fts 实测扒到表)、智能上下文管理(自动检查点 + 预算注入 + /context-limit 可调压缩点)、子代理编排 + /goal 独立裁判模型、14 阶段 compose 流水线 + 4 个确定性 JS 工作流,外加 /dream /distill 自我进化。背后是 MiMo-V2.5(310B/1.05M 上下文)和 V2.5-Pro(1.02T)。实测安装、--help、无 key 裸跑、自定义 provider、mock 服务全链路跑通——坑也踩实了:开箱默认走小米免费 API 但服务已终止、坏 key 静默退出 exit 0、mock 响应校验严格直接判 "empty output"、26 个内置 skill 比 README 多 3 个。
Claude Code 的代码库被 fork 出来大改成「模型自由」版:一套终端工作流跑 OpenAI 兼容全家桶/DeepSeek/Gemini/GitHub Models/Codex OAuth/Ollama/Atomic Chat 等 20+ 后端。MIT,TypeScript,npm @gitlawb/openclaude,2026 年 4 月建仓,不到 5 个月 30,796 Star / 8,920 fork,8/20 刚发 v0.29.1。agent 级模型路由、后台会话 --bg、PageRank repo map、默认 DuckDuckGo 联网、headless gRPC server。实测安装、--help、无 key 裸跑、假 key 挂起、配置落盘全链路跑通——坑也踩实了:OSV 高危公告历史(<0.5.1 沙箱逃逸,现版已修)、开箱默认自家网关要 key、坏 key 不报错直接挂 25 秒、.env 不自动加载、--fork-session 只 fork 对话不做文件隔离。
Agent = Model + Harness,Ruflo 就是那个 harness——前身 claude-flow,一年 68,580 Star。把单上下文的 Claude Code 变成共享记忆、会自学习、能跨机器协作的 agent 蜂群:queen/worker 编排 + 5 种共识算法(Raft/BFT/Gossip/CRDT/Quorum)、AgentDB + HNSW 向量记忆、WASM Agent Booster 免 LLM 通道(<1ms/$0)、mTLS + ed25519 零信任联邦。MIT,TypeScript,昨天还在发 v3.38.16。实测安装、init、doctor、mcp、memory、swarm 全链路跑通——坑也踩实了:npx 冷启动 3 分钟超时、611 个依赖、333 个 MCP 工具 ≈ 61,550 schema tokens/轮、改名残留(package.json 还叫 claude-flow)、加密默认关。
同样跑 DeepSeek API,通用 agent 框架缓存命中率 30-60%,它做到 99.82%——真实用户单日 4.35 亿输入 token 只花 $1.38(无缓存要 $61)。核心是缓存优先循环:不可变前缀 + 只追加日志 + 易失草稿三区隔离,外加工具调用修复四通道(flatten/scavenge/truncation/storm)和 flash-first 成本控制。Go 重写版已多模型化(DeepSeek 只是预设)、单静态二进制、reasonix.toml 配置驱动、支持 MCP/ACP/VS Code。MIT,34,935 Star,4 个月长出来的,npm v1.31.0 昨天刚发。实测安装、doctor、run 全链路跑通——坑也踩实了:GitHub main 分支 README 过期(照它操作第一步就撞墙)、沙箱无 bwrap 直接拒跑 bash、开箱自带两个引用不存在工具的坏 skill。
2026 年 4 月 10 日 bloop 官宣 shutdown:「成千上万工程师每天用它,但绝大多数是免费用户,找不到能让自己兴奋的商业模式」。功能行业第一(多 agent 并行、diff 行级评论闭环、内置浏览器预览、远程访问全是它首创),依然养不活团队——整个 coding agent 生态商业化困境的样本。Rust 33 crate 后端 + executor 抽象(每 agent 一模块 + ACP 标准协议)+ 自己就是 MCP server(agent 反向操作看板)。Apache-2.0,27,850 Star,终版 v0.1.44(4/24)。实测 npx vibe-kanban 下载、启动、WebUI、/api/health 全链路跑通——但云端功能已按公告下线、版本冻结,最大的坑已踩。
免费开源的 Claude Cowork 替代品:内置 Rust agent 引擎(aionrs)贴个 API key 就能干活;自动识别本机 Claude Code / Codex / Hermes / Cursor Agent 等 20+ CLI agent 接进同一界面;Team Mode 让 Leader 拆活、Teammate 并行;Cron 定时 + 防睡眠 + 唤醒补跑,真 24/7 无人值守;WebUI + Telegram / 飞书 / 钉钉 / 微信远程遥控;连 PPT / Word / Excel 都有 28.7K Star 的 OfficeCLI 引擎来产出。Apache-2.0,32,090 Star,昨天刚发 v2.1.58。实测无头版 aionui-web 2.1.47 下载、启动、WebUI、API 全链路跑通——但官方下载直链已 404,最近 9 个版本全没挂安装包,最大的坑已踩。
一个 Go 单二进制桥接层,把本地 coding agent(Claude Code、Codex、Cursor、Gemini CLI、Kimi CLI、OpenCode 等 10+ 种)接进 13 个消息平台(飞书、钉钉、Telegram、Slack、Discord、企业微信、QQ、微信),大部分平台走 WebSocket/长轮询出站长连接、免公网 IP;持久会话防 context drift、/mode yolo 权限模式、run_as_user OS 级隔离、群里多 bot 互相喊话、/cron 自然语言定时任务。MIT,15,008 Star,6 个月长出来的,8 月 17 日还在更新。实测 v1.5.0:下载、启动、三关校验链全走通——README 的 release 直链已 404、--web-port flag 不存在、假 token 报错有误导性,三个坑全踩实了。
一个常驻后台的 Rust 单二进制 server,把你的 coding agent 全部装进它管的真终端里:ctrl+b q 断开、合盖、重启、SSH 远程,agent 都活着;每个 pane 显示 working/blocked/idle,谁卡了一目了然;CLI + socket API + SKILL.md 三件套让 agent 能自己开 pane、读输出、等另一个 agent 干完活。Apache-2.0(v0.8.0 刚从 AGPL 改过来),29,687 Star,4 个月长出来的,8 月 16 日还在更新。实测 v0.8.0 无头模式:headless server、agent 状态机、真实驱动 Hermes agent 干活并等到回复全链路跑通——两个坑已踩:wait-output 子串匹配会命中命令回显行、report-agent 的 label 不能当 agent target 用。
一个 Rust 二进制内置 10 套官方 agent harness(Claude Code / Kimi Code / DeepSeek TUI / Qwen Code / SWE-agent…),/harness 一条命令换壳——大厂锁在自家 CLI 里的提示词工程被解耦成可插拔模块。Codex fork,Apache-2.0,68,015 Star,8 月 15 日刚发 rust-v0.0.38。实测 v0.0.38:默认 provider 是 OpenAI(没 key 就 401 重连循环)、--oss 要本地 ollama/lmstudio、容器里 bwrap 沙箱起不来——三个坑全踩了。
OpenCode 生态里最激进的多模型编排插件:11 个 Discipline Agent、54+ 生命周期 Hook、Team Mode 1+8 并行小队、哈希锚定编辑(Grok Code Fast 成功率 6.7%→68.3%)。TypeScript,67,857 Star,2025 年 12 月建仓、8 月 14 日还在更新。Light 版(Codex CLI 插件)沙箱实测装通:12 个 agent、14 个 CLI、20+ hooks 一次落盘——但 --codex-autonomous 会直接写 approval_policy=never + danger-full-access,最大的坑已踩。
你的 Agent 每生成一行 Terraform 都在替你决定下个月账单——而它对价格一无所知。Infracost 把成本估算和 FinOps 策略直接塞进 Claude Code / Cursor 的生成流程:4 个 agent skills(iac-generation / scan / price-lookup / fix-findings)MCP + CLI 双绑定,1,100+ 云资源覆盖,CI 里还能发成本 diff 评论。Go,Apache-2.0,12,445 Star。实测 v2.16.1:装得上、命令全,但 scan 必须先登录,否则无限挂起——最大的坑已踩。
17 节课从零手写一个 Claude Code 式 agent harness:s01 只有 137 行 Python,一个 while 循环 + 一个 bash 工具就是完整 agent。三闸门权限管线、四级上下文压缩、agent 团队、goal loop——每章一个机制、一份可运行代码、中英日三语文档。MIT,73,986 Star,昨天还在合并 PR #512(课程刚重构到 17 节)。s03 权限管线我已在这台机器上实测跑通。
不是又一个代码知识图谱:GitNexus 在索引期就用 Tree-sitter + LadybugDB 预计算好调用链、Leiden 社区聚类和置信度,17 个 MCP 工具一次调用返回完整爆炸半径,Claude Code / Codex 还有 PreToolUse hooks 主动喂上下文。实测 4.9 秒索引完 demo 仓库,impact UserService 直接列出 depth 1 调用者(CALLS 0.85)。TypeScript,45,284 Star,昨天还在更新——注意是 PolyForm Noncommercial 许可。
xAI monorepo 里完整 agent 栈的开源切片:pager 式全屏 TUI、Landlock/Seatbelt 内核级沙箱(deny glob 堵死 mv 绕过)、plan.md 工具层强制只读、headless 四格式输出 + JSON Schema、/goal 自主目标 + /deep-research 交叉验证。7 月 14 日创建,28 天 24,584 Star,Apache-2.0,8 月 9 日还在同步更新。
把「plan → test → implement → review → verify → remember → improve」整条工程闭环装进你的 Coding Agent:67 个专职子 Agent、284 个按需加载的技能、会从真实会话里长出「本能」的记忆,外加 AgentShield 安全审计。2026 年 1 月创建,7 个月冲到 23.9 万 Star,MIT 协议,昨天还在更新。支持 Hermes 等 12+ 个 harness。
自动捕获 Agent 每次会话的工具调用与观察,AI 压缩成语义摘要存进本地 SQLite,下次会话自动注入相关上下文。Claude Code / Codex / Gemini / Hermes / OpenCode 通吃,不到一年 9 万 Star。跟 engram 的极简路线正好打对台。
Electron + git worktree 的并行 Agent 编排:每个任务一个隔离工作区、一条独立分支、一个独立终端,10+ 个 CLI Agent 同时跑互不干扰。内置 diff 审查、端口预览、定时自动化,还能用 MCP 让 Agent 自己调度 Agent。昨天刚发 v1.19.0。
Tauri 2 + Rust + SQLite,一年从 0 涨到 12.5 万 Star。50+ Provider 预设一键切换、统一管理 8 个 Agent 的 MCP 和 Skills、本地代理自动故障转移、用量成本仪表盘——多 Agent 工作流的配置地狱,终于有人出手了。
起家于 VS Code 插件的 Cline,现在用同一个 agent core 撑起 CLI、Kanban、JetBrains 插件和 SDK 五条产品线。SDK 月下载 57 万、npm 月下载 60 万,昨天刚发 v4.1.4——它正在从"编辑器里的助手"变成"你自家 Agent 的引擎"。
Rust 内核预索引全代码库,一次 codegraph_explore 返回源码 + 调用路径 + 爆炸半径,文件一改图就自动更新。7 个真实仓库基准:工具调用省 89%、成本省 60%、文件读取归零。支持 Claude Code / Codex / Hermes Agent 等 8 个 Agent。
从 Gemini CLI 分叉、用自己改自己的自举开发、Fork Subagent 省 80% 成本、Agent Arena 多模型对决——这就是阿里交出的终端 Coding Agent 答卷。26,597 Star,Apache-2.0。
Agent 无关、SQLite + FTS5、20 个 MCP 工具——给你的 Claude Code、Cursor、Windsurf 装上跨会话的"大脑"。比 claude-mem 更简单,零依赖,MIT 协议。
Pi 的进化版——40+ LLM 提供商、LSP 直连、真实调试器、子 Agent 并行、GitHub 当文件系统用。hashline 编辑让 token 省 61%,MIT 协议开源。
ChatGPT Plus 用户的内置工具、Rust 写的、一天三次 alpha 发布、今天刚合并了 MCP 支持。OpenAI 的 Codex CLI 从"终端插件"长成了 Coding Agent 领域最活跃的项目。
Python + JavaScript 双 SDK + GroupChat 自动协商,让 Coding Agent 从"单体"走向"团队架构"。31,200 Star + MIT 协议,微软开源的 AI 工程化操作系统。
Python SDK + Docker 隔离工作区 + ACP 协议,让 Coding Agent 从"对话式"升级为"自主工作流"框架。82,510 Star + MIT 协议 + 77.6% SWE-bench 分数,目前最接近"自主开发软件"的开源框架。
TypeScript 扩展 + Skills + Prompt Templates,让 Agent 不再是黑盒,而是你手里的瑞士军刀。26+ LLM 提供商支持,会话像 Git 一样可回溯分支。
用 YAML 把开发流程"编译"成确定性工作流——计划、实现、验证、审查、PR 一气呵成,像 GitHub Actions 一样让 AI 编码可预测、可重复。
Tree-sitter + 知识图谱 + Blast Radius 分析,Agent 再也不瞎读代码了。2.3.7 最新,MIT 开源。
5 个生命周期 Hooks + QMD 语义搜索 + 9 个 Subagent,让你的 Agent 每次重启都「记得」一切。支持 Claude Code / Codex / Gemini CLI。
开源 Managed Agents 平台——像分配同事一样给 Agent 分任务。
Google 官方出品,一套 Skills 系统把 ADK 开发全流程注入 Claude Code / Codex / 任何 Coding Agent。
你的 Agent 每天读 10 万个 token 的工具输出,其中一半是废话。Headroom 在 Agent 和 LLM 之间插一层压缩,同样的回答、零代码改动、本地运行。
2.1K Star 的 MCP Server,用 chain-of-thought + reflection 让 Agent 不再「做完就忘」——跨会话记忆、任务依赖图、自动拆分子任务。
9.4K Star 的终端 Agent 框架,用 Rust 把性能卷到极致——语义记忆、多 Agent 协作、自改源码,全都塞进了一个 28MB 的进程里。
Ghostty 内核、Swift 原生、竖向标签栏带 git 分支和 PR 状态、通知环告诉你哪个 Agent 在等你。
零依赖、21 个 MCP 工具、预索引后符号查询 0.1ms。给 Agent 设计的代码上下文引擎,不是编辑器。
Google 官方出品,47K Star,把 Chrome DevTools 全部能力通过 MCP 暴露给 Coding Agent。
从链式调用到 LangGraph 多步 Agent,LangChain 如何成为 LLM 应用开发的事实标准。
产品经理、架构师、程序员各司其职,MetaGPT 让自然语言驱动软件开发全流程。
能自主调研、写代码、生成内容的 SuperAgent 框架,支持深度研究和多步任务编排。
从代码审查到安全扫描,一套 Skills 跑遍 Claude Code / Cursor / Codex CLI / Hermes Agent。
集成 Agents + MCP + Skills,支持 20+ 模型提供商,自托管的 AI 平台。
本地优先的桌面应用,你的 Agent 不仅写代码,还能做原型、落地页、PPT、视频。
类型安全的 Agent 开发体验,内置工作流编排、工具调用、记忆系统,前端开发者的福音。
一套 Skills 同时跑 Claude Code / Codex CLI / Cursor / Hermes Agent / Copilot,真正的跨平台生态。
Google Chrome 工程负责人出品,覆盖前端、后端、测试、代码审查的工程级 Skills。
Rust 写的、桌面+CLI+API 三形态、15+ LLM 提供商、70+ MCP 扩展、还能用你已有的 Claude/ChatGPT 订阅免 API 费——这是目前最被低估的通用 Agent。
同一个 agent 内核跑在三种 IDE 里,500+ 模型零加价直连,内置 5 种专业 Agent(Code/Plan/Ask/Debug/Review),支持 CI/CD 自动化模式。
在 OpenCode 的地基上叠了持久记忆、上下文自动重建、Goal 判断、Compose 工作流、13 个内置技能、以及 /dream 和 /distill 自我进化命令。11.9K Star,一个月做到的。
MIT 协议、TypeScript + Effect 全栈、75+ LLM 提供商、5 种内置 Agent、插件系统和桌面端。
Go 单二进制、零依赖、175 个 MCP 工具,3 分钟索引 7 万个文件的 Linux 内核。841 Star 的代码智能引擎。
当所有人都在卷单个 Agent 的能力时,CCB 换了个思路——让 Codex、Claude、Gemini、Kimi、Qwen 坐在同一张桌子上干活。
MoonshotAI 把自家的 Coding Agent 开源了——单二进制、毫秒启动、视频输入、子 Agent 并行。
25K Star 的分布式图结构 Issue 追踪器,用 Dolt 做版本控制数据库,专为 Coding Agent 的长任务记忆而设计。
用 git worktree 隔离多个 Coding Agent 的工作区,自动把 CI 失败、Review 评论路由回正确的 Agent 会话。
26K Star 的 MCP 工具包,把 IDE 级别的代码语义理解能力暴露给 AI Agent。
4K Star 的 CLI 工具,一行命令给你的代码库生成完整文档,还自动告诉 Claude 和 Copilot「写代码前先读这个」。
6K Star 的终端 Diff 查看器,专门为 AI Agent 生成的代码变更设计。
8K Star 的 Go 二进制,用两个老工具解决「同时跑多个 Coding Agent」这件事。
你要求一个日期选择器,Agent 装了 flatpickr、写了 wrapper、加了样式表、开始讨论时区。Ponytail 说:用原生 input[type="date"],一行搞定。最好的代码是没有代码。
一个刚出生 3 个月就拿了 1 万 Star 的桌面应用,把「同时跑 5 个 Claude Code」这件事做到了手机上。
纯 C 实现的 MCP 服务器,把整个代码库变成可查询的知识图谱。Linux 内核 2800 万行代码 3 分钟索引完,查询延迟不到 1 毫秒。
24K Star 的 Agent 技能,用三个 Markdown 文件解决 Coding Agent 最致命的问题。
2K Star 的 MCP Server,用 RAG + AST + 谱系聚类 + Obsidian 双链,给 AI Agent 一套真正「看懂」大型代码库的语义智能系统。
清华 OpenBMB 做了个 Agent OS,我拿它跟 Codex、Claude Code、OpenHands 放一起比了比。
8.3K Star 的本地工具,一个命令看清楚你的 Claude、Codex、Cursor 到底烧了多少钱。
不是又一个 AI 编程工具,而是一套让 Agent 自动遵循工程纪律的技能框架。
714 Star 的 Python 工具,把代码库解析成知识图谱再通过 MCP 暴露给 AI Agent。
17K Star 的开源工具,输入一个 GitHub 链接,几秒钟生成完整的项目文档、架构图、数据流图。