YAO JUN · AI PRODUCT MANAGER · PORTFOLIO 2026

姚军 / AI 产品经理

把 AI 能力翻译成可落地的产品。

多 Agent 系统架构 × AI 工具测评选型 × 0→1 PRD。三个案例分别对应:一套跑了 200+ 天的生产系统、一套可复用的测评方法论、一份完整的产品定义——全部附带可验证的交付物与失败复盘。

安徽财经大学 数字经济硕士 · github.com/683280yj · 本页 work.idkyjun.me

Selected Cases

三个案例,三种能力证明

系统设计 → 评测方法论 → 0→1 产品定义。每份文档都写明了「哪里做错了」。

CASE-001 · System Design

OpenClaw「六部制」多 Agent 系统

个人 AI 助理的多 Agent 架构:参照三省六部制做职责分工,决策与执行分离,模型按任务价值分层。

  • 11 个常驻 Agent,7×24 生产运行
  • 三级模型 fallback,决策链路才用旗舰模型
  • 含 4 段失败复盘(token 轮换 / linger / 成本)
阅读设计文档 →
CASE-002 · Evaluation

AI 编程工具四维测评框架

用五个真实工作任务横向实测主流 AI 编程工具,沉淀出可复用的选型框架,而非厂商参数对比。

  • 四维模型:任务适配 × 上下文 × 成本 × 可控性
  • E1–E5 全部为本人真实生产任务
  • 输出工具画像与场景匹配结论
阅读测评报告 →
CASE-003 · 0→1 PRD

研桌 ResearchDesk

自然语言驱动的实证研究工作台:从自身科研痛点出发,完成问题定义到指标体系的完整产品定义。

  • 非目标清单 + 三类 Persona + P0/P1/P2
  • 信任架构:防「静默统计错误」为成败点
  • 北极星指标:数据到手 → 首张可信回归表 ≤10min
阅读 PRD v0.1 →
CASE-001 架构一览
接入层微信 / 终端入口,统一路由与鉴权
决策 · 三省中书规划 → 门下审核 → 尚书调度
执行 · 六部吏 · 户 · 礼 · 兵 · 刑 · 工,并行分派,各管一摊
模型 · 三级旗舰只留给决策与重推理,其余轻量模型承接,故障自动降级
Real Deployments

真实部署清单

产品判断最终要落到能跑的服务上。以下均部署在我自己的域名与算力上,处于日常使用状态。

图床ImageVault · im.idky.tech —— 基于开源内核自建,上传 / 管理 / 外链一体;另 fork CloudFlare-ImgBed 作为纯 CF 备选
域名邮箱cloudflare_temp_email · mail.idky.tech —— Workers + D1 全免费额度,注册验证码与主邮箱隔离
文献阅读Paper Burner X · burner-x-teal.vercel.app —— 自部署开源 AI 文献工作站:多引擎 OCR、多模型翻译、Agentic RAG 对照阅读
研究工具stata-mcp —— 深度使用并定制扩展的开源 MCP(AI ↔ Stata),跑通论文实证全流程,CASE-003 的技术底座
知识库Quartz 数字花园 —— 基于 Quartz v5 搭建的大学知识库站点,笔记发布为可检索双链网站
AI 网关ai-relay · github.com/683280yj/ai-relay —— serverless AI API 网关(Vercel),多供应商中转,多 Agent 系统三级 fallback 的最后一环
Capabilities

能力清单

只列能在上方案例与部署中找到证据的条目。

产品设计竞品分析0→1 定义 PRD / 优先级多 Agent 架构MCP 工具链 模型选型与成本AI 工具测评提示工程 计量实证 / StataPythonLinux / VPS CF Workers / PagesVercel