我做多智能体系统。从 174 行就能读完的 deep-research 团队,到跑在 Temporal 上、有租户隔离和审计的企业级执行内核,我想搞清楚同一件事:让一群模型可靠地协作,到底需要什么样的工程。
我信什么? 模型负责判断,代码负责搬运。安全边界、状态机、可审计性这些东西应该由确定性代码兜底,而不是寄希望于 prompt。
- 🎓 研究生: 北京工业大学(211)· 计算机科学与技术 · 2025.09 – 2028.06
- 🎓 本科: 河南大学(双一流)· 计算机科学与技术 · 2021.09 – 2025.06
- 🧪 方向: LLM Agent 编排、持久化执行、多智能体安全治理
- 💼 实习: 面壁智能(ModelBest / OpenBMB)· Agent 方向 · 2026.08 至今
- 📍 状态: 研二在读
- ⚙️ SwarmCore 正在冲 M5 里程碑(v1 候选基线):Temporal 持久化编排 + PostgreSQL 单一事实源 + OPA/Vault 治理
- 💼 在面壁智能实习,参与 OpenBMB 的 Agent 产品(ChatDev / StaffDeck / PilotDeck)开发
- 🔧 给上游 Agent 框架修 bug、提特性:Hugging Face smolagents、Agno、OpenHands、Strands Agents
- 🔍 审 Agent 框架的核心模块(provider 适配层、streaming 聚合、tool 调用)主动找缺陷,带最小复现报 issue,再自己修
- 📖 维护 nanoteam,把多智能体的最小可用形态写成一本能跑的教科书
| 项目 | 简介 |
|---|---|
| 🐜 nanoteam | 1000 行以内的 deep-research 多智能体团队,Leader–Worker 架构,CI 强制行数上限 |
| 🔨 forge-code | 本地 AI 编程助手:跨会话项目记忆、Skill 自进化、权限沙箱 |
| 🏥 Medical-Agent-Swarm | LangGraph 医疗问答多智能体原型,Orchestrator–Worker + 确定性安全层 |
| ⚙️ SwarmCore | 企业级多租户智能体执行内核:Temporal 持久化编排、PostgreSQL 单一事实源、OPA/Vault 治理 |
- strands-agents/harness-sdk ⭐7k — fix(openai): report max_tokens when a Responses function call is cut off
2026-09-03 - agno-agi/agno ⭐42k — [fix] Resolve Gemini image MIME type instead of hard-coding image/jpeg
2026-09-02
自己审代码发现、带无网络最小复现报出的缺陷(PR 合并后会自动进上一栏):
- strands-agents/harness-sdk ⭐7k — OpenAIResponsesModel 在 function call 被 max_output_tokens 截断时报 tool_use 而非 max_tokens,截断的工具调用被直接执行
2026-09-03· 已被打上bug,修复待认领 - OpenBMB/StaffDeck(实习所在团队的项目)— 报销额度查询对不存在的员工返回"成功"结果
2026-09-02· 修复 #258 已提交
