工具软件:FDE 与 AI Agent 工具目录
面向 FDE 与 AI Agent 交付的工具软件目录:框架、评测、编程、检索、部署、MCP、提示词与安全,共 12 个条目。每张工具卡给出一句话定位、在交付现场什么时候用它、开源/商业属性与官方入口。先看 按交付阶段选工具的总览,或直接按分类浏览。
目录
Agent 框架与编排(3)
- 工具档案:Claude Agent SDK——与 Claude Code 同源的 agent 开发套件(Anthropic Engineering:Building agents with the Claude Agent SDK)——Claude Agent SDK 是 Anthropic 官方的 agent 开…
- 工具档案:LangGraph——被国内大厂 JD 点名的多 agent 编排框架(LangGraph 官方页面)——LangGraph 是 LangChain 的有状态多 agent 编排框架,用…
- 工具档案:OpenAI Agents SDK——把 agent 从原型推向生产的官方框架(OpenAI Agents SDK(Python)官方文档)——OpenAI Agents SDK 是 OpenAI 官方的 agent 构建框…
评测与观测(6)
- 工具档案:Arize Phoenix——面向 agent 过程评测的开源可观测工具(r/AI_Agents:主流 LLM 评测平台深度对比(社区讨论))——Arize Phoenix 是开源的 LLM 可观测与评测工具,agent 评测…
- 工具档案:Braintrust——支持自托管的产品化评测平台(Braintrust:2026 自托管 AI 评测工具横评)——Braintrust 是产品化的 LLM 评测与观测平台,覆盖数据集管理、评分器…
- 工具档案:LangSmith——与 LangGraph 绑定最紧的官方评测观测平台(r/AI_Agents:主流 LLM 评测平台深度对比(社区讨论))——LangSmith 是 LangChain 官方的可观测与评测平台,与 Lang…
- 工具档案:Langfuse——开源自托管的 LLM 可观测与评测平台(Langfuse 官方工程资源页(对比 LangSmith))——Langfuse 是开源的 LLM 可观测性与评测平台,提供 tracing、p…
- 工具档案:OpenAI Evals——FDE 交付里的第一块评测底座(OpenAI Evals(GitHub 开源仓库))——OpenAI Evals 是 OpenAI 官方开源的大模型评测框架,用统一的评…
- 工具档案:promptfoo——CLI 优先的 prompt 测试与红队工具(Respan:LangSmith vs promptfoo 对比)——promptfoo 是开源、CLI 优先的 prompt 与 agent 测试工…
模型服务与部署(2)
- 工具档案:Modal——POC 到试点之间的弹性算力平台(Modal 官方站点)——Modal 是 serverless GPU 与容器平台,按需伸缩、秒级起容器,…
- 工具档案:vLLM——私有化交付里的高吞吐推理引擎(vLLM 官方文档)——vLLM 是高吞吐的 LLM 推理服务引擎,也是自托管模型部署的事实标准之一。在…
MCP 生态(1)
- 工具档案:Model Context Protocol(MCP)——FDE 交付的事实标准连接层(Model Context Protocol 官方站点)——Model Context Protocol(MCP)是 Anthropic 发…
其他工具
收录说明
目录以「交付现场用得上」为唯一标准收录:同品类的工具优先收稳定、有社区或商业支持、可私有化或可控的。开源/商业属性以官方口径为准,具体定价请以官方页面为准。发现收录过时或错误,欢迎通过联系我们指出。