FDE中国 · 从业者与关注者的专业知识、实践与行业资料 新手指南关于版权说明
主题归档

工具

按频道与主题浏览 FDEChina 的全部内容。

16
共 16 篇按时间排序
内容

工具档案:OpenAI Evals——FDE 交付里的第一块评测底座

OpenAI Evals 是 OpenAI 官方开源的大模型评测框架,用统一的评估器与注... 编辑说这张卡解决的是「评测方法论看了很多,落地第一步用什么」的问题。 工具软件· 内容 ·OpenAI Evals(GitHub 开源仓库) ·2026-08-18
内容

向量数据库:Vector Database

一张术语卡讲清向量数据库的定位与选型误区:以向量嵌入为数据形态、支持相似度检索的专用数据... FDE 观察· 内容 ·来源见原文 ·2026-08-17
内容

工具档案:OpenAI Agents SDK——把 agent 从原型推向生产的官方框架

OpenAI Agents SDK 是 OpenAI 官方的 agent 构建框架,内置... 编辑说这张卡想讲清一件事:选 agent 框架首先是在选「生态锚点」。 工具软件· 内容 ·OpenAI Agents SDK(Python)官方文档 ·2026-08-16
内容

工具档案:vLLM——私有化交付里的高吞吐推理引擎

vLLM 是高吞吐的 LLM 推理服务引擎,也是自托管模型部署的事实标准之一。在 For... 编辑说这张卡面向的是国内 FDE 最常见、也最容易被低估的场景:私有化部署。 工具软件· 内容 ·vLLM 官方文档 ·2026-08-15
内容

工具档案:Model Context Protocol(MCP)——FDE 交付的事实标准连接层

Model Context Protocol(MCP)是 Anthropic 发起的工具... 编辑说这张卡回答「agent 怎么接客户系统」。 工具软件· 内容 ·Model Context Protocol 官方站点 ·2026-08-13
内容

调用链追踪:Trace

一张术语卡讲清调用链追踪的定义与智能体扩展:把一次请求经过的全部环节串成一条可回放的链。... 交付实战· 内容 ·来源见原文 ·2026-08-08
内容

工具档案:promptfoo——CLI 优先的 prompt 测试与红队工具

promptfoo 是开源、CLI 优先的 prompt 与 agent 测试工具,并内... 编辑说这张卡回答「轻量级评测用什么」。 工具软件· 内容 ·Respan:LangSmith vs promptfoo 对比 ·2026-08-06
内容

工具档案:Arize Phoenix——面向 agent 过程评测的开源可观测工具

Arize Phoenix 是开源的 LLM 可观测与评测工具,agent 评测能力突出... 编辑说这张卡的定位词是「过程评测」。 工具软件· 内容 ·r/AI_Agents:主流 LLM 评测平台深度对比(社区讨论) ·2026-08-04
内容

工具档案:Langfuse——开源自托管的 LLM 可观测与评测平台

Langfuse 是开源的 LLM 可观测性与评测平台,提供 tracing、promp... 编辑说这张卡解决「私有化交付里可观测层怎么选」。 工具软件· 内容 ·Langfuse 官方工程资源页(对比 LangSmith) ·2026-08-04
内容

工具档案:LangSmith——与 LangGraph 绑定最紧的官方评测观测平台

LangSmith 是 LangChain 官方的可观测与评测平台,与 LangGrap... 编辑说这张卡解决「用了 LangGraph 之后评测观测接什么」。 工具软件· 内容 ·r/AI_Agents:主流 LLM 评测平台深度对比(社区讨论) ·2026-07-31
内容

工具档案:Braintrust——支持自托管的产品化评测平台

Braintrust 是产品化的 LLM 评测与观测平台,覆盖数据集管理、评分器、实验对... 编辑说这张卡解决「客户把评测写进验收标准后怎么办」。 工具软件· 内容 ·Braintrust:2026 自托管 AI 评测工具横评 ·2026-07-30
内容

工具档案:Claude Agent SDK——与 Claude Code 同源的 agent 开发套件

Claude Agent SDK 是 Anthropic 官方的 agent 开发套件,... 编辑说这张卡的信号是「agent 能力从聊天走向执行」。 工具软件· 内容 ·Anthropic Engineering:Building agents with the Claude Agent SDK ·2026-07-29