FDE中国 · 从业者与关注者的专业知识、实践与行业资料
新手指南
关于
版权说明
FDE
FDE
中国
FDECHINA.ORG
⌕
首页
FDE 观察
阅读路径
企业落地
交付实战
职业发展
生态资源
全部内容
联系我们
工具软件
全部栏目
首页
FDE 观察
阅读路径
企业落地
交付实战
职业发展
生态资源
全部内容
联系我们
工具软件
联系我们
文章
按时间排序
文章
Delivery Excellence:把好交付变成组织能力
Delivery excellence 指把高质量交付从个人能力变成组织能力的体系:标准流程、资产复用、质量门禁与持续复盘。本文讲三条判断标准、把它等同加班文化的误用,以及复盘驱动的运营闭环,读完即可盘点团队最近的资产复用率。
自有原创
·
FDE中国
·
2026-07-20
文章
Utilization Target:目标利用率的定价与代价
Utilization target 指公司为交付人员设定的目标利用率(计费工时占总工时的比例),是交付组织最核心的经营杠杆之一。本文讲目标定多高的权衡、层层下压导致数据失真的误用,以及与待工时间的关系。
自有原创
·
FDE中国
·
2026-07-20
文章
验收标准:Acceptance Criteria
验收标准(Acceptance Criteria)是交付物被客户接受所需满足的可验证条件集合,通常写入工作说明书或验收文档。本卡重点讲 AI 项目验收的特殊结构:功能验收之外必须约定效果指标、评测集归属与争议仲裁方式,并警示只写功能清单不写效果指标这一最常见的合同缺陷。
自有原创
·
FDE中国
·
2026-07-20
文章
监督微调:SFT(Supervised Fine-tuning)
一张术语卡讲清监督微调的定义与操作要点:用输入输出示范数据对训练模型执行任务的能力。卡片强调数据质量与配比决定成败,辨析它与 RLHF、蒸馏的分工,并给出 FDE 评估客户是否具备微调数据条件的清单。文章给出数据、专家、算力三条件评估法。
自有原创
·
FDE中国
·
2026-07-20
文章
FDE:AI 行业最热门的岗位
Forward Deployed Engineer(FDE,前置部署工程师)正成为 AI 行业最热门的岗位:OpenAI 以超过 40 亿美元组建部署公司,Google Cloud 一周内放出 59 个 FDE 职位并计划招数百人,Anthropic 把 FDE 驻场嵌进 FIS 共建反洗钱 Agent,ServiceNow 与埃森哲也启动了联合 FDE 项目。本文梳理这个角色究竟做什么、为什么在十天之内走向主流,以及一条可操作的转型训练路径:AI 工程栈、真实工作流、客户侧判断力。
自有原创
·
FDE中国
·
2026-05-16
文章
多智能体到底什么在起作用:Cognition 的立场更新
Cognition 的多智能体立场更新:十个月前主张「别建多智能体」之后,作者基于 Devin 与 Windsurf 的生产实践给出修订版结论——并行写者蜂群依然不可靠,真正奏效的是写入单线程、其他 Agent 贡献智能的模式。文章拆解了不共享上下文的代码评审循环、跨模型「聪明朋友」路由与经理式委托三个已验证实验及其失败教训。
自有原创
·
FDE中国
·
2026-04-22
文章
托管 Agent 的规模化:大脑与双手解耦
harness 中编码的「模型做不到什么」的假设会随模型进步而过时。Anthropic 的托管 Agent 服务围绕一组稳定接口构建:把大脑(模型与 harness)、双手(沙箱与工具)与会话日志彼此解耦,使各组件可独立故障与替换。这一架构让 p50 首 token 延迟下降约 60%、p95 下降超过 90%,并支持多大脑多双手的规模化扩展。
自有原创
·
FDE中国
·
2026-04-08
文章
Agent 评测准备度清单:上线前该回答的所有问题
LangChain 官方的 Agent 评测实操清单:从人工审读真实轨迹、定义无歧义成功标准,到单步/整轮/多轮三层评测层级、数据集构建、评分器设计与校准,再到离线/在线/临时评测、CI/CD 质量门禁与生产反馈飞轮。全篇以「先拿信号再上复杂度」为主线,逐项拆解上线前该回答的每一个问题,并给出常见陷阱的规避方法。
自有原创
·
FDE中国
·
2026-03-27
文章
我们如何为 Deep Agents 构建评测:正确性、步数与 CI 集成
最好的 Agent 评测,直接度量你在乎的那个行为。LangChain 团队开源了为 Deep Agents 构建评测的完整方法:数据从哪来(自用吃狗粮、外部基准改造、手工定制)、如何给评测写 docstring 并打标签分组、如何用理想轨迹定义步数比、工具调用比、延迟比与求解率等指标,以及如何用 pytest 加 GitHub Actions 把评测跑进 CI。核心提醒:评测越多不等于 Agent 越好,有针对性的评测才省成本、有信号。
自有原创
·
FDE中国
·
2026-03-26
文章
长周期开发任务的 Harness 设计:让 Agent 跑真实项目
Anthropic 工程师复盘长周期自主编程任务的 harness 设计:借 GAN 思路用生成器-评估器对抗结构让主观质量可评分,用规划器、冲刺契约与 Playwright 真机走查支撑数小时无人值守的全栈应用构建,并示范随模型进步逐件拆除脚手架的方法论。
自有原创
·
FDE中国
·
2026-03-24
文章分页
上一页
1
…
23
24
25
26
下一页