Forward Deployed Engineering · 前向部署工程

把 AI 部署到
你的业务现场

我们不卖模型,也不卖工具许可。FDE 工程师进驻你的办公室和车间, 用 4–12 周一个真实业务环节跑通——交付可运行的系统、可复现的评测、 以及一份你自己的工程师接得住的代码库。

2
免费现场诊断,走完产线或坐进业务岗
4–12
单场景从锁定到上线的标准周期
3
一个前哨小组的标准编制,不堆人头
100%
代码、提示词、评测集随交付全部移交
现状

大模型进不了企业,是四件事卡住了

过去两年,多数企业的 AI 项目都停在同一个位置:演示很惊艳,生产很沉默。 这不是模型能力的问题,是交付方式的问题。

ISSUE / 01

POC 过了,生产没过

演示用的 20 条整洁样例,撑不住每天 8000 单的真实数据:错别字、简称、串行的历史脏数据、上游系统半夜改了字段。

ISSUE / 02

有价值的数据都在墙内

关键字段散在 ERP、WMS、企业微信群和几十个部门自己维护的 Excel 里。没有人同时有这几个系统的权限,也没有人被授权去打通。

ISSUE / 03

没有人动流程

模型给出了建议,但审批链、岗位职责和考核口径一个都没改。于是建议被打印出来,压在文件夹底下。

ISSUE / 04

交付方不对结果负责

方案交了、款结了。三个月后上游接口变更、模型版本更新、效果开始漂移,没有人还在现场。

交付方式

四个阶段,每个阶段都有验收口径

FDE 的做法是把工程师放到问题发生的地方,按阶段推进、按里程碑验收。 下面这张表在项目启动第一天就会贴在双方的会议室里。

00

现场诊断

2 天 主任 FDE ×1 免费
做什么
不开需求会。跟着一线岗位坐一天,走一遍产线或仓库,看真实的表和真实的报错。
产出
候选场景清单(按可行性分 A/B/C 级)、一页作战图、明确的"暂时做不了"的部分。
验收
业务负责人能当场指出:这里面哪一个是我今天就痛的。指不出来,我们不进入下一阶段。
01

场景锁定与基线

1–2 周 FDE ×2 客户对口 ×1
做什么
只锁一个场景。量出它今天的样子:人工耗时、返工率、错单率、月度成本。
产出
场景定义书、基线指标、数据可获得性确认(哪张表、谁给权限、什么频率)、书面验收口径。
验收
一份双方签字的基线数字。没有基线就没有"提升 30%",只有感觉。
02

共建交付

4–8 周 FDE ×2–3 每周现场 ≥3 天
做什么
在你的环境里写代码。每周一次可运行版本,业务方直接用,不看 PPT 看屏幕。
产出
可运行系统、评测集与回归脚本、护栏与人工兜底路径、异常回退方案、运行手册。
验收
在真实数据上连续跑满 2 周,达到阶段 01 约定的口径,且出问题时业务能安全退回人工。
03

移交自持

2 周 FDE ×1 客户工程师 ×1–2
做什么
把方向盘交出去。我们在旁边看着你的工程师改一次提示词、跑一次评测、发一次版。
产出
完整代码库与 CI、监控看板、故障处置手册、两场培训(含录像)。
验收
客户工程师独立完成一次从修改到上线的完整迭代,我们全程不碰键盘。
交付物

项目结束时,你手里应该有什么

判断一个 AI 项目是否真的落地,最简单的办法是看结项那天客户拿到了什么。 下面左边是我们交的,右边是我们明确不交的。

随交付移交

  • 完整源码仓库,含 CI 与部署脚本(私有化 / VPC / 完全离网三选一)
  • 全部提示词、工具定义与 Agent 编排配置,无加密、无黑盒模块
  • 评测集与回归测试脚本——换模型时,你自己就能验证还行不行
  • 数据接入说明:接了哪张表、字段口径、清洗规则、更新频率
  • 运行监控看板:调用量、失败率、人工接管率、单次成本
  • 故障处置手册与人工兜底流程
  • 两场面向客户工程师与业务方的培训,含录像

我们不交这些

  • 无法运行的架构图和"整体规划蓝图"
  • 只在演示环境跑通、换真实数据就崩的 Demo
  • 看不到提示词、改不了逻辑的封装黑盒
  • 没有基线数字支撑的"效率提升 300%"
  • 需要长期续费才能维持运行的托管依赖
  • 把 KPI 定义成"上线了几个 AI 场景"
落地场景

我们优先接的是这一类环节

共同点:高频、有明确对错、今天靠人肉硬扛、且上游有可拿到的结构化数据。 场景越窄,跑通得越快。

制造 · 供应链

补货建议单的生成与人工复核

接入
ERP 库存与在途、WMS 出入库、历史销量、门店/经销商反馈
谁在用
商品计划岗,每天早上第一件事
算成功
建议单采纳率、改单幅度、缺货与滞销金额环比
零售 · 品牌

门店巡检与陈列稽核的结构化

接入
巡店照片、督导手写记录、陈列标准手册、门店主数据
谁在用
区域督导与运营中心
算成功
单店巡检报告出具时长、问题项复查闭环率
医疗 · 健康

随访记录与科研数据的整理归集

接入
院内随访文本、检验结构化结果、科室自建数据库(全程院内部署)
谁在用
临床科研秘书、随访护士
算成功
单例整理耗时、字段完整率;不参与任何诊断结论
金融 · 风控

授信材料的要素抽取与交叉核对

接入
企业征信报告、财报 PDF、合同扫描件、工商数据
谁在用
信贷审查岗,作为人工复核的前置
算成功
要素抽取准确率、矛盾项召回率、单件审查耗时
政企 · 公共服务

政策文件比对与办事指南问答

接入
历年政策文本、办事指南、常见问题工单(完全离网部署)
谁在用
窗口人员与 12345 坐席
算成功
引用可溯源率、答非所问率、坐席二次转人工率
通用 · 职能

合同与订单条款的偏差比对

接入
标准合同模板、往来合同、订单主数据
谁在用
法务与商务合规岗
算成功
偏差条款召回率、漏检率(人工抽检对照)
前哨小组

FED 不是顾问,也不是外包程序员

顾问交方案不碰代码,外包接需求不问业务。FDE 的位置在两者中间—— 既要能在客户的生产环境里改代码,也要能坐在会议室里推动流程改动。

工程实现40%
业务理解35%
现场沟通与推动25%

我们的工程师会做三件不像工程师的事

  1. 在业务岗位上跟班一整天,不带电脑,只带本子。
  2. 自己去仓库数一次货,验证系统里的数和地上的货对不对得上。
  3. 把失败案例贴在项目墙上,每周复盘一次,不删。

FDE 组长Lead

对交付结果负责的唯一一个人。手机号给到客户业务负责人,项目期内随时可打。既写代码也参加客户的业务例会。

系统 FDESystems

负责数据与集成:打通 ERP / WMS / MES / OA,处理权限、网络隔离、私有化部署与上线后的可观测。

场景 FDEDomain

负责业务口径与评测:把"做得对不对"翻译成可自动判定的评测集,和业务专家一起标注边界情况。

客户侧对口人Counterpart

由客户指定、我们强制要求的一个角色。没有这个人,项目不启动——因为流程改动只有内部人推得动。

技术底座

模型无关,部署形态由你的合规要求决定

我们不绑定任何一家模型厂商。选型在阶段 01 用你的真实数据跑评测决定, 并且保证换模型时不用重写系统。

模型层

  • 闭源 API Claude / GPT / 通义千问 / 豆包
  • 开源自托管 DeepSeek / Qwen / GLM 系列
  • 专用小模型 抽取、分类、排序等确定性任务
  • 选型依据 你的评测集得分 × 单次成本 × 合规

编排层

  • Agent 编排 多步任务、工具调用、人工审批节点
  • 检索 结构化优先,文档检索带出处引用
  • 工具接入 MCP / REST / 数据库直连 / RPA 兜底
  • 状态与重试 长任务可断点续跑,失败可追溯

质量层

  • 评测集 来自你的真实历史数据,含边界与脏样本
  • 回归 每次改动自动跑分,分数下降不允许上线
  • 护栏 输出格式校验、越界拦截、敏感信息过滤
  • 人工兜底 低置信度自动转人工,全程留痕

部署与运维

  • 三种形态 公有云 / 客户 VPC / 完全离网机房
  • 可观测 调用链、耗时、成本、人工接管率
  • 成本控制 缓存、模型分级路由、按场景设预算上限
  • 安全 数据不出域、日志脱敏、按岗位鉴权
合作与计价

按里程碑付款,验收不过不收尾款

我们把付款节点和验收口径绑死。这样双方在阶段 01 就会认真对待那份基线数字, 而不是留到结项时才开始争论"算不算做成了"。

阶段 00 · 现场诊断
免费

2 天,含差旅自理。产出候选场景清单与可行性分级。诊断完你可以直接拿着清单找别家做。

阶段 01 · 基线确认
30%

双方签字确认场景定义、基线指标与验收口径后支付。此时尚未写一行业务代码。

阶段 02 · 上线运行
40%

系统在真实数据上连续稳定运行 2 周后支付。演示环境跑通不算上线。

阶段 03 · 验收移交
30%

客户工程师独立完成一次迭代发布后支付。移交完成才算项目结束。

如果达不到约定基线:我们不收阶段 03 的尾款,代码库、评测集与全部资料仍然移交给你, 并出具一份书面复盘,写清楚是哪一步判断错了。这条写进合同。
常见问题

客户在第一次会上通常会问这些

我们的数据一条都不能出内网,还能做吗?

能。三种部署形态里有一种是完全离网:模型权重、向量库、应用全部落在你的机房,我们的工程师在你的场地、用你的设备开发,代码通过你的审计流程出入。代价是可选模型的范围会变窄、单次推理成本更高,这些会在阶段 00 就明确告诉你。

我们没有 API,关键数据都在 Excel 和几个老系统里,怎么办?

这是常态,不是例外。阶段 01 的一半时间就用在这件事上:确认每张表由谁维护、能不能定时导出、字段口径是否一致。实在没有接口的,我们用数据库只读账号、定时文件投递或 RPA 兜底,但会明确标注这是临时方案以及它的失效条件。

你们和咨询公司、软件外包的区别到底在哪?

咨询公司交的是判断和方案,通常不进代码库;软件外包接的是写清楚的需求文档,通常不质疑需求本身。FDE 两件事都做:既在你的生产环境里写和改代码,也会在业务口径不合理时把问题摆到会议室里。代价是我们只接窄场景,接不了"整体数字化转型"。

项目结束后,我们养不起一个 AI 团队怎么办?

这正是阶段 03 存在的原因。移交的目标不是"你自己再建一个团队",而是让你现有的 1–2 名工程师能维持系统运行、改提示词、跑评测、发版。如果连这个都没有人,我们会在阶段 00 就建议你先别做,而不是先签合同。

多久能看到实际效果?

阶段 02 的第一周就会有可运行版本给业务方试用,但那时候还不好用。可靠的判断点是阶段 02 的连续运行期——真实数据上跑满 2 周的数字,比任何演示都可信。整体上,从第一次现场诊断到能拿数字汇报,通常是 6–14 周。

一次能做几个场景?

一个。这是我们最硬的一条规矩。同时铺三个场景的项目,我们见过的结局基本都是三个都半途而废。第一个场景跑通、移交、稳定运行一个月之后,再谈第二个。

先约两天,让工程师去现场看一眼

不需要你先写需求文档,也不需要提前准备材料。 发一封邮件,标题里写上你目前最痛的那个业务环节——比如"每天早上排补货单要花 3 小时"—— 我们会在两个工作日内回复,先判断这件事值不值得做。

现场诊断申请fanli@haobangyang.com
发邮件预约 先看交付方式