指南
给普通应用按需加入 AI 能力
把推理、模型网关和自然语言搜索当作可替换模块,而不是应用成立的前提。
编辑与核验:橙宝书编辑团队 ·
OPTIONAL AI中级25 分钟产出:是否接入 AI 的决策记录
先让应用在没有模型时成立,再加入真正改善用户任务的 AI 能力。SaaS 的租户管理、CMS 的草稿发布、图片的尺寸转换和 PDF 的生成都不依赖大模型。AI 更适合处理分类、摘要、生成、语义检索等无法用确定性规则经济解决的部分。
本页不是 Agent 教程
Agent、Chat 只是 AI 能力的一种产品形态。本页关注的是普通应用如何安全地调用一个可替换的模型模块,并在模块失败时继续提供核心服务。
先判断是否值得接入
| 用户任务 | 默认方案 | 何时考虑 AI | 无 AI 回退 |
|---|---|---|---|
| 表单校验 | Schema 与确定性规则 | 不建议用模型替代 | 显示字段错误 |
| 内容分类 | 规则、标签或人工选择 | 类别模糊、规模大 | 保存为待分类 |
| 文本摘要 | 截取与人工摘要 | 长文、批量、允许近似 | 展示原文与目录 |
| 内容搜索 | 关键词与筛选 | 用户用自然语言表达意图 | 保留关键词搜索 |
| 文案草稿 | 模板 | 需要多样化初稿 | 使用固定模板 |
如果 AI 输出会直接扣款、删除数据、变更权限或公开发布,模型只能提出建议,最终动作必须经过确定性校验或人工确认。
三类 Cloudflare 入口
Workers AI
应用直接调用 Cloudflare 托管模型,适合把推理放在 Worker 的受控服务层。
AI Gateway
统一观测、控制和切换模型提供商,适合已有外部模型 API 或需要故障回退的应用。
AI Search
从网站、R2 或上传文档建立托管检索,适合自然语言搜索与带来源的知识体验。
这些入口可以组合,但不应一次全开。先写清楚输入、输出、延迟目标、数据敏感级别和预算,再选择最少的一个。
接入顺序
定义稳定的应用接口
业务代码调用你自己的 classify()、summarize() 或 search() 接口,而不是在页面组件里散落模型请求。接口返回结构化结果、来源、模型状态和可识别的错误类型。
缩小输入与输出
在服务端限制文本长度、文件类型和允许字段。检索到的文档与用户输入都视为不可信数据,不允许它们覆盖系统规则或要求泄露 Secret。
加入超时与回退
模型超时或配额不足时,返回可理解状态。搜索回退到关键词,摘要回退到原文预览,分类进入人工队列。核心保存、登录和付款流程不能依赖模型成功。
记录成本与质量
按功能记录调用数、Token 或对应计量、延迟、错误与人工纠正。不要把完整敏感 Prompt 和用户私密内容默认写进日志。
发布门槛
正确性
固定样本包含正常、空输入、超长、对抗文本和下游错误。
安全
Secret 只在服务端;输出经过 Schema 校验;高风险动作不自动执行。
成本
有单请求上限、日预算信号和超额回退,不用免费额度猜长期成本。
可替换
关闭 AI binding 后,应用仍能保存、读取并完成核心任务。
下一步:选择搜索与知识方案。
官方来源
这篇内容帮你完成目标了吗?
内测反馈只在当前浏览器生成,不会自动上传。