橙宝书
指南

给普通应用按需加入 AI 能力

把推理、模型网关和自然语言搜索当作可替换模块,而不是应用成立的前提。

编辑与核验:橙宝书编辑团队 ·

OPTIONAL AI中级25 分钟产出:是否接入 AI 的决策记录

先让应用在没有模型时成立,再加入真正改善用户任务的 AI 能力。SaaS 的租户管理、CMS 的草稿发布、图片的尺寸转换和 PDF 的生成都不依赖大模型。AI 更适合处理分类、摘要、生成、语义检索等无法用确定性规则经济解决的部分。

本页不是 Agent 教程

Agent、Chat 只是 AI 能力的一种产品形态。本页关注的是普通应用如何安全地调用一个可替换的模型模块,并在模块失败时继续提供核心服务。

先判断是否值得接入

用户任务默认方案何时考虑 AI无 AI 回退
表单校验Schema 与确定性规则不建议用模型替代显示字段错误
内容分类规则、标签或人工选择类别模糊、规模大保存为待分类
文本摘要截取与人工摘要长文、批量、允许近似展示原文与目录
内容搜索关键词与筛选用户用自然语言表达意图保留关键词搜索
文案草稿模板需要多样化初稿使用固定模板

如果 AI 输出会直接扣款、删除数据、变更权限或公开发布,模型只能提出建议,最终动作必须经过确定性校验或人工确认。

三类 Cloudflare 入口

Workers AI

应用直接调用 Cloudflare 托管模型,适合把推理放在 Worker 的受控服务层。

AI Gateway

统一观测、控制和切换模型提供商,适合已有外部模型 API 或需要故障回退的应用。

AI Search

从网站、R2 或上传文档建立托管检索,适合自然语言搜索与带来源的知识体验。

这些入口可以组合,但不应一次全开。先写清楚输入、输出、延迟目标、数据敏感级别和预算,再选择最少的一个。

接入顺序

定义稳定的应用接口

业务代码调用你自己的 classify()summarize()search() 接口,而不是在页面组件里散落模型请求。接口返回结构化结果、来源、模型状态和可识别的错误类型。

缩小输入与输出

在服务端限制文本长度、文件类型和允许字段。检索到的文档与用户输入都视为不可信数据,不允许它们覆盖系统规则或要求泄露 Secret。

加入超时与回退

模型超时或配额不足时,返回可理解状态。搜索回退到关键词,摘要回退到原文预览,分类进入人工队列。核心保存、登录和付款流程不能依赖模型成功。

记录成本与质量

按功能记录调用数、Token 或对应计量、延迟、错误与人工纠正。不要把完整敏感 Prompt 和用户私密内容默认写进日志。

发布门槛

正确性

固定样本包含正常、空输入、超长、对抗文本和下游错误。

安全

Secret 只在服务端;输出经过 Schema 校验;高风险动作不自动执行。

成本

有单请求上限、日预算信号和超额回退,不用免费额度猜长期成本。

可替换

关闭 AI binding 后,应用仍能保存、读取并完成核心任务。

下一步:选择搜索与知识方案

官方来源

这篇内容帮你完成目标了吗?

内测反馈只在当前浏览器生成,不会自动上传。

本页目录