开发者 3 秒速决决策指标
Cloudflare 于 2026-10-01 宣布 AI Search GA:托管索引/检索管线(Workers AI + Vectorize + R2 + Browser Run)进入正式可用;新增 Qwen3-VL-Embedding 原生图像嵌入、扫描 PDF OCR、文本/OCR PDF 上限 10 MiB;新实例默认混合检索;计费自 2026-11-01 起,含免费额度。
核心要点速览 (Key Takeaways)
- ✓GA 日 2026-10-01;Changelog + 官博
- ✓多模态:
@cf/qwen/qwen3-vl-embedding-2b与google-ai-studio/gemini-embedding-2;查询可带图(REST/公网端点) - ✓文件:OCR 全账号可用;明文/代码与开启 OCR 的 PDF 上限 10 MiB(未开 OCR PDF 等仍 4 MiB)
- ✓默认混合检索(向量+全文);Workers AI 嵌入/重排费用计入 AI Search,不再单独出现在 Workers AI 账单
- ✓定价锚点(官博):摄入 $0.75/百万 token、存 $2/GB-月、语义 $0.75/千次、全文 $0.10/千次;免费档含 5M 摄入 token、10 GB、各 1k 语义/全文查询;计费 11/1 起
阅读完核心要点?进一步了解模型实力与实际开销
7 大权威镜像天梯跑分与 29+ 款主流编程套餐横向比价测算
相关资源与官方项目出处
免代理直达深度技术解析与实战评估
核心背景与行业痛点
Agent 要查「自家文档 / 产品图 / 扫描 PDF」,往往得自建解析、向量库、重排与计费。Cloudflare 把 Workers AI、Vectorize、R2、Browser Run 收成托管检索产品 AI Search;经一年预览后,于 2026-10-01 官博 宣布 GA,并同步 Changelog。与同周 Web Search API(查公网)互补:AI Search 面向你的数据,不是外网伙伴检索。
架构亮点与底层机制
查询路径(官博):可选改写 → 嵌入(多模态模型可对查询图直接嵌入;纯文本模型则先 ToMarkdown 成说明再搜)→ 向量与关键词并行 → 融合 / 可选重排 → 返回 chunk 或再交给生成模型。新实例默认 hybrid search。多模态嵌入支持 @cf/qwen/qwen3-vl-embedding-2b 与 google-ai-studio/gemini-embedding-2;用 Matryoshka(MRL)压缩维度。创建实例时 type 可省略:HTTP(S) URL 推网站源,桶名推 R2。Workers AI 嵌入/重排费用计入 AI Search,不再出现在 Workers AI 账单或 AI Gateway 日志;生成、查询改写与外部提供商仍走账户/网关。
权威 Benchmark 与实测跑分对比
官博与 Changelog 未公布统一检索质量榜(nDCG/召回)——本稿不编造跑分。可核对产品事实:Limits & pricing 与官博表——摄入 $0.75/百万 token、图像处理附加 +$0.50/百万、存储 $2/GB-月、语义查询 $0.75/千次、全文 $0.10/千次;免费月额度 5M 摄入 token、10 GB、语义/全文各 1000 次;计费自 2026-11-01。文件:OCR 全账号可用;明文/代码与开启 OCR 的 PDF 至 10 MiB(未开 OCR 的 PDF 等仍 4 MiB)。
开发者实战落地与开箱指南
- 读 AI Search docs 与 Get started,建 namespace/instance。
- 选多模态嵌入模型后,用 REST/公网端点在
messages里带image_url做以图搜图/图文混合。 - 扫描 PDF 打开 OCR;大文档对齐 10 MiB 上限。
- 在 11/1 前用免费额度压测语义 vs 全文流量;Workers AI 嵌入账单变化按 Changelog 核对。
- 勿与 Web Search API 混用:前者接地公网,后者索引你的 R2/站点。

讨论与评论
0登录后即可参与深度讨论
与广大 AI 开发者、工程师交流评测心得与前沿洞察