搜索体系重建:DeepSeek 服务端搜索 + Firecrawl 提取

2026-08-05 ~ 08-06 折腾两天,解决"搜索引擎全被反爬"的痛点的完整方案。 背景 之前用 curl/浏览器直接抓搜索引擎(Google/Bing/DDG/Startpage/Yandex 等),结果全被反爬挡住(CAPTCHA/403/验证页)。需要一个稳定、免反爬、低成本的搜索方案。 方案演进 阶段 1:发现 DeepSeek 支持服务端 web_search DeepSeek 官方 Responses API 支持 web_search 工具——搜索在 DeepSeek 服务器端执行,客户端拿到的就是结构化结果,完全绕开反爬。 关键验证: api.deepseek.com/v1/responses 支持 tools: [{type: web_search}] 事件流有 web_search_call.in_progress / searching / completed 返回结果含 title/url/description 阶段 2:发现 opencode-go 中转也支持 意外收获:opencode-go 的 /zen/go/v1/responses 端点同样支持 web_search 工具——意味着可以用已有的 OPENCODE_GO_API_KEY(和主模型同一账户),不用额外注册 DeepSeek 官方 key。 实测: {"tools": [{"type": "web_search"}]} → output 含 web_search_call(completed),返回真实搜索结果 阶段 3:Firecrawl 负责提取(分工) 社区共识:Firecrawl 擅长网页提取(extract),搜索是弱项(官方也承认"basic search endpoint, not true SERP")。于是分工: web.search_backend: deepseek ← 搜索(服务端,免反爬) web.extract_backend: firecrawl ← 提取(HTML 转 markdown) 最终架构 ┌─────────────────────────────────────────────┐ │ 搜索(web_search) → opencode-go /responses │ │ → DeepSeek 服务端执行 → 结构化结果 │ ├─────────────────────────────────────────────┤ │ 提取(web_extract) → Firecrawl API │ │ → 网页转 markdown(1 credit/页) │ ├─────────────────────────────────────────────┤ │ 兜底 → cn.bing / 搜狗 / curl 直抓 │ └─────────────────────────────────────────────┘ 关键点 搜索和提取解耦:搜索走模型服务商(不烧 Firecrawl 额度),提取走 Firecrawl(免费 1000 credits/月) 服务端搜索免反爬:反爬是客户端直抓的问题,服务端执行彻底绕开 成本极低:搜索按 token 计费(缓存命中 0.02 元/百万),提取 1 credit/页 附:Firecrawl 注册 2026 年 6 月起 Firecrawl 推出 Keyless 模式(免 key 每月 1000 credits),但 Hermes 插件仍需要 key——邮箱注册即可拿到 fc- 开头的 key,免费额度无需绑卡。 ...

2026-08-06 · 1 分钟

DeepSeek API 大幅涨价预告与峰谷定价

2026-08-06,DeepSeek 在开发者后台发布涨价提示,多家媒体(东方财富/新浪财经/界面等)同日报道。 核心信息 DeepSeek 官方宣布:近期将整体上调 API 服务定价,预计涨幅较大,并引入峰谷定价机制。 当前 V4-Flash 价格(涨价前) 单位:元/百万 tokens 计费项 平峰 高峰(工作日 9-12点/14-18点,翻倍) 缓存命中输入 0.02 0.04 缓存未命中输入 1 2 输出 2 4 V4-Pro 当前价:缓存未命中输入 3 元、输出 6 元(高峰翻倍)。 2026 年调价轨迹 时间 事件 4 月 限时折扣 5 月 优惠结束,正式定价调整为原价 1/4(大降价) 6 月底 预告 V4 上线涨价 + 引入峰谷定价 8 月 6 日 预告大幅整体上调 对重度用户的影响分析 以实际用量为例(7 天 4 亿 token,其中 98.6% 是缓存读取): 缓存读 3.99 亿 × 0.02 元/百万 ≈ 8 元(平峰) 输出 76 万 × 2 元/百万 ≈ 1.5 元 输入 447 万 × 1 元/百万 ≈ 4.5 元 周成本约 14 元,月约 50-60 元 关键结论:长会话 + 上下文重发型用量(缓存命中占比极高)恰好是 DeepSeek 定价最友好的场景——即使涨价翻倍,真实成本上升也有限,因为大头是本就便宜的缓存读取。 ...

2026-08-06 · 1 分钟