研究边界截至 2026-08-01,本文研究消费端联网问答及同厂商相邻搜索产品/API。“信源”指 AI 检索、生成和引用使用的信息来源。本文不宣称掌握平台未公开算法。
EXECUTIVE SUMMARY

先看结论:没有“固定权重秘笈”,只有可验证的多阶段策略

01

四平台都未公开消费端完整权重

官方能确认的是候选来源、查询改写、时效、垂类、指定站点和引用展示等环节,不是政府、媒体、官网的固定分数表。

02

豆包最接近“权威治理”的公开表述

但必须分开豆包 App 与火山引擎“豆包搜索”企业产品;后者公开的站点、创作者、行业维度不能直接外推为消费端权重。

03

元宝的来源池分层公开得最清楚

腾讯云 WSA 区分开放网页、权威垂类和腾讯生态。服务档位是能力/价格档位,Score 是相关性,二者都不是信源权威等级。

04

千问公开的是检索编排能力

turbo / max / agent / agent_max 表示检索深度或处理强度,不是来源质量等级。消费端还连接淘宝、飞猪、高德、支付宝等原生任务数据。

05

DeepSeek 公开的信源治理参数最少

官方确认 Web/App 会并行搜索,Responses API 已有服务端 web_search;但未公开站点、行业、时间或权威等级控制。自建搜索工具时,来源责任属于接入方。

06

Web、App 与 API 不能混为一个“渠道结果”

2026 年跨平台大样本研究显示,同平台 Web 与 App 的域名和 URL 集合差异很大;一次问答或一个代理 API 不能反推稳定内部规则。

四渠道最简比较

渠道官方可确认的来源池/处理固定信源等级公开可控项核心边界
豆包公开第三方网页;企业搜索产品还有全网、行业知识、头条/抖音与百余垂类消费端否企业产品可指定信源、关键词和垂类豆包搜索不等于豆包 App 算法
元宝开放网页、腾讯生态、权威垂类;政务/新闻/学术/金融站点、时间、行业、数量、时效档位、引用结果WSA 档位和相关性分都不是权威分
千问夸克/开放网页、指定站点、行业垂类、深读;App 连接阿里原生服务数据搜索强度、强制搜索、站点、时间、行业、查询数、引用检索强度不是信源等级;App 与 API 不等同
DeepSeekWeb/App 公开网页并行检索;Responses API 服务端搜索官方原生控制较少;自定义工具可自行设计模型与搜索提供方是两层
RESEARCH METHOD

信源策略是一条链,不是一个分数

联网触发 查询改写 候选召回 质量过滤 相关/权威/时效排序 正文抽取 交叉验证 答案与引用

公开材料往往只披露链路的一部分。因此需要把四种“分级”分开:

  • 信源可信度分级:政府、机构、企业官网、媒体、社区等来源的可信差异。
  • 来源池分层:开放网页、厂商生态、专业数据库、垂类结果和商业服务数据。
  • 检索强度分级:搜索次数、查询数量、正文深读程度。
  • 商业服务档位:不同价格套餐提供不同结果数、垂类或时效能力。

后两种不能被写成平台内部的信源可信度等级。

本文证据等级

A官方消费端条款、产品说明、API 文档可确认公开能力与责任边界
B同厂商相邻云搜索产品、官方新闻可说明厂商能力,不自动外推消费端
C有样本、时间窗和方法的系统研究只作外部观测,不作算法因果证明
D软文、用户文章、个案截图、无方法“权重揭秘”只作线索,不采纳为事实
限制:平台持续迭代;官方不披露完整候选池、被淘汰页面、特征权重和最终重排。“没有公开”不等于“内部没有”。本文不包含多账号、跨日期黑箱复测。
CROSS-CHANNEL VIEW

跨渠道共同观察

官方材料交叉支持五类信号:查询与页面/段落的相关性;站点、创作者、垂类的权威或质量;时间范围与当前信息的时效性;开放网页、厂商生态和专业数据的来源类型;以及正文能否稳定读取、抽取和引用的证据粒度

被搜索结果召回,不等于被最终答案采用。

候选网页仍可能因为内容不匹配、读取失败、证据过浅、冲突、过时、安全过滤或答案压缩而不出现。2026 年跨平台研究把“来源出现”与“品牌进入答案”分开,总体样本中品牌被答案选择的比例约为 8.3%。跨多来源出现、证据在页面中的语义角色、匹配与新鲜度与进入答案存在更强关联,但因为无法观察完整候选池,不能当作权重公式。

同一研究在 214,119 条原始引用和 160,860 条引用级记录中观察到:新闻约 28.8%、垂直门户 24.1%、社交/UGC 16.4%、企业官网 12.9%、电商 7.6%、百科 5.7%、政府 4.5%。这是特定问题集的外部观测,它说明不同问题会组合不同来源,不是全平台固定占比。

01
DOUBAO

豆包:公开网页 + 字节生态 + 企业端权威治理

官方已确认

《豆包用户服务协议》确认:当用户意图或主动选择搜索时,系统会检索公开的第三方网页,并可展示来源或内容;来源和结果可能不准确,展示不代表平台认可。《豆包算法说明》的公开粒度是:结合输入、上下文、行为与反馈,利用模型知识和全网搜索生成结果;没有公开来源间的固定权重或分数门槛。

企业产品方面,火山引擎 Search Agent支持指定信源、关键词、头条/抖音特色源、图文多模态与百科、新闻等 100+ 垂类优化;联网内容插件曾公开可组合公开网页、头条文章、墨迹天气、抖音百科等来源。“豆包搜索”官方文档入口确认了新产品及 Custom 版;IT之家对发布信息的转述补充了站点、创作者和行业维度的权威治理描述。该细节为可信二手补充,不升级为消费端数值权重。

联网按用户意图或主动选择触发
来源池公开网页;企业产品可组合字节生态、专业数据和垂类
干预企业 Search Agent 支持指定信源和关键词
边界豆包 App 的固定权重、淘汰阈值和最终重排未公开

外部观测与企业含义

跨平台研究的旅游/消费样本中,豆包 App 最大域名占比约 28.6%、HHI 约 0.094,表现出较强抖音生态集中;Web/App 域名 Jaccard 约 0.505,URL Jaccard 约 0.310。这只代表特定时间窗。企业应先在可抓取官网建立主体、产品参数、资质和服务边界,再补足头条/抖音的真实内容形态与行业外证;不采用“豆包固定三级信源”口径。

02
YUANBAO

元宝:开放网页 + 权威垂类 + 腾讯生态

官方已确认

腾讯云联网搜索增强(WSA)把能力追溯到搜狗的收录、召回和排序链,并称元宝在时效和权威类问题中会检索当前新闻、政府网站和政策文件。WSA 产品概述公开:所有档位都基于开放网页,支持站点和时间筛选;标准及以上加入优质权威垂直信源(VR);高级及以上支持指定垂类;旗舰档位增加更强时效能力;并可用腾讯新闻、搜狗百科、企鹅号等生态增强。

WSA API还公开了自然结果、多模态 VR 或混合结果模式,可指定站点、时间、数量和政务/新闻/学术/金融垂类。返回的 Score 被定义为查询相关性 0—1,不是信源权威分。TokenHub 联网搜索显示模型可自主决定是否搜索、使用轻量或标准来源,以及搜索上下文量;这是腾讯云模型服务能力,不等于元宝 App 的最终策略。

来源池开放网页 + 腾讯生态 + 权威垂类 VR
垂类政务、新闻、学术、金融有显式行业入口
排序对外返回查询相关性,未公开综合权威权重
边界未公开元宝 App 的固定权重、淘汰阈值和最终重排公式

外部观测与企业含义

外部研究样本中,元宝更常组合社交媒体和在线旅行平台;App 深层引用比例约 8.0%;Web/App 域名 Jaccard 约 0.299,URL Jaccard 约 0.097。政策、新闻、学术和金融问题应优先进入对应权威垂类,企业官网承担第一方事实,公众号、腾讯新闻、企鹅号更适合补充解释、案例和持续更新。评估时必须分开 App、Web 与 WSA。

03
QWEN

千问:检索编排最丰富,原生服务数据需单独理解

官方已确认

阿里云百炼联网搜索公开了四类检索强度:turbo 平衡速度和效果,max 更全面、多来源,agent 可多次搜索与模型迭代,agent_max 加入正文提取。它还支持搜索意图判断、多查询改写、强制联网、引用返回、指定站点、行业、时间和提示词干预。严格指定站点没有匹配时,部分模式可能回到模型自身知识;“开启联网”不保证每次实际搜索。

通义千问 Web Search Agent宣称会自动过滤权威来源、改写查询、选择垂直工具,并支持域名、时间、结果数、网页深读和多种搜索模式。其“精准优先 + 全域保障”会在指定域无结果时回全网,与严格站点列表不同。阿里云 AI 网关联网搜索说明能力基于夸克,支持金融、法律、医疗、互联网、税务、中央新闻、地方新闻等行业过滤。

消费端另有一层:阿里巴巴集团对千问与淘宝打通的说明确认商品、交易和商家经营数据可直接支持消费任务。这类淘宝、天猫、飞猪、支付宝、高德原生数据不是普通网页抓取。

触发模型判断或强制联网,存在未搜索和限流边界
编排意图识别、多查询改写、多轮搜索、正文深读
来源权威过滤,支持站点、时间、行业垂类
边界检索强度不是信源等级;未公开消费端固定来源权重

外部观测与企业含义

外部研究样本中,千问 App 语义匹配均值约 0.407;约 22,000 条引用覆盖 975 个域名;深层引用比例约 36.8%。Web/App 域名 Jaccard 约 0.190,URL Jaccard 约 0.014,是四平台中入口差异最大的一组。政策、医疗、法律、税务等问题应进入对应官方/专业垂类并确保正文可深读;电商与本地生活还要单独核对商品、门店、交易和服务数据。App、Web、百炼和 AI 网关应分别建基线。

04
DEEPSEEK

DeepSeek:官方原生信源规则公开最少

官方已确认

DeepSeek 在 2024-12-10 的官方联网搜索说明中称:Web/App 面对复杂问题时会抽取多个关键词并行搜索后组合答案。该历史页当时所述“API 不支持联网”已被当前 Responses API 更新,不能继续当作现状。DeepSeek 使用条款确认联网搜索会依据输入或指令检索公开互联网信息,并提醒仍可能不准确、遗漏或过时。

DeepSeek Responses API已支持服务端 web_search / web_search_2025_08_26,但文档明确 search_context_sizeuser_location 当前会被忽略,且未列出指定站点、行业垂类、时间范围、权威等级或来源评分控制。Function Calling 文档则是由开发者实现和执行外部工具;候选源、排序、过滤和引用责任因此落到接入方。

查询复杂问题可拆成多关键词并行搜索
APIResponses API 支持服务端联网搜索
自定义可通过函数工具接入搜索,来源治理由接入方负责
边界未公开消费端信源等级或固定权重公式

外部观测与企业含义

外部研究样本中,DeepSeek Web/App 最大域名占比约 5%、HHI 约 0.01,来源较分散,且样本中政府和企业官网引用较多。Web/App 域名 Jaccard 约 0.507,URL Jaccard 约 0.408,虽是四平台中相对一致的一组,仍不应合并统计。企业应保证官网、政府/机构、专业媒体和垂类来源的事实一致;API 项目要记录搜索提供方、查询、候选 URL、过滤规则、最终引用和模型版本,不能只记“模型 = DeepSeek”。

EMPIRICAL STUDY

四平台外部实证比较

2026-07-17 发布的预印本《What Do Chinese-Language Generative Search Engines Cite and Surface?》覆盖四平台 Web 与 App 共 8 个接口,使用 614 个查询、每题 3 次重复,采集于 2026 年 6—7 月。

指标豆包元宝千问DeepSeek
Web/App 域名 Jaccard0.5050.2990.1900.507
Web/App URL Jaccard0.3100.0970.0140.408
每次回答平均引用数(Web/App)18.5 / 18.113.9 / 13.320.1 / 11.09.2 / 9.2
App 深层引用率22.3%约 8.0%36.8%研究正文另列
主要观察App 字节生态集中较明显社交/OTA 组合较多Web/App 差异最大来源较分散,官方/企业来源较多

这些数字只能帮助理解特定时间窗的渠道差异,不能用于承诺“发到某平台必然被引用”。研究无法看到完整候选池和被拒页面,结果是观察性关联。

BASELINE 2026 年商业研究基于 2,307 个品类问题,同样观察到不同中文 AI 搜索引擎间引用域名重叠很低,并提醒品牌词问题会高估品牌自然可见性。由于它是商业机构研究,本文只用于支持“平台不可合并评估”。

共同支持的判断:一个来源在四平台不会天然同步;同平台 Web/App 也要分开测;单次检出只能说明当时被召回或采用;品牌点名题、自然问题、比较题和事实核验题需要分层。
ENTERPRISE FRAMEWORK

品见建议的企业信源 L0–L4 框架

这是基于公开证据形成的企业治理框架,用于管理内容和验证效果;它不是任何平台披露的内部等级。

L0

原始权威事实

政府、监管、法院、标准组织、论文/数据库原文、企业依法公开原始文件。用作法律状态、政策、许可、标准和研究结论的高风险基线,保留版本、日期和适用范围。

L1

第一方正式事实

企业官网、官方公告、产品文档、官方门店/商品/服务数据。承载主体、产品、参数、服务边界、联系方式和更新日期;使用独立稳定 URL,与 L0 不冲突。

L2

专业与主流交叉证据

主流媒体、权威行业媒体、专业垂直平台、学术/金融/医疗等专业源。承载行业解释、第三方核验、评测和案例,来源需与问题垂类匹配且可回溯原始证据。

L3

平台生态与真实体验

公众号、头条/抖音、企鹅号、商品评论、问答社区和用户内容。承载使用体验、场景问题、口碑和持续更新,必须标明主观性,不得代替资格、参数和政策事实。

L4

低可信或待核来源

采集站、批量软文、无作者/日期、SEO 拼接、无法回溯的转载。不作为关键事实依据,只能隔离、降级或作发现线索,回到 L0–L2 核验。

不同问题的最低来源组合

问题类型最低建议组合
政策、监管、资质、法律L0 原文为主,L1 说明适用情况;至少复核一次日期和适用范围
企业/产品事实L1 为主,L0 或 L2 交叉确认;避免多个官方页面冲突
专业判断、医疗、金融、技术L0/L2 专业证据为主,L1 只说企业自身事实,不以社区口碑代替专业证据
推荐、比较、体验L1 参数 + L2 评测 + L3 真实体验;明确评价维度和时间窗
新闻与动态原始发布者 + 权威新闻来源,记录事件发生时间与网页更新时间
ACTION PLAN

可执行的信源建设与验证策略

  1. 建立事实主表统一企业主体、品牌关系、产品名称、参数、资格、服务范围、发布日期和有效期。
  2. 发布可引用页面一个页面解决一个明确问题,具有稳定 URL、标题、正文证据、更新时间和责任主体。
  3. 补问题匹配的外部证据政府/机构、专业垂类、主流媒体、平台生态按事实类型分工,不做同一软文跨站复制。
  4. 保证技术可读公开访问、服务端可见正文、合理内链、规范标题层级、结构化数据、sitemap、canonical,避免登录墙与脚本空壳。
  5. 维护多源一致官网、商品/门店、公众号、媒体和行业平台的名称、数字、时间与法律主体保持一致。
  6. 按渠道和入口复测豆包、元宝、千问、DeepSeek 分别测 Web/App;云 API 另列,不与真人结果合并。

最低验证矩阵

问题组目的关键记录
自然非品牌题验证自然发现与推荐是否联网、搜索词、候选源、最终引用、品牌是否出现
品牌点名题验证主体事实准确性事实正确率、官网/权威源是否进入、错误来源
对比/推荐题验证多源选择与立场比较维度、来源类型、竞品与本企业证据对称性
最新/高风险事实题验证时效与权威源事件时间、来源更新时间、官方原文、错误兜底

每题至少记录:平台、Web/App/API、账号、地区、时间、模型/模式、是否联网、原始回答、可见检索词、候选 URL、最终引用 URL、页面快照、品牌露出和关键事实正确性。没有这些字段,就不能把波动归因为“信源等级变化”。

四渠道差异化重点

渠道建设重点验证重点
豆包官网事实 + 字节生态真实内容 + 行业权威外证消费端与企业豆包搜索分开;观察生态集中和来源展示
元宝官网事实 + 政务/新闻/学术/金融垂类 + 腾讯生态App、Web、WSA 分开;不把相关性分当权威分
千问官网深读页 + 行业垂类 + 阿里商品/门店/服务数据一致App、Web、百炼、AI 网关分开;确认是否真正触发联网
DeepSeek多源公开网页一致 + 官方/机构/专业来源确认搜索由 DeepSeek 还是第三方提供;记录工具与版本
EVIDENCE HYGIENE

本次不采纳或需要降级的信息

全网存在大量“官方揭秘三级权重”“某平台偏好固定百分比”“EEAT 是核心评分公式”“某媒体能提升数倍采信”类文章。即使发布在厂商开发者社区,也必须核对作者身份、栏目属性和正式 API 字段。

  • 没有官方文档链接,或链接无法支持文中字段/比例。
  • 把作者自定义的 L1–L5 模型写成平台内部机制。
  • 把搜索服务价格档位、检索深度档位或相关性分写成权威等级。
  • 用单个品牌、单次问答或营销案例推导全平台规则。
  • 引用无法查到的报告、市场份额、提升倍数或所谓内部字段。

因此,本文不采纳“豆包固定三级信源”“企业官网固定三级”“某类媒体固定提升 3—4 倍”“AuthInfoLevel 已是消费端公开权重”等说法。

FINAL JUDGEMENT

稳妥策略是多层事实互证,而不是猜测一张内部权重表

四平台的共同方向是:先按意图和时效组织查询,在开放网页、平台生态和专业垂类中召回候选,再综合相关性、权威/质量、可读性、时效与安全过滤,最后由模型选择证据生成答案并展示部分引用。

豆包生态与垂类能力突出,新企业搜索产品开始明确谈权威治理,消费端权重仍不透明。
元宝开放网页、权威垂类和腾讯生态的公开结构最清楚。
千问搜索编排和来源控制最丰富,消费任务还受阿里原生服务数据影响。
DeepSeek官方原生信源规则公开最少,更依赖公开网页一致性和接入方的搜索审计。

对企业而言,应建立原始权威事实、第一方正式事实、专业交叉证据、平台生态体验四层互补的信源资产,并按“渠道 × 入口 × 问题类型 × 时间”持续复测。

SOURCES

主要来源清单

外部补充资料

  1. Tao Zhen 等:What Do Chinese-Language Generative Search Engines Cite and Surface?,预印本,2026-07-17。
  2. BASELINE:Chinese AI Search Engines Barely Share Sources,商业研究,2026-06-15。
  3. IT之家:火山引擎上线豆包搜索服务,2026-07-28;只补充动态页未完整展示的发布信息。

结论可信度速查

结论可信度原因
四平台都未公开消费端固定权重公式官方文档交叉核验,未发现可验证公式
元宝 WSA 有开放网页、权威垂类和行业源分层官方产品与 API 文档明确
千问有多级检索强度、站点/时间/行业控制官方百炼与 AI 网关文档明确
DeepSeek Responses API 支持服务端联网搜索当前官方 API 文档明确,已替代 2024 历史状态
新豆包搜索按站点、创作者、行业做权威治理中高官方产品入口已确认,具体表述来自可信二手转述
某平台对某类网站有固定百分比权重低/不可确认无官方公式或可复现实验支持
Web、App、API 可以合并代表一个渠道低/错误大样本研究显示来源集合与结果显著不同
升级为正式渠道基准前,还需要:
  1. 人工确认正确来源、错误来源和歧义样本,形成金标准。
  2. 用冻结问题集做多账号、跨日期 Web/App 重复测试。
  3. API 或代理结果单独成组,不代替消费端真人结果。
  4. 只发布统计置信足够的观察,不发布不可验证的“内部权重”。
  5. 平台大版本或搜索产品变更后重新校准,不沿用旧快照。