先看结论:没有“固定权重秘笈”,只有可验证的多阶段策略
四平台都未公开消费端完整权重
官方能确认的是候选来源、查询改写、时效、垂类、指定站点和引用展示等环节,不是政府、媒体、官网的固定分数表。
豆包最接近“权威治理”的公开表述
但必须分开豆包 App 与火山引擎“豆包搜索”企业产品;后者公开的站点、创作者、行业维度不能直接外推为消费端权重。
元宝的来源池分层公开得最清楚
腾讯云 WSA 区分开放网页、权威垂类和腾讯生态。服务档位是能力/价格档位,Score 是相关性,二者都不是信源权威等级。
千问公开的是检索编排能力
turbo / max / agent / agent_max 表示检索深度或处理强度,不是来源质量等级。消费端还连接淘宝、飞猪、高德、支付宝等原生任务数据。
DeepSeek 公开的信源治理参数最少
官方确认 Web/App 会并行搜索,Responses API 已有服务端 web_search;但未公开站点、行业、时间或权威等级控制。自建搜索工具时,来源责任属于接入方。
Web、App 与 API 不能混为一个“渠道结果”
2026 年跨平台大样本研究显示,同平台 Web 与 App 的域名和 URL 集合差异很大;一次问答或一个代理 API 不能反推稳定内部规则。
四渠道最简比较
| 渠道 | 官方可确认的来源池/处理 | 固定信源等级 | 公开可控项 | 核心边界 |
|---|---|---|---|---|
| 豆包 | 公开第三方网页;企业搜索产品还有全网、行业知识、头条/抖音与百余垂类 | 消费端否 | 企业产品可指定信源、关键词和垂类 | 豆包搜索不等于豆包 App 算法 |
| 元宝 | 开放网页、腾讯生态、权威垂类;政务/新闻/学术/金融 | 否 | 站点、时间、行业、数量、时效档位、引用结果 | WSA 档位和相关性分都不是权威分 |
| 千问 | 夸克/开放网页、指定站点、行业垂类、深读;App 连接阿里原生服务数据 | 否 | 搜索强度、强制搜索、站点、时间、行业、查询数、引用 | 检索强度不是信源等级;App 与 API 不等同 |
| DeepSeek | Web/App 公开网页并行检索;Responses API 服务端搜索 | 否 | 官方原生控制较少;自定义工具可自行设计 | 模型与搜索提供方是两层 |
信源策略是一条链,不是一个分数
公开材料往往只披露链路的一部分。因此需要把四种“分级”分开:
- 信源可信度分级:政府、机构、企业官网、媒体、社区等来源的可信差异。
- 来源池分层:开放网页、厂商生态、专业数据库、垂类结果和商业服务数据。
- 检索强度分级:搜索次数、查询数量、正文深读程度。
- 商业服务档位:不同价格套餐提供不同结果数、垂类或时效能力。
后两种不能被写成平台内部的信源可信度等级。
本文证据等级
跨渠道共同观察
官方材料交叉支持五类信号:查询与页面/段落的相关性;站点、创作者、垂类的权威或质量;时间范围与当前信息的时效性;开放网页、厂商生态和专业数据的来源类型;以及正文能否稳定读取、抽取和引用的证据粒度。
被搜索结果召回,不等于被最终答案采用。
候选网页仍可能因为内容不匹配、读取失败、证据过浅、冲突、过时、安全过滤或答案压缩而不出现。2026 年跨平台研究把“来源出现”与“品牌进入答案”分开,总体样本中品牌被答案选择的比例约为 8.3%。跨多来源出现、证据在页面中的语义角色、匹配与新鲜度与进入答案存在更强关联,但因为无法观察完整候选池,不能当作权重公式。
同一研究在 214,119 条原始引用和 160,860 条引用级记录中观察到:新闻约 28.8%、垂直门户 24.1%、社交/UGC 16.4%、企业官网 12.9%、电商 7.6%、百科 5.7%、政府 4.5%。这是特定问题集的外部观测,它说明不同问题会组合不同来源,不是全平台固定占比。
豆包:公开网页 + 字节生态 + 企业端权威治理
官方已确认
《豆包用户服务协议》确认:当用户意图或主动选择搜索时,系统会检索公开的第三方网页,并可展示来源或内容;来源和结果可能不准确,展示不代表平台认可。《豆包算法说明》的公开粒度是:结合输入、上下文、行为与反馈,利用模型知识和全网搜索生成结果;没有公开来源间的固定权重或分数门槛。
企业产品方面,火山引擎 Search Agent支持指定信源、关键词、头条/抖音特色源、图文多模态与百科、新闻等 100+ 垂类优化;联网内容插件曾公开可组合公开网页、头条文章、墨迹天气、抖音百科等来源。“豆包搜索”官方文档入口确认了新产品及 Custom 版;IT之家对发布信息的转述补充了站点、创作者和行业维度的权威治理描述。该细节为可信二手补充,不升级为消费端数值权重。
外部观测与企业含义
跨平台研究的旅游/消费样本中,豆包 App 最大域名占比约 28.6%、HHI 约 0.094,表现出较强抖音生态集中;Web/App 域名 Jaccard 约 0.505,URL Jaccard 约 0.310。这只代表特定时间窗。企业应先在可抓取官网建立主体、产品参数、资质和服务边界,再补足头条/抖音的真实内容形态与行业外证;不采用“豆包固定三级信源”口径。
元宝:开放网页 + 权威垂类 + 腾讯生态
官方已确认
腾讯云联网搜索增强(WSA)把能力追溯到搜狗的收录、召回和排序链,并称元宝在时效和权威类问题中会检索当前新闻、政府网站和政策文件。WSA 产品概述公开:所有档位都基于开放网页,支持站点和时间筛选;标准及以上加入优质权威垂直信源(VR);高级及以上支持指定垂类;旗舰档位增加更强时效能力;并可用腾讯新闻、搜狗百科、企鹅号等生态增强。
WSA API还公开了自然结果、多模态 VR 或混合结果模式,可指定站点、时间、数量和政务/新闻/学术/金融垂类。返回的 Score 被定义为查询相关性 0—1,不是信源权威分。TokenHub 联网搜索显示模型可自主决定是否搜索、使用轻量或标准来源,以及搜索上下文量;这是腾讯云模型服务能力,不等于元宝 App 的最终策略。
外部观测与企业含义
外部研究样本中,元宝更常组合社交媒体和在线旅行平台;App 深层引用比例约 8.0%;Web/App 域名 Jaccard 约 0.299,URL Jaccard 约 0.097。政策、新闻、学术和金融问题应优先进入对应权威垂类,企业官网承担第一方事实,公众号、腾讯新闻、企鹅号更适合补充解释、案例和持续更新。评估时必须分开 App、Web 与 WSA。
千问:检索编排最丰富,原生服务数据需单独理解
官方已确认
阿里云百炼联网搜索公开了四类检索强度:turbo 平衡速度和效果,max 更全面、多来源,agent 可多次搜索与模型迭代,agent_max 加入正文提取。它还支持搜索意图判断、多查询改写、强制联网、引用返回、指定站点、行业、时间和提示词干预。严格指定站点没有匹配时,部分模式可能回到模型自身知识;“开启联网”不保证每次实际搜索。
通义千问 Web Search Agent宣称会自动过滤权威来源、改写查询、选择垂直工具,并支持域名、时间、结果数、网页深读和多种搜索模式。其“精准优先 + 全域保障”会在指定域无结果时回全网,与严格站点列表不同。阿里云 AI 网关联网搜索说明能力基于夸克,支持金融、法律、医疗、互联网、税务、中央新闻、地方新闻等行业过滤。
消费端另有一层:阿里巴巴集团对千问与淘宝打通的说明确认商品、交易和商家经营数据可直接支持消费任务。这类淘宝、天猫、飞猪、支付宝、高德原生数据不是普通网页抓取。
外部观测与企业含义
外部研究样本中,千问 App 语义匹配均值约 0.407;约 22,000 条引用覆盖 975 个域名;深层引用比例约 36.8%。Web/App 域名 Jaccard 约 0.190,URL Jaccard 约 0.014,是四平台中入口差异最大的一组。政策、医疗、法律、税务等问题应进入对应官方/专业垂类并确保正文可深读;电商与本地生活还要单独核对商品、门店、交易和服务数据。App、Web、百炼和 AI 网关应分别建基线。
DeepSeek:官方原生信源规则公开最少
官方已确认
DeepSeek 在 2024-12-10 的官方联网搜索说明中称:Web/App 面对复杂问题时会抽取多个关键词并行搜索后组合答案。该历史页当时所述“API 不支持联网”已被当前 Responses API 更新,不能继续当作现状。DeepSeek 使用条款确认联网搜索会依据输入或指令检索公开互联网信息,并提醒仍可能不准确、遗漏或过时。
DeepSeek Responses API已支持服务端 web_search / web_search_2025_08_26,但文档明确 search_context_size 和 user_location 当前会被忽略,且未列出指定站点、行业垂类、时间范围、权威等级或来源评分控制。Function Calling 文档则是由开发者实现和执行外部工具;候选源、排序、过滤和引用责任因此落到接入方。
外部观测与企业含义
外部研究样本中,DeepSeek Web/App 最大域名占比约 5%、HHI 约 0.01,来源较分散,且样本中政府和企业官网引用较多。Web/App 域名 Jaccard 约 0.507,URL Jaccard 约 0.408,虽是四平台中相对一致的一组,仍不应合并统计。企业应保证官网、政府/机构、专业媒体和垂类来源的事实一致;API 项目要记录搜索提供方、查询、候选 URL、过滤规则、最终引用和模型版本,不能只记“模型 = DeepSeek”。
四平台外部实证比较
2026-07-17 发布的预印本《What Do Chinese-Language Generative Search Engines Cite and Surface?》覆盖四平台 Web 与 App 共 8 个接口,使用 614 个查询、每题 3 次重复,采集于 2026 年 6—7 月。
| 指标 | 豆包 | 元宝 | 千问 | DeepSeek |
|---|---|---|---|---|
| Web/App 域名 Jaccard | 0.505 | 0.299 | 0.190 | 0.507 |
| Web/App URL Jaccard | 0.310 | 0.097 | 0.014 | 0.408 |
| 每次回答平均引用数(Web/App) | 18.5 / 18.1 | 13.9 / 13.3 | 20.1 / 11.0 | 9.2 / 9.2 |
| App 深层引用率 | 22.3% | 约 8.0% | 36.8% | 研究正文另列 |
| 主要观察 | App 字节生态集中较明显 | 社交/OTA 组合较多 | Web/App 差异最大 | 来源较分散,官方/企业来源较多 |
这些数字只能帮助理解特定时间窗的渠道差异,不能用于承诺“发到某平台必然被引用”。研究无法看到完整候选池和被拒页面,结果是观察性关联。
BASELINE 2026 年商业研究基于 2,307 个品类问题,同样观察到不同中文 AI 搜索引擎间引用域名重叠很低,并提醒品牌词问题会高估品牌自然可见性。由于它是商业机构研究,本文只用于支持“平台不可合并评估”。
品见建议的企业信源 L0–L4 框架
这是基于公开证据形成的企业治理框架,用于管理内容和验证效果;它不是任何平台披露的内部等级。
原始权威事实
政府、监管、法院、标准组织、论文/数据库原文、企业依法公开原始文件。用作法律状态、政策、许可、标准和研究结论的高风险基线,保留版本、日期和适用范围。
第一方正式事实
企业官网、官方公告、产品文档、官方门店/商品/服务数据。承载主体、产品、参数、服务边界、联系方式和更新日期;使用独立稳定 URL,与 L0 不冲突。
专业与主流交叉证据
主流媒体、权威行业媒体、专业垂直平台、学术/金融/医疗等专业源。承载行业解释、第三方核验、评测和案例,来源需与问题垂类匹配且可回溯原始证据。
平台生态与真实体验
公众号、头条/抖音、企鹅号、商品评论、问答社区和用户内容。承载使用体验、场景问题、口碑和持续更新,必须标明主观性,不得代替资格、参数和政策事实。
低可信或待核来源
采集站、批量软文、无作者/日期、SEO 拼接、无法回溯的转载。不作为关键事实依据,只能隔离、降级或作发现线索,回到 L0–L2 核验。
不同问题的最低来源组合
| 问题类型 | 最低建议组合 |
|---|---|
| 政策、监管、资质、法律 | L0 原文为主,L1 说明适用情况;至少复核一次日期和适用范围 |
| 企业/产品事实 | L1 为主,L0 或 L2 交叉确认;避免多个官方页面冲突 |
| 专业判断、医疗、金融、技术 | L0/L2 专业证据为主,L1 只说企业自身事实,不以社区口碑代替专业证据 |
| 推荐、比较、体验 | L1 参数 + L2 评测 + L3 真实体验;明确评价维度和时间窗 |
| 新闻与动态 | 原始发布者 + 权威新闻来源,记录事件发生时间与网页更新时间 |
可执行的信源建设与验证策略
- 建立事实主表统一企业主体、品牌关系、产品名称、参数、资格、服务范围、发布日期和有效期。
- 发布可引用页面一个页面解决一个明确问题,具有稳定 URL、标题、正文证据、更新时间和责任主体。
- 补问题匹配的外部证据政府/机构、专业垂类、主流媒体、平台生态按事实类型分工,不做同一软文跨站复制。
- 保证技术可读公开访问、服务端可见正文、合理内链、规范标题层级、结构化数据、sitemap、canonical,避免登录墙与脚本空壳。
- 维护多源一致官网、商品/门店、公众号、媒体和行业平台的名称、数字、时间与法律主体保持一致。
- 按渠道和入口复测豆包、元宝、千问、DeepSeek 分别测 Web/App;云 API 另列,不与真人结果合并。
最低验证矩阵
| 问题组 | 目的 | 关键记录 |
|---|---|---|
| 自然非品牌题 | 验证自然发现与推荐 | 是否联网、搜索词、候选源、最终引用、品牌是否出现 |
| 品牌点名题 | 验证主体事实准确性 | 事实正确率、官网/权威源是否进入、错误来源 |
| 对比/推荐题 | 验证多源选择与立场 | 比较维度、来源类型、竞品与本企业证据对称性 |
| 最新/高风险事实题 | 验证时效与权威源 | 事件时间、来源更新时间、官方原文、错误兜底 |
每题至少记录:平台、Web/App/API、账号、地区、时间、模型/模式、是否联网、原始回答、可见检索词、候选 URL、最终引用 URL、页面快照、品牌露出和关键事实正确性。没有这些字段,就不能把波动归因为“信源等级变化”。
四渠道差异化重点
| 渠道 | 建设重点 | 验证重点 |
|---|---|---|
| 豆包 | 官网事实 + 字节生态真实内容 + 行业权威外证 | 消费端与企业豆包搜索分开;观察生态集中和来源展示 |
| 元宝 | 官网事实 + 政务/新闻/学术/金融垂类 + 腾讯生态 | App、Web、WSA 分开;不把相关性分当权威分 |
| 千问 | 官网深读页 + 行业垂类 + 阿里商品/门店/服务数据一致 | App、Web、百炼、AI 网关分开;确认是否真正触发联网 |
| DeepSeek | 多源公开网页一致 + 官方/机构/专业来源 | 确认搜索由 DeepSeek 还是第三方提供;记录工具与版本 |
本次不采纳或需要降级的信息
全网存在大量“官方揭秘三级权重”“某平台偏好固定百分比”“EEAT 是核心评分公式”“某媒体能提升数倍采信”类文章。即使发布在厂商开发者社区,也必须核对作者身份、栏目属性和正式 API 字段。
- 没有官方文档链接,或链接无法支持文中字段/比例。
- 把作者自定义的 L1–L5 模型写成平台内部机制。
- 把搜索服务价格档位、检索深度档位或相关性分写成权威等级。
- 用单个品牌、单次问答或营销案例推导全平台规则。
- 引用无法查到的报告、市场份额、提升倍数或所谓内部字段。
因此,本文不采纳“豆包固定三级信源”“企业官网固定三级”“某类媒体固定提升 3—4 倍”“AuthInfoLevel 已是消费端公开权重”等说法。
稳妥策略是多层事实互证,而不是猜测一张内部权重表
四平台的共同方向是:先按意图和时效组织查询,在开放网页、平台生态和专业垂类中召回候选,再综合相关性、权威/质量、可读性、时效与安全过滤,最后由模型选择证据生成答案并展示部分引用。
对企业而言,应建立原始权威事实、第一方正式事实、专业交叉证据、平台生态体验四层互补的信源资产,并按“渠道 × 入口 × 问题类型 × 时间”持续复测。
主要来源清单
官方与厂商资料
- 豆包:用户服务协议、算法说明。
- 火山引擎:Search Agent、联网内容插件、豆包搜索文档入口。
- 腾讯云:WSA 产品页、产品概述、WSA API、TokenHub 联网搜索。
- 阿里云:百炼联网搜索、Web Search Agent、AI 网关联网搜索。
- 阿里巴巴集团:千问与淘宝打通说明。
- DeepSeek:联网搜索说明、使用条款、Responses API、Function Calling。
外部补充资料
- Tao Zhen 等:What Do Chinese-Language Generative Search Engines Cite and Surface?,预印本,2026-07-17。
- BASELINE:Chinese AI Search Engines Barely Share Sources,商业研究,2026-06-15。
- IT之家:火山引擎上线豆包搜索服务,2026-07-28;只补充动态页未完整展示的发布信息。
结论可信度速查
| 结论 | 可信度 | 原因 |
|---|---|---|
| 四平台都未公开消费端固定权重公式 | 高 | 官方文档交叉核验,未发现可验证公式 |
| 元宝 WSA 有开放网页、权威垂类和行业源分层 | 高 | 官方产品与 API 文档明确 |
| 千问有多级检索强度、站点/时间/行业控制 | 高 | 官方百炼与 AI 网关文档明确 |
| DeepSeek Responses API 支持服务端联网搜索 | 高 | 当前官方 API 文档明确,已替代 2024 历史状态 |
| 新豆包搜索按站点、创作者、行业做权威治理 | 中高 | 官方产品入口已确认,具体表述来自可信二手转述 |
| 某平台对某类网站有固定百分比权重 | 低/不可确认 | 无官方公式或可复现实验支持 |
| Web、App、API 可以合并代表一个渠道 | 低/错误 | 大样本研究显示来源集合与结果显著不同 |
- 人工确认正确来源、错误来源和歧义样本,形成金标准。
- 用冻结问题集做多账号、跨日期 Web/App 重复测试。
- API 或代理结果单独成组,不代替消费端真人结果。
- 只发布统计置信足够的观察,不发布不可验证的“内部权重”。
- 平台大版本或搜索产品变更后重新校准,不沿用旧快照。
