让 AI 分析网页内容,最危险的做法是只复制一段摘要,然后把它当成事实。网页可能包含更新日期、条件说明、脚注和隐藏限制。可靠的分析流程应当先固定页面范围,保存关键证据,再让 AI 归纳结构,最后由人检查结论是否超出了原文。
先确定要回答的问题
“分析这个网页”太宽。可以改成“找出产品的适用对象、价格条件和限制”“比较两页文档中的步骤差异”或“提取一组政策的生效日期”。问题越具体,证据范围越容易界定。

| 分析任务 | 需要记录的证据 | 最终交付 |
|---|---|---|
| 信息提取 | 字段、原文片段、更新时间 | 结构化表格 |
| 页面比较 | 页面版本、共同项、差异项 | 差异清单 |
| 流程梳理 | 步骤、前置条件、例外 | 流程图或检查表 |
| 观点归纳 | 作者、发布日期、支持段落 | 带证据的摘要 |
建立网页证据卡
每次分析至少保留页面标题、访问时间、目标段落和上下文。对动态页面还要记录页面版本或截图,避免内容更新后无法解释当时的结论。
页面:
访问时间:
问题:
证据位置:
原文摘录:
我的判断:
仍需核实:让 AI 处理证据卡,而不是直接处理一堆没有边界的网页文本。输出时要求它区分“页面明确写了什么”和“根据多处信息推断了什么”。
用结构化格式限制输出
提取字段时,先定义字段名、允许的值和缺失时的写法。比如价格字段必须同时记录金额、计费周期和适用条件;找不到时写“页面未说明”,不能自行补全。
处理冲突与版本变化
- 同一页面出现两种说法时,记录各自所在段落。
- 优先查看发布日期、更新日期和适用范围。
- 把无法判断的内容单独列为待确认项。
- 不要用搜索摘要替代页面正文。
AI 的作用是帮助你快速定位和整理,最终结论要能回到证据卡中的原文。若需要把多个网页的结果汇总成表格,可以参考站内的AI Excel 数据分析流程;对于任务边界的写法,可参考AI 提示词编写案例。
隐私和版权边界
分析前确认网页内容是否允许抓取、保存和再利用,不要把登录后的私人页面、客户资料或未公开文档交给不具备权限的工具。对外发布时,用自己的结构和判断表达,避免整段复制受版权保护的内容。
交付前做一次人工复核
- 每个关键结论是否有对应证据。
- 是否把推断写成了确定事实。
- 数字、日期和单位是否与页面一致。
- 页面更新后,原结论是否仍然适用。
网页分析的价值不是生成一段听起来顺的摘要,而是让读者知道结论从哪里来、哪些地方仍然需要确认。




