我现在见到搜索结果顶部那块 AI Overview 就想装个 uBl
一、 幻觉不是概率问题,是它把“听起来像”当正确
别跟我扯什么 “RAG 落地不完美”,这玩意儿连最基础的 引用溯源 都做不到。你点开它引用的那三个小链接,有一半根本不支持它生成的那句话,剩下一半是 StackOverflow 上 2015 年的过期回答。最离谱的是问医疗、法律、税务这类高风险领域,它能把 “建议咨询专业人士” 当免责符,中间夹带着完全错误的剂量或条款引用。对于我们这种天天要查 API 参数、排报错堆栈的开发者,这不仅是噪音,简直是 生产力杀手 —— 你得先花精力辨别它哪句是胡说八道,再去找真文档,反而比直接跳过它慢。
二、 它正在把“搜索”变成“二手转述”的闭环
Google 现在的逻辑很明显:把用户留在 SERP 里,别让他们点出去。可后果是内容生产者(文档站、技术博客、开源项目维护者)流量被截胡,没动力更新维护,长远看训练语料质量只会更烂,模型再反哺搜索,形成死循环。我现在养成肌肉记忆:看到彩色生成框直接 Tab 切到底部蓝链,或者直接 site:github.com / site:stackoverflow.com 硬过滤。更别提它对中文技术术语的翻译腔极重,把 "race condition" 译成 “竞赛条件”、把 "idempotent" 译成 “幂等性” 还要我反向脑补英文原文才能看懂啥意思。
三、 物理屏蔽的几个实操手段(亲测有效)
不想等 Google 出“关闭开关”,自己动手丰衣足食:
1. uBlock Origin 静态规则
面板 → 我的过滤器 → 粘进去:
www.google.com##div[data-ved]:has-text(/AI Overview/i)
www.google.com##.M8OgIe:has-text(/AI Overview/i) 这两条能干掉 95% 的生成框,偶尔漏网再右键 “屏蔽元素” 补一次。2. 搜索参数强制关闭
地址栏后面加 &udm=14(或 &tbs=li:1),直接回到传统十条蓝链界面。做成浏览器关键字搜索引擎,比如 g 关键词 就自动带参数。
3. 换个默认引擎
Kagi、DuckDuckGo HTML 版、甚至 Bing 的“深度搜索”模式,起码不把幻觉塞在第一屏最显眼的位置。我现在主力 Kagi + 自建 SearXNG 实例,干净得多。
四、 别指望它变聪明,指望自己变懂工具
大模型做摘要、做规划、做代码生成我全用,但 检索入口 我绝不交给一个连 “引用来源与生成内容不一致” 都解决不了的系统。搜索的本质是 定位可信源头,而不是 “帮我读完再转述一遍”。下次再看到那行小字 “Generative AI is experimental”,别当装饰,当警告牌看。