所谓AI幻觉,说人话就是:大数据模型一本正经地给你胡说八道,但是由于其输出过程过于有条理有逻辑,且表述过程中甚至不惜引经据典,加上“AI很强”的外部氛围,导致你一不留神,就会误以为真——其实通篇都在扯淡。

AI幻觉这玩意儿不是新鲜事,早在ChatGPT刚推出时已经有了“很多”讨论,后面到了o4、o1以及现在最新的o3,一方面是症状减轻了,另一方面是因为我们已经积累了足够多的、与ChatGPT斗智斗勇的经验了——不停地在Google做fact-checking,一遍又一遍地跟它argue。

但,我确实低估了两件事:
1. ChatGPT的高门槛。如果你要流畅订阅ChatGPT Plus,你甚至有一张香港银行卡都不行,因为Open AI在香港未开通付费服务。过去几个月我帮助了好几位朋友开通ChatGPT Plus订阅,很多朋友都是老网民了,依然搞不定,其门槛真的高得离谱。
2. 与之相比,从春节前开始爆发的,因为deepseek之低门槛、免费、人人可用(甚至我给爸妈手机都装上了,跟他们说这是baidu最新款 emmm,以后不用百度用这个),其在简中的普及程度并非ChatGPT可比。也因为deepseek之免费,许多用户是以休闲、体验、分享的心态来使用,而非我身边的自媒体从业者,愿意一个月给美帝20刀购买ChatGPT订阅——因为这是吃饭的家伙,所以会不停地总结工具的使用心得,锻炼出强劲的fact-checking经验。
3. 当然,也是因为deepseek在中文本地化的语境中,打造出了一套更适合中国国情的表达方式,中文表达更优于ChatGPT;“逻辑正确,答案也正确”,这种潜移默化的思维(如果你在大厂上过班,你一定会修炼出所谓的,通过一份ppt,把一团*的结果,汇报成一场伟大战役的功夫),我们理科至上、文科生靠边站的思维,使得人稍不留神就中招。
最终的结果,就是deepseek生成了大量的、天马行空的谬误。这些谬误,严重地污染了简体中文互联网(而本身deepseek在信源引用上,跟ChatGPT相比,确实做得不如)。
今日公众号上看到一篇《比ChatGPT危险100倍!DeepSeek正在中文互联网建造“幻觉长城”》,好家伙,幻觉都变长城了,好文章。感兴趣可以看看。
如今在小红书上,可以刷到无数deepseek生成的帖子,前阵子我看到一个很有代表性,叫做《我听了这么多年***,还不如deepseek》,大概是让deepseek说说***音乐里的彩蛋:这里面全特么是扯几把蛋,但是评论区里都是大呼小叫,我留言了一句:我说你们就不能自己去查查看吗?没人理我。
两周前我的朋友红老师也在第一时间试用了deepseek之后给我发来贺电,分享了她和deepseek讨论她的爱豆woodz的音乐风格、路线、趋势,因为我晓得deepseek对音乐文本的无能,所以本能反应也是——这特么的一眼假啊。逻辑没问题,但是这里面的论据、信源都是扯淡的啊。它本义就是一个大数据生成(搜索)模型,如果本身信源是不存在的,它能怎么得知呢?
我就随便点开红老师发给我的图:随便进去一首歌吧,这里说:


1. 人声处理黑科技
双声道交替(《Trigger》副歌):左右声道分别录制不同音高,营造眩晕感
这,我压根没听出这首歌里的左右声道有什么高八度低八度,而且不同音高本身根本不会制造眩晕感啊,如果要左右声道录double、通过音高作出区分,那是增强力道啊?眩晕感是通过混响、延迟整的啊?deepseek你在说啥呢?
呼吸声放大(《Bump Bump》前奏):将吸气声提升 6dB作节奏组件
这首歌前奏哪里有吸气声了……?吸气声提升6db做beat?不是哥们,这是什么玩意儿啊?就算我当你是有吸气声,但是“提升”肯定要有相对的吧,你是跟什么相对呢?你推大音量,你也要有“标准”对吧?这完全就是一个狗屁不通的描述啊?
元音拉伸(《Waiting》桥段):将“oh”音采样后时间拉伸 300%制造太空感
不是哥们,这首歌有bridge吗?桥在哪里?我连桥都找不到。
哦哦,说的是副歌后面的那个oh了一下的?这个真要说应该是“后副歌”,以及……这样采样拉伸300%,也是纯粹扯淡了。
好好好,下面还有:

2. 节拍设计密码
反拍陷阱:在 4/4拍中植入7/8拍吉他切分(《Dirt on my leather》)
Dirt on my leather这首歌确实是四四拍,确实也是走的rock band风格,有一把电吉他从头贯穿始终,但是7/8从何而来?这吉他弹的就是一个比较hard rock的,一直在弹call response,节拍是一直跟着鼓组的,并没有任何复合节奏的意思。
心跳模拟:BPM严格对应心率变化曲线(《l hate you》从72BPM渐增至128BPM)
喂喂喂,这首歌从头到尾的速度都没有变化啊?BPM一直稳定在86左右啊,这心率曲线是怎么来的?
破碎节拍:用 Ableton Live的 Beat Repeat功能随机切碎鼓组(《Chaser》)
Live里面确实是有一个叫做Beat Repeat的功能,打开里面确实是能把鼓组切碎,但是这首chaser里面,鼓组一直都是非常稳定的啊?哪里碎了?
所以到了后面风格预测那些,大可笑笑罢了。

我确定了,红老师这是对我进行钓鱼,她就是希望以此摁头让我去听她家爱豆的歌,让我好好复习一下,然后让我去怼deepseek,让我给她说说,未来她的哥哥音乐会怎么走,她一定是在钓鱼。100%的。
总之,AI幻觉不是deepseek的问题,ChatGPT也一样跑火车,当然ChatGPT跑的程度会少一点(最新发布的o3貌似跑得离谱一些了),可deepseek的语言模型实在太真了,太言之确凿了,而且使用deepseek的门槛太低了,适用人数太多了,这里所造成的AI幻觉,确实是长城一般了。
如之前红老师给我发的这些,我当然可以说,一眼假,不信我打开歌曲听听,看看是不是都是扯淡——但是,如果讨论的是我不清楚的领域呢?我能否有这么轻松的方式去鉴定真伪?就像如今的小红书里,到处都是“我跟ds聊了聊XX”的内容,每次标题都很酷,我都点进去看了,结果又变着戏法再推给我这些玩意儿。AI确实是很强大的东西,但目前的AI有着巨大的技术缺陷,“颠覆了传统知识传播链条——专业论文→科普文章→网络内容”,你以为AI里面说的都是对的,尤其是它说出大量的专业词汇、超出你的学科认知的时候,其信息量之大,你几乎无从下手,无可辨别。
最新发现
相关资讯
科大讯飞总裁吴晓如:大模型协同大过竞争
科大讯飞总裁吴晓如:大模型协同大过竞争产业端特别是传统产业,尚不能感受大模型发展带来的变革?吴晓如表示,接受大模型较快的是数字化程度较高的领域,它们有丰富的数据;其次是应用价值较大的领域,它们对数
2025-10-14 11:11:47
清华系前腾讯Robotics X核心成员创业,业内首款能“单手玩手机”的灵巧手来了|涌现新项目
一款能把脉、操作鼠标的“六边形”产品。
2025-09-17 11:00:00
华为全新小艺拟人化实时音视频对话功能适配机型公布,含MateXTs三折叠等
华为小艺智慧助手已在今年8月底推送了1137300版本升级,部分机型在更新该版本的小艺智慧助手后,新增支持“小艺看世界”功能。目前华为官网已公布该功能适配机型,包含MateXTs三
2025-09-17 10:30:00
通义千问系列最强大的语言模型:Qwen3-Max-Preview上线
阿里通义千问今日在官网和OpenRouter上线了最新的Qwen-3-Max-Preview模型。根据官网描述,该模型是通义千问系列中最强大的语言模型。
2025-09-17 10:00:00
AMD谈AI显卡:没有性能就没有人买推理一直有优势
9月5日消息,GPU显卡不仅决定了游戏性能,也是AI领域各大厂商竞争的焦点,NVIDIA一家占了90%以上的份额,AMD也紧追不舍。AMDCFO首席财务官JeanHu日前在花旗TMT大会上也谈到了
2025-09-17 09:30:00
支持百万卡扩展,中科曙光发布国内首个开放架构AI超集群系统
该系统以GPU为核心,实现了“算、存、网、电、冷、管、软”一体化紧耦合设计,可为万亿参数大模型训练推理、行业大模型微调、多模态大模型开发、AI4S等场景提供算力底座。
2025-09-17 09:00:00
今日热榜
当AI制药不再讲故事
2025-03-12 17:29:46ZCOOLxCanva可画:Canva可画创作者大赛“变飞为宝计划”,4/3截止征集
2025-06-21 13:01:44“AI+养老”,晚年更美好
2025-01-15 18:30:24东信集团发布首个AIGC营销大模型,赋能智能营销
2025-04-30 11:31:48美国人工智能政策与中国应对策略
2025-05-06 11:25:29男子用AI造谣“女儿被抱走”:内容是编的图是网上找的
2025-08-07 09:20:35AI体育训练场“常驻”京张遗址公园
2025-02-11 14:50:36深圳人工智能先锋城市建设加速推进
2025-05-04 19:56:38“国内AIApp产品TOP100”榜单揭晓美图秀秀斩获第三名
2025-02-24 16:54:27爱奇艺融入AI搜索,首次将生成式AI(AIGC)应用于剧情搜索等三大场景
2025-07-06 13:00:48热门推荐