2026-10-08 21:28:52
作者:
科技
昨天在南京珠江路巷子里那家开了二十年的老咖啡馆待了一下午,邻座坐了两个穿校服的高中生,凑着一台笔记本吵得面红耳赤。一个说大语言模型就是把网上所有内容存起来,用的时候拼一拼,另一个说不是,它真的会“思考”。我搅着手里化得很快的冰美式,半天没插上话,干脆自己捋一遍这个大伙天天听却没几个人真说清楚的东西。
别被专业名词唬住,它就是个天生的“接话狂”
你不用记什么复杂的模型结构、参数规模这些听不懂的词,就想想你平时跟人聊天。你朋友跟你说“秋天去南京栖霞山”,你下一句会接什么?大概率是“看红叶对吧?我上周还刷到有人发朋友圈”,你绝不会说“今年夏天西红柿涨价了一块五”。为什么?因为你根据前面说的内容,下意识算出了下一句说什么最合理。
大语言模型干的事儿,跟这个一模一样。它从诞生第一天起,核心任务就不是“记住知识”,而是“把话说顺”。它对着互联网上公开的几百亿上千亿文字练了几个月,练会了一件事:给它前面任意一段文字,它能一秒就算出,下一个字放哪个最通顺。
然后它写一个字,再把这个字加进去,算下一个,再下一个,一段话说完就停。就这么简单。
大语言模型逐字生成文本演示示意图
很多人说那它怎么能写代码做数学题?其实还是接话。你给它一道题,它一步一步接,每一步的字都符合逻辑,凑起来就是正确答案。当然,如果接错了,那就是一本正经的胡说八道。
说实话我第一次用的时候,让它给我列南京民国建筑的参观路线,它给我列了一个根本不存在的“中山路150号民国图书馆”,我顺着地址找过去,那是个开了十年的盐水鸭店。你说好笑不好笑。
被吹上天的能力背后,藏着改不掉的天生缺陷
现在网上最常见的误区,就是把大语言模型当成无所不知的AI大脑,说它比人聪明,要取代这个取代那个。其实它天生带俩改不掉的毛病,很多卖AI产品的商家都不会跟你说。
第一个毛病就是瞎编,业内叫幻觉,说白了就是为了把话说顺,什么都能编,编得比真的还像。我上个月帮一个做自媒体的朋友改稿子,他让大语言模型找几个近代史研究数据,结果大语言模型给了一串根本不存在的数字,来源还是一个不存在的学术期刊。要真发出去,那就是天大的祸。
大语言模型幻觉错误案例对比图
第二个毛病,它真的不会思考。它不会判断对错,不会区分什么是真的什么是编的,它只看字和字连得顺不顺。你问它1+1等于几,它说等于3,你要是不纠正,它能顺着这个错跟你说十万字,每一句都通顺,每一句都是错的。
不过话说回来,这毛病其实也不是不能用,你只要知道它的边界,就能把它用得很好。我认识一个做装修设计的朋友,他原来画效果图之前,要想三天方案,现在让大语言模型先出十个不同风格的平面布局思路,他再挑两个改改,两三天的活半天就能干完,剩下的时间去陪小孩上兴趣班,不好吗?
很多人用它踩坑,其实都是自己的问题:把它说的所有话都当真,又不肯花时间核对,出了错反而怪AI不对。
别跟着瞎焦虑,它从来都只是个工具
别跟着瞎焦虑,它从来都只是个工具
刷短视频刷多了,总能刷到“大语言模型将颠覆所有行业”“十年内大部分工作会被AI取代”,看得人慌慌的,好像明天就要失业了。
我反正不慌。
你想啊,当年互联网出来的时候,也有人说会取代作家取代编辑,结果呢?现在靠互联网吃饭的创作者比原来多十倍都不止。打字机刚出来的时候,也有人说取代书法家,现在书法反而成了更稀缺也更值钱的爱好。工具永远是帮人干活的,取代人的从来都是不肯接受新东西的旧思维。对吧?
我前几天碰着一个大学刚毕业的小孩,说他找工作,HR问会不会用大语言模型整理资料做方案,他说他不会,硬生生错过了不错的offer。这不是大语言模型的问题,是他自己抱着偏见不肯碰新工具而已。
当然,我也不觉得它能神到哪里去。现在很多创业公司,随便整个聊天机器人就说自己是“千亿参数大语言模型”,骗投资的多,真能用的少。你去用用就知道,大部分连个简单的需求都做不好,错漏百出。真要用到正经地方,还得人盯着,人改。
就说现在最成熟的几个大模型,你让它帮你写个述职报告,它能给你写得全是空话套话,一点你的个人特点都没有,还得你自己改。它出力气,你出脑子,这不就是最好的分工吗?
天凉了,下个月栖霞山红叶就开了,我打算让大语言模型给我做个攻略,找几个冷门不挤的观景台,再列一下周边的老馆子,然后自己去走,错了就当场改,挺香的。谁会拒绝一个帮你查路线找餐馆的免费助理呢?
反正我是不会跟我的助理抢活儿干,也不用担心它抢我的位置。
免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:咖啡馆蹲一下午聊透:大语言模型根本不是你想的那样
文章链接:https://www.lfdjt.com/p/keji/a/7933.html