2026-10-04 01:11:02
作者:
科技
上周六0923蹲在南京老门东巷口的咖啡店蹭空调,邻座坐了个学插画的小姑娘,盯着电脑上的AI绘图面板挠头,突然转过脸问我:你做科技的,能不能说人话讲清楚,到底什么是深度学习?是不是只有那种好几个G的大模型才算?
我一口冰美式差点喷出来,原来好多人对这东西的印象,还停留在新闻里的大模型、AI画图,要么就是实验室飘着的黑科技,根本没意识到,你每天摸的手机里,早就有这玩意儿在跑了。
先不说算法,先讲你天天用的深度学习
你打开手机相机拍人,背景自动虚掉那个效果,十年前根本做不到这么自然。那时候要么靠双摄像头测距,要么就是简单的边缘抠图,边缘总会发虚糊成一片。现在呢?哪怕你用的是几千块的中端手机,拍出来的人像边缘,连头发丝都能给你分清楚。谁在干活?就是藏在芯片里的深度学习模型。
它不是靠镜头测距,是它看过几百万张有人物的照片,知道哪里该是前景人物,哪里该是背景,对着你拍的新图,一秒就算出来分割线。
手机相机深度学习人像分割效果示意图
不止拍照。你打字的时候输入法自动蹦出来你接下来想打的词,你刷短视频的时候刷到的内容刚好都是你喜欢的,你戴的智能手表自动检测你有没有心率异常,甚至你寄快递的时候快递柜自动识别你的手机号,全是深度学习在干活。
很多人觉得这东西遥不可及,其实它早就钻到你生活的每个缝隙里了。我妈今年七十多,拼音打字慢,每次都夸现在输入法“比我闺女还懂我”,她哪知道,就是深度学习模型天天盯着她的打字记录学出来的。
说实话,要不是那天被小姑娘问住,我也很少会特意想起,原来我们已经被深度学习包围这么久了。
那些被营销号带偏的误区,得掰扯清楚
我刷短视频刷到过好多讲深度学习的内容,十有八九都在瞎吹,把人带得晕头转向。挑几个常见的掰扯清楚。
第一个误区,深度学习就是人工智能。真不是。人工智能是好大一个范畴,几十年前的象棋程序,那也算人工智能,只不过那时候是人类把规则写死,让程序按规则跑。深度学习呢?是人类给一堆数据给一堆标签,让程序自己从数据里找规则。它只是人工智能里的一个分支,只不过最近十年长得特别快,抢了所有风头而已。
第二个误区,深度学习会“思考”,马上要有自我意识了。我的天,这个谣我已经辟了八百次了。它真的不会思考。你教它认一万张猫的照片,它学会的只是猫这个标签对应的像素分布规律,它根本不知道猫是会叫会跑会蹭人的小动物,也不知道猫毛过敏的人碰了会打喷嚏。它就是个找规律的一把好手,仅此而已。
深度学习浅层神经网络分层结构示例图
第三个误区,深度学习就得做超大参数,越大越厉害。这话也就骗骗外行。我上个月跟南京一个做农业物联网的团队聊天,他们做了个深度学习模型,用来识别青菜叶上的蚜虫,整个模型才不到三十兆,跑在田间地头的低成本摄像头上,不用连云端,一块太阳能板就能供电,识别准确率比他们之前试的通用大模型还高。
为什么?因为大模型见了太多乱七八糟的东西,这个小模型只学蚜虫和菜叶的特征,针对性强,还省资源。不过话说回来,现在行业里就爱吹大模型,好像参数不够大都不好意思出门跟人打招呼,其实很多具体场景,小模型才是真的好用,又便宜又准,为什么非要挤大模型的独木桥?对吧。
还有人说深度学习就是“大力出奇迹”,没有任何技术含量,这话也不对。最早的深度学习概念半个世纪前就有了,那时候为什么没火?没有足够多的数据,没有足够强的算力,也没有人把结构调对,缺哪一样都不行,哪是光靠堆力气就能成的。
接下来,深度学习会往哪走
接下来,深度学习会往哪走
开头那个插画小姑娘,她自己用的勾线辅助模型,就是一个几百兆的深度学习小模型,放在自己笔记本里就能跑,不用连网,不会把自己未发布的草稿传到网上泄露,她自己拿自己的插画作品微调了半个月,出来的效果比那种在线通用AI绘图好太多,完全符合她的线条风格。
这其实就是深度学习接下来一个很重要的方向:从小处落地,往场景扎进去。之前十年,大家都忙着堆参数搞大模型,把知名度打出去了,接下来就是往各个具体的行业场景钻,给每个场景做合适的小模型,不用那么多参数,只要好用就行。
还有一个方向,就是往端上走,就是把模型放在你本地的设备里,不用什么都传到云端去算,既保护隐私,速度又快,还省带宽钱。我见过一个做汽车的朋友,他们把识别路况的深度学习模型直接放在车载芯片里,不用连车联网,哪怕进了隧道没信号也能正常干活,稳得很。
当然,我也不否认大模型的价值,大模型做通用内容生成确实厉害,但不是所有场景都需要通用大模型。很多人现在一提到深度学习就想到GPT,想到千亿参数,其实这是挺窄的一个印象。深度学习从最开始的图像识别,到后来的语音识别,再到现在的大语言模型,其实一路走来,核心没变,就是让模型从数据里自己找规律,代替人类干那些重复的模式识别活儿。
它没那么神,也没那么玄乎,更不会明天就取代人类。它就是个工具,跟我们祖先发明的镰刀锄头,跟后来发明的蒸汽机电力,没什么本质区别,都是帮人省力气的。你会用它,就能把重复的活儿扔给它干,自己去干更有意思的创意部分。
那个插画小姑娘跟我说,她现在勾线这种重复活儿全扔给深度学习模型,自己只需要画草稿和最后润色,效率比之前高了两倍,能多画两张原创。你看,这就是深度学习最好的用法。
今天路过那个咖啡店,那个小姑娘发了个新画的插画给我,背景的参考是手机深度学习拍的虚化图,线稿是模型辅助勾的,她只花了一天就画完了之前要三天的作品。
你看,深度学习就在你身边,没那么遥远,也没那么可怕。
免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:巷口咖啡店的深度学习,和你想的不太一样
文章链接:https://www.lfdjt.com/p/keji/a/6187.html