返回

DeepSeek和国运有啥关系?

m76almlf.png

DeepSeek横空出世,成功破圈。破圈之后,照例就是各自发挥的“六经注我”。其中最值得警惕的,中美双方都出现了借题发挥的“技术孤立主义”。美方的“脱钩论”者把DeepSeek视为技术威胁,剽窃、盗用的指责满天飞;这边的“国运赌徒”则是把DeepSeek渲染为“中美争霸”的一击制胜的,自我感觉良好。

好端端的科技成果,却成了地缘政治的符号。妖魔化和神化看似针尖对麦芒,其实都是对科技进步事业的亵渎,是阻挠人类科技进步事业的合谋。

唯有屏蔽杂音,才能直面真相:DeepSeek到底是什么?将会造成怎样的影响?

01

DeepSeek师承chatgpt

1月27日,DeepSeek应用登顶苹果美国地区应用商店免费APP下载排行榜,在美区下载榜上超越了ChatGPT。随即引发了资本市场的震荡,DeepSeek被形容为“英伟达的最大空头”,英伟达的股价大幅下跌。“DeepSeek碾压ChatGPT,吊打英伟达”的神话就此诞生。

先说Deepseek和ChatGPT之间的关系。DeepSeek和ChatGPT之间的竞争,是“师徒之战”。两者的师承关系源于“蒸馏技术”,这是Deepseek快速崛起的技术路径。

通俗的说,“蒸馏技术”就是用一个较为成熟的“教师模型”训练“学生模型”,这一过程类似低度酒蒸馏加工为高度酒。具体操作方式是,“学生模型”每分钟上百万次高频提问,从“教师模型”中汲取数据、学习逻辑。然后在人工干预下优化算法,最终形成独特的个性。ChatGPT就是Deepseek的“教师模型”,或许不是唯一的,肯定是主要的。因此,说ChatGPT是Deepseek的老师,不过分吧?

“蒸馏技术”不是近年来的新发明,发明者既不是中国人,也不是美国人,而是英国佬杰弗里.辛顿在2015年提出的,比阿尔法狗一战成名还早一年。所以,当时“蒸馏技术”只是纯理论的屠龙技——压根就没有成熟的“教师模型”,没法蒸馏。直到ChatGPT等成熟大模型相继投入实际应用,“蒸馏技术”才有了实际应用的空间。因此,“先有ChatGPT,后有Deepseek”也是无法否认的事实。

显然,Deepseek不是“天上掉下个林妹妹”,而是站在巨人肩膀上的衍生产品。咋咋呼呼的“国运赌徒”竭力否认、淡化Deepseek的师承ChatGPT,强拗“独立原创”的造型,是可笑又可怜的掩耳盗铃。

当然,也不能因为Deepseek是蒸馏技术的产物,就否认其原创性。蒸馏不等于盗窃、抄袭。要是能一抄了之,哪里轮得到Deeseek?在蒸馏技术的赛道上,有名有姓的玩家少说也有上百家。Deepseek能出圈,是有几把刷子的。“蒸馏”大同小异,人工干预的算法优化各显神通。简洁高效的算法是Deepseek的成功关键,颇有中国特色。

人工智能三大要素——算法、算力、数据,中国长于算法,美国重视算力。这种“偏科”倾向在赛道开启初期就已经显现了。昔日商汤为代表的视觉系AI“中国四小龙”,就是以算法著称。ChatGPT崛起,“算力为王”的大力出奇迹成为主流。风水轮流转,Deeepseek的勃兴,在一定程度上是“算法复兴”。这种技术风格的转换,在人类的科技进步史上反复发生,是一种常态。

Deepseek最大的优势是性价比,算法赋能大幅降低了算力成本。省钱永远是商业竞争的王道,绝大部分个人用户都没有很高的专业需求,免费、开源的Deepseek更有吸引力,这是人工智能商业化应用的成功。

但是,这并不意味着因Deepseek已经青出于蓝胜于蓝,更谈不上“碾压ChatGPT”。“蒸馏技术”和算法优化是做减法,以简化的方式提高效率。所以,Deepseek更垂直、更聚焦专业领域,这也意味着牺牲了一部分通用性。比如说,文生图等视觉系技术就不是Deepseek的强项,和文心一言比都有差距,遑论ChatGPT。而且,蒸馏技术的技术“天花板”到底有多高,现在也很难判断。未来能否实现性能全面超越,并没有清晰的预期。

这从资本市场的表现也可以看出端倪,Deepseek上架后,微软的股价仅仅下跌了2%。表明了市场投资者还处于观望态度,资本市场用真金白银的站队表态,不是各路“嘴强王者”的唾沫星子可比的。

反而是英伟达的股价“大跌”17%,Deepseek真是“英伟达终结者”吗?

02

Deepseek不是“英伟达终结者”

Deepseek到底使用了多少英伟达芯片,目前有三个版本分别是五万、一万和两千多,越传越少。其中“只有了两千多”的版本最假,Deepseek创始人梁文峰本人在采访中就说过,早在公司成立前额2021年就囤了一万块GPU。无论是一万还是五万,比起动辄几十万芯片的大厂产品,都是数量级的降低。大可不必在传播过程中人为夸大Deepseek的“省芯”。

必须指出的是,Deepseek的算法优化“省芯”,并不会降低人工智能领域的算力需求降低。算法优化和算力需求的关系,有点类似燃油发动机技术节油和燃油消费需求。燃油发动机开发省油技术,并没有降低汽油消费的总量。因为汽车的燃油成本越低,促进了汽车的普及度,燃油消费的总量不降反增。Deepseek省芯降低了人工智能研发应用的资金门槛,会吸引更多的投资者进场。

人工智能的研发端将会进一步走向“群狼搏虎”的遍地开花。在应用端,Deepseek成功实现免费开源模式,大幅推进了人工智能的普及应用,也会产生巨大的算力需求增长。别小看中小企业、个人用户本地部署的仨瓜俩枣,聚沙成塔是巨大的潜在需求增长。Deepseek不是“英伟达终结者”,而是英伟达的财神爷。

所以,英伟达对Deepseek的态度非常积极,不仅第一时间登陆NVIDIANIM,还给了权威背书——“DeepSeek-R1是最先进的大语言模型”。

至于所谓“股价大跌”,英伟达经历了市值十年增长222倍的超高增长,区区17%的跌幅不痛不痒。这轮回调,不是Deepseek对英伟达产生了实质性威胁,而是市场投资者借Deepseek释放一波回调势能。

当然,算力需求增长,未必是英伟达笑到最后。给英伟达造成竞争压力的不是Deepseek,而是其他大厂的算力芯片。英伟达的大客户谷歌、亚马逊、微软竞相推出自家算力芯片,算力大战已经开打。这场“神仙打架”对人工智能技术的研发、应用无疑是好消息。

因此,“国运赌徒”强行把Deepseek树立为英伟达的对手,是莫名其妙的“关公战秦琼”。这种强行对立,不是拔高,而是矮化——低估了Deepseek对整个人工智能领域的结构性冲击。

03

Deepseek是计划外的中美科技合作产物

我们应该怎样评价Deepseek呢?DeepSeek创始人梁文峰给出了标准答案,“我们不是有意成为一条鲶鱼,只是不小心成了一条鲶鱼”。

Deepseek的成功完全是计划外的市场产物。一家注册资金1000万的小公司,而不是“国运赌徒”心心念念的“国家队”。起点不高,也没有“星辰大海”的宏大目标——DeepSeek的初始目标是专攻金融交易,就是“国运赌徒”们最反感的“资本工具”。这样一家“起于草莽”的小民企,打造了一款成功的人工智能产品。不经意间改变了整个产业。这才是科技产业发展的正常模式。各种奇思妙想在开放的市场中竞争、试错,实现从量变到质变的升华。

Deepseek的成功,没有“赌国运”、中美争霸的宏大叙事,只有朴实的市场逻辑和水到渠成的科技路径。市场需要性价比高的人工智能技术,企业研发满足了市场需求。蒸馏技术从纯理论的纸上谈兵,到成熟大模型开道后真正落地。自然而然,不需要拔苗助长。

Deepseek不是闭门造车的产物,而是中美科技合作的成果。美国大厂的“教师模型”和算力技术,中国科技企业的研发力量,缺一不可。市场机制的无形之手,总是撮合出“佳偶天成”。那些彩旗飘飘、仪式感十足的“合作签约仪式”十之八九只是“仪式”而已。只有市场机制下的合作才保真。

因此,大可不必刻意强调Deepseek的原创性、创新性。师承chatgpt的蒸馏技术、使用英伟达GPU都是无法否认的事实,又何必遮遮掩掩?“微创新”的一小步,也可以是人类科技事业的一大步。瓦特并没有发明蒸汽机,而是改良了前辈的创作。这并不妨碍瓦特蒸汽机叩开了工业化的大门。

一款好产品本身,足以说明一切。Deepseek无疑是一款好产品,至于是否具备“划时代”的意义,无需“口头加冕”,时间会说明一切。就算没有又何妨?只要有良好的市场合作机制,而不是以邻为壑的自我封闭,划时代的好产品一定不会缺席。

分享到
QQ 微信 微博 复制链接
微信分享二维码

微信扫一扫,分享给好友

本文来自投稿,不代表本站立场,如若转载,请注明出处:

发表评论

V注册会员 L评论等级
R3 条回复
  1. 2026-08-31     Win 10 /    QQ浏览器

    说实话看完全文我就一个感觉 这作者对蒸馏技术的理解是不是有点太想当然了 把大模型训练说得跟蒸馏白酒一样简单 学生模型每分钟上百万次提问 从教师模型里学逻辑 这话听着就外行 大模型训练要是光靠提问就能学会 那openai花几十亿美金买算力干嘛 直接雇几百个人天天问chatgpt问题不就得了 还有那个师徒关系的说法 我真是服了 照这逻辑 牛顿还是伽利略的徒弟呢 爱因斯坦还是牛顿的徒弟呢 那物理学是不是早就该被某国垄断了 技术这东西本来就是全人类一步一步堆出来的 辛顿提出transformer架构的时候也没想过自己成了谁的爹吧 现在非要给DeepSeek安个出身 说他不是原创 这跟网上那些扒明星祖宗十八代的黑粉有啥区别 再说国运那段 作者说两边都在搞技术孤立主义 这话倒是没错 但我看着怎么感觉作者自己也挺拧巴的 一边说DeepSeek是算法复兴 一边又强调它师承ChatGPT 那你到底是觉得咱们行了还是不行 怎么话都让你说了 跟和稀泥似的 其实我觉得DeepSeek这波最大的意义根本不在什么国运不国运 而是它把价格打下来了 这玩意儿就跟当年小米出799的手机一样 山寨机都懵了 我现在日常写东西查资料都用它 免费的 不心疼 有什么不懂的随手就问 确实方便 这才是普通老百姓能感受到的变化 什么中美博弈什么技术路线 离我们太远了 最后说一句 作者说deepseek最大的优势是性价比 这点我同意 但你说这是中国特色 我就呵呵了 性价比是全世界所有穷人的共同追求 跟哪国人没关系 咱们也别啥都往自己脸上贴金

    回复
  2. 2026-08-30     Win 10 /    Chrome

    说DeepSeek师承ChatGPT我信,但到处乱喊国运的确实离谱。反过来说人家抄的也不好使,技术不就一步步踩肩膀过来的,真服了整天非黑即白。

    回复
  3. 2026-08-26     Android /    Chrome

    我看完这篇就想笑 真把DeepSeek当国运了 还什么一击制胜 这不跟当年说气功大师能灭原子弹一个路数吗 😂 文章里说蒸馏技术是辛顿2015年提的 先有ChatGPT后有DeepSeek 这话没错 但问题是哪个技术不是站在前人肩膀上 牛顿还说过站在巨人肩膀上呢 咋没人说牛顿是剽窃啊 国运赌徒固然可笑 可你这篇不也在变着法子泼冷水吗 好像非得证明DeepSeek就是个蒸馏出来的学生模型 才有优越感似的 我倒是想问问 蒸馏怎么了 你以为ChatGPT就不蒸馏别人吗 互联网上所有公开数据都是它的老师 它把维基百科Reddit知乎啥的全吞了 这不也是蒸馏吗 只不过它蒸馏的是全人类的文本 你DeepSeek蒸馏的是ChatGPT 五十步笑百步罢了 真要论起来 ChatGPT才是最大的剽窃犯 多少作家画家的东西被它白嫖了 没人管 反而揪着DeepSeek说师承 这不是双标是啥 再说那个师徒之战的比喻 也够搞笑的 学生考了高分 老师股票跌了 你就说学生吊打老师 那以前学生考上清华北大 是不是也吊打老师啊 这根本是两个维度的事 算法优化和算力堆砌本来就是两条路 文章自己也说了中国长算法美国重视算力 那DeepSeek用算法优势把成本打下来 这难道不是正经本事 非得把它说成是捡了ChatGPT的便宜 才显得你理性中立客观是吧 我有个朋友搞编程的 他跟我说 蒸馏这东西真没文章写的那么轻巧 说是每分钟上百万次提问从教师模型里学 但你问什么不问什么 怎么筛选答案 怎么调整权重 这里面的门道深了去了 就好比同一个老师教一百个学生 有人考大专有人上清北 你能说考上清北的也是抄老师的吗 算法优化这块 中国团队确实有几把刷子 这不是什么国运不国运的 就是一群工程师熬夜调参调出来的 非要扯上意识形态 两边都闲得慌 不过我也不是完全反对文章 它说妖魔化和神化都是亵渎 这话倒是对的 美方说DeepSeek剽窃 确实没证据 这边说DeepSeek碾压ChatGPT 也确实过了 但文章的立场怪得很 嘴上说屏蔽杂音 实际上自己也在带节奏 把DeepSeek的成功归功于蒸馏技术 然后再来一句但是也不否认原创性 这波先抑后扬玩得挺溜 可惜明眼人都看得出来 你重点强调的是师承 强调的是站在巨人肩膀上 这不是又一种杂音吗 说到国运 我更觉得扯淡 一个开源模型出来 股市跌了一下 就国运了 那昨天英伟达涨回去 是不是国运又没了 国运要是这么便宜 咱们早该天天盯着股票软件磕头了 科技进步是慢慢熬出来的 不是靠一两个爆炸新闻吹出来的 真正搞AI的人 谁有空关心这玩意儿是不是国运 他们关心的是下一版模型能不能少算错几道数学题 能不能别一本正经地胡说八道 文章里还有个细节让我不爽 说什么ChatGPT是DeepSeek的主要教师模型 这我信 但别把话说死啊 你又没看过DeepSeek的训练日志 怎么就知道是主要的 说不定人家还用了别的开源模型呢 大模型圈子里互相参考早就是常态 大家心里都清楚 非得像查户口一样把人家祖宗十八代翻出来 然后盖个章说你不是原创 这种做法跟那些说中国只会抄袭的西方媒体有啥区别 换了个方向而已 反正我的看法就是 技术这东西 好用就行 便宜就行 开不开源是人家的事 你DeepSeek免费让我用 我就说声好 你用起来确实不咋地 我也照样骂 扯什么国运 什么师徒 什么中美争霸 纯粹是吃饱了撑的 有这个功夫不如去多问它几个刁钻问题 看看它会不会露馅 那才是真玩家 哦对了 顺便说一句 我试过让DeepSeek写菜谱 它推荐的西红柿炒鸡蛋居然说要放糖 我直接笑喷 这就是国运吗 啊哈哈哈 😄

    回复
没有更多评论了

作者信息

岸边为啥
作者有点忙,还没写简介
TA的最新作品
    请配置好页面缩略名选项

推荐话题

关于本站

来跟我聊聊吧~