梁文锋“硬汉梗图”走红背后,中国大模型正成为全球AI界的“鲇鱼”

梁文锋“硬汉梗图”走红背后,中国大模型正成为全球AI界的“鲇鱼”
2026年08月05日 21:55 新京报网

近日,对DeepSeek创始人梁文锋的“同人二创”,正在社交媒体上掀起一股新的狂欢——网友将梁文锋最广为流传的一张蓝色西服照片“P”成了硬汉形象。许多评论不乏调侃,但背后却透露出了DeepSeek新模型激发起新一轮AI行业“鲇鱼效应”的惊叹。

以“DeepSeek”为关键词搜索,排名靠前的几个帖子是网友对梁文锋形象的“二创” 图片来源:小红书以“DeepSeek”为关键词搜索,排名靠前的几个帖子是网友对梁文锋形象的“二创” 图片来源:小红书

7月31日,DeepSeek V4 Flash发布。起初,这个带有“Flash”后缀的模型并未引起过多关注,毕竟,这不是“Pro”也非“Max”,一般而言,带有这一后缀的模型意味着成本低廉、性能适中,通常作为入门级或辅助性选项。

然而,数据却给出了截然不同的答案:凭借极致的性价比与卓越的响应速度,V4 Flash迅速在全球开发者群体中引发“使用热潮”,以7.1万亿Token的数据登顶OpenRouter周度全球调用量榜单。有外国网友在X上评论:“对DeepSeek充满敬意。”有人去其他海外大模型的社交账号下评论,“别打广告了,我们希望得到DeepSeek的价格。”

新京报AI研究院注意到,当前OpenRouter榜单的前五名均为中国模型,其中DeepSeek独占两席,直到第六名才是GPT-5.6 Luna。这说明,无需盲目堆砌参数,中国AI大模型已经通过架构优化与工程创新,以“小而美”的姿态重塑行业标准,走出了一条独特的技术出海之路。

8月4日的OpenRouter周度全球调用量榜单,图左红框处的榜单前五名均为中国模型 图片来源:OpenRouter官方网站

这不是又一次“国产之光”的自嗨。当全球开发者用真金白银的Token调用量投票时,一个更深层的问题浮出水面:中国大模型出海,为什么这次不一样了?

DeepSeek V4 Flash,一场性价比屠杀

先算一笔账。

就在DeepSeekV4 Flash上线前一天,OpenAI宣布GPT-5.6 Luna降价80%——输入价格降至0.2美元/百万Token,输出价格降至1.2美元。

开发者们还没来得及为OpenAI的降价而欣喜,就迎来了DeepSeek V4 Flash的出现,其定价为:输入缓存命中0.2元/百万Token,未命中1元,输出2元。换算成美元,就是输入约0.14美元/百万Token,输出约0.28美元。

海外独立大模型评测社区Artificial Analysis测算,DeepSeek V4 Flash在典型Agent任务下的单任务成本比Luna低约60%——除了价格本身更低之外,还有一个关键原因是DeepSeek提供98%的缓存命中折扣(行业普遍90%)。OpenCode平台实测显示,DeepSeek V4 Flash 输入缓存命中率96%,平均每次会话的成本为0.06美元。

模型价格对比图,DeepSeekV4 Flash位于最左边,代表价格最低 图片来源:Artificial Analysis官网

更重要的是,DeepSeek V4 Flash不止价格低,还拥有不俗的性能。根据DeepSeek披露的官方跑分文档,该模型的各项配置的分数测评普遍超过DeepSeek V4 Pro Preview、GLM 5.2,略逊于Opus-4.8。

DeepSeek各项维度能力数据 图片来源:DeepSeek官方账号DeepSeek各项维度能力数据 图片来源:DeepSeek官方账号

在Artificial Analysis的评测中,V4 Flash在智能指数上拿到50分,仅比GPT-5.6 Luna的51分低1分。Bold Metrics CTO摩根·林顿在VulcanBench测试后指出,V4 Flash在中等努力水平下“极其稳定”,击败了Grok 4.5和Claude Fable。

甚至有声音认为,DeepSeek已经成为全球AI的“斩杀线”——性能更好的模型价格数倍甚至几十倍于DeepSeek,更有不少大模型性能没DeepSeek好,价格比DeepSeek还贵。DeepSeek就像一头巨鲸,跟在所有AI模型的身后,无情吞噬掉那些性价比不高的模型。

但这背后是开发者们的狂欢,便宜、能打、开源——海外开发者没有理由不给它投票。OpenRouter的数据清楚地显示,美国、欧洲开发者在该平台流量中占比接近半数。这意味着,DeepSeek不是只有中国在用,全球开发者的手都伸了过来。

鲸鱼兄弟到Harness领域招人,DeepSeek聚焦智能体

为何Flash就拥有如此强悍的性能?

DeepSeek官方发文称,7月31日发布的DeepSeekV4 Flash的模型结构、尺寸和DeepSeekV4 Flash Preview(预览版)保持一致,仅重新进行了后训练。值得注意的是,DeepSeek表示,“我们大幅提升了其Agent(智能体)能力”。

这也许是DeepSeek近期一直强调强化Agent能力,进行战略转向后交出的一份成功的答卷。

事实上,DeepSeek版本的Agent要追溯到今年“五一”期间美国独立开发者Hunter Bown的走红。这名外国开发者是DeepSeek的“铁粉”,他制作了一个名为DeepSeek-TUI的终端编程Agent,几天内Star数涨到11000+,登顶GitHub全球Trending。而让他真正在国内开发者社区“出圈”的是其5月1日在社交媒体发的一段接地气的“交友帖”,开头就是“鲸鱼兄弟们好,我是做DeepSeek-TUI的那个美国佬”。

Hunter Bown在社交媒体发文寻找中国的“鲸鱼兄弟” 来源:X平台Hunter Bown在社交媒体发文寻找中国的“鲸鱼兄弟” 来源:X平台

Hunter Bown选择DeepSeek做Agent底座的时间节点,恰好与DeepSeek自身战略转向吻合。

2026年上半年,DeepSeek悄悄加大了Harness领域的投入。Harness是包裹在AI模型外的一整套工作条件——负责给模型准备上下文、工具、任务状态、反馈和边界,也是智能体性能提升的关键。6月21日,DeepSeek核心成员崔添翼在社交媒体公开发布“招人帖”,表示Harness组作为新成立的部门,“目标远大、工作繁重,仍然非常缺人”。

DeepSeekV4 Flash发布后,崔添翼仍然不忘继续打磨模型。8月2日,他在社交媒体发文称,“如果你是Agent Harness相关开源项目的开发者,希望参加DeepSeek Harness的内测,可以回复或私信联系我。请附上GitHub id以及开源代表作。”截至记者发稿,该帖文下已有1117条回复,不少开发者带着作品前来“网络面试”。

DeepSeek核心成员崔添翼发布的内测帖文 图片来源:X平台DeepSeek核心成员崔添翼发布的内测帖文 图片来源:X平台

中信证券在研报中指出,Harness的核心价值在于将模型能力转化为稳定、低成本的端到端交付。AI竞争正从模型本身转向任务交付能力。DeepSeek显然是押对了方向——V4 Flash官方技术报告也首次披露“DeepSeek Harness即将公布”。

一个美国独立开发者用DeepSeek做Agent工具破圈,DeepSeek自己则在底层强化Harness让Agent更强——这两条线交织在一起,说明的不只是某个模型的胜利,而是一个生态正在自发生长。

从Kimi到Qwen,中国大模型正在海外走出自然口碑路径

把时间线拉长一点看,DeepSeek V4 Flash的爆火不是孤例。

7月17日,月之暗面发布参数量达2.8 万亿的Kimi K3大模型,在Frontend Code Arena上击败Anthropic旗舰Fable 5。7月17日,CNBC报道美股半导体板块走出今年以来最差单周行情,跌幅创下2025年4月之后新低,而导火索是“中国月之暗面发布全新AI大模型。”

7月31日,DeepSeek V4 Flash正式版上线。同日,多模态模型Seedance2.5,MiniMax H3发布。8月3日,阿里发布参数量达2.4万亿的旗舰机模型Qwen3.8-Max。

18天内,国内多款重量级模型密集发布,它们具备与硅谷顶级模型正面对抗的能力,并大多已经开源或即将开源。

这组数据最能说明问题:根据OpenRouter披露的数据,中国模型全球市场份额已在6月初整体超过美国模型,截至7月26日,中国模型近28天份额约为63.5%,占据全球三分之二市场份额,美国模型为35.5%。Hugging Face2026年春季报告则显示,中国开源模型下载量占全球41%,首次超越美国。a16z合伙人 Martin Casado称,如今有约80%的美国AI初创公司,融资路演时用的是中国开源模型。

难怪,现任美国总统科技顾问委员会(PCAST)联席主席David Sacks(大卫·塞克斯)近期在评价K3的表现时警告,“美国自我束缚的政策正在削弱其AI竞争力”,认为“这可能就是输掉AI竞赛的方式。”

回过头看,中国大模型出海的路径,和很多人预判的完全不同。不是靠补贴砸市场,不是靠政府推动,不是靠营销买量。它走了一条更朴素的路——用技术实力和性价比,让海外开发者自发传播、主动迁移。

新京报AI研究院看到一条AI领域科技博主Pratham发布的帖文,很好地代表了海外开发者的心态,他表示,“DeepSeek没有炒作,没有虚假营销,没有不必要的‘戏剧性’,只是一个能够与最佳前沿模型竞争,且成本更便宜模型。”

AI领域科技博主Pratham对DeepSeek的评价 来源:X平台AI领域科技博主Pratham对DeepSeek的评价 来源:X平台

斯坦福大学2026年AI指数报告写得很直白:中美大模型的性能差距已基本消失。当性能拉平、价格只有对手的几十分之一时,开发者用脚投票是必然的结果。美国高价模型的神话,正在被中国大模型厂商的工程化降本能力一点点拆解。

这不是终局。模型能力迭代、全球化服务、合规方案、商业化盈利——每一关都不好过。但有一点已经很清楚:中国大模型正在海外走出一条依靠技术实力收获自然口碑的全新路径。不靠声量,靠账本。不靠叙事,靠代码。

当全球开发者开始默认选择中国模型时,格局就已经变了。

新京报AI研究院 罗亦丹

编辑 岳彩周

校对 柳宝庆

新浪科技公众号
新浪科技公众号

“掌”握科技鲜闻 (微信搜索techsina或扫描左侧二维码关注)

创事记

科学探索

科学大家

苹果汇

众测

专题

官方微博

新浪科技 新浪数码 新浪手机 科学探索 苹果汇 新浪众测

公众号

新浪科技

新浪科技为你带来最新鲜的科技资讯

苹果汇

苹果汇为你带来最新鲜的苹果产品新闻

新浪众测

新酷产品第一时间免费试玩

新浪探索

提供最新的科学家新闻,精彩的震撼图片