| 首页| 无证之罪| 长发公主| 一诺倾情| 遗失的世界| 春风十里不如你| 倒数第二次恋爱| 那一场呼啸而过的青春|
您的位置:首页 > 新闻中心 > 社会 > 正文

海派甜心

刚刚:李芷萱、何杰夺冠!为何选择c类赛事阿尔山?_我的网站

铁石心肠

A |     

今天清晨7:30,2026阿尔山马拉松在内蒙古阿尔山圣泉广场鸣枪起跑,6000名跑者踏着草原清风冲出起点。    想想美国的顶尖人工智能开发者吧。他们将心血、汗水和巨额资金倾注到每一个前沿模型的新版本中。然而,他们几乎来不及喘口气,竞争对手就已经追了上来。而最引人注目的两个国内精英选手,何杰、李芷萱,也参加了此次比赛。如果只是收费的竞争对手紧追不舍,情况已经够糟了。当国内绝大多数精英选手扎堆北上广深等一线城市热门赛事时,何杰和李芷萱却选择了这场仅有6000人规模的C类小众赛事。结果毫无悬念:两人双双夺冠。

B | 何杰成绩为:2小时20分01秒;李芷萱成绩为:2小时42分20秒(成绩为直播估算成绩,最终以官方成绩为准。)以赛代练何杰和李芷萱的夺冠,都在跑友的意料之中。作为中国马拉松顶尖选手,他们在阿尔山的赛道上几乎没有遇到真正意义上的对手。但像Anthropic和OpenAI这样的公司还必须全力冲刺,才能勉强领先那些免费提供模型的实验室几步。何杰、李芷萱42.195公里的全程赛道,几乎看不到竞争对手,一直专注于自己的节奏。         7月16日,中国初创公司月之暗面(Moonshot AI)发布了Kimi K3——一个仅比Anthropic和OpenAI的最新作品Fable和Sol分别略逊一筹的模型。其参数(或称“权重”)将在本月晚些时候免费公开,这意味着它可以被下载并在任何能够运行的服务器上使用。阿尔山地处大兴安岭腹地,平均海拔超过1000米,对于长距离项目而言,这是绝佳的训练场。7月19日,中国互联网巨头阿里巴巴(Alibaba)也发布了其通义千问(Qwen)模型系列新成员的预览版,该公司称其性能仅次于Fable。草原、森林、湿地、林海……多变的地形和起伏的海拔,对选手的也是一种考验。何杰、李芷萱选择在这里参赛,与其说是争冠,不如说是一场精心策划的“训练”——在相对轻松的比赛环境中,检验夏训成果,打磨比赛节奏,为下半年更重要的赛事储备体能。

C |          根据研究公司Epoch AI的分析,最强大的开源权重模型(通常来自中国)落后于技术前沿仅几个月(见图表)。这些系统的采用正在迅速扩大。为什么是阿尔山?为什么两位顶级选手,放着奖金更高、曝光更大的大城市赛事不跑,偏偏选中了这场C类小众赛?阿尔山的赛道,北纬47°,大兴安岭腹地,夏季均温不到20℃。当全国大多数城市被高温裹挟时,阿尔山却拥有最清凉的奔跑环境。5月,在热门模型市场OpenRouter上,客户使用美国顶尖实验室提供的系统量与使用中国顶尖实验室的系统量大致相当——以tokens(行业首选输出单位)消耗量计算。到了6月,美国模型的使用量增加了三分之二——但中国模型增加了两倍。

D |          这不仅引起美国领先模型制造商的警觉,也引起美国政府的担忧,他们担心国家在AI领域失去领先地位并为黑客攻击创造新机会。据说特朗普(Trump)政府内部一些人正在推动各种措施来减缓中国模型的传播,例如将其制造商加入贸易黑名单或警告美国公司不要使用它们。没有酷暑炙烤,只有林海清风;没有城市喧嚣,只有草原风光。然而,美国政府在授予Fable和Sol等先进模型访问权方面的不可预测做法,也在刺激人们采用中国的开源权重替代方案。对于需要高质量训练的精英选手来说,这样的环境远比城市柏油马路更具价值。         甚至在K3发布之前,中国的开源权重模型就已引起全球关注。更重要的是,在全马2000人的赛道上,意味着更少的干扰、何杰和李芷萱可以完全按照自己的节奏跑。热爱不分赛场大小何杰、李芷萱的夺冠,看似意料之中,实则意味深长。真正的强者,从不拘泥于赛场大小;极致的坚持,从不畏惧路途远近。GLM-5.2是另一家中国实验室Z.ai于6月推出的模型,在执行所谓的智能体任务(agentic tasks,如创建软件)方面,比美国另一家顶级模型制造商Google目前提供的任何产品都要出色。当越来越多的人涌入马拉松赛道,当流量和热度成为衡量赛事成功的标准,何杰和李芷萱用行动给出了另一种答案:回归奔跑的本质,在最适合自己的赛道上,跑出最好的自己。来自另两家中国实验室DeepSeek和MiniMax的模型也很受欢迎。根据Firefox浏览器制造商Mozilla的报告,开源权重模型在推理和复杂智能体工作方面仍落后于前沿,但现在被普遍认为对许多任务“足够好”(good enough)。

E |          它们的成本也低得多——在公司应对AI不断上升的成本时,这是一个重要优势。另一家研究公司Artificial Analysis追踪选定模型在其一系列测试中执行每项任务的成本。DeepSeek提供的最强系统平均每个任务花费0.04美元。尚未开源的K3平均每个任务花费0.95美元。

F | Fable的用户预计需要支付2.75美元。亲爱的跑友,您说呢?欢迎大家留言参与讨论。

G |          部分成本差异来自几乎任何云提供商都可以出售对开源权重模型的访问权,从而压低利润率。例如,DeepSeek以每百万tokens 0.28美元的价格提供其v4 flash模型的访问权,而最便宜的第三方提供商则提供每百万0.18美元的价格。         更重要的是,许多开源权重模型的训练特别注重运行效率,部分原因是中国实验室因美国对先进芯片的限制而在获取计算能力方面面临挑战。像“专家混合”(mixture of experts)模型这样的创新——仅激活AI系统中与查询相关的部分——已被开源权重开发者广泛采用,DeepSeek和阿里巴巴等实验室在这一技术上取得了重大进展。         然而,开源权重模型的吸引力更深层次。由于美国政府仓促试图将Fable模型仅限美国公民使用,导致该模型在全球范围内三周无法使用,这促使许多公司审视自己对单一实验室的依赖。这鼓励他们尝试可以通过多个提供商访问、甚至可能在内部服务器上运行的开源权重替代方案。

H | Mozilla首席技术官Raffi Krikorian指出,这一事件起到了“警示射击”(shot across the bow)的作用。         (注:本文编译自《经济学人》7月22日文章,原链接:https://www.economist.com/business/2026/07/21/americas-ai-labs-are-under-threat-from-cheap-chinese-rivals)。

Current article:http://kwx.recuigoutoubaozukai.pics/2chh1/tctz.html

Published on:03:16:10


24小时排行

热点推荐