|
|
此文章由 dootbear 原创或转贴,不代表本站立场和观点,版权归 oursteps.com.au 和作者 dootbear 所有!转贴必须注明作者、出处和本声明,并保持内容完整
金融时报:月之暗面掀起AI冲击波,美国这次恐难轻松化解
DeepSeek震动全球一年多后,另一款来自中国的“开放”人工智能模型,再次给硅谷带来强烈冲击。这一次,美国AI公司可能更难轻松应对这一挑战。美国采取反制行动的可能性也因此进一步上升,而这将给AI企业及其客户带来难以预测的后果。
最新一轮冲击来自中国初创企业月之暗面(Moonshot)上周发布的Kimi K3。该模型的能力已接近美国顶尖前沿AI实验室推出的最先进产品。
这引发的焦虑令人想起DeepSeek R1曾带来的担忧。R1的训练成本很低,似乎对美国企业耗资更高开发的模型构成威胁。不过,华尔街后来逐渐接受了这一挑战,认为美国前沿模型仍拥有明显优势,尽管领先时间已缩短至不到一年。
但Kimi K3,以及上个月发布的GLM 5.2和阿里巴巴周末公布的Qwen 3.8等其他中国模型,几乎已经完全抹去美国的时间优势。
部分美国官员迅速指责月之暗面抄袭美国竞争对手,采用一种名为“蒸馏”的技术,同时规避美国对先进芯片的出口管制。不过,越来越多迹象显示,真正的创新正发挥日益重要的作用。
就连OpenAI一名高级管理人员也承认,Kimi K3的进步看起来并非来自模仿。该模型相较早期产品所作的架构改进,也获得美国业界赞赏。这看起来是真正的竞争,而不仅仅是复制。
从经济角度来看,这种竞争会产生什么影响,目前并不明确。开放权重模型是开源软件的一种有限形式,通常价格更低,因为开发这些模型的公司并不打算收回全部训练成本,而且模型可以在客户自己的系统上运行,或者由在价格上相互竞争的云计算公司托管。
不过,Kimi K3这类超大型模型的运行成本依然高昂。此外,对用户而言,真正重要的成本并不是每个token的价格。Token是模型输出的基本计价单位,但用户真正承担的是完成一项任务的总成本。
一些模型可以使用更少的token完成任务,或者产生更少的“幻觉”,这意味着需要投入较少人力来验证其答案。
尽管如此,最近密集出现的中国模型,似乎将给最先进的人工智能产品带来更激烈的价格竞争。现在的问题是,美国AI企业,以及华盛顿和北京的政策制定者将如何回应。
美国前沿AI实验室需要加快转型,不再只是出售原始智能能力,而是把这些能力包装成能够完成更高价值任务的智能体。这种做法已经在编程领域取得成效,但Kimi K3等模型正在迅速追赶,迫使美国实验室不断寻找新的应用场景。
更激烈的竞争也提高了前沿AI实验室贴近用户的紧迫性。它们需要利用客户数据和商业背景,提高模型的实际价值,同时将模型深度嵌入客户的工作流程。对OpenAI和Anthropic而言,问题在于,它们能否在进行规模庞大的首次公开募股之前,证明这些措施已经取得实质性进展。
地缘政治影响则更加难以预测。Kimi K3发布之际,习近平刚刚将开源人工智能宣传为中国向全球推广科技实力的重要组成部分。然而,仅仅几天后,《金融时报》报道称,中国正在考虑对部分技术实施出口管制,其中包括限制外界获取最先进模型的权重。模型权重是决定模型如何作出回应的参数。
这反映出中国科技战略中正在出现一种矛盾。一方面,中国正推动以出口为导向的发展模式,强调技术广泛普及和低成本;另一方面,中国也越来越意识到保护本土技术的必要性。这种矛盾最终将如何发展,目前尚不清楚。
华盛顿方面则显露出作出本能式反应的种种迹象。美国财政部长贝森特暗示,美国可能打击使用蒸馏技术的中国企业。不过,如果模型本身已经公开,要阻止其知识产权外泄将十分困难。
美国还有其他理由试图遏制中国先进人工智能的发展,例如这些模型可能带来的网络安全风险。但即使美国成功将本国市场变成只保护美国前沿模型的区域,从全球角度看,结果也可能适得其反。
世界其他地区的企业仍然可以使用价格低廉的中国模型,而仅仅禁止美国机构使用这些模型,也无法解决网络安全威胁。


来源:
https://www.ft.com/content/ce76e ... 11f2?syn-25a6b1a6=1
Richard Waters
Published5 hours ago
73 |
|