一种新型的、价格低廉的中国人工智能模型正在迎头赶上 Anthropic 和 OpenAI 等公司
概要:
西方初创企业对转向使用更便宜的中国人工智能越来越感兴趣。
Z.ai 的 GLM-5.2 性能几乎与 Claude Opus 4.8 一样出色。
西方企业采用西方模式因数据安全问题而变得复杂
北京/班加罗尔,7 月 2 日(路透社)——自从 DeepSeek 去年初凭借其廉价而强大的 AI 模型震惊市场以来,全球消费者面临着一个选择:要么选择价格更低、功能较弱的中国产品,要么选择 OpenAI 或 Anthropico,这两家公司已投入数十亿美元进行开发。
北京初创公司 Z.ai 上个月推出的GLM-5.2模型,或许最终能够缩小西方关注度方面的差距。
GLM-5.2 的编码和代理功能(即在极少提示下执行复杂任务的能力)让硅谷沸腾起来,其性能几乎可以与美国领先的产品相媲美,而成本却只有后者的一小部分,一些专家称之为“迷你版 DeepSeek 时刻”。
它迅速攀升至 OpenRouter 等第三方 AI 开发者平台的使用排行榜,目前排名高于 Anthropic 的模型,而从云数据平台 Snowflake 的首席执行官 Sridhar Ramaswamy 到风险投资家 Marc Andreessen 等高管都对其能力赞不绝口。
“我们现在有了一个中国开源模型,它与 OpenAI 和 Anthropic 目前提供的模型一样好,”美国总统唐纳德·特朗普的前人工智能沙皇大卫·萨克斯上周表示。周二,华盛顿方面解除了对 Anthropic 的 Fable 和 Mythos 模型的限制。
这些功能使 Z.ai 的 GLM-5.2 模型成为一场日益激烈的辩论的核心,这场辩论的焦点是中国是否最终在人工智能竞赛中赶上了美国。与此同时,科技高管警告说,华盛顿对该行业的不可预测的监管可能会阻碍其在前沿技术领域的领先地位。
Sacks 在 All-In 播客节目中谈到 GLM-5.2 时说:“它比 Anthropic 的 Opus 4.8 略逊一筹,与 OpenAI 的 GPT 5.5 不相上下。”他还补充说:“我们不能做任何会拖慢公司发展速度的事情。”
一些专家表示, 对 Anthropic 限制,以及OpenAI 最新 GPT-5.6 模型的延迟公开推出,刺激了全球对中国模型的需求。
“国际开发者社区越来越意识到,仅仅依赖美国专有的 API 模型会带来重大风险,”总部位于北京、专注于人工智能安全的咨询公司 Concordia AI 的创始人兼首席执行官 Brian Tse 表示。
GLM-5.2 在全球范围内受到的积极反响也表明,人们对更便宜的开源开发越来越感兴趣,因为企业正因使用 AI 完成任务的成本不断上升且往往难以预测而遭受损失,因为闭源代理 AI 工具消耗的代币(用于衡量 AI 使用情况的单位)更多。
长期以来,它一直被视为衡量全球经济状况的一种方式,但现在出现了一个新因素:人工智能。
Z.ai(又名智普AI)拒绝置评。Anthropic和OpenAI尚未立即回复置评请求。
GLM-5.2 目前在 Artificial Analysis 的大型语言模型 (LLM) 智能排行榜上位列第五,该排行榜根据一系列旨在衡量整体能力(包括推理和编码技能)的基准测试对模型进行排名。同时,它在 Code Arena 的前端编码排名中位列第二,该排名衡量模型生成网站和前端应用程序的能力,而其运行成本约为 Claude 和 GPT 系列等封闭式美国前沿模型的六分之一。
Z.ai 没有透露其为开发 GLM-5.2 花费了多少资金。
上个月,Z.ai 创始人唐杰在回复埃隆·马斯克关于 X 的提问时表示,这家中国初创公司可以在明年第一季度之前生产出与 Anthropic 的 Fable 相媲美的车型。
“GLM-5.2 带来的转变是,开源模型变成了一个即插即用、开箱即用的产品,”Hugging Face 的前亚太区负责人王铁珍说道。Hugging Face 是一家初创公司,为开发者提供了一个改进开源模型的平台。
“你只需部署模型,无需进行任何复杂的系统微调,它就能立即投入使用,非常方便。这大大降低了开源软件的普及门槛。”
说服美国企业
GLM-5.2大规模应用的一大障碍仍然是数据安全问题,这限制了美国企业,尤其是银行和网络安全等受监管行业,对中国模型的使用。王先生表示,企业人工智能系统的迁移和升级通常需要几个月的时间。
“我看到一些欧洲公司在讨论它是否可以在企业环境中使用,”Counterpoint Research 的首席人工智能分析师魏孙表示。
“在欧盟和美国,一些客户、合作伙伴和受监管行业可能根本不愿意在其人工智能技术栈中接受中国模型,无论其技术性能或价格如何。”
今年早些时候,非营利组织兰德公司发布的一份报告显示,基于对135个国家网站流量数据的分析发现,自去年1月DeepSeek推出R1模型以来,中国LLM(学习型管理软件)的全球市场份额在短短两个月内从3%跃升至13%。该模型的发布引发了全球科技股抛售潮,因为它与DeepSeek的低成本优势形成鲜明对比,而其他公司则在人工智能基础设施方面投入巨资。
中国LLM的使用增长在发展中国家以及与北京有着密切政治和经济联系的国家最为显著。
一些专家表示,对中国人工智能模型安全性的担忧被夸大了,他们认为,在美国云服务提供商或公司自有服务器上运行这些模型就能确保数据安全。虽然大型企业迁移速度缓慢,但科技初创公司和中小企业的迁移速度要快得多。
“开发者往往不太关心模型的来源,而是更关心它是否有效、成本多少以及他们是否可以可靠地部署或访问它,”中国科技分析师、Hello China Tech 时事通讯创始人 Poe Zhao 表示。
“可能的模式是部分路由,而不是一夜之间取代 OpenAI 或 Anthropologie。所以,是的,这有点像 DeepSeek 的翻版,但规模更小,更侧重于开发者。”
|