找回密码
 点击注册
搜索
查看: 3305|回复: 7

中国AI模型Kimi的领先水平震惊了人工智能界

[复制链接]
发表于 2026-7-17 08:41:18 | 显示全部楼层 |阅读模式

中国开发的AI模型Kimi以领先水平的成绩震惊了人工智能界

新一代模型Kimi K3于16日发布,参数规模达2.8万亿

新一代模型Kimi K3于16日发布,参数规模达2.8万亿


据Axios报道,中国人工智能初创公司 Moonshot AI 周四发布了一款全新的大型模型,令开发者们震惊不已。该模型可能与美国最好的系统相媲美,而成本却只有后者的一小部分。

重要性: Kimi K3 的早期表现令整个人工智能界惊叹不已,同时也引起了硅谷和华盛顿的警惕,因为中国似乎正在迅速抹去美国在先进人工智能领域的领先地位。

赶紧跟上: Moonshot 表示 Kimi K3 包含 2.8 万亿个参数,使其成为有史以来发布的最大的开放权重 AI 模型之一。

它拥有 100 万个标记的上下文窗口,可以一次处理大量文本,并且可以处理文本和图像。

在AI 评估机构 Arena的盲测中,开发者们更喜欢 Kimi 而不是所有领先的美国前端编码模型——包括 Anthropic 的 Fable 5 和 OpenAI 的 GPT-5.6 Sol。

在Arena 更广泛的文本排名中,K3 也超过了 Anthropic 的标准版 Opus 4.8(几周前还处于人工智能前沿的模型),并与 Sol 并列。

从宏观角度来看: Moonshot 提供的 K3 价格远低于它所挑战的高端型号,这引发了新的疑问:美国实验室还能对前沿情报收取高价多久?

Mozilla 首席技术官 Raffi Krikorian告诉Axios:“目前,这是一个美国与中国的问题。”

他表示,美国人工智能实验室“显然很担心”,并认为,除非这些实验室的首席执行官们认为开放权重模型(中国公司主导的这一类别)构成严重的竞争威胁,否则他们几乎没有理由游说华盛顿反对这些模型。

放眼全局: Kimi 的发布恰逢 2026 年上海世界人工智能大会召开前夕,届时中国国家主席习近平预计将阐述北京在人工智能领域的优先事项。

Moonshot 的国内竞争对手 DeepSeek 也预计很快会发布升级版机型,这增加了中国科技领域在短时间内取得又一次重大突破的可能性。

但是, Kimi 才推出几个小时,早期的基准测试和病毒式传播的演示可能夸大了它在实际工作中的可靠性。

Moonshot 表示将于 7 月 27 日发布 K3 的权重,这意味着开发者目前还不能独立检查、修改或运行该模型。

K3 的价格约为每百万枚代币 12 美元,这并非中国代币价格通常为人称道的低价——它的定价更接近 Anthropic 的中档产品,而不是 Moonshot 早期产品提供的大幅折扣。

结论是,随着中国实验室竞相降低前沿人工智能的成本并使其更广泛地普及,美国在先进人工智能领域的领先优势正在逐月缩小。

 楼主| 发表于 2026-7-17 08:42:39 | 显示全部楼层

Kimi K3 是月之暗面公司于 2026 年 7 月 16 日发布的新一代 AI 大模型,参数规模达 2.8 万亿,支持 100 万 Token 上下文,目前可通过 Kimi 开放平台 体验 。‌‌‌

发布与核心规格
‌发布时间与开发者‌:Kimi K3 已于 2026 年 7 月 16 日正式发布,由北京月之暗面科技有限公司(Moonshot AI)开发,是 Kimi 系列迄今能力最强的旗舰模型 。
‌参数与上下文‌:模型参数规模达 2.8 万亿,支持 100 万 Token 上下文窗口,是目前全球参数最大的开源模型之一 。
‌开源计划‌:官方宣布将于 2026 年 7 月 27 日全面开源,开发者可免费下载权重并自行部署 。‌‌‌

技术架构与性能表现
‌核心技术‌:
采用自研 Kimi Delta Attention (KDA) 混合线性注意力机制与 Attention Residuals 结构,实现百万级上下文下 6.3 倍解码加速 。
基于 MoE 混合专家架构,共 896 个专家模块,每次推理仅激活 16 个,优化计算效率 。
原生支持视觉理解,具备多模态处理能力 。‌‌‌

‌评测表现‌:
在 GDPval-AA v2 知识工作评测中得 1687 分,超过 Claude Opus 4.8 Max(1600 分),仅次于 Claude Fable 5 Max 和 GPT-5.6 Sol Max。
在 BrowseComp 信息检索测试中获 91.2 分,单智能体模式下无需额外上下文压缩 。
Frontend Code Arena 中 1679 分,7 个领域 6 个位居第一,仅游戏领域略逊于 Fable 5。‌‌‌

应用场景与获取方式
‌主要场景‌:面向软件工程、知识工作、深度研究及多模态理解等复杂任务,擅长长程智能体编程与端到端工作流 。‌‌‌
‌API 服务‌:
输入费用:缓存命中 2 元/100 万 Tokens,未命中 20 元/100 万 Tokens。
输出费用:100 元/100 万 Tokens。‌‌‌
‌访问渠道‌:可通过 Kimi 开放平台调用 API,或等待 7 月 27 日开源后本地部署 。‌‌‌

 楼主| 发表于 2026-7-17 08:43:17 | 显示全部楼层

月之暗面发布全球最大开源模型Kimi K3 参数规模达2.8万亿

智通财经APP获悉,7月16日,月之暗面宣布正式推出 Kimi K3,其迄今能力最强的模型。这是目前全球参数最大的开源模型,标志着我国人工智能模型发展迈出新的一步。

据介绍,Kimi K3是一个2.8万亿参数模型,基于KDA混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有100万token上下文窗口。它是全球首个开源的3万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。

Kimi K3重点优化智能体编程(Agentic Coding)能力,能够理解大型代码库、调用工具、执行测试,并根据反馈持续调整任务方案。同时,K3采用更高稀疏度的MoE设计,据社区整理信息显示,模型拥有896个专家模块,但每次推理仅激活16个专家,在扩大模型容量的同时控制计算成本。

媒体报道称,月之暗面Kimi K3模型系列最新版本,预计将达到甚至超越Anthropic Opus 4.8的效能水平。

月之暗面表示,虽然Kimi K3的整体表现仍落后于最强的闭源模型Claude Fable 5和GPT-5.6 Sol,但它在其整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。

即日起,可通过kimi.com、最新版Kimi手机App、最新版Kimi Work桌面客户端、Kimi Code和Kimi API,使用Kimi K3模型。当前默认思考强度为max(极致),后续更新后会增加low和high两种模式。
 楼主| 发表于 2026-7-17 08:44:05 | 显示全部楼层

据新华社上海7月16日电 2026世界人工智能大会暨人工智能全球治理高级别会议即将举行之际,新一代模型Kimi K3于16日发布,参数规模达2.8万亿。这是目前全球参数最大的开源模型,标志着我国人工智能模型发展迈出新的一步。

发布模型的北京月之暗面科技有限公司介绍,Kimi K3原生支持视觉理解,具备100万词元上下文窗口,面向软件工程、知识工作、深度研究、多模态理解等复杂任务场景进行优化,进一步提升了大模型复杂任务的处理能力。

“参数越大,能力上限越高,可以提供更智能的模型表现。”月之暗面有关负责人表示,参数就像人脑里的神经连接,近3万亿参数意味着这个模型能把更多的知识和规律装进“脑子”,懂得更多、想得更深、答得更准。

当前,人工智能技术加速迭代,正迎来爆发式发展。前沿人工智能的发展,正在逐步转向算法创新、工程组织、应用能力和资源效率的综合运用。

据了解,在评测中,Kimi K3综合智能水平接近全球前沿的闭源模型。月之暗面有关负责人介绍,在训练Kimi K3新一代基座大模型的过程中,其使用了自主研发的底层模型架构,并积累形成了一整套科学的模型训练方法。

近年来,中国高度重视人工智能发展,推动人工智能综合实力整体性、系统性跃升,并同世界共享发展经验和技术产品。

北京中关村学院院长刘铁岩说,技术的生命力在于开放流动,一批中国开源大模型从“单点亮相”走向“群体突破”,为世界人工智能发展提供了新方案、新路径,将加快推动人工智能技术向上向善发展。
 楼主| 发表于 2026-7-18 14:05:43 | 显示全部楼层

中国AI模型花48小时跑通芯片设计,美国EDA巨头股价暴跌!Kimi K3搭载2.8万亿参数开源挑战GPT、Claude双雄,马斯克:令人印象深刻


7月17日凌晨,Kimi K3正式亮相。据官方披露,Kimi K3搭载2.8万亿参数规模,配备100万Token(词元)超长上下文窗口,原生兼容视觉理解能力,是当前全球参数体量最大的开源大模型,直接将开源阵营的技术门槛抬升至3万亿级别。

Kimi K3发布后,第三方评测数据显示,Arena AI的Code Arena榜单上Kimi K3得分1679,位列第一,超过行业双雄Claude Fable 5和GPT-5.6 Sol。本次Kimi新模型的发布还得到特斯拉CEO(首席执行官)马斯克的关注,他在评论区留言道:“Impressive(令人印象深刻)。”

伴随国产大模型在全球AI赛道话语权的持续提升,行业竞争重心已从参数比拼转向商业价值兑现。

Kimi K3系统架构

Kimi K3系统架构

Kimi K3系统架构


图片来源:月之暗面官网

来自华尔街的消息称,市场担忧,如果中国高性能AI模型获得更多采用,可能影响美国AI企业资本开支预期及高端芯片需求。

昨夜美股大型科技股普跌,英伟达、Meta、谷歌跌超2%;费城半导体指数跌1.63%,较6月22日创下的历史高点下跌20.2%,进入技术性熊市。全球EDA(电子设计自动化)巨头新思科技、铿腾电子均一度大跌超12%,新思科技收跌7.85%,铿腾电子收跌9.47%。

消息面上,月之暗面表示在连续48小时的自主 Agent(智能体) 运行中,K3基于开源EDA工具和Nangate 45nm工艺库,独立完成了芯片的构建、优化与验证。


48小时跑通芯片设计

Kimi瞄准长程编程能力

具体到模型的测试表现,在编码(coding)专项测评中,Kimi K3呈现出较突出的竞争力。在测试超长程软件工程任务能力的SWE Marathon测评中,Kimi K3以42.0分位列第一;而在AI终端操作能力基准测试的Terminal Bench 2.1和评估AI模型软件工程能力的FrontierSWE两项测评及其自研内部代码测试集Kimi Code Bench 2.0中,Kimi K3则略有落后排在第二。

通用智能体赛道下,Kimi K3在自动化操作、网页深度检索、办公类实操任务测试中优势明显。从Kimi披露的测试结果综合来看,Kimi K3整体表现虽未能超越闭源模型Claude Fable 5和GPT-5.6 Sol,但与头部两款闭源模型差距较小。

值得一提的是,本次Kimi在介绍中也特别提到了架构层面变化带来的效率提升。Kimi K3基于Kimi Delta Attention(KDA)混合线性注意力机制和Attention Residuals(AttnRes)注意力残差技术构建。MoE(混合专家)层面,模型在896个专家中激活16个。而上述结构性改进让Kimi K3 相比K2的整体扩展效率提升约2.5倍。

Kimi重点突破的长程编码能力在案例上也有具体体现。Kimi具体介绍了Kernel优化、创作数字作品、芯片设计等几项涉及侧重不同能力需求的应用场景。

其中Kimi K3设计了一款芯片,用于运行一个基于自身架构构建的nano模型。官方表示在连续48小时的自主 Agent(智能体) 运行中,K3基于开源EDA工具和Nangate 45nm工艺库,独立完成了芯片的构建、优化与验证。该芯片能够在100 MHz下完成时序收敛,仿真解码吞吐持续超过每秒8700个Token。

K3不是孤立的产品。月之暗面于6月中旬发布的K2.7 Code、Kimi Work也已经在做垂直方向的尝试。

K2.7 Code专攻编程场景,Token消耗比前代降低30%,后来又追加了高速版。Kimi Work则把Agent能力搬到桌面端,支持本地文件操作、浏览器自动化和定时任务,并提供可连续工作24小时的目标模式,以及接入飞书、WPS、钉钉等第三方应用的插件中心。

桌面Agent正在成为各家大模型研发企业落地的共同选择。百度、阿里等把Agent集成进办公套件,6月底豆包也开启了付费功能,重点覆盖办公和Agent场景,月费从68元到500元分了三档。行业整体转向让AI直接在工作流里干活,而不是停留在聊天框。

K3的发布,给应用提供了更强的模型底座,Kimi Work也同步新增了小组件和看板两项功能,把对话输出变成可持续查看的可视化界面。

值得一提的是,官方主动列出三点模型目前存在的局限:一是对历史思考内容敏感,中途切换模型或框架不兼容可能导致上下文干扰,导致内容生成质量不稳定;二是训练侧重长程高难任务,简单场景下模型可能“过于主动”,替用户做非预期判断。而对于这两点Kimi官方也都给出了简单的使用指南;三是“尽管Kimi K3总体上是一个非常有竞争力的模型,但与Claude Fable 5和GPT-5.6 Sol相比,在用户体验上仍有一定差距”。

目前,Kimi K3的完整模型权重尚未发布,月之暗面表示将于今年7月27日前发布。更多技术细节将随技术报告一并公布。


行业涨价潮来袭

大模型商业化进入兑现期

与模型能力一同走高的还有模型价格。

Kimi K3的API(应用程序编程接口)定价为:输入每百万Token 2元(命中缓存)和20元(未命中),输出每百万Token100元。官方称编程场景缓存率超过90%,折算下来实际输入成本低不少。

据第三方机构Artificial Analysis测算,Kimi K3单任务成本约0.94美元,与GPT-5.6 Sol的1.04美元接近,约为Claude Opus 4.8(1.80美元)的一半。

整体来看,涨价已是全行业的主旋律。智谱GLM-5系列已经分三轮上调价格。DeepSeek宣布V4正式版上线后实行峰谷定价,高峰时段价格翻倍。此前,Kimi的价格也有所上涨,从K2的每百万Token 4元涨到K2.7 Code的6.5元,涨幅约60%。

月之暗面B端(商家端)负责人黄震昕近期公开表示,供需两端挤压下,API涨价是必然趋势。用户愿意为高性能支付溢价,厂商则通过缓存优化、推理效率提升来对冲成本。目前Kimi原厂服务的缓存命中率超过90%。

在涨价之外,各家企业在商业化路径上分化明显。有的押注企业私有化部署,有的深耕开发者生态拓展付费用户。而Kimi的选择是B端和C端(消费者端)同时发力。黄震昕提到,互联网、金融、制造、教育、医疗是目前主要的企业客户来源。海外市场增长更快,付费用户和API收入都增长了400%,产品进入200多个国家和地区。

C端最有话题性的尝试是Kimi信用卡,这款联名卡已于7月10日正式发行,合作方是美国运通和农业银行(6.390, 0.09, 1.43%)。通过这张卡,用户可以把消费积分换成Kimi算力额度和Agent使用权,相当于用金融权益做C端获客和留存。项目从4月酝酿到7月落地,3个月走完流程,知情人士称双方“一拍即合”。然而类似的跨界合作在行业里不多见,效果如何还需要时间验证。

商业化探索背后,是估值火箭般的攀升。过去半年,月之暗面完成三级跳:2025年12月估值43亿美元,今年5月D轮后跃至200亿美元,6月又被曝出新一轮融资投前估值达315亿美元,半年增长超6倍。

当前,大模型头部梯队的资本化竞速全面铺开,智谱、MiniMax已先后登陆港股,在股价高点时市值分别冲到万亿港元、千亿港元级别。月之暗面此刻的每一步商业化试探,也都承载着资本市场的高预期。

而在闭源模型持续领跑、国产同行加速追赶的格局下,K3能给月之暗面带来多大的实际优势?面对定价的抬升,Kimi K3能否呈现出与价格匹配的良好表现?这些都还需要进一步检验。

每日经济新闻


发表于 2026-7-20 18:36:55 | 显示全部楼层

工业和信息化部:我国人工智能开源大模型全球累计下载量突破100亿次

7月20日上午,国务院新闻办公室举行新闻发布会介绍2026年上半年工业和信息化发展情况。

工业和信息化部总工程师王卫明介绍,今年以来深化拓展“人工智能+”,规模以上制造业企业人工智能技术应用普及率超30%,人工智能开源大模型全球累计下载量突破100亿次。加快打通“科技—服务—产业”闭环,发布第二批111家重点培育中试平台,认定14家卓越级、402家标准级科技型企业孵化器。充分发挥国家科技重大专项引领作用,加快关键核心技术、根技术攻关突破。量子计算原型机“九章四号”刷新光量子信息技术世界纪录,全球首款侵入式脑机接口医疗器械获批上市。

发表于 2026-7-20 18:37:40 | 显示全部楼层

人工智能竞赛一分为二,中国开源模型攻城略地

据Axios报道,中国在人工智能领域的最新突破迫使硅谷面对一个可怕的可能性:打造世界上最智能的模型可能不再足以赢得胜利。

重要性:像登月计划这样的中国实验室正在垄断廉价、可定制的人工智能市场,有可能将美国的高端机型变成昂贵的奢侈产品。

新闻要点:在 Moonshot 的 Kimi K3 本周横空出世之前,各公司就已经开始放弃高端 AI 模型,转而使用更便宜的中国替代品。

在OpenRouter(一个允许开发者访问数百个相互竞争的 AI 系统的主要市场)上,中国模型目前按每周代币使用量排名前五。

这五款产品——分别来自中国的腾讯、小米、DeepSeek、MiniMax 和 Z.ai——都是“开源”的,允许用户下载、定制并在自己的系统上运行。

言外之意:大多数企业人工智能工作并不需要最智能的模型。

企业可以使用价格较低的系统进行日常编码、摘要、数据提取和客户服务,而将高级型号留给最棘手的问题。

一位人工智能投资者告诉 Axios:“最终将会出现开源模型来处理 95% 的企业查询,而剩下的 5% 可能会落入 OpenAI 或 Anthropic 手中。”

他们说: Kong 首席执行官 Augusto Marietti 告诉 Axios,由于旗舰型号“太贵”,过去一个季度开放重量级的使用量激增。

Mozilla 首席技术官 Raffi Krikorian 将使用前沿人工智能进行日常工作比作“开着法拉利去全食超市”。

他表示,对于许多日常任务而言,价格较低的型号速度足够快、功能足够强大,而且价格可以便宜多达 50 倍。
威胁等级:中国AI模型正以惊人的速度发展,而且价格更低、重量更轻,因此更容易被接受。

Anthropic 首席执行官 Dario Amodei 在 5 月份表示,中国在最危险的网络能力方面仍然落后美国 6 到 12 个月。

十周后,Moonshot 发布了一款模型,在关键基准测试中可与 Anthropic 的 Fable 和 OpenAI 的 GPT-5.6相媲美——这凸显了美国的任何领先优势都可能迅速缩小。

另一方面:随着中国威胁要抢占开放式人工智能的先机,一些美国公司正争先恐后地进行反击。

由前 OpenAI 首席技术官 Mira Murati 创立的初创公司Thinking Machines本周推出了备受期待的首秀,其推出的是一款专为深度定制而构建的开放权重模型。

英伟达正在迅速扩展其 Nemotron 系列开放式模型,押注可定制的人工智能将推动对该公司芯片和软件的更多需求。

本周,SpaceXAI开源了其编码代理背后的软件 Grok Build,将开放性推向了模型本身之外的领域。

从宏观角度来看:如果企业能够从自己掌控的更便宜的模式中获得所需的大部分东西,那么硅谷的“皇冠上的明珠”可能很难证明其高昂价格及其背后巨额投资的合理性。

OpenAI 和 Anthropic 正在准备进行轰动性的 IPO,其估值取决于前沿人工智能保持稀缺性、不可或缺性和盈利性。

任何破裂的影响都将远远超出硅谷:人工智能支出在美国经济增长中占据了过大的份额,而股市已经高度依赖于少数几家搭上这波繁荣顺风车的公司。

Mozilla 的 Krikorian总结道: “他们显然很害怕”,他指的是面对中国竞争对手迅速崛起的美国实验室。


发表于 2026-7-21 11:23:18 | 显示全部楼层

中国AI新模型让硅谷不安

法国世界报周一刊出的一篇文章强调,中国AI让硅谷感到不安。文章表示,中国近期接连推出了多款性能极其强大、并且采用开放模式的人工智能模型,其中,月之暗面刚刚发布的新一代大模型Kimi3尤其成为市场关注的焦点。

7月16日,月之暗面发布了最新的大模型Kimi3。消息公布后,美国纽约纳斯达克指数受到冲击,市场震动不小。业内人士惊讶地发现,在部分性能指标上,该模型接近甚至超过部分美国领先模型,并在综合智能评测中位居世界前列。

另外,在Kimi3发布前大约一个月,北京另一家AI初创公司--智谱也于6月中旬推出了自己的新模型。

法国世界报表示,近年来,美国一直认为,由于华盛顿禁止向中国出口英伟达最先进的AI芯片,中国企业至少落后美国几个月甚至几年。然而,这种看法如今正开始受到挑战。

法国世界报指出,确实,月之暗面和智谱都没有透露自己训练模型所使用的具体芯片。但中国AI迅速发展的一个重要特点,是中国工程师在芯片受限的情况下,更加注重算法的优化和资源利用的效率,大量采用“专家混合(Mixture of Experts,MoE)”等先进架构,在处理不同任务时只激活模型中相关的部分模块,大幅降低计算成本,不断提高算力资源使用的效率。法国世界报表示,大多数业内专家认为,中国工程师成功地把“芯片不足”转化为了优势。

开源,成为中国AI的新旗帜

法国世界报表示,更重要的是,包括Kimi3在内的中国AI模型,采用开源模式,开发者可以免费下载、部署和修改模型,而美国主要AI企业仍以收费、封闭模式为主。中国AI的开放策略不仅降低了AI应用的门槛,也有利于AI的快速传播和AI生态的建设。

开源是中国AI最鲜明的特点之一。“开源”不仅是一种技术选择,也逐渐成为中国AI发展的重要理念,被视为与美国封闭商业模式相区别的重要优势。

中国AI高度竞争,百花齐放

法国世界报认为,中国AI产业的迅速崛起,还得益于中国高度竞争的AI产业环境。

中国政府将人工智能视为未来国际竞争的关键领域之一,并把追赶甚至超越世界AI领先水平列为国家战略重点。

与此同时,中国互联网巨头也在展开激烈竞争。在深圳、杭州,以及北京等地,不断涌现新的AI创业公司,整个行业充满活力。

除了月之暗面、智谱和DeepSeek,中国已经拥有大量成熟的AI企业,比如:MiniMax、字节跳动的豆包、阿里巴巴的通义千问、腾讯的混元等多个大型模型共同发展,推动中国AI整体水平不断提升。

中国拥有大量优秀的AI人才

法国世界报还指出,中国拥有大量优秀的AI人才。许多企业创始人毕业于像清华大学这样的顶尖高校,并曾在美国知名大学或国际科技公司学习、工作。例如,月之暗面创始人杨植麟曾在美国卡内基梅隆大学攻读博士,并先后在元宇宙(Meta)和谷歌大脑(Google Brain)工作,之后回国创办企业,成为中国AI新生代代表人物。

RFI
您需要登录后才可以回帖 登录 | 点击注册

本版积分规则

Archiver|小黑屋|SiXiang.com 思乡思想

GMT+8, 2026-8-7 23:56

Powered by Discuz! X5.0

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表