智东西(公众号:zhidxcom)
作者 | 江宇
编辑 | 漠影
7月24日上午,北京市委主要领导围绕智能经济调研,走进了三家AI企业:360、月之暗面与千寻智能。
在此之前的一周,Kimi K3刚刚完成了一场惊艳的全球亮相。马斯克在社交媒体上将它列为Grok 4.5的“重点追赶目标”,OpenAI战略负责人坦言其性能“无法靠简单蒸馏实现”,高盛出了一份研报,写着“中国大模型走向定价权的全新节点”。一时间,全世界的目光都聚向了北京。
但如果只看到Kimi一家公司,或许就错过了北京AI正在发生的真正变化。
13公里之外,另一家北京企业千寻智能的Spirit v1.6模型,早已在RoboArena登顶全球第一,超越英伟达DreamZero与Physical Intelligence Pi0.5,成为中国首个登顶该榜的具身模型。
它的Moz1机器人不仅可以仅凭一句自然语言指令便完成了“客厅收纳”的长程任务,同时已在宁德时代产线常态化运行,作业成功率稳定在99%以上;

新一代商服机器人Moz2则在WAIC期间惊艳亮相。

两家公司,一个让AI在数字世界里学会思考,一个让AI在物理世界里学会行动。外界可能会把它们放进不同的赛道——大模型、具身智能,互不搭界。
但正是这两家看似不搭界的公司,正在成为北京AI面向世界的“两张新名片”,共同勾勒出AI从数字空间走向物理世界的完整创新版图。
如果细细观察,你还会发现它们共享同一种“基因”:都押注底层技术创新而非应用层套壳,都在把底层能力开放给全球检验,并且都在各自领域站上了全球牌桌的最前排。
一、登月与“千寻万找”,他们都选了更难的路
Kimi的英文名叫Moonshot,千寻智能的名字则包含着“千寻万找”的寓意——一个要登月,一个要寻找答案。两家公司在取名这件事上不约而同地拒绝了宏大叙事,在技术路线上选了同一条爬坡之路。
Kimi K3的性能跃升,源于Moon Clip二阶优化器、Kimi Linear Tension线性注意力机制、Attention Residuals注意力残差三项底层原创架构,在优化器、注意力机制、残差连接等基础组件上做结构性突破。
月之暗面Kimi企业业务负责人黄震昕坦言:“我们的目标从来不是做高性价比的雕琢。”正如其名“Moonshot”所表达的,他们选择的是一场如同登月般艰难、却被其视为正确且有价值的技术探索。
千寻智能走的是同一条路。创始人兼CEO韩峰涛曾判断:“至少在第一波具身智能创业浪潮里,应该没有再做基座模型的机会了。”这意味着,沿着别人的技术路线做跟随式改良,连入场券可能都拿不到。

因此,千寻智能给出的选择是:从具身基座模型、一体化力控关节到数据采集体系全栈自研。
支撑其这一决心的,就包括千寻智能自研的具身基座模型Spirit v1.6。该模型采用VLA与世界模型深度融合的架构,从物理世界的感知与控制需求出发重构底层逻辑,回到Physical AI的第一性原理。如何在现有技术路线之外蹚出一条新路,是千寻必须回答的命题。

除此以外,这两家公司还有一个不容忽略的交集:两家公司的领军人物都来自清华。
Kimi创始人杨植麟出身清华,千寻联合创始人兼首席科学家高阳是“伯克利归国四子”之一,现任清华交叉信息研究院助理教授。
让顶尖学者走出实验室,做“难而正确”之事——这既是两家公司的共同底色,也是北京AI颇具辨识度的基因。
二、自信才开源:两条产品线,同一种价值
“开源模型不该贴上低价标签。”Kimi K3发布后,黄震昕曾这样回应。在此之前,千寻智能的Spirit v1.5也成为国内首个综合性能超越美国标杆Pi0.5的中国开源具身模型。
两家北京公司,不谋而合地在两条赛道上做同一件事:把开源模型的能力和商业化价值拉高了一档。
Kimi K3以开源模型身份登顶Frontend Code Arena编程榜榜首,首次在该榜单超越头部闭源模型,被外媒称为“DeepSeek 2.0时刻”。发布后供不应求,C端新用户订阅暂停。
在“开源=性能妥协”的行业惯性里,K3撕开了一道口子。
千寻在具身智能这个更年轻的赛道里做着同样的事:Spirit v1.5开源即超越Pi0.5,搭载Spirit v1.6的Moz1在WAIC现场首次挑战“一句话整理客厅”这样的长程复杂推理任务,打破了具身智能行业长久以来的“金鱼记忆”瓶颈。
在一个人人都在追问”具身智能能不能落地”的时期,千寻用开源和真机实操给出了另一种回答——中国团队做的具身模型,可以在性能上和全球顶尖选手正面较量。
两家公司在开源策略上的底层逻辑出奇一致:不是“做不出好的所以开源”,而是“做出了最好的所以开源”。
Kimi创始人杨植麟曾说:“我们既能做非常前沿的研究,又愿意把模型开源出来、把技术开放出来,这在全球来看是其他国家的企业很难做到的。”千寻亦是如此——从一开始的设计就是做通用具身模型,开源、开放、包容并蓄,啃行业最难啃的骨头。

三、垂直整合与逐步迭代,同一种“笨功夫”
如果把Kimi K系列和千寻智能Spirit系列的演进史放在一起,还能够看出不少共识。
“垂直整合”是两家公司共同的追求。Kimi坚持“模型公司一定要做模型”;千寻智能则是Physical AI基础模型方向的原生创新者。
两家公司的技术迭代都不是“毕其功于一役”。Kimi从底层架构三件套的逐步打磨到K3的爆发,千寻智能从Spirit v1到Spirit v1.5到Spirit v1.6的逐代跃迁,它们都在做长期、持续、可积累的进化。
垂直整合是下限,真实场景中的持续迭代决定了上限。Kimi和千寻在两条赛道上各自验证了同一件事:中国AI团队能够从基础层定义自己的技术路线,并使其成为一种可以被复用和放大的创新范式。
四、补上Action拼图:北京AI的两张新名片
Kimi在北京,千寻的策源地同样在北京。这座城市,正在批量产出全球前沿的AI公司。
北京拥有中国密度最高的AI人才池,为基础模型和前沿技术创新提供了持续的人才供给。
而在7月24日的调研中,北京也释放出三组明确关键词:“持续提升基础大模型能力”“探索世界模型多技术路线”“促进具身智能等前沿领域发展”——恰好与Kimi和千寻的技术主航道一一对应。
从全球竞争视角看,硅谷有OpenAI、Anthropic主导数字智能,有Figure、Optimus攻坚具身智能,但很难在同一座城市同时找到两条赛道的全球级选手。而北京恰恰聚集了两家。
Kimi和千寻智能的崛起,支撑起数字智能和物理智能两条全球AI前沿路线。如今,北京已经不仅拥有全球竞争力的大模型企业,也正在孕育具身智能领域的全球竞争者。
结语:数字智能与物理智能,中国玩家同步出牌
Kimi K3让世界看到了北京AI在数字世界的技术高度,千寻智能Spirit v1.6则证明了这种突破正在进入物理世界。
当马斯克将Kimi K3列为追赶目标,当Spirit v1.6在RoboArena中超越英伟达与Physical Intelligence——北京AI企业正在完成一次集体身份转变:从跟随者到定义者。
数字世界的智能边界正在被重新丈量,物理世界的智能版图刚刚开始绘制。而这一次,北京两家企业的坐标已经同时标在了两张地图的起点上。