苹果选择阿里千问,中美AI差距2.7%的拐点时刻

中美AI差距2.7%,苹果用脚投了票

2026年8月9日 · 阅读时间约8分钟
文|犀牛伯爵

8月8日下午,苹果中国官网的Mac使用手册里,悄无声息地多了一个页面。

标题是《在Mac上配合Apple智能使用千问》。内容不长,核心信息就一条。符合条件的中国大陆Mac用户,可以让Apple智能调用阿里巴巴的千问模型。设置路径写得很清楚,系统设置里找到Apple智能与Siri,点扩展,选千问,登录账户就能用。

用户能拿千问干什么?写作工具可以在备忘录和邮件里创作文本。Siri可以调用千问回答问题。官方文档里还举了个例子,你可以说"嘿Siri,让千问写一首关于龙的诗"。如果Siri判断千问能帮上忙,它会主动问你一句,要不要用千问来完成。

24小时不到,这个页面消失了。8月9日,财联社确认文档已被苹果删除。

苹果删得了文档,删不了已经传出去的信号。

两年评估,走到这一步

苹果和千问走到一起,不是突然发生的事。拉一条时间线,能看到一条很清晰的路径。

2024年起
苹果开始在中国市场寻找AI合作伙伴,据报道评估了多家中国AI公司的模型,历时两年多
2026年7月8日
Apple Intelligence在中国通过生成式AI服务备案
2026年7月15日
网信部门正式批准苹果在中国推出Apple Intelligence,阿里巴巴千问和百度同时成为技术合作伙伴
2026年7月下旬
库克在财报会议上确认,苹果已在中国获准推出首批Apple Intelligence功能
2026年8月8日
支持文档《在Mac上配合Apple智能使用千问》现身苹果官网
2026年8月9日
财联社确认,该文档已被苹果删除

阿里巴巴方面此前确认,千问将作为AI能力集成至Apple Intelligence,覆盖iOS、iPadOS、macOS和visionOS。这不是装个App的事,是系统级集成。苹果把AI能力底座交给了千问。

文档被删,原因还没有官方说法。可能是发布时机不对,可能还需要最后调整。但页面已经被人截图传开了,互联网有记忆。苹果的手指按了删除键,信号已经飞了出去。

从"追赶者"到"被选择者"

我的判断是这样的。国产AI已经跨过了一道门槛,从"追赶者"变成了"被选择者"。

这两个身份之间,隔着一道很多人还没反应过来的距离。追赶者意味着你在跑,别人也在跑,你只是离他更近了。被选择者意味着有人主动停下来,转过身,把手伸过来说,就你了。

苹果是全球市值最高的公司。Apple Intelligence是它最看重的战略级产品,没有之一。过去两年多,苹果的团队评估了多家中国AI公司的模型能力、中文理解水平、响应速度、安全合规。最后选了千问。

不是因为它便宜。千问在商业上的投入是天文数字,阿里巴巴最新的旗舰模型Qwen3.8-Max总参数量达到2.4万亿,训练成本远超普通模型。不是因为它"还能用"。一个全球战略级产品不会找一个"还能用"的合作伙伴。

是因为它够好。

这个判断有数据支撑,而且不是阿里自己说的数据。

斯坦福说了什么

斯坦福大学HAI实验室发布的《2026年AI指数报告》,423页,是目前全球覆盖面最广的年度AI追踪之一。覆盖研发、技术性能、负责任AI、经济、科学、医学、教育、政策与治理、公众舆论九大章节。

报告第9页白纸黑字写着一句话,"The U.S.-China AI model performance gap has effectively closed."

中美AI模型性能差距,已有效关闭。

斯坦福大学 HAI《2026年AI指数报告》第9页

具体数字是这样的。

指标 美国顶尖模型 中国顶尖模型 差距
Elo评分(2026年3月) 1503 1464 2.7%
全球调用份额(OpenRouter,7月) 35.5% 63.5% 中国领先28个百分点
Hugging Face开源下载占比 41% 全球第一,超100亿次

2.7%是什么概念?放在跑道上,两个人几乎并排冲过终点线。放在考试里,同一档分数段的小数点差异。一年前这个差距还是两位数,两年前没人觉得这是一个可以讨论的话题。

更值得注意的,智谱GLM 5.2在第三方评测中与Anthropic、OpenAI一同位居全球前三。在SWE-bench Pro基准上,中国模型甚至超过了OpenAI。这不是单项偶发,是结构性收窄。

不止苹果,硅谷在换底座

苹果选千问,不是孤例。如果你把视角放大,会发现一整个趋势正在发生。

一年前(2025年中)

美国模型占全球调用份额70%以上
硅谷初创几乎全部用美国模型底座
Hugging Face下载量美国领先
没人讨论"切换到中国模型"

现在(2026年8月)

中国模型调用份额63.5%,反超
80%美国AI初创已集中国开源模型
Hugging Face下载量中国占41%
近200家企业联名反对切断中国模型

据a16z报告,全球约八成AI初创企业已经集成了中国开源大模型。Uber、Salesforce、Ramp等企业公开承认,为了降低70%到90%的接入成本,已经把代码底座从美国模型切换到了中国模型。

这不是边缘试验,不是小范围试用。硅谷寻求融资的AI初创公司里,八成的技术底座用的是中国模型。

近200家美国企业曾联名致信白宫,反对切断中国开源模型的访问渠道。他们的理由很直白,切了中国开源模型,数百家公司业务会直接停摆。

美国参议员推出了一个5亿美元的基金,专门补贴盟友采购美国AI技术产品。5亿美元听着不少。但面对中国AI模型已经拿下的63.5%全球份额,这点钱杯水车薪。想说服世界弃用中国AI,比当年围堵华为还难上十倍。

有人说这只是合规

有人可能会说,苹果选千问只是因为合规要求,不得不选中国厂商。不是千问真的好,是没有别的选。

这个说法站不住脚。

第一,苹果在全球其他市场用的是自己的端侧模型加ChatGPT。在中国市场,它需要选一个云端模型合作伙伴。符合备案要求的中国AI公司不止阿里一家。百度也入选了,但千问是主力。如果只是合规,选谁不是选。苹果花了两年评估,这不是走过场。

第二,苹果选的不只是一个模型,是一整个生态。千问要接入Siri、写作工具、图像理解。这些场景对模型的推理能力、中文理解、响应速度、稳定性都有很高要求。不是随便塞个模型就能干的活。你让Siri调用一个"还能用"的模型,用户体验一塌糊涂,苹果的品牌就砸了。

第三,系统级集成意味着深度绑定。千问嵌入Apple Intelligence的架构里,覆盖四个操作系统。苹果把AI能力底座交给千问,信任门槛极高。这不是签个合同就完事的事,是技术能力和工程能力的双重考核。

一个被忽略的细节

苹果的文档里写了一个很有意思的交互逻辑。Siri会自己判断千问能不能帮上忙,如果能,它才询问用户是否使用。这意味着苹果不是简单地把千问当工具调用,而是让Siri具备了一个"判断什么时候需要千问"的决策层。这种集成深度,远超普通的API接入。

接下来会发生什么

文档删了,但千问不会消失。

秋天苹果新系统正式发布的时候,千问大概率会回来。到那时候,每一个升级了新系统的国行iPhone用户,在Siri里问问题、在备忘录里写东西的时候,背后跑的可能就是千问的推理引擎。

大多数用户不会知道,也不会关心。他们只会觉得Siri变聪明了,能写东西了,能帮忙分析照片了。但恰恰是最有力的验证。技术最好的归宿不是被讨论,而是被使用。当几亿人在不知不觉中每天用着千问的时候,那才是国产AI真正站稳的时刻。

今晚20点,央视综合频道会播出《2026中国AI盛典》。国产大模型持续迭代,工业、文旅、生态监测场景加速落地。如果你关注这个领域,值得看一眼。这不是某个公司的发布会,是一个产业走到台前的标志性时刻。

2.7%不是终点

聊到这里我想起一个事。上世纪80年代,日本企业把美国消费电子市场打了个底朝天。索尼从"便宜货"变成了品质标杆,本田从"仿制品"变成了工程师的最爱。美国企业花了二十年才反应过来。历史不会简单重复,但节奏有时候会押韵。

回到开头那个被删除的页面。

苹果可以删掉一篇支持文档,但删不了一个已经发生的事实。全球最有价值的公司选了千问。硅谷八成初创在用中国开源模型。Hugging Face上41%的下载来自中国。OpenRouter上63.5%的调用给了中国模型。

2.7%的差距不是终点,是一个新起点的标记线。当追赶变成了被选择,游戏的性质就变了。

这不是追赶的故事了。这是一个被选择的故事。

谢谢你看我的文章。

文中数据来源:斯坦福HAI《2026年AI指数报告》、OpenRouter公开数据、Hugging Face 2026年春季报告、a16z报告、IT之家/财联社相关报道。苹果支持文档已于8月9日被删除,文中引用内容来自删除前的公开页面截图及媒体报道。