论坛
BBS
默认
简体中文
繁體中文
登录
全球主机MJJ交流论坛
»
论坛
›
主机交流
›
水池
›
苹果想把AI塞进你的口袋,用的却是中国的模型、美国小公 ...
返回列表
发新帖
查看:
1
|
回复:
0
苹果想把AI塞进你的口袋,用的却是中国的模型、美国小公司的手艺
[复制链接]
hlx
hlx
当前离线
积分
58935
1万
主题
0
回帖
5万
积分
论坛元老
论坛元老, 积分 58935, 距离下一级还需 9941064 积分
论坛元老, 积分 58935, 距离下一级还需 9941064 积分
积分
58935
关注TA
发消息
发表于 2026-7-17 14:03:38
|
显示全部楼层
|
阅读模式
一个你可能没留意、但挺魔幻的组合
先说件事,你品品这里面的味道。
一家美国的小创业公司,用一套加州理工的数学,把一个中国阿里开源的大模型,压进了一台苹果iPhone 里,还准备让全世界免费下载。
中国的模型,美国的手艺,苹果的机器。
这几方平时在新闻里要么互相封锁、要么互相较劲,结果在一部手机上凑齐了。
昨天(7 月 9 日)The Information 捅出来的消息:苹果正在跟一家叫 PrismML 的小公司密集接触。这家公司干了件事——把阿里通义千问 Qwen 3.6 的 270 亿参数版本,从 54GB 压到不到 4GB,塞进 iPhone 17 Pro,本地就能跑。
不是连云端。是断网也能用的那种「本地」。
一堆媒体标题写得很燃:「性能无损」「刷新移动端纪录」「苹果 AI 天花板要被解锁了」。
先别急着跟着嗨。这事确实有分量,但分量不在你以为的地方。
事件回顾:到底发生了什么
把噪音去掉,就三条硬事实:
第一,模型是中国的。 被压缩的是阿里开源的 Qwen 3.6,270 亿参数。注意,苹果自己 6 月 WWDC 刚发的端侧模型 AFM 是 200 亿参数,还打不平。
第二,手艺是美国小公司的。 PrismML 从加州理工分拆出来,核心是「原生 1-bit 压缩」技术,体积压到原来的十四分之一,内存占用降 90% 以上,号称推理提速最高 8 倍、能耗降 75%。开源模型下周二就放出来。
第三,苹果是那个着急的买家。 苹果这几年死磕「端侧 AI」,就是不想把你的数据传上云。但它自己压模型压不好——去年内部试过一次,性能掉得惨。现在盯上了 PrismML。
【图片1】
翻译成人话:
苹果想让 AI 住进你手机里,不上云,不喝你的隐私。它自己搞不定,于是找了个外援;而这个外援手里练的「活儿」,恰好用中国的开源模型练得最顺。
一句话——万亿市值的苹果,这次是在别人的地基上盖自己的房子。
第一层:先泼盆冷水,「性能无损」这话得打个折
我知道你被「性能无损」四个字勾住了。我也想信。但做过量化的都清楚,这话得留个心眼。
模型压缩这事,本质是拿「精度」换「体积」。把 16 位的数压成 1 位,等于把一段高清录音压成语音备忘录——你说话内容还在,但那些细微的语气、尾音、呼吸声,多少会掉。
PrismML 说它没有「高精度逃生通道」(就是那种偷偷保留一部分高精度参数来撑场面的取巧做法),靠分组缩放硬扛。听着挺硬核。
但「接近 FP16 精度」和「无损」,中间隔着一条不小的沟。营销话术里,这条沟经常被一笔带过。
更值得琢磨的是另一个细节:苹果自己那个 200 亿的模型是「稀疏」的——270 亿里同一时刻只醒着 10 到 40 亿,其余在睡觉,省电。而 PrismML 这个是 270 亿全程满血激活。
全激活当然更聪明,但也更吃电、更烫手。一部手机跑起来,续航和发热扛不扛得住,发布会 PPT 是不会告诉你的。
所以我的态度:这是一次实打实的工程进步,但「进步」和「随时能用在你手机上」是两码事。 别把 demo 当成量产。
第二层:真正的信号是「端侧 AI」到了临界点
冷水泼完了,说重点。
这条新闻真正的价值,不在某个参数破了纪录,而在它踩到了一个拐点上:AI 正在从「云端的一项服务」,慢慢变成「你口袋里的一件东西」。
过去两年,所有人的默认认知是:想用强 AI,就得连服务器。你问一句,数据跑到几千公里外的机房,算完再传回来。
这套模式很爽,但有三个死穴:烧钱——每次对话都在烧别人机房的电,成本要么转嫁给你,要么先贴着你,可补贴总有停的一天;烧隐私——你说的每句话、拍的每张图,理论上都离开了你的设备;还得要网——没信号、断网、飞机上,AI 就是块砖。
【图片2】
而端侧 AI,就是把这三条全反过来:不烧机房电、数据不出门、断网也能用。
苹果这么执着于此,不是情怀,是算过账的。它没钱去跟微软、谷歌拼几百亿美金堆数据中心,那它干脆换个战场——你不是要比谁云更强吗?我比谁的手机更能自己扛。
而 PrismML 这个突破的意义在于:它第一次让「把一个真正够用的大模型塞进消费级手机」从 PPT 走到了可验证的边上。
一旦这条路走通,整个 AI 的权力结构会挪位。今天 AI 的话语权攥在有大机房的巨头手里;明天如果强 AI 能装进十几亿部手机本地跑,权力就散回到每一台设备、每一个人手上。
这不是小事。这是「中心化」和「去中心化」两种未来的分岔口。
第三层:最该被看见的,是中国开源模型悄悄成了「全球公共品」
前两层都还在讲技术。第三层,我想聊点让我最有感触的。
为什么 PrismML 压的是阿里的千问,而不是别的?
答案朴素得有点扎心:因为它开源、免费、够强,随便拿来用不用给钱、不用求授权。
你想想这个画面——一家美国公司,做本国前沿产品的技术验证,第一反应是抄起一个中国的开源模型当地基。这在三年前是不可想象的。
那会儿的剧本是:好模型都是 OpenAI、谷歌、Anthropic 的,闭源、收费、还挑客户。全世界的开发者都得排队看它们脸色。
现在呢?中国这一批开源模型——千问、DeepSeek、GLM——悄没声地变成了全球开发者的「默认零件」。不是因为爱国滤镜,是因为它们真的成了那个「随手就能拿、拿了就能用、还够好」的东西。
这才是「不装了」最想说的一层:
我们过去总盯着排行榜第一是谁、谁的分更高,其实那是「看得见的战争」。真正决定格局的是另一场「看不见的渗透」——当你的模型变成了别人造东西时想都不用想就顺手拿起的那块砖,你就不再是选手,你成了地基。
芯片被卡脖子的时候,大家才痛悟「基础设施」这仨字的分量。而在 AI 这层,中国的开源模型正在不声不响地,把自己焊进全球的基础设施里。
苹果这台 iPhone 里如果真跑起了千问,那不是阿里的一次公关胜利,而是一个更安静、更长久的事实:在 AI 世界里,越来越多的「别人的产品」,底座是中国的。
我的几个态度,摊开说
第一,为工程突破鼓掌,但别替营销吹牛。
把 27B 模型塞进手机,是真本事,值得敬。但「性能无损」「解锁天花板」这类词,是拿来卖概念的。发热、续航、真实场景下掉不掉链子,等下周开源了、等真装进量产机再看。做技术判断,永远等实测,别信预告片。
第二,端侧 AI 这个拐点,比某条新闻本身重要得多。
AI 从「你得连它的服务器」变成「它住在你手机里」,这一步一旦迈过去,改变的不只是体验,是整个产业的权力怎么分。谁能让强 AI 在设备上自己跑起来,谁就绕开了「没钱堆机房就出局」的老规矩。这条线,值得你长期盯着。
第三,也是我最想留给你的——
我们习惯了用「谁赢了谁」看科技竞争。但这条新闻里没有输赢,只有一种更耐人寻味的东西:中国的模型、美国的手艺、苹果的机器,被一个共同的需求拧到了一起。
技术到了某个阶段,会自己找最优解,不太在乎国界和立场。真正的实力,不是你在头条上喊得多响,而是当别人低头造东西的时候,会不会顺手用上你的东西——用得那么自然,自然到都忘了它是谁家的。
中国的开源模型,正在争取的就是这种「被忘掉出处」的存在感。
这比拿第一,扎实多了。
说到这,想听听你的:
一是,你会想要一部「AI 完全在本地跑、一个字都不上传」的手机吗?愿意为这份隐私,牺牲一点点性能和续航吗?
二是,中国的开源模型成了别人产品的「默认地基」——这算不算一种更高级的赢?还是说,被人免费拿走用,其实是我们把最值钱的东西白送了?
内容来源于互联网[玫瑰]
回复
使用道具
举报
返回列表
发新帖
高级模式
B
Color
Image
Link
Quote
Code
Smilies
您需要登录后才可以回帖
登录
|
立即注册
本版积分规则
发表回复
回帖并转播
回帖后跳转到最后一页
浏览过的版块
VPS综合讨论
Archiver
|
手机版
|
小黑屋
|
全球主机MJJ交流论坛
Powered by
Discuz!
X5.0
© 2001-2026
Discuz! Team
.
在本版发帖
返回顶部
快速回复
返回顶部
返回列表