小米 15 Ultra vs 三星 S25 Ultra:AI 大模型能力深度对比
# 小米 15 Ultra vs 三星 S25 Ultra:AI 大模型能力深度对比
两款 Ultra 旗舰在硬件层面已经卷到边际收益递减,真正决定日常体验差距的是 AI 与大模型能力。本文不谈影像、不谈跑分,只拆端侧大模型、NPU 算力、功能落地、生态协同四个维度,给出工程师视角的选购参考。
## 一、端侧大模型:参数之外,看架构与实测
小米 15 Ultra 搭载澎湃 HyperAI 端侧大模型,参数量级 6B(INT4 量化),文本任务为主,多模态能力需调用云端。端侧推理依靠 Hexagon NPU 加速,首 token 延迟约 220ms,长上下文(4K tokens)下内存占用约 3.2GB。澎湃 HyperAI 的底层源自小米自研的多任务蒸馏框架,最早出现在小米 14 Ultra 上做语音助手增强,HyperAI 是澎湃 OS 2 把模型能力下沉到系统服务的产物——相册智能分类、录音转写、文件摘要、小爱同学复杂指令都在端侧完成,云端只兜底长上下文和知识时效性问题。
三星 S25 Ultra 集成 Google Gemini Nano 2,端侧模型 3.25B 参数,原生支持文本+图像多模态输入。相同量化精度下,文本生成速度比小米快 15%-20%,但上下文窗口较短(2K tokens),图片理解是加分项。Gemini Nano 2 由 Google 与三星联合调校,S25 Ultra 是首发机型,模型权重随 One UI 7 安全补丁月度推送——这也是三星端侧模型越用越聪明的原因。
| 维度 | 小米 15 Ultra | 三星 S25 Ultra |
|——|————–|————–|
| 端侧模型 | HyperAI 6B | Gemini Nano 2 3.25B |
| 量化精度 | INT4 | INT4 |
| 多模态 | 仅文本(端侧) …