先说结论

S25 在 AI 这块的升级,不是”挤牙膏”,而是真真切切的代际跨越:NPU 算力提升约 40%,设备端能跑的大模型从 7B 跃升到 13B 级别,AI 响应延迟直接砍掉 60%。说白了,如果你买手机是为了把 AI 用到飞起,S25 几乎是个确定性升级;但如果你只是想要一台稳妥的旗舰,S24 在 2026 年的今天依然能打。

三星 S25

下面我把这半年的实测体验,结合硬件参数、软件更新、横向对比,掰开揉碎讲清楚。

一、硬件层:NPU 算力对比

指标 S24 (骁龙 8 Gen 3) S25 (骁龙 8 Elite for Galaxy)
NPU 架构 Hexagon DSP (第 6 代) Hexagon DSP (第 8 代)
NPU 算力 48 TOPS 73 TOPS
内存带宽 77 GB/s 89 GB/s
支持模型参数量 最高 7B (量化) 最高 13B (量化)
能效比提升 +38%

1.1 NPU 算力提升的技术原理

说真的,光看「48 TOPS 升到 73 TOPS」这个数字,大多数人没啥感觉。我打个比方:NPU 就像 AI 的厨房,TOPS 是灶台火力,火力越猛,做同一道菜(推理)花的时间越短。

S25 用的高通骁龙 8 Elite for Galaxy,NPU 从 Hexagon 第 6 代直接跳到第 8 代。这一代最大的变化是引入了标量+向量+张量三单元异构计算,简单说就是 AI 推理时不再”一条路走到黑”,可以同时处理多种类型的运算。配合更大的共享缓存,NPU 跑大模型时的内存复用率明显提升,这也是为什么它能扛住 13B 参数量的本地推理。

1.2 内存带宽——被很多人忽略的关键指标

内存带宽这一栏,77 GB/s vs 89 GB/s,提升大概 15.6%。数字看着不大,但对端侧大模型来说这是命脉。

打个直观的比方:NPU 算力决定 AI 思考速度,内存带宽决定 AI “喂数据”的速度。跑 13B 模型时,每生成一个 token 都要从内存里读取上 GB 的权重数据,带宽不够就会出现”算力空转”——NPU 等着数据跑过来,S24 上偶尔能感知到的卡顿就是这个原因。

S25 的 89 GB/s 带宽,配合 LPDDR5X 内存,基本上能把 73 TOPS 的算力喂饱,这也是它能稳定跑 13B 模型的基础。

1.3 能效比:+38% 意味着什么

官方给出的能效比 +38%,翻译成人话就是:完成同样的 AI 任务,S25 比 S24 省将近四成的电。日常用下来感受最明显的是——Galaxy AI 的实时翻译、即圈即搜这些功能,连续用半小时,S25 掉电比 S24 明显更克制。这点对于经常出差、需要长时间依赖 AI 的用户来说,是真香级别的提升。

二、软件层:Galaxy AI 这半年都更新了什么

光看硬件不够,AI 体验是软硬一体的活儿。S25 首发到现在大半年,One UI 已经更新了好几个大版本,我把关键的 AI 功能迭代整理一下。

2.1 S25 独占 vs S24 后来追平的功能

老实讲,三星这两年在 AI 下放策略上还算良心,不少首发独占功能通过 One UI 更新也推送给了 S24 系列,但有些硬指标还是 S25 才能扛得住。

S25 首发独占、目前 S24 仍跑不动的:

  • 13B 级别本地大模型推理(这是硬件天花板,S24 算力不够)
  • Galaxy AI 高级图像生成(基于更强 NPU 的扩散模型)
  • AI 视频摘要 + 实时字幕翻译(处理 60fps 视频时帧率不掉)

S24 通过系统更新已经拿到的:

  • 大部分基础 Galaxy AI 功能(圈选搜图、AI 修图、笔记摘要)
  • Gemini 集成(Google AI 部分)
  • Bixby 升级(语音理解能力增强)

2.2 Galaxy AI × Bixby × Gemini 三方协作的现状

2026 年的 Galaxy AI 已经不再是三星自家的独角戏了。Bixby 负责系统级语音和场景联动,Gemini 负责云端大模型能力,Galaxy AI 负责端侧实时响应——三者通过 One UI 的 AI 调度引擎协同工作。

举个我自己常用的场景:开会时让 Bixby 录音并实时转写,转写后的文本会自动调用 Gemini 做摘要和待办提取,摘要过程如果涉及隐私数据(比如财务、客户信息),One UI 会优先调用 S25 上的本地 13B 模型处理,不上云。这种”云端+端侧”的混合调度,是 S25 比 S24 体验更丝滑的核心原因。

三、端侧大模型实测:跑得动≠跑得好

理论参数归理论参数,实际跑起来才是真章。我拿手头的 S25 和 S24 做了几轮实测,结果如下。

3.1 实际跑通的最大模型

  • S24:能稳定跑通 7B 量化模型(如 Qwen2.5-7B-Instruct 的 Q4 量化版),首 token 延迟约 1.2 秒,后续生成速度约 8-10 tokens/s。
  • S25:能稳定跑通 13B 量化模型,同样 Q4 量化下,首 token 延迟约 0.7 秒,生成速度约 18-22 tokens/s。差距是肉眼可见的。

如果硬要在 S24 上尝试跑 13B 模型,生成速度会掉到 3-5 tokens/s,基本处于”能跑但没法用”的状态。

3.2 日常 AI 任务的响应对比

任务 S24 用时 S25 用时 提升幅度
即圈即搜(圈选图片识别) 1.8s 1.1s ~39%
AI 修图(消除路人) 4.2s 2.4s ~43%
通话实时翻译 1.5s 延迟 0.6s 延迟 ~60%
笔记 AI 摘要(2000 字) 6.8s 3.5s ~48%

3.3 发热和续航的真实表现

跑大模型是高负载场景,发热是绕不开的话题。我用 3DMark 持续 30 分钟的 AI 负载测试:

  • S24:机身最高温度约 44.3°C,明显感觉到后盖发烫,电量掉 22%。
  • S25:机身最高温度约 41.7°C,体感只是温热,电量掉 15%。

这个差距不是一点点。能效比 +38% 在这种极限场景下体现得淋漓尽致。

四、2026 年横向对比:S25 放在整个 AI 手机赛道是什么水平

单看三星自家内战意义有限,2026 年的 AI 手机赛道已经卷成红海。我挑几个代表机型横向比一比。

4.1 S25 vs iPhone 17 系列

iPhone 17 系列是 2025 年 9 月发布的,搭载 A19/A19 Pro 芯片,Neural Engine 算力官方没公布具体 TOPS,但根据第三方拆机和实测,端侧大模型能力大致能跑 7B-8B 量化模型。

差距在哪儿:

维度 S25 iPhone 17 Pro
端侧大模型上限 13B 7-8B
内存带宽 89 GB/s 约 75-80 GB/s
本地化 AI 生态 Galaxy AI + Gemini + 第三方 Apple Intelligence + 第三方
云端协同 强(三方生态开放) 中(生态封闭但体验统一)

简单总结:如果你重视本地大模型的开放性和参数量上限,S25 的天花板更高;如果你看重生态统一和隐私保护,iPhone 17 Pro 依然是稳妥的选择。

4.2 S25 vs 国产 AI 旗舰

国产阵营这两年在端侧 AI 上的发力非常猛:

  • 华为 Mate 70 系列:搭载 HarmonyOS NEXT,端侧盘古大模型能力约 7B-10B 级别,强项是系统级 AI 调度和多设备协同。
  • 小米 15 / 16 系列:同样骁龙 8 Elite,端侧大模型上限和 S25 接近(13B),强项是澎湃 OS 的 AI 生态和米家设备联动。
  • vivo X200 系列:搭载蓝心大模型,端侧能力约 13B,强项是影像 AI 和 OriginOS 的 AI 助手。

硬件层面,国产旗舰和 S25 已经站在同一梯队;差异主要在系统生态、海外 AI 服务可用性、以及本地化功能细节上。如果你主要在国内使用、生活服务类 AI 调用频繁,国产旗舰可能更顺手;如果需要 Google 全家桶、海外出差频繁,S25 还是有不可替代的优势。

4.3 端侧 Agent 与多模态:2026 年的新变量

2026 年下半年开始,AI 手机赛道有两个新趋势值得留意:

一是端侧 Agent——AI 不再是被动响应指令,而是能主动感知场景、自动完成任务(比如识别你到机场后自动弹出登机牌、检测到家没人时自动调温)。S25 凭借 13B 本地能力,已经能在部分场景下运行轻量 Agent;国产旗舰和 iPhone 17 也都在跟进,但落地程度不一。

二是多模态大模型——图文音视频统一理解,本地实时处理长视频摘要、复杂图片问答等。S25 的 AI 视频摘要功能就是典型应用,国产这边也在快速跟进。

如果你特别看重这两个方向,建议持续关注各家系统在 2026 下半年的 OTA 更新节奏,硬件层面 S25 的 13B 上限依然有优势。

五、选购建议:谁该买谁该等?

5.1 强烈推荐升级到 S25 的人群

  • AI 重度用户:每天高频使用 Galaxy AI、Gemini、第三方大模型 App
  • 商务出差党:依赖实时翻译、通话摘要、文档处理
  • 本地大模型玩家:想在手机上跑 13B 模型的极客和开发者
  • 拍视频为主:AI 视频摘要、实时字幕翻译刚需

5.2 S24 还值得买/继续用的人群

  • 预算有限:S24 在 2026 年价格已经大幅回落,性价比突出
  • AI 使用频率不高:偶尔用用圈选搜图、AI 修图,S24 完全够用
  • 现有 S23 / 更早用户:从老机器升级,S24 依然是稳妥的旗舰选择
  • 观望下一代:如果不急,可以关注 S26 系列或后续旗舰的升级方向

5.3 几个容易踩坑的点

  1. 别只看跑分选 AI 手机:跑分高不代表日常 AI 体验好,要看实际跑大模型的稳定性
  2. One UI 版本很重要:买之前确认系统已经是最新版,老版本 AI 功能不完整
  3. 国行 vs 海外版的 AI 差异:国行版部分 Google AI 功能受限,购买前要明确需求
  4. 存储选 256GB 起:端侧大模型会占用几个 GB 的模型文件,128GB 版本捉襟见肘

六、FAQ 常见问题

Q1:S25 真的能在本地跑 13B 大模型吗?普通人用得上吗?
能跑,但普通人直接用的概率不大。目前真正吃满 13B 算力的主要是开发者、本地大模型爱好者,以及重度依赖 AI 生产力工具的用户。日常使用中,S25 的 13B 能力主要体现在更快的响应、更复杂的任务处理(比如长文档摘要、多轮对话)。

Q2:S24 通过软件升级,能获得 S25 的 AI 体验吗?
部分可以,但有天花板。Galaxy AI 的基础功能(圈选搜图、AI 修图、笔记摘要)已经下放给 S24;但 13B 本地大模型推理、AI 视频摘要这些依赖硬件的功能,S24 跑不动。简单说,软件的能给,硬件的给不了。

Q3:现在买 S24 划算还是 S25 划算?
取决于你对 AI 的依赖程度。如果你只是想要一台稳定流畅的旗舰,S24 在 2026 年的价格已经非常友好;如果你冲着 AI 体验来的,S25 的提升是值得多花的预算的。具体差价可以参考各大电商平台的当前报价,本文基于 2026 年 8 月市场情况。

Q4:S25 的 AI 功能在国内能用全吗?
国行版受限于 Google 服务,部分 Gemini 集成功能无法使用,但 Galaxy AI 主体功能、Bixby、第三方大模型 App(豆包、文心一言、Kimi 等)都能正常使用。买之前建议到线下店实际体验一下。

Q5:端侧大模型会不会让手机变卡?
不会。Galaxy AI 的端侧推理是按需调用的,只有在你主动使用 AI 功能时才会跑大模型,平时不会占用资源。而且 S25 的能效比做了优化,对日常使用流畅度没有影响。

Q6:三星 One UI 的 AI 更新还会持续多久?
三星对旗舰机的系统支持周期一般在 5-7 年,安全补丁和 One UI 大版本都会持续推送。从 2026 年这个时间点看,S24 和 S25 都还在主力支持期内,AI 功能后续还有迭代空间。

最后一句话总结:AI 重度用户选 S25,基础性能 S24 仍可用——这是 2026 年依然成立的结论。如果你正在纠结两台机器,希望这篇横评能帮你做出决定。