芯片与计算

电脑上的 NPU 是什么?AI PC 值不值得买,你的笔记本能不能本地跑 AI

发布会上的 TOPS 越报越大,可想在自己电脑上跑个大模型时,真正卡住你的多半是内存。

方屿作者方屿
笔记本电脑线稿,屏幕中央是一块芯片,分成 CPU、GPU 和点亮的 NPU 三块区域

2026 年 10 月 5 日,旧金山一家叫 Ghost 的初创公司拿到 1100 万美元种子轮融资,要卖一台 3499 美元、不带屏幕的小主机,专门在你家里跑私人 AI 助手。TechCrunch 的报道里写得很清楚,这台机器的核心是一块英伟达显卡,不是 NPU。可同一时间,各家电脑在宣传里主打的偏偏是 NPU 和 TOPS。两件事放在一起看,正好点出一个常被讲混的问题:“AI PC”里的 NPU 管的是一类活,在自己电脑上跑大模型靠的是另一类硬件。分清这一点,买电脑时就知道该盯哪几行参数,手里的旧电脑能不能用,也心里有数。

电脑上的 NPU 是什么,和 CPU、GPU 差在哪

NPU 是神经网络处理器(Neural Processing Unit)的缩写,是芯片里专门做 AI 运算的一块区域。AI 模型干活时绝大部分时间在做同一件事:成批的乘法再加起来。NPU 就是为这件事设计的,同样的活,它比 CPU 和 GPU 用的电少得多。苹果把它叫神经网络引擎(Neural Engine),从 M1 开始,所有用苹果芯片的 Mac 里都有。

微软在 Windows 11 的规格页上给 NPU 的定位是三点:让一部分 AI 功能不联网也能用;比 CPU、GPU 更省电;让更多数据留在本机处理。所以它最适合长时间、在后台一直开着的小活,比如视频会议时的背景虚化和降噪、实时字幕、本机文件的语义搜索。

芯片里的部分擅长什么日常例子耗电
CPU什么都能干,一次能并行的活不多打开软件、网页、办公中等
GPU(显卡)大规模并行运算,算力最大游戏、剪视频、在本机跑大模型最高
NPU低功耗地做 AI 推理背景虚化、降噪、实时字幕、本机搜索最低

有 NPU 不等于所有 AI 软件都会变快。微软给开发者的文档写明,NPU 要软件专门为它编程才用得上,模型通常还得先压缩成 INT8 这类低精度格式;走不通 NPU 时,Windows 会退回用 GPU 或 CPU。你装的软件有没有为 NPU 适配,比 NPU 有多快更关键。

40 TOPS 是什么意思?各家芯片的 NPU 算力对照

TOPS 是“每秒万亿次运算”(trillion operations per second),厂商一般按 INT8 这种低精度来算。40 TOPS 之所以到处都是,是因为微软把它定成了 Copilot+ PC 的门槛。看这个数字时,有三件事要先弄清。

一是只拿 NPU 比 NPU。英特尔会同时报两个数:NPU 自己的,和 CPU、GPU、NPU 加在一起的“平台 TOPS”。酷睿 Ultra 200V 的 NPU 最高 48 TOPS,平台合计最高 120 TOPS,其中显卡单独就有最高 67 TOPS。拿平台数去比别家的 NPU 数,会差出一大截。二是精度要一致,高通给骁龙 X2 标明了 INT8,苹果没有说明 M4 的 38 TOPS 按什么精度算。三是苹果从 M5 起不再公布神经网络引擎的 TOPS,改为宣传每个 GPU 核心里的神经网络加速器,Mac 已经没法用这个数和 Windows 电脑直接对比了。

芯片NPU 算力(厂商公布)备注
高通骁龙 X Elite / X Plus45 TOPS第一批 Copilot+ PC 用的芯片
高通骁龙 X2 Elite / X2 Plus80 TOPS(INT8)2025 年 9 月发布,比上一代多 78%
英特尔酷睿 Ultra 200V(Lunar Lake)最高 48 TOPS平台合计最高 120 TOPS,别和 NPU 数混着比
英特尔酷睿 Ultra 第 3 代(Panther Lake)最高 50 TOPS2026 年 1 月 CES 发布
AMD 锐龙 AI 30050 TOPS2024 年发布
AMD 锐龙 AI 400(笔记本)最高 60 TOPS2026 年第一季度起有整机
苹果 M438 TOPS(神经网络引擎)苹果没说明精度
苹果 M5 及之后未公布改讲 GPU 里的神经网络加速器

只要过了 40 TOPS,这个数再大一点,日常几乎感觉不到差别:背景虚化、实时字幕这些功能,过了门槛就都能开。真正拉开差距的,是下一节说的内存和显卡。

Copilot+ PC 要什么配置,多出来哪些功能

“AI PC”没有统一定义,有明确标准的是微软的 Copilot+ PC。按微软 Windows 11 规格页的写法,在普通 Windows 11 电脑的要求之外,它还要同时满足三条:处理器里的 NPU 达到 40 TOPS 以上;内存 16GB,类型是 DDR5 或 LPDDR5;存储 256GB 以上的固态硬盘。目前列入的处理器是 AMD 锐龙 AI 300 和 400 系列、英特尔酷睿 Ultra 200V 和 300V 系列、高通骁龙 X 系列。微软还特别写了一句:内存不到 16GB 或存储更小的机型,就算 NPU 够 40 TOPS,也不算 Copilot+ PC,用不了它独有的那些功能。

多出来的功能主要有这些,微软写明具体能用哪些会因地区和机型而不同:

  • 改进的 Windows 搜索:用一句大白话描述,就能在本机找到文件、图片和设置。
  • Click to Do:对屏幕上的文字和图片直接调出可做的操作,具体有哪些,微软说因设备、地区和语言而不同,部分要订阅。
  • 回顾(Recall):目前是预览版,定时记录屏幕方便以后回找,需要开启 Windows Hello 增强登录安全。
  • 实时字幕翻译:可以把 40 多种语言译成英文,把 27 种语言译成简体中文。
  • Windows 工作室效果:基础的自动取景、背景虚化、眼神接触和语音聚焦,只需要 10 TOPS 以上的 NPU 和兼容的摄像头。
  • 画图里的 Cocreator、照片里的图像生成:要登录微软账户,并且联网做内容安全检查。

还有几项只在骁龙 X 机型上有,比如画图的生成式填充、照片的重新打光、游戏的自动超分辨率。微软说很多功能下载好之后不联网也能用,部分功能需要微软账户。

价格上,微软美国官网 2026 年 10 月 6 日列出的 Copilot+ PC 里,最便宜的机型标价 699.99 美元起,微软自家的 Surface 从 1049.99 美元起,这些价格经常变。买之前在配置单上核对三行:NPU 是否 40 TOPS 以上,内存是否 16GB 以上,存储是否 256GB 以上。轻薄本的内存大多焊死在主板上,买回来就加不了,预算允许就直接选大一档。

在自己电脑上跑大模型,用的是 NPU 吗

多数情况下不是。现在最常用的两个本地工具是 Ollama 和 LM Studio。Ollama 官方的硬件支持文档只列了英伟达的 CUDA、AMD 的 ROCm、苹果的 Metal 和 Vulkan 这几条路,都是显卡;在 Mac 上,它用苹果芯片的 CPU 和 GPU,Intel 处理器的 Mac 只能用 CPU。整套文档里找不到 NPU 的支持说明。跑起来以后,在命令行输入 ollama ps,能看到这个模型是全在 CPU 上跑,还是 CPU、GPU 各占一部分。

LM Studio 的系统要求页同样只谈内存和显卡:Mac 要 M1 到 M4 这类苹果芯片,建议 16GB 以上内存,8GB 的 Mac 也能用,但只能跑小模型;Windows 支持普通 x64 电脑和骁龙 X Elite 这类 ARM 电脑,x64 处理器要支持 AVX2 指令集,建议至少 16GB 内存和 4GB 独立显存。

LM Studio 官方文档的系统要求页,macOS 一栏写着需要 Apple 芯片、建议 16GB 以上内存,Windows 一栏写着需要支持 AVX2、建议至少 16GB 内存和 4GB 独立显存
LM Studio 官方文档的系统要求页:Mac 和 Windows 两栏写的都是内存、显存和指令集,没有一行提到 NPU(截图于 2026 年 10 月 6 日)。

也有专门走 NPU 的路。微软的 Foundry Local 能在本机跑模型,有 GPU 和 NPU 时会用上,没有就退回 CPU,Windows、苹果芯片的 Mac 和 Linux 都能装。不过它能用 NPU 的前提是模型已经为这块芯片转换好,能选的模型比 Ollama 和 LM Studio 少。开头那台 3499 美元的 Ghost 主机也是同一个道理:它想让几百亿参数的模型在家里跑得顺,选的是一块带大显存的显卡。

所以想在本机跑聊天模型,看的是显存或内存够不够大、读写够不够快,NPU 在这件事上帮不上主要的忙。

我的电脑能跑多大的模型?先看内存

跑模型时,整个模型文件要装进显存或内存里,旁边还得给系统、浏览器和对话上下文留出位置。下面是 Ollama 模型库里通义千问 Qwen3 各个尺寸的默认下载大小(2026 年 10 月查看),文件越大,回答通常越好,也越吃内存:

模型文件大小大致适合的电脑(我们的估算)
Qwen3 0.6B / 1.7B523MB / 1.4GB8GB 内存的电脑也能跑,适合试手
Qwen3 4B2.5GB8GB 内存能跑,16GB 更从容
Qwen3 8B5.2GB16GB 内存,或 8GB 显存的显卡
Qwen3 14B9.3GB16GB 内存勉强,32GB 或 12GB 以上显存更稳
Qwen3 32B20GB32GB 以上内存,或 24GB 显存
Llama 3.1 70B43GB64GB 以上统一内存的 Mac,或多块显卡

最右一列是我们按“文件大小再加几 GB 余量”推出来的,不是哪家厂商的规定。可以拿来对照的官方说法有两条:LM Studio 建议至少 16GB 内存;Ollama 的说明文件曾经长期写着,跑 7B 模型至少要 8GB 内存,13B 要 16GB,33B 要 32GB,这句在 2026 年 2 月的新版里删掉了,但量级没变。

Windows 电脑和 Mac 在这里的差别很大。带独立显卡的 Windows 电脑,看的是显卡自己的显存,模型装不下时会有一部分挪到 CPU 上算,速度明显变慢,ollama ps 里看到 CPU 占了一大块就是这个情况。苹果芯片的 Mac 用统一内存,显卡能直接用大部分内存,所以一台 32GB 或 64GB 的 Mac 能跑的模型,往往比显存只有 8GB 的游戏本还大。

最省事的试法是:装上 LM Studio 或 Ollama,先下一个 4B 的模型问几个问题,速度能接受,再试 8B;回答一个字一个字往外蹦、风扇狂转,就说明这台电脑到上限了。

怎么查自己的电脑有没有 NPU

Windows 电脑:打开任务管理器,点“性能”,看左侧列表里有没有 NPU 这一项,点进去能看到它的占用曲线。想知道是哪个程序在用,切到“进程”页,在列标题上点右键,勾选 NPU 这一列;微软说按程序显示 NPU 占用只在部分较新的设备上有。没看到 NPU,可以在“性能”里的 CPU 页查到处理器型号,再对照上面那张表。

Mac:点左上角苹果菜单,选“关于本机”,“芯片”一行写着 Apple M1 或更新的型号,就有神经网络引擎;写的是 Intel 处理器,就没有。Intel 处理器的 Mac 用不了 Apple 智能,LM Studio 目前也不支持。

Apple 智能对设备的要求,按苹果 2026 年 9 月的说明,是 M1 及之后的 Mac、iPhone 15 Pro 和 iPhone 15 Pro Max、iPhone 16 及之后的机型,还要预留最多 8GB 的存储空间,部分新机型最多要 14GB。苹果写明在中国大陆购买的设备目前用不了 Apple 智能。

要不要为了 AI 换电脑:按用途来定

你主要想用 AI 做什么该看什么NPU 重要吗
用 ChatGPT、Gemini、Claude 这类网页或 App 里的 AI都在服务器上算,能流畅上网的电脑就够不重要
视频会议背景虚化、降噪、实时字幕有 NPU 更省电、续航更长;基础效果 10 TOPS 以上就能开有用
想用 Windows 的回顾、Click to Do、新的本机搜索必须是 Copilot+ PC:40 TOPS、16GB、256GB 三条都满足必须
在本机跑 8B 到 14B 的聊天模型16GB 到 32GB 内存;有独立显卡就看显存基本用不上
在本机跑 70B 级的大模型64GB 以上统一内存的 Mac,或大显存显卡不重要
修图、剪视频软件里的 AI 功能看软件官网写的是用显卡还是 NPU看软件

手上的电脑还能用,就先别急着换。云端的 AI 对电脑几乎没有要求;想试本机模型,先用现有的电脑跑一个 4B 模型看看效果。真要买新电脑,把钱优先花在内存上,内存焊死的机型尤其要一次买够;NPU 只要过了 40 TOPS 就够用,不必为了表里多出来的几十 TOPS 多付钱。商家把“AI PC”当卖点时,让他把这台机器的 NPU 算力、内存和存储三项写清楚,再对照上面 Copilot+ 的三条门槛。

常见问题

NPU 和显卡,跑 AI 哪个更重要?

看你跑什么。背景虚化、实时字幕、本机搜索这类一直开在后台的小功能,NPU 更省电;在本机跑聊天大模型,Ollama 和 LM Studio 用的都是显卡、CPU 和内存,显存或统一内存越大,能跑的模型越大。只用网页上的 AI,两者都不重要。

16GB 内存够在本地跑大模型吗?

够跑 8B 左右的模型,比如 5.2GB 的 Qwen3 8B,14B 就比较勉强。LM Studio 官方建议至少 16GB 内存,8GB 的 Mac 只能跑小模型。想跑 30B 以上,至少要 32GB;跑 70B 级,要 64GB 以上统一内存的 Mac 或多块显卡。

旧电脑能加装 NPU 吗?

不能。NPU 做在处理器里,笔记本和台式机都没法单独加。台式机可以加一块独立显卡来跑本地模型,效果通常比 NPU 更好。Copilot+ 的那些功能要求处理器自带 40 TOPS 以上的 NPU,加显卡也开不了。

AI PC 断网还能用 AI 功能吗?

一部分可以。微软说 Copilot+ PC 的很多功能下载好之后可以离线用,部分功能需要微软账户;画图的 Cocreator 这类图像生成要联网做内容安全检查。LM Studio 下载好模型后也能完全离线运行。

苹果电脑算不算 AI PC?

Copilot+ PC 是微软给 Windows 电脑定的标准,Mac 不在其中。M1 及之后的 Mac 都有神经网络引擎,支持 Apple 智能;本机跑模型时,Mac 的统一内存能被显卡直接使用,所以内存大的 Mac 能跑比较大的模型。

资料来源与延伸

更新记录:2026 年 10 月 6 日首发。各家芯片的参数和微软的功能列表变化很快,有变动会记在这里。

方屿
方屿 · 未来观察主编

长期跟踪科技报道,习惯把被讲复杂、或被讲浮夸的技术,对照公开资料一条条还原成普通人能判断的样子;也被各种“颠覆性”宣传忽悠过,才学会先核证据再下结论。开「看懂未来」专栏。了解更多