电脑上的 NPU 是什么?AI PC 值不值得买,你的笔记本能不能本地跑 AI
发布会上的 TOPS 越报越大,可想在自己电脑上跑个大模型时,真正卡住你的多半是内存。
2026 年 10 月 5 日,旧金山一家叫 Ghost 的初创公司拿到 1100 万美元种子轮融资,要卖一台 3499 美元、不带屏幕的小主机,专门在你家里跑私人 AI 助手。TechCrunch 的报道里写得很清楚,这台机器的核心是一块英伟达显卡,不是 NPU。可同一时间,各家电脑在宣传里主打的偏偏是 NPU 和 TOPS。两件事放在一起看,正好点出一个常被讲混的问题:“AI PC”里的 NPU 管的是一类活,在自己电脑上跑大模型靠的是另一类硬件。分清这一点,买电脑时就知道该盯哪几行参数,手里的旧电脑能不能用,也心里有数。
电脑上的 NPU 是什么,和 CPU、GPU 差在哪
NPU 是神经网络处理器(Neural Processing Unit)的缩写,是芯片里专门做 AI 运算的一块区域。AI 模型干活时绝大部分时间在做同一件事:成批的乘法再加起来。NPU 就是为这件事设计的,同样的活,它比 CPU 和 GPU 用的电少得多。苹果把它叫神经网络引擎(Neural Engine),从 M1 开始,所有用苹果芯片的 Mac 里都有。
微软在 Windows 11 的规格页上给 NPU 的定位是三点:让一部分 AI 功能不联网也能用;比 CPU、GPU 更省电;让更多数据留在本机处理。所以它最适合长时间、在后台一直开着的小活,比如视频会议时的背景虚化和降噪、实时字幕、本机文件的语义搜索。
| 芯片里的部分 | 擅长什么 | 日常例子 | 耗电 |
|---|---|---|---|
| CPU | 什么都能干,一次能并行的活不多 | 打开软件、网页、办公 | 中等 |
| GPU(显卡) | 大规模并行运算,算力最大 | 游戏、剪视频、在本机跑大模型 | 最高 |
| NPU | 低功耗地做 AI 推理 | 背景虚化、降噪、实时字幕、本机搜索 | 最低 |
有 NPU 不等于所有 AI 软件都会变快。微软给开发者的文档写明,NPU 要软件专门为它编程才用得上,模型通常还得先压缩成 INT8 这类低精度格式;走不通 NPU 时,Windows 会退回用 GPU 或 CPU。你装的软件有没有为 NPU 适配,比 NPU 有多快更关键。
40 TOPS 是什么意思?各家芯片的 NPU 算力对照
TOPS 是“每秒万亿次运算”(trillion operations per second),厂商一般按 INT8 这种低精度来算。40 TOPS 之所以到处都是,是因为微软把它定成了 Copilot+ PC 的门槛。看这个数字时,有三件事要先弄清。
一是只拿 NPU 比 NPU。英特尔会同时报两个数:NPU 自己的,和 CPU、GPU、NPU 加在一起的“平台 TOPS”。酷睿 Ultra 200V 的 NPU 最高 48 TOPS,平台合计最高 120 TOPS,其中显卡单独就有最高 67 TOPS。拿平台数去比别家的 NPU 数,会差出一大截。二是精度要一致,高通给骁龙 X2 标明了 INT8,苹果没有说明 M4 的 38 TOPS 按什么精度算。三是苹果从 M5 起不再公布神经网络引擎的 TOPS,改为宣传每个 GPU 核心里的神经网络加速器,Mac 已经没法用这个数和 Windows 电脑直接对比了。
| 芯片 | NPU 算力(厂商公布) | 备注 |
|---|---|---|
| 高通骁龙 X Elite / X Plus | 45 TOPS | 第一批 Copilot+ PC 用的芯片 |
| 高通骁龙 X2 Elite / X2 Plus | 80 TOPS(INT8) | 2025 年 9 月发布,比上一代多 78% |
| 英特尔酷睿 Ultra 200V(Lunar Lake) | 最高 48 TOPS | 平台合计最高 120 TOPS,别和 NPU 数混着比 |
| 英特尔酷睿 Ultra 第 3 代(Panther Lake) | 最高 50 TOPS | 2026 年 1 月 CES 发布 |
| AMD 锐龙 AI 300 | 50 TOPS | 2024 年发布 |
| AMD 锐龙 AI 400(笔记本) | 最高 60 TOPS | 2026 年第一季度起有整机 |
| 苹果 M4 | 38 TOPS(神经网络引擎) | 苹果没说明精度 |
| 苹果 M5 及之后 | 未公布 | 改讲 GPU 里的神经网络加速器 |
只要过了 40 TOPS,这个数再大一点,日常几乎感觉不到差别:背景虚化、实时字幕这些功能,过了门槛就都能开。真正拉开差距的,是下一节说的内存和显卡。
Copilot+ PC 要什么配置,多出来哪些功能
“AI PC”没有统一定义,有明确标准的是微软的 Copilot+ PC。按微软 Windows 11 规格页的写法,在普通 Windows 11 电脑的要求之外,它还要同时满足三条:处理器里的 NPU 达到 40 TOPS 以上;内存 16GB,类型是 DDR5 或 LPDDR5;存储 256GB 以上的固态硬盘。目前列入的处理器是 AMD 锐龙 AI 300 和 400 系列、英特尔酷睿 Ultra 200V 和 300V 系列、高通骁龙 X 系列。微软还特别写了一句:内存不到 16GB 或存储更小的机型,就算 NPU 够 40 TOPS,也不算 Copilot+ PC,用不了它独有的那些功能。
多出来的功能主要有这些,微软写明具体能用哪些会因地区和机型而不同:
- 改进的 Windows 搜索:用一句大白话描述,就能在本机找到文件、图片和设置。
- Click to Do:对屏幕上的文字和图片直接调出可做的操作,具体有哪些,微软说因设备、地区和语言而不同,部分要订阅。
- 回顾(Recall):目前是预览版,定时记录屏幕方便以后回找,需要开启 Windows Hello 增强登录安全。
- 实时字幕翻译:可以把 40 多种语言译成英文,把 27 种语言译成简体中文。
- Windows 工作室效果:基础的自动取景、背景虚化、眼神接触和语音聚焦,只需要 10 TOPS 以上的 NPU 和兼容的摄像头。
- 画图里的 Cocreator、照片里的图像生成:要登录微软账户,并且联网做内容安全检查。
还有几项只在骁龙 X 机型上有,比如画图的生成式填充、照片的重新打光、游戏的自动超分辨率。微软说很多功能下载好之后不联网也能用,部分功能需要微软账户。
价格上,微软美国官网 2026 年 10 月 6 日列出的 Copilot+ PC 里,最便宜的机型标价 699.99 美元起,微软自家的 Surface 从 1049.99 美元起,这些价格经常变。买之前在配置单上核对三行:NPU 是否 40 TOPS 以上,内存是否 16GB 以上,存储是否 256GB 以上。轻薄本的内存大多焊死在主板上,买回来就加不了,预算允许就直接选大一档。
在自己电脑上跑大模型,用的是 NPU 吗
多数情况下不是。现在最常用的两个本地工具是 Ollama 和 LM Studio。Ollama 官方的硬件支持文档只列了英伟达的 CUDA、AMD 的 ROCm、苹果的 Metal 和 Vulkan 这几条路,都是显卡;在 Mac 上,它用苹果芯片的 CPU 和 GPU,Intel 处理器的 Mac 只能用 CPU。整套文档里找不到 NPU 的支持说明。跑起来以后,在命令行输入 ollama ps,能看到这个模型是全在 CPU 上跑,还是 CPU、GPU 各占一部分。
LM Studio 的系统要求页同样只谈内存和显卡:Mac 要 M1 到 M4 这类苹果芯片,建议 16GB 以上内存,8GB 的 Mac 也能用,但只能跑小模型;Windows 支持普通 x64 电脑和骁龙 X Elite 这类 ARM 电脑,x64 处理器要支持 AVX2 指令集,建议至少 16GB 内存和 4GB 独立显存。

也有专门走 NPU 的路。微软的 Foundry Local 能在本机跑模型,有 GPU 和 NPU 时会用上,没有就退回 CPU,Windows、苹果芯片的 Mac 和 Linux 都能装。不过它能用 NPU 的前提是模型已经为这块芯片转换好,能选的模型比 Ollama 和 LM Studio 少。开头那台 3499 美元的 Ghost 主机也是同一个道理:它想让几百亿参数的模型在家里跑得顺,选的是一块带大显存的显卡。
所以想在本机跑聊天模型,看的是显存或内存够不够大、读写够不够快,NPU 在这件事上帮不上主要的忙。
我的电脑能跑多大的模型?先看内存
跑模型时,整个模型文件要装进显存或内存里,旁边还得给系统、浏览器和对话上下文留出位置。下面是 Ollama 模型库里通义千问 Qwen3 各个尺寸的默认下载大小(2026 年 10 月查看),文件越大,回答通常越好,也越吃内存:
| 模型 | 文件大小 | 大致适合的电脑(我们的估算) |
|---|---|---|
| Qwen3 0.6B / 1.7B | 523MB / 1.4GB | 8GB 内存的电脑也能跑,适合试手 |
| Qwen3 4B | 2.5GB | 8GB 内存能跑,16GB 更从容 |
| Qwen3 8B | 5.2GB | 16GB 内存,或 8GB 显存的显卡 |
| Qwen3 14B | 9.3GB | 16GB 内存勉强,32GB 或 12GB 以上显存更稳 |
| Qwen3 32B | 20GB | 32GB 以上内存,或 24GB 显存 |
| Llama 3.1 70B | 43GB | 64GB 以上统一内存的 Mac,或多块显卡 |
最右一列是我们按“文件大小再加几 GB 余量”推出来的,不是哪家厂商的规定。可以拿来对照的官方说法有两条:LM Studio 建议至少 16GB 内存;Ollama 的说明文件曾经长期写着,跑 7B 模型至少要 8GB 内存,13B 要 16GB,33B 要 32GB,这句在 2026 年 2 月的新版里删掉了,但量级没变。
Windows 电脑和 Mac 在这里的差别很大。带独立显卡的 Windows 电脑,看的是显卡自己的显存,模型装不下时会有一部分挪到 CPU 上算,速度明显变慢,ollama ps 里看到 CPU 占了一大块就是这个情况。苹果芯片的 Mac 用统一内存,显卡能直接用大部分内存,所以一台 32GB 或 64GB 的 Mac 能跑的模型,往往比显存只有 8GB 的游戏本还大。
最省事的试法是:装上 LM Studio 或 Ollama,先下一个 4B 的模型问几个问题,速度能接受,再试 8B;回答一个字一个字往外蹦、风扇狂转,就说明这台电脑到上限了。
怎么查自己的电脑有没有 NPU
Windows 电脑:打开任务管理器,点“性能”,看左侧列表里有没有 NPU 这一项,点进去能看到它的占用曲线。想知道是哪个程序在用,切到“进程”页,在列标题上点右键,勾选 NPU 这一列;微软说按程序显示 NPU 占用只在部分较新的设备上有。没看到 NPU,可以在“性能”里的 CPU 页查到处理器型号,再对照上面那张表。
Mac:点左上角苹果菜单,选“关于本机”,“芯片”一行写着 Apple M1 或更新的型号,就有神经网络引擎;写的是 Intel 处理器,就没有。Intel 处理器的 Mac 用不了 Apple 智能,LM Studio 目前也不支持。
Apple 智能对设备的要求,按苹果 2026 年 9 月的说明,是 M1 及之后的 Mac、iPhone 15 Pro 和 iPhone 15 Pro Max、iPhone 16 及之后的机型,还要预留最多 8GB 的存储空间,部分新机型最多要 14GB。苹果写明在中国大陆购买的设备目前用不了 Apple 智能。
要不要为了 AI 换电脑:按用途来定
| 你主要想用 AI 做什么 | 该看什么 | NPU 重要吗 |
|---|---|---|
| 用 ChatGPT、Gemini、Claude 这类网页或 App 里的 AI | 都在服务器上算,能流畅上网的电脑就够 | 不重要 |
| 视频会议背景虚化、降噪、实时字幕 | 有 NPU 更省电、续航更长;基础效果 10 TOPS 以上就能开 | 有用 |
| 想用 Windows 的回顾、Click to Do、新的本机搜索 | 必须是 Copilot+ PC:40 TOPS、16GB、256GB 三条都满足 | 必须 |
| 在本机跑 8B 到 14B 的聊天模型 | 16GB 到 32GB 内存;有独立显卡就看显存 | 基本用不上 |
| 在本机跑 70B 级的大模型 | 64GB 以上统一内存的 Mac,或大显存显卡 | 不重要 |
| 修图、剪视频软件里的 AI 功能 | 看软件官网写的是用显卡还是 NPU | 看软件 |
手上的电脑还能用,就先别急着换。云端的 AI 对电脑几乎没有要求;想试本机模型,先用现有的电脑跑一个 4B 模型看看效果。真要买新电脑,把钱优先花在内存上,内存焊死的机型尤其要一次买够;NPU 只要过了 40 TOPS 就够用,不必为了表里多出来的几十 TOPS 多付钱。商家把“AI PC”当卖点时,让他把这台机器的 NPU 算力、内存和存储三项写清楚,再对照上面 Copilot+ 的三条门槛。
常见问题
NPU 和显卡,跑 AI 哪个更重要?
看你跑什么。背景虚化、实时字幕、本机搜索这类一直开在后台的小功能,NPU 更省电;在本机跑聊天大模型,Ollama 和 LM Studio 用的都是显卡、CPU 和内存,显存或统一内存越大,能跑的模型越大。只用网页上的 AI,两者都不重要。
16GB 内存够在本地跑大模型吗?
够跑 8B 左右的模型,比如 5.2GB 的 Qwen3 8B,14B 就比较勉强。LM Studio 官方建议至少 16GB 内存,8GB 的 Mac 只能跑小模型。想跑 30B 以上,至少要 32GB;跑 70B 级,要 64GB 以上统一内存的 Mac 或多块显卡。
旧电脑能加装 NPU 吗?
不能。NPU 做在处理器里,笔记本和台式机都没法单独加。台式机可以加一块独立显卡来跑本地模型,效果通常比 NPU 更好。Copilot+ 的那些功能要求处理器自带 40 TOPS 以上的 NPU,加显卡也开不了。
AI PC 断网还能用 AI 功能吗?
一部分可以。微软说 Copilot+ PC 的很多功能下载好之后可以离线用,部分功能需要微软账户;画图的 Cocreator 这类图像生成要联网做内容安全检查。LM Studio 下载好模型后也能完全离线运行。
苹果电脑算不算 AI PC?
Copilot+ PC 是微软给 Windows 电脑定的标准,Mac 不在其中。M1 及之后的 Mac 都有神经网络引擎,支持 Apple 智能;本机跑模型时,Mac 的统一内存能被显卡直接使用,所以内存大的 Mac 能跑比较大的模型。
资料来源与延伸
- 微软 Windows 11 规格与系统要求:Copilot+ PC 的 40 TOPS、16GB、256GB 三项最低配置,支持的处理器和各项功能的说明
- 微软 Learn Copilot+ PC 开发者指南(2026 年 8 月更新):NPU 需要软件专门适配、模型量化和退回 GPU/CPU 的说明
- 英特尔 酷睿 Ultra 200V 的 NPU 算力说明,以及高通 骁龙 X2 Plus 产品简介、AMD CES 2026 发布稿、苹果 M4 发布稿
- Ollama 硬件支持文档和 Qwen3 模型页;LM Studio 系统要求
- 微软 Windows IT Pro 博客 任务管理器查看 AI 负载的功能(2026 年 8 月 19 日);苹果 Apple 智能设备要求(2026 年 9 月)
- TechCrunch Ghost 融资 1100 万美元、推出 3499 美元个人 AI 主机(2026 年 10 月 5 日)
更新记录:2026 年 10 月 6 日首发。各家芯片的参数和微软的功能列表变化很快,有变动会记在这里。