【2026年6月ds】模型跑在端侧的意思
2026/8/5 1:51:27 网站建设 项目流程

“模型跑在端侧”的意思就是:把人工智能(AI)模型直接放在你的本地设备(如手机、电脑、智能音箱、车载芯片等)上运行,而不是放在云端服务器上。

要理解这句话,可以拆解为两个部分:

1. 什么是“端侧”?
“端”指的是终端设备,即你手上能直接接触到的硬件,比如:

  • 智能手机
  • 笔记本电脑/台式机
  • 智能手表
  • 物联网设备(如智能摄像头、空调)
  • 汽车的车机系统

2. 什么是“跑在端侧”?
“跑”指的是模型的推理(计算)过程。当模型“跑在端侧”时,所有的计算都在设备本地完成,不需要联网把数据发送到远处的云端数据中心去处理。


为了更直观,对比一下“云端”和“端侧”:

  • 云端跑模型(传统方式):你在手机上和AI对话,手机把你的问题传到云端的超级计算机,算完再把结果传回来。(依赖网络,有延迟)
  • 端侧跑模型(现在趋势):你把AI模型下载到手机里,手机自带的芯片(CPU/GPU/NPU)直接计算,给出回答。(不联网也能用,极速响应)

端侧跑模型的核心优缺点:

优点缺点
隐私安全:你的数据(照片、语音、文件)不出设备,不会被上传,不怕泄露。算力受限:手机芯片不如云端超级计算机强,无法跑太大的模型(比如千亿参数),通常只能跑小模型(几十亿参数)。
无需网络:在飞机、地下室、没信号的地方照样能用。存储和内存占用大:一个大模型可能占几个GB的内存和存储空间。
零延迟:没有网络传输的等待,响应速度极快(毫秒级)。功耗和发热:运行大模型会让手机发烫、耗电变快。
成本低:不需要向云端付费买算力,用本地电量就行。

举个生活中的例子:

  • 云端跑模型= 叫外卖,后厨(云端)给你做,做好送过来(有等待时间和配送费)。
  • 端侧跑模型= 自家厨房(端侧)自己做,食材(数据)不出家门,想吃就吃(不用等外卖员),但家里灶台火力(算力)有限,做不了满汉全席(超大模型)。

目前很多手机厂商(如苹果、华为、小米)都在大力推广端侧AI,把大模型塞进手机系统里,用来做相册修图、实时翻译、语音助手等功能。你最开始问的存储大小(336MB),刚好就很适合用来装一个端侧的小模型。

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询