新模型
2026-09-08
华为麒麟 9050 Pro 发布:手机本地能跑 300 亿参数大模型,飞机上没网也能用 AI
华为麒麟 9050 Pro 发布:手机本地能跑 300 亿参数大模型,飞机上没网也能用 AI
一句话说清:以前手机上的 AI 助手,其实都是把你的话传到云端服务器算完再传回来——没网就废。麒麟 9050 Pro 把一个 300 亿参数的大模型直接塞进了手机芯片,飞机上、地下车库、信号盲区,AI 照样干活,而且你的照片和数据不用上传。
发生了什么
据 21 世纪经济报道 / 腾讯新闻、电子工程专辑、ChinaBiz Insider 等报道(2026-09-07 至 09-08):
- 9 月 7 日,华为举行 HarmonyOS 7 及折叠屏新机发布会,新一代三折叠旗舰 Mate XT 2 非凡大师 首发搭载 麒麟 9050 Pro 芯片。这是继 2020 年 Mate 40 之后,时隔六年华为再次在旗舰发布会上专门解读全新麒麟芯片。
- 核心亮点:端侧大模型。达芬奇架构 NPU 采用多级存算协同优化技术,实现行业首个端侧 300 亿参数(30B)MoE 全模态大模型入端,每次激活参数 20 亿(2B)。余承东现场举例:在无网络环境下(例如飞机上),仅靠本地就能一句话整理相册。
- 整机性能:Mate XT 2 相比上代 提升 42%。
- 灵犀 CPU:9 核(1 超大核 + 2 性能核 + 4 能效核 + 2 小核)+ 超线程,另有超低功耗微核处理息屏显示;单核峰值性能 +24%,多核并发 +52%。
- 马良 GPU:硬件级光线追踪,计算单元与缓存翻倍,可处理 5000 万线实时光追,渲染性能 +142%;4K 视频导出速度 +40%。
- 巴龙基带:空口速率与寻呼成功率提升 42%,支持天地一体融合通信。
- 技术路线换道:麒麟 9050 Pro 是全球首款落地华为「韬定律(τ Law)」、采用逻辑折叠(Logic Folding)技术的旗舰芯片。传统提升性能靠把晶体管做小(摩尔定律),「韬定律」改为压缩芯片关键路径上的信号传输延迟 τ——把原本平铺的电路折叠成多层垂直堆叠,像房子从平层改成复式并加装电梯,信号跑得更短更快。晶体管密度从每平方毫米约 1.55 亿个提升到约 2.38 亿个。
- 散热方面采用多通道导热封装 + 超大 VC 石墨烯跨轴散热系统,游戏峰值温升降低约 2.5°C。安全上支持双硬件安全单元、后量子密码算法检测、EAL5+ 认证。
来源:21 世纪经济报道 / 腾讯新闻(2026-09-08)、电子工程专辑(2026-09-07)、ChinaBiz Insider(2026-09-07)、快科技(2026-09-08)。
对我有什么用
- 没网也能用 AI,这是质变。目前主流手机 AI 助手(包括各家的语音助手、AI 搜图、AI 修图)绝大部分依赖联网。端侧跑 30B 模型意味着:飞机、高铁隧道、地下室、出国没流量的时候,AI 功能不会「变砖」。
- 隐私更安全。本地推理不用把照片、录音、聊天记录传到云端服务器。对于处理私密照片、财务截图、家人语音这类场景,端侧是本质上更放心的方案。
- 响应更快、不花额度。少了一次网络往返,延迟更低;也不消耗云端 AI 的付费额度或次数限制。
- 「全模态」的含金量:能同时处理文字、图片、语音、视频,所以「一句话整理相册」这种需要看懂图片内容的任务才能在本地完成。
- 对行业的信号:这是国产芯片在被限制先进制程(无 EUV 光刻机)的情况下,用架构创新换性能的一次公开验证。如果「逻辑折叠」路线跑通,成熟制程也能做出对标先进制程的性能表现。
我可以怎么做
- 不用急着换手机。先搞清楚一个概念:判断一款手机「AI 强不强」,别只看跑分,要问它的 AI 功能是本地跑还是联网跑。华为线下门店可以现场测试——开飞行模式,试试语音整理相册、AI 消除、实时翻译还能不能用。
- 手上的手机也能享受端侧 AI:不少机型的「AI 消除」「文字识别」「离线翻译」「实时字幕」本来就是本地跑的。在设置里搜索「离线」,把离线语音包、离线翻译包提前下载好,出门断网也能用。
- 想体验端侧模型的电脑党:在电脑上装 Ollama(ollama.com)或 LM Studio,下载 Qwen3、Llama 之类的小模型(4B–8B 版本对普通笔记本比较友好),断网也能和 AI 聊天。这是理解「端侧大模型」最直观的方式。
- 敏感内容优先用本地 AI。整理身份证照片、银行流水、家人合照、公司文件时,能用本地功能就别用云端在线工具。
温馨提醒
- 性能数据来自厂商发布会,「提升 42%」「+142%」等均为华为内部基准,实际体验请以第三方评测和上手体验为准。
- 端侧 ≠ 全能。20 亿激活参数的端侧模型在复杂推理、长文写作、专业编程上仍明显弱于云端大模型(如 GPT、Gemini、Qwen 的旗舰版),端侧的定位是「快、私密、断网可用」,不是「最聪明」。
- 端侧跑大模型耗电、发热。长时间高强度调用本地 AI,续航掉得比正常使用快,这是物理规律,任何芯片都一样。
- 三折叠是高端旗舰机型,价格不低。如果只是想用端侧 AI,很多中端机型的离线 AI 功能已经够日常,不必为此专门升级。
- 「韬定律」目前仍是华为提出并主推的技术路线,学术界与产业界的长期验证还在进行中,散热与良率等争议尚未完全落定。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法