9月16日,2026 vivo开发者大会在深圳举行。会上vivo正式提出个人化智能理念,发布全新蓝心大模型矩阵与系统级蓝心Harness,展示OriginOS 7与蓝心小V深度融合后的系统级AI能力,并公开蓝河AgentOS技术预览版、智能体安全架构及多项无障碍技术进展。会后,vivo副总裁、OS领域副总裁、AI全球研究院院长周围,接受南都湾财社等媒体采访时表示,未来两三年,端侧大模型、智能体操作系统和全设备协同将成为手机厂商竞争的核心赛道。谁能率先把个人化智能真正融入系统底层,谁就能跳出过去参数、硬件、影像的传统竞争框架,重新定义下一代智能手机的核心体验。
2025年底,行业普遍认为7B参数模型在手机上稳定运行已经接近硬件极限,多数厂商对端侧模型参数量的提升持谨慎态度。vivo在本次大会上直接公布蓝心30B MoE端侧大模型已进入深度预研阶段,打破了此前行业对端侧算力边界的判断。
周围在采访中坦言,去年行业普遍认为手机上跑3B、7B模型对内存来说仍然吃力,今年初MoE稀疏架构的技术变化彻底改变了这一判断。大模型不再需要一次性全部加载进内存,每次按需激活1-3个专家子网络即可完成任务处理,当前旗舰机型标配12G内存,实际分配3-4G空间就可以支撑30B MoE模型的动态运行。
南都湾财社记者了解到,目前行业内不同厂商的端侧路线已经出现明显分化。部分厂商延续云端为主、端侧辅助的思路,把复杂推理任务放回云端完成;部分厂商选择继续在7B-13B稠密模型范围内做体验优化。而vivo直接押注MoE稀疏架构,目标在2028年底让30B级端侧大模型在普通旗舰手机上实现全本地运行,全程无需云端介入。
对比PC端当前部署30B大模型普遍需要18-19G内存的现状,手机端能把内存占用压缩到2-4G,核心不是单纯靠算法压缩,而是终端厂商与芯片厂商在指令集级别完成协同优化。周围表示,“通用大模型厂商很难做到这一点,只有长期扎根终端场景的手机厂商,才能针对GPU、NPU和内存调度做定向优化,最终把功耗和延迟压到用户可接受的范围。按照目前的技术进度,2028年底端侧MoE模型工作电流有望控制在600毫安上下,达到普通手机高清视频播放的负载水平,日常使用不会带来明显续航负担。”
当前多数手机AI功能的运行逻辑仍然是用户主动唤醒、发出指令、系统联网处理、返回结果。OriginOS 7对系统级AI体验的改造,核心是把这个流程完全反转过来。vivo AIOS产品总监黄梓勋介绍,vivo在相册随手清、文件管理、AI日历等高频场景中,已经实现端侧模型在用户触发功能之前,就在后台默默完成内容理解和特征沉淀。如用户打开相册想要找去年国庆带孩子在海边的照片时,端侧模型早已经把所有照片的人物、场景、时间特征全部识别完成,指令发出后瞬间就能返回结果,完全不需要等待云端上传和处理。
2026年,智能体接入方式成为行业争议焦点。部分厂商选择通过模拟GUI点击的方式,让AI直接操作第三方应用界面,快速实现跨App任务执行。vivo在本次大会上明确表示,现阶段不会把GUI自动化作为智能体接入的主流路线。
黄梓勋进一步解释,GUI操作本质上是非常短期的技术方案,在PC生态里除浏览器之外,大量私有应用对GUI自动化的支持体验非常差,强行推进反而会带来大量执行错误和权限安全问题。vivo目前已经开放6000多个系统级原子能力,覆盖笔记、日历、电话、短信、设置等几乎所有系统应用的单点功能,未来目标是把这个数量级扩展到3万个。这些原子能力可以直接被智能体调用,不需要走模拟点击的迂回路径,执行效率和稳定性远高于GUI方案。
对于第三方应用接入,vivo AI产品总经理关岩冰表示,90%用户的高频需求集中在头部应用,vivo会优先和头部合作伙伴联合打磨体验,共同确认二次确认机制、权限边界等细节,在保证用户可控透明的前提下逐步提升执行成功率。对于大量中长尾应用,即使强行用GUI方式接入,实际用户使用频次也非常低,体验反而容易出问题,现阶段vivo选择保持克制,不盲目追求覆盖数量。
在收费模式上,vivo也明确不会走全量订阅的路线。关岩冰表示,面向普通大众用户,基础AI能力将保持免费可用,只有重度高频使用的用户,才会提供额外的流量包扩容选项,不会让普通用户为基础体验付费。
此外,值得关注的是,蓝河操作系统发布至今已经迭代到4.0版本,目前主要搭载在vivo WATCH系列智能手表上。周围在采访中首次确认,蓝河系统的技术准备完全按照完整通信手机的标准推进,大会展示区的预览版工程机已经可以正常打电话、录像、拍照、发短信,只是当前应用生态还不够成熟。未来蓝河系统不会局限在手表品类,还会扩展到更多低功耗、高安全性要求的设备上。
采写:南都·湾财社记者 孔学劭