DeepSeek这么好用,为什么手机厂商还要自研大模型?

DeepSeek狂潮席卷到了手机行业。截至2月18日,华为、荣耀、努比亚、魅族、小米、vivo、OPPO等国内主流手机厂商全部都已接入DeepSeek。

DeepSeek狂潮席卷到了手机行业。截至2月18日,华为、荣耀、努比亚、魅族、小米、vivo、OPPO等国内主流手机厂商全部都已接入DeepSeek。

不过,上述多数厂商目前做的都是同样的工作:在自家产品服务上为DeepSeek开“入口”,再接入兼容DeepSeek开源模型所提供的API接口,这也是搭上快车最简便的办法。

但由于部分厂商只接入了“尝鲜版”,在问答体验上并不完全与DeepSeek相同。并且,API接入的方式也被质疑是“相当于安装了一个APP”,并没有太多体验创新。这是因为,满血版推理任务需要庞大算力支持,若直接采用满血版,可能面临类似DeepSeek官方服务“服务器繁忙”的体验风险,而“尝鲜版”在成本与稳定性间更易平衡。

努比亚并未选择开“入口”的方式。其旗舰手机Z70 Ultra已经实现了全尺寸系统内嵌6710亿参数DeepSeek R1模型,实现了DeepSeek-R1与系统的整合。

在DeepSeek-R1诞生之前,AI手机的战火已经烧了两年。为了自研大模型,头部厂商纷纷投入了高额资金:荣耀前CEO赵明曾透露,荣耀在AI领域的投入已达100亿元,大模型战之后每天的投入都在翻倍;vivo副总裁周围也表示,每年在大模型领域的投入成本在20-30亿元。

但手机厂商对AI的重金投入,暂时还没有换来明显的销量增长。一个原因是,当前AI功能主要集中在语音助手优化、图像处理等场景,缺乏杀手级应用。尽管手机厂商开始探索AI与系统的融合,推出智能体点外卖等差异化功能,但就实际体验而言,仍然处于起步阶段。

DeepSeek的诞生改变了过去手机厂商比拼参数的逻辑。努比亚技术专家告诉界面新闻,DeepSeek为手机厂商带来的最大改变,是打破了高性能推理模型的成本桎梏,且开源,使得这类模型也能够部署在像手机这样的消费电子产品上,并且成本大幅降低。

除了通过API接入DeepSeek之外,已经有多家手机厂商尝试将DeepSeek-R1部署在本地。不过,当前的手机芯片配置还难以支持满血版DeepSeek-R1(670B)的本地部署,仅能够支持10B(10亿参数)以下的蒸馏版本。

这显然不是最佳方案,因为蒸馏也会在一定程度上损失推理能力。但有手机从业者对界面新闻表示,小模型在部分垂直场景的表现值得肯定,例如在通话总结、文档概要等高频场景中,vivo蓝心3B端侧模型(30亿参数)通过模型压缩和精度恢复技术,实现了端侧运行且功耗降低46%。

也正因如此,手机厂商引入DeepSeek等通用大模型的同时,也仍有必要推进自研。一方面是出于保护用户隐私的考虑,承载健康监测、支付验证等敏感数据,另一方面还是成本压力。

努比亚技术专家提到,尽管算力成本已经大幅降低,但现阶段需要借助云端算力,鉴于手机用户规模之大,跑起来同样是一笔不菲的数字,自研端侧模型能够承接部分高频次用户场景,进一步降低成本。

上述专家指出,DeepSeek与手机厂商自研大模型的本质差异在于能力边界:厂商自研模型聚焦用户意图理解与多模态场景串联(如通过传感器数据预判需求),这正是DeepSeek-R1这类通用推理模型的盲区。

目前,行业普遍采用“前端感知层自研+后端服务层调用”的协同模式――厂商通过自研模型实现实时场景感知与交互设计,复杂计算则交由专业大模型处理。这也是一种共识:简单的文字搬运式调用无法体现移动端价值,真正的竞争力在于芯片-模型-传感器的全链路整合。

例如,全尺寸嵌入DeepSeek-R1的努比亚Z70 Ultra将DeepSeek与其自研星云AI的多模态能力结合,在拍照后可直接调用DeepSeek进行分析、解答。

诸如此类的差异化体验,也将是未来AI手机的竞争焦点。问答与搜索是第三方应用都能够满足的需求,手机厂商比拼的则是如何通过AI对系统进行重构,以及联动生态资源的能力,例如用AI智能体来实现真正的自动点单、订餐等。

来源:飞象网
免责声明:本文内容来源于第三方或整理自互联网,本站仅提供展示,不拥有所有权,不代表本站观点立场,也不构成任何其他建议,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容,不承担相关法律责任。如发现本站文章、图片等内容有涉及版权/违法违规或其他不适合的内容, 请及时联系我们进行处理。

相关推荐

  • 我国生成式人工智能用户规模突破7亿人,全球主流大模型调用榜单上排名前6的模型全部来自中国团队

    9月29日,中国互联网络信息中心政策与国际合作所在“2026(第七届)中国互联网基础资源大会”上发布《生成式人工智能应用发展报告(2026)》(以下简称《报告》),通过最新调查数据,对生成式人工智能的用户使用情况、产业应用情况、政策制定情况进行研究分析。《报告》显示,截至2026年上半年,我国生成式人工智能用户规模突破7亿人,普及率超50.0%。

    2026-09-29
  • 海光深入医院场景,助力医疗大模型跑进临床

    一张ICU病床,一天大约会产生10万条数据。在生死时速的真实临床现场,医生每天的诊疗,本质上就是在这片庞杂的数据汪洋中求索。 近年来,AI在医疗场景的布局按下了加速键,尤其是自2025年初,DeepSeek的爆火,激发了国内上百家三级医院陆续完成了大模型的本地化部署。然而,真正能将其嵌入核心诊疗闭环的却屈指可数。 事实...

    2026-09-26
  • 大模型规模化商用:AI浪潮下软件测试范式的迭代之路

    近年大模型能力实现跨越式跃升,AI 智能体快速从实验室原型走向产业生产场景,从单纯对话交互升级为可自主规划任务、调用工具、完成复杂业务流程的行动型系统,千行百业都在加速探索智能体的落地应用。但产业实践中也能看到,不少项目演示效果出众,落地真实业务却屡屡碰壁,很多企业把焦点集中在模型能力迭代,却忽略了软件底层质...

    2026-09-15
  • DeepSeek找了一个90后投资人当CFO

    9月14日消息,高瓴创投“90后”合伙人严文韬或将加入DeepSeek出任CFO,预计近期正式到岗。若消息落地,DeepSeek将完成一次重要的非技术高管补位。 就在上周,DeepSeek被曝出已选定中信证券、全面筹备科创板上市相关事宜,预计本年度内递交IPO申报材料。投资人出身的CFO到位后,过去以模型能力著称...

    2026-09-14
  • 张宏江外滩大会三点观察:从大模型到智能体经济,涌现的坡度就是企业竞争力

    9月10日消息(报道:李楠)今日,在 2026 Inclusion·外滩大会开幕主论坛上,源码资本投资合伙人、美国国家工程院外籍院士张宏江以《人工智能加速演进:大模型技术发展的 3 点观察》为题,分享了他的判断。 开场他先把三个观察摆了出来:一是大模型是人类历史上发展最快的一次技术浪潮;二是这背后的驱动,是从基础...

    2026-09-13
  • DeepSeek发布V4.1 Flash并合并三大交互模式,V4 Pro将于9月14日下线

    9月10日消息,DeepSeek今日正式发布V4.1 Flash模型,同时宣布将原有的快速模式、专家模式和识图模式合并为统一的智能模式。用户不再需要手动切换,模型可自动检测查询复杂度、在检测到图片输入时激活视觉能力,并根据任务难度调整处理能力。 据了解,V4.1 Flash为552B参数的MoE模型,采用了全新的...

    2026-09-11
  • 天猫上线AI空间站,大模型订阅服务首入电商消费场景

    9月3日消息,天猫今日正式上线“AI空间站”(Token充值中心),首批接入阿里云、智谱、Kimi、MiniMax等国内头部大模型厂商的订阅服务,标志着大模型订阅服务首次进入传统电商消费场景。 页面显示,该充值中心在售商品涵盖按周期订阅的Token Plan、Coding Plan以及按用量付费的充值方案,支持卡...

    2026-09-04
  • DeepSeek发布公告,称API将大幅涨价

    8月6日消息,DeepSeek今日在开发者后台发布公告,计划近期整体上调API服务定价,并明确提示“预计涨幅较大”。这是DeepSeek自开启商业化以来首次公开预告大幅提价,标志着其延续近一年的“极致低价”策略即将转向。 目前DeepSeek API采用峰谷定价模式:工作日高峰时段(北京时间9:00-12:00、...

    2026-08-09
  • DeepSeek投了1.4亿锁三年:宇树科技战配名单释放了哪些信号?

    8月7日消息(报道:王佩)8月6日晚,宇树科技(688836)披露科创板上市发行安排公告,发行价定为150.80元/股。按发行后总股本约4.0446亿股计算,上市市值约609.93亿元。本次拟发行4044.6434万股,占发行后总股本10%,预计募资总额约60.99亿元,发行市盈率219.23倍,远超行业平均市盈...

    2026-08-08