大模型正在“變小”?

2026年7月22日 09:52
大模型正在“變小”?

重點摘要

# 大模型正在“变小”:从云端下凡到终端的智能革命 在刚刚过去的WAIC 2026上,一个明显的风向转变正在发生:厂商不再像去年那样热衷于比拼模型参数规模和榜单跑分,反而集体谈论“模型能干什么”“能不能赚钱”。细心观察不难发现,几乎所有的参展商都在推广轻量化部署,纷纷拿出自家的“mini版”大模型。曾几何时,我们习惯了让手机语音助手在电梯里失灵、让汽车导航在隧道里沉默、让相册里的AI修图因断网变成灰色图标——真正的智能似乎永远依赖那朵“云”。

站內 AI 整理稿

# 大模型正在“变小”:从云端下凡到终端的智能革命

在刚刚过去的WAIC 2026上,一个明显的风向转变正在发生:厂商不再像去年那样热衷于比拼模型参数规模和榜单跑分,反而集体谈论“模型能干什么”“能不能赚钱”。细心观察不难发现,几乎所有的参展商都在推广轻量化部署,纷纷拿出自家的“mini版”大模型。曾几何时,我们习惯了让手机语音助手在电梯里失灵、让汽车导航在隧道里沉默、让相册里的AI修图因断网变成灰色图标——真正的智能似乎永远依赖那朵“云”。但今天,一场让大模型“瘦身”的全球竞赛正在改写这一切:研发人员正将曾经需要一整栋机房和巨大电力才能驱动的超级大脑,拼命塞进手机、汽车、甚至一台机械臂中。这不是幻想,而是源自现实需求催生的产业共识。 需求端的三记“耳光”,直接扇醒了路径依赖。第一记来自手机隐私:当用户拍下孩子第一次走路的视频、截图股票账户或与伴侣火热聊天,这些数据绝不该上传到任何云端。手机作为最贴身的数字器官,倒逼大模型必须本地运行,否则隐私保护就是一句空话。第二记来自汽车安全:当一辆以时速120公里飞驰的电车,需要理解“有点困了,来点提神的但别对着脸吹”这样复杂的口语指令,任何将其上传云端再等待回传的延迟都可能带来致命的0.5秒——那意味着15米的距离。自动驾驶和智能座舱的端到端决策,必须长在车身上。第三记则来自工厂效率:长三角、珠三角的“黑灯工厂”里,高速摄像头每秒上百帧扫描电子元件,如果每笔数据都要上传到中央服务器分析,一旦网络抖动或过载,整条产线就得停摆。如今,内置轻量视觉大模型工控机直接在产线上做毫秒级判决,既不需要联网,也不会抱怨。这三记耳光从隐私、安全和效率三个维度打出一个清晰的结论:智能不能只漂浮在云端,它必须像血氧一样融入每一个终端。 全球科技巨头迅速响应,但路径各有千秋。OpenAI的策略是纵向分级、按质论价:云端用最强GPT-4探索智能上限,但应对每天数十亿“帮炸鸡店起名”“写会议纪要”这类高频简单任务,则派出更轻更快的GPT-4o mini。后者的响应速度极快,成本断崖式下降了超过60%,就像一个随叫随到的博士生师兄,把诺贝尔奖级的导师留给关键答辩和战略方向。Google则走“全尺寸覆盖、软硬一体”路线,从发布之初就将Gemini分为Ultra、Pro、Nano三个版本。最不起眼的Gemini Nano被专门设计用于在Android设备本地运行,通过极致的蒸馏算法和量化技术,将诈骗短信检测、智能回复、离线语音转录等能力压缩成一个小型高效离线引擎。即使飞行模式,Pixel 8 Pro依然能精准过滤垃圾短信并生成智能摘要——所有计算都在本机完成,数据没有一比特离开设备。 视线回到国内,创新的形式更为多元。DeepSeek背靠量化交易的创始背景,对效率有近乎偏执的追求。它不仅发布对标GPT-4的云端大模型,更推出了1.3B、6.7B这样“犯规”的微型模型矩阵,专攻代码生成与数学推理。一个6.7B的代码小模型,在特定算法题上的速度与表现能媲美大几十倍的模型,且完全免费开源。这意味着一个回龙观出租屋里的三人极客团队,可以用几千块的服务器跑着一位24小时不知疲倦、水平堪比三年经验工程师的AI同事。DeepSeek将“AI平权”的口号直接变成了小团队手里的生产力工具。而Kimi的创始人杨植麟则重新定义了什么是“轻”:当其他模型还在炫耀能处理几十页PDF时,Kimi已经能一口气吞下3小时录音、100页财报和50篇论文,然后精准回答内容的内在矛盾。它用极致的算法深度替代系统层面的复杂度累加,一个模型就完成了往常需要“大模型+向量数据库+检索增强生成工具+多智能体”才能搞定的长文本任务——轻的是整个应用架构的复杂度和开发成本。面壁智能则把“小”本身当作信仰,其推出的“小钢炮”系列端侧模型在只有几亿参数的情况下就在基础NLP任务上展现惊人能力,让人看到未来洗衣机、电饭煲里也能住着一个懂衣料分类和大米新鲜度的“哆啦A梦”。 面对“变小了会变傻吗”的核心疑虑,业界的回答既坦诚又严密。过去几年,“大力出奇迹”似乎是唯一铁律,参数越多就越聪明。但工程师们指出,当模型要被部署到手机相册“一键修图”功能时,它99.99%的知识都是占内存的废物。它只需要成为全宇宙最懂相册管理的专家,不需要会写离骚或求解量子力学。在这种目标下,知识蒸馏像一位“一对一精英私教”,大模型老师在教学生时不仅给出答案,还传递思考过程中的“软标签”——比如看一张狗的照片,老师内心判断是金毛犬85%、拉布拉多10%、还有5%是混血犬,这种带温度和不确定性的“暗知识”让小学生学会举一反三。同时,工程师给这些模型实行了最严格的“饮食管理”,用最强大的模型去合成最纯净的因果链数据,在合同审查、医学影像分析等高精尖任务里,一个只吃“特供营养餐”的1B参数小模型可以在精准度上轻松超过被全网噪音污染过的千亿大模型。再辅以量化感知训练——从训练第一天就告诉模型以后要在信号严重损失的设备上工作,让它主动学会用更少的比特位表达最核心的信息,进化出内在的“降噪算法”。这些技术合力证明:变小不等于降智,而是以放弃全知全能为代价,换取在特定场景内的极致表现。 这场让模型变小的史诗级大戏高潮远未到来。它真正的野心,不是创造一项可写入教科书的技术指标,而是让技术完全消失——消失在手机里、汽车后视镜里、工厂流水线的每一次快门里。如盐溶于水,潜入生活的角角落落。真正伟大的技术,就是你感受不到它的存在,却再也离不开它带来的那种不动声色的妥帖。而每日伴随我们的手机与汽车,正是距离这场风暴最近的前线,正在你我掌中,无声惊雷。

Related

相關文章

量子位生成式AI

天立啟鳴發佈教育AGI白皮書:破解教育“不可能三角”

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 天立啟鳴發佈教育AGI白皮書:破解教育“不可能三角” 量子位的朋友們 2026-07-22 11:54:49 來源:量子位 從答題響應到心智仿真 當下教育數字化已走完信息化、數字化兩大階段,但教育仍深陷質量、成本、規模難以兼顧的“不可能三角”:傳統自適應工具、通用大模型僅停留在內容分發表層,只能完成答題響應、習題推薦,無法仿真學習者內在認知邏輯,難以破解統一教學與異質認知的核心矛盾,行業亟待從“信息傳遞”邁向“認知仿真”。 7月18日,在2026第9屆世界人工智能大會(WAIC)未來計算與未來算力論壇上,天立國際、啟鳴達人、天立啟鳴AI研究院、AIII人工智能國際研究院,以及北京航空航天大學國際創新研究院聯合打造併發布了《世界模型驅動的教育AGI白皮書——從認知仿真到教育智能體的範式躍遷》(以下簡稱:《白皮書》)。 天立國際首席科學家、啟鳴達人公司CTO、天立啟鳴AI研究院院長、北京航空航天大學國際創新研究院基礎教育通用人工智能實驗室首席科學家兼聯合主任劉志毅在論壇上對《白皮書》做了詳細解讀。 《白皮書》以認知世界模型(CWM)為底座、以LAM(Learning Assessment-Modeling)閉環為範式,提出教育仿真器—規劃器—渲染器為三位一體的工程架構。並將”湧現式教育”(Emergent Education)確立為未來願景、”認知共生”(Cognitive Symbiosis)確立為人機關係主張,為政策制定者、教育從業者、技術開發者與學術研究者提供下一代智能教育基礎設施的理論錨點與落地指南。 值得一提的是,白皮書的技術主張並非停留在紙

剛剛
鈦媒體生成式AI

大廠AI入口大戰升級,誰是最能幹活的桌面Agent?

大廠AI入口大戰升級,誰是最能幹活的桌面Agent?劃重點KeyPoints2026.07.22 11:57 · 來自浙江全文4694字00:00 / 13:42實測騰訊WorkBuddy、字節豆包專業版、百度搭子、阿里QoderWork文 | 劃重點KeyPoints,作者|心怡,編輯|重點君互聯網大廠間的AI入口大戰打到了桌面端。先說一條剛出爐的消息。據《財經》7月21日報道,阿里即將推出千問辦公,把QoderWork、悟空、MuleRun三款Agent產品合併成,交給釘釘新任CEO陳宇森負責。不止阿里,騰訊也正把資源集中到WorkBuddy上,字節內部討論把飛書和豆包辦公深度整合。信號很明確,持續半年的大廠Agent“賽馬”結束,C端的入口大戰剛歇,各家開始把資源集中到新戰場:桌面Agent的入口大戰升級了。目前戰況如何?數據顯示,WorkBuddy今年7月DAU已突破1300萬,是國內用戶活躍度最高的Agent辦公產品。再看一組訪問量數據,從六月桌面AI原生辦公智能體的訪問量看,騰訊WorkBuddy、阿里QoderWork排在第一梯隊。四位選手各有來頭。WorkBuddy產品底座沿用打磨兩年多的CodeBuddy內核,馬化騰在財報會上直接稱它是“中國使用最廣的效率智能體服務”。豆包專業版背靠字節自家的Seedream、Seedance,是四家裡多模態彈藥比較足的一個,但只跑自家模型、生態也有些封閉。百度搭子入局較晚但動作密集、持續升級,7月剛甩出個人版升級、企業版和“搭子聯盟”三個更新。QoderWork是阿里把Agent能力從代碼搬到辦公的產物,招牌是帶下載量排行的技能市場和15套專家套件,即將要升格為“千問辦公”的底座。一線城市機場和地鐵的廣告位上,大家都說自己是六邊形戰士。但用戶更多隻關心一件事:今天要選一款Agent,到底誰能真正幹活?這次,我們挑兩個高頻

剛剛
鈦媒體生成式AI

Kimi K3其實“賤賣”了

Kimi K3其實“賤賣”了超聚焦2026.07.22 10:50 · 來自湖北全文4824字00:00 / 13:57別拿DeepSeek攬Kimi的活。文 | 超聚焦Kimi K3,可能是月之暗面成立以來最接近“封神”的一次。在7月17日公佈的Artificial Analysis獨立測試中,K3以57分登上綜合智能指數全球第三,超過Claude Opus 4.

剛剛
IT之家生成式AI

Mac 版 Claude Code 集成 iOS 模擬器,可 AI 構建和測試 App

Anthropic 旗下官方帳號 @ClaudeDevs 於今日(7 月 22 日)在 X 平台發文宣布,Mac 桌面版 Claude Code 已正式內建整合 iOS 模擬器,開發者現在可以直接在模擬器中建構、執行與測試 iOS 應用程式,且過程中完全不需要額外授予螢幕錄製或輔助功能權限。這項功能目前以公測版本形式開放,官方已邀請開發者搶先體驗。

剛剛

七月起,大模型進入「無限戰爭」

# 七月起,大模型进入“无限战争” 2026年7月,全球大模型产业迎来一道分水岭。市场猛然意识到,在这个行业里,没有任何一个模型性能的领先地位是安全的——胜利的保质期正以月甚至周为单位缩短。 短短几周内,中国五家头部独立大模型公司各自展开了截然不同却同样急迫的行动。智谱以4.2%的新增股份换取314亿港元融资,并宣布两年内不追求短期变现;MiniMax在同一周推出160亿港元的配股加可转债组合,创始人宣布零薪酬直至实现AGI;月之暗面发布了参数规模达2.

剛剛