AI日報:商湯開源8B輕量多模態大模型;騰訊新一代大模型Hy4將發佈;Grok Build重磅上線網頁與移動端

2026年8月21日 08:044400 次瀏覽
站內 AI 整理稿

AI資訊最新AI日報正文AI日報:商湯開源8B輕量多模態大模型;騰訊新一代大模型Hy4將發佈;Grok Build重磅上線網頁與移動端發布於最新AI日報時間 :Aug 21, 2026閱讀 :1分鐘歡迎來到【AI日報】欄目!這裡是你每天探索人工智能世界的指南,每天我們為你呈現AI領域的熱點內容,聚焦開發者,助你洞悉技術趨勢、瞭解創新AI產品應用。新鮮AI產品點擊瞭解:https://app..com/zh1、商湯科技開源8B輕量多模態大模型:原生4K輸出、全能視覺編輯商湯科技開源了全新的輕量級多模態大模型 SenseNova U1.

5Lite,其在視覺任務中表現出色,尤其在文字與佈局處理上表現亮眼,同時支持原生4K高分辨率輸出,具備強大的視覺編輯能力。【提要:】🧠 原生支持3至4K上下文長度,提升複雜視覺任務穩定性。🎨 更高質量的視覺生成,改善構圖、色彩、材質等細節。🖼️ 支持多種視覺控制方式,實現原生4K高分辨率輸出。詳情鏈接:https://github.com/OpenSenseNova/SenseNova-U12、騰訊新一代大模型Hy4將發佈,將成WorkBuddy核心引擎騰訊新一代大模型Hy4的內部測試界面已曝光,表明其即將發佈。

Hy4定位為專家級大模型,性能顯著提升,可能源於參數規模擴大和強化學習後訓練。Hy4將作為WorkBuddy的核心引擎,進一步釋放騰訊在AI智能體應用中的潛力。【提要:】🧠 騰訊新一代大模型Hy4的內部測試界面曝光,預示其即將發佈。🚀 Hy4定位為專家級大模型,性能顯著提升,可能源於參數規模擴大和強化學習後訓練。💼 Hy4將作為WorkBuddy的核心引擎,進一步釋放騰訊在AI智能體應用中的潛力。

3、Grok Build重磅上線網頁與移動端,人人皆可一句話秒變全棧開發者文章詳細介紹了 xAI 的 Grok Build 功能全面上線,其通過自然語言描述即可生成應用,極大降低了開發門檻,並支持社交分發和功能擴展,標誌著人人皆可構建強大應用的時代加速到來。【提要:】🧠 Grok Build 通過自然語言描述即可生成應用,極大降低了開發門檻。🔗 應用可生成專屬鏈接並支持社交分發,提升傳播效率。🛠️ 支持調用 xAI API 和第三方 API 管理,增強功能擴展性。

4、Adobe Firefly音頻工具全面上線,支持AI生成音樂、語音和音效Adobe推出Firefly音頻生成工具,涵蓋音樂、語音和音效生成,解決創作者在版權和授權上的痛點,同時擴展第三方模型生態,提升AI創作效率。【提要:】🎧 Adobe Firefly音頻工具全面上線,支持AI生成音樂、語音和音效。📝 生成音樂可提供原創且完全授權的音樂方案,適用於商業作品。🌐 Adobe持續擴展Firefly第三方模型生態,整合多模態音視頻能力。5、移動端基準全面超越GPT與Claude!

阿里發佈Qwen-UI-Agent,開啟GUI智能體新紀元阿里巴巴發佈了全新的GUI智能體基座模型Qwen-UI-Agent,在多項核心圖形用戶界面基準測試中全面對標並超越業界多款旗艦模型。該模型在移動端、電腦端、網頁端及深度搜索環境中表現出色,並具備強大的安全性與長程任務處理能力。【提要:】📱 Qwen-UI-Agent在移動端基準測試中表現優異,得分領先GPT和Claude。💻 在電腦端與瀏覽器方面,Qwen-UI-Agent超越了GPT和Gemini3.1Pro。🔒 模型具備完善的安全機制,能夠處理高風險請求並支持長程任務處理。

6、皮尤研究:ChatGPT發佈後,超三成網頁出現AI創作痕跡皮尤研究中心的研究揭示了生成式AI對互聯網內容生態的快速影響,表明AI生成內容正在成為主流。【提要:】🤖 AI生成內容在互聯網中迅速增長,超過三分之一的網頁出現AI創作痕跡。🌐 .com網站AI內容比例遠高於.edu和.gov網站,顯示不同領域對AI應用的差異。🔍 研究指出AI檢測工具存在誤判可能,但整體趨勢具有重要參考價值。7、千問AI平臺模型矩陣持續擴容,GLM-5.3、DeepSeek-V4-Pro正式上線阿里雲千問AI平臺近期更新模型服務矩陣,新增GLM-5.

3和DeepSeek-V4-Pro模型,進一步完善了全場景模型供給,為開發者和企業用戶提供更豐富的AI能力選型。【提要:】🧠 GLM-5.3模型強化編程能力與網絡安全能力🤖 DeepSeek-V4-Pro提升智能體交互能力💰 平臺推出Token Plan套餐服務8、從對話助手到智能辦公平臺,豆包推出技能、連接器與工作夥伴豆包工作任務模式迎來重磅更新,技能、連接器、工作夥伴三大功能全新上線,豆包協同辦公能力再度升級。平臺已上架超200個技能與連接器,同時支持用戶自主創建專屬技能,搭建標準化工作流。【提要:】🧠 技能功能支持個性化工作方法的沉澱與複用。

🔗 連接器打通豆包與各類辦公工具,提升工作效率。👥 工作夥伴提供多領域專業智能體,實現協作完成複雜任務。相關推薦商湯科技開源8B輕量多模態大模型:原生4K輸出、全能視覺編輯商湯開源8B輕量級統一多模態模型SenseNova U1.5Lite,核心視覺任務表現超越同級,部分複雜排版與文字渲染媲美大規模商業模型;原生支持3-4K上下文,可同時處理主體、數量、空間關係、文字、佈局、風格等多重約束。Aug 21, 2026126.4k8B 參數塞進 4K 生成與編輯,商湯開源輕量統一多模態模型 U1.5-Lite 預覽版商湯科技面向社區開源輕量統一多模態模型SenseNova U1.

5-Lite-Preview。該模型基於U1系統性迭代,在單一架構中融合視覺理解、推理、生成與編輯四大能力,僅以8B-MoE參數即支持4K分辨率、更真實質感與複雜視覺控制。商湯稱U1驗證了統一架構可行性,U1.5則實現了輕量高性能的突破。Aug 4, 2026280.9k商湯開源SenseNova U1.5-Lite-Preview:8B模型支持原生4K圖像生成商湯開源輕量級多模態模型SenseNova U1.5-Lite-Preview,採用8B-MoT參數和NEO-unify架構,支持原生4K圖像生成、精細紋理、精準中英文字生成及穩定圖像編輯。

該模型重點提升長篇自然語言與結構化視覺指令理解,實現複雜需求下的精準多模態生成。Aug 3, 2026284.7k視覺模型新突破:商湯開源 SenseNova-Vision-7B-MoT商湯科技開源多任務視覺模型SenseNova-Vision-7B-MoT,集成目標檢測、OCR、深度估計、法線估計、圖像分割與多視圖處理等核心視覺任務於7B參數單一架構,為視覺理解及GUI智能體開發提供高效基座。Jul 14, 2026222.

0k商湯開源SenseNova-Vision統一視覺大模型,單模型橫掃四大核心視覺任務商湯發佈並開源“日日新SenseNova-Vision”視覺大模型,核心是將視覺能力原生融入通用基礎模型,打破傳統將檢測、分割等專家模型打包的割裂模式。該模型以單模型在多項評測中實現了四大領域的性能碾壓,標誌著視覺任務向統一原生架構的關鍵升級。Jul 13, 2026261.5k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛