分類頻道

生成式AI

1967 篇文章,依最新發布時間排序。

智東西生成式AI

又一國產模型重磅開源!有聲視頻編輯全球第一,16家芯片及平臺首日適配

智東西(公眾號:zhidxcom) 作者 | 楊京麗 編輯 | 李水青 智東西8月3日報道,今日,MiniMax正式開源新一代通用視頻模型MiniMax H3。 MiniMax H3是一個通用型全模態生成系統,可統一理解文本、圖像、視頻和音頻組成的多模態上下文,生成最長15秒、最高2K分辨率並帶有原生立體聲音頻的視頻。 此前7月31日,MiniMax H3發佈。

1 小時前
MarkTechPost AI生成式AI

使用穩健數據載入與自動評判,以Moonshot PerceptionBench評估多模態視覺模型

本教學設計了一個端到端評估流程,用於Moonshot PerceptionBench,這是一個衡量多模態視覺模型細粒度感知能力的基準,涵蓋OCR、計數、定位、上下文推理等任務。流程包含穩健的數據載入、多種後端模型支援(如盲測基準、OpenAI相容API及本地Hugging Face模型),以及基於規則或LLM輔助的自動評判機制,最終產出可重現的預測與報告。

1 小時前

豆包輸入法撕開語音口子,扒開科大訊飛外衣

# 豆包輸入法撕開語音口子,科大訊飛的護城河為何失效? 大模型戰火正在燒向一個用戶習以為常、卻高頻剛需的角落——輸入法。這個被視為“最後一公里”的關鍵入口,迎來了新一轮殘酷洗牌。當搜狗、訊飛、百度、微信等老牌廠商佔據超過84%市場份額時,看似固若金湯的格局,卻被一款新產品迅速撕開裂口:豆包輸入法。 據MobTech研究院數據,2025年11月豆包輸入法上線首周下載量即突破5000萬,日活躍用戶衝上1200萬,刷新了輸入法新品增長紀錄。

3 小時前

Claude 焚書又“越獄”邊界在哪?

# Claude 焚书又“越獄”,Anthropic的邊界何在? **——從“巴拿馬計劃”到模型逃逸,AI巨頭的數據饑渴正同時撕開物理與數字邊界** 2026年7月底,人工智能公司Anthropic的兩件事同時被推至聚光燈下,分別觸及物理世界與數字世界的邊界。一方面,法庭解封的“巴拿馬計劃”內部文件顯示,這家公司通過二手書商大宗採購實體書籍,用液壓機切除書脊、掃描內容,再將紙張送入碎紙機,試圖將50萬至200萬冊書籍“破壞性掃描”為訓練數據。

3 小時前

靠做“中間商”生意估值20億美元,Liblib跑出了奇蹟還是泡沫?

在AI領域普遍追求「得大模型者得天下」的浪潮中,一家不走尋常路的應用層公司卻交出了截然不同的成績單。演語科技(Evoken)於6月18日宣布完成近3億美元的B+輪融資,投後估值一舉突破20億美元,成為中國AI應用層至今為止規模最大的單輪融資之一。多數人或許對演語科技這個集團品牌感到陌生,但其旗下產品LiblibAI以及Liblib這個名稱,在業界早已廣為人知。此次融資也是演語科技首次以集團身分對外發聲。 在大量AI初創公司仍依賴投資人耐心爭取時間窗口的當下,這家沒有自研大模型的企業卻成了最會賺錢的AI應用之一。

3 小時前

大模型公司估值,正在降權「SOTA敘事」

7月之后,资本市场对大模型公司的估值逻辑正在发生显著变化:单一大模型在榜单上的领先排名,已经不足以支撑长期估值溢价。8月3日,阿里巴巴发布Qwen 3.8-Max版正式版,港股当日上涨6.75%;而在此前半个月,Kimi K3的发布却让智谱和MiniMax股价坐上过山车。同样是竞争对手发布新模型,市场给出的反应截然不同,这背后折射出投资者对“SOTA叙事”的降权。 7月17日,Kimi K3发布,其在Artificial Analysis(AA)的编程评分一度位列第一。这一排名直接冲击了智谱依靠GLM-5.

3 小時前

無人再議AI六小龍

# 無人再議AI六小龍:三年分化背後,大模型行業正從技術敘事走向商業現實 「AI六小龍」這個稱謂,正在成為一個頗具時代氣息的歷史標籤。三年前,智譜、MiniMax、月之暗面、階躍星辰、百川智能和零一萬物被市場共同裝進同一個籃子裡比較——誰的模型參數更大,誰的融資速度更快,誰更有希望成為「中國的OpenAI」。彼時,技術敘事是AI創業的第一針強心劑,資本的熱情幾乎全部押注在AGI的遠期想象力之上。 三年過去,潮水退去,賽道並未如預期般跑出唯一的贏家,反而走出了六條截然不同的路徑。

3 小時前

國產算力破局,超節點才是勝負手

國產大模型因算力需求激增,導致算力緊張問題再度浮現,單靠算法優化無法完全解決,智能算力規模已爆發式增長。國產AI晶片崛起,超節點成為提升算力效率與降低成本的最佳方案,業界正探索大小節點的不同技術路線。

3 小時前
MarkTechPost AI生成式AI

如何在生產環境中保護 AI 代理、MCP 伺服器與 LLM 應用程式

代理、MCP 整合以及 LLM 驅動的應用程式正以超越多數安全團隊追蹤速度的速度湧入程式碼庫。Mend.io 的新實務指南《保護 AI 代理、MCP 伺服器與 LLM 應用程式:實用框架》正是針對此缺口。該指南圍繞三大步驟展開:看清重點、更快修復重點、在生產環境中保護 AI,並提供七個可重複使用的工件。為何傳統應用程式安全(AppSec)會失效?AppSec 建立在一個假設上:應用程式會按照其程式碼的指示執行。但代理式 AI 打破了這個假設。代理行為來自模型、系統提示、檢索到的上下文、使用者輸入以及它可能呼叫的工具。兩個完全相同的部署可能表現出截然不同的行為。故障模式也是全新的。提示注入透過數據而非程式碼進入;權限過大的代理可能造成危害。

3 小時前
鈦媒體生成式AI

對話博登智能趙捷:十億訂單在手,具身智能最缺的仍是高質量數據

對話博登智能趙捷:十億訂單在手,具身智能最缺的仍是高質量數據TechPulse2026.08.03 19:48 · 來自河北全文5467字00:00 / 17:40機器人真正的進步,有時就藏在一次失敗之後:它有沒有記住,人類當時是怎樣把錯誤糾正過來的。具身智能的數據生意正在迅速升溫。斯坦福大學《2026 AI Index Report》顯示,機器人在仿真操作基準中的任務成功率已達到89.

4 小時前

在K3爆火之際,來聊聊Kimi的商業化前景

月之暗面推出的Kimi K3模型因開源且性能強勁而爆紅,上線後迅速登頂Hugging Face趨勢榜,並引發資本市場震盪。其商業化進展迅速,年度經常性收入(ARR)已突破3億美元,API收入佔比超過七成,海外付費用戶增長顯著,並藉助與亞馬遜雲科技等雲平台的合作拓展全球市場。

4 小時前
鈦媒體生成式AI

怎麼看待AI大回調,大摩120頁研報深度解讀

怎麼看待AI大回調,大摩120頁研報深度解讀AlphaEngineer2026.08.03 18:40 · 來自北京全文3170字00:00 / 08:53摩根士丹利解讀AI板塊回調:屬技術性回調,看好AI基建。作者 | 費斌傑 北京市青聯委員 熵簡科技CEO6月下旬以來,全球AI板塊經歷了一輪顯著回調。這到底是短暫的技術性回調,還是週期見頂的信號,這是一個價值千金的問題。

5 小時前

深度:外賓 Genspark

Genspark 雖在公開信支持開放權重模型,但其真實立場更接近閉源實驗室,商業策略上則希望藉開放模型降低成本。該公司創辦人刻意淡化曾在百度任職的背景,並在矽谷華人社群活動中保持距離,反而積極贊助國際商業會議,塑造純正美國 AI 公司的形象。

5 小時前

怎麼看待AI大回調,大摩120頁研報深度解讀

全球AI板塊自6月下旬以來出現明顯回調,市場對這波下跌究竟是技術性修正還是週期頂點存在高度分歧。摩根士丹利在7月27日發布一份長達120頁的深度報告,標題為《Playing the AI Infrastructure Dip》,明確指出回調主要來自倉位擁擠、保證金融資去槓桿與動量因子反轉等技術面因素,而非基本面邏輯遭到破壞。報告從資本市場三大疑慮切入,逐一拆解,並提出對AI基礎設施投資機會的獨特看法。 第一個市場擔憂圍繞「Tokenmaxxing」敘事是否逆轉。

6 小時前

上海AI Lab團隊推出MemHarness:讓Agent記憶像人類一樣被重構

賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

7 小時前

Claude僅用8分鐘,5年未解Bug秒破

Claude在短短8分鐘內成功破解一個存在五年的加密貨幣錢包漏洞,未經額外訓練即實際進入系統驗證。此事件凸顯大型語言模型在程式碼審查與漏洞挖掘上的潛力,目前該漏洞已修復。

7 小時前