哈佛大學 Sham Kakade 硬核萬字演講:LLM 預訓練,二次模型該站 C 位| ICML 2026
重點摘要
這篇消息聚焦「哈佛大學 Sham Kakade 硬核萬字演講:LLM 預訓練,二次模型該站 C 位| ICML 2026」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。
雷峰網 消息指出,雷峰網 消息指出,雷峰網 消息指出,雷峰網 消息指出,雷峰網 消息指出,這篇消息聚焦「哈佛大學 Sham Kakade 硬核萬字演講:LLM 預訓練,二次模型該站 C 位| ICML 2026」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。
Related
相關文章

北京推出新舉措支持智能體發展:鼓勵發展 Token 經濟,加大算力券等支持力度
首頁 > 智能時代>人工智能 北京推出新舉措支持智能體發展:鼓勵發展 Token 經濟,加大算力券等支持力度 2026/7/23 16:53:55 來源:IT之家 作者:遠洋 責編:遠洋 評論: IT之家 7 月 23 日消息,北京市發展改革委等部門聯合印發《北京市關於加快智能體引領發展的若干措施》,推動智能體創新引領發展,率先培育智能經濟新形態。其中提到,鼓勵發展 Token 經濟。推動創新主體研發適配智能體系統調用、複雜任務調度與高頻決策的通用處理器,開發低延遲、高吞吐專用推理芯片。推動創新主體開展推理架構等關鍵技術攻關,通過異構協同、存算協同以及智能調度等降低推理成本,加快推理緩存複用、智能任務路由等應用層效率優化,全鏈路優化提高 Token 效率。重構產品形態和服務模式,培育 Token 即服務、智能體即服務、結果即服務等商業新模式,推動更多符合條件的 Token 新產品新服務納入中小企業服務券配券產品範圍。加大算力券等支持力度,鼓勵有條件的區聯合創新主體探索發放 Token 券、智能體服務券等加速智能體等推廣應用。支持銀行、保險等金融機構依法依規開發支持智能體落地應用的各類金融產品。支持創新主體依法依規匯聚行業知識、智能體執行數據等並開放共享,構建數據飛輪,反哺驅動智能體能力持續進化。IT之家附一圖讀懂:北京市加快智能體引領發展若干措施廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:智能體,AI,人工智能,Token經濟微軟 Excel 負責人:Copilot 將把電子表格轉變為 AI 決策平臺騰訊雲發佈雲端智能體 CodeBuddy NPC:直接交付,不費 Token消息稱 Claude

梁文鋒投資人閉門會實錄(全):DeepSeek的AGI之路與“剋制”哲學
梁文鋒投資人閉門會實錄(全):DeepSeek的AGI之路與“剋制”哲學高見pro2026.07.23 16:42 · 來自河北全文6986字00:00 / 20:48大模型競爭的終局差距,成本、時間、體驗。文 | 高見Pro本文根據一場發生在5月20日、總時長約3小時44分鐘的DeepSeek投資者交流會整理而成。會上,DeepSeek創始人梁文鋒系統闡述了公司的願景理念、開源戰略、AGI技術路線圖、中美算力差距、國產芯片替代機遇以及組織管理哲學等核心議題,並與在場投資人進行了深入互動問答。以下內容來自於一位投資人提供的會議速記,經由DeepSeek整理而成,僅供參考。Part 01 願景驅動的初心我們一開始來做這個公司,初衷是沒有想到說要賺多少錢、要上市、要怎麼樣——完全沒有這個初衷。最開始的幾十個人完全沒有這麼想過,如果他這麼想,他就不會來。總體來講,我們是懷著一個對這個世界非常大的善意來做這個事情。我們覺得這是對人類有用的,這是一個金錢以外的事情。當然,到了後面,這個事情發現利益非常大之後,又有其他的誘惑,那是另外的事。但我們出發的初衷、我們的願景,以及保持到現在的這個願景,不是按照商業利益最大化的方式來做的——這點我覺得比較關鍵。我大概二十年前在管理上最崇拜的是傑克·韋爾奇。現在回看,他說的大部分東西可能都不對了,但他最重要的一點說對了:一個公司最重要的是它的願景。管理一個大公司,靠的不是規章制度,靠的是願景。願景不是掛在牆上的標語,願景是你怎麼做,不是怎麼說——就是你怎麼實際運行。所以,我們是怎麼管理這麼多人、怎麼組織起來的?其實我們沒有組織,就是願景驅動的,靠一個願景來組織。沒有KPI、沒有考核,只有願景。這個願景甚至也不是成文的,沒有寫出來過任何東西。這個願景是在我們做事情的方法、我們對待這個世界的態度裡。每個人對這個願景的理解可能有差別,但大的方向上是一致

AI行業告別“最強模型”崇拜
AI行業告別“最強模型”崇拜明晰野望2026.07.23 16:31 · 來自河北全文4693字00:00 / 12:19大模型競爭要件正在改變。文 | 明晰野望美股AI交易近日再度遭遇“DeepSeek時刻”。7月17日凌晨,月之暗面發佈新一代旗艦模型——Kimi K3。這個2.8萬億參數的開源模型,在Artificial Analysis智能指數上得分57,綜合水平直逼國際兩座大山,位列全球第三,僅排在Claude Fable 5和GPT-5.6 Sol之後。技術能力上追平全球前三,成本上做到對手一半,路線上用開源挑戰閉源——K3發佈後首個交易日,美股半導體板塊出現明顯下跌,英偉達單日蒸發1111億美元。K3不是最強的模型,但它是最強性價比的模型。它引發的震盪,在於迫使市場系統性重估AI產業鏈的價值分配。7月9日,OpenAI、xAI、Meta同日發佈新一代模型。發佈會的重心出奇一致:沒有一家把“跑分刷新紀錄”“參數更大”“智能更強”作為主敘事,取而代之的是分層定價、企業場景以及一場幾乎肉眼可見的價格戰。一邊是中國模型讓美股AI板塊再次劇烈重估,一邊是美國頭部廠商集體放棄“最強智能”的神話敘事。過去兩年支撐整個AI行業估值和話語權的“最強模型”崇拜,正在被打破——不是被某一家顛覆,而是“差距”本身被消解了。大模型的競爭維度,正在從模型參數轉向效率閉環。模型差距在收斂過去三年,大模型行業賴以生存的商業底層邏輯是“贏家通吃、代差壓制”,在絕大多數投資人和創業者的認知裡,只要OpenAI或Anthropic能保持一年以上的智能水平代差,那麼任何後發者的追趕都會淪為低水平的重複勞動。然而到了2026年夏天,這場圍繞“代差”築起的護城河正在被多路大軍以不同方式無情填平。一直以來,萬億級參數大模型被視為效果的唯一保證,但模型通過架構優化和長上下文注意力機制的改良,正在徹底打破“體型

獨家|混元多模態理解負責人胡瀚離職創業,原團隊或將聚焦世界模型
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

一份CUDA源碼,跑上了蘋果GPU
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

Claude Agent突然大更新,狂塞500個技能,網友直呼瘋狂
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。