硅谷開始在大模型上“消費降級”了

2026年7月28日 17:47
硅谷開始在大模型上“消費降級”了

重點摘要

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦浙江最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作硅谷開始在大模型上“消費降級”了硅基星芒·2026年07月28日 17:35從炫耀性消費到算計性生存 2026年7月24日,《華爾街日報》一篇報道的標題平淡無奇,內容卻是一道分水嶺:美國企業界正在集體停止在大模型調用上燒錢。 過去兩年,企業以“Token最大化”為榮。內部排行榜上,誰的API調用費用最高,誰就是數字化轉型的急先鋒。如今這套敘事被徹底翻轉,省錢成了新信仰,節儉成了新美德。 Cursor這家即將被馬斯克以600億美元收購的公司,為這場運動發明瞭一個精準的詞:tokenomics,Token經濟學。它的前投資銀行家、現任現場首席技術官Mike Saeks用一個比喻道破了這場轉向的核心:“用最強大的模型處理日常任務,就像開著蘭博基尼去雜貨店買牛奶,那車是為了賽道而生的。” 種種跡象證明,這不是一句俏皮話,它是對過去兩年AI泡沫敘事的清算的開始。 從炫耀性消費到算計性生存 這場轉向的速度之快,連最敏銳的觀察者都措手不及。 幾個月前,企業還在攀比誰的AI賬單更嚇人。Token最大化是一個充滿硅谷氣質的詞:把浪費包裝成進取,把燒錢曲解為信仰。那時的邏輯是,用得越多意味著AI化越徹底,花得越狠意味著技術領先越明顯。

站內 AI 整理稿

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦浙江最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作硅谷開始在大模型上“消費降級”了硅基星芒·2026年07月28日 17:35從炫耀性消費到算計性生存 2026年7月24日,《華爾街日報》一篇報道的標題平淡無奇,內容卻是一道分水嶺:美國企業界正在集體停止在大模型調用上燒錢。 過去兩年,企業以“Token最大化”為榮。內部排行榜上,誰的API調用費用最高,誰就是數字化轉型的急先鋒。如今這套敘事被徹底翻轉,省錢成了新信仰,節儉成了新美德。 Cursor這家即將被馬斯克以600億美元收購的公司,為這場運動發明了一個精準的詞:tokenomics,Token經濟學。它的前投資銀行家、現任現場首席技術官Mike Saeks用一個比喻道破了這場轉向的核心:“用最強大的模型處理日常任務,就像開著蘭博基尼去雜貨店買牛奶,那車是為了賽道而生的。” 種種跡象證明,這不是一句俏皮話,它是對過去兩年AI泡沫敘事的清算的開始。 從炫耀性消費到算計性生存 這場轉向的速度之快,連最敏銳的觀察者都措手不及。 幾個月前,企業還在攀比誰的AI賬單更嚇人。Token最大化是一個充滿硅谷氣質的詞:把浪費包裝成進取,把燒錢曲解為信仰。那時的邏輯是,用得越多意味著AI化越徹底,花得越狠意味著技術領先越明顯。 現在呢?Pylon這家AI客服平臺的CEO Marty Kausas說得直白:“我看到的客戶忠誠度是零。現在真的像一場血洗。” Pylon自己就是這場“血洗”的受益者,今年到目前為止,它從一家AI供應商那裡免費獲得了約160萬美元的Token額度,從另一家拿了6.5萬,再一家拿了1萬。Kausas的總結冷酷而精確:AI公司正在瘋狂地塞優惠,只求客戶別走。 這種畫風的突變,驅動力只有一個:模型太多了。 當OpenAI還在為GPT-5.5的推理能力洋洋得意,當Anthropic還在為Fable模型的道德對齊大做文章時,企業發現了一個讓他們憤怒又釋然的真相:絕大多數任務,根本不需要那些最昂貴、最前沿的模型。 Cursor做了一個實驗:從頭構建一個網頁瀏覽器。全程用GPT-5.5完成,花費略高於1萬美元。用Cursor自家的Composer模型搭配Anthropic的Opus 4.8,花費1339美元。二者差了一個數量級。 Mike Saeks的觀察更為致命:“過去,最適合某項任務的模型每隔幾個月才換一次。現在,感覺每週都換好幾次。” 這句話裡藏著一枚信息炸彈:模型能力的商品化速度已經超過了所有人的預期。前沿模型與普通模型之間的實際可用差距,正在以周為單位收窄。企業CFO的Excel表格,比任何技術白皮書都更早嗅到了這個趨勢。 中國模型的“側翼迂迴” 硅谷企業的AI省錢運動,驗證了另一層更底層的判斷:模型的未來是商品。 這意味著,模型本身將越來越便宜,越來越可替代,真正值錢的是智能的持續突破,而非模型本身的銷售。 中國企業恰恰是商品化模型最激進的供給方。DeepSeek、月之暗面的Kimi、智譜的GLM、MiniMax、Mimo……這些名字正在以令人不安的速度出現在美國企業的採購清單上。 Hex是一家AI數據分析平臺,CEO Barry McCardel透露,在過去兩週內,約50%的客戶已經在工作流中接入了月之暗面的Kimi模型。 他的態度代表了新一代企業決策者的共識:“任何一個實驗室隨時都可能發佈一個達到前沿水平的模型,我們要保持靈活。” 注意這個詞:靈活。 過去,企業選擇AI供應商是一樁近乎婚姻的承諾。選定了OpenAI或Anthropic,就意味著長期綁定、深度集成、難以遷移的技術棧。 現在,婚姻變成了約會。企業可以在不同模型之間自由切換,用最貴的做規劃,用便宜的做執行,用開源的做定製,用中國模型填縫。 法律AI初創公司Harvey的做法堪稱教科書級示範:用中國的GLM-5.2處理日常任務,給它配備一個工具,讓它判斷任務是否太難;如果太難,就自動呼叫Anthropic的Fable 5來接管。 總裁Gabe Pereyra的總結雲淡風輕:“我們和所有模型都合作。我們正在摸索一堆類似的方案,在保持或提升性能的同時,大幅降低成本。” 這就是美國企業界正在上演的側翼迂迴戰。 正面戰場,OpenAI和Anthropic仍在為最前沿的智能上限燒錢廝殺;側翼,中國企業用開源或低價模型,正在一口一口吃掉大量應用層的市場份額。 兩種敘事的交叉感染 把鏡頭拉遠,更深的暗流正在交匯。 過去兩年,美國AI行業構建了雙重敘事。 第一重是OpenAI和Anthropic代表的聖盃敘事:更貴的研究、更大的模型、更接近AGI的每一次呼吸,都值得不計代價的投入。這個敘事支撐了它們天價的私募估值和即將到來的上市預期。 第二重是企業客戶的FOMO敘事:害怕錯過AI革命,害怕競爭對手搶先一步,於是瘋狂採購最高端的模型服務,Token花費節節攀升。這個敘事支撐了AI公司飛漲的營收曲線。 現在,這兩個敘事正在同時出現裂痕。 Cursor的實驗數據、Pylon的零忠誠度宣言、Hex的50%客戶轉向中國模型……這些碎片拼在一起,指向同一個結論:企業客戶正在從FOMO中醒來。他們意識到,那輛蘭博基尼固然漂亮,但自己只是去雜貨店。 而客戶的覺醒,直接動搖了聖盃敘事的根基。如果最賺錢的應用層客戶開始分流,開始用便宜的替代品,那麼OpenAI和Anthropic靠高端模型收費來反哺研發的飛輪,就會開始失速。 最諷刺的是,這場運動恰恰發生在美國政府醞釀限制中國AI模型之際。 OpenAI和Anthropic的高管公開指責中國創業公司抄襲他們的技術,特朗普政府內部甚至有人提議全面封禁中國模型。 但企業的腳比政策的嘴誠實得多:微軟已經在考慮將DeepSeek等中國模型整合到自家平臺。英偉達、微軟、Palantir等一批科技公司上週五聯名簽署了一封支持開放模型的公開信,敦促政策制定者對潛在限制保持克制。 看似偶然的同盟,實質則是資本對地緣政治的本能反抗。當API賬單可以省下一個數量級時,意識形態的顧慮往往會被暫時擱置。因為省下來的錢,比可能的威脅更具體、更緊迫。 三個臭皮匠的智慧 在所有案例中,Zoom的故事最具象徵意義。 這家以視頻會議聞名的公司,三年前就開始使用Meta發佈的開源模型Llama。通過精調,Zoom省下了一大筆錢。如今,它同時使用Anthropic、OpenAI和多個開源模型。 Zoom的首席技術官黃學東援引了一句中國古語:“三個臭皮匠,頂個諸葛亮。”他認為,這種模型混用的方法論,才是企業的秘密醬汁。 這句引用意味深長。在OpenAI和Anthropic的敘事裡,通往智能的路是線性的、等級森嚴的:最聰明的人造出最聰明的模型,其他人付錢使用。 Zoom們用行動證明:我們可以自己搭建一個聰明的系統,用拼裝的方式。與其說這是技術層面的叛變,不如說是哲學層面的分道揚鑣。 一個追求深度,一個追求廣度。一個追求智能上限的苦行,一個追求成本下限的精算。它們並不矛盾,它們共同構成了AI落地的完整圖景。 2026年7月,美國企業界的這場集體轉向正在悄然蔓延,這是對過去兩年AI泡沫敘事的清算。企業開始用Excel表格核算每一次API調用的投入產出比,CTO們開始像Saeks那樣評估“蘭博基尼買牛奶”的荒謬,AI行業的估值邏輯已經面臨全面重估。 這不是說OpenAI和Anthropic沒有價值。恰恰相反,它們在最前沿的探索依然無可替代。Cursor的實驗也證明,最複雜的任務仍然需要最強大的模型來規劃、審核、把關。 但“無可替代的頂層”和“可以被拼裝的底層”,是兩種完全不同的生意。 前者是聖盃,後者是管道。 前者需要極致的聚焦和漫長的忍耐,後者需要極致的效率和靈活的適配。 Zoom和Cursor們用“三個臭皮匠”選擇了後者,這是市場的智慧。 它們不是敵人,它們只是站在了同一枚硬幣的兩面。只是那枚硬幣,正在被整個美國企業界翻過來。 聖盃依然閃耀,但人們開始計算去往雜貨店的油費了。 本文來自微信公眾號“硅基星芒”,作者:星芒,36氪經授權發佈。 該文觀點僅代表作者本人,36氪平臺僅提供信息存儲空間服務。+10好文章,需要你的鼓勵硅基星芒特邀作者0收 藏+10評 論打開微信“掃一掃”,打開網頁後點擊屏幕右上角分享按鈕微 博沉浸閱讀返回頂部舉報參與評論評論千萬條,友善第一條登錄後參與討論提交評論0/1000你可能也喜歡這些文章谷歌史上第一次賺的不夠花淨利潤暴增3倍,谷歌讓馬斯克帶著上天了Meta推出AI兒童故事App,搶佔下一代親子內容入口?谷歌自由現金流首次轉負,上調全年資本開支至最高2050億美元,盤後跌逾4%谷歌,這次拼了命 搞AI …Meta定製版AMD MI450芯片算力減半、內存大縮水,SemiAnalysis:這是Meta公司文化的悲哀硅谷繼續“燒錢”堆算力:OpenAI預算升至7500億,Anthropic、AMD“股權換訂單”谷歌非常焦慮硅谷新風向:幹掉“左滑右滑”,花錢買約會硅基星芒特邀作者錦緞旗下人工智能研究與媒體服務平臺發表文章23篇最近內容硅谷開始在大模型上“消費降級”了24分鐘前AI製藥正在復刻大模型領域的競爭格局2026-07-16AI Coding的價值,正在從“誰的模型更強”悄悄轉向“誰的工具鏈更密”2026-07-15閱讀更多內容,狠戳這裡查看AI測評DeepSeekKimiMiniMax選靠譜AI,看真實評測查看36氪AI測評官方交流社區加入諮詢報道審核和入駐聯繫36氪尋求報道訂閱號關注下一篇土匪式文旅,正在反噬全國景區誰慣壞了中國景區?28分鐘前關於36氪城市合作尋求報道我要入駐投資者關係商務合作關於我們聯繫我們加入我們36氪歐洲站36氪歐洲站36氪歐洲站Ai產品日報網絡謠言信息舉報入口熱門推薦熱門資訊熱門產品文章標籤快訊標籤合作伙伴36氪APP下載iOS & Android本站由 阿里雲 提供計算與安全服務 違法和不良信息、未成年人保護舉報電話:010-89650707 舉報郵箱:[email protected] 網上有害信息舉報© 2011~2026 北京多氪信息科技有限公司 | 京ICP備12031756號-6 | 京ICP證150143號 | 京公網安備11010502057322號意見反饋36氪APP讓一部分人先看到未來36氪鯨準氪空間推送和解讀前沿、有料的科技創投資訊一級市場金融信息和系統服務提供商聚焦全球優秀創業者,項目融資率接近97%,領跑行業

Related

相關文章

Claude給閉源軍團再扣一分

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦廣東最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作Claude給閉源軍團再扣一分象先志·2026年07月28日 18:30閉源AI安全估值遭受重創 閉源軍團又扣分了,這次是難以忽視的信息安全問題。 北京時間7月26日凌晨,Reddit上有人發帖:在Google搜site:claude.ai/share,能直接翻出別人和Claude的私聊信息,相當於直接看到用戶的所有溝通記錄。 有人找到一個帶私鑰的加密貨幣錢包,點進去驗過,裡面真有餘額。還有人翻出律師討論職業操守違規要不要自我申報、簡歷、疑似社保號、臨床試驗摘要,以及一個能認出姓名的大廠員工。 7月26日上午,Google上的結果消失了。Bing和Brave上還在。到7月28日,Anthropic沒有就這件事發過一句公開聲明。 這事兒要是發生在國內,我都不知道該怎麼收場。 圖片由AI生成 洩露是怎麼發生的 現有的技術解釋是:Anthropic沒給分享頁設noindex標籤。 安全分析師Daniel J Glover7月26日的實測結果比這個說法複雜。分享頁的返回頭裡帶著X-Robots-Tag: none,意思約等於“不要索引”,但它被robots.txt裡的Disallow擋住了。就導致這個標籤被繞開了,信息就赤

剛剛
IT之家生成式AI

Day0 適配:阿里雲靈駿真武 M890 超節點實例現已支持月之暗面 Kimi K3 大模型

首頁 > 智能時代>人工智能 Day0 適配:阿里雲靈駿真武 M890 超節點實例現已支持月之暗面 Kimi K3 大模型 2026/7/28 18:40:53 來源:IT之家 作者:潞源 責編:潞源 評論: 感謝IT之家網友 不一樣的體驗、麻辣清補涼、小星_14、防火防盜防師兄 的線索投遞! IT之家 7 月 28 日消息,阿里雲今天宣佈,靈駿真武 M890 超節點實例成功適配 2.8 萬億參數大模型 Kimi K3,基於芯片、推理平臺和模型的聯合優化,有效提升模型推理效率。IT之家瞭解到,Kimi K3 是月之暗面最新的旗艦模型,參數規模達到 2.8 萬億,採用混合專家(MoE)架構。而靈駿真武超節點實例基於平頭哥訓推一體 AI 芯片真武 M890 打造,具備 ICN Switch 1.0 互聯芯片,可讓 64 張 M890 實現 800 GB/s 的 All-to-All 高速互聯,顯存規模達 9TB,可將萬億級 MoE 模型的 EP 專家並行通信流量,跑在一個高帶寬通信域內,保證 Token(詞元)生成效率。同時,阿里雲、平頭哥和 Kimi 團隊從子、軟件棧等層面進行深度協同,成功讓 kimi K3 模型實現 Day0 適配。真武芯片的 T-Head SAIL 軟件棧可讓 Kimi 自研 Mooncake 推理框架實現“開箱即跑”,M890 的 Triton 支持也讓大量基於 Triton 編寫的自定義算子無需重寫,大幅降低適配工作量。廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:月之暗面 Kimi K3,靈駿真武 M890,阿里雲華為官宣昇騰 0day 支持 Kimi K3 的訓練適配及

剛剛

賣 Token還是賣結果:AI 商業模式的幾個悖論

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦廣東最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作賣 Token還是賣結果:AI 商業模式的幾個悖論騰訊研究院·2026年07月28日 18:23智能正在快速商品化,而利潤僅停留在少數環節。 2026 年年中,AI 行業的主要經營指標,收入、調用量均保持高速增長。但拆分各家公司的財務與業務結構後可以發現,同一組增長數據背後,商業模式不盡相同。本文梳理當前 AI 商業模式中四個結構性悖論:成本、層級、責任與開閉源。這四個悖論指向同一個底層趨勢:智能正在快速商品化,而利潤僅停留在少數環節。 成本悖論:Token越便宜,賬單越重 2023 年 3 月 GPT-4 發佈時,每百萬 Token的輸入價格為 30 美元、輸出價格為 60 美元。企業用其搭建客服系統,一個月的 API 費用可能超過整個客服團隊的工資。三年後,同等智能水平的價格已下降超過 95%。 按常識推斷,AI 開支應當隨之收縮,但現實相反。2026 年 3 月,全球單週 Token調用量達 20.4 萬億;中國日均調用量突破 140 萬億,較 2024 年初增長超過千倍。這一現象與經濟學中的傑文斯悖論(Je vons Para dox)一致:蒸汽機效率越高、單位耗煤越低,煤炭總消耗反而越大。Token單價下

剛剛

你看的無盡連載,作者可能已經不當人了

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦安徽最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作你看的無盡連載,作者可能已經不當人了差評·2026年07月28日 18:22資深網文愛好者難受了。 “ 我最愛的網文作者,用 AI 把他的連載變成了拼接屍塊。” 如果問現在寫作圈最忌憚的話題是什麼,那絕對是 AI。 前有《 北京摺疊 》作者郝景芳,公開承認新書摻 AI 被罵;後有網絡文學《 鬼嬰 》被扒全文 AI,作者刪號跑路,連微博道歉貼的評論區都被衝了上千層。 傳統文學和網絡文學雙雙翻車,讓 “AI 寫文 ” 一下子被掛上了熱搜,讀者和讀者,作者和作者,讀者和作者隨機匹配,撕得不可開交。 有人覺得文藝創作用 AI 是死罪,就有人覺得 AI 寫作無可厚非。 本來吧,在沒有深入研究這個事兒之前,差評君屬於看得開那一派。畢竟各行各業都在和 AI 極限拉扯,本就很難說它最終帶來的是災難,還是福報。 但在調查之後,我發現,AI 寫作不可怕,可怕的是濫用 AI,正在製造一場讀者與作者之間,難以彌補的信任崩塌。 作為網文圈內小有名氣的作者,小 A 告訴差評君,今年業內對 AI 寫文的爭議,比以往激烈、頻繁得多。 從去年到現在,以 DeepSeek 為代表的一眾國產大模型崛起,只要少少的錢,中國話講得還好聽,一下子給網文界帶來

剛剛

湯臣倍健,悄悄投了AI半壁江山

# 湯臣倍健,悄悄投了AI半壁江山 一家保健品公司,成了梁文鋒和楊植麟的共同點。 2026年最魔幻的商業敘事之一,是保健品龍頭湯臣倍健成了中國AI大模型賽道最活躍的跨界玩家。從DeepSeek到月之暗面,從階躍星辰到兩家硬科技芯片公司,這家賣蛋白粉的企業在短短數月內合計投入約4.5億元,精準押中了多家頭部AI公司。 ## 一場意外的估值曝光 DeepSeek成立以來從未公開披露具體融資估值,市場傳聞從2000億到5000億滿天飛。結果捅破這層窗戶紙的,是兩家A股公司——賣箱包的開潤股份,以及賣保健品的湯臣倍健。

剛剛