北京酒吧推出"Token 免費暢飲":連上 Wi-Fi 就能白嫖 DeepSeek V4 Flash 算力

2026年8月4日 07:015100 次瀏覽

重點摘要

北京AGI Bar推出創新服務,顧客連接店內Wi-Fi即可免費獲得DeepSeek V4 Flash模型的無限量API使用權限,所有推理在本地完成。酒吧採購NVIDIA DGX Spark工作站提供算力,支持多種開發工具直接調用。此舉被視為AI算力從線上延伸至線下消費場景的嘗試,未來可能普及到更多場所。

站內 AI 整理稿

# 北京酒吧推出「Token 免費暢飲」:連上 Wi-Fi 就能白嫖 DeepSeek V4 Flash 算力,AI 算力正式「實體化」

當「算力」不再只是雲端服務商計費表上的一個數字,而是像店裡的自來水一樣擰開就能用,會是什麼景象?北京一家名為 AGI Bar 的程序員主題酒吧,最近給出了令人耳目一新的答案。這間酒吧推出一項名為「Token 免費暢飲」的活動:顧客只要到店消費並連接店內 Wi-Fi,就能免費獲得 DeepSeek V4 Flash 模型的無限量 API 使用權限,而且所有推理都在本地完成,速度快、不用排隊、更不用看雲端廠商的臉色。據 AIBase 消息,AGI Bar 近日公開了這項活動的具體玩法。酒吧採購了英偉達 DGX Spark AI 工作站,用來提供 DeepSeek V4 Flash 的算力服務。

顧客進店後,只需向店家索取 Base URL 和 API Key,就能在 Claude Code、Codex、Cursor、Cherry Studio 等一眾支持 OpenAI API 格式的開發工具中,直接填入並調用模型。換句話說,開發者只要坐在酒吧裡,打開筆電、連上 Wi-Fi,就能享受與雲端 API 幾乎無異的推理體驗——而且完全免費、不限量。這項服務的出現,乍看像是酒吧的行銷噱頭,細想卻頗具深意。一直以來,大模型的算力消耗都在雲端進行,使用者必須按 Token 付費,或訂閱各家廠商的 API 服務。

即便開源模型可以本地部署,對個人開發者來說,也需要一臺配置夠高的顯示卡或工作站,門檻並不低。AGI Bar 的做法,等於把「算力」變成了一種店面基礎設施,就像 Wi-Fi、插座、冷氣一樣,成為消費者願意走進店裡的理由之一。從線上工具到線下消費場景,AI 算力正在悄悄「實體化」。過去我們習慣把 AI 當作一種軟體服務,打開網頁、呼叫 API、等待回應;現在,有人開始把 AI 當作一種空間體驗——你付費的是一杯精釀啤酒,附贈的是無限量的頂級開源模型推理能力。這種轉變,某種程度上也反映了 AI 產業的趨勢:當模型本身越來越便宜、越來越有效率,算力不再稀缺,真正稀缺的是「場景」和「人與人的連接」。

公開資訊顯示,AGI Bar 由長期參與 AI 創業領域的人士創立,目前在北京和上海各有一家門店。這間酒吧從一開始就鎖定程序員與 AI 從業者為核心客群,店內不時舉辦技術分享、黑客松、圓桌論壇等活動,已經成為 AI 圈層的知名聚點。值得注意的是,Midjourney 創始人 David Holz 此前訪問中國內地期間,也曾特地到訪 AGI Bar 與開發者交流。一個國外頂尖 AI 產品的創辦人,願意走進一間北京的酒吧坐下來聊天,足見 AGI Bar 不僅是喝酒的地方,更是 AI 社群的重要節點。回到「Token 免費暢飲」這項服務本身,它的技術底蘊其實相當紮實。

DeepSeek V4 Flash 是 DeepSeek 於今年五月推出的小型推理引擎,特別針對 Metal 平臺進行了優化,專注於提升本地推理效率。透過對 DeepSeek V4 Flash 模型的定製執行,這款引擎能在速度和靈活性上超越通用引擎,並引入創新的思考模式設計,讓模型在回應複雜問題時表現更佳。簡單來說,V4 Flash 本身就是為了在終端設備上高效運行而設計的模型,AGI Bar 用 DGX Spark 這類 AI 工作站來承載它,可說是「殺雞用牛刀」,但也因此保證了顧客的使用體驗。對開發者而言,這種「白嫖」算力的誘惑力不容小覷。

在一般情況下,即使是開源模型,想要穩定、快速地跑起來,還是得依賴雲端服務或高階硬體。AGI Bar 提供的方案,省去了繁瑣的部署流程,只要拿到 API 金鑰,就能在常用的開發工具中直接使用。無論是寫程式時請 AI 協助排查 Bug、重構程式碼,還是臨時跑個資料分析、做個自然語言處理實驗,都能在喝一杯咖啡或啤酒的時間內完成。對那些正在創業、還沒有穩定收入的獨立開發者來說,這無疑是相當友善的資源。更深一層看,「Token 免費暢飲」也折射出 AI 普惠化的一種可能性。

當 Token 像自來水一樣擰開就用,使用 AI 的成本趨近於零,那麼阻礙一般人擁抱 AI 的,就不再是價格或技術門檻,而是「想不想用」的意願。AGI Bar 的嘗試,某種程度上是在示範一種新的商業模式:不是賣算力,而是用算力吸引人來消費其他東西。就像咖啡廳提供免費插座和高速 Wi-Fi 一樣,未來或許會有更多咖啡廳、酒吧、共享辦公空間,將 AI 算力納入標配服務。當然,目前這項服務仍屬單一商業空間的探索嘗試,距離成為普遍現象還有很長的路要走。像是 DGX Spark 這類 AI 工作站的採購成本、電力消耗、設備維護、模型授權等問題,都不是一般小店鋪能夠輕鬆承擔的。

不過,隨著大模型推理成本持續下降,以及終端推理引擎不斷優化,這類「算力實體化」的場景只會愈來愈多。可以想像,不久的將來,走進一家書店,店內提供的不只是書籍和咖啡,還有免費的模型推理額度;住進一間青年旅館,房客可以用旅館提供的 API 金鑰來開發自己的 AI 應用。AGI Bar 的創新玩法,讓人有種「AI 走進人間」的實感。過去我們談 AI 普惠化,多半在談降低 API 價格、釋出開源模型、提供免費方案;現在,有人直接把算力擺在吧檯上,讓顧客用一杯酒的時間去體驗未來。當 Token 變得像自來水一樣隨手可得,AI 就不再是少數工程師的工具,而是所有人都能觸碰的基礎服務。

而這一切最接地氣的入口,或許就藏在街角那杯精釀啤酒裡——正如 AGI Bar 所展示的那樣,喝下去的是一口啤酒,跑起來的是無限算力。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

59 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前