阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,支持討論式交互

重點摘要
首頁 > 智能時代>人工智能 阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,支持討論式交互 2026/7/28 16:14:49 來源:IT之家 作者:遠洋 責編:遠洋 評論: 感謝IT之家網友 Domado 的線索投遞! IT之家 7 月 28 日消息,今日,阿里雲 Qoder 上線實時語音交互智能體 QoderVoice,由全雙工語音模型 Qwen-Audio-3.
阿里雲旗下的開發者平台 Qoder 於今日(7 月28 日)正式推出即時語音互動智能體「QoderVoice」,該功能由全雙工語音模型 Qwen-Audio-3.0-Realtime 驅動。這項新服務的目標是讓開發者能夠直接透過語音與 AI 進行討論與協作,而不僅僅是傳統的打字下指令,進一步提升程式開發與專案執行的效率。 根據官方說明,QoderVoice 的核心特色在於「語音指令與任務執行同步進行」。使用者只需在 Qoder Quest 模式的主介面點擊語音入口,就能在任何畫面喚起語音助手懸浮窗。說出指令後,Qoder 會自動在背景建立任務、調用對應工具並開始執行,過程中使用者完全不需要停留在同一個頁面等待結果。更重要的是,對話期間可以隨時打斷、追問或調整需求,AI 會即時理解並更新任務,讓互動更像是在與真人工程師交談。 此外,QoderVoice 支援「討論式交互」,對於較複雜的任務可以透過多輪協商來完成。官方舉例說明:當使用者說「幫我重構這個模組」,Qoder 會先提出幾個具體的重構方案;如果使用者進一步表示「方案 B 更好,但要加上快取機制」,Qoder 會立即調整策略並繼續執行,無需重新輸入完整的文字指令。這種一來一往的討論模式,大幅降低了溝通門檻,也讓 AI 助手更能貼合開發者的真實需求。 這項功能的背後,是阿里雲自主研發的全雙工語音模型 Qwen-Audio-3.0-Realtime。所謂全雙工,指的是語音互動不再是傳統的「你說完我才說」的輪流模式,而是可以同時接收與輸出語音,支援打斷與即時回應,讓對話更自然流暢。這項技術突破使得 Qoder 能夠在同一時間處理語音輸入、理解意圖、執行任務,並用語音回饋進度,實現真正即時的協作體驗。 目前 QoderVoice 已率先登陸 Qoder 國際版,首波開放給個人訂閱、個人體驗版以及企業訂閱用戶,並提供 3 天限時免費試用,讓開發者可以零成本體驗語音驅動的開發流程。至於中國大陸版本(Qoder CN 版),官方則預告將於近期上線,屆時預計會吸引更多本地開發者嘗試這項語音互動功能。 分析人士指出,隨著大型語言模型與語音技術持續整合,開發者工具正從純文字介面走向更直覺的語音操控。QoderVoice 的推出,不僅是阿里雲在 AI 編程助手領域的一次重要功能擴展,也可能帶動業界重新思考開發者與 AI 的協作模式。當開發者可以用講話的方式直接與程式碼互動,整個開發流程的節奏與彈性都將發生轉變。 對於習慣在桌上型電腦前工作的開發者而言,語音助手的懸浮窗設計讓多工處理更便捷,尤其適合需要頻繁切換視窗、查閱文件或除錯的情境。而在行動端或遠端工作場景中,語音指令更可以釋放雙手,讓開發者隨時隨地啟動任務或調整專案方向。 QoderVoice 的具體使用情境也值得注意。除了程式碼重構之外,舉凡單元測試生成、架構建議、錯誤排查等任務,都可以透過語音多輪討論的方式進行。使用者可以在一段對話中不斷收斂需求,而 Qoder 則會針對每次反饋更新執行計畫,減少來回切換工具與編輯器的時間。 阿里雲表示,未來將持續優化 QoderVoice 的語音辨識準確度與響應速度,並考慮加入更多語言與方言支援。隨著 CN 版即將上線,預料將會有更多繁體中文與簡體中文的開發者能夠體驗這項功能。整體而言,QoderVoice 讓語音不再只是輸入的替代方案,而是成為開發者與 AI 之間真正的協作橋梁。
Related
相關文章

LM Studio Bionic 智能體工具新增月之暗面 Kimi K3 模型支持,定價方案公佈
LM Studio 旗下 Bionic 智能體工具近日宣布,正式支援月之暗面(Moonshot AI)最新開源的 Kimi K3 大模型。該模型擁有 2.8 萬億參數,並提供高達 100 萬 token 的上下文窗口,能夠處理極為龐大的文本內容。目前服務託管於美國伺服器,開發者與企業用戶可直接透過 Bionic 平台調用此模型,無需自行部署基礎設施。

普通人跑不起K3,Kimi 開源,Anthropic微妙表態:從未主張禁止開放權重模型
K3 模型開源後因運算門檻過高,讓一般開發者與中小企業難以負擔,凸顯落地普及的硬體限制;Kimi 也宣布加入開源,但細節尚未完全明朗。Anthropic 則表態從未主張全面禁止開放權重模型,強調應在安全與開放之間取得平衡,為開源權重之爭增添治理與倫理討論。

中國開源模型三連擊,梁文鋒開最後一槍?
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業。

榮耀Robot Phone把拍攝玩出花,聯手阿萊,復刻好萊塢級運鏡
智東西(公眾號:zhidxcom) 作者 | ZeR0 編輯 | 漠影 智東西7月28日報道,今日,榮耀發佈機器人手機Robot Phone的核心影像技術能力,提出影像演進底層規律“光智進化律”,首度展示與全球電影工業標杆阿萊(ARRI)合作的電影級影像技術路徑,在移動終端搭建專業電影級影像技術體系。 “光智進化律”的公式是:影像體驗 = 光學能力 ^ 智能能力。

Kimi K3 開源:2.8 萬億參數的門檻與紅利
月之暗面開源全球最大權重Kimi K3,擁有2.8萬億參數,硬體門檻極高,僅機房級別可運行,但透過Modified MIT許可證和MoE架構,雲廠商與生態夥伴可快速接入,將改造權下放給小B端。雖然個人開發者短期無法直接受益,但產業鏈分層傳導有望讓中小企業最終獲得選擇權與定價權。

ESP32-AI 亮相:8MB PSRAM 運行 2890 萬參數模型,設想離線調配出最佳咖啡
首頁 > 智能時代>人工智能 ESP32-AI 亮相:8MB PSRAM 運行 2890 萬參數模型,設想離線調配出最佳咖啡 2026/7/28 12:03:00 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 7 月 28 日消息,科技媒體 Tom's Hardware 昨日(7 月 27 日)發佈博文,報道稱烏克蘭開發者 Slava S 發佈 ESP32-AI 項目,針對樂鑫(Espressif)的 ESP32-S3 開發板,成功部署 2890 萬個參數的本地 AI 模型。IT之家注:ESP32-S3 開發板由樂鑫推出,配備 512KB 的 SRAM(片上高速存儲,訪問週期僅需 1 個 CPU 時鐘)、8MB 的 PSRAM(通過 SPI 總線擴展的 8MB 內存,訪問速度取決於 SPI 時鐘配置)和 16MB 的閃存,由於內存容量受限,此前 Dave Bennett 針對該開發板部署 AI 參數上限為 26 萬個。Slava S 採用 Google Gemma 使用的 P er-Layer Embeddings(分層嵌入)技術。模型經過 4-bit 量化後,文件大小為 14.9MB。開發者把 25M 參數嵌入表存入 16MB 閃存。模型每生成 1 個 Tokens,只需讀取嵌入表中的少量數據。在使用場景方面,ESP32-S3 開發板雖然成功部署 2890 萬個參數模型,但無法支持聊天或者編程,不過開發者提出離線咖啡機應用設想。該設備可以圍繞咖啡豆、研磨方式、配比和水溫生成內容。廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:AIAitver 推出 ESP32-C3 開發板:集成 0.