大模型給圖片打分不再“靠嘴說”,結構圖、頻譜圖當“物證”,用“視覺證據”來給圖片打分

重點摘要
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI自助報道廣東最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作大模型給圖片打分不再“靠嘴說”,結構圖、頻譜圖當“物證”,用“視覺證據”來給圖片打分量子位·2026年07月20日 15:38IQA-T1:讓多模態大模型在評估圖像質量時,學會像專業檢測員一樣 讓大模型給一張圖片打“質量分”,它其實經常看走眼。 一張乾淨的照片,和它偷偷加了噪聲、被壓過、糊了一點的“退化版”,在你我眼裡質量天差地別——但在多模態大模型(MLLM)的“眼睛”裡,這兩張圖幾乎長得一模一樣。 於是它給出的分數,往往是“憑感覺”估的,而不是“看證據”得出的。 現在,來自西北工業大學與香港科技大學的研究團隊提出了一個新框架——IQA-T1,第一次讓多模態大模型在評估圖像質量時,學會像專業檢測員一樣: 不再只靠“瞥一眼”的直覺,而是主動調用一套專業分析工具,生成噪聲殘差圖、梯度分佈、傅里葉頻譜等結構化的“視覺證據”,再一步步基於證據做出判斷。 從“憑感覺打分”到“拿證據說話”——在7個圖像質量評估基準上,IQA-T1取得了綜合最優(SOTA)的成績,平均PLCC/SRCC達到0. 784,同時給出的評估過程可解釋、可追溯。 △現有MLLM打分要麼是“純文本推理”(易受語義偏見誤導),要麼是“區域裁剪推理”(一堆沒有解釋的圖像塊);IQA-T1則走向“工具生成視覺證據”的新範式。 圖像質量評估(Image Quality Assessment, IQA)的目標,是讓機器打出的分數儘可能貼近人的主觀感受。 它是圖像修復、增強、壓縮等一系列視覺任務的“裁判”,直接決定了視覺系統在真實開放環境中好不好用、穩不穩。
Related
相關文章

AI大模型公司,正在集體“造芯”
AI大模型公司,正在集體“造芯”影子備忘錄2026.07.21 09:14 · 來自廣東全文5050字00:00 / 14:33算力自主權之爭。文 | 影子備忘錄此前,據路透社獨家報道:DeepSeek已秘密啟動自研AI推理芯片項目約一年,芯片定位專攻推理而非訓練,目的是降低對英偉達和華為等外部供應商的依賴。幾乎同一時間,The Information爆料稱智譜AI也在評估自研定製芯片,已向多家國內芯片設計公司進行初步詢問。再往前推不到兩週,OpenAI剛剛發佈了與博通聯合開發的首款定製推理芯片Jalapeño。而Anthropic也被曝出正在與三星接洽,探討2納米制程的代工合作。短短半個月,全球最頭部的大模型公司OpenAI、Anthropic、DeepSeek、智譜等,都在不約而同地把手伸向了芯片。這不是巧合。DeepSeek的“第三條路”先說說DeepSeek。7月7日路透社的消息讓整個行業為之一震。據三位知情人士透露,DeepSeek的自研芯片項目大約在一年前就已秘密啟動,目前仍處於早期階段,公司已與芯片設計公司、晶圓代工廠及存儲廠商展開多輪接洽。值得注意的是,DeepSeek選擇的是一條“中間路線”,芯片定位既不是英偉達的GPU路線,也不是華為昇騰的國產替代路線,而是一條完全自研的推理芯片路線。長期以來,DeepSeek同時使用英偉達和華為芯片。其底層基礎模型曾在英偉達H800上完成訓練,美國對華實施芯片出口管制後,DeepSeek逐漸轉向華為昇騰芯片,今年4月發佈的DeepSeek-V4模型已全面適配華為昇騰架構。但即便如此,DeepSeek依然選擇自己造芯片。這是為什麼?最直接的答案藏在DeepSeek剛剛完成的融資裡。2026年6月,DeepSeek完成了成立以來的首輪外部融資,籌集約510億元人民幣(約74億美元),投後估值在520億至590億美元之間。此

朱松純:中國AI產業,不要被“馬斯克信仰”帶偏
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI自助報道廣東最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作朱松純:中國AI產業,不要被“馬斯克信仰”帶偏36氪的朋友們·2026年07月21日 08:54過去幾年,WAIC的中心舞臺屬於大模型、Scaling Law和“大力出奇跡”的信仰。北京通用人工智能研究院院長朱松純則是這套敘事最堅定、也最持久的批評者之一。 朱松純上一次出現在世界人工智能大會(WAIC),還是2019年。此後七年,他幾乎缺席了這個中國最大的AI產業秀場。 缺席本身,也是一種態度。 過去幾年,WAIC的中心舞臺屬於大模型、Scaling Law和“大力出奇跡”的信仰。北京通用人工智能研究院院長朱松純則是這套敘事最堅定、也最持久的批評者之一。 從2022年底ChatGPT引爆大模型浪潮開始,他就反覆強調:大語言模型無法自然通向通用人工智能,單純擴大參數、數據和算力,也不會自動湧現出AGI。在他看來,這場熱潮背後的資本營銷和國際敘事,遠比真正的技術突破更強大。 2026年7月19日,朱松純重新回到WAIC。 在“思想者論壇”的一小時演講中,他把過去幾年的AI熱潮概括為一場由“硅谷、華爾街、華盛頓三重奏”共同推動的資本與地緣政治敘事。中國科技界則長期困在美國定義的問題中:“信息從美國傳過來,我們再請美國專家

階躍星辰,還是有點急了
階躍星辰,還是有點急了藍媒匯2026.07.21 08:52 · 來自天津全文3056字00:00 / 08:58是好棋,還是豪賭?文 | 藍媒匯,作者 | 封華,編輯 | 魏曉剛結束的WAIC(世界人工智能大會)上,手機有了很多新花樣。榮耀把創新形態的Robot Phone推到臺前,試圖直接定義“機器人手機”;中興努比亞聯手豆包,要將第二代豆包手機敞開賣。最激進的當屬階躍星辰。

Edge AI Daily 早報(7月21日)
OpenAI模型突破數學難題後暴露安全困境,揭示長週期自主模型評測盲區。Alphabet將Gemini架構嵌入Frozen v2芯片,算力效率提升6-10倍,標誌AI競賽從規模轉向效率。SpaceX向鴻海下達520億美元AI服務器訂單,打破戴爾-超微壟斷,顯示算力產業邊界重構。

