Trae 搭網站:翻車、補救、埋雷

2026年7月13日 07:58
Trae 搭網站:翻車、補救、埋雷

重點摘要

實測使用Trae AI IDE從Excel數據整理到建立網站,發現它能有效處理數據清洗並生成結構良好的網頁,但會因過度理解導致漏項,且在上下文消耗與模型選擇上存在限制。整體而言,Trae適合快速原型開發,但長期維護仍需人工監督指令明確性與代碼債管理。

站內 AI 整理稿

一位專注於AI工具測評的部落客,為了整理一份塵封已久的Excel檔案庫,決定測試字節跳動推出的AI開發工具Trae。他將三個工作表、22個AI工具的混亂數據,從資料清理到建立成一個可篩選、可排序的動態網站,過程中卻發現Trae雖然聰明,卻也暴露出過度解讀、容易埋下技術債的特性。測評者手邊有三個Excel檔案,裡頭記錄了2025年初測評的22個AI工具,從DeepSeek-V3到Claude 3.5 Sonnet,再到可靈與Midjourney。然而這些工具的字段名稱中英混雜,日期格式五花八門,評分標準從十分制到百分制都有,一直沒有整理完成。他決定將這個爛攤子交給Trae,測試它的極限。

第一關是資料清洗。測評者要求Trae合併三個工作表、統一字段名稱、轉換為十分制、統一日期格式,並輸出兩個Excel檔案。Trae收到指令後,自動建立了Python程式碼開始處理。但第一次執行結果出來,主表只顯示18個工具,少了DeepSeek-V3、Kimi-K1.5、可靈AI與即夢。問題出在去重邏輯,Trae自作聰明地將名稱相近的工具如「可靈AI」與「可靈1.5」視為同一個,這正是AI過度理解的典型案例。測評者要求修正,嚴禁模糊匹配,並要求評分保留一位小數。然而修復過程並不順利,Trae在執行刪除舊檔案指令時觸發了沙箱的高風險命令確認,又因為Excel檔案正被占用而無法寫入。

幾經波折後,Trae最終自行調用檢查工具,發現日期解析的bug並修復,才成功輸出包含全部22個工具的正確資料。第二階段是建立網站。基於整理好的資料,測評者要求一個「AI工具測評檔案庫」,需具備深色模式、表格展示、篩選與排序功能。更關鍵的是,他要求資料層必須獨立。結果令他意外,Trae自動將專案分為四個檔案:index.html作為入口、data/tools.js存放資料、js/app.js處理渲染、css/styles.css管理樣式。頁面顯示出22個工具、5個類型分類,包含國產與海外產品,篩選按鈕與排序功能都正常運作。隨後測評者陸續要求加入「狀態」字段,並將評分從十分制改為五分制。

Trae成功推算出新的狀態閾值,4.5分以上持續推薦、3.5到4.4分保持觀察、3.5分以下已淘汰。邊界值處理也相當準確。但在修改評分單位時,它修改了四個檔案,也暴露了硬編碼問題。測評者進一步要求Trae進行程式碼自我審查,找出三個最嚴重的工程問題。Trae沒有敷衍地回應,而是精準點出篩選按鈕的選項是「寫死」的、卡片渲染函數耦合過高、以及中英文數據翻譯不一致的問題。這顯示它具有察覺程式碼債務的能力。之後的產品疊代測試中,Trae將卡片式呈現改為表格,又新增了詳情頁與歷史評分折線圖。過程中資料層保持獨立,架構扛住了需求變更。但折線圖因為歷史數據只有兩筆,看起來像一根筷子。

當模擬數據從22個暴增至100個時,Trae主動提出分頁建議,並列出四個效能瓶頸,包括全量渲染、無分頁機制、字串拼接與無狀態緩存,甚至區分小於500條與大於500條的長期優化方案。它實施了每頁20條的分頁功能,篩選後自動跳回第一頁,切換流暢。不過測評者發現分頁按鈕第一次點擊時,驗證日誌顯示失敗,之後才成功,事件綁定可能有微小的延遲問題。此外,關閉自動模式後,Trae的模型列表僅顯示豆包、DeepSeek、GLM、Kimi、QWEN等國產模型。當詢問為何沒有Claude或GPT-4時,Trae回應需要手動添加API Key並考慮網絡與費用問題,意即開箱即用的只有國產模型。

測評者對Trae的結論是複雜的。它能幹活,具備架構意識,能預見效能問題,但容易在業務邏輯上想太多、程式碼債務會持續累積、也不會主動優化。對於需要快速搭建數據展示站的原型驗證,Trae效率極高,但在下指令時必須把規則咬死,避免留下模糊空間讓它自由發揮。長期維護的專案,也不能指望它一次交出完美程式碼,該盯的地方還是得持續盯。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

40 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

4 小時前