Microsoft Open Sources code-testing-generator: a Polyglot Unit-Test Agent That Hits 92.1% Task Completion Versus 78.9% for Stock Copilot

2026年8月7日 05:42
站內 AI 整理稿

Microsoft has open sourced code-testing-generator, a polyglot agent that writes unit tests and then proves they work.It ships in the dotnet-test plugin inside the MIT-licensed dotnet/skills repository.The agent targets a gap that coding assistants usually leave open.

A prompt like ‘generate unit tests’ does not say which framework, file location or assertions to use.code-testing-generator settles those decisions by reading the repository before it writes anything.It then plans, writes, runs and checks the tests it produces.

On Microsoft’s internal 152-task benchmark, it completed 140 tasks against 120 for stock GitHub Copilot.Both setups used the same model and prompts.Is it deployable Yes.

Related

相關文章

量子位AI Agent

Agent時代,CPU的價值該重估了

。 為什麼這麼說? 因為Agent正在改變AI計算的配比—— 從一顆CPU搭配四顆GPU(1:4),到現在的一顆CPU搭配一顆GPU(1:1)。 這便是芯片巨頭英特爾剛剛在蘇州舉辦的技術創新與產業生態大會(Intel Connection)中給出的判斷—— 隨著AI開始調用工具、執行任務,CPU需要承擔更多的調度、數據處理和執行工作,其在整套AI系統中的價值也需要重新衡量。

1 小時前
量子位AI Agent

WebArena作者Shuyan Zhou入職Meta超級智能實驗室

夢想是做能幫媽媽訂機票的AI瀏覽器。程淺 發自 凹非寺 | 公眾號 QbitAI Meta的億元俱樂部又添一中國面孔。最新消息,哈工大校友、WebArena作者Shuyan Zhou,宣佈自己於今年年初離開學術界,加入了Meta的“AI夢之隊”超級智能實驗室。

4 小時前
IT之家AI Agent

美銀等多家銀行警告:“AI 代購”或增加詐騙、欺詐和數據隱私洩露風險

作者:清源 責編:清源 評論: 9 月 22 日消息,據路透社今天(22 日)傍晚報道,國民西敏銀行、美國銀行等多家銀行警告,讓 AI 智能體代替消費者進行網上購物,可能增加詐騙、欺詐和數據隱私洩露的風險。OpenAI、Anthropic、谷歌和 Meta 等科技企業正大力把 AI 聊天機器人推向購物場景,希望未來消費者可以讓 AI 智能體挑選商品並直接代為下單,零售商則開始爭相影響聊天機器人的商品推薦。

6 小時前
IT之家AI Agent

OpenAI 呼籲美國牽頭聯合其他國家為前沿 AI 制定全球性標準

作者:清源 責編:清源 評論: 感謝網友 烏蠅哥的左手、咩咩洋 的線索投遞!9 月 22 日消息,各界對先進 AI 潛在危害的擔憂持續升溫之際,OpenAI 呼籲美國牽頭聯合其他國家,為前沿 AI 制定共同標準。當地時間 21 日,OpenAI 通過官方博客發文指出,要確保 AI 安全發展,需要建立國際技術標準,重點明確哪些 AI 模型事故必須上報、各國如何協同推進 AI 發展,以及如何改善開發此類技術所需算力的獲取條件。

8 小時前