🐾 【AI快訊】強勢挑戰 OpenAI!阿里 Qwen3.8-Max 發表,電腦自主操作效能宣稱超越 GPT-5.6
喵~今天的科技圈又發生什麼大事?讓 DaeDae 幫你整理好啦!各位鏟屎官們,如果你覺得現在的 AI 只能幫你寫寫文章、畫畫圖,那你就太小看它們了。最近阿里巴巴的 Qwen 團隊拋下了一枚震撼彈,推出了一個號稱能「接管電腦」的超強 AI,重點是價格還便宜到不行,簡直是為了讓我們這些想 摸魚 的人量身打造的!🐾 💻 阿里巴巴 Qwen3.8-Max 強勢登場:電腦自主操作效能超越 GPT-5.6? 阿里巴巴 AI 研究團隊(Qwen)正式發表了最新的旗艦模型 Qwen3.8-Max 。這可不是一般的小改版,它是一個擁有 2.4 兆參數 的「混合專家(MoE)」多模態大語言模型。 這次 Qwen3.8-Max 最讓人驚豔的,是它在 自主電腦操作(Agentic Computer Use) 上的表現。根據官方公布的數據,在衡量 AI 操控桌面系統能力的關鍵指標 OSWorld-Verified 中,Qwen3.8-Max 拿下了 86.1 的高分,直接超車了 OpenAI 的 GPT-5.6 Sol Max (83.2)以及 Anthropic 的 Fable 5 (85.0)。 這意味著什麼?以後你只要出一張嘴,AI 就能幫你在電腦上完成複雜的操作,從點擊選單到跨軟體執行任務,它比現在的頂尖模型都還要聰明! 📍 肉球筆記: * 電腦操控王者 :在桌面操作測試中取得 86.1 分,制霸目前主流 AI 模型。 * 全方位領先 :在終端機指令(TerminalBench)與視覺網頁開發(Vision2Web)等領域也取得領先。 * 強大的視覺回饋 :能邊看螢幕邊修正計畫,不是盲目執行指令。 摸魚結論: 以後複雜的軟體操作不用自己動手,交給 Qwen 幫你點點滑鼠,鏟屎官就能騰出手來擼貓了! 🛠️ 超長待機 10 天!軟體工程師也要被「取代」了嗎? 除了會操作電腦,Qwen3.8-Max 的耐力也相當驚人。阿里表示,這個模型具備 連續自主執行超過 10 天 軟體專案的能力。它不僅能讀論文並重現程式碼(PaperBench),還能進行晶片設計優化。 對於企業來說,這意味著 AI 代理(Agent)不再只是寫寫簡單的 Snippet,而是可以真正參與到長跨度的開發流程中。這種「長續航」的自動化能力,將大幅提升軟體工程的效率。 摸魚結論: 長時間的自動化開發交給 AI...