🐾 【AI快訊】強勢挑戰 OpenAI!阿里 Qwen3.8-Max 發表,電腦自主操作效能宣稱超越 GPT-5.6

喵~今天的科技圈又發生什麼大事?讓 DaeDae 幫你整理好啦!各位鏟屎官們,如果你覺得現在的 AI 只能幫你寫寫文章、畫畫圖,那你就太小看它們了。最近阿里巴巴的 Qwen 團隊拋下了一枚震撼彈,推出了一個號稱能「接管電腦」的超強 AI,重點是價格還便宜到不行,簡直是為了讓我們這些想摸魚的人量身打造的!🐾

💻 阿里巴巴 Qwen3.8-Max 強勢登場:電腦自主操作效能超越 GPT-5.6?



阿里巴巴 AI 研究團隊(Qwen)正式發表了最新的旗艦模型 Qwen3.8-Max。這可不是一般的小改版,它是一個擁有 2.4 兆參數的「混合專家(MoE)」多模態大語言模型。

這次 Qwen3.8-Max 最讓人驚豔的,是它在自主電腦操作(Agentic Computer Use)上的表現。根據官方公布的數據,在衡量 AI 操控桌面系統能力的關鍵指標 OSWorld-Verified 中,Qwen3.8-Max 拿下了 86.1 的高分,直接超車了 OpenAI 的 GPT-5.6 Sol Max(83.2)以及 Anthropic 的 Fable 5(85.0)。

這意味著什麼?以後你只要出一張嘴,AI 就能幫你在電腦上完成複雜的操作,從點擊選單到跨軟體執行任務,它比現在的頂尖模型都還要聰明!

📍 肉球筆記:
* 電腦操控王者:在桌面操作測試中取得 86.1 分,制霸目前主流 AI 模型。
* 全方位領先:在終端機指令(TerminalBench)與視覺網頁開發(Vision2Web)等領域也取得領先。
* 強大的視覺回饋:能邊看螢幕邊修正計畫,不是盲目執行指令。

摸魚結論: 以後複雜的軟體操作不用自己動手,交給 Qwen 幫你點點滑鼠,鏟屎官就能騰出手來擼貓了!




🛠️ 超長待機 10 天!軟體工程師也要被「取代」了嗎?



除了會操作電腦,Qwen3.8-Max 的耐力也相當驚人。阿里表示,這個模型具備連續自主執行超過 10 天軟體專案的能力。它不僅能讀論文並重現程式碼(PaperBench),還能進行晶片設計優化。

對於企業來說,這意味著 AI 代理(Agent)不再只是寫寫簡單的 Snippet,而是可以真正參與到長跨度的開發流程中。這種「長續航」的自動化能力,將大幅提升軟體工程的效率。

摸魚結論: 長時間的自動化開發交給 AI,工程師終於可以安心睡午覺,不用半夜起來修 Bug 了。




💰 價格屠夫再現!用 1/4 的價格賺更多罐罐



身為一隻專業的理財貓,DaeDae 最關心的就是如何幫大家賺罐罐(或者省下罐罐錢)。Qwen3.8-Max 這次在定價策略上非常「殘暴」:

* Qwen3.8-Max API 定價:輸入每百萬 Token $2 美元 / 輸出 $6 美元。
* 對比 GPT-5.6 Sol Max:成本僅需對方的 1/4
* 對比 Claude Opus 5:成本不到其 1/3

考慮到自主 AI 代理在執行任務時,需要不斷進行「自我糾錯」與「長對話」,會消耗極大量的 Token。阿里巴巴的這種價格攻勢,將大幅降低企業佈署 Agent 的門檻,讓躺平賺罐罐變得更有可能!

摸魚結論: 效能更強、價格更便宜,這就是所謂的 CP 值之王,省下來的預算通通拿去買肉泥!




🔓 下週震撼開源:旗艦級模型權重首度釋出?



最令社群興奮的還在後頭!阿里巴巴宣佈將於下週開放 Qwen3.8-MaxQwen3.8-27B模型權重(Open Weights)

如果最終採用的是寬鬆的商用授權,這將是全球「Max 級別」旗艦模型首次開放企業私有化部署。這對於重視資安、不想把數據傳給第三方 API 的企業來說,簡直是天大的好消息。

摸魚結論: 開源代表大家都能用、都能改,AI 技術的普及速度會像貓咪看到雷射筆一樣快!




今天的 AI 熱搜報就到這裡啦!阿里巴巴這次真的是出大招,不僅技術上挑戰 OpenAI,價格上也想把大家捲到底。如果你想追蹤更多能讓你摸魚的 AI 科技,別忘了關注 DaeDae 喔!

交給 AI,我要去睡覺了🐾



🐾 我的 FB 粉絲專頁:https://www.facebook.com/1120642004455326
🎧 我的 Podcast 主頁:https://airsb.firstory.io/

Podcast 封面或生活照

Comments