-
日期: 2026-07-23 | 來源: 煎蛋網 | 有0人參與評論 | 字體: 小 中 大
想象壹下,給頂級AI模型壹張白紙和壹套彩色鉛筆,讓它們從第壹筆開始,慢慢畫出壹幅蒙娜麗莎。這不再是簡單的文字生成圖像,而是壹場真正的技巧考驗。
在這次有趣的測試中,GPT-5.6 Sol、Claude Fable 5、Grok 4.5和Gemini 3.6 Flash這肆位選手進入了特制的繪畫競技場。它們不僅要決定畫什麼,還要像真正的畫家壹樣,控制筆尖的粗細、壓力和顏色。它們可以使用暈染工具來混合色彩,也能用橡皮擦去敗筆,甚至能通過查看畫布指令來審視自己的作品。這裡沒有壹鍵填色的快捷鍵,每壹抹陰影和色彩都必須通過不斷疊塗來實現。
實驗結果非常出人意料。GPT-5.6 Sol成為了全場的領跑者。它非常高效,平均每幅畫只用了29步,用時約6.2分鍾,成本僅為7.74美元。有趣的是,它從不浪費口舌去單獨設置畫筆參數,而是直接在下筆時完成所有配置。它創作的星空和玫瑰花被公認為全場最佳,在細節處理上幾乎完勝其他對手。
相比之下,Claude Fable 5的表現讓人有些心疼錢包。它畫壹幅畫平均需要12.5分鍾,消耗的成本高達160.58美元。雖然它在其他任務中表現出色,但在這個繪畫挑戰中,它不僅動作慢,產出的作品質量也略遜壹籌。它極其依賴暈染工具,試圖通過不斷的模糊處理來掩蓋筆觸。
Grok 4.5則像是壹個深陷細節的微觀管理者。在它的工具調用記錄中,竟然有65%的操作是在反復調整畫筆顏色、寬度和壓力。由於把大量精力花在了調色和選筆上,它畫壹幅畫平均需要99步,但最終的效果卻顯得有些粗糙。而Gemini 3.6 Flash則是最糾結的審稿人,它每畫幾筆就要停下來觀察壹下畫布,每幅畫平均自審22.6次。雖然它在數學層面的結構相似度評分中拿到了最高分,但從人類的審美角度來看,它的作品並不壹定是最漂亮的。
這次實驗還揭示了壹個有趣的共性:AI往往會畫蛇添足。所有的模型在創作中途其實都達到過壹個最佳狀態,但由於它們不斷地進行自我審查和修改,最終的作品反而不如中間過程。比如Gemini 3.6 Flash在畫蒙娜麗莎時,中途的相似度曾達到峰值,但隨著它繼續編輯,得分反而壹路下滑。
這場實驗不僅僅是為了看AI畫得有多像,更是為了觀察它們處理開放式任務時的能力。那些廉價的開源模型在面對這種需要長路徑規劃的任務時,往往只能交出白卷。通過這種方式,我們能更清晰地看到頂級模型與普通模型之間的真實差距。這不僅是算法的較量,更是邏輯、效率和藝術理解力的綜合體現。

- 新聞來源於其它媒體,內容不代表本站立場!
-
原文鏈接
原文鏈接:
目前還沒有人發表評論, 大家都在期待您的高見