新聞 > 科教 > 正文

當頂級模型拿起彩色鉛筆 誰是真正的藝術家?

想像一下,給頂級AI模型一張白紙和一套彩色鉛筆,讓它們從第一筆開始,慢慢畫出一幅蒙娜麗莎。這不再是簡單的文字生成圖像,而是一場真正的技巧考驗。

在這次有趣的測試中,GPT-5.6 Sol、Claude Fable5、Grok4.5和Gemini3.6 Flash這四位選手進入了特製的繪畫競技場。它們不僅要決定畫什麼,還要像真正的畫家一樣,控制筆尖的粗細、壓力和顏色。它們可以使用暈染工具來混合色彩,也能用橡皮擦去敗筆,甚至能通過查看畫布指令來審視自己的作品。這裡沒有一鍵填色的快捷鍵,每一抹陰影和色彩都必須通過不斷疊塗來實現。

實驗結果非常出人意料。GPT-5.6 Sol成為了全場的領跑者。它非常高效,平均每幅畫只用了29步,用時約6.2分鐘,成本僅為7.74美元。有趣的是,它從不浪費口舌去單獨設置畫筆參數,而是直接在下筆時完成所有配置。它創作的星空和玫瑰花被公認為全場最佳,在細節處理上幾乎完勝其他對手。

相比之下,Claude Fable5的表現讓人有些心疼錢包。它畫一幅畫平均需要12.5分鐘,消耗的成本高達160.58美元。雖然它在其他任務中表現出色,但在這個繪畫挑戰中,它不僅動作慢,產出的作品質量也略遜一籌。它極其依賴暈染工具,試圖通過不斷的模糊處理來掩蓋筆觸。

Grok4.5則像是一個深陷細節的微觀管理者。在它的工具調用記錄中,竟然有65%的操作是在反覆調整畫筆顏色、寬度和壓力。由於把大量精力花在了調色和選筆上,它畫一幅畫平均需要99步,但最終的效果卻顯得有些粗糙。而Gemini3.6 Flash則是最糾結的審稿人,它每畫幾筆就要停下來觀察一下畫布,每幅畫平均自審22.6次。雖然它在數學層面的結構相似度評分中拿到了最高分,但從人類的審美角度來看,它的作品並不一定是最漂亮的。

這次實驗還揭示了一個有趣的共性:AI往往會畫蛇添足。所有的模型在創作中途其實都達到過一個最佳狀態,但由於它們不斷地進行自我審查和修改,最終的作品反而不如中間過程。比如Gemini3.6 Flash在畫蒙娜麗莎時,中途的相似度曾達到峰值,但隨著它繼續編輯,得分反而一路下滑。

這場實驗不僅僅是為了看AI畫得有多像,更是為了觀察它們處理開放式任務時的能力。那些廉價的開源模型在面對這種需要長路徑規劃的任務時,往往只能交出白卷。通過這種方式,我們能更清晰地看到頂級模型與普通模型之間的真實差距。這不僅是算法的較量,更是邏輯、效率和藝術理解力的綜合體現。

責任編輯: 李華  來源:煎蛋網 轉載請註明作者、出處並保持完整。

本文網址:https://tw.aboluowang.com/2026/0724/2412200.html