分類: AI, UI/UX, 藝術, 觀看

視覺秩序如何生成:格式塔、抽象藝術與演算法美學

當代視覺文化正在經歷一場結構性的改變。圖像生產已從畫筆、攝影機延伸到電腦與人工智慧,藝術家也開始利用演算法生成過去難以手工完成的複雜形式。更重要的變化,發生在「圖像如何成為圖像」這個問題上。

過去,藝術通常被理解為藝術家製作一個物件,再由觀看者對這個物件進行感知與解釋。今日的生成系統卻使這種線性關係逐漸鬆動。圖像可以由規則反覆運算,在觀看之前便存在大量潛在版本,也可以根據資料、參數、隨機值與模型權重即時改變。藝術家的工作因此不再只在於決定形式應該長成什麼樣子,也逐漸轉向設定一組條件,使某些形式得以出現。作品不一定先以固定物件存在,而可能在規則、系統與觀看條件的交互作用中持續生成。

若沿著這個問題重新回望二十世紀的視覺思想,格式塔心理學(Gestalt Psychology)、Wassily Kandinsky(1866-1944)的抽象藝術理論,以及後來的生成式藝術(Generative Art),便形成了一條值得重新閱讀的思想軸線。三者之間並不存在簡單的歷史繼承,也不能被理解為心理學先發現規律、藝術家加以運用,最後再由電腦將其程式化。真正使它們產生關聯的,是共同面對了一個更基本的問題:當視覺世界不再依靠再現物體來維持意義時,秩序究竟從哪裡產生?

知覺並不是世界的被動複製

二十世紀初由 Max Wertheimer(1880-1943)、Wolfgang Köhler(1887-1967)與 Kurt Koffka(1886-1941)等人建立的格式塔心理學,首先改變的並不是藝術理論,而是心理學對知覺本身的理解。它反對將視覺經驗拆解為彼此孤立的刺激單位,認為觀看並不是眼睛接收一組色點、亮度與邊緣之後,再由意識逐步把它們組合成物體。視覺經驗從一開始便具有組織性,局部元素所呈現的意義受到整體結構制約,而整體也會反過來改變局部元素被理解的方式。

所謂格式塔,真正重要之處因而不在一句經常被簡化引用的「整體大於部分的總和」,而在於知覺關係具有不可還原性。兩個完全相同的點,只因為彼此距離改變,便可能被觀看者理解為同一組或不同組;相同的線段放入不同構圖之中,也可能出現完全不同的方向性與張力。視覺不是把已經存在的意義搬運進大腦,而是在元素之間形成關係的瞬間建立一個知覺場。

接近律、相似律、閉合律、良好連續、共同命運與圖底關係之所以長期影響平面設計、資訊設計與使用者介面,並不是因為它們提供了一本可以機械套用的構圖手冊,而是因為它們揭示了一件更根本的事:視覺系統會主動尋找關係。當幾個元素彼此靠近,我們容易把它們視為一個群體;當形狀、色彩或尺寸形成重複,我們會推定其中存在某種共同性;當輪廓中斷,我們往往並不把它理解為純粹的缺失,而會根據其他線索補足可能的完整形態。圖像因此並不需要把所有東西實際畫出來,觀看自身便會參與形式的完成(圖 1)。

圖 1:格式塔知覺組織原理示意圖,2026 年,自製圖。接近律、相似律、圍合律、連接律、良好連續、對稱律、圖底關係、閉合律與共同命運,分別呈現視覺系統如何依據元素的距離、形態、邊界、連結、方向與空間關係,自動形成群組與整體形式。這些原理顯示,觀看並非被動接收孤立元素,而是在元素彼此產生關係時主動建立知覺結構。圖片來源:作者自製(以 ChatGPT/OpenAI 影像生成工具生成);圖片版權:作者自有。

主觀輪廓所顯示的正是這種知覺生產能力。當幾個局部形狀以特定方式排列,即使畫面中並不存在一條真正的三角形輪廓,觀看者仍可能清楚感受到一個白色三角形浮現在背景之前。這裡最值得注意的並不是大腦「受到欺騙」,而是那個三角形在知覺層次上確實成為經驗的一部分。物理刺激與知覺物件之間因此不能被直接畫上等號。

這也使格式塔理論與現代藝術之間出現了一個重要交會。當藝術逐漸降低對具象再現的依賴,觀看者面對的不再是「這畫的是什麼」這一個問題,而開始直接面對線、面積、間距、方向、色彩與重心之間的組織。知覺並不因為物體消失而停止,相反地,當再現性的支撐減弱,原本被物象遮蔽的知覺組織反而更加清楚地暴露出來。

格式塔研究中的多穩態現象更進一步說明,知覺秩序並非永遠只有一個穩定答案。某些圖像可以在兩種甚至多種組織方式之間切換,經典的圖底反轉便使一個區域有時成為形象,有時退回背景。兩種結構通常無法同時保持同等清晰,觀看因此成為持續重新組織的活動。這種現象對理解二十世紀以來的視覺藝術尤其重要,因為藝術作品可以不再提供一個唯一而穩定的觀看位置,而是刻意延長知覺決定尚未完成的時間,使觀看在幾種可能的形式之間擺動。

Kandinsky 的問題不是幾何,而是如何使形式具有力量

若從格式塔心理學轉向 Kandinsky,最容易產生的誤解,是把他的抽象藝術理解為格式塔法則的藝術版本。兩者確實共享二十世紀初德語思想世界對形式、感知、力與整體結構的高度關注,但沒有必要假定 Kandinsky 是先知道某套心理學規律,再把它轉換成抽象繪畫。他真正處理的問題,來自繪畫自身所遭遇的危機:如果繪畫不再以再現外在物體作為首要任務,那麼一條線、一個色塊或一個圓為什麼值得被放在畫面上?

在《藝術的精神性》(Über das Geistige in der Kunst, 1911)以及後來的《點、線、面》(Punkt und Linie zu Fläche, 1926)中,Kandinsky 試圖建立一種不依賴物象的視覺語法。這套語法之所以重要,不在於它成功制定了一張普遍適用的形式字典,而在於它重新描述了藝術元素的存在方式。點不再只是尺寸極小的形狀,線也不是用來勾勒物體輪廓的工具,它們開始具有自身的時間、方向、密度與力量。

在 Kandinsky 的分析中,點可以被理解為一種高度集中的視覺事件。它在幾何學上可能被視為沒有面積的抽象位置,但一旦進入繪畫,點必然具有尺寸、重量與位置。相同的黑點被移向畫面的左上角、中央或右下角,所產生的張力並不相同。這意味著形式的意義不能只由形式自身決定,它總是在一個更大的場域之內出現。

線則使時間更直接地進入畫面。Kandinsky 將線理解為點在力的作用下產生運動之後留下的軌跡。這個說法的重要性並不在於它是不是物理學上的精確描述,而在於它使幾何形式從靜態物件轉變為運動的痕跡。水平線、垂直線、斜線、弧線與折線因此具有不同的方向性與節奏,線條所形成的不只是輪廓,而是一套力的配置。

到了「面」,問題則進一步從單一元素轉向場域。畫面的基本平面並非消極承載圖像的背景,它本身已經具有方向差異。上方與下方、左側與右側並不是完全等價的位置,元素一旦進入其中,便與邊界、中心及其他元素形成新的關係。Kandinsky 的繪畫因而可以被理解為不同形式力量在有限平面中的安排,而不只是各種幾何圖形的集合。

從這個角度閱讀《構成第八號》(Composition VIII, 1923),便會發現作品最值得注意的並不是畫面中存在圓、三角形、線段與弧形,而是這些元素之間沒有被組織成一個傳統透視空間。它們仍然形成關係,仍然具有遠近、聚散、速度與重量,卻不必共同服務於一個被再現的世界。視覺秩序第一次如此明確地從物體的秩序中獨立出來(圖 2)。

圖 2,Wassily Kandinsky(1866-1944),《構成第八號》(Composition VIII / Komposition 8),1923 年,油彩、畫布,140 × 201 cm。畫面由圓形、三角形、直線、曲線、網格與色塊構成,彼此並未依照傳統透視形成單一空間,而是透過距離、相似性、方向、交疊與連續關係組織成多個視覺群體。觀看者會自然把鄰近的圓形、平行的線段與方向相近的形態組織在一起,同時沿著曲線與斜線建立視覺運動,使原本分散的幾何元素形成具有張力與節奏的整體知覺場。此作特別適合說明格式塔所強調的知覺關係不可還原性,畫面的整體結構並非來自任何單一形狀,而是在元素彼此接近、相似、連續與對位的過程中生成。現藏於 United States,New York,Solomon R. Guggenheim Museum;圖片來源:Wikimedia Commons;圖片版權@Public Domain。

色彩與形狀不是固定密碼

Kandinsky 關於色彩與形狀的討論經常被後來的設計教材整理成一套簡單對應,例如黃色對三角形、紅色對正方形、藍色對圓形。這樣的整理雖然方便,卻容易把一套探索性的藝術理論誤讀成固定的心理學定律。

Kandinsky 確實認為色彩具有方向、溫度與精神強度,並嘗試討論某些色彩與幾何形式之間可能產生的親和性。黃色具有向外擴張、逼近觀看者的傾向,藍色則容易被他描述為向內收縮與遠離;尖銳的三角形與黃色之間因此可能形成某種強化關係,而圓形與藍色則可能產生另一種內向性的結合。然而,這些對應首先屬於 Kandinsky 自身的色彩哲學與包浩斯時期的形式研究,並不能直接提升為跨文化、跨歷史的人類知覺自然法則。

更重要的是,Kandinsky 並沒有只關心「和諧」的配對。他同樣重視不匹配所造成的摩擦。藍色未必只能與圓形結合,黃色也沒有必要永遠服從三角形。當形狀與色彩之間出現預期之外的搭配,形式之間可能產生更複雜的張力。藝術的目的並不是找出一張最正確的視覺配色表,而是在具體作品之中控制不同力量相遇時產生的效果。

這也使他的「內在必然性」(Innere Notwendigkeit)概念不能被簡化成藝術家的個人情緒。內在需求所指向的是形式選擇何以具有必要性的問題。藝術家選擇一個圓、一條斜線或一塊藍色,不是因為某條外部規則要求如此,也不只是因為形式看起來漂亮,而是因為它在整體作品的精神與形式關係中具有不可任意交換的位置。

這種構想與格式塔心理學之間真正有意思的地方,也許正在於兩者都拒絕把形式視為孤立單位。格式塔心理學主張元素的知覺性質受到整體結構決定,Kandinsky 則認為點、線、面與色彩只有進入整體構圖後才會形成真正的張力。兩者所使用的語言、研究方法與目的並不相同,一方處理實驗心理學,一方處理藝術與精神問題,但它們同時把十九世紀以來將視覺理解為「物件加屬性」的方式推向另一種場域性的理解。

格式塔與抽象藝術的交會不是影響關係,而是共同的視覺問題

若把格式塔心理學與 Kandinsky 放在同一條歷史線上,必須避免製造過於漂亮的因果故事。格式塔心理學並不是先完成一套知覺科學,再由 Kandinsky 將它運用在繪畫上;同樣地,也沒有必要宣稱 Kandinsky 在心理學家之前「預言」了格式塔。二十世紀初的德語知識環境中,心理學、美學、藝術教育、建築、音樂與生理學都在重新處理形式與感知問題,兩者較適合被理解為在不同制度與學科位置上回應共同的歷史壓力。

這個共同問題可以概括為「關係如何先於物件產生意義」。

傳統再現繪畫中,一條線很容易被理解為人物輪廓、建築邊界或遠方地平線的一部分。到了抽象藝術裡,線失去了這種預先給定的指涉,觀看者只能透過它與其他線條、色塊、空白以及畫面邊界之間的關係來理解它。格式塔心理學則從另一個方向指出,即使在日常知覺中,物體之所以能夠形成穩定形象,本來就依靠分組、圖底、邊界、連續與閉合等組織作用。

抽象藝術因此並沒有發明知覺組織,而是把知覺平常默默進行的工作暴露出來。觀看者站在 Kandinsky 的畫作前,很難完全停止尋找形象。幾條相交的線可能短暫被理解成建築,一個圓可能被看成行星,一組黑色細線又可能被理解為機械結構,但這些辨識很快被其他形式關係推翻。作品沒有讓格式塔停止運作,而是不斷給它提供足以形成秩序、卻又不足以完成穩定物象的條件。

抽象藝術的重要性也由此發生變化。它並不只是拒絕再現世界,而是把觀看本身轉變為作品的一部分。作品不再把一個完成的世界交給觀者,而是提供一個知覺場,使觀看者必須持續組織、修正與重新配置其中的關係。

到了數位與生成藝術時代,這個問題又出現一次根本性的轉折。現在,尚未完成的不只是觀看者對作品的理解,連作品本身也可能尚未具有唯一確定的形式。

從構圖轉向規則,藝術家開始設計可能性

生成式藝術最關鍵的改變,不在於藝術家開始使用電腦,而在於藝術製作的對象發生了轉移。藝術家不一定直接決定最終圖像中的每一條線與每一個位置,而是先制定一組規則,再讓系統依照這些規則產生形式。

這使傳統構圖概念出現根本性的擴張。

在一幅固定畫作中,藝術家面對的是具體的位置問題,一個圓究竟應該向左移多少,一條線究竟應該延伸到哪裡,一個色塊到底應該佔據多少面積。生成系統所處理的則可能是另一種問題:圓可以出現在哪一個範圍,它的半徑允許如何變化,不同圓之間最小距離是多少,線條碰到圓時應該穿過、停止、偏轉,還是改變方向。

藝術家不再只是構成一張圖,而是在構成一個「能夠產生圖的空間」。

這裡便出現了生成藝術與 Kandinsky 之間真正值得討論的連結。《點、線、面》把繪畫從物象拆解為基本元素及其力量關係,而演算法則可以把這些關係轉換為參數、條件與運算。點可以變成座標,線可以由起點、終點、方向與曲率描述,色彩可以進入數值空間,元素間的距離、密度與重疊程度也都能被轉換成變數。

但「可以計算」並不等於「已經理解」。

當程式把畫面切成若干區域,限制大形狀集中在某些位置,讓細線在其他區域形成較高密度,再藉由隨機值改變角度與尺寸,確實可以得到某種近似 Kandinsky 的視覺結構。然而,這並不證明 Kandinsky 的藝術已經被還原成演算法。程式處理的是可以形式化的關係,而「內在需求」、精神性與藝術史位置並不會因為圓與線被成功生成而自動進入系統。

也正是在這個差距中,生成藝術開始形成自己的美學問題。真正有意思的生成系統很少只是把既有風格轉寫為程式,而是利用規則產生藝術家本人無法逐一預先想像的結果。作品的價值逐漸從「完成一個理想構圖」轉向「建立一個具有生產力的規則系統」。

Molnár 之後,秩序開始包含偏差

Vera Molnár(1924-2023)在生成藝術史上的重要性,正在於她很早便理解到演算法藝術真正值得探索的並不是完美規則,而是規則如何承受偏差。

在電腦尚未普及之前,她便以想像機器(machine imaginaire)的方式,在紙上構想如果由機器執行一系列明確規則,形式將如何逐步改變。日後實際使用電腦進行創作時,她持續處理網格、方形、線條、排列與變異之間的關係。她常被概括為在規則之中加入少量混亂,但這裡的「混亂」並不是把秩序摧毀,而是測試秩序在哪個位置開始鬆動(圖 3)。

圖 5,Vera Molnár(1924-2023),《Inclinaisons 32》,1971 年,電腦繪圖,Benson 繪圖紙,36 × 30.5 cm。作品以大量長度相近的細直線為基本元素,透過角度、位置與交錯密度的變化形成近似而不完全重複的視覺場。單一線段本身幾乎不具有明確意義,但當數百條線彼此疊合後,觀看會主動辨認局部的方向群組、連續趨勢與疏密差異,使離散元素形成具有運動感的整體結構。作品同時顯示早期電腦藝術如何將構圖轉化為規則、參數與有限變異的生成過程,特別適合說明格式塔知覺中的相似、接近與良好連續,也揭示視覺秩序並不必然來自預先畫定的完整形體,而可能由大量局部關係逐步生成。作品資料:The Mayor Gallery,London;圖片來源:The Mayor Gallery;圖片版權 © Vera Molnár。

一個完全規則的方形網格很容易立即被觀看者辨認。當其中一條線發生偏移,異常反而變得極為突出;如果偏移增加,觀看開始在規則與失序之間尋找新的整體結構。這正是生成藝術與格式塔問題重新相遇的地方。

格式塔理論通常研究觀看如何從複雜刺激中形成穩定結構,而生成藝術則可以主動操縱形成穩定結構所需的條件。藝術家可以逐步改變密度、間距、方向、對稱性與重複程度,觀察一套原本清晰的視覺秩序在什麼位置開始變成另一種秩序。

隨機性在這裡也必須被重新理解。生成藝術中的隨機並不是藝術家放棄控制,而是把控制移到另一個層次。藝術家不再決定每一次結果,卻可以決定什麼東西允許隨機、隨機範圍多大、哪些關係不能被破壞,以及什麼時候系統必須重新開始。

因此,生成藝術的核心並不是秩序與混亂的二選一,而是兩者之間可調整的閾值。

這一點在許多後來的演算法藝術中更加清楚。藝術家可以設定粒子沿著向量場移動,使每一條線的實際路徑都不完全相同,卻仍然共享一個不可直接看見的力場。觀看者看到的是大量彎曲線條,真正組織這些線條的卻是一套位於圖像背後的規則。此時的「整體」不再只是畫面中所有線條加總之後形成的構圖,還包括那套使這些線得以出現的生成機制。

格式塔所說的整體與部分關係,因而在演算法藝術裡獲得另一種含義。部分不只受到畫面整體支配,也受到一個不可見系統支配。

從視覺作品到視覺生態系統

當生成藝術逐漸成熟,作品與系統之間的區別也變得愈來愈重要。一張輸出的圖像可能只是某個生成系統在特定種子值與參數下的一次實現。更換隨機種子,同一套規則便可能產生另一幅作品;調整少量參數,整個系列的構圖特性也可能隨之改變。

這意味著藝術作品開始具有兩種不同的存在尺度。

第一種是我們實際看到的單一圖像。它仍然可以用傳統形式分析的方法觀看,我們可以討論色彩、重心、密度、對比與線條方向。第二種則是產生這張圖像的可能性空間。觀看任何單一作品時,我們實際面對的只是那個空間中的一個樣本。

Tyler Hobbs(1987-)的《Fidenza》之所以成為生成藝術的重要案例,也可以從這個角度理解。系列中的每件作品具有明顯差異,卻又能迅速被辨識為屬於同一個生成系統。真正維持風格一致性的不是某一個固定構圖,而是曲線流動方式、尺度層級、色彩選擇、形狀密度與空間分布之間的一組統計與程序關係。

這種狀態與傳統藝術中的系列作品並不完全相同。畫家當然也可以在不同畫作中維持相似筆觸與構圖習慣,但生成系統把這些習慣明確地轉換成可執行條件。所謂風格不再只是藝術家長期形成的手感,而開始以規則的形式存在。

也因如此,生成藝術把一個長久存在於藝術史中的問題推到了更明確的位置:藝術家的風格究竟存在於作品裡,還是存在於產生作品的方法裡?

若沿著 Kandinsky 的「內在需求」重新閱讀這個問題,便會發現生成藝術並沒有讓藝術家的判斷消失,只是使判斷從微觀的形狀安排轉移到規則層次。藝術家不再必須親自決定每一條線的位置,卻必須決定什麼樣的線有權出現、什麼樣的偏差仍屬於作品、系統能夠走多遠,以及在哪個位置它已經失去自身的形式身份。

所謂藝術直覺,開始被分散到參數選擇、規則設定、測試、刪除、重寫與選擇輸出的整個過程之中。

演算法可以使用格式塔,但不等於具有格式塔知覺

當生成藝術、電腦視覺與人工智慧逐漸相互靠近,一種很誘人的說法隨之出現:既然人工神經網路能夠從局部特徵逐層辨認形狀與物體,它們是否已經重新實現了格式塔心理學?

這種比擬具有啟發性,卻必須保持限制。

早期卷積神經網路確實會在不同層級形成由簡單特徵走向複雜特徵的表示,低層可能對邊緣、方向與局部紋理較敏感,高層則形成更複雜的結構表示。但這種計算架構不能直接等同於人類格式塔知覺。格式塔心理學處理的是現象經驗中的組織規律,神經網路處理的則是透過資料、損失函數與訓練程序形成的數值表示。兩者可能在某些視覺問題上產生相似結果,運作原理卻不必相同。

真正值得注意的並不是機器是否「擁有格式塔」,而是人類已經開始把過去以心理學語言描述的知覺秩序轉換成計算問題。

例如,視覺元素是否過度擁擠,可以用距離與密度衡量;構圖是否具有明顯群聚,可以透過空間分布分析;對稱程度、方向一致性與色彩差異也可以轉化為數值。生成系統於是能在大量結果之間自動篩選某些結構,或者讓特定規則限制圖像不至於完全失去可辨識的組織。

但就在格式塔原則變得可以被計算時,它的美學意義也開始改變。

對人類設計師而言,接近律可能是一種使資訊容易理解的手段;對生成系統而言,它可以變成一個限制條件。當兩個元素距離低於某個閾值,系統便把它們視為同一群;當視覺密度超過某個值,程式便重新配置位置。心理學描述的傾向於是成為演算法中的參數。

這是一個重要的歷史轉換。知覺規律原先用來描述人如何看世界,現在也開始被用來規定機器如何生產一個「容易被人看」的世界。

生成式人工智慧帶來的問題已經不同

今日所稱的生成式人工智慧(Generative AI),與 Molnár 以來的規則型生成藝術並不是同一件事。兩者都可以產生藝術家未逐一預先決定的圖像,但傳統生成藝術通常由創作者明確設計生成規則,而當代大型生成模型的形式能力則主要來自龐大資料與訓練過程所形成的統計表示。

這個差異使「點、線、面可以被程式化」的說法到此必須再次修改。

在傳統演算法繪圖中,藝術家可以直接寫下圓的半徑、線條的角度、粒子的速度與色彩變化規則;在文字生成圖像模型中,使用者輸入的可能只是「一個藍色圓形漂浮在黃色幾何空間中」。真正決定圖像中光線、質感、透視、材質與構圖細節的,不再是一組由使用者逐條指定的幾何法則,而是模型在訓練中形成的高維度關係。

這使當代生成圖像重新提出格式塔曾經提出、卻無法預見的問題。

如果觀看者會主動將視覺刺激組織成整體,那麼生成模型現在所做的,似乎是在觀看發生之前,就先根據大量既有圖像的統計關係生產一個高度符合人類知覺期待的視覺場。物體通常具有可辨識邊界,人物傾向成為圖形,背景形成空間延續,色彩與光線被配置成足以建立層次的關係。

這並不代表模型「理解」格式塔,而是我們的視覺文化早已把大量格式塔式秩序沉積在圖像之中。攝影、繪畫、廣告、電影、資訊設計與介面長期使用某些構圖習慣,而生成模型從這些圖像學到的,並不只是物體長什麼樣子,也包括物體通常如何被安排成可觀看的畫面。

於是,當代生成模型最大的問題甚至可能不是它能不能製造秩序,而是它太容易製造秩序。

人物總能被置於適當位置,色彩容易產生和諧,光線往往主動建立戲劇性,背景會自動形成景深,構圖迅速獲得一種已經完成的視覺合理性。這種能力與早期抽象藝術面對的問題恰好形成一種奇特反轉。Kandinsky 必須努力證明沒有物體的畫面仍然能形成視覺秩序,今日的生成模型則必須面對另一個問題:當機器幾乎可以無限製造「看起來成立」的圖像時,藝術是否反而需要重新學習如何使秩序失效。

從內在需求到系統需求

如果把這條歷史線拉長,格式塔心理學、Kandinsky 與生成藝術之間真正連續的,並不是某一套視覺形式,而是「秩序如何出現」這個問題不斷改變它的位置。

對格式塔心理學而言,秩序存在於知覺活動之中。外界刺激並沒有直接攜帶完整的視覺物件,人類的知覺系統會透過分組、閉合、圖底與連續關係,把刺激組織成可經驗的世界。

到了 Kandinsky,秩序從知覺研究轉入藝術生產。畫家不再依靠外部物象保證構圖的統一,而必須讓點、線、色彩與平面本身產生足以維持作品的內在關係。所謂內在需求,可以被理解為藝術家對這套關係何以成立的持續判斷。

到了生成藝術,秩序進一步轉移到規則。作品不一定先以完整圖像存在,而是先以條件、參數與程序的形式存在。藝術家設計的已經不是唯一結果,而是一個結果得以出現的空間。

到了生成式人工智慧,情況再次發生變化。秩序不再完全由單一藝術家制定,也不只是觀者在觀看中建立,而開始沉積於資料、模型架構、訓練程序與提示語之間。圖像的形成成為多人、多資料來源與多層計算共同作用的結果。

「內在需求」到了這裡便面臨一個前所未有的問題。當生成系統能夠自主補足構圖、光線與形式關係時,究竟是誰在決定一張圖像為什麼必須如此?

如果答案只是「因為模型判斷這樣最符合資料中的機率分布」,那麼生成圖像所具有的秩序便與 Kandinsky 所追求的內在需求產生根本差異。前者意味著形式在統計上容易成立,後者卻要求形式在作品內部具有某種不可交換的必要性。

兩者之間的差距,或許正是當代生成藝術真正值得思考的位置。

今日最迫切的問題已經不是機器能否畫出一張具有格式塔秩序的圖,也不是人工智慧能不能模仿 Kandinsky。從技術層面而言,這些事情早已不再特別困難。真正困難的是,在一個秩序能夠被快速、自動而大量生成的時代,我們如何區分「形式成立」與「作品成立」。

一張圖像可以具有完美的圖底關係,可以符合接近與相似原則,可以擁有平衡的色彩、明確的重心與流暢的視線引導,仍然不必因此成為一件重要的作品。格式塔心理學能說明我們為什麼容易把它看成一個整體,演算法可以使這個整體被有效生成,Kandinsky 留下的問題卻仍然沒有因此消失:為什麼必須是這個形式,而不是另一個同樣成立的形式?

生成系統使這個問題比過去更加尖銳。當另一個版本只需要重新輸入一次指令便可以出現,當同一個提示語可以產生數百張構圖完整的圖像,「不可替代性」便不再是藝術作品自然擁有的條件,而成為需要重新建立的東西。

從這個角度看,格式塔、抽象藝術與生成藝術之間真正重要的歷史關係,並不是一條從心理學走向程式設計的技術進步史,而是一部視覺秩序逐漸外部化的歷史。格式塔把秩序放在知覺之中,Kandinsky 把它轉化為形式之間的內在張力,生成藝術把它寫入規則,人工智慧則進一步把它分散到資料與模型之中。

藝術家的角色也隨之改變。藝術家曾經是製造圖像的人,後來成為組織形式的人,再成為設計規則的人,如今則愈來愈可能成為選擇、干預與抵抗系統傾向的人。真正值得關注的藝術直覺,或許不會因為人工智慧而消失,卻也不再只存在於手與材料接觸的瞬間。它可能出現在藝術家決定哪些結果不接受、哪些秩序過於順暢、哪些錯誤必須留下,以及何時應該讓系統偏離它最容易生成的形式之中。

二十世紀初,格式塔心理學告訴我們,人並不是被動接收世界,而是在觀看中不斷組織世界。Kandinsky 隨後證明,藝術不必等待物體替形式提供秩序,點、線、面與色彩本身便足以建立一個視覺世界。生成藝術又把這種組織能力從單一作品轉向規則與程序,使藝術家可以創造產生形式的系統。到了今天,人工智慧進一步使系統自身也開始參與形式選擇。

這條歷史並沒有把我們帶到「機器終於學會藝術」的終點。它反而把一個更早的問題重新交回我們手中。當知覺能夠形成秩序,規則能夠生成秩序,模型也能大量模擬秩序之後,藝術真正需要處理的,也許已經不再只是如何使世界變得可見,而是如何在一切都太容易成為圖像的時代,重新決定什麼值得被看見。