Игорь Мандель
Почему де Кунинг стоит так дорого?
ИИ, эстетика и прогнозирование цен на живопись
Данная статья является авторским модифицированным переводом отдельных фрагментов препринта (Mandel, 2026).
Работы на рис. 1 схематично отражают почти все сложные проблемы, связанные с рынком произведений искусства. Рекордная цена за картину Леонардо, выплаченная в 2017 году, была результатом стечения множества запутанных обстоятельств. Изначально проданная за $1,200 как работа выполненная "по мотивам Леонардо да Винчи" в 2005 году, картина претерпела очень серьезную реставрацию, выдержала судебные иски, скачки в цене от 80 млн через 120 до 450 млн долларов, но ее атрибуция все равно остается предметом спора. Как отметил один из крупных специалистов Чарльз Хоуп, который полностью отвергает версию об авторстве Леонардо, невероятно, что тот мог написать полотно, на котором глаза изображены не на одном уровне, а складки драпировки не искажены хрустальной сферой. И подобное мнение не единственное.
То есть цена была следствием совпадения как минимум трех обстоятельств: некоего консенсуса между определенным кругом специалистов (далеко не всех), грандиозного хайпа, поднятого во время продажной комании, и согласия покупателя с атрибуцией. При этом "атрибуция" - дело скользкое в данном случае еще и потому, что, наверняка в работе участвовали ученики Леонардо, и процент их участия играет решающую роль. Видимо, покупатель решил, что он близок к нулю. Если только появятся неопровержимые доказательства отсутствия авторства Леонардо, цена картины упадет многократно, и никакие ее эстетические прелести этому не помогут.

Рисунок 1. Три самые дорогие картины в истории аукционных продаж (цены откорректированы на инфляцию)
Подобные проблемы не возникают с двумя другими работами на рис. 1. Авторство заявленных художников несомненно. Почему они стали столь дороги, по сравнению с сотнями других работ Сезанна и де Кунинга? Они что, настолько лучше всего прочего? Непонятно. Да, "Игроки в карты" - прекрасный образец зрелого творчества Сезанна, но эта цена отличается от цены второй в списке его работ почти в два раза, а от третьей - почти в 5 раз. А де Кунинг? Ниже показана "Полицейская газета" (тоже 1955 года), которая стоит "всего" 63 млн, хотя чем она хуже, так сказать? Да и вообще, как случилось, что за неряшливые пятна де Кунинга люди платят почти столько же, сколько за тончайшую работу Леонардо да Винчи и/или его учеников?
Вопросы такого рода издавна волновали людей, и было предложено множество самых различных объяснений этому странному феномену – “цены на предметы искусства”. Взаимосвязь между эстетической ценностью произведения искусства и его рыночной ценой имеет долгую историю научных исследований.

Я с коллегами рассматривали этот вопрос в серии публикаций (Mandel, 2018; Mandel, 2019; Mandel et al., 2021), где приведены обширные ссылки на релевантную литературу, которые здесь повторяться не будут. В данных заметках я расскажу вкратце о самыx последних своиx изысканиях, связанных с тем, как ипользовать искусственный интеллект (ИИ) в моделировании цен на живопись, используя те эстетические оценки, которые ИИ спослобен давать.
Программа ранних исследований, лежавшая в основе указанных работ, заключалась в следующeм.
Был собран значительный массив индивидуальных эстетических суждений, включавший не только общее впечатление (по шкале «нравится / не нравится»), но и пять специфических характеристик, связанных с эстетическим восприятием произведения: степень Гедонизма, Гармонии, Оригинальности (интереса), Релаксации и Технического мастерства. Эти индикаторы являются примерным переводом с английкого (Hedonism, Harmony, Arousal, Relaxation, Technical mastery) и не вполне точно отражают нюансы оригинала. Особенно спорно переводить слово Arousal как Оригинальность, т.к. в русском прямой перевод (Возбуждение) непременно имеет сексуальную коннотацию, тогда как в английском - нет. Наиболее аккуратно будет сказать "Степень волнения от необычности работы, от ее оригинальности, насыщенности смыслом или художественной новизной". Но это будет слишком длинно. Поэтому я использую просто слово "Оригинальность", хотя осознаю некую неадекватность. Подробнее каждая из шкал будет разъяснена ниже.
Эти оценки были проанализированы как с точки зрения их внутренних корреляций, так и в связи с ценами на картины;
Анализ выявил наличие слабой положительной нелинейной связи между эстетическими индикаторами и ценой.
Последние годы принесли существенные достижения в анализе эстетических характеристик и в моделировании цен. Что, однако, до сих пор не предпринималось, насколько мне известно— это использование генеративного ИИ для получения эстетических оценок и изучения их связи с ценами на искусство; именно этому посвящена настоящая статья.
Такой подход представляет интерес по нескольким причинам. Способность больших языковых моделей (LLM) синтезировать огромные массивы информации и выражать результат в лаконичной, интерпретируемой форме делает их, в определенном смысле, функциональными аналогами респондентов. Это особенно значимо, учитывая, что индивидуальные эстетические суждения людей демонстрируют чрезвычайно высокую дисперсию — и по нашему опыту, и в цитированных выше исследованиях коэффициенты вариации 100% и более являются обычным явлением, что затрудняет характеристику «типичного» эстетического отклика. Агрегированные ИИ-оценки могут обеспечивать большую стабильность и имеют дополнительное преимущество в виде явных, аргументированных обоснований присвоенных баллов. Кроме того, ИИ делает возможным оценивание большого числа работ по множеству критериев за считанные минуты — задача, непомерно трудоемкая при опоре на живых участников. Наш собственный веб-сайт, использовавшийся в упомянутом ранее исследовании, pollart1000.com, потребовал более шести месяцев для привлечения не менее 30 респондентов для каждой из 80 работ; проект EVA (Kang et al., 2020) столкнулся с сопоставимыми трудностями. Наконец, ИИ позволяет осуществлять различные формы адаптивного самообучения, которые были бы непрактичны с респондентами. Оценки на основе ИИ также имеют недостатки; они обсуждаются ниже.
Выбор эстетических индикаторов (Гармония, Релаксация и т.д.) был основан на факторном анализе более широкого набора характеристик, описанном в Marković and Radonjić (2008), и предназначался для фиксации психологически независимых измерений эстетического опыта. Для оценки использовались три модели ИИ: Gemini (Google), Claude (Anthropic), Meta AI. Сама оценка проводилась в июне 2026 года на бесплатных версиях всех трех систем и осуществлялась в два этапа.
Обучение на примерах. Каждой ИИ-системе были предъявлены картины, обладающие экстремальными значениями по каждой из пяти специфических эстетических размерностей, названных выше (исключая общее эстетическое впечатление), и предложено подтвердить понимание предполагаемого конструкта. Это были те же изображения, которые ранее были показанны респондентам; все они воспроизведены в (Mandel, 2018, Приложение 2). На рис. 2 показаны примеры, представляющие максимальное и минимальное значения по шкале Оригинальности, где высокое значение соответствует работам, воспринимаемым как сложные, стимулирующие или интеллектуально насыщенные, а низкое — предсказуемым, пассивным или непримечательным. На протяжении всего исследования использовались работы известных художников, но имена авторов ИИ-системам не раскрывались (хотя они иногда идентифицировали иx самостоятельно, не всегда корректно). Как показано на рис. 2, примеры высоко оригинальных работ охватывают сатирическую картину Комара и Меламида с сильным концептуальным и идеологическим содержанием; инновационное фигуративное произведение Шиле; нетрадиционный пейзаж Климта; и загадочную, экспрессионистскую работу Шульженко. Все они требуют устойчивого внимания и определенной степени контекстуальной и искусствоведческой грамотности. Примеры низкой оригинальности — два конвенциональных пейзажа, примитивный портрет и советский пропагандистский плакат — передают свое содержание немедленно и не предъявляют когнитивных требований к зрителю, они ясны с первого вгляда.
Ниже приведен рапорт Gemini после калибровки примеров рис. 1 по шкале от 1 до 10. Система самостоятельно и корректно идентифицировала выдающихся художников, представленных в верхнем ряду, без соответствующего промпта с моей стороны.

Рисунок 2. Работы, представленные ИИ-системам как примеры максимального (верхний ряд) и минимального (нижний ряд) уровня по шкале Оригинальность.
Понимание системой Gemini понятия Оригинальность ********************************************
Высокая Оригинальность (10)
Изображения, представляющие максимальную оригинальность, характеризуются высоким когнитивным и психологическим напряжением, интенсивным нарративным весом или драматическими сдвигами перспективы:
Подрывное/Сюрреалистическое: Комар и Меламид «Происхождение соцреализма» (Сталин с музой). Интенсивное столкновение идеологического пафоса, неожиданной чувственности, классической композиции и тяжелого светотеневого освещения создает огромный психологический и концептуальный диссонанс.
Висцеральное/Экзистенциальное: Экспрессионистские, изломанные фигуры Эгона Шиле. Грубые, рваные линии, мрачные тона и изможденные выражения лиц вызывают дискомфорт, внутреннюю турбулентность и высокую психологическую стимуляцию.
Пространственное/Вибрирующее: «Березовая роща» Густава Климта. При натуралистичности, плотное, вибрирующее поле цвета, вертикальное повторение деревьев и отсутствие традиционной линии горизонта создают оптически интенсивную, поглощающую визуальную текстуру, заставляющую глаз быстро двигаться.
Головокружительное/Клаустрофобное: Ошеломляющая, искаженная перспектива с высокого подоконника, смотрящая вниз во двор, с напряженной, полулежащей мужской фигурой. Экстремальный ракурс, плотные тактильные текстуры и ощущение надвигающейся опасности вызывают немедленную, высоко-стимульную физиологическую реакцию.
Низкая Оригинальность (1) Изображения, представляющие минимальную оригинальность, содержат низкое визуальное трение, предсказуемую гармонию, эмоциональную нейтральность или идеализированные, успокаивающие нарративы:
Пасторальное/Традиционное: Классические, безмятежные пейзажи с пологими холмами, мягким открытым небом и удаленными элементами. Композиции с четкой, успокаивающей глубиной поля, приглушенными земляными тонами и статичной пасторальной жизнью (вроде пасущихся овец) снижают пульс и приглашают к пассивному сканированию.
Статичная портретная живопись: Конвенциональный, фронтальный портрет ребенка в овальной раме в народном или 19-вековом стиле. Симметрия, мягкий сепийный фон и нейтральное выражение не предлагают нарративного конфликта или формальных неожиданностей.
Идеализированная/Пропагандистская Сентиментальность: Отполированный советский пропагандистский плакат Сталина с ребенком на фоне красного флага. В отличие от подрывной иронии Комара и Меламида, это изображение опирается на полностью предсказуемую, неосложненную, сглаженную сентиментальность, яркие плоские цвета и ясное, послание, предназначенное успокаивать, а не шокировать или бросать вызов.
Статус калибровки: Оригинальность зафиксированa. Я полностью понимаю спектр. «Высокая Оригинальность » в этом наборе данных варьируется от интенсивной оптической текстуры и экзистенциальной тревоги до острой идеологической иронии и драматического пространственного напряжения. «Низкая Оригинальность » охватывает умиротворенные пейзажи, формальную симметрию и эмоционально неосложненные, гладкие нарративы.
**************************************************
Рис. 2 показывает примеры экстремальных значений по четырем оставшимся эстетическим размерностям. Прежде чем обсудить ее, сделаю небольшое замечание.
Когда я предъявлял образцы для калибровки по каждому эстетическому индикатору, мне эти примеры казались самоочевидными. Но во время презентации некоторых результатов в Принстоне в конце июля 2026 года вдруг обнаружилось, что некоторые люди так не считают. В частности, беспорядочные пятна граффити на рисунке 2 были восприняты как очень даже гармоничные, хотя я им присвоил минимальное значение по этой шкале. Я своего мнения не поменял, но пришлость лишь лишь развести руками и признать, что эстетика - дело очень тонкое. ИИ меня в этом мнении только укрепил: и его суждения оставлют порой желать много лучшего (см. примеры ниже).
В процессе калибровки Gemini допустила два типа ошибок, заслуживающих обсуждения. Первая — неверная атрибуция произведений. Он идентифицировал «Уродливую герцогиню» Квентина Массейса как «Сатурн, пожирающий своего сына» Гойи (!?); обозвал многофигурную работу Шульженко «Криком» Мунка и описал абстрактную работу Дюбюффе
:
как: Дистопический сюрреализм Здзислава Бексиньского представляет ужасающий, скелетный ландшафт монолитного здания, сформированного из разлагающихся, органических костных структур, полностью лишенного жизни, тепла или надежды.
Этот тип ответа выходит за рамки того, что обычно подразумевается под ИИ-«галлюцинацией»: он читается не как фактическая ошибка, а как фрагмент профессиональной искусствоведческой критики, примененный к неверному объекту — самоуверенный, стилистически связный и направленный на совершенно ложную цель. Поскольку ошибки этого типа в конечном итоге не исказили характеристику эстетических критериев, они были оставлены без исправления; попытки поправки породили бы длительные обмены извинениями и переформулировки без существенного изменения результата.
Рисунок 2. Примеры картин с максимальными (верхний ряд) и минимальными (нижний ряд) значениями по четырем эстетическим размерностям. Слева направо: Гармония (Альберс — граффити); Гедонизм (Чонтвари — Дикс); Релаксация (Моне — Сазерленд); Техническое мастерство (Энгр — Ларионов).
Второй тип ошибки был более существенным. По неясным причинам Gemini перепутала метки максимума и минимума (закодированные в именах файлов) и защищал свое неверное прочтение, конструируя обоснования постфактум. Ниже приводится описание работы Бриджет Райли,

которая была представлена как пример максимальной Релаксации (ошибочно принятой ИИ за минимальную): Острая/Фрагментированная геометрическая кинетика: высококонтрастная, угловатая, абстрактная композиция, заполненная острыми черными, белыми и красными пересекающимися линиями, зигзагами и зазубренными молниеподобными узорами. Композиция заставляет глаз стремительно метаться по холсту, генерируя острое оптическое и когнитивное напряжение.
На самом деле в работе нет ни красного, ни зигзагов, ни пересекающихся линий. Описание было, очевидно, сконструировано для поддержки ошибочной классификации, а не для анализа изображения. Это поведение напоминает известные истории, когда человек защищает любыми средствами заведомо нелепые утверждения, лишь бы не брать свои слова обратно (в самых тяжелых случаях защищаются не просто слова, но и дела, как проиходит сейчас с войной России в Украине). Этот неприятный эпизод иллюстрирует существенный риск: ИИ-система способна аргументировать как за тезис, так и за его отрицание с равной беглостью и видимым авторитетом. После исправления Gemini просто извинилась, как если бы ошибка была рутинной. Было ли исправленное понимание действительно усвоено, остается неясным, как обсуждается далее.
Несмотря на трудности (которые не наблюдались в той же степени у двух других систем) итоговая калибровкa Gemini, приведенная ниже в табличной форме, была признана адекватной для целей исследования (см. выше вполне внятные комментарии, данные Gemini по критерию Оригинальность). Конечно, и тут можно к чему-то придраться (например, что такое "Интенсивный ручной труд" при определении нижнего уровня Релаксации?), но в целом система более-менее верно оценила направление, по которому требуется давать оценку, Две другие ИИ-системы выдали нечто подобное. Иногда оценки очень широкие (экзистенциальный распад, структурное напряжение), иногда - очень зауженные (широкие морские горизонты). Конечно, при увеличении количества примеров критерии были бы, я думаю, более определенными.
Каждая ИИ-система произвела числовые оценки для всех 80 картин восьми художников, которые ранее были оценены респондентами. Общий вывод - корреляции с ценой картин стали несколько выше, чем были ранее, но все равно недостаточны для того, чтобы что-то предсказывать.
Интересно взглянуть, на каких работах разные "оценщики" (либо люди, либо ИИ) дают наиболее различающиеся оценки. С помощью специальной статистической процедуры были выделены четыре такие картины, в которых диссонансе между оценками максимален. Они показаны на рис. 3.
Калибровка эстетических параметров согласно Gemini

Рисунок 3. Картины с наиболее несхожими оценками (Таблица 3), по часовой стрелке от верхнего левого угла: Б. Ньюман, Черный огонь I. Э. Шиле, Снег. К. Фридрих, Горная вершина. Ж. Миро, Человеческая голова
Рассмотрим случай «Черного огня I» Ньюмана. Респонденты присвоили ему низкие баллы по всем шести эстетическим измерениям — с этим я согласен, я не вижу в этой работе ничего выдающегося (кроме исторически сложившегося факта, что Ньюмен стал "знаковой фигурой" американского искусства. Но это совсем не обязательно связано с эстетикой). Практика платить десятки миллионов долларов за работы такого рода - феномен, укорененный в институциональном престиже абстрактного экспрессионизма - давно вызывает мой скептицизм как симптом иррациональности арт-рынка. Gemini, напротив, присвоила ему общую оценку 7 и оценку Технического мастерства 8 — рейтинг, который трудно согласовать с формальными свойствами работы - что в ней технически сложного? Возможно, Gemini, как и профессиональный американский арт-критик, распознала знаменитое имя и решила, что надо немедленно давать высокие баллы, не глядя на саму работу. Очень печал;но, если так.
Для «Снега» Шиле, с другой стороны, оценки Gemini тесно согласованы с оценками респондентов, с чем я также согласен: работа относительно непримечательна по сравнению с наиболее совершенными картинами этого замечательного художника. Утверждение Meta, что «Снег» заслуживает оценки Гармонии и Релаксации 9 представляется столь же труднообоснуемым. Работа Фридриха, в целом, была очень высоко оценена Claude (с чем я согласен) и средне или низко Gemini. А картина Миро - высоко оценена Claude и низко или средне Meta (с чем я тоже согласен). Уже из этого простого примера видно, что мнения ИИ и "здравого чувства" простого зрителя или другого ИИ могут радикально различаться.
А на рис. 4, напротив, показаны работы, которые, в целом получили высоко согласованные оценки, по крайней мере от одной пары оценщиков. Например, картины Тернера и Дали были очень высоко или высоко оценены респондентами, Gemini и Meta,
в то время как работа Ньюмена очень низко оценена Claude и Meta. Можно сделать осторожный вывод, что когда достоинстав или недостатки работ очевидны, то все оценки становятся более согасованными. Но поскольку большинство работ находится в промежутожных зонах, рашождения бывают велики - точно как у людей.

Рисунок 4. Картины с наиболее схожими оценками, по часовой стрелке от верхнего левого: С. Дали, Весна некрофила; М. Эрнст, Падение ангела; Дж. М. У. Тернер, Современный Рим - Кампо Ваччино; Б. Ньюман, Без названия
Перейдем к прогнозированию цен, основанному исключительно на эстетических оценках, сгенерированных ИИ. Практическая мотивация проста: если эстетические суждения людей и затратны в сборе, и лишь слабо предсказывают цену, то ИИ-оценки — гораздо менее ресурсоемкие, хотя и столь же несовершенные — могут предложить жизнеспособную альтернативу.
Пять активно торгующxся художников были выбраны на сайте artprice.com, одном из крупнейших общедоступных хранилищ аукционных данных: Хуан Миро, Сальвадор Дали, Клод Моне, Энди Уорхол и Марк Шагал. Для каждого вручную была отобрана 31 работа по следующему принципу: 15 самых дорогих и 16 самых дешевых работ, доступных в базе данных. Цель состояла в максимизации контраста между группами, что облегчает выявление систематических различий. Для обеспечения сопоставимости цен выборка была ограничена картинами маслом, акриловые работы включались лишь в редких случаях. Основная гипотеза заключалась в том, что в рамках корпуса одного художника эстетические качества должны быть сильнее связаны с ценой, чем в объединенных кросс-художнических наборах данных. Каждая из трех ИИ-систем была откалибрована с использованием примеров экстремальных значений, описанных выше; оценки производились по тем же шести эстетическим измерениям. Аукционные цены были логарифмически преобразованы после корректировки на инфляцию,как это обычно делается для сглаживания огромных колебаний в ценах (Mandel 2018).
Корреляции между эстетическими оценками и ценой позволяют установить несколько закономерностей. Во-первых, корреляции существенно выше, чем наблюдавшиеся в более раннем анализе. Во-вторых, Claude дает наибольшее число высоких корреляций. В-третьих, самые высокие корреляции на уровне художников наблюдаются для Моне и, особенно, Уорхола, где оценки Claude для Эстетики и Оригинальности достигают 0.83 и 0.88 соответственно — очень сильное отклонение от почти нулевых значений, наблюдаемых ранее. В-четвертых, корреляции, вычисленные на объединенном наборе данных из всех 155 картин, слабее любых индивидуальных корреляций на уровне художников, что подтверждает точку зрения о том, что агрегирование работ разных художников без соответствующего контроля вносит существенное смещение. В-пятых, среди шести эстетических измерений Гедоническая ценность показывает наиболее устойчивую положительную связь с ценой по ИИ-системам и художникам, что позволяет предположить, что она может быть необходимым, хотя и не достаточным, детерминантом рыночной стоимости - правило, нарушаемoe только Gemini, чьи оценки остаются некоррелированными с ценой по всем измерениям.
Регрессионный анализ. Для каждого художника была построена регрессионная модель с использованием объединенных эстетических оценок Meta и Claude в качестве независимых переменных (всего 12 предикторов). Gemini была исключена из комбинированной модели, поскольку ее индивидуальные модели на уровне художников объясняли лишь 3–10% дисперсии цены, фактически производя шум, а не сигнал. Основной вывод: все пять моделей для отдельных художников объясняют существенную долю дисперсии цены, от 62.8% для Шагала до 85.2% для Уорхола. Это заметно более сильный результат, чем сообщавшийся в (Mandel 2018) и в других ранних исследованиях. Можно сделать несколько содержательных наблюдений из результатов моделирования.
Общее эстетическое впечатление (Эстетика) вносит относительно малый вклад в детерминацию в большинстве моделей, за заметным исключением Шагала (Claude, 49%). Специфические индикаторы, как правило, более информативны, что само по себе является интересным выводом.
Оценки Гармонии Claude и Meta преимущественно весьма противоречивы
Вклады Оригинальности Claude положительны для всех художников, что предполагает более стабильную и согласованную оценочную реакцию на это измерение.
Вклады Технического мастерства Claude положительны (кроме Шагала), a Meta более вариабельны.
Релаксация показывает нестабильную закономерность для обеих ИИ-систем,
Для Уорхола — наиболее предсказуемого художника в наборе данных — две ИИ-системы присваивают противоположные знаки нескольким вкладам (Эстетика, Оригинальность, Гедонизм), при относительно скромных вкладах Технического мастерства и Релаксации. Для Шагала — наименее предсказуемого — расхождение сравнительно велико по большинству измерений.
В совокупности эти результаты позволяют предположить, что каждая ИИ-система применяет собственную, мало похожую на другие, оценочную структуру, и что комбинация двух различных структур генерирует более полную характеристику эстетической вариации, связанной с ценой. Основной содержательный вывод состоит в том, что аукционные цены действительно связаны с эстетическими свойствами отдельных произведений, но связь сложна, варьируется между художниками и существенно зависит от того, какая ИИ-система предоставляет оценки. При этом, конечно, я не ставлю вопрос о том, какaя система "объективнее", ибо не могу на него ответить.
Разрыв в ценах и в эстетических характеристиках. Регрессия и корреляция - отнюдь не единственный способ получить представление о связи между какими-то перемeнными. Иногда бывает достаточно просто взглянуть на данные самым прямым образом. Так, таб. 1 показывает средние цены и соотношения оценок для подгрупп с наивысшей и наинизшей ценой по каждому художнику.
Наивысшие цены очень велики для всех пяти художников. Моне и Уорхол выделяются уровнями цен, которые в некоторых случаях на порядок выше, чем у трех других. Однако более информативным, чем абсолютные значения, является соотношение между самыми дорогими и самыми дешевыми работами. Для пяти наиболее экстремальных работ на каждом конце распределения эти дроби варьируются от 47 для Шагала до 1 641 (!) для Уорхола: самая дешевая картина маслом Уорхола была продана примерно за $22 000, а самая дорогая — примерно за $195 млн.
Если бы эстетическое качество строго определяло цену, следовало бы ожидать, что соотношение средних баллов для самых дорогих и наименее дорогих работ будут существенно больше 1 и приближаться по величине к ценовым пропорциям. Данные не подтверждают это ожидание. Для Уорхола оценки Gemini для пяти самых дорогих работ в среднем на 4% ниже (!), чем для самых дешевых (дробь 0.96; выделена желтым, как и другие дроби меньше единицы); оценки Meta всего на 11% выше; только Claude показывает существенный разрыв в 64%.
Таблица 1. Цены и отношения оценок для самых дорогих и самых дешевых работ
Вычисление аналогичных пропорций для каждого из пяти специфических эстетических измерений лишь усиливает неопределенность: многие соотношения падают ниже 1 — например, все дроби Meta по измерениям для Миро и Дали (кроме Оригинальности) и Оригинальности Gemini для всех пяти художников. На этом фоне устойчивая тенденция Claude присваивать более высокие баллы самым дорогим работам — особенно для Моне и Уорхола, где модели Claude на уровне художников работают лучше всего, — примечательна. Этот анализ подчеркивает важное структурное ограничение: большие наблюдаемые ценовые дифференциалы не отражаются пропорционально в разницах эстетических оценок, что поднимает вопрос о том, какие другие факторы объясняют разрыв (частично рассмотренный в 3.6 ниже).
Анализ на уровне художников. Рисунки 5–9 отображают три самые и три наименее дорогие работы каждого художника вместе с данными о названии, площади, общей цене и цене за квадратный сантиметр (удельная цена). Рассмотрение этих примеров дает качественное обоснование количественным выводам выше.

Рисунок 5. Хуан Миро, самые дорогие (верхний ряд) и самые дешевые работы
Для Миро качественный контраст между двумя группами довольно очевиден. Более дорогие работы — крупные, сразу узнаваемые как канонические образцы зрелого стиля Миро; менее дорогие работы значительно меньше по размеру и при первом рассмотрении не столь однозначно могут быть приписаны художнику. Как абсолютная цена, так и цена за единицу площади различаются колоссально: отношение наивысшей удельной цены к наименьшей составляет примерно 241, варьируясь от $14 за см² до $3 378.

Рисунок 6. Сальвадор Дали, самые дорогие (верхний ряд) и самые дешевые работы
Случай Дали иллюстрирует иную динамику. Исключительное техническое мастерство обеспечивает наивысшие удельные цены в наборе данных, достигая $34,616 за см² для «L'Àngelus». Даже самые дешевые работы демонстрируют удельные цены, превосходящие цены самых дорогих произведений Миро: миниатюрный «Portrait de Gala jeune» площадью всего 6 см² дает $5,040 за см². Как и в случае Миро, самые дорогие работы являются сразу узнаваемыми каноническими примерами, тогда как самые дешевые включают произведения, нетипичные для фирменной манеры художника — в частности, последняя работа в нижней группе, демонстрирующая очевидное влияние фигуративных искажений Пикассо, которые для Дали несвойственны.

Рисунок 7. Клод Моне, самые дорогие (верхний ряд) и самые дешевые работы
Ситуация с Моне менее однозначна. Самые дорогие работы каноничны и легко узнаваемы, однако в группу менее дорогих входят произведения, также характерные и мастерски выполненные — прежде всего «Anémones», которую нельзя отнести к периферийным. Таким образом, большие ценовые дифференциалы, наблюдаемые у Моне, не столь ярко «оправданы» качественными различиями, как ранее, хотя они тем не менее сохраняются.

Рисунок 8. Энди Уорхол, самые дорогие (верхний ряд) и самые дешевые работы
Цены Уорхола являются самыми экстремальными в наборе данных. «Shot Sage Blue Marilyn» входит в число двадцати самых дорогих картин, когда-либо проданных на аукционах. Все дорогие работы — иконические образы из фирменного периода поп-арта; самые дешевые — поздние, периферийные работы, не обладающие статусом канонических примеров. Этот качественный контраст согласуется с высокой детерминацией модели для Уорхола и с гипотезой о том, что иконичность — узнаваемость и культурный резонанс изображения — является значимым драйвером цены, даже если она не полностью охватывается шестью использованными здесь эстетическими измерениями.
Случай Шагала (рис. 9) отличается от всех предыдущих. Работы как из высокодоходной, так и из низкодоходной групп мгновенно узнаваемы: на протяжении продуктивной карьеры, охватившей почти 80 лет, он возвращался к одним и тем же мотивам — летающие влюбленные, букеты, деревенские сцены — в легко узнаваемом стиле. Эта стилистическая однородность согласуется с наименьшими ценовыми пропоциями, наблюдаемыми в данных (таб. 1) и с наихудшей аппроксимацией ИИ-модели (62.8% для Шагала против 85.2% для Уорхола). Более ранние работы, такие как «Moi et le Village», формально более своеобразны, чем его поздняя продукция; в остальном качественные различия между двумя группами существенно меньше, чем у других рассмотренных художников.
Из этого обзора вырисовывается некоторая закономерность: значимым (хотя и не единственным) предиктором того, получит ли работа высокую цену, по-видимому, является иконичность и узнаваемость изображения в сочетании с его типичностью для наиболее характерной манеры художника.

Рисунок 9. Марк Шагал, самые дорогие (верхний ряд) и самые дешевые работы
Эти свойства не фиксируются напрямую шестью эстетическими измерениями, но они связаны с ними, о чем свидетельствуют высокие значения детерминации моделей. Будь они полностью ортогональны эстетике, модели не имели бы предсказательной силы.
Внутри-ИИ и меж-ИИ согласованность. Корреляции между oбшим впечатлением (Эстетикой) и отдельными индикаторами, в принципе, должны быть высокими. Однако, в основном связи высокие, но, например, корреляции Meta для Оригинальности и Релаксации значительно варьируют по художникам — от 0.6 до нуля. Claude показывает сопоставимо высокую внутрисистемную согласованность для большинства индикаторов, но его корреляции Релаксации варьируют от 0.6 (Моне) до −0.4 (Дали и Уорхол). А корреляции Оригинальности у Gemini отрицательны для всех пяти художников, усиливая предположение о том, что калибровка Gemini для этой оси не была правильно сфокусирована.
Корреляции эстетических индикаторов, сделанные разными ИИ (например, оценки трех ИИ Релаксации для каждого художника), дают еще более яркую картину рассогласованности. Подавляющее большинство корреляций близкo к нулю для всех художников и измерений. Всего около 8% превышают 0.5. Закономерность аналогична той, что наблюдалась для человеческих эстетических суждений: независимые оценщики — будь то люди или ИИ — редко имеют одно и то же мнение насчет конкретной работы. Вывод - каждая система представляет собой, по сути, независимый источник эстетической информации. Эта независимость может частично объяснять, почему комбинированная модель двух ИИ превосходит любую систему в отдельности: предикторы достаточно разнообразны, чтобы охватить разные измерения релевантной для цены вариации в работах.
Основные выводы исследования можно суммировать следующим образом.
Практическая эффективность. Генерация оценок с помощью ИИ существенно менее ресурсоемка, чем сбор эквивалентных оценок у респондентов, что представляет значительное практическое преимущество для крупномасштабных исследований такого рода.
Требования к калибровке. Обучение ИИ-систем посредством демонстрации примеров является методологически нетривиальной процедурой. Последующие исследования должны рассмотреть предоставление большего и более систематически варьируемого набора примеров (anchor examples) на обоих экстремумах каждой эстетической шкалы.
Защита ИИ собственной ошибки (confabulation). Когда ИИ совершает ошибку — такую как инверсия полярности эстетического критерия — он может генерировать внутренне согласованные, но фактически неверные обоснования своей позиции, а не признавать ошибку. Эпизод, задокументированный здесь, в котором Gemini описала работу, предназначенную как пример максимальной Релаксации, в терминах, прямо противоположных ее фактическим визуальным свойствам, иллюстрирует тенденцию защищать предшествующее обязательство через рационализацию постфактум. Это поведение имеет аналог в свойствах человеческого поведения и вызывает законные опасения относительно надежности ответов ИИ в областях, где истина неоднозначна или трудно верифицируема.
Неэффективность объединенных выборок (pooled data). Когда эстетические оценки ИИ применяются к объединенному набору данных, охватывающему несколько художников с малым числом работ на художника, результаты в целом сопоставимы с полученными от респондентов: корреляции с ценой несколько сильнее, чем у людей, но остаются низкими. Структура корреляций между общим эстетическим впечатлением и специфическими измерениями также в целом аналогична закономерностям у респондентов. Однако существуют множество отдельныx картинx, для которых оценки ИИ и людей существенно расходятся — феномен, заслуживающий независимого исследования.
Модели для отдельных художников. Наиболее существенный вывод исследования состоит в том, что ИИ-генерируемые эстетические оценки, используемые в качестве предикторов в регрессионных моделях для отдельных художников, объясняют от 63% до 85% дисперсии цены. Этот результат получен путем комбинации оценок Meta и Claude, а не какой-либо ИИ-системы в отдельности. Столь сильных связей между ценой и эстетическими мерами не наблюдалось ранее в других исследованиях.
Интерпретационные ограничения. Несмотря на высокие уровни детерминации моделей, структура вкладов регрессии не допускает прямой причинной интерпретации. Ни отдельные ИИ-системы, ни отдельные художники не демонстрируют стабильных и согласованных закономерностей в поведении вкладов. Следует также отметить, что аукционные цены на работы высокого уровня, рассматриваемого здесь, отражают эстетические предпочтения не широкой публики, а малого и весьма нетипичного сегмента покупателей — очень богатых индивидуумов. Связь между эстетическими предпочтениями различных сегментов населения и ценами арт-рынка обсуждается в (Mandel 2018).
Разрывы в ценах и баллах. Сравнение ИИ-эстетических оценок для самых дорогих и самых дешевых работ подтверждает ожидаемую направленную связь — более высокие баллы обычно присваиваются более дорогим работам, но количественный разрыв между дифференциалами оценок и цен очень велик. Для Уорхола средние цены двуx групп различаются примерно в 1,600 раз, тогда как средние эстетические оценки различаются лишь на 11%, а для некоторых ИИ-систем и индикаторов связь даже обратная (Таблица 1). Такое расхождение подчеркивает пределы эстетическоой оценки (ИИ или людьми) как достаточного объяснения формирования цены - скорее всего, эффект связан с линейностью эстетичских оценок и резко выраженноым гиперболическим (степенным) законом распределения аукционных цен.
Внутри-ИИ согласованность. То, как каждая ИИ-система агрегирует специфические эстетические измерения в общее впечатление (то есть как Эстетика связана с другими индикаторами), варьируется между художниками и не является полностью согласованным внутри какой-либо ИИ-системы: наряду с ожидаемыми положительными корреляциями есть немало примеров нулевых или отрицательных значений. Эти несоответствия предполагают, что эстетическое суждение ИИ не следует фиксированному и прозрачному правилу агрегации, аналогично хорошо документированной непоследовательности человеческих эстетических предпочтений.
Меж-ИИ несогласвоанность и ее следствия. Три ИИ-системы показывают очень низкое взаимное согласие по всем эстетическим измерениям и всем художникам. Этот вывод имеет более широкое последствие: в областях, где оценочные критерии формально не определены — таких как эстетика — ИИ-системы могут быть не более авторитетны, чем любой другой индивидуальный оценочный агент. По мере того как ИИ-ландшафт продолжает фрагментироваться по специализированным приложениям, ботам, персонализированным ассистентам и бизнес-специфичным версиям, дивергенция между системами, вероятно, станет более, а не менее выраженной. Практическое следствие состоит в том, что утверждения вида «ИИ оценивает X как Y» не несут большей внутренней авторитетности, чем мнение любого индивидуального критика, и должны интерпретироваться соответственно. Это, возможно, наиболее существенный методологический урок исследования.
Потенциал ансамблевого ИИ-оценивания. Несмотря на выявленные выше ограничения, комбинация множественных ИИ-генерируемых эстетических оценок демонстрирует значимую предсказательную силу в отношении аукционных цен, объективно определяемого внешнего критерия. Этот результат заслуживает дальнейшего исследования как с точки зрения его теоретических основ, так и практического применения: надежные прогностические модели цен арт-рынка имеют значимость для коллекционеров, институций и рыночных аналитиков.
Благодарности. Автор благодарен д-ру Ивану Шамшурину, обратившему его внимание на возможность использования ИИ для численной оценки картин на основе более ранней совместной работы (Mandel et al., 2021), и д-ру Михаилу Эпштейну, который независимо и почти одновременно поделился с ним результатами своего исследования по оценке качества текстов с помощью ИИ (Epstein, 2025). Оба импульса послужили триггером для настоящего исследования. Благодарность также выражается слушателям моей презентации в Принстоне 27 июня 2026 г., чьи комментарии и предложения способствовали уточнению некоторых положений данной статьи.
Литература
Epstein, M. The Index of the Interesting: A Formal Method for Evaluating Textual Quality. Zenodo (2025), https://philarchive.org/
Kang,C., Valenziseé, G., and Dufaux, F. EVA: An Explainable Visual Aesthetics Dataset (2020)
Mandel, I. Aesthetic, Art-Historical and Economic Values in Painting: Empirical Study
(2018) https://papers.ssrn.com/sol3/papers.cfm?abstract_id=3160419
Mandel, I. Monetized creativity: empirical study of art prices and Aesthetic values. In:
Integrative Exploration of the Creative Mind, Cambridge Scholars Publishing, 2019, 265-311
Mandel, I., Mastandrea,S., Rachenkov, K., and Shamshurin, I. Beauty or money? Statistical analysis. (2021) Model Assisted Statistics and Applications 16 151–162
Mandel, I. Predicting Art Market Prices with AI-Based Aesthetic Evaluation (2026). https://papers.ssrn.com/sol3/papers.cfm?abstract_id=7055340
Marković, S., and Radonjić, A. Implicit and explicit features of paintings. (2008); Spatial Vision, 21(3-5), 229-59

