Pragmatic Terminal

Как исследование превратилось в комикс

Когда я начинал этот эксперимент, я планировал сделать небольшой комикс из восьми сцен. Довольно простой: человек в офисе, компьютеры, графики, схемы, несколько диалогов. Никакой сложной архитектуры, никаких больших панорам. Мне казалось, этого будет достаточно.

Не хватило. Получилось скучно до скрежета зубов. И тогда я понял: если уж делать эксперимент, нет смысла специально упрощать историю до состояния, когда мне самому неинтересно на неё смотреть.

Так появился другой вариант — прагматичный нуар, промышленная архитектура, ретро-футуристические элементы и гораздо больше пространства для визуального повествования. Вместо восьми сцен получилось восемнадцать. И это, пожалуй, самое интересное, что произошло с этим экспериментом.

Я думал, что буду генерировать картинки. На самом деле пришлось заниматься постановкой.

Нейросеть сегодня сама по себе легко создаёт красивый кадр. Гораздо сложнее заставить несколько кадров работать как одну историю. Она любит очевидные решения: неон, симметрию, футуристические здания, слишком много деталей, эффектный свет. Всё это может выглядеть впечатляюще. Но если дать модели слишком много свободы, довольно быстро получается не история, а набор красивых картинок.

Поэтому мне пришлось постепенно выстраивать собственные ограничения: не киберпанк, не глянцевый футуризм, не огромные симметричные здания. Вместо этого — промышленная архитектура, металл, старые конструкции, неровный свет. Меньше декоративности, больше фактуры.

История осталась прежней

Я взял за основу свой текст из поста «Pragmatic Terminal» — исследование о том, почему я пока отложил идею искать, где именно бизнес теряет деньги. Мне хотелось проверить простую вещь: можно ли из текста, который не был написан как сценарий, сделать самостоятельную визуальную историю. Не иллюстрировать отдельные абзацы, а рассказать ту же мысль другим способом.

И тут неожиданно ключевым оказался ритм, то, что я сначала считал просто технической задачей. Если герой должен идти, это один кадр. Если он остановился, нужен другой. Если вокруг него появляется пространство, камера должна отойти. Если происходит что-то важное, наоборот, нужно приблизиться. Постепенно я начал мыслить не абзацами, а сценами и логичными переходами между ними. Где читатель должен задержаться? Где быстро проскочить? Где оставить пустоту? Где нужен общий план? Где достаточно детали?

Вертикальный формат оказался здесь очень кстати. Я мог строить историю сверху вниз, буквально управляя расстоянием между сценами. Пустое пространство стало частью повествования.

Как я разговаривал с нейросетью

Для работы я использовал бесплатные нейросети на смартфоне. Одну для подготовки описаний будущих кадров, другую непосредственно для генерации изображений.

Сначала я попытался поручить текстовой модели написать саму историю, реплики и сцены. Не получилось. Точнее, технически получилось, но результат мне не понравился: слишком гладкий, предсказуемый, банальный. Возможно, с точки зрения самой нейросети он был даже лучше моего первоначального текста, но это не имело значения — мне он не нравился.

Поэтому я оставил текстовую модель в другой роли: она стала инструментом для подготовки промтов. И вот здесь результат оказался неожиданно хорошим. Поставил бы ей 9 из 10. Один балл снимаю за то, что небольшие правки всё-таки приходилось делать вручную. Повторяемость сцен оказалась достаточно высокой: я генерировал несколько вариантов (чаще всего три), выбирал лучший и переходил к следующей сцене. Были сцены, которые не получались, но иногда проблема была даже не в нейросети — я сам не мог нормально сформулировать, что именно хочу увидеть. И это оказалось полезным наблюдением: иногда проблема не в том, что AI «не понимает задачу», а в том, что человек сам ещё не понял, какую задачу ставит.

С генерацией картинок оказалось проще, чем я думал. В большинстве случаев хватало одного подготовленного описания, без длинной серии дополнительных инструкций. Это особенно интересно в сравнении с моим первым экспериментом, когда я пытался контролировать буквально всё и только усложнял результат. Теперь я задавал настроение, композицию, несколько ключевых объектов и технические ограничения. А детали оставлял модели. Именно это, похоже, и сработало лучше — не лезть в каждую мелочь.

Что я сознательно оставил «ручным»

Текст (баблы и реплики) я не стал генерировать вместе с изображениями. Не потому, что уверен, что модель с этим не справилась бы, я просто этого не проверял. Мне понравился сам процесс создания сцен, и не хотелось рисковать хорошим изображением ради эксперимента с типографикой. Кроме того, с самого начала я решил, что хочу собрать комикс вручную, поэтому текст появится уже на этапе склейки отдельных сцен в единую вертикальную ленту. Это тоже часть эксперимента: AI создаёт отдельные элементы, а человек собирает из них произведение.

В одной из сцен я использовал фотографию, которую сам когда-то сделал для блога, обычную чашку кофе. Она неожиданно очень хорошо подошла к атмосфере сцены. Я немного изменил освещение, чтобы фотография не выпадала из общего визуального ряда, и оставил её. Мне понравилась сама идея такого смешения: не всё в работе обязательно должно быть сгенерировано нейросетью. Если реальная фотография подходит лучше, почему бы её не использовать?

А ещё я специально оставил немного ручной работы. Для небольших правок я использовал Jump, но не потому, что без него сцена была бы непригодна. Скорее наоборот: некоторые изображения мне настолько понравились, что захотелось самому немного вмешаться в них, добавить небольшую деталь, что-то изменить, оставить пасхалку. В какой-то момент я понял, что мне вообще нравится эта часть процесса. Это важно: я не хотел, чтобы AI сделал всё за меня. Мне не нужна была кнопка «Создать комикс». Мне было интересно самому собрать его из разных частей.

Где теперь проходит граница?

Первоначально я ставил довольно техническую задачу: можно ли с помощью AI создать последовательный вертикальный комикс? Теперь вопрос стал немного другим: где проходит граница между генерацией и авторской работой?

Нейросеть может создать сцену. Но не она решила, что история должна состоять из восемнадцати сцен, а не восьми. Не она сменила офис на промышленную архитектуру. Не она написала окончательный текст. Не она выбрала, какой из трёх вариантов оставить. Не она добавила фотографию с чашкой. И не она решила, где оставить пустое пространство между сценами.

Получается странная конструкция: AI сделал значительную часть визуальной работы, но чем больше я с ним работал, тем меньше этот процесс напоминал автоматическую генерацию и тем больше — обычную работу режиссёра, редактора и монтажёра. Только часть инструментов теперь находится внутри нейросети.

Что получилось в итоге

Комикс сейчас практически готов: осталось собрать финальную ленту и сделать титры. Вместо первоначальных восьми сцен — восемнадцать. И, неожиданно для меня самого, простой текст превратился в историю, которую мне действительно интересно смотреть.

В начале эксперимента я вообще сомневался, что из моего поста от 11.08.2026 получится сделать что-то не банальное. Сейчас у меня уже есть несколько идей, которые хочется попробовать в следующем комиксе. Возможно, он будет совсем другим: длиннее, более продуманным, с большим количеством сцен. И, скорее всего, с теми же принципами: меньше автоматизации ради автоматизации, больше осознанных ограничений и ручных решений.

Пока я не знаю, станет ли этот формат частью проекта. Но теперь я точно знаю одну вещь: AI действительно может быть инструментом создания последовательного визуального повествования. По крайней мере, в моём случае этот эксперимент дошёл до результата.

Теперь осталось проверить самое интересное: захочет ли кто-нибудь это читать?