Showing posts with label automatic. Show all posts
Showing posts with label automatic. Show all posts

Friday, 2 January 2026

GenAI і розумна докачка.


Всім привіт.

От чого не вистачає в багатьох безкоштовних інструментах GenAI ? 

Розумної докачки великих файлів, особливо моделей.

Розробники вважають що інтернет завжди стабільний, а файл моделі іноді не докачується, потім на диску лежить недокачаний файл, а сам GenAI-інструмент не знає як з цим бути.

Це класична помилка "Happy Path" (шляху щасливчика) у розробці - коли програміст пише код, розраховуючи, що мережа ідеальна, диск не переповниться, а світло не вимкнуть. Звісно коли ми користуємся безкоштовним ПЗ то всі претензії зайві, хоча побажання завжди можно залишити на github.

Для великих файлів (LLM моделі, ваги нейромереж .gguf, .bin, які важать гігабайти) простої докачки замало. Є ще одна величезна проблема - "биті" файли.

Файл може скачатися повністю (розмір зійдеться байт-у-байт), але всередині буде "сміття" через помилку мережі. Інструмент спробує завантажити таку модель і впаде з незрозумілою помилкою.

Ось "золотий стандарт" для завантажувача моделей, який вирішує проблему "недокачаного або битого файлу". Тому додаємо перевірку SHA256 хешу.

Цей код робить три речі (для Python 3.10+):

  • Перевіряє, чи файл вже є. Якщо він є і розмір збігається — перевіряє його цілісність (хеш).
  • Докачує, якщо файл неповний.
  • Видаляє файл, якщо після скачування хеш не зійшовся (щоб ви не зберігали сміття).

Python

import urllib.request

import urllib.error

import sys

import os

import hashlib

Friday, 21 November 2025

Про Sage Attention.


Всім привіт.

Якось ввечері надивившись відео про SageAttention я вирішив спробувати це чудо інженерної думки в себе на сервері GenAI. Звісно повівся я на те що всі запевняли що інсталювати його не проблема, натомість буду мати вигоду по швидкості генерації в ComfyUI до 30%.

Зважаючи на те що в Stability Matrix в якості бекенду використовується саме ComfyUI (там він зветься як Inference), то чому б не задіяти ШТАТНУ функцію з меню.


Тим більше що автор ось цього відео запевняв глядача що це самий ПРОСТИЙ спосіб отримати SageAttention.


Та не так сталося як гадалося!) 

Я витратив годину на те щоб зрозуміти що Matrix це чорна скриня і будь які намагання зовні зробити йому апгрейд будуть проігноровані, і ще три години на те щоб полагодити ComfyUI, який там знаходиться в пакетах і який я так легко поламав намагаючсь додати SageAttention...

Мабуть у автора відео Matrix інший, хоча він також вибирав портабельну установку.

Зрозуміло, що це не просто проблема установки - Matrix у своєму портативному середовищі просто не дозволяє збирати сучасні C++/CUDA пакети на зразок SageAttention. Тобто сенс був спробувати зробити все "з Matrix", але через старі версії setuptools/distutils та обмеження venv це просто не спрацює.

То ж маю кілька висновків:

  • Matrix обмежений у підтримці нових пакетів, які потребують компіляції.
  • SageAttention вимагає збірки з torch, і навіть всі обхідні способи які він сам і пропонує (--no-build-isolation, editable, копіювання Node) не працюють у тому venv.

Для роботи безпосередньо в Matrix можна:

  • чекати, поки SageAttention зроблять prebuilt для Windows + Python 3.10 у портативному вигляді;
  • або шукати альтернативний Node/Attention, який не потребує збірки (чистий Python).

Тобто, на жаль, сенс “зробити все всередині Matrix” для цієї версії SageAttention тут обмежений технічно. 

Все, Matrix більше не чіпаємо!

Але маємо ще декілька гарних варіантів щодо встановлення SageAttention в окремий, все ще портабельний ComfyUI. До речі, вони також згадані в тому відео.

Перший це файлік SageAttention-NEXT.bat з ComfyUI-Easy-Install. Не обов'язково виконувати сам ComfyUI-Easy-Install, просто пирніть глибше в архів папка Add-ons, він там.

Тобто кладете цей файл в свій  ComfyUI в підпапку /Add-ons і звідти його виконуєте.

Friday, 24 October 2025

Промпт-інжиніринг з Pixel AI Studio.

Привіт привіт.

Існує одна з ключових технік у просунутому промпт-інжинірингу щодо Google Gemini.

Однак, спосіб, у який це робиться, сильно залежить від конкретної моделі ШІ. У деяких системах, як-от Stable Diffusion (через GUI типу Automatic1111), існують спеціальні синтаксиси, наприклад, дужки () для збільшення ваги та квадратні дужки [] для її зменшення, або навіть числові коефіцієнти (token:1.5).

У Pixel AI Studio, яке працює на моделях Google Gemini, немає такого жорсткого синтаксису з дужками та цифрами. Gemini краще реагує на природну мову та структуру речення. Проте, ви можете дуже ефективно керувати "вагою" або "увагою" моделі до певних токенів, використовуючи наступні методи:

Найефективніші способи "підняти вагу" токена в Gemini:

1. Позиціонування та Повторення (Найпотужніший метод)

Слова на початку промпту мають значно більший вплив на кінцевий результат, ніж слова в кінці. Якщо ви хочете, щоб модель зосередилася на чомусь, поставте це на перше місце. Повторення ключового слова або фрази також сильно підсилює її значення.

Приклад:

Ви хочете отримати зображення велетенського червоного дракона, що летить над замком, але модель постійно малює замок більшим за дракона.

Слабкий промпт: A castle on a mountain with a red dragon flying around it.

(Тут "замок" стоїть першим, тому модель може надати йому пріоритет).

Сильний промпт: A giant, majestic red dragon. The massive red dragon is the main subject. It is flying high above a tiny castle in the background. Photorealistic, cinematic lighting.

(Тут ми тричі наголосили на "червоному драконі", поставили його на перше місце і навіть прямо вказали, що він є "головним об'єктом", а замок — "крихітний" і "на задньому плані").

Thursday, 11 September 2025

EbSynth online.

Привіт привіт. 

Мій читачу, вам давно відомий EbSynth - це інструмент для творчої обробки відео, який працює за принципом ключових кадрів. Користувач бере відео, вибирає один чи кілька кадрів, редагує їх у будь-якому графічному редакторі (наприклад, додає малювання, змінює кольори чи стилізує під певний художній стиль), а програма автоматично переносить ці зміни на всі інші кадри відео. Для цього застосовуються алгоритми аналізу руху (оптичний потік) та синтезу текстур, завдяки чому правка одного кадру може плавно розповсюдитися на весь ролик. Такий підхід дозволяє створювати ефекти “намальованого вручну” відео, колоризувати чорно-білий матеріал, робити швидку ретуш об’єктів чи додавати художні стилізації.

Спочатку EbSynth існував як безкоштовна офлайн-програма для Windows і macOS, створена студією Secret Weapons. У класичному варіанті робочий процес виглядав так: відео спершу треба було вручну розбити на кадри (наприклад, через FFmpeg), потім вибрати з цієї послідовності ключові кадри, відредагувати їх у Photoshop чи Krita, після чого у самому EbSynth вказати шлях до оригінальних кадрів, шлях до відредагованих і шлях для збереження результату. Програма виконувала обробку локально, використовуючи ресурси комп’ютера, і видавала результат у вигляді нової послідовності кадрів. Для отримання фінального відео ці кадри потрібно було знову зібрати у ролик окремою командою через FFmpeg або у відеоредакторі. Якщо з’являлися артефакти, доводилося додавати нові ключові кадри й повторювати процес.


Я сам їм пару раз користувався коли допилював відео з під Automatic1111-a.

Але ось з’явилася оновлена онлайн-версія EbSynth, доступна через сайт ebsynth.com. Вона працює як хмарний сервіс: користувач одразу завантажує цілий відеофайл, а не послідовність кадрів, і не потребує потужного ПК, оскільки обробка виконується на серверних GPU. Сайт сам пропонує кілька ключових кадрів для редагування, які можна підтвердити або замінити. Відредаговані кадри завантажуються назад, і система автоматично запускає обробку. Результат можна завантажити у вигляді MP4-відео чи PNG-послідовності (залежно від тарифного плану). Якщо в певних місцях результат вийшов з артефактами, у веб-інтерфейсі легко додати ще один ключовий кадр і перерахувати відео.

Таким чином, офлайн-версія дає більше контролю, але вимагає ручних операцій з кадрами й налаштувань, тоді як онлайн-версія максимально автоматизує процес і робить його простим для користувача, проте працює за моделлю підписки з певними обмеженнями у безкоштовному варіанті. Обидві версії реалізують одну й ту саму ідею - редагування ключових кадрів з автоматичним перенесенням змін на весь відеоролик.

Наприклад, якщо потрібно взяти 20-секундний ролик і зробити його схожим на акварельний малюнок, то в офлайн-версії доведеться вручну розбити відео на сотні PNG-кадрів, відкрити потрібний кадр у графічному редакторі, додати стилізацію, а потім через EbSynth і FFmpeg зібрати результат назад у відео. Онлайн-версія спрощує цей процес: достатньо завантажити відео прямо на сайт, система сама вибере ключові кадри, користувач редагує один із них, завантажує назад і отримує готовий оброблений ролик у форматі MP4 без зайвих технічних дій.

В онлайн версії є free план з деякими технічними обмеженнями. Не без цього), інакше навіщо той онлайн.

Щасти вам.


Tuesday, 17 June 2025

Dynamic Prompts и шаблоны Jinja2.

Всем привет.

Вы заметили что в расширении «Dynamic Prompts» есть интересное подменю «Jinja2 templates»?

Jinja2 - это движок шаблонов, который позволяет использовать синтаксис в стиле Python в шаблонах. Эта возможность особенно полезна для подсказок Stable Diffusion, поскольку она позволяет создавать один запрос, который генерирует несколько запросов, генерировать рандомизированные элементы внутри запросов, итерировать по элементам, использовать подстановочные знаки и многое другое. Jinja2 может эмулировать результаты, для получения которых обычно требуются сложные скрипты Python.

Чтобы включить шаблоны Jinja2:

1. Установите Dynamic Prompts через браузер расширений.

2. Перезапустите Web UI.

3. Прокрутите вниз до скриптов и разверните аккордеон dynamic prompt.

4. Разверните аккордеон Jinja2 и включите его.


Jinja2 предлагает различные структуры управления, включая циклы и условные операторы, а также фильтры, тесты и макросы, которые позволяют создавать мощные и гибкие шаблоны. Хотя эти функции на первый взгляд могут показаться сложными, их возможности впечатляют.

Операторы Jinja2 начинаются с {% и заканчиваются %} , выражения заключены в {{ }} , а комментарии содержатся в {# #} .

В Stable Diffusion (Automatic1111 или Forge) подсказки определяются с помощью тегов {% prompt %} и {% endprompt %}. Операторы и выражения внутри этих тегов не обязательно должны быть на отдельных строках, но разделены для лучшей читаемости. Эти программные подсказки могут быть длиннее традиционных подсказок, поскольку сгенерированные результаты, как правило, короче.

Friday, 17 January 2025

Безнодовый ComfyUI.

Привет на привет.

В сети много жалоб что интерфейс ComfyUI сложен для понимания, эти паутины, ноды,  и т.п. Согласен, порог вхождения в GenAI через ComfyUI высокий. Но с помощью youtube все возможно, более того - так сложилось у меня лично что знакомство с GenAI я начинал именно с ComfyUI.))

это потом уже были Automatic1111 с Fooocus-м. Но сейчас уже многим очевидно что за ComfyUI будущее, и гуру от GenAI начинают медленно (чтобы подписота не разбежалась), но уверенно переводить своих прихожан на религию ComfyUI. ComfyUI можно ругать за сложность и не очевидность(весьма спорно!) некоторых моментов, но с помощью этого генератора можно сделать буквально ВСЕ. Более того, в процесс генерации можно сохранить (картинка или файл json) буквально ВСЕ параметры workflow для будуших генераций в отличие от Automatic1111 или Forge.

Кроме того сегодня ComfyUI работает в качестве бекенда в Stability Matrix, SimpleSDXL и SwarmUI. этo те случаи когда разработчики прячут GUI ComfyUI от пользователя чтобы не травмировать его психику. 

Tuesday, 27 August 2024

Оптимизация ComfyUI.

Всем привет.

Предлагаемая идея полностью заимствована с ИИ-практикума сайта 3DNews.ru.

Все чаще меня удручает тот факт, что имеющаяся в моем распоряжении видавшая виды GTX 1080 чудовищно медленно обрабатывает workflow с SD3M/SDXL/Flux моделями - генерация картинки идёт со скоростью до 30 секунд на каждую итерацию, и, если учесть, что параметр «Steps» в пробном workflow установлен в значение «22», времени уходит неоправданно много.

Поэтому проведём небольшую оптимизацию ComfyUI - воспользуемся Python-модулем venv (virtual environments, очень полезная вещь между прочим), призванным, в частности, ускорять работу генеративных ИИ-моделей. В комплект поставки портативной версии ComfyUI он не входит, однако есть множество способов его установки, которые в итоге сводятся к развёртыванию полноценного окружения Python на локальном ПК - и активации необходимого модуля уже из этого окружения.

Среди истинных фанатов генеративного ИИ давно водится за правило иметь у себя несколько популярных генераторов как то AUTOMATIC1111, Forge, Fooocus и ComfyUI.

В этом случае для нас всё значительно проще: модуль venv уже развёрнут в AUTOMATIC1111, и всё, что требуется сделать для активации его при запуске рабочей среды ComfyUI, - это должным образом произвести его вызов. 

Скопируем наш run_nvidia_gpu.bat в новый, с именем, допустим, run_with_venv.bat. Исходный файл запуска весьма лаконичен — он просто вызывает портативно развёрнутую копию Python с параметром --windows-standalone-build:

.\python_embeded\python.exe -s ComfyUI\main.py --windows-standalone-build

pause

Friday, 19 July 2024

GenAI и забытое старое.


Всем привет. 

Поведаю я вам сегодня про новое, которое напомнило мне (не)забытое старое.

Как частично анимировать изображение? Фанаты ИИ используют рабочий процесс в Stable Diffusion для создания частично анимированного AI-изображения в AUTOMATIC1111 с помощью animateDiff и inpainting. Вот как здесь.

Ветераны используют Nature Illusion Studio - очень удобный и простой в использовании инструмент для создания анимированных изображений. Возможности программы: оживление водных пейзажей: водопадов, озер, рек и т.п., редактор позволяет применить до 4-х водных эффектов на одном изображении, добавление спецэффектов шума воды, эффекты атмосферных осадков: снег, дождь, создание анимированных изображений из ваших собственных фотографий, установка изображений в качестве обоев для рабочего стола, создание хранителей экрана из коллекции ваших анимированных изображений, доступ к огромной, еженедельно обновляемой бесплатной галерее водных пейзажей. Cо своей фантазией также легко в программе оживают дым и огонь.

А как заставить известный персонаж заговорить твоим голосом? Фанаты ИИ используют расширение SadTalker.

SadTalker - делает LipSync в видео и оживляет изображения при помощи нейросети⁠. SadTalker - нейросеть от китайских разработчиков, изначально предназначенная для анимации лиц на различных изображениях - от артов до фотографий. SadTalker VideoLip - это форк SadTalker, предназначенный для синхронизации движения губ на видео с аудиодорожкой.

Уверен, что такие говорящие головы в youtube вы выдели часто.) Да, и это тоже было, а может и сейчас живет. 

Tuesday, 9 July 2024

Еще раз про Stability Matrix.


Всем привет.

Я сделал над собой уcилие и установил Stability Matrix.) Не то чтобы он(она) мне сильно нужен, но уж больно его хвалят на форумах. Ниже репост про Stability Matrix с Дзен.ру, где более менее многое справедливо и по сей день. Мои выводы в самом конце.

Я хочу рассказать вам об очередном универсальном решении - оболочке Stability Matrix. Она поможет вам установить большинство популярных нейросетей на ваш компьютер, так же с её помощью вы сможете легко управлять всеми ресурсами необходимыми для работы нейросетей. (модели, лоры, апскейлеры и т.д .)

Скачать и установить её можно по ссылке. Установка очень проста и не требует сложных манипуляций.


Вам нужно будет скачать архив, затем распаковать его и запустить исполняемый файл (exe) для установки. В процессе установки можно указать свой путь, по которому вы хотите установить программу, и дождаться завершения процесса. 


При установке программы вы можете выбрать полную версию или портативную. После завершения установки запустится интерфейс программы, который сразу предложит вам установить одну или несколько нейронных сетей.

* Так как я уже имею несколько генераторов портативок, то и для Matrix выбираю тоже портативную установку.


Но вы можете пропустить установку и сначала ознакомиться с интерфейсом, настроить его под себя. Для этого нажмите «Skip first time setup».

Если вам нужен интерфейс на русском языке, перейдите в настройки. Для этого нажмите на значок шестерёнки в левом нижнем углу экрана. В разделе «Language» выберите русский язык, после чего программа попросит перезапустить интерфейс.

* Не рекомендую - кто его знает как делали ту русскую локализацию, после будете постоянно сверять имена пунктов меню.

Описывать все пункты настроек не вижу смысла, так как они интуитивно понятны а вот остальные пункты давайте рассмотрим.

Monday, 1 July 2024

Automatic1111 и styles.csv

Всем привет.

Полезная фишка в A1111 это файл стилей styles.csv. У кого он больше у кого меньше, а кто подсуетился и поправил свой.

Но вовсе не обязательно править исходный файл стилей, или каждый раз менять их местами, можно сделать библиотеку стилей в A1111.

Делаем так:

1) создаем в папке A1111 папку styles

2) забрасываем туда хоть дюжину разных файлов со стилями, т.е. свой файл стилей лучше создать отдельно и в дальнейшем править только его, а не чужие.

3) к COMMANDLINE_ARGS добавляем ключ --styles-file="styles\*.csv"

Готово. 


Теперь при запуске Автоматик просто подтянет все файлы стилей и выведет одним списком alphabetically по имени файлов из папки styles. Также по имени файла блоки стилей будут чередоваться в выпадающем списке Styles Автоматика. Теперь можно менять, добавлять или удалять файлы по своему вкусу и потребностям в любое время.

Удачи.


Sunday, 23 June 2024

Automatic1111 для себя как для других.


Всем привет.

Вы уже в курсе что достаточно  иметь одну копию Automatic1111 чтобы использовать модели в другой копии Automatic1111-а или Forge. Конечно, конечно, мы же используем символические ссылки.)

А вот и нет, я имею ввиду только штатные возможности ИИ-генераторов.

Как? В sd-webui.bat второй копии Automatic1111 добавляем вызовы ключей:

set A1111_HOME=D:/A1111

set VENV_DIR=%A1111_HOME%/venv

set COMMANDLINE_ARGS=%COMMANDLINE_ARGS% ^

--ckpt-dir %A1111_HOME%/models/Stable-diffusion ^

--hypernetwork-dir %A1111_HOME%/models/hypernetworks ^

--embeddings-dir %A1111_HOME%/embeddings ^

--lora-dir %A1111_HOME%/models/Lora

где D:/A1111 папка первой копии вашего Automatic1111-а.


Более того, для Forge блок выше можно сократить до одного(!) хитрого ключика:

set A1111_HOME=D:/A1111

set COMMANDLINE_ARGS=%COMMANDLINE_ARGS% ^

--forge-ref-a1111-home %A1111_HOME%


Для ComfyUI, как и раньше, используем файлик extra_models_pack.yaml.

А вот с Fooocus-ом чуть сложнее, его автор время от времени меняет фокусировку настроек между файлами. Ранее то было в одном файле config.txt, a в последних версиях все перешло в пресеты (папка presets).

Удачи вам.


Sunday, 16 June 2024

Run Stable Diffusion on AWS.

Hi all.

This is retype post from  Andrew "How to run Stable Diffusion on AWS".

Running Stable Diffusion in the cloud (AWS) has many advantages. You rent the hardware on-demand and only pay for the time you use. You don’t need to worry about maintaining the hardware.

Author set up a personal cloud server to run AUTOMATIC1111, ComfyUI, and SD Forge for saving storage space, the three Stable Diffusion software share models.


When do you want to use the Cloud?

The benefits of using a personal cloud server to run Stable Diffusion are:

  • You don’t need to buy and maintain hardware. The cloud provider is responsible for the capital cost and maintenance.
  • You can easily rent a more powerful GPU if you need it.
  • You can access the machine anywhere, even when you are traveling.

Setting up a cloud server requires some technical expertise and can be time-consuming. You can use Google Colab notebooks as alternative method.


Cloud server setup

This article will guide you in setting up a Stable Diffusion cloud server for personal use. You will use Amazon Web Service (AWS) to set up the cloud system.

AWS is Amazon’s cloud computing service. You can rent computer resources such as CPU, GPU, RAM, storage, and public IP addresses on demand. You only pay for the hours you use.

We will use:

  • EC2: Compute instance to host the Stable Diffusion server. You can select the CPU, GPU, and RAM specs. The instance will have options to run A1111, ComfyUI, or SD Forge.
  • Elastic IP: Fix the IP address of the EC2 instance. Without it, the IP address will change everytime you stop and start the instance.
  • S3 bucket (optionally): For storing the AI models more economically.


Notes:

You should stop the instance after each session. Otherwise, it will keep charging at the rate of a running instance. The storage is persistent, meaning that all the files and settings stay the same between sessions. It is no different from your local PC. See the summary of commands at the end.

Personal prerequisite - to follow this tutorial you should have a basic knowledge of using Linux with a terminal.

PS: of course, you can choose a Amazon Machine Image as Windows11 and simply upload your portable builds of A1111, ComfyUI and SD Forge to running EC2 instance.)

Saturday, 25 May 2024

Символические ссылки и SD.

Всем привет.

Наличие трех и более инструментов для генерации картинок на одном ПК предполагает наличие моделей для каждого из них. Я, к примеру, использую Autоmatic1111, ComfyUI, Fooocus и Forge. Иногда приходится пробовать и чужие сборки. Размещать модели, checkpoints как минимум, для каждого из них отдельно затратно по мегабайтам.

Но, как говорит наш гуру Orex, нет ничего удобнее как создание символических ссылок на одно единственное хранилище для каждого инструмента, т.е. и ваши модели расположены в одном месте и получим экономию места на диске.

Если отталкиваться от Autоmatic1111, то нам следует разместить отдельно в E:\storage\ папки:

  • embeddings - встройка
  • extensions - всевоможные расширения от сторонних разработчиков
  • models - все модели, лоры и прочее
  • outputs - результаты (тут желательно чтобы ваши генераторы раскладывали файлы по папкам в формате yyyy-mm-dd).

Далее, к примеру, создаем символическую ссылку на checkpoints, в командной строке от Администратора это выглядит так: mklink /D  d:\Automatic1111\models E:\storage\models. Знаю, не все знакомы с в командной строкой, тогда вам следует использовать утилиту LinkShellExtension.

Готово, теперь Automatic1111 при обращении к checkpoints будет смотреть в E:\storage\models. Отлично. К расширениям, встраиваниям и файловому выводу можно и нужно сделать подобные ссылки.

Далее самое интересное. 

Ведь у нас есть еще ComfyUI, Fooocus и Forge. Если по науке то вам следует создать набор символических ссылок для каждого из них. По аналогии с  Automatic1111. Но если по хитрому, то вам не запрещено копировать уже созданную ссылку в новую ссылку, прямо как новый файл. И даже переименовывать ее. Ссылка все равно будет смотреть на ту папку на которую ее создали.

Единственное ограничение - создание, копирование, переименовывание и удаление символической ссылки возможно под Администратором. Под правами пользователя можно только их переименовывать(переносить) и удалять.

Идея понятна? Вы просто копируете для ComfyUI, Fooocus и Forge те ссылки которые уже созданы для Automatic1111 под новыми именами, т.е. такими которые ноебходимы, а размещаете их в нужных папках соответствующих инструментов. Теперь вы легко наведете порядок в своем хранилище E:\storage.

Удачи.


Monday, 13 May 2024

Первый видео-курс по "AUTOMATIC 1111".

Всем привет.

Automatic 1111 - мощный и бесплатный инструмент. Он открывает дверь в мир AI-генераций изображений тем, кто хочет научиться с помощью искусственного интеллекта преображать идеи в визуальные шедевры. А также получить новую, высокооплачиваемую, востребованную профессию.

Вышел в свет онлайн курс по созданию изображений с помощью искусственного интеллекта в Automatic 1111 от известного гуру - Олега ОreX. Я слежу за творчеством Олега уже не первый год, автор старается ухватить все новое и легко делится своими навыками в youtube, поэтому могу смело рекомендовать его курс вам к изучению.

Чему вы научитесь на курсе:

✅Владение мощной технологией AI - овладеете навыками использования Automatic1111, чтобы превращать свои творческие замыслы в визуальные реальности.

✅Эффективная визуализация идей - получите способность быстро превращать свои идеи в удивительные изображения

✅Адаптация к различным стилям - научитесь в создавать изображения в разнообразных стилях, от реалистичных до абстрактных, а также смешивать их

✅Создание коммерчески ценных работ - откроете для себя, как монетизировать AI-генерированные изображения в различных областях

✅Создание портфолио с AI-артами - составите привлекательное портфолио с помощью AI-генерированных работ, которое покажет вашу уникальность и креативность потенциальным покупателям

✅Использование AI для личного брендинга - научитесь использовать AI-генерированные изображения для укрепления личного бренда и привлечения внимания к вашим услугам или продуктам

✅Коммуникация и презентация работ - приобретите навыки эффективного представления ваших AI-работ потенциальным клиентам или в социальных сетях

Описание уроков автора я приведу в моей последовательности, так, я уверен, будет больше логики и важности в процессе вашего освоения Автоматика. Но нумерация уроков останется от оригинала. Те уроки которые я не упомянул носят общепознавательный или коммерческий характер. Кому будет интересно, глянете их сами.

Но с чего же начать? С организаиции бекапа! Ибо Автоматик хороший комбайн, а с расширениями просто монстр графического дизайна. Жаль будет терять время на его восстановление или повторную инсталяцию с нуля.

Monday, 1 April 2024

Automatic альтернатива SUPIR-у.

Всем привет.

По сети уже месяц ходит рецепт магического увеличения (upscale) картинки по качеству и по детализации одновременно. Этот рецепт как альтернатива SUPIR-у который так и не внедрили в горячо любимый многими Automatic1111. Честно, мне такой рецепт не нравится, уж больно он громоздкий, и результат будет зависеть во многом от вашего везения. Но таковой имеет место быть.

Рецепт подходит и для Automatic1111, и для Forge. Прошу к столу!

Все происходит на закладке img2img.

В позитивном промпте пишем: masterpiece, best quality, highres, <lora:more_details:0.5> <lora:SDXLrender_v2.0:1>

(Лоры качаем отсюда: more_details - https://civitai.com/models/82098?modelVersionId=87153

и SDXLrender_v2.0 - https://civitai.com/models/171159?modelVersionId=236130)

В негативном промпте пишем: (worst quality, low quality, normal quality:2), JuggernautNegative-neg



Wednesday, 13 March 2024

Аргументи Automatic1111.

Всім привіт.

Якщо ви користуєтесь Automatic1111 з розумом то ви маєте деякі аргументи в командному рядку. В принципі як і я. На сьогодні мій старт виглядає ось так:

set COMMANDLINE_ARGS=--xformers --autolaunch --theme=dark --disable-safe-unpickle --disable-nan-check --precision full --no-half --upcast-sampling

Спробую пояснити деякі з них:

a) --skip-load-model-at-start - аргумент який міг би виключити завантаження cheсkpoint на старті. Однак я його більше не бачу в переліку офіційних, тому більше не застосовую;

b) --disable-safe-unpickle - аргумент який дозволяє використовувати моделі старого формату (ckpt models), наприклад для розширень DeOldify та AnimateDiff;

c) --no-half-vae --no-half OR --disable-nan-check - аргумент який запобігає виникненню помилки NansException is tensor with all NaNs was produced in VAE;

d) --api - вмикає підтримку API для використання обмеженого функціоналу Automatic1111 з інших застосунків, наприклад в GIMP та Krita;

e) --listen - вмикає налаштування Automatic1111 як web-серверу для доступу всіх користувачів з локальної мережі (LAN);

f) --log-startup - детальна фіксація процесів завантаження Automatic1111;

g) --precision full --no-half - використовується для виключення "чорного квадрату" у фіналі. Можливо треба виключити аргумент --disable-nan-check.

If still not fixed, use command line arguments --precision full --no-half at a significant increase in VRAM usage, which may require --medvram.

h) --share - вмикає налаштування вашого Automatic1111 як web-серверу для всіх користувачів Internet через сайт gradio. Тобто на відміну від local URL: http://127.0.0.1:7860 буде доступ з  public URL: https://40a6211a09ejf93.gradio.app. Але за для вашої безпеки аргумент "--share" не рекомендую до використання!

Аргументи --xformers, --autolaunch та --theme=dark, гадаю, вам добре знайомі без зайвих пояснень.

Щасти вам.

Wednesday, 17 January 2024

Про Stability Matrix.

Всем привет.

В прошлую пятницу прибежала новость  про этакое мега GUI для Stability Diffusion под названием Stability Matrix. 

Собственно Stability Matrix можно назвать органайзером или агрегатором для популярных UI: A1111, Fooocus, ComfyUI и прочих. Т.е. ежели вы еще ничего из упомянутого не ставили себе, то начать с Stability Matrix вам как раз будет в тему. Он имеет как установочный вариант так и портативный.


Вы сможете выбрать какую же GUI из имеющегося списка установить для своего дальнейшего творчества.  Установка выполняется не выходя из Stability Matrix, более того вы также можете выбрать доступный branch и даже его версию, если вам так принципиально. Автор Stability Matrix также гарантирует обще управление моделями, lora-ми и остальными параметрами для всех установленных GUI SD.


В итоге, как по мне, вещица похожа на NeuroHub, который исчез раньше своего срока. Большего рассказать пока не могу, потому как я не нашел для себя главного - как внедрить в Stability Matrix уже имеющиеся GUI SD, а их у меня уже три в пользовании:  A1111, Fooocus и ComfyUI. Сами понимаете, что из-за новой оболочки переинсталировать всю тройку я не стану, хотя иногда встречаю людей которые занимаются подобным раз в месяц.)

Удачи.

Monday, 15 January 2024

А зараз я покажу вам Фокус!

Всім привіт.

Сучасні генератори зображень - це один з найцікавіших варіантів використання AI. Але для тих хто бажає цим зайнятися по повній він або дорогий (привіт, Midjourney), або лімітований (привіт, Bing), або не дуже інтуїтивний (привіт, Stable Diffusion в особі Automatic1111). 

І ось тут з’являється Fooocus! Вауууууууууу.

Автор Fooocus-у сміливо заявив що його витвір це безкоштовна, безлімітна та на 100% автономна(без Інтернет) альтернатива Midjourney!

Хочу одразу зауважити, що я користуюсь Fooocus меньше часу ніж Automatic1111 або СomfyUI але воно того варте! Детальний гайд абсолютно по всіх можливостях Fooocus нижче. 


Реально, там немає з чим розбиратися для старту, якщо вам дійсно потрібна генерація. Власне, це генератор зображень, який виконує абсолютно ті ж функції, що й Midjourney чи будь-який інший подібний ШІ. Однак у нього є декілька переваг, які роблять його набагато функціональнішим та зручнішим у використанні - головна то мінімум зусиль на отримання готового зображення в розмірах SDXL.

Від чого варто застерегти - не вибирайте купу стилів за раз. Ви не зрозумієте що вибрав з того що ви наклікали сам Fooocus. Тим паче що Fooocus НЕ пише промпт в EXIF-поле зображення.

Як захочете чогось більшого клацніть на Input Image та Advanced. Це з розрахунку для тих користувачів які знають що роблять. Ви ж саме такі?)

Ок, а як набігаєтесь по меню, то можете спробувати заміксувати Upscale, Image Prompt та Inpaint.


Але зважте що все ж таки автор це виніс в Developer Debug mode, то ж ваші очікування можуть бути марними. Але обов'язково спробуйте, воно того варте!

Користувачі Automatic1111 та СomfyUI в Fooocus-i можуть заскучати, це точно, сам таке відчув спочатку. Але свобода від зайвих параметрів для творчості може вас легко надихнути на шедевр!

Удачі.


Sunday, 14 January 2024

Pixel Maker - возможно Все!

Всем привет.

Уверен что вы еще помните мой пост про онлайн площадку принтов Pixel Maker где все возможно.

Так вот, со всей ответственностью вам заявляю что сейчас там второе рождение артов. И знаете почему?  Все верно, внедрение ИИ дает на новые возможности в художественном творчестве. И я не  исключение, так что заходите, смотрите, выбирайте. Как и ранее, принципиально никакого текста на принтах не пишу и не буду - футболка с ним выглядит банально и смахивает на агитационный плакат.

Да, продукция на площадке сегодня стоит не дешево, но теперь создать что-то уникальное свое  стало намного проще! Если не желаете разбираться сами, я к вашим услугам: идеи ваши, принты наши.



Там доступна как флекс-печать так и прямая печать которую можно заказать на футболке любого размера и цвета.  А можно на кепке, худи, сумке и кружке!

Помните - онлайн площадка Pixel Maker где возможно Все!

Удачи!🤩 

Friday, 5 January 2024

Пробуем Deep Fashion.

Привет всем.

Похоже что функция перекрашивания одежды и даже ее замена на топ-моделях для продажи в интернет-магазинах набирает популярности. И правда, зачем мучить девушек фотосессией когда можно их разок отснять в нужных позах, а после приодеть, или раздеть, в соответствии с новой модной линейкой одежды. И возможности Stable Diffusion тут как нельзя кстати.

Разумеется без Inpainting-a тут не обойтись. Но хотелось бы больше автоматизации в наложении масок и определении именно элементов одежды. И тут вам на помощь приходит проект DeepFashion2.

DeepFashion2 - это масштабный и всеобъемлющий набор данных изображений одежды, который можно использовать для решения различных задач, таких как обнаружение, оценка позы, сегментация и поиск. Он содержит более 800000 изображений различных предметов одежды, аннотированных богатыми атрибутами, ориентирами и масками. DeepFashion2 - это ценный ресурс для исследователей и разработчиков, которые хотят изучить применение компьютерного зрения и глубокого обучения в области моды. Отлично, но как же его использовать в А1111?

Конечно же лучшим помощником вам станет расширение ADetailer. ADetailer - это расширение для А1111, которое позволяет автоматически обнаруживать, маскировать и закрашивать объекты на изображениях с помощью  фреймворка Ultralytics, который и предоставляет современные модели для обнаружения, сегментации и классификации объектов. ADetailer может обрабатывать сложные сцены с множеством объектов и окклюзий и создавать реалистичные и высококачественные закрашенные изображения. ADetailer можно использовать для различных целей, таких как удаление нежелательных объектов, изменение фона, улучшение эстетики и создание новых композиций. Обычно в А1111 с ADetailer-ом мы улучшаем лица, руки, глаза или все тело человека, и поэтому ADetailer имеет для этого свои собственные модели, которые сам и скачивает и хранит их у себя, а не в общем хранилище А1111. Но с моделью deepfashion2_yolov8s-seg.pt малость по другому - ее вам надо скачать самостоятельно и положить, например в \models\adetailer, а после в settings не забыть указать путь к ней.

Версия на печать

Популярное