DALL·E, нарисувай ми овца!

май 27, 2022 | Технологии

DALL·E, нарисувай ми овца!

27 май 2022 | Технологии

„Бихте ли ми нарисували купа със супа, в която като че ли има чудовище от вълна?“

Хващам се на бас, че с такава странна заявка не могат да се справят повечето добри художници и фотографи. Като го чуя, и аз не мога да си представя нищо, което да прилича на нещо подобно. Далѝ обаче си представя много интересна картинка:

 

 

Този артист определено си заслужава уважението, затова нататък ще се погрижим да изписваме правилно името му. Защото DALL·E може да няма засукания мустак и ексцентричността на на адаша си Салвадор, но прави вълнуващи неща. Той е алгоритъм, който с помощта на изкуствения интелект превръща описанието в изображение. При това само колко точно!

„Нарисувай ми овца“, казва малко момче със златни коси на пилот, озовал се сред знойните хълмове на Сахара. Какво се случва нататък, знаем всичко, но отговорът на пилота е красиво детски.

Всичко друго освен детски са отговорите на DALL·E. Името му се изписва като на дете на Мъск, то идва от асоциацията с адаша му художник и анимационния герой – роботчето на „Пиксар“ WALL·E. От първите дни на май тази година алгоритъмът привлече вниманието на хората, които се интересуват от изкуствения интелект, със зашеметяващи примери.

 

Плюшени мечета работят по ново изследване на ИИ под вода с технологии от 90-те.

 

А дали е така кой ще ми каже?

DALL·E е доста активен онлайн. Даже редовно публикува новите си произведения в инстаграм.

След като миналата година първата версия на проекта загатна за впечатляващите му перспективи, вторият му версия дойде не само за да покаже, че алгоритмите са способни да творят. Но и много по-важни неща за възможностите им.

Проектът е дело на една от двете най-мащабни групи учени днес, които работят в областта на висшия пилотаж, свързан с разработката на изкуствен интелект. OpenAI е компанията, подкрепяна от Мъск срещу големия конкурент на Google, която създаде технологията GPT-3. Именно тази, най-впечатляваща до момента, предварително тренирана невронна мрежа се крие и зад проекта за електронния художник.

Нашият герой определено се смята за сериозен пробив в своята област. Както си струва отново да споменем, днес алгоритмите на изкуствения интелект са особено силни тогава, когато имат една от следните две задачи: на базата на обработката на огромен обем информация да предположат каква ще е следващата единица, която се зададе, или пък да успеят да я класифицират. Те се справят все по-впечатляващо в някои от посоките, в които очакваме чудеса, като например лицевото разпознаване, в други изостават, но като цяло продължават да се развиват в рамките на тези си основни роли.

 

Астронавт на кон във фотореалистичен стил.

 

Дали вали

Докато нашият нов приятел DALL·E променя парадигмата. Той анализира връзките между човешкия говор и изображенията. И в резултат създава неочаквани, понякога впечатляващи с майсторството си картини.

И пак стигаме до големия въпрос. Можем ли да ги наречем изкуство?

Наистина е изумително. Нека опитаме пак.

Някой: Уважаеми DALL·E, хайде да вземеш да ни нарисуваш плюшени мечета, които смесват бълбукащи химикали като луди учени от 90-тарско съботно анимационно шоу…

DALL·E:

 

Точно така, можем да му кажем не само какво искаме да видим, но и в каква стилистика. Имаме възможността да му описваме и обясняваме и той ще даде всичко от себе си, за да изпълни задачата. При това, давайки ни много възможни решения, от които да си изберем

Е, понякога резултатите може и да приличат, що се отнася до реалистичността, на тези от творчеството на адаша му. Не е случайно, че за момента алгоритъмът все още не е пуснат за свободна „проверка“. За да го изпиташ сам, се записваш в листа на чакащите (можете да сте сигурни, че съм там от първия момент, в който чух за него. Ако решите, опитайте и вие тук). Но това е стандартен подход в света на изкуствения интелект, където нещата са все още доста неясни и не винаги контролируеми. Понякога опитът да наподобим естествения интелект води дотам, че успяваме да извадим на преден план най-грозните му страни.

 

 

Куче влачи рейс, диря няма

Обещавам, именно това ще гласи първата задача, която мисля да му дам, стискайте палци да ми дойде редът, после ще споделя резултата!

Но междувременно, извън шегите, си струва да споменем още за достойнствата на DALL·E.

Както стана дума, новата версия на твореца използва алгоритъма GPT-3. Трениран е с помощта на 650 милиона изображения и текстовете към тях, търсейки закономерностите.

Именно в това е и нестандартният му успех. Той показва, че ИИ може да се окаже изненадващо силен, ако му покажем различни закономерности, а не просто го вкараме в руслото да класифицира или предсказва. А това е твърде вероятно да се окаже пътят по създаването на генералния изкуствен интелект. Следващото поколение алгоритъм, което пък ще може с помощта на една и съща програма да решава различни задачи.

А всичко това ни води все по-напред по пътя към машината, по-„умна“ от човека.

 

Страница на паспорт, пълна с печати от извънземни светове.

 

Бу-Дали

Дотам, разбира се, има много стъпки и никак не е сигурно, че криволичещата пътека няма да се изгуби. И все пак, успехът на DALL·E е впечатляващ.

Нека се разходим сред изложбата на електронния майстор. Той умее не само да генерира изцяло нова картина или фотография. Способен и на ретуширане. Казвате му да добави едно пате някъде насред хаоса и той му намира място.

 

 

После е способен да ви предлага различни варианти. Без да съм специалист в тази област, но… забелязвате ли как се справя алгоритъмът със светлосенките? Дори да отнесе известни критики от баш майсторите, със сигурност спестява доста работа на хората, които се занимават с ретуширане.

Поне му казваха „ретуширане“, преди годините на „Фотошоп“. После спряхме да бъдем толкова убедени във всичко, което виждаме на картинка… Уви, не спряхме, а трябваше. И днес често сме твърде лесно убеждавани, а фотоманипулацията наистина може да бъде съвършена, по пътя ѝ върви и видеото.

А какво ще стане, когато обаче алгоритъмът започне да се справя сам? И ако допълним това със задаващия се генерален ИИ, способен да изпълнява различни задачи…

DALL·E 2 много добре разбира какво ще рече „стил“. Ако му кажете какво да нарисува, ще прояви повече творчество, давайки ви доста разнообразни варианти, но ограничите ли го до епоха, направление или излъчване, ще се опита да ви помогне в зададените рамки.

 

Тигър, който с притеснение очаква часа си при зъболекаря, стил дигитално изкуство.

 

А дано, ама надали

Е, по модерна американска традиция, обвиняват го в това, че изпълнява задачите, като рисува основно лица на бели мъже. От гледната точка на бял мъж съм склонен да подкрепя атаките, също и от другата страна, срещу това, че рядко рисува голи тела.

Но всичко това се пристрастия, а в света на изкуствения интелект те, наричани по-често с англоезичния термин “bias”, са често смятани за най-сериозния проблем. Показателите, в които алгоритъмът може да се отклони от задачата си по някакви субективни причини.

DALL·E очевидно е склонен да го прави, заради което тестването му е ограничено, а и има безброй уговорки в тази посока. И в този смисъл той е доста симпатичен, покрива повече от критериите за твореца… който май по дефиниция е субективен. И си оправдава названието, което задължава към дадена самобитност.

Даже му подготвят и своеобразна цензура. Част от специалистите, работили по него, настояват да не му бъде дадена изобщо възможност да генерира лица (защото, когато му казват да нарисува затворник или ядосан човек, винаги връщал цветнокожи).

DALL·E обаче не е виновен, а е способен на впечатляващи резултати. И преди да го насочим към еротичния жанр (защо ли), бързам да ви кажа, че създателите му са цензурирали при обучението му всякакви по-пиперливи изображения. Така че ако му зададете горещ сюжет, може да ви покаже чук вместо действието, с което го свързваме вербално.

 

Ленивец в смокинг, който яде чийзбургер, докато кара колело с една гума във футуристичен град, дигитално изкуство.

 

Хляб и зрелища

Всяко от изображенията, които му се подават, минава през сериозен филтър, така че да няма и политически символи, и всички онези послания, които днес не се приемат за подходящи. Като знаем колко добре се справят с този филтър днес социалните мрежи, остава да допуснем колко подходяща идея е подобен подход да приложим и към следващите поколения алгоритми.

Той разчита на съвършените описания на кадрите, за да се опитва да намери взаимовръзките. За да си върши работата, алгоритъмът получава успоредно изображенията и текста, кодирани в знаци. Докато се тренира с помощта на огромния брой кадри, той открива закономерностите в описанията. И се опитва да ги претвори на практика след това, по зададените от потребителя рамки.

 

Хипопотам учен изследва проба под микроскоп.

 

Освен да помага на хората да се изразяват визуално, другата голяма цел на нашия приятел е да ни даде повече знание за това как ИИ възприема и обработва информацията. Както подробно стана дума в материала за
зрелищните сънища на алгоритмите, ние все още знаем прекалено малко за това, което се случва между подадената информация и крайния резултат.

Мнозина виждат още едно бъдещо приложение: DALL·E може да се окаже дългоочакваното средство, което да превърне в действителност прословутата значително по-съвършена и реалистична метавселена. Днешните решения според първите ѝ потребители са доста несъвършени, докато следващите версии на програмата – поръчков художник, могат да помогнат сериозно новият виртуален свят не само да е реалистичен, но и да се създава бързо и евтино.

 

Една и съща задача, изпълнена от DALL·E1 и DALL·E2.

 

Взели Дали

През февруари, преди пускането на алгоритъма, в екипа бяха привлечени 23-ма външни изследователи в т. нар. „червен екип“. Учени със сериозен опит в областта на машинното самообучение, които да проверяват за всякакви възможни пропуски и потенциални проблеми. Именно от тях е дошло предложението първоначално проектът да попадне само в ръцете на избрани люде. До момента този късмет са имали 400 души, основно служители на и OpenAI, подбрани творци и учени.

Според хора от „червения екип“ нашият приятел не е достатъчно способен да рисува реалистични лица. Е, и истинският Дали не е силен в лизата.

Още критики идват за това, че алгоритъмът просто прави това, на което е способен всеки средно добър майстор на „Фотошоп“ с повечко въображение.

Но пък е алгоритъм, нали? В която и да било област дефиницията „прави това, което всеки“… е знак, че тази професия си отива.

Освен това е зависим от това, което му се подаде. Колкото по-оригинална задача му поставите, толкова по-неочаквано изображение ще получите в замяна. Не е ли това дълго чаканата форма на симбиоза, що се отнася до креативността?

 

Купа със супа, която е портал към други измерения.

 

Imagine all the AI…

И ето че този журналистически материал едва беше подготвен за публикуване, когато се оказа, че нашият приятел вече… не е сам! Заформя се компания от ИИ художници, като нищо ще оформят и художническа школа, подобна на импресионистите.

По-скоро обаче се заформя конкуренция, защото Imagen е „отроче“ на другите най-големи днес в света на изкуствения интелект – Google. Този художник е способен на доста сходни задачи, но… определено има доста различен стил на изразяване.

Ето примери и от неговото творчество:

 

Двойка роботи на романтична вечеря пред Айфеловата кула.

 

Мраморна статуя на коала диджей.

 

Много ще е интересно ако един ден имаме възможност със свободен достъп да проверим как биха реагирали на едни и същи оригинални задачи двата алгоритъма. Дали ако разликата е сериозна, това няма да е още един аргумент да говорим за… творчество?!

 

Бори се, Дали!

Изображенията определено привлякоха вниманието и не е случайно, че напредъкът е постигнат едновременно от няколко проекта. Немалко мнения скептични, защото малко хора имат достъп до алгоритмите и могат да ги изпитат. Значи се подбират само най-добрите резултати, показват ни се само картините, които са се получили… А не правеха ли същото и хората художници?

„DALL·E е удобен помощник, който подсилва онова, което хората сами могат. Но е и силно зависим от въображението на хората, които го ползват. Творците, артистите, с негова помощ могат да създадат неочаквани резултати“, казва Адитя Рамеш, един от водещите инженери на проекта.

Последното сериозно умение на DALL·E наистина се оказват вариациите. Обратното на основната му задача, не да му поръчате рисунка и да я получите, а да му дадете картина, от която да се вдъхнови. И да създаде подобна по свое усмотрение

С това май вече не би могъл да се справи и адашът му.

А какво ще стане, когато пуснем и рекламистите, маркетолозите, инфлуенсърите? „DALL·E, знам, че си творец, ама направи ми реклама за…“? Всеки творец от модерното време знае колко ще му е неприятно на електронния колега.

И ето че след броени дни ще научим още по темата, като поговорим с един от доказаните български фотографи, който има шанса да изпробва (и покаже) невероятните възможности точно на тези алгоритми!

„DALL·E, нарисувай ми овца!“ Обещавам ви, ако имам шанса, ще го помоля и за това.

Скоро очаквайте и още една, само че не толкова дигитална история – на човека, написал оригинала на тази реплика – Антоан дьо Сент-Екзюпери. След това – текст и за генералния изкуствен интелект. Ех, няма ли да е хубав животът, да е доста по-шарено бъдещето на човечеството, ако успеем да ги срещнем…!

Дигитални истории
<a href="https://karamanev.me/author/georgik" target="_self">Георги Караманев</a>

Георги Караманев

Програмист, журналист на свободна практика и писател. Още за мен – четете тук.
Дигитални истории

Най-нови публикации:

„Всеки може да е програмист. Време е да сме повече инженери!“

„Всеки може да е програмист. Време е да сме повече инженери!“

Ивайло Кенов е вдъхновяващ учител, помогнал на толкова много хора да станат програмисти. Насочва се към тази професия случайно, след като разбира, че строителното инженерство не е за него. Решава да...

повече информация
Как DALL·E „прочете“ любими български книги?

Как DALL·E „прочете“ любими български книги?

Чукчата не е читател, а писател, знаете сигурно, ами… ChatGPT? Време е за поредния прелюбопитен експеримент, който да ни покаже на какво са способни днес алгоритмите в областта както на създаването...

повече информация
„Представям си бъдещето като битка за невидимото“

„Представям си бъдещето като битка за невидимото“

есен смили се над тези които не могат да те понесат бъди красива до смърт   Или   близостта нанася удари под кръста подарък който не мога да пренеса без твоя помощ който не мога да откажа...

повече информация
„Българите имаме манталитета, за да сме успешни предприемачи“

„Българите имаме манталитета, за да сме успешни предприемачи“

Борис Паскалев e предприемач с впечатляващ опит в света на стартъпите. Отскоро е стратегически съветник към института INSAIT, още една гаранция, че оттам си струва да очакваме още и все...

повече информация

Още публикации по темата:

От рубриката:

Stack Overflow. Спасителят на програмистите си отива

Stack Overflow. Спасителят на програмистите си отива

Много е лесно да различиш човек, който някога е програмирал от останалите – „докосвал“ ли си код, просто няма как да не си виждал Stack Overflow. Само за 15 години сайтът с въпроси и отговори промени из основи начина, по който работят програмистите. Превърна се в Мека за софтуерните инженери, в спасителен пристан за почти всеки ежедневен техен проблем.
Днес обаче легендата върви към своя залез. При това, по ирония на съдбата, заради напредъка в технологиите, който сама направи възможен…
Нещо повече – заради упадъка на проекта мнозина вещаят сериозни проблеми, с които ще се сблъскват следващите програмисти.
Историята на Stack Overflow е показателна за това къде сме днес в света на технологиите. За стремителната скорост, с която се променяме. За семенцата, за добрите идеи, които могат да покълнат само ако попаднат в подходящата среда и в точния момент. И за бързината, с която до вчера непоклатимият гигант се превръща в сянка на себе си.

повече информация
Как DALL·E „прочете“ любими български книги?

Как DALL·E „прочете“ любими български книги?

Чукчата не е читател, а писател, знаете сигурно, ами… ChatGPT? Време е за поредния прелюбопитен експеримент, който да ни покаже на какво са способни днес алгоритмите в областта както на създаването на изображения, така и на разбирането на контекст.
Ще призова алгоритъма DALL·E 3, който е част от платената версия на ChatGPT, да ми илюстрира класически български литературни произведения от различни периоди.
Защо това е интересно? От една страна, ще ни покаже колко добре работи големият езиков модел на български. Ще стане ясно доколко разпознава някои от безспорните наши класически произведения.
Не на последно място просто защото… е интересно дали пък няма да ни покаже някакви по-неочаквани, различни, атрактивни гледни точки? Дали не можем да говорим за някаква форма на колективно неосъзнато? Дали картините ще се припокрият поне донякъде с образите, които всеки от нас има за тези книги в главата си?

повече информация
ИИ детектив. Технологията ли ще ни върне истината?

ИИ детектив. Технологията ли ще ни върне истината?

След като експериментът на Дигитални истории, в който се включиха почти 2000 души, показа, че вече не сме способни да различаваме генерираните от изкуствения интелект изображения и текстове, е време за следващата стъпка.
Дали пък… самият изкуствен интелект няма да ни помогне в тази вече неравна битка в търсене на истината? След като алгоритмите станаха толкова добри в генерирането на разнообразни текстове, изображения, а вече и видео, дали пък няма те да се окажат спасението?
Ще проверим на практика. Радостин Чолаков от родопското село Барутин ни гостува с една от първите Дигитални истории. Тогава, само на 15, той разказа за работата си в света на невронните мрежи, много преди изкуственият интелект да се превърне в темата на деня. А до днес успехите му са още по-впечатляващи. През последните години пътят му често се преплита с този на друг талантлив младеж на същата възраст. Делян Бойчев също завършва средното си образование тази година, но вече има сериозни успехи, специалността му са методите за компютърно зрение.
Двамата приятели се заговарят по темата и решават да проверят: ясно е, че днес изкуственият интелект създава забележителни изображения, но дали пак той би могъл да разпознае истината и лъжата, да прецени коя картинка е създадена от човек и коя – от алгоритъм?

повече информация

Най-новите:

Stack Overflow. Спасителят на програмистите си отива

Stack Overflow. Спасителят на програмистите си отива

Много е лесно да различиш човек, който някога е програмирал от останалите – „докосвал“ ли си код, просто няма как да не си виждал Stack Overflow. Само за 15 години сайтът с въпроси и отговори промени из основи начина, по който работят програмистите. Превърна се в Мека за софтуерните инженери, в спасителен пристан за почти всеки ежедневен техен проблем.
Днес обаче легендата върви към своя залез. При това, по ирония на съдбата, заради напредъка в технологиите, който сама направи възможен…
Нещо повече – заради упадъка на проекта мнозина вещаят сериозни проблеми, с които ще се сблъскват следващите програмисти.
Историята на Stack Overflow е показателна за това къде сме днес в света на технологиите. За стремителната скорост, с която се променяме. За семенцата, за добрите идеи, които могат да покълнат само ако попаднат в подходящата среда и в точния момент. И за бързината, с която до вчера непоклатимият гигант се превръща в сянка на себе си.

повече информация
„Всеки може да е програмист. Време е да сме повече инженери!“

„Всеки може да е програмист. Време е да сме повече инженери!“

Ивайло Кенов е вдъхновяващ учител, помогнал на толкова много хора да станат програмисти. Насочва се към тази професия случайно, след като разбира, че строителното инженерство не е за него. Решава да опита като преподавател, въпреки че е срамежлив по природа.
Дълги години е начело на екипа програмисти в СофтУни, води лекции по безброй технологии. Преподава, увлича и дава занаят, от него и аз съм научил основите на технологията, с която днес си изкарвам хляба.
Днес Ивайло е изправен пред ново начинание. Екипът му се превърна във фирма, която се е устремила към амбициозната задача да припомни, че създаването на софтуер все повече трябва да бъде инженерен процес, а не просто кодене.
Наистина ли всеки може да стане програмист, както казва учителят, помогнал на мнозина да изпълнят тази мечта? Какви са основните трудности, които спират хората?
Кои са големите проблеми, с които се сблъскват днешните програмисти? Защо си струва те вече да са не просто кодери, а да подхождат инженерно и към останалите страни от работата си?
Дали наистина е толкова трудно да си намериш първа работа в тази област? Кои са най-честите грешки?
Как Ивайло, на когото лекарите предричат, че няма да може да ходи, днес вдига 150-килограмови тяги благодарение на… инженерния подход?

повече информация
Как DALL·E „прочете“ любими български книги?

Как DALL·E „прочете“ любими български книги?

Чукчата не е читател, а писател, знаете сигурно, ами… ChatGPT? Време е за поредния прелюбопитен експеримент, който да ни покаже на какво са способни днес алгоритмите в областта както на създаването на изображения, така и на разбирането на контекст.
Ще призова алгоритъма DALL·E 3, който е част от платената версия на ChatGPT, да ми илюстрира класически български литературни произведения от различни периоди.
Защо това е интересно? От една страна, ще ни покаже колко добре работи големият езиков модел на български. Ще стане ясно доколко разпознава някои от безспорните наши класически произведения.
Не на последно място просто защото… е интересно дали пък няма да ни покаже някакви по-неочаквани, различни, атрактивни гледни точки? Дали не можем да говорим за някаква форма на колективно неосъзнато? Дали картините ще се припокрият поне донякъде с образите, които всеки от нас има за тези книги в главата си?

повече информация
„Представям си бъдещето като битка за невидимото“

„Представям си бъдещето като битка за невидимото“

„Засега изкуственият интелект ни се струва смешен, прилича ни на криво огледало или на глупчо, когото напътстваме и благодарение на когото се чувстваме знаещи и повече отвсякога хора. Това обаче се променя буквално за дни и скоро той ще се превърне в реалистично и достоверно наше отражение. Мисля за този момент – вероятно тогава ще успеем да се видим през неговия поглед, да осмислим кои части от нас са ясни дори за едно изкуствено създание, кое остава недостъпно за него и кое е най-ценното. Според мен това са онези места, където той не може да надзърне. Представям си бъдещето като битка за невидимото, това ще бъде най-важният ресурс. Онова, което изкуственият интелект не може да регистрира, е най-ценното в нас.“
„Почти всичко е наред“ се казва дебютната стихосбирка на поетесата Виолета Кунева и толкова точно формулира усещането ни за света днес.
Но как така се оказа, че вече не е възможно да различаваме поета от алгоритъма? Какво губим, ако е така?
Дали проблемът е, че масово сме изгубили критерия си за изкуство, за метафора, за многопластови, живи и човешки по дефиниция текстове, каквито са поетичните?
Ще дойде ли краят на поезията или… именно тя може да ни спаси от самите нас?

повече информация
Да си купиш вечна младост

Да си купиш вечна младост

46-годишният Браян Джонсън вече е похарчил над $4 милиона, така че тялото му да заработи като на 18-годишен. Твърди, че му се получава. Влага всички сили, стига дотам да си влива кръвна плазма от собствения си син. Смята, че е най-изследваното човешко същество, живяло някога, че експериментът му ще промени живота на всеки, който иска да живее дълго.
Тоест, на всеки.
Мечта или утопия? Безобразно пилеене на пари или идея, която може да промени еволюцията ни? Гениалност или чиста лудост?

повече информация
„Българите имаме манталитета, за да сме успешни предприемачи“

„Българите имаме манталитета, за да сме успешни предприемачи“

Борис Паскалев e предприемач с впечатляващ опит в света на стартъпите. Отскоро е стратегически съветник към института INSAIT, още една гаранция, че оттам си струва да очакваме още и все по-забележителни новини.
Преди това младежки национал по баскетбол, днешният ни гост заминава да следва не къде да е, а в MIT. Завършва магистратура с отличие и започва кариерата си като програмист преди повече от 20 години. После се пренасочва към мениджмънта и предприемачеството. За да стигнем до момента, когато се събира с двама други герои на Дигитални истории – проф. Мартин Вечев и д-р Веселин Райчев в стартъпа DeepCode. Той е изпълнителен директор на една от пионерните разработки за създаване на код с изкуствен интелект, която през 2020 г. е придобита от мултимилиардната компания Snyk.
Ще поговорим за успешния му път през сърцето на Силициевата долина. За започналата революция на изкуствения интелект, която според него е по-голяма дори от откриването на електричеството. За друга революция, която се задава – тази в роботиката. За това как у нас може да има повече успешни стартъпи, които да развият средата и страната ни.
Кои са следващите големи новини, които да очакваме от INSAIT?

повече информация
Share This