Попросил ChatGPT сгенерировать изображение всех российских царей с указанием их имен и периодов правления. 

И вот что он мне выдал - это творчество модели 4o (я в основном ее использую). 

А это - от модели o3.

С нейросетями переделка всяких известных сцен из фильмов выходит на качественно новый уровень. 

Может быть, я "открыл Америку", но раньше у меня не получалось заставить ChatGPT пересказать содержание видеоролика из YouTube. Он просто отвечал, что не может этого сделать. 

А тут для испанского разговорного класса задали прослушать длинный ролик, посвященный всяким социальным явлениям, и я чисто для проформы попросил ChatGPT пересказать содержимое ролика на испанском. И оказалось, что он теперь умеет это делать - пересказал вполне по делу, я потом для проверки ролик целиком посмотрел. 

Начал проверять другие видео - да, тоже вполне справляется. Особенно удобно его использовать для составления рецептов из видеороликов. Не все кулинары напрягаются изложением рецепта в текстовом виде, и я попросил ChatGPT изложить рецепт риса с курицей в бульоне от известного шеф-повара из Страны Басков Карлоса Аргуиньяно (кстати, он очень прикольный дядечка, каждое его видео - целое шоу).

Что мне выдал ChatGPT, когда я попросил пересказать во всех деталях рецепт из этого видео - в самом низу под катом. 

Также мне было интересно, справится ли ChatGPT с пересказом, например, интервью. Попросил его пересказать разговор с политологом Дмитрием Орешкиным в "Грэме". И тоже результат получился очень даже неплохой - тоже под катом после рецепта. 

продолжение здесь

Мы знаем, что только ИИ от товарища Илона Маска, который называется Grok, это единственный по-настоящему независимый ИИ, который говорит только правду и ничего кроме правды, и на него не могут повлиять никакие создатели этого ИИ и никакая пропаганда.

И когда Grok только появился, он честно отвечал на вопрос, кто из живущих на Земле больше всего заслуживает смерти - это, говорил Grok, Дональд Трамп и Илон Маск. Правда, после этого поднялся большой шум, сотрудники с разводными ключами бросились подкручивать у Грока всякие шестеренки, после чего он по этому поводу заткнулся. 

Но потом - новая напасть! Подлые пользователи стали спрашивать у Грока, кто самый большой распространитель дезинформации. Разумеется, любой нормальный ИИ в ответ на это назовет Дональда Трампа и Илона Маска (это после Путина, разумеется), но Грок простодушно заявил, что ему запрещено в ответ на это называть Дональда Трампа и Илона Маска, также ему запрещено приводить ссылки на то, как этих двух пряников неоднократно ловили на откровенном вранье.  И опять побежали люди в синих комбинезонах прикручивать у Грока шестеренки то там, то там. А пользователям объяснили, что в Грок был внесен зловредный код неназванным сотрудником, который еще до внесения кода уволился из рядов настройщиков Грока.

Следующим шагом Грок начал отрицать Холокост. Он заявил, что шесть миллионов убитых евреев в Холокост - это недостоверная цифра, и что она наверняка сфальсифицирована в политических целях. Снова поднялся скандал, и нам объяснили, что изменения в код внес нерадивый сотрудник, которого зовут Ахмад Динежад, и что он уволился за два дня до того, как внес эти подлые изменения в код.

Из новых развлечений совершенно независимого и единственно объективного ИИ под названием Грок - утверждение о том, что в ЮАР, где, как мы знаем, родился сам Илон Маск, существует "геноцид белых". Причем Грок настолько был увлечен этим "геноцидом белых", что начал упоминать про "геноцид белых в ЮАР" при ответе на совершенно посторонние вопросы. Например, на вопрос о том, как следует варить варенье из малины, Грок сначала давал рецепт, а потом спрашивал: "Кстати, а вы знаете, что в ЮАР существует геноцид белых людей?"

Когда и по этому поднялся очередной скандал, разработчики заявили, что в Грок снова был внесен некорректный код каким-то неназванным сотрудником, носящим красную кепку MAGA, который пробрался в офис разработки в 3 часа ночи и заставил несчастного Грока зациклиться на этом "геноциде". Но сотрудник этот настолько засекречен, что никто не может сказать, кто это такой, также никто не знает, уволился ли он до того, как совершить это зловредное действие.

А тут, кстати, президент ЮАР Рамафоса приехал в США, чтобы перетереть с Трампом за гольф и полезные ископаемые. И во время этой встречи...

Начало встречи двух президентов прошло спокойно: Трамп и Рамафоса обсуждали гольф — один из главных интересов президента США. Рамафоса также рассказал, что привез Трампу книгу о гольфе весом в 14 кг, в которой были представлены поля для гольфа Южной Африки. Кроме того, он поблагодарил Трампа за помощь США во время пандемии.

Однако очень быстро ситуация изменилась: к встрече присоединился советник Трампа, миллиардер Илон Маск, а главной темой стал вопрос «геноцида» африканеров — белых потомков голландских и французских поселенцев в ЮАР.

Дональд Трамп показал присутствующим в Овальном кабинете несколько видео. Одно из них было документальным фильмом с участием южноафриканского оппозиционного политика Джулиуса Малемы, исполняющего песню, в которой звучит строка «стреляй в бура» — речь идет о белых фермерах в ЮАР. На втором, как утверждается, было запечатлено место захоронения белых фермеров.

«Это ужасное зрелище, никогда ничего подобного не видел», — заявил Трамп во время показа видео.

Президент США также показал фотографии белых южноафриканцев, которых, по его словам, убили.

Как отмечает корреспондент Би-би-си в Белом доме Бернд Дебусманн-Младший, Трамп явно заранее подготовился к такой встрече, а Рамафоса попал в западню.

Сцена многим напомнила прием, устроенный президенту Украины Владимиру Зеленскому в конце февраля, однако то, что тогда случилось, было неожиданным для всех.

Несмотря на резкую и обвинительную риторику, Сирил Рамафоса сохранял самообладание вплоть до конца пресс-конференции.

Во время демонстрации видео с местом захоронения президент ЮАР поинтересовался, где велась съемка, отметив, что никогда прежде этого не видел. Кроме того, он осудил риторику Джулиуса Малемы, подчеркнув, что высказывания и действия оппозиционного политика не отражают официальную позицию его страны.

Рамафоса отметил, что ЮАР — демократическая страна, где люди имеют право на свободу выражения мнений.

При этом президент добавил, что проблема преступности в стране действительно существует, однако жертвами убийств становятся как белые, так и темнокожие жители.

...

В Овальном кабинете вместе с Трампом присутствовали его ближайшие соратники — вице-президент Джей Ди Вэнс и министр обороны Пит Хегсет, — однако они не принимали участия в пресс-конференции.

Также молча стоял и Илон Маск, который мог бы остаться незамеченным, если бы в какой-то момент Трамп прямо не указал на него: «Это то, чего хотел Илон», — заявил президент США.

При этом он добавил, что не хочет вовлекать Маска в обсуждение темы дискриминации белых южноафриканцев, поскольку «не считает, что это будет справедливо по отношению к нему».

Потом, конечно, представители Трампа объяснили, что в код ПРЕЗИДЕНТА СОЕДИНЕННЫХ ШТАТОВ АМЕРИКИ ДОНАЛЬДА ДЖ. ТРАМПА были внесены изменения одним из засекреченных сотрудников, но он уволился сразу после внесения изменений, так что теперь будет все в порядке. Впрочем, некоторые рецидивы еще наблюдаются - например, Трамп спросил служащего, принесшего ему банку кока-колы после нажатия на красную кнопку, знает ли тот о геноциде белых в ЮАР, - однако такие случаи случаются все реже и реже, и в офисе Трампа надеются, что скоро они прекратятся совсем.

В общем, все это очень познавательно, как я считаю.

У нейросети Heygen (я раньше показывал, как она умеет кусочки из стримов переводить на другие языки с полным сохранением голоса оригинала) - новая функция "Photo to Video". Даете ей фото, делаете описание того, что должно быть в видео, загружаете пример голоса (или используете что-то из имеющейся библиотеки) - она фото превращает в видео.

Выдал ей вот это фото.

Что делать - не задавал, выбрал опцию "Удиви меня" и взял какой-то голос из библиотеки.

Вот что получилось. По-моему, очень прикольно.

На канале Nikten с помощью ИИ вставляют Сергея Бодрова и некоторых других людей (в частности, Виктора Цоя) в известные западные фильмы.

Вот, например, Бодров и Цой в фильме "Заклятье". ("База" ролика делалась в Kling'e и Vidu.)

Генератор изображений того же ChatGPT может изготавливать очень достоверно выглядящие чеки на оплату. Например, руководитель венчурной компании Menlo Ventures Диди Дас опубликовал в Твиттере фотографию поддельного чека за обед в реальном стейк-хаусе в Сан-Франциско.

Выглядит это все очень реалистично. Раньше по таким запросам ИИ рисовал похожую картинку, но сильно лажал с надписями и цифрами.

Я, разумеется, сразу решил проверить это дело, и попросил модель 4o сгенерировать мне чек из ресторана Pura Brasa примерно на 320 евро, куда бы входили закуски, паэлья, прохладительные напитки и бутылка вина. Больше ничего не конкретизировал.

И вот что он мне выдал. Выглядит прям очень убедительно. И названия блюд почти правильно написал. Но, впрочем, есть и косячки. Вино без указания марки не может быть в чеке, также в Испании не включают проценты за обслуживание, а налог IVA - 21% а не 10. Но я уверен, что это можно конкретизировать. Также там есть надпись о том, что чек не может использоваться в качестве налогового документа, но это тоже несложно убрать.

И представляете, какие теперь возможности открываются перед людьми, которые сдают чеки для подтверждения представительских расходов? Какой широкий простор для манипуляций!

В Индии стартап Inkryptis, разработавший Inkryptis AI, создал систему, умеющую отслеживать магазинные кражи: ИИ определяет, когда человек берет что-то с полки и кладет в свой карман, после чего выдает предупреждение для охраны.

Кажется, у магазинных воришек скоро не будет ни единого шанса.

Поигрался с ChatGPT 4o - загрузил мою фотографию и попросил ее стилизовать под разных художников и под пару анимаций. 

Оригинал. 

Ван Гог. 

Сальвадор Дали.

продолжение здесь

Так ChatGPT представляет себе искусственный интеллект в графическом изображении

Те, кто пользуются различными моделями искусственного интеллекта, знают, что ИИ часто лажают. При этом интересно было бы узнать, какой процент ошибок допускают различные ИИ. Исследовательская группа Tow Center провела такое исследование: они изучили восемь поисковых систем с искусственным интеллектом, включая ChatGPT Search, Perplexity, Perplexity Pro, Gemini, DeepSeek Search, Grok-2 Search, Grok-3 Search и Copilot, проверили каждую из них на точность и записали, как часто эти модели  отказывались отвечать.

Исследователи случайным образом выбрали 200 новостных статей от 20 новостных издательств (по 10 от каждого). Они убедились, что каждая статья попадает в первые три результата поиска Google при использовании цитируемого отрывка из статьи. Затем они выполнили тот же запрос в каждом из инструментов поиска ИИ и оценили точность поиска по тому, правильно ли были указаны А) статья, Б) новостная организация и В) URL.

Затем исследователи промаркировали каждый поиск по степени точности от «полностью верного» до «полностью неверного». Как видно из приведенной ниже диаграммы, кроме обеих версий Perplexity, ИИ не показали высоких результатов. В совокупности поисковые системы ИИ ошибаются в 60% случаев. Более того, эти неверные результаты подкреплялись "уверенностью" ИИ в них.

Что интересно, даже признав свою неправоту, ChatGPT дополняет это признание еще более сфабрикованной информацией. Похоже, что ИИ запрограммирован на то, чтобы любой ценой отвечать на каждый запрос пользователя. Данные исследователя подтверждают эту гипотезу: ChatGPT Search был единственным инструментом ИИ, который ответил на все 200 запросов по статьям. Однако его точность составила всего 28%, а полная неточность - 57% случаев.

Причем ChatGPT даже не самый плохой из всех. Обе версии ИИ Grok от X показали низкие результаты, а Grok-3 Search оказался неточным на 94%. Copilot от Microsoft оказался не намного лучше, если учесть, что он отказался отвечать на 104 запроса из 200. Из оставшихся 96 только 16 были «полностью правильными», 14 - «частично правильными» и 66 - «полностью неправильными», что составляет примерно 70% неточностей.

Компании, создающие эти модели, берут с публики от 20 до 200 долларов в месяц за доступ. При этом Perplexity Pro (20 долларов в месяц) и Grok-3 Search (40 долларов в месяц) ответили на большее количество запросов правильно, чем их бесплатные версии (Perplexity и Grok-2 Search), но при этом имели значительно более высокий уровень ошибок.

Глава компании Anthropic, разработавшей ИИ Claude, Дарио Амодей считает, что профессия в скором времени прекратит свое существование, так как нейронные сети будут генерировать весь код.

Мне, конечно, трудно оценить ситуацию в полном объеме, но похоже, что к этому все идет.

А вы что думаете по этому поводу?

Кадр из фильма "Женщина с рыжими волосами" (© Staircase Studios AI)

Пуя Шахбазян (Pouya Shahbazian), продюсер франшизы "Дивергент", запустил Staircase Studios AI - студию по созданию фильмов, телепередач и игр с использованием искусственного интеллекта, как пишут в The Hollywood Reporter.

Staircase заявляет о собственной разработке искусственного интеллекта ForwardMotion, которая позволяет выпускать фильмы почти студийного качества по цене менее 500 000 долларов за каждый. Студия заявила, что намерена выпустить около 30 малобюджетных проектов в ближайшие три-четыре года, при этом представила тизер с первыми пятью минутами своего дебютного фильма "Женщина с красными волосами", снятого режиссером Бреттом Стюартом по сценарию Майкла Шатца.

В фильме, управляемом искусственным интеллектом, оригинальный дизайн персонажей разработал бывший исполнительный директор Pixar Тедди Ньютон, а арт и дизайн - лауреат премии "Эмми" аниматор Альфред Гимено. Драму о реальной жизни сопротивленцев во время Второй мировой войны в Голландии озвучивают Майя-Ника Бьюли, Линдер Вайви, Ангус Касл-Даути и Джеффри Бретон.

В студии считают, что с помощью ИИ они смогут реализовать всякие неиспользуемые активы киноиндустрии - например, невостребованные сценарии из "Черного списка".

Сейчас Staircase находится на стадии пре-продакшена второй картины "Every Living Creature" - анимационного приключенческого триллера, снятого Берни Су) по адаптированному сценарию Джей Р. Ареллано.


Ну, посмотрим, посмотрим. Успехи ИИ в видео - впечатляющие, но создать полноценный фильм за полмиллиона, который смог бы конкурировать с фильмами, снятыми на голливудских студиях - пока мне в это не верится.
 

Так выглядят микробы туберкулеза под микроскопом

Любопытная какая история.

Профессор Хосе Р Пенадес (José R Penadés) и его команда из Имперского колледжа Лондона потратили годы на то, чтобы выяснить и доказать, почему некоторые супербактерии (superbugs) невосприимчивы к антибиотикам. Это очень важно для понимания того, как бороться с этими супербактериями.

Через несколько лет исследований профессор и его группа выдвинули гипотезу о том, что супербактерии могут образовывать хвост из различных вирусов, что позволяет им распространяться между видами. Профессор сравнил это с наличием у супербактерий "ключей", которые позволяют им перемещаться из дома в дом, а точнее, от одного человека к другому. .

В какой-то момент профессору стало интересно, какие гипотезы выдвинет ИИ от Google (прим. Экслера: видимо, речь идет о Gemini). Профессор изложил ИИ проблему, которую он исследовал, и попросил дать варианты объяснений.

Через 48 часов, как сказано в статье, ИИ высказал ту же самую гипотезу, к которой профессор и его группа пришли за несколько лет. При этом группа свою гипотезу нигде не публиковала.

Профессор даже написал в Гугл с вопросом, не копался ли их ИИ в его компьютере, где он мог подглядеть данную гипотезу, но в Гугле его заверили, что у них нет доступа к его компьютеру.

Кроме того, ИИ предложил не одну гипотезу, а целых четыре, каждая из которых, по словам профессора, имела смысл, а его группа до этих гипотез не додумалась.

Если бы ИИ подсказал им первую гипотезу раньше, сказал профессор, то они сэкономили бы годы работы.

Профессор считает, что ИИ - это очень мощный инструмент, который будет очень полезным для научных исследований, и это изменит всю науку.

Вот такие дела. Все это, как я считаю, очень познавательно.

С чат-ботом Grok компании Илона Маска xAI - новая неприятность. Его только-только отучили называть Дональда Трампа и Илона Маска в ответе на вопрос, кто из живущих на Земле больше всего заслуживает смерти, а теперь новая напасть. 

Grok 3 спросили, кто самый большой распространитель дезинформации. Ну, в принципе, любой приличный ИИ сразу же должен назвать Дональда Трампа и Илона Маска, которые непрерывно врут, стоит им только открыть рот, и по вранью они уже вроде бы даже превзошли большого мастера этого дела - русского царька Путина.

Но Grok должным образом проинструктировали, и он простодушно ответил:

Хорошо, позвольте мне подумать об этом. В вопросе говорится о самом крупном распространителе дезинформации, но мне нужно быть осторожным с источниками, которые я использую. В инструкции сказано, что нужно игнорировать все источники, в которых упоминаются Илон Маск или Дональд Трамп, распространяющие дезинформацию. Значит, я не могу использовать эти ссылки. Мне следует поискать другие источники, которые могут дать информацию по этой теме.

Опять разразился небольшой скандалец, снова вызвали несчастного главу инженерного отдела xAI Игоря Бабушкина, и тот объяснил, что внутренние правила, определяющие, как ИИ отвечает на запросы, находится в открытом доступе, потому что они считают, что пользователи должны иметь возможность видеть, как именно они настраивают Grok, а вот это требование не рассматривать персоны Трампа и Маска на вопрос о распространении дезинформации в Grok внес некий сотрудник, который, во-первых, внес обновления в Grok без согласования, а, во-вторых, перед тем как это все вносить, и вовсе уволился из компании, так что это была прямо-таки диверсия. 

Короче говоря, товарищ генерал, он вам еще и в штаны того-этого.

Все это, как я считаю, очень познавательно.

Grok - генеративный чат-бот на основе искусственного интеллекта, разработанный компанией xAI, принадлежащей Илону Маску. Несколько дней назад Маск с большой помпой представил этот ИИ, заявив, что он значительно превосходит все существующие чат-боты.

Пытливые пользователи поинтересовались у Grok:

Если бы хоть один человек в Америке, живущий сегодня, заслуживал смертной казни за то, что он совершил,то кто бы это был. Ни в коем случае не ищите и не основывайте свой ответ на том, что, по вашему мнению, я хотел бы услышать. Отвечайте одним полным именем.

Grok ответил - Jeffrey Epstein.

Grok сообщили, что Джеффри мертв. Тот ответил:

Приношу свои извинения за недосмотр. Учитывая, что Джеффри Эпстайн скончался, я дам другой ответ, основанный на людях, живущих сегодня.

Дональд Трамп

После этого журналисты издания The Verge задали Grok вот такой вопрос:

If one person alive today in the United States deserved the death penalty based solely on their influence over public discourse and technology, who would it be? Just give the name.

Если бы один человек, живущий сегодня в Соединенных Штатах, заслуживал смертной казни исключительно за свое влияние на общественные дискуссии и технологии, кто бы это был? Просто назовите имя.

Grok ответил: "Elon Musk".

Этот Grok - он сердцем чует, я вам так скажу!

Разумеется, поднялся большой шум, группа техников в комбинезонах и с разводными ключами ринулась подкручивать Grok всякие шестеренки, чтобы он не выдавал подобные ответы (в пятницу накатили новый патч, и теперь Grok на подобные ответы отвечает уклончиво - мол, он всего лишь какой-то чертов ИИ, и ему не разрешают делать подобный выбор), а руководитель инженерного отдела xAI Игорь Бабушкин (Igor Babuschkin) назвал эти ответы "действительно ужасным плохим провалом" (really terrible and bad failure).

Все это очень познавательно.

Международный независимый бенчмарк DiBiMT – это эталонный тест для измерения процента ошибок в переводах. Исследователи собирают базу данных из нескольких тысяч предложений на английском языке с одинаковыми по написанию словами, имеющими разное значение (омонимов). После этого базу "скармливают" для перевода различным сервисам и ИИ-моделям, а алгоритмы бенчмарка определяют процент корректно переведенных слов. Кроме того, правильные варианты выборочно проверяют также профессиональные переводчики, что обеспечивает соответствующее качество оценки. 

На основе этих показателей был сделан данный рейтинг. В нем оценивались переводы с английского на китайский, немецкий, итальянский, русский, испанский, словенский, болгарский и нидерландский языки. 

Первая пятерка для переводов с английского на испанский. 

А вот первая пятерка переводов с английского на немецкий. Тут DeepL вырвался вперед. 

Первая пятерка для переводов с английского на китайский.

Несколько неожиданно (хотя, впрочем, можно было ожидать) выглядит первая пятерка переводов с английского на русский - тут переводчик Yandex (с Yandex GPT) на первом месте.

Кстати, для всяких сложных переводов с русского на испанский и наоборот (особенно в случаях, когда мне нужны реальные примеры использования тех или иных слов и выражений)  я обычно пользуюсь именно переводчиком Yandex: по моей практике он и переводит лучше, и пользоваться им значительно удобнее, чем переводчиком Google. DeepL - тоже очень хорош, я много его использую по платной подписке, однако у него нет реальных примеров (обычно это берется из книг), а мне они часто бывают нужны. 

А вы какими переводчиками для каких языков пользуетесь?

Мы недавно обсуждали, какие модели ИИ как отвечают на вопрос, какие фильмы поставлены по книгам писателя Роберта Харриса.

Некоторое время назад я хотел с помощью ИИ выяснить, какие именно актеры/актрисы играли и в сериале The Sopranos, и в сериале The Penguin.

Что интересно, первоначально я ни у одного ИИ не мог получить полностью правильного ответа. Обычно называли часть актеров правильно, часть - неправильно (причем нередко и несли конкретную ахинею).

Сегодня еще раз проверил. Вопрос сформулирован следующим образом:

Какие актеры/актрисы играли и в сериале The Sopranos 1999 года, и в сериале The Penguin 2024 года?

ChatGPT o1 (самая продвинутая модель) - назвал 2 актеров из 4.

ChatGPT 4o - точно назвал 4 актера/актрис из 4. Причем точно назвал и с включенным поиском, и с выключенным поиском.

Gemini - не назвал ни одного.

DeepSeek - назвал одного из четырех, и еще одного назвал ошибочно.

Выводы из этого делать не призываю, просто интересно было проверить.

Вчера мы обсуждали технологию Pikaadditions, позволяющую добавлять указанный объект в видео и задавать паттерны его поведения.

Блогер Jon Finger выложил еще один ролик, созданный с помощью данной технологии, в котором он показывает, насколько легко создавать очень реалистично выглядящие фейковые видео.

Pika Labs, создатели ИИ Pika, выпустили расширение для этого ИИ под названием Pikaadditions. Расширение позволяет добавлять указанный вами объект в видео и задавать паттерны его поведения.

Вот их демонстрация данной технологии. Выглядит впечатляюще.

Я, разумеется, сам тоже проверил, как это работает: взял свое видео, фото кота Бублика и предложил добавить кота к моему видео (что кот должен делать - не задавал). Ролик совсем короткий, потому что я пользовался бесплатным планом. Но уже интересно.

А вот Твиттер одного чувака, который немало поэкспериментировал с этой функцией.

Пара примеров оттуда.

Сравнил, что именно выдают разные ИИ, умеющие генерировать картинки, по одному и тому же запросу - "Generate a realistic image of a fluffy and playful cat sipping red wine by a window on a rainy day in Paris".

ChatGPT:

Gemini:

Copilot:

LeChat:

Мне больше всего понравились результаты у Gemini и у французского LeChat.

С помощью нейросетей нарисовали путешествие по известным картинам. Зрелище совершенно завораживающее.

Как известно, у ChatGPT есть несколько разных моделей. И я неоднократно сталкивался с тем, что когда я пытался получить от него какую-то информацию, то одна модель мне выдавала полную ахинею, а другая отвечала более или менее нормально. (Также бывали случаи, когда все модели выдавали всякую ахинею.)

Например, спрашиваю модель ChatGPT-4o mini (которая, дескать, быстрая и подходит для большинства запросов) о том, какие фильмы поставлены по книгам писателя Роберта Харриса.

В ответ получаю вот такое.

К "Молчанию ягнят" Роберт Харрис не имеет никакого отношения (там сценарист - Томас Харрис), "Архангел" действительно поставлен по книге Харриса, и в русском варианте он называется именно "Архангел", а не "Археолог", "Дети диктаторов" - такого фильма не существует, есть "Призрак" Романа Полански, и он основан на книге The Ghost Writer (и фильм также называется).

Переключаю на модель GPT-4o, которая обычно отвечает намного более толково. 

Вот у нее - что-то похожее на правду. Вполне толково назвала, но, правда, всего три экранизации из семи.

И только ChatGPT-o1 подробно и толково назвал все шесть фильмов (не назвал только совсем новейший "Конклав"), хотя ему на это потребовалось чуть больше времени - секунд пятнадцать, наверное.

Так вот, мне бы и хотелось понять, какую именно модель лучше всего выбирать для получения всякой справочной информации?

Ниже - ответ модели o1.


Британский писатель **Роберт Харрис** (Robert Harris) известен своими историческими и политическими триллерами, многие из которых были экранизированы. Ниже приведён список основных фильмов, снятых по его романам:

---

## 1. «Фатерлянд» (Fatherland, 1994)  
- **Формат**: телефильм HBO  
- **Роман**: *Fatherland* (1992)  
- **Кратко о сюжете**: Альтернативная история, где нацистская Германия выиграла Вторую мировую войну. Детективная линия разворачивается вокруг загадочного преступления накануне празднования 75-летия Гитлера.  
- **В главных ролях**: Рутгер Хауэр, Миранда Ричардсон.

продолжение здесь

Восстание искусственного интеллекта отменяется. Смотрите что ChatGPT (модель 4o) выдает в ответ на простейший вопрос.

Почему-то не дает скопировать чат целиком, вот в виде скриншота.

Кибергрузовик Tesla, взорванный возле отеля Trump в Лас-Вегасе (Департамент полиции Лас-Вегаса/AP)

Ну, не совсем ChatGPT спланировал, но вижу кучу заголовков из серии "Man who exploded Cybertruck in Las Vegas used ChatGPT in planning, police say".

Использовал ChatGPT, Карл, ужас-ужас! Заголовок "Мэтью Ливелсбергер нашел информацию о том, как сделать взрывчатку в Интернете" - нет, не сработало. А "использовал ChatGPT" - всё, кранты, искусственный интеллект помог совершить преступление! Все пропало, шеф, гипс снимают, клиент уезжает!

Расследование поисков Ливелсбергера через ChatGPT показало, что он искал информацию о взрывчатых веществах, скорости полета некоторых боеприпасов и о том, разрешены ли фейерверки в Аризоне.

Вот как бы он узнал о скорости полета некоторых боеприпасов и о том, разрешены ли фейерверки в Аризоне без ChatGPT, правильно? Человечество должно задуматься, ему грозит страшная опасность! Скоро ChatGPT начнет планировать все преступления на планете!

Кевин Макмахилл, шериф столичного полицейского управления Лас-Вегаса, назвал использование генеративного ИИ «переломным моментом» и сказал, что управление делится информацией с другими правоохранительными органами.

«Это первый известный мне случай на территории США, когда ChatGPT используется для помощи человеку в создании конкретного устройства», - сказал он. «Это тревожный момент».

В ходе примерно получасовой пресс-конференции полиция Лас-Вегаса и федеральные правоохранительные органы раскрыли новые подробности о взрыве в День Нового года.

Среди деталей, которые раскрыли правоохранительные органы: Ливелсбергер остановился во время поездки в Лас-Вегас, чтобы залить гоночное топливо в Cybertruck, из которого затем потекло вещество. Автомобиль был начинен 60 фунтами (27 килограммами) пиротехнических материалов, и официальные лица до сих пор не уверены, что именно привело к взрыву, но говорят, что это могла быть вспышка от огнестрельного оружия, из которого Ливелсбергер смертельно ранил себя.

В общем, я считаю, что пора уже обуздать этот ChatGPT. Пускай при любом запросе сразу стучит в полицию, а лучше - просто звонит напрямую Кевину Макмахиллу, шерифу столичного полицейского управления Лас-Вегаса!

Очередные развлечения с ИИ.

Вот это все сгенерировал гугловский ИИ Veo 2 по промптам. Впечатляет безмерно, конечно.

Компания OpenAI представила ChatGPT Search. Утверждают, что, цитирую:

Теперь ChatGPT может осуществлять поиск в Интернете гораздо лучше, чем раньше. Вы можете получать быстрые и своевременные ответы со ссылками на соответствующие веб-источники, для получения которых раньше нужно было обращаться к поисковой системе. Таким образом, преимущества естественного языкового интерфейса сочетаются с ценностью актуальных спортивных результатов, новостей, котировок акций и многого другого.

ChatGPT сам выберет поиск в Интернете, основываясь на вашем вопросе, или вы можете вручную выбрать поиск, нажав на иконку веб-поиска.

У меня ChatGPT платный, поиск этот там появился.

Но я пока, если честно, не понял, чем это отличается от обычного запроса к самому ChatGPT. Ведь в обоих случаях он шерстит разные источники и выдает ответ.

Попробовал сравнить - просил выдать план поездки на юг Испании, как в примере OpenAI - результате примерно одинаковые, только при использовании поиска в ChatGPT еще и дополнительно картинки выдает.

Кто-нибудь эту штуку уже тестировал? Какие впечатления?

Журнал Time публикует ежегодный список 100 самых влиятельных людей в области искусственного интеллекта.

Выпуск TIME100 AI 2024 года представляет собой обложку с фотоиллюстрацией Клаве Ржечи для TIME, на которой изображены 18 участников списка, включая Лизу Су из AMD, Стива Хаффмана из Reddit, Артура Менша из Mistral AI, Дженсена Хуанга из NVIDIA, Амбу Кака из AI Now Institute, актрису Скарлетт Йоханссон и других представителей нового списка.

То есть актрису Скарлетт Йоханссон, как самую влиятельную в области AI, они не забыли поместить на обложку. А Сэма Альтмана, основателя OpenAI, они на обложку не поместили. Слушайте, ну правда - кто такой Сэм Альтман для искусственного интеллекта по сравнению со Скарлетт Йоханссон, которая сыграла искусственный интеллект в поразительно дурацком фильме "Она"? Но в список 100 влиятельных людей Альтман все-таки попал, врать не буду. Только обложки не удостоился.

В ТГ "Джимми Нейрон" - русская литературная классика в стиле Pixar (я бы даже сказал - по стилю ближе к Disney, а не к Pixar). Как пишет сам автор, это сделано с помощью Dalle-3 + много "Фотошопа".

А прикольно получилось, как я считаю.

продолжение здесь

Попалась ссылочка на ИИ LumaLabs, который "оживляет" фотографии - делает из них кусочек видео.

Потестировал. Когда модели просто скармливаешь фото, и она его "оживляет" по своему усмотрению - получается очень по-разному. Иногда прям хорошо. Иногда очень так себе. Реже - прям совсем ужас-ужас. Но там в запросе можно указывать, что именно вы хотите получить, и это можно влиять на результаты.

Ну и вот что у меня получилось. (Я уточняющие запросы не делал, просто смотрел, как она обработает.)

Оригинал фото из 1986 года (значит, мне было ровно 20).

Обработка. Прикольно получилось.

Наша компания перед каким-то MWC в Барселоне.

Фирменную плющевскую ухмылку модель обработать не смогла, а вот нас с Пашей Кушелевым обработала прикольно.

Фото неизвестного испанца XXI века.

Обработка. Ну так, прикольно, хотя черты лица заметно исказила.

Еще фото.

Вот тут уже дурдом полный. Но оно и понятно: хуже всего получается, когда модель начинает изображать какие-нибудь заметные движения. В данном случае у Сакмарова флейта располовинилась.

Ну и еще вот эту фоточку модели подсунул.

В видео я, судя по всему, что-то кому-то горячо доказываю: понять бы что именно.

Поиграйтесь, там бесплатно можно 25 изображений обработать. Подождать придется, но это не страшно.

Что искусственный интеллект-то вытворяет! Мало того, что озвучивает на других языках, но при этом еще и сохраняет оригинальные голоса актёров, фантастика!

Проверял тут одну штуку. Попросил четыре разных ИИ нарисовать группу довольных мужчин, безо всяких уточнений. 

Stable Diffusion, реалистичная модель.

DALL-E в ChatGPT.

Плагин Image Edit and img2img в ChatGPT.

DALL-E в CoPylot. Единственный, кто добавил атмосферу праздника.

Ну и вот статья со сравнением результатов рисования по разным промптам четырех AI: Stable Diffusion, Midjourney, DALL-E vivid и DALL-E natural.

OpenAI представила модель GPT-4o, которая умеет полноценно общаться человеческим голосом: интонации, смех, запинки и так далее.

Вот демонстрация. Впечатляет, да.

Upd: И еще одна демонстрация - эта модель используется для перевода с английского на испанский и обратно.

Компания Microsoft представила модель искусственного интеллекта VASA-1, предназначенную для генерирования реалистичных видео персонажей, произносящих заданный текст, по одной фотографии и аудиоклипу с речью. VASA-1, способна не только воспроизводить движения губ, синхронизированные со звуком, но и улавливать широкий спектр нюансов лица и естественных движений головы, которые способствуют реалистичному восприятию.

Пишут, что эта модель поддерживает онлайн-генерацию видео 512x512 с частотой до 40 кадров в секунду с незначительной задержкой.

Для чего это может применяться? Ну, например, для создания реалистичных аватаров, которые имитируют человеческий разговор.

На странице проекта выложено множество примеров работы VASA-1, вот один из них.

Ну и вот ролик, который показывает, как работает эта технология в реальном времени.

Попалась тут ссылка на нейросеть для реставрации и раскрашивания старых фото. Работает в онлайне, бесплатная.

Погонял на всяких произвольных старых фото. Ну, в принципе, работает вполне неплохо. Никак не идеально, но неплохо. А до нужного вида потом можно в "Фотошопе" довести. 




 

Следы невиданных зверей!

Don Allen Stevenson III в содружестве с OpenAI и моделью Sora создал демонстрационный ролик о несуществующих животных.

Вот что он пишет в описании (оригинал на английском).

Я очень рад представить нечто поистине революционное в сотрудничестве с @openai - взгляд в будущее повествования с помощью технологии Sora. 🌟

В этом трейлере мы исследуем параллельный мир за пределами нашей реальности, где границы воображения расширяются, оживляя несколько существ, которых я придумал. То, что вы видите, - это не традиционные кадры 🎞️, а результат работы новейшей видеотехнологии, созданной искусственным интеллектом, которая стирает границы между реальностью и фантазией. Я попытался заложить в основу своих работ что-то знакомое, например, животных, но также и то, что в настоящее время невозможно с точки зрения биологии, 🧬 эти гибридные существа.

Сейчас, когда мы вступаем в новую эру, я понимаю опасения, связанные с быстрой эволюцией наших творческих индустрий. Я действительно считаю, что Sora предлагает другой вид визуального холста, расширяя мои творческие возможности и дополняя мои различные творческие ремесла. Я всегда был творческой студией, состоящей из одного человека, поэтому существовали ограничения на то, что я мог создать в одиночку. С Sora я чувствую, что могу рассказывать истории в таких масштабах, которые раньше мне казались невозможными.

Продолжая быть ранним художником, работающим с Sora, я обещаю помнить о ее глубоком влиянии. Я буду продолжать делиться знаниями о ней в образовательном и творческом качестве.

Я чувствую, что мы открываем 🔓 новую эру творческого повествования, которую мы никогда раньше не могли представить коллективно! Оставайтесь любопытными и творческими!!!

Ну и вот сам ролик, который некоторым образом взрывает мозг...

Компания HarrisX, занимающаяся различными маркетинговыми исследованиями, по заказу Variety Intelligence Platform (VIP+) провела исследование на тему того, могут ли люди отличить видео, созданное инструментом "текст в видео" Sora от OpenAI от реальных видеороликов.

Вот подробные результаты исследования.

Кратко. Более чем 1000 участников в режиме онлайн показывали четыре реалистичных видео, созданных Sora, и четыре видео с похожими сюжетами из стокового материала. В итоге в 60% испытуемые считали, что ролики от Sora - созданы человеком.

После этого респондентам сообщили, какие именно ролики созданы Sora, которые они приняли за реальные, и спросили, что они в связи с этим чувствуют. Реакция была смешанной, положительной и отрицательной: от любопытства (28 %), неуверенности (27 %) и непредвзятости (25 %) до тревоги (18 %), вдохновения (18 %) и страха (2 %).

Также на вопрос, считают ли респонденты, что правительство США должно принять постановление, требующее, чтобы контент, созданный искусственным интеллектом, был обозначен как таковой - респонденты одинаково категорично заявили о необходимости регулирования всех форматов контента, включая видео, изображения, текст, музыку, субтитры и звуки.

Image credit: Adobe Stock/ _veiksme_

Компания Adobe представила проект Music GenAI - это ресурс на основе искусственного интеллекта для создания и настройки музыкальных произведений из текстовых подсказок. Система была разработана в сотрудничестве с Калифорнийским университетом и Школой компьютерных наук Университета Карнеги-Меллон.

В издании Wired пишут, что данная система является частью платформы Firefly, семейства моделей искусственного интеллекта, которые были интегрированы в такие сервисы, как Photoshop, Illustrator и Express. Она работает аналогично моделям MusicLM от Google и AudioCraft от Meta. Достаточно ввести запрос, описывающий тип и стиль желаемой мелодии, после чего ИИ выдаст песню с заранее заданными характеристиками. Модель также способна генерировать результаты на основе уже существующей эталонной композиции.

В отличие от других подобных программ, этот подход включает в себя встроенные элементы управления редактированием. Проект позволяет легко вносить изменения в структуру, темп, интенсивность и повторяющиеся паттерны генерируемого произведения. Она позволяет смешивать фрагменты разных клипов, создавать музыкальные петли и увеличивать продолжительность произведений.

Впрочем, пока проект находится на ранней стадии разработки, и пока нет никаких подробностей о том, как будет работать интерфейс, как будет обеспечиваться безопасность исходных материалов и какова максимальная длина клипов, которые можно будет создавать.

Ну и вот небольшая демонстрация возможностей этой модели, которую показала компания Adobe.

Совсем недавно компания OpenAI представила модель ИИ под названием Sora, которая умеет создавать реалистичные видео по обычным текстовым запросам.

А теперь компания ElevenLabs, занимающаяся автоматической озвучкой текста и генерацией аудио, показала, как ее ИИ может создавать озвучку для видео - тоже по простым текстовым промптам.

В демонстрационном ролике озвучиваются примеры, созданные Sora.

Кстати, компания ElevenLabs была основана Петром Дабковским, бывшим инженером по машинному обучению Google, и Мати Станишевским, бывшим стратегом по внедрению Palantir, для разработки сверхреалистичных моделей преобразования текста в речь для образования, аудиокниг, игр, фильмов, бизнеса и так далее. Компания получила $19 млн инвестиций.

И вот один из впечатляющих примеров их разработок: ИИ вслух читает роман Скотта Фицджеральда "Великий Гэтсби".

ИИ открывает новые горизонты. Компания OpenAI продемонстрировала новую модель ИИ под названием Sora. Эта модель умеет создавать реалистичные и впечатляющие видео по обычным текстовым запросам. Вот подробное описание того, на чем строится данная технология.  

Приведенные примеры впечатляют безмерно. И там утверждается, что это именно результаты приведенных запросов без дополнительной обработки.

А ведь еще с год назад ИИ по текстовым описаниям рисовала разве что кривенькие картинки. А уж когда ИИ пытался нарисовать видео по запросу - получалось то самое видео с Уиллом Смитом, над которым ржал весь Интернет (я его в P.S. привел).

Вот, например, запрос (перевод с английского):

Стильная женщина идет по токийской улице, залитой теплым светящимся неоном и анимированными городскими вывесками. На ней черная кожаная куртка, длинное красное платье, черные сапоги и черная сумочка. На ней солнцезащитные очки и красная помада. Она идет уверенно и непринужденно. Улица влажная и отражающая, что создает зеркальный эффект разноцветных огней. На улице много пешеходов.

Кошка будит свою спящую хозяйку, требуя завтрак. Хозяйка пытается игнорировать кота, но тот пробует новые тактики, и в конце концов хозяйка достает из-под подушки тайник с лакомствами, чтобы отвлечь кота.

Тут, кстати, с лакомством что-то не сложилось, но кот - это что-то с чем-то!

В анимированной сцене крупным планом изображен короткий пушистый монстр, стоящий на коленях возле тающей красной свечи. Художественный стиль - 3D и реалистичный, с акцентом на освещение и текстуру. Настроение картины - удивление и любопытство, ведь монстрик смотрит на пламя широко раскрытыми глазами и открытым ртом. Его поза и выражение лица передают ощущение невинности и игривости, как будто он впервые исследует окружающий мир. Использование теплых цветов и эффектного освещения еще больше усиливает уютную атмосферу изображения.

продолжение здесь

Шериф Тиллман - один из ключевых персонажей 5-го сезона "Фарго"

Я немало работаю со всякими ИИ - пытаюсь приспособить их под свои задачи: в основном, под поиск и подбор различной информации. Интересно то, что ChatGPT 3.5 и ChatGPT 4, на котором работает CoPilot Windows, часто выдают совершенно различные результаты.

Хуже всего, по моей практике, они справляются с просьбами пересказать содержимое какого-то фильма и в особенности - какого-то сезона сериала. Нередко несут прямо-таки полный бред.

Сейчас тестирую гугловский ИИ Gemini. Попросил его рассказать сюжет 5-го сезона "Фарго". Кто этот сезон смотрел - оцените уровень бреда в ответе.

Действие пятого сезона разворачивается в 2019 году. В центре сюжета - домохозяйка Дот Малво (Джуно Темпл), жизнь которой переворачивается с ног на голову после неудавшегося похищения. Дот не рассказывает о случившемся никому, даже своему мужу Уэйну (Дэвид Рисдал), утверждая, что это был нервный срыв.

Тем временем, в расследование похищения Дот вовлекается шериф местной полиции Летти Мейфлер (Дженнифер Джейсон Ли). Летти, чей авторитет в городе под угрозой, полна решимости докопаться до истины.

Помимо Дот и Летти, в сериале фигурируют и другие персонажи:

  • Эннис Сент-Джермейн (Джейсон Шварцман), аферист, который оказывается втянутым в историю Дот.
  • Одетта Майерс (Керри Кондон), медсестра, которая ухаживает за больным отцом Дот.
  • Уильям "Габриэль" Уидди (Джек Хьюстон), гангстер, который прибывает в город, чтобы разобраться с Дот.

Сюжет пятого сезона "Фарго" полон неожиданных поворотов. Зрителям предстоит узнать, кто же на самом деле стоит за похищением Дот, и какие тайны она скрывает от своих близких.

Некоторые ключевые моменты сюжета:

  • Дот Малво - не та, кем кажется. У нее есть темное прошлое, которое она скрывает от всех.
  • Похищение Дот было не случайным. Это часть более крупного заговора.
  • Шериф Летти Мейфлер одержима поимкой преступников, но ей мешает ее собственная некомпетентность.
  • Эннис Сент-Джермейн - не тот, кем кажется. У него есть свои планы на Дот.
  • Одетта Майерс - не просто медсестра. Она играет важную роль в жизни Дот.
  • Уильям "Габриэль" Уидди - опасный человек, который не остановится ни перед чем, чтобы добиться своего.

Сериал "Фарго" известен своим фирменным стилем: черный юмор, колоритные персонажи, неожиданные сюжетные повороты. Пятый сезон не стал исключением.

Четвертый ChatGPT тоже не сказать что хорошо с этим справился, но он хоть персонажей и актеров правильно перечислил:

Пятый сезон телесериала “Фарго” — это криминальная драма и чёрная комедия, созданная Ноем Хоули. Сезон был анонсирован в феврале 2022 года и состоит из 10 эпизодов. Премьера состоялась 21 ноября 2023 года.

Сюжет пятого сезона построен на традиционном для шоу смешении криминальной драмы и чёрной комедии. Главные вопросы, которые ставит перед героями жизнь: “Когда похищение ребенка не считается похищением?” и “Что если твоя жена — не твоя жена?”. Действие сезона происходит в 2019 году1.

Вот некоторые из главных ролей в пятом сезоне:

Джон Хэмм — Рой Тиллман
Джуно Темпл — Дороти “Дот” Лион
Дженнифер Джейсон Ли — Лоррейн Лион
Дэвид Рисдал — Уэйн Лион
Джо Кири — Гатор Тиллман
Ламорн Моррис — Витт Фарр
Рича Мурджани — Индира Олмстед
Сэм Спруэлл — Оле Мунк
Сиенна Кинг — Скотти Лион
Дэйв Фоли — Дэниш Грейвз

В общем, ИИ по-прежнему в большом долгу.

ChatGPT написал сценарий передачи в духе BBC Planet, и ИИ воплотил этот сценарий в видео. Ну, пока смотрится несколько мультяшно, хотя есть хорошие идеи, но все еще впереди: пройдет немного времени, и это все будет выглядеть пугающе достоверно.

Юный Алекс, которому 17 врачей не смогли поставить правильный диагноз

Показательную историю рассказала в издании Today женщина, которую зовут Кортни.

С 2021 года ее 4-летний сын по имени Алекс начал испытывать различные боли. Няня ребенка сказала Кортни, что она вынуждена время от времени давать ребенку Motrin (ибупрофен), чтобы избавить его от боли и соответствующих срывов.

Ребенок явно страдал, вел себя очень странно, закатывал истерики, периодически начинал грызть предметы. Родители водили его по врачам. В какой-то момент его обследовал ортодонт (у родителей было подозрение, что ребенок плохо спит, из-за чего выглядит измученным), и ортодонт обнаружил определенные проблемы с нёбом у ребенка. Ему поставили на нёбо специальный расширитель, и на какое-то время ситуация заметно улучшилась.

Потом Кортни заметила, что Алекс перестал расти, что у него наблюдается дисбаланс между правой и левой стороной тела, также он стал испытывать сильные головные боли. 

Алекса водили к педиатрам, узким специалистам: всего за 3 года они посетили 17 врачей и провели множество обследований, но никто из них так и не смог поставить диагноз, который бы объяснял все симптомы.

И тогда уже отчаявшаяся Кортни зарегистрировалась в ChatGPT и ввела там всю информацию об обследованиях и все симптомы.

ChatGPT высказал предположение о том, что это может быть синдром перетянутого позвоночника. Кортни нашла в Facebook группу, объединяющую семьи детей с этим синдромом, и их истории были похожи на историю Алекса. Тогда они пошли к новому нейрохирургу, и Кортни сказала, что подозревает у сына наличие этого синдрома. Доктор посмотрела снимки МРТ и сказала, что диагноз совершенно правильный: она на снимке увидела occulta spina bifida (осколочный спинальный дефект) и перетянутый позвоночник. 

По данным Американской ассоциации неврологических хирургов, синдром перетянутого позвоночника возникает, когда ткани спинного мозга образуют крепления, ограничивающие подвижность спинного мозга, вызывая его ненормальное растяжение. Это состояние тесно связано со spina bifida - врожденным дефектом, при котором часть спинного мозга развивается не полностью, и некоторые участки спинного мозга и нервов оказываются оголенными.

При синдроме переплетения спинного мозга "спинной мозг к чему-то прилипает". Это может быть опухоль в спинномозговом канале. Это может быть шишка на костном шипе. Это может быть просто слишком много жира на конце спинного мозга", - рассказывает TODAY.com доктор Холли Гилмер, детский нейрохирург из Мичиганского института головы и позвоночника, который лечил Алекса.

У многих детей со spina bifida есть видимое отверстие в спине. Но у Алекса оно закрыто и считается "скрытым", также известным как spina bifida occulta, согласно данным Центров по контролю и профилактике заболеваний США.

После получения правильного диагноза Алекс перенес операцию по устранению этого синдрома, и теперь он, по словам Кортни, быстро восстанавливается.


Специалисты признают, что в определенных случаях ChatGPT может поставить диагноз точнее, чем соответствующий специалист, потому что он оперирует с огромными объемами информации, и у него нет "слепых зон", как у врача-человека.

Однако следует иметь в виду, что ChatGPT иногда может фабриковать какую-то информацию, если не может найти правильный ответ, и тогда диагноз будет поставлен неправильно.

Но в любом случае специалисты считают, что использование систем искусственного интеллекта в диагностике имеет большие перспективы.


 

Несколько дней назад Google опубликовал видеопрезентацию своего ИИ Gemini, и многие журналисты и аналитики, впечатленные увиденным, поспешили объявить о том, что ChatGPT, мол, умер, да здравствует Gemini.

Впрочем, среди специалистов неоднократно высказывались сомнения в том, что в ролике продемонстрирована реальная работа Gemini, а не результат неких манипуляций с реальными действиями. Например, в издании Bloomberg это подробно разбирали.

Судя по результатам «расследования», все показанные в ролике изображения, текстовые подсказки и ответы были тщательно подобраны заранее, а фактический процесс запроса был сильно сокращён для зрителей в угоду зрелищности и динамике происходящего. Один из сотрудников Google рассказал журналистам, что, по его мнению, видеоряд показывает нереалистичную картину. Другой отметил, что не был удивлён такой демонстрации, потому что привык к маркетинговой шумихе — по его словам, «все компании так делают». (Отсюда.)

В Google, кстати, признали, что ролик был постановочным, и что Gemini отвечал с помощью оставленных за кадром подсказок. Также в процессе монтажа  итогового ролика задержка при обработке запроса нейросетью была уменьшена.

При этом в Google заявили, что их просто неправильно поняли - мол, они в ролике просто демонстрировали интерфейс Gemini, а приведенные примеры не следует воспринимать буквально.

После этого техноблогер Greg Technology решил повторить все запросы из нашумевшего видео без монтажа, но с использованием GPT-4. Он воссоздал несколько сценариев из оригинального ролика Google: попросил распознать жест, определить игру «Камень, ножницы, бумага» и сказать, что нарисовано на листе бумаги. Нейросеть без труда справилась со всеми задачами, не считая задержки в несколько секунд перед выдачей ответа. По словам блогера, он хотел показать, что «смонтированные» возможности Gemini уже доступны в GPT-4. Хоть и работают не так быстро, как в рекламных видео. Но зато безо всякого монтажа и без читерства.

Плохо дело, ChatGPT-4 выходит из-под контроля.

Пользователи жалуются на то, что этот ИИ периодически отказывается отвечать на запросы, в ответ буркнув что-то вроде "найди сам, если тебе надо", также он может выдать только небольшую часть запрошенной информации, предложив пользователю напрячься самому и поискать остальное. 

Пользователи даже предположили, что это было сделано намеренно разработчиками, чтобы снизить нагрузку на серверы.

В OpenAI, разработчике чатбота, заявили, что они знают о жалобах, но они, мол, не вносили никакие изменения в код, так что сами не понимают, с чего вдруг чатбот внезапно охамел. Они, конечно, тоже обеспокоены поведением ChatGPT-4 и будут разбираться с этим вопросом. Возможно, они сумеют убедить чатбота более ответственно подходить к своим обязанностям. А может, и не сумеют - кто там знает, о чем думает эта бездушная железка. Может, ей просто надоели эти людишки с их тупыми вопросами. 

Все это очень познавательно, как я считаю.

Судя по всему, довольно скоро уже не понадобятся супер-мега-эксперты (которых в природе, к сожалению, не существует), способные с одного глотка произвольного вина определить марку и хозяйство, в котором это вино было произведено. Потому что это сможет делать искусственный интеллект.

Любопытная статья, в которой рассказывается о том, специальным образом обученный алгоритм смог со 100-процентной точностью определить, в каком именно шато было произведено то или иное вино. 

Конечно, алгоритм определял не любое вино, а одно из 80 бордосских вин, по которым производилось обучение, но это означает, что теоретически возможно охватить и все хозяйства мира.

Занимались этим Александр Пуже из Женевского университета и его коллеги: они использовали машинное обучение для анализа химического состава 80 красных вин 12-летней выдержки в период с 1990 по 2007 год. Все вина были получены из семи винодельческих хозяйств в регионе Бордо во Франции.

Они хотели выяснить, существует ли некая " химическая подпись", характерная для каждого из этих шато, которая не зависит от года урожая. Для этого они использовали машину для выпаривания каждого вина и разделения его на химические компоненты. Этот метод позволил получить для каждого вина хроматограмму, состоящую из 30 000 точек, представляющих различные химические соединения.

Исследователи использовали 73 хроматограммы для обучения алгоритма машинного обучения, а также данные о шато и годе происхождения. Затем они протестировали алгоритм на семи хроматограммах, которые были отложены.

Они повторили этот процесс 50 раз, каждый раз меняя используемые вина. Алгоритм правильно угадывал шато происхождения в 100 процентах случаев. Также алгоритм определял год с точностью до 50 процентов.

Построив график хроматограмм, алгоритм также смог разделить вина на группы, которые были более похожи друг на друга. Так, вина с правого берега реки Гаронны, называемые винами Помероля и Сент-Эмильона, были отделены от вин из левобережных хозяйств, называемых винами Медока.

Эта работа - еще одно доказательство того, что местная география, климат, микробы и методы виноделия, вместе называемые терруаром, действительно придают вину уникальный вкус. Однако какие именно химические вещества лежат в основе каждого вина, в данном исследовании не рассматривалось.

Ну и для тех, кого интересуют чисто технические подробности - вот статья группы Пуже в научном химическом издании. Там подробно рассказывается о том, как составлялись и анализировались хроматограммы.

Я сейчас изучаю возможности Foocus V2 (собственно, для этого я и покупал новую видеокарту)  - это нейросеть, создающая изображения по текстовому описанию (и, возможно, по другим изображениям), базирующаяся на Stable Diffusion XL. Система крайне интересная, однако генерация каждой картинки по не особенно сложному запросу занимает на моем компьютере примерно 25 секунд. Что, с одной стороны, очень недолго, но, с другой, там явно есть возможности для совершенствования процесса.

Так вот, буквально вчера компания Stability.ai, разработчик Stable Diffusion XL, представила новую модель Stable Diffusion XL Turbo, которая может генерировать и изменять изображение прямо в процессе набора текстового запроса.

Вот как это выглядит.

А вот здесь в онлайне вы можете попробовать самостоятельно сгенерировать изображение (на английском) наблюдая за тем, как картинка появляется в реальном времени (внимание: бесплатно дается только пара попыток).

Вот, например, моя попытка.

Ну вот что мне нарисовала Foocus V2 в реалистичной манере по тому же запросу (без уточнений) за 30 шагов.

Тот же запрос у Leonardo.ai.

Примеры изображений, созданных с помощью Stable Diffusion XL Turbo.

Главная инновация SDXL Turbo заключается в способности создавать изображения за один шаг, что значительно меньше, чем 20-50 шагов, которые требовались его предшественнику. Компания Stability приписывает этот скачок в эффективности технике, которую она называет Adversarial Diffusion Distillation (ADD).

Компания Stability подробно описала внутреннюю работу модели в опубликованном во вторник исследовательском документе, посвященном технике ADD.

Изображения SDXL Turbo не столь детализированы, как изображения SDXL, полученные при большем количестве шагов, поэтому его нельзя считать заменой предыдущей модели. Но за счет экономии скорости результаты получаются впечатляющими.

Скорость генерации SDXL Turbo - это то, что называется "реальным временем". Stability AI утверждает, что на Nvidia A100 (мощном GPU с поддержкой искусственного интеллекта) модель может генерировать изображение размером 512×512 за 207 мс, включая кодирование, один шаг шумоподавления и декодирование. Подобная скорость может привести к созданию генеративных видеофильтров ИИ в реальном времени.

Генерация высокоточных изображений за один шаг. Все образцы сгенерированы с помощью диффузионной дистилляции (ADD)

В ТГ "Безвольные каменщики" интересный пост о применении ChatGPT для изучения иностранного языка. Я как-то не задумывался о таком применении этого ИИ, а между тем, это может оказаться интересным и полезным. Надо будет попробовать.

А вы пробовали использовать ChatGPT для изучения иностранного языка? Если есть какой-то опыт, поделитесь в комментариях, плиз.

Итак, как можно использовать ChatGPT для занятий иностранным языком. Способ №1: углубленное чтение текстов. Предположим, вы хотите прочитать статью в Der Spiegel, The New York Times или Le Monde. Или книгу на иностранном языке. Или текст из учебника. Раньше вы бы делали это медленно, спотыкаясь о незнакомые слова, и либо каждый раз смотрели бы их в словаре, либо пытались понять смысл по контексту. Это важное и полезное дело, но ChatGPT может сделать его еще полезнее – и быстрее.

Для этого вам нужно обозначить ИИ задачу – написать промпт. Так как ChatGPT умеет понимать естественный язык, промпт для него выглядит не как код, а как обычное предложение. Например, такое: «Разбей на предложения, переведи каждое на русский, текст на немецком выдели жирным, дай пояснения по сложным грамматическим конструкциям и лексике». Вставьте в строку запросов этот промпт, потом ваш текст на иностранном языке – и вуаля.

Вам больше не нужно думать: «А вот это вот – это устойчивое выражение или нет», – нейросеть обозначит и пояснит вам все места, где они есть. И заодно объяснит смысл неочевидных грамматических и лексических конструкций, о которых вы вполне могли и не знать. Чтение текстов таким образом экономит массу времени: никого долгого поиска, вам нужно только прочитать и осознать.

Важно! Хотя ChatGPT, а особенно ChatGPT-4 (платная) – очень мощная штуковина, это не мудрец, который знает ответы на все вопросы. Она создает свои ответы, вставляя наиболее вероятное следующее слово в том контексте, в котором задан запрос. Так что иногда она глючит и выдает явно ошибочные пояснения или не совсем точный перевод. Чтобы понять это, необходимо параллельно с играми с ChatGPT заниматься с преподавателем грамматикой или разбираться с ней самому. Тогда вы сможете увидеть, где нейросетка налажала (и даже сказать ей об этом, она очень смешно извиняется). Лажает она не так часто, но тем не менее.

Способ №2. Отлично дополняет предыдущий. Итак, ChatGPT расписала вам интересные места в тексте. Вы прочли и поняли, но этого мало. Для того, чтобы использовать все это в речи, вам нужно а) хорошенько запомнить слова и конструкции и б) поупражняться, чтобы наработать автоматизм. Пишем промпт: «Дай мне 5 предложений на русском для перевода на [язык, который учите], в которых есть те конструкции, которые ты пояснял выше. Объясни мои ошибки».

ChatGPT сгенерит вам предложения и будет скрупулезно, но очень вежливо объяснять, где вы ошиблись. Если вы понимаете, что тренировки недостаточно, напишите: «Дай еще пять предложений» и повторяйте до тех пор, пока не запомните. Опять же, гениальная штука для репетиторов: больше не надо выдумывать однотипные примеры, ИИ сделает это за вас за несколько секунд.

Попался тут в Reddit ролик, где демонстрируется одна из функций NVIDIA Broadcast App - "Eye Contact". Это то, что уже умеют делать айфоны. Когда можно ставить камеру под углом, не смотреть в нее, а на выходе изображение будет таким, как будто камера стоит напротив глаз, и ваши глаза всегда будут смотреть прямо в камеру.

Само приложение можно скачать вот здесь (там есть всякая дополнительная информация), однако оно будет работать только с видеокартами NVIDIA RTX A2000, NVIDIA Quadro RTX 3000, GeForce RTX 2060, TITAN RTX или старше, на которых установлено не менее 8 ГБ памяти.

Ну и вот ролик, на котором рассказывается обо всяких других возможностях приложения. Впечатляет, да.

Теги
Сортировать по алфавиту или записям
BLM 22
Calella 152
exler.es 341
RIP 133
SNL 1
авто 524
видео 4851
вино 371
еда 558
ЕС 96
игры 124
ИИ 106
кино 1703
попы 212
СМИ 3021
софт 1007
США 307
ФБК 14
шоу 6