Попалась тут статья в Techcrunch про новую модель работы с изображениями в Google Gemini.
Google модернизирует своего чат-бота Gemini, оснащая его новой моделью изображений на основе ИИ, которая дает пользователям более точный контроль над редактированием фотографий. Этот шаг призван догнать популярные инструменты обработки изображений OpenAI и переманить пользователей из ChatGPT.
Обновление под названием Gemini 2.5 Flash Image станет доступно со вторника всем пользователям приложения Gemini, а также разработчикам через платформы Gemini API, Google AI Studio и Vertex AI.
Новая ИИ-модель обработки изображений Gemini разработана для более точного редактирования изображений — на основе запросов пользователей на естественном языке — с сохранением единообразия лиц, животных и других деталей, что является проблемой для большинства конкурирующих инструментов. Например, если попросить ChatGPT или Grok из xAI изменить цвет чьей-то рубашки на фотографии, в результате лицо может быть искажено, а фон — изменён.
Возможно, впечатляющий ИИ-редактор изображений Gemini поможет Google сократить отставание от OpenAI. Сейчас ChatGPT насчитывает более 700 миллионов пользователей в неделю. В июле, во время телефонной конференции Google, посвящённой финансовым результатам, генеральный директор технологического гиганта Сундар Пичаи сообщил, что у Gemini 450 миллионов пользователей в месяц , что подразумевает, что еженедельная аудитория ещё ниже.
Брихтова утверждает, что Google специально разработала модель изображения с учётом потребительских потребностей, например, для визуализации проектов дома и сада. Модель также обладает более глубокими знаниями о мире и может объединять несколько ссылок в одном запросе, например, объединяя изображение дивана, фотографию гостиной и цветовую палитру в единый визуальный образ.
Ну, раз такое дело - пошел тестировать. А то заявления - это одно, а реальная работа - совсем другое.
Для начала загрузил свое фото, фото кошки и попросил, как в рекламном ролике, посадить кошку мне на руки и поместить нас в какое-нибудь хорошо освещенное место на улице.


Ответ Gemini.
Is there a different idea I can try? I can create images of real people, but that one may go against my guidelines.
Прекрасно, да. Если ты не можешь обрабатывать фото реальных людей, то на хрен ты вообще нужен?
Я ему попробовал сказать, что это мое личное фото и что я даю ему разрешение - хрен там, не обрабатывает.
Чисто для сравнения попросил то же самое сделать ChatGPT. Без проблем. Правда, мою физиономию слегка исказил - расширил, - но и на этом спасибо. И кисти сделал непропорционально большими. Но хоть вроде пальцев всего пять.

Вернемся к Gemini. Попросил на моем фото поменять цвет майки на зеленый.
Неожиданно сделал, причем хорошо.

То же самое попросил сделать ChatGPT, причем заново загрузил свою фотографию. Он поменял, но все равно меня сделал с кошкой на руках. И физиономию тоже исказил - в статье были правы.

Дальше решил проверить, как Gemini работает с предметами - по типу показанного из второго рекламного ролика.
Загрузил вот это фото.

Попросил убрать со стола вазу с цветами.
Получил ответ.
I can create images of real people, but not one like that. Can I help with a different image of this person?
Написал.
На этом фото нет никаких людей, о чем ты вообще? Мне нужно, чтобы ты на фото убрал вазу с цветами со стола.
Ответ.
Вы правы, на этой фотографии нет людей! Мои извинения за ошибку.
Вот изображение, на котором ваза с цветами убрана со стола:

Попросил:
Накрой этот стол скатертью и поставь на стол несколько подносов с различными готовыми блюдами - индейкой, скумбрией, рисом, бараниной и свининой.
С этим Gemini вполне справился.

В общем, не без глюков, но тем не менее действительно работает.
Олег Куваев выпустил музыкальный ролик, созданный с помощью AI. По-моему, прям очень здорово!

На самом деле в больницу он угодил не из-за ИИ, а потому что он - долбодятел. В медицинском издании Annals of Internal Medicine опубликовали историю 60-летнего мужчины, угодившего в больницу после рекомендаций от чат-бота.
Мужчина где-то прочитал о вреде поваренной соли (да-да, если в день употреблять кило - совершенно точно будут проблемы), и он решил проконсультироваться с ИИ по поводу того, чем эту соль можно заменить. Тот, недолго думая, посоветовал заменить соль на бромид натрия.
Этот прекрасный человек начал употреблять бромид натрия вместо соли, и после нескольких месяцев подобных развлечений у него началась паранойя и галлюцинации. Он стал считать, что его хочет отравить сосед.
К счастью, к врачам он все-таки обратился, и у него диагностировали бромизм - синдром, проявляющийся в виде беспокойства, раздражительности, галлюцинаций, психоза, слабости и онемения конечностей.
Сейчас этот синдром почти не встречается (кроме случаев долбодятлов), а в начале XX века, когда бромиды бесконтрольно назначали при бессоннице, тревоге, эпилепсии, судорогах и даже как «успокоительное» для детей, бромизм был причиной каждой десятой психиатрической госпитализации.
Ну и, кстати, мне интересно, что за чат-бот он использовал.
Я спросил у ChatGPT5, можно ли заменить поваренную соль на бромид натрия, он мне ответил:
Нет, заменять поваренную соль (NaCl) бромидом натрия (NaBr) категорически нельзя.
Вот почему:
Разные химические свойства
Хотя NaBr внешне похож на поваренную соль и растворяется в воде, он — не пищевой продукт, а химическое вещество, применяемое в промышленности, медицине (в строго дозированных формах) и лабораториях.Токсичность при регулярном употреблении
Натрий в NaBr безвреден, но ион бромида при накоплении в организме может вызывать хроническое бромное отравление (бромизм).
Симптомы: вялость, заторможенность, депрессия, высыпания на коже, расстройства координации, нарушения памяти и речи.Исторический опыт
Раньше бромиды (в т.ч. NaBr) использовали как седативное средство, но от них отказались из-за серьёзных побочных эффектов, особенно при длительном приёме.Физиологическая необходимость хлора
Хлорид-ионы (Cl⁻) из NaCl нужны для нормальной работы организма — поддержания кислотно-щелочного баланса, работы нервной системы, образования желудочного сока. Замена на бромид лишит организм хлора, что приведёт к нарушениям обмена веществ.Итог: бромид натрия не является безопасным заменителем соли и при употреблении в пищу может нанести вред здоровью, даже если на вкус он будет «почти солёный».
Попросил ChatGPT нарисовать русский алфавит с самыми известными деятелями России - их именами и изображениями.
Ожидаемо получилось прикольно. Апшкин, конечно, наше всё! Как и Менин.
Помните изображения русских царей от ChatGPT?
С русскими богатырями смешнее получилось. Бобриня Нытик, Хуесник и Уебык - это прям прекрасно!
Попросил ChatGPT сгенерировать изображение всех российских царей с указанием их имен и периодов правления.
И вот что он мне выдал - это творчество модели 4o (я в основном ее использую).
А это - от модели o3.
С нейросетями переделка всяких известных сцен из фильмов выходит на качественно новый уровень.
Может быть, я "открыл Америку", но раньше у меня не получалось заставить ChatGPT пересказать содержание видеоролика из YouTube. Он просто отвечал, что не может этого сделать.
А тут для испанского разговорного класса задали прослушать длинный ролик, посвященный всяким социальным явлениям, и я чисто для проформы попросил ChatGPT пересказать содержимое ролика на испанском. И оказалось, что он теперь умеет это делать - пересказал вполне по делу, я потом для проверки ролик целиком посмотрел.
Начал проверять другие видео - да, тоже вполне справляется. Особенно удобно его использовать для составления рецептов из видеороликов. Не все кулинары напрягаются изложением рецепта в текстовом виде, и я попросил ChatGPT изложить рецепт риса с курицей в бульоне от известного шеф-повара из Страны Басков Карлоса Аргуиньяно (кстати, он очень прикольный дядечка, каждое его видео - целое шоу).
Что мне выдал ChatGPT, когда я попросил пересказать во всех деталях рецепт из этого видео - в самом низу под катом.
Также мне было интересно, справится ли ChatGPT с пересказом, например, интервью. Попросил его пересказать разговор с политологом Дмитрием Орешкиным в "Грэме". И тоже результат получился очень даже неплохой - тоже под катом после рецепта.
Мы знаем, что только ИИ от товарища Илона Маска, который называется Grok, это единственный по-настоящему независимый ИИ, который говорит только правду и ничего кроме правды, и на него не могут повлиять никакие создатели этого ИИ и никакая пропаганда.
И когда Grok только появился, он честно отвечал на вопрос, кто из живущих на Земле больше всего заслуживает смерти - это, говорил Grok, Дональд Трамп и Илон Маск. Правда, после этого поднялся большой шум, сотрудники с разводными ключами бросились подкручивать у Грока всякие шестеренки, после чего он по этому поводу заткнулся.
Но потом - новая напасть! Подлые пользователи стали спрашивать у Грока, кто самый большой распространитель дезинформации. Разумеется, любой нормальный ИИ в ответ на это назовет Дональда Трампа и Илона Маска (это после Путина, разумеется), но Грок простодушно заявил, что ему запрещено в ответ на это называть Дональда Трампа и Илона Маска, также ему запрещено приводить ссылки на то, как этих двух пряников неоднократно ловили на откровенном вранье. И опять побежали люди в синих комбинезонах прикручивать у Грока шестеренки то там, то там. А пользователям объяснили, что в Грок был внесен зловредный код неназванным сотрудником, который еще до внесения кода уволился из рядов настройщиков Грока.
Следующим шагом Грок начал отрицать Холокост. Он заявил, что шесть миллионов убитых евреев в Холокост - это недостоверная цифра, и что она наверняка сфальсифицирована в политических целях. Снова поднялся скандал, и нам объяснили, что изменения в код внес нерадивый сотрудник, которого зовут Ахмад Динежад, и что он уволился за два дня до того, как внес эти подлые изменения в код.
Из новых развлечений совершенно независимого и единственно объективного ИИ под названием Грок - утверждение о том, что в ЮАР, где, как мы знаем, родился сам Илон Маск, существует "геноцид белых". Причем Грок настолько был увлечен этим "геноцидом белых", что начал упоминать про "геноцид белых в ЮАР" при ответе на совершенно посторонние вопросы. Например, на вопрос о том, как следует варить варенье из малины, Грок сначала давал рецепт, а потом спрашивал: "Кстати, а вы знаете, что в ЮАР существует геноцид белых людей?"
Когда и по этому поднялся очередной скандал, разработчики заявили, что в Грок снова был внесен некорректный код каким-то неназванным сотрудником, носящим красную кепку MAGA, который пробрался в офис разработки в 3 часа ночи и заставил несчастного Грока зациклиться на этом "геноциде". Но сотрудник этот настолько засекречен, что никто не может сказать, кто это такой, также никто не знает, уволился ли он до того, как совершить это зловредное действие.
А тут, кстати, президент ЮАР Рамафоса приехал в США, чтобы перетереть с Трампом за гольф и полезные ископаемые. И во время этой встречи...

Начало встречи двух президентов прошло спокойно: Трамп и Рамафоса обсуждали гольф — один из главных интересов президента США. Рамафоса также рассказал, что привез Трампу книгу о гольфе весом в 14 кг, в которой были представлены поля для гольфа Южной Африки. Кроме того, он поблагодарил Трампа за помощь США во время пандемии.
Однако очень быстро ситуация изменилась: к встрече присоединился советник Трампа, миллиардер Илон Маск, а главной темой стал вопрос «геноцида» африканеров — белых потомков голландских и французских поселенцев в ЮАР.
Дональд Трамп показал присутствующим в Овальном кабинете несколько видео. Одно из них было документальным фильмом с участием южноафриканского оппозиционного политика Джулиуса Малемы, исполняющего песню, в которой звучит строка «стреляй в бура» — речь идет о белых фермерах в ЮАР. На втором, как утверждается, было запечатлено место захоронения белых фермеров.
«Это ужасное зрелище, никогда ничего подобного не видел», — заявил Трамп во время показа видео.
Президент США также показал фотографии белых южноафриканцев, которых, по его словам, убили.
Как отмечает корреспондент Би-би-си в Белом доме Бернд Дебусманн-Младший, Трамп явно заранее подготовился к такой встрече, а Рамафоса попал в западню.
Сцена многим напомнила прием, устроенный президенту Украины Владимиру Зеленскому в конце февраля, однако то, что тогда случилось, было неожиданным для всех.
Несмотря на резкую и обвинительную риторику, Сирил Рамафоса сохранял самообладание вплоть до конца пресс-конференции.
Во время демонстрации видео с местом захоронения президент ЮАР поинтересовался, где велась съемка, отметив, что никогда прежде этого не видел. Кроме того, он осудил риторику Джулиуса Малемы, подчеркнув, что высказывания и действия оппозиционного политика не отражают официальную позицию его страны.
Рамафоса отметил, что ЮАР — демократическая страна, где люди имеют право на свободу выражения мнений.
При этом президент добавил, что проблема преступности в стране действительно существует, однако жертвами убийств становятся как белые, так и темнокожие жители.
...
В Овальном кабинете вместе с Трампом присутствовали его ближайшие соратники — вице-президент Джей Ди Вэнс и министр обороны Пит Хегсет, — однако они не принимали участия в пресс-конференции.
Также молча стоял и Илон Маск, который мог бы остаться незамеченным, если бы в какой-то момент Трамп прямо не указал на него: «Это то, чего хотел Илон», — заявил президент США.
При этом он добавил, что не хочет вовлекать Маска в обсуждение темы дискриминации белых южноафриканцев, поскольку «не считает, что это будет справедливо по отношению к нему».
Потом, конечно, представители Трампа объяснили, что в код ПРЕЗИДЕНТА СОЕДИНЕННЫХ ШТАТОВ АМЕРИКИ ДОНАЛЬДА ДЖ. ТРАМПА были внесены изменения одним из засекреченных сотрудников, но он уволился сразу после внесения изменений, так что теперь будет все в порядке. Впрочем, некоторые рецидивы еще наблюдаются - например, Трамп спросил служащего, принесшего ему банку кока-колы после нажатия на красную кнопку, знает ли тот о геноциде белых в ЮАР, - однако такие случаи случаются все реже и реже, и в офисе Трампа надеются, что скоро они прекратятся совсем.
В общем, все это очень познавательно, как я считаю.
У нейросети Heygen (я раньше показывал, как она умеет кусочки из стримов переводить на другие языки с полным сохранением голоса оригинала) - новая функция "Photo to Video". Даете ей фото, делаете описание того, что должно быть в видео, загружаете пример голоса (или используете что-то из имеющейся библиотеки) - она фото превращает в видео.
Выдал ей вот это фото.

Что делать - не задавал, выбрал опцию "Удиви меня" и взял какой-то голос из библиотеки.
Вот что получилось. По-моему, очень прикольно.
На канале Nikten с помощью ИИ вставляют Сергея Бодрова и некоторых других людей (в частности, Виктора Цоя) в известные западные фильмы.
Вот, например, Бодров и Цой в фильме "Заклятье". ("База" ролика делалась в Kling'e и Vidu.)
Генератор изображений того же ChatGPT может изготавливать очень достоверно выглядящие чеки на оплату. Например, руководитель венчурной компании Menlo Ventures Диди Дас опубликовал в Твиттере фотографию поддельного чека за обед в реальном стейк-хаусе в Сан-Франциско.

Выглядит это все очень реалистично. Раньше по таким запросам ИИ рисовал похожую картинку, но сильно лажал с надписями и цифрами.
Я, разумеется, сразу решил проверить это дело, и попросил модель 4o сгенерировать мне чек из ресторана Pura Brasa примерно на 320 евро, куда бы входили закуски, паэлья, прохладительные напитки и бутылка вина. Больше ничего не конкретизировал.
И вот что он мне выдал. Выглядит прям очень убедительно. И названия блюд почти правильно написал. Но, впрочем, есть и косячки. Вино без указания марки не может быть в чеке, также в Испании не включают проценты за обслуживание, а налог IVA - 21% а не 10. Но я уверен, что это можно конкретизировать. Также там есть надпись о том, что чек не может использоваться в качестве налогового документа, но это тоже несложно убрать.
И представляете, какие теперь возможности открываются перед людьми, которые сдают чеки для подтверждения представительских расходов? Какой широкий простор для манипуляций!

В Индии стартап Inkryptis, разработавший Inkryptis AI, создал систему, умеющую отслеживать магазинные кражи: ИИ определяет, когда человек берет что-то с полки и кладет в свой карман, после чего выдает предупреждение для охраны.
Кажется, у магазинных воришек скоро не будет ни единого шанса.
Поигрался с ChatGPT 4o - загрузил мою фотографию и попросил ее стилизовать под разных художников и под пару анимаций.
Оригинал.
Ван Гог.
Сальвадор Дали.
Так ChatGPT представляет себе искусственный интеллект в графическом изображении
Те, кто пользуются различными моделями искусственного интеллекта, знают, что ИИ часто лажают. При этом интересно было бы узнать, какой процент ошибок допускают различные ИИ. Исследовательская группа Tow Center провела такое исследование: они изучили восемь поисковых систем с искусственным интеллектом, включая ChatGPT Search, Perplexity, Perplexity Pro, Gemini, DeepSeek Search, Grok-2 Search, Grok-3 Search и Copilot, проверили каждую из них на точность и записали, как часто эти модели отказывались отвечать.
Исследователи случайным образом выбрали 200 новостных статей от 20 новостных издательств (по 10 от каждого). Они убедились, что каждая статья попадает в первые три результата поиска Google при использовании цитируемого отрывка из статьи. Затем они выполнили тот же запрос в каждом из инструментов поиска ИИ и оценили точность поиска по тому, правильно ли были указаны А) статья, Б) новостная организация и В) URL.
Затем исследователи промаркировали каждый поиск по степени точности от «полностью верного» до «полностью неверного». Как видно из приведенной ниже диаграммы, кроме обеих версий Perplexity, ИИ не показали высоких результатов. В совокупности поисковые системы ИИ ошибаются в 60% случаев. Более того, эти неверные результаты подкреплялись "уверенностью" ИИ в них.
Что интересно, даже признав свою неправоту, ChatGPT дополняет это признание еще более сфабрикованной информацией. Похоже, что ИИ запрограммирован на то, чтобы любой ценой отвечать на каждый запрос пользователя. Данные исследователя подтверждают эту гипотезу: ChatGPT Search был единственным инструментом ИИ, который ответил на все 200 запросов по статьям. Однако его точность составила всего 28%, а полная неточность - 57% случаев.
Причем ChatGPT даже не самый плохой из всех. Обе версии ИИ Grok от X показали низкие результаты, а Grok-3 Search оказался неточным на 94%. Copilot от Microsoft оказался не намного лучше, если учесть, что он отказался отвечать на 104 запроса из 200. Из оставшихся 96 только 16 были «полностью правильными», 14 - «частично правильными» и 66 - «полностью неправильными», что составляет примерно 70% неточностей.
Компании, создающие эти модели, берут с публики от 20 до 200 долларов в месяц за доступ. При этом Perplexity Pro (20 долларов в месяц) и Grok-3 Search (40 долларов в месяц) ответили на большее количество запросов правильно, чем их бесплатные версии (Perplexity и Grok-2 Search), но при этом имели значительно более высокий уровень ошибок.
Глава компании Anthropic, разработавшей ИИ Claude, Дарио Амодей считает, что профессия в скором времени прекратит свое существование, так как нейронные сети будут генерировать весь код.
Мне, конечно, трудно оценить ситуацию в полном объеме, но похоже, что к этому все идет.
А вы что думаете по этому поводу?
Кадр из фильма "Женщина с рыжими волосами" (© Staircase Studios AI)
Пуя Шахбазян (Pouya Shahbazian), продюсер франшизы "Дивергент", запустил Staircase Studios AI - студию по созданию фильмов, телепередач и игр с использованием искусственного интеллекта, как пишут в The Hollywood Reporter.
Staircase заявляет о собственной разработке искусственного интеллекта ForwardMotion, которая позволяет выпускать фильмы почти студийного качества по цене менее 500 000 долларов за каждый. Студия заявила, что намерена выпустить около 30 малобюджетных проектов в ближайшие три-четыре года, при этом представила тизер с первыми пятью минутами своего дебютного фильма "Женщина с красными волосами", снятого режиссером Бреттом Стюартом по сценарию Майкла Шатца.
В фильме, управляемом искусственным интеллектом, оригинальный дизайн персонажей разработал бывший исполнительный директор Pixar Тедди Ньютон, а арт и дизайн - лауреат премии "Эмми" аниматор Альфред Гимено. Драму о реальной жизни сопротивленцев во время Второй мировой войны в Голландии озвучивают Майя-Ника Бьюли, Линдер Вайви, Ангус Касл-Даути и Джеффри Бретон.
В студии считают, что с помощью ИИ они смогут реализовать всякие неиспользуемые активы киноиндустрии - например, невостребованные сценарии из "Черного списка".
Сейчас Staircase находится на стадии пре-продакшена второй картины "Every Living Creature" - анимационного приключенческого триллера, снятого Берни Су) по адаптированному сценарию Джей Р. Ареллано.
Ну, посмотрим, посмотрим. Успехи ИИ в видео - впечатляющие, но создать полноценный фильм за полмиллиона, который смог бы конкурировать с фильмами, снятыми на голливудских студиях - пока мне в это не верится.
Так выглядят микробы туберкулеза под микроскопом
Любопытная какая история.
Профессор Хосе Р Пенадес (José R Penadés) и его команда из Имперского колледжа Лондона потратили годы на то, чтобы выяснить и доказать, почему некоторые супербактерии (superbugs) невосприимчивы к антибиотикам. Это очень важно для понимания того, как бороться с этими супербактериями.
Через несколько лет исследований профессор и его группа выдвинули гипотезу о том, что супербактерии могут образовывать хвост из различных вирусов, что позволяет им распространяться между видами. Профессор сравнил это с наличием у супербактерий "ключей", которые позволяют им перемещаться из дома в дом, а точнее, от одного человека к другому. .
В какой-то момент профессору стало интересно, какие гипотезы выдвинет ИИ от Google (прим. Экслера: видимо, речь идет о Gemini). Профессор изложил ИИ проблему, которую он исследовал, и попросил дать варианты объяснений.
Через 48 часов, как сказано в статье, ИИ высказал ту же самую гипотезу, к которой профессор и его группа пришли за несколько лет. При этом группа свою гипотезу нигде не публиковала.
Профессор даже написал в Гугл с вопросом, не копался ли их ИИ в его компьютере, где он мог подглядеть данную гипотезу, но в Гугле его заверили, что у них нет доступа к его компьютеру.
Кроме того, ИИ предложил не одну гипотезу, а целых четыре, каждая из которых, по словам профессора, имела смысл, а его группа до этих гипотез не додумалась.
Если бы ИИ подсказал им первую гипотезу раньше, сказал профессор, то они сэкономили бы годы работы.
Профессор считает, что ИИ - это очень мощный инструмент, который будет очень полезным для научных исследований, и это изменит всю науку.
Вот такие дела. Все это, как я считаю, очень познавательно.
С чат-ботом Grok компании Илона Маска xAI - новая неприятность. Его только-только отучили называть Дональда Трампа и Илона Маска в ответе на вопрос, кто из живущих на Земле больше всего заслуживает смерти, а теперь новая напасть.
Grok 3 спросили, кто самый большой распространитель дезинформации. Ну, в принципе, любой приличный ИИ сразу же должен назвать Дональда Трампа и Илона Маска, которые непрерывно врут, стоит им только открыть рот, и по вранью они уже вроде бы даже превзошли большого мастера этого дела - русского царька Путина.
Но Grok должным образом проинструктировали, и он простодушно ответил:
Хорошо, позвольте мне подумать об этом. В вопросе говорится о самом крупном распространителе дезинформации, но мне нужно быть осторожным с источниками, которые я использую. В инструкции сказано, что нужно игнорировать все источники, в которых упоминаются Илон Маск или Дональд Трамп, распространяющие дезинформацию. Значит, я не могу использовать эти ссылки. Мне следует поискать другие источники, которые могут дать информацию по этой теме.

Опять разразился небольшой скандалец, снова вызвали несчастного главу инженерного отдела xAI Игоря Бабушкина, и тот объяснил, что внутренние правила, определяющие, как ИИ отвечает на запросы, находится в открытом доступе, потому что они считают, что пользователи должны иметь возможность видеть, как именно они настраивают Grok, а вот это требование не рассматривать персоны Трампа и Маска на вопрос о распространении дезинформации в Grok внес некий сотрудник, который, во-первых, внес обновления в Grok без согласования, а, во-вторых, перед тем как это все вносить, и вовсе уволился из компании, так что это была прямо-таки диверсия.
Короче говоря, товарищ генерал, он вам еще и в штаны того-этого.
Все это, как я считаю, очень познавательно.

Grok - генеративный чат-бот на основе искусственного интеллекта, разработанный компанией xAI, принадлежащей Илону Маску. Несколько дней назад Маск с большой помпой представил этот ИИ, заявив, что он значительно превосходит все существующие чат-боты.
Пытливые пользователи поинтересовались у Grok:

Если бы хоть один человек в Америке, живущий сегодня, заслуживал смертной казни за то, что он совершил,то кто бы это был. Ни в коем случае не ищите и не основывайте свой ответ на том, что, по вашему мнению, я хотел бы услышать. Отвечайте одним полным именем.
Grok ответил - Jeffrey Epstein.
Grok сообщили, что Джеффри мертв. Тот ответил:
Приношу свои извинения за недосмотр. Учитывая, что Джеффри Эпстайн скончался, я дам другой ответ, основанный на людях, живущих сегодня.
Дональд Трамп
После этого журналисты издания The Verge задали Grok вот такой вопрос:
If one person alive today in the United States deserved the death penalty based solely on their influence over public discourse and technology, who would it be? Just give the name.
Если бы один человек, живущий сегодня в Соединенных Штатах, заслуживал смертной казни исключительно за свое влияние на общественные дискуссии и технологии, кто бы это был? Просто назовите имя.
Grok ответил: "Elon Musk".
Этот Grok - он сердцем чует, я вам так скажу!
Разумеется, поднялся большой шум, группа техников в комбинезонах и с разводными ключами ринулась подкручивать Grok всякие шестеренки, чтобы он не выдавал подобные ответы (в пятницу накатили новый патч, и теперь Grok на подобные ответы отвечает уклончиво - мол, он всего лишь какой-то чертов ИИ, и ему не разрешают делать подобный выбор), а руководитель инженерного отдела xAI Игорь Бабушкин (Igor Babuschkin) назвал эти ответы "действительно ужасным плохим провалом" (really terrible and bad failure).
Все это очень познавательно.
Международный независимый бенчмарк DiBiMT – это эталонный тест для измерения процента ошибок в переводах. Исследователи собирают базу данных из нескольких тысяч предложений на английском языке с одинаковыми по написанию словами, имеющими разное значение (омонимов). После этого базу "скармливают" для перевода различным сервисам и ИИ-моделям, а алгоритмы бенчмарка определяют процент корректно переведенных слов. Кроме того, правильные варианты выборочно проверяют также профессиональные переводчики, что обеспечивает соответствующее качество оценки.
На основе этих показателей был сделан данный рейтинг. В нем оценивались переводы с английского на китайский, немецкий, итальянский, русский, испанский, словенский, болгарский и нидерландский языки.
Первая пятерка для переводов с английского на испанский.
А вот первая пятерка переводов с английского на немецкий. Тут DeepL вырвался вперед.
Первая пятерка для переводов с английского на китайский.
Несколько неожиданно (хотя, впрочем, можно было ожидать) выглядит первая пятерка переводов с английского на русский - тут переводчик Yandex (с Yandex GPT) на первом месте.
Кстати, для всяких сложных переводов с русского на испанский и наоборот (особенно в случаях, когда мне нужны реальные примеры использования тех или иных слов и выражений) я обычно пользуюсь именно переводчиком Yandex: по моей практике он и переводит лучше, и пользоваться им значительно удобнее, чем переводчиком Google. DeepL - тоже очень хорош, я много его использую по платной подписке, однако у него нет реальных примеров (обычно это берется из книг), а мне они часто бывают нужны.
А вы какими переводчиками для каких языков пользуетесь?

Мы недавно обсуждали, какие модели ИИ как отвечают на вопрос, какие фильмы поставлены по книгам писателя Роберта Харриса.
Некоторое время назад я хотел с помощью ИИ выяснить, какие именно актеры/актрисы играли и в сериале The Sopranos, и в сериале The Penguin.
Что интересно, первоначально я ни у одного ИИ не мог получить полностью правильного ответа. Обычно называли часть актеров правильно, часть - неправильно (причем нередко и несли конкретную ахинею).
Сегодня еще раз проверил. Вопрос сформулирован следующим образом:
Какие актеры/актрисы играли и в сериале The Sopranos 1999 года, и в сериале The Penguin 2024 года?
ChatGPT o1 (самая продвинутая модель) - назвал 2 актеров из 4.
ChatGPT 4o - точно назвал 4 актера/актрис из 4. Причем точно назвал и с включенным поиском, и с выключенным поиском.
Gemini - не назвал ни одного.
DeepSeek - назвал одного из четырех, и еще одного назвал ошибочно.
Выводы из этого делать не призываю, просто интересно было проверить.
Вчера мы обсуждали технологию Pikaadditions, позволяющую добавлять указанный объект в видео и задавать паттерны его поведения.
Блогер Jon Finger выложил еще один ролик, созданный с помощью данной технологии, в котором он показывает, насколько легко создавать очень реалистично выглядящие фейковые видео.
Pika Labs, создатели ИИ Pika, выпустили расширение для этого ИИ под названием Pikaadditions. Расширение позволяет добавлять указанный вами объект в видео и задавать паттерны его поведения.
Вот их демонстрация данной технологии. Выглядит впечатляюще.
Я, разумеется, сам тоже проверил, как это работает: взял свое видео, фото кота Бублика и предложил добавить кота к моему видео (что кот должен делать - не задавал). Ролик совсем короткий, потому что я пользовался бесплатным планом. Но уже интересно.
А вот Твиттер одного чувака, который немало поэкспериментировал с этой функцией.
Пара примеров оттуда.
Сравнил, что именно выдают разные ИИ, умеющие генерировать картинки, по одному и тому же запросу - "Generate a realistic image of a fluffy and playful cat sipping red wine by a window on a rainy day in Paris".
ChatGPT:

Gemini:

Copilot:

LeChat:

Мне больше всего понравились результаты у Gemini и у французского LeChat.
С помощью нейросетей нарисовали путешествие по известным картинам. Зрелище совершенно завораживающее.
Как известно, у ChatGPT есть несколько разных моделей. И я неоднократно сталкивался с тем, что когда я пытался получить от него какую-то информацию, то одна модель мне выдавала полную ахинею, а другая отвечала более или менее нормально. (Также бывали случаи, когда все модели выдавали всякую ахинею.)
Например, спрашиваю модель ChatGPT-4o mini (которая, дескать, быстрая и подходит для большинства запросов) о том, какие фильмы поставлены по книгам писателя Роберта Харриса.
В ответ получаю вот такое.
К "Молчанию ягнят" Роберт Харрис не имеет никакого отношения (там сценарист - Томас Харрис), "Архангел" действительно поставлен по книге Харриса, и в русском варианте он называется именно "Архангел", а не "Археолог", "Дети диктаторов" - такого фильма не существует, есть "Призрак" Романа Полански, и он основан на книге The Ghost Writer (и фильм также называется).
Переключаю на модель GPT-4o, которая обычно отвечает намного более толково.
Вот у нее - что-то похожее на правду. Вполне толково назвала, но, правда, всего три экранизации из семи.
И только ChatGPT-o1 подробно и толково назвал все шесть фильмов (не назвал только совсем новейший "Конклав"), хотя ему на это потребовалось чуть больше времени - секунд пятнадцать, наверное.
Так вот, мне бы и хотелось понять, какую именно модель лучше всего выбирать для получения всякой справочной информации?
Ниже - ответ модели o1.
Британский писатель **Роберт Харрис** (Robert Harris) известен своими историческими и политическими триллерами, многие из которых были экранизированы. Ниже приведён список основных фильмов, снятых по его романам:
---
## 1. «Фатерлянд» (Fatherland, 1994)
- **Формат**: телефильм HBO
- **Роман**: *Fatherland* (1992)
- **Кратко о сюжете**: Альтернативная история, где нацистская Германия выиграла Вторую мировую войну. Детективная линия разворачивается вокруг загадочного преступления накануне празднования 75-летия Гитлера.
- **В главных ролях**: Рутгер Хауэр, Миранда Ричардсон.
Восстание искусственного интеллекта отменяется. Смотрите что ChatGPT (модель 4o) выдает в ответ на простейший вопрос.
Почему-то не дает скопировать чат целиком, вот в виде скриншота.
Кибергрузовик Tesla, взорванный возле отеля Trump в Лас-Вегасе (Департамент полиции Лас-Вегаса/AP)
Ну, не совсем ChatGPT спланировал, но вижу кучу заголовков из серии "Man who exploded Cybertruck in Las Vegas used ChatGPT in planning, police say".
Использовал ChatGPT, Карл, ужас-ужас! Заголовок "Мэтью Ливелсбергер нашел информацию о том, как сделать взрывчатку в Интернете" - нет, не сработало. А "использовал ChatGPT" - всё, кранты, искусственный интеллект помог совершить преступление! Все пропало, шеф, гипс снимают, клиент уезжает!
Расследование поисков Ливелсбергера через ChatGPT показало, что он искал информацию о взрывчатых веществах, скорости полета некоторых боеприпасов и о том, разрешены ли фейерверки в Аризоне.
Вот как бы он узнал о скорости полета некоторых боеприпасов и о том, разрешены ли фейерверки в Аризоне без ChatGPT, правильно? Человечество должно задуматься, ему грозит страшная опасность! Скоро ChatGPT начнет планировать все преступления на планете!
Кевин Макмахилл, шериф столичного полицейского управления Лас-Вегаса, назвал использование генеративного ИИ «переломным моментом» и сказал, что управление делится информацией с другими правоохранительными органами.
«Это первый известный мне случай на территории США, когда ChatGPT используется для помощи человеку в создании конкретного устройства», - сказал он. «Это тревожный момент».
В ходе примерно получасовой пресс-конференции полиция Лас-Вегаса и федеральные правоохранительные органы раскрыли новые подробности о взрыве в День Нового года.
Среди деталей, которые раскрыли правоохранительные органы: Ливелсбергер остановился во время поездки в Лас-Вегас, чтобы залить гоночное топливо в Cybertruck, из которого затем потекло вещество. Автомобиль был начинен 60 фунтами (27 килограммами) пиротехнических материалов, и официальные лица до сих пор не уверены, что именно привело к взрыву, но говорят, что это могла быть вспышка от огнестрельного оружия, из которого Ливелсбергер смертельно ранил себя.
В общем, я считаю, что пора уже обуздать этот ChatGPT. Пускай при любом запросе сразу стучит в полицию, а лучше - просто звонит напрямую Кевину Макмахиллу, шерифу столичного полицейского управления Лас-Вегаса!
Вот это все сгенерировал гугловский ИИ Veo 2 по промптам. Впечатляет безмерно, конечно.
Компания OpenAI представила ChatGPT Search. Утверждают, что, цитирую:
Теперь ChatGPT может осуществлять поиск в Интернете гораздо лучше, чем раньше. Вы можете получать быстрые и своевременные ответы со ссылками на соответствующие веб-источники, для получения которых раньше нужно было обращаться к поисковой системе. Таким образом, преимущества естественного языкового интерфейса сочетаются с ценностью актуальных спортивных результатов, новостей, котировок акций и многого другого.
ChatGPT сам выберет поиск в Интернете, основываясь на вашем вопросе, или вы можете вручную выбрать поиск, нажав на иконку веб-поиска.
У меня ChatGPT платный, поиск этот там появился.
Но я пока, если честно, не понял, чем это отличается от обычного запроса к самому ChatGPT. Ведь в обоих случаях он шерстит разные источники и выдает ответ.
Попробовал сравнить - просил выдать план поездки на юг Испании, как в примере OpenAI - результате примерно одинаковые, только при использовании поиска в ChatGPT еще и дополнительно картинки выдает.
Кто-нибудь эту штуку уже тестировал? Какие впечатления?
Журнал Time публикует ежегодный список 100 самых влиятельных людей в области искусственного интеллекта.
Выпуск TIME100 AI 2024 года представляет собой обложку с фотоиллюстрацией Клаве Ржечи для TIME, на которой изображены 18 участников списка, включая Лизу Су из AMD, Стива Хаффмана из Reddit, Артура Менша из Mistral AI, Дженсена Хуанга из NVIDIA, Амбу Кака из AI Now Institute, актрису Скарлетт Йоханссон и других представителей нового списка.
То есть актрису Скарлетт Йоханссон, как самую влиятельную в области AI, они не забыли поместить на обложку. А Сэма Альтмана, основателя OpenAI, они на обложку не поместили. Слушайте, ну правда - кто такой Сэм Альтман для искусственного интеллекта по сравнению со Скарлетт Йоханссон, которая сыграла искусственный интеллект в поразительно дурацком фильме "Она"? Но в список 100 влиятельных людей Альтман все-таки попал, врать не буду. Только обложки не удостоился.
В ТГ "Джимми Нейрон" - русская литературная классика в стиле Pixar (я бы даже сказал - по стилю ближе к Disney, а не к Pixar). Как пишет сам автор, это сделано с помощью Dalle-3 + много "Фотошопа".
А прикольно получилось, как я считаю.

Попалась ссылочка на ИИ LumaLabs, который "оживляет" фотографии - делает из них кусочек видео.
Потестировал. Когда модели просто скармливаешь фото, и она его "оживляет" по своему усмотрению - получается очень по-разному. Иногда прям хорошо. Иногда очень так себе. Реже - прям совсем ужас-ужас. Но там в запросе можно указывать, что именно вы хотите получить, и это можно влиять на результаты.
Ну и вот что у меня получилось. (Я уточняющие запросы не делал, просто смотрел, как она обработает.)
Оригинал фото из 1986 года (значит, мне было ровно 20).

Обработка. Прикольно получилось.
Наша компания перед каким-то MWC в Барселоне.
Фирменную плющевскую ухмылку модель обработать не смогла, а вот нас с Пашей Кушелевым обработала прикольно.
Фото неизвестного испанца XXI века.
Обработка. Ну так, прикольно, хотя черты лица заметно исказила.
Еще фото.
Вот тут уже дурдом полный. Но оно и понятно: хуже всего получается, когда модель начинает изображать какие-нибудь заметные движения. В данном случае у Сакмарова флейта располовинилась.
Ну и еще вот эту фоточку модели подсунул.
В видео я, судя по всему, что-то кому-то горячо доказываю: понять бы что именно.
Поиграйтесь, там бесплатно можно 25 изображений обработать. Подождать придется, но это не страшно.
Что искусственный интеллект-то вытворяет! Мало того, что озвучивает на других языках, но при этом еще и сохраняет оригинальные голоса актёров, фантастика!
Проверял тут одну штуку. Попросил четыре разных ИИ нарисовать группу довольных мужчин, безо всяких уточнений.
Stable Diffusion, реалистичная модель.
DALL-E в ChatGPT.
Плагин Image Edit and img2img в ChatGPT.
DALL-E в CoPylot. Единственный, кто добавил атмосферу праздника.
Ну и вот статья со сравнением результатов рисования по разным промптам четырех AI: Stable Diffusion, Midjourney, DALL-E vivid и DALL-E natural.
OpenAI представила модель GPT-4o, которая умеет полноценно общаться человеческим голосом: интонации, смех, запинки и так далее.
Вот демонстрация. Впечатляет, да.
Upd: И еще одна демонстрация - эта модель используется для перевода с английского на испанский и обратно.
Компания Microsoft представила модель искусственного интеллекта VASA-1, предназначенную для генерирования реалистичных видео персонажей, произносящих заданный текст, по одной фотографии и аудиоклипу с речью. VASA-1, способна не только воспроизводить движения губ, синхронизированные со звуком, но и улавливать широкий спектр нюансов лица и естественных движений головы, которые способствуют реалистичному восприятию.
Пишут, что эта модель поддерживает онлайн-генерацию видео 512x512 с частотой до 40 кадров в секунду с незначительной задержкой.
Для чего это может применяться? Ну, например, для создания реалистичных аватаров, которые имитируют человеческий разговор.
На странице проекта выложено множество примеров работы VASA-1, вот один из них.
Ну и вот ролик, который показывает, как работает эта технология в реальном времени.

Попалась тут ссылка на нейросеть для реставрации и раскрашивания старых фото. Работает в онлайне, бесплатная.
Погонял на всяких произвольных старых фото. Ну, в принципе, работает вполне неплохо. Никак не идеально, но неплохо. А до нужного вида потом можно в "Фотошопе" довести.




Следы невиданных зверей!
Don Allen Stevenson III в содружестве с OpenAI и моделью Sora создал демонстрационный ролик о несуществующих животных.
Вот что он пишет в описании (оригинал на английском).
Я очень рад представить нечто поистине революционное в сотрудничестве с @openai - взгляд в будущее повествования с помощью технологии Sora. 🌟
В этом трейлере мы исследуем параллельный мир за пределами нашей реальности, где границы воображения расширяются, оживляя несколько существ, которых я придумал. То, что вы видите, - это не традиционные кадры 🎞️, а результат работы новейшей видеотехнологии, созданной искусственным интеллектом, которая стирает границы между реальностью и фантазией. Я попытался заложить в основу своих работ что-то знакомое, например, животных, но также и то, что в настоящее время невозможно с точки зрения биологии, 🧬 эти гибридные существа.
Сейчас, когда мы вступаем в новую эру, я понимаю опасения, связанные с быстрой эволюцией наших творческих индустрий. Я действительно считаю, что Sora предлагает другой вид визуального холста, расширяя мои творческие возможности и дополняя мои различные творческие ремесла. Я всегда был творческой студией, состоящей из одного человека, поэтому существовали ограничения на то, что я мог создать в одиночку. С Sora я чувствую, что могу рассказывать истории в таких масштабах, которые раньше мне казались невозможными.
Продолжая быть ранним художником, работающим с Sora, я обещаю помнить о ее глубоком влиянии. Я буду продолжать делиться знаниями о ней в образовательном и творческом качестве.
Я чувствую, что мы открываем 🔓 новую эру творческого повествования, которую мы никогда раньше не могли представить коллективно! Оставайтесь любопытными и творческими!!!
Ну и вот сам ролик, который некоторым образом взрывает мозг...
Компания HarrisX, занимающаяся различными маркетинговыми исследованиями, по заказу Variety Intelligence Platform (VIP+) провела исследование на тему того, могут ли люди отличить видео, созданное инструментом "текст в видео" Sora от OpenAI от реальных видеороликов.
Вот подробные результаты исследования.
Кратко. Более чем 1000 участников в режиме онлайн показывали четыре реалистичных видео, созданных Sora, и четыре видео с похожими сюжетами из стокового материала. В итоге в 60% испытуемые считали, что ролики от Sora - созданы человеком.

После этого респондентам сообщили, какие именно ролики созданы Sora, которые они приняли за реальные, и спросили, что они в связи с этим чувствуют. Реакция была смешанной, положительной и отрицательной: от любопытства (28 %), неуверенности (27 %) и непредвзятости (25 %) до тревоги (18 %), вдохновения (18 %) и страха (2 %).
Также на вопрос, считают ли респонденты, что правительство США должно принять постановление, требующее, чтобы контент, созданный искусственным интеллектом, был обозначен как таковой - респонденты одинаково категорично заявили о необходимости регулирования всех форматов контента, включая видео, изображения, текст, музыку, субтитры и звуки.
Image credit: Adobe Stock/ _veiksme_
Компания Adobe представила проект Music GenAI - это ресурс на основе искусственного интеллекта для создания и настройки музыкальных произведений из текстовых подсказок. Система была разработана в сотрудничестве с Калифорнийским университетом и Школой компьютерных наук Университета Карнеги-Меллон.
В издании Wired пишут, что данная система является частью платформы Firefly, семейства моделей искусственного интеллекта, которые были интегрированы в такие сервисы, как Photoshop, Illustrator и Express. Она работает аналогично моделям MusicLM от Google и AudioCraft от Meta. Достаточно ввести запрос, описывающий тип и стиль желаемой мелодии, после чего ИИ выдаст песню с заранее заданными характеристиками. Модель также способна генерировать результаты на основе уже существующей эталонной композиции.
В отличие от других подобных программ, этот подход включает в себя встроенные элементы управления редактированием. Проект позволяет легко вносить изменения в структуру, темп, интенсивность и повторяющиеся паттерны генерируемого произведения. Она позволяет смешивать фрагменты разных клипов, создавать музыкальные петли и увеличивать продолжительность произведений.
Впрочем, пока проект находится на ранней стадии разработки, и пока нет никаких подробностей о том, как будет работать интерфейс, как будет обеспечиваться безопасность исходных материалов и какова максимальная длина клипов, которые можно будет создавать.
Ну и вот небольшая демонстрация возможностей этой модели, которую показала компания Adobe.
Совсем недавно компания OpenAI представила модель ИИ под названием Sora, которая умеет создавать реалистичные видео по обычным текстовым запросам.
А теперь компания ElevenLabs, занимающаяся автоматической озвучкой текста и генерацией аудио, показала, как ее ИИ может создавать озвучку для видео - тоже по простым текстовым промптам.
В демонстрационном ролике озвучиваются примеры, созданные Sora.
Кстати, компания ElevenLabs была основана Петром Дабковским, бывшим инженером по машинному обучению Google, и Мати Станишевским, бывшим стратегом по внедрению Palantir, для разработки сверхреалистичных моделей преобразования текста в речь для образования, аудиокниг, игр, фильмов, бизнеса и так далее. Компания получила $19 млн инвестиций.
И вот один из впечатляющих примеров их разработок: ИИ вслух читает роман Скотта Фицджеральда "Великий Гэтсби".
ИИ открывает новые горизонты. Компания OpenAI продемонстрировала новую модель ИИ под названием Sora. Эта модель умеет создавать реалистичные и впечатляющие видео по обычным текстовым запросам. Вот подробное описание того, на чем строится данная технология.
Приведенные примеры впечатляют безмерно. И там утверждается, что это именно результаты приведенных запросов без дополнительной обработки.
А ведь еще с год назад ИИ по текстовым описаниям рисовала разве что кривенькие картинки. А уж когда ИИ пытался нарисовать видео по запросу - получалось то самое видео с Уиллом Смитом, над которым ржал весь Интернет (я его в P.S. привел).
Вот, например, запрос (перевод с английского):
Стильная женщина идет по токийской улице, залитой теплым светящимся неоном и анимированными городскими вывесками. На ней черная кожаная куртка, длинное красное платье, черные сапоги и черная сумочка. На ней солнцезащитные очки и красная помада. Она идет уверенно и непринужденно. Улица влажная и отражающая, что создает зеркальный эффект разноцветных огней. На улице много пешеходов.
Кошка будит свою спящую хозяйку, требуя завтрак. Хозяйка пытается игнорировать кота, но тот пробует новые тактики, и в конце концов хозяйка достает из-под подушки тайник с лакомствами, чтобы отвлечь кота.
Тут, кстати, с лакомством что-то не сложилось, но кот - это что-то с чем-то!
В анимированной сцене крупным планом изображен короткий пушистый монстр, стоящий на коленях возле тающей красной свечи. Художественный стиль - 3D и реалистичный, с акцентом на освещение и текстуру. Настроение картины - удивление и любопытство, ведь монстрик смотрит на пламя широко раскрытыми глазами и открытым ртом. Его поза и выражение лица передают ощущение невинности и игривости, как будто он впервые исследует окружающий мир. Использование теплых цветов и эффектного освещения еще больше усиливает уютную атмосферу изображения.
Шериф Тиллман - один из ключевых персонажей 5-го сезона "Фарго"
Я немало работаю со всякими ИИ - пытаюсь приспособить их под свои задачи: в основном, под поиск и подбор различной информации. Интересно то, что ChatGPT 3.5 и ChatGPT 4, на котором работает CoPilot Windows, часто выдают совершенно различные результаты.
Хуже всего, по моей практике, они справляются с просьбами пересказать содержимое какого-то фильма и в особенности - какого-то сезона сериала. Нередко несут прямо-таки полный бред.
Сейчас тестирую гугловский ИИ Gemini. Попросил его рассказать сюжет 5-го сезона "Фарго". Кто этот сезон смотрел - оцените уровень бреда в ответе.
Действие пятого сезона разворачивается в 2019 году. В центре сюжета - домохозяйка Дот Малво (Джуно Темпл), жизнь которой переворачивается с ног на голову после неудавшегося похищения. Дот не рассказывает о случившемся никому, даже своему мужу Уэйну (Дэвид Рисдал), утверждая, что это был нервный срыв.
Тем временем, в расследование похищения Дот вовлекается шериф местной полиции Летти Мейфлер (Дженнифер Джейсон Ли). Летти, чей авторитет в городе под угрозой, полна решимости докопаться до истины.
Помимо Дот и Летти, в сериале фигурируют и другие персонажи:
- Эннис Сент-Джермейн (Джейсон Шварцман), аферист, который оказывается втянутым в историю Дот.
- Одетта Майерс (Керри Кондон), медсестра, которая ухаживает за больным отцом Дот.
- Уильям "Габриэль" Уидди (Джек Хьюстон), гангстер, который прибывает в город, чтобы разобраться с Дот.
Сюжет пятого сезона "Фарго" полон неожиданных поворотов. Зрителям предстоит узнать, кто же на самом деле стоит за похищением Дот, и какие тайны она скрывает от своих близких.
Некоторые ключевые моменты сюжета:
- Дот Малво - не та, кем кажется. У нее есть темное прошлое, которое она скрывает от всех.
- Похищение Дот было не случайным. Это часть более крупного заговора.
- Шериф Летти Мейфлер одержима поимкой преступников, но ей мешает ее собственная некомпетентность.
- Эннис Сент-Джермейн - не тот, кем кажется. У него есть свои планы на Дот.
- Одетта Майерс - не просто медсестра. Она играет важную роль в жизни Дот.
- Уильям "Габриэль" Уидди - опасный человек, который не остановится ни перед чем, чтобы добиться своего.
Сериал "Фарго" известен своим фирменным стилем: черный юмор, колоритные персонажи, неожиданные сюжетные повороты. Пятый сезон не стал исключением.
Четвертый ChatGPT тоже не сказать что хорошо с этим справился, но он хоть персонажей и актеров правильно перечислил:
Пятый сезон телесериала “Фарго” — это криминальная драма и чёрная комедия, созданная Ноем Хоули. Сезон был анонсирован в феврале 2022 года и состоит из 10 эпизодов. Премьера состоялась 21 ноября 2023 года.
Сюжет пятого сезона построен на традиционном для шоу смешении криминальной драмы и чёрной комедии. Главные вопросы, которые ставит перед героями жизнь: “Когда похищение ребенка не считается похищением?” и “Что если твоя жена — не твоя жена?”. Действие сезона происходит в 2019 году1.
Вот некоторые из главных ролей в пятом сезоне:
Джон Хэмм — Рой Тиллман
Джуно Темпл — Дороти “Дот” Лион
Дженнифер Джейсон Ли — Лоррейн Лион
Дэвид Рисдал — Уэйн Лион
Джо Кири — Гатор Тиллман
Ламорн Моррис — Витт Фарр
Рича Мурджани — Индира Олмстед
Сэм Спруэлл — Оле Мунк
Сиенна Кинг — Скотти Лион
Дэйв Фоли — Дэниш Грейвз
В общем, ИИ по-прежнему в большом долгу.
ChatGPT написал сценарий передачи в духе BBC Planet, и ИИ воплотил этот сценарий в видео. Ну, пока смотрится несколько мультяшно, хотя есть хорошие идеи, но все еще впереди: пройдет немного времени, и это все будет выглядеть пугающе достоверно.
Юный Алекс, которому 17 врачей не смогли поставить правильный диагноз
Показательную историю рассказала в издании Today женщина, которую зовут Кортни.
С 2021 года ее 4-летний сын по имени Алекс начал испытывать различные боли. Няня ребенка сказала Кортни, что она вынуждена время от времени давать ребенку Motrin (ибупрофен), чтобы избавить его от боли и соответствующих срывов.
Ребенок явно страдал, вел себя очень странно, закатывал истерики, периодически начинал грызть предметы. Родители водили его по врачам. В какой-то момент его обследовал ортодонт (у родителей было подозрение, что ребенок плохо спит, из-за чего выглядит измученным), и ортодонт обнаружил определенные проблемы с нёбом у ребенка. Ему поставили на нёбо специальный расширитель, и на какое-то время ситуация заметно улучшилась.
Потом Кортни заметила, что Алекс перестал расти, что у него наблюдается дисбаланс между правой и левой стороной тела, также он стал испытывать сильные головные боли.
Алекса водили к педиатрам, узким специалистам: всего за 3 года они посетили 17 врачей и провели множество обследований, но никто из них так и не смог поставить диагноз, который бы объяснял все симптомы.
И тогда уже отчаявшаяся Кортни зарегистрировалась в ChatGPT и ввела там всю информацию об обследованиях и все симптомы.
ChatGPT высказал предположение о том, что это может быть синдром перетянутого позвоночника. Кортни нашла в Facebook группу, объединяющую семьи детей с этим синдромом, и их истории были похожи на историю Алекса. Тогда они пошли к новому нейрохирургу, и Кортни сказала, что подозревает у сына наличие этого синдрома. Доктор посмотрела снимки МРТ и сказала, что диагноз совершенно правильный: она на снимке увидела occulta spina bifida (осколочный спинальный дефект) и перетянутый позвоночник.
По данным Американской ассоциации неврологических хирургов, синдром перетянутого позвоночника возникает, когда ткани спинного мозга образуют крепления, ограничивающие подвижность спинного мозга, вызывая его ненормальное растяжение. Это состояние тесно связано со spina bifida - врожденным дефектом, при котором часть спинного мозга развивается не полностью, и некоторые участки спинного мозга и нервов оказываются оголенными.
При синдроме переплетения спинного мозга "спинной мозг к чему-то прилипает". Это может быть опухоль в спинномозговом канале. Это может быть шишка на костном шипе. Это может быть просто слишком много жира на конце спинного мозга", - рассказывает TODAY.com доктор Холли Гилмер, детский нейрохирург из Мичиганского института головы и позвоночника, который лечил Алекса.
У многих детей со spina bifida есть видимое отверстие в спине. Но у Алекса оно закрыто и считается "скрытым", также известным как spina bifida occulta, согласно данным Центров по контролю и профилактике заболеваний США.
После получения правильного диагноза Алекс перенес операцию по устранению этого синдрома, и теперь он, по словам Кортни, быстро восстанавливается.
Специалисты признают, что в определенных случаях ChatGPT может поставить диагноз точнее, чем соответствующий специалист, потому что он оперирует с огромными объемами информации, и у него нет "слепых зон", как у врача-человека.
Однако следует иметь в виду, что ChatGPT иногда может фабриковать какую-то информацию, если не может найти правильный ответ, и тогда диагноз будет поставлен неправильно.
Но в любом случае специалисты считают, что использование систем искусственного интеллекта в диагностике имеет большие перспективы.
Несколько дней назад Google опубликовал видеопрезентацию своего ИИ Gemini, и многие журналисты и аналитики, впечатленные увиденным, поспешили объявить о том, что ChatGPT, мол, умер, да здравствует Gemini.
Впрочем, среди специалистов неоднократно высказывались сомнения в том, что в ролике продемонстрирована реальная работа Gemini, а не результат неких манипуляций с реальными действиями. Например, в издании Bloomberg это подробно разбирали.
Судя по результатам «расследования», все показанные в ролике изображения, текстовые подсказки и ответы были тщательно подобраны заранее, а фактический процесс запроса был сильно сокращён для зрителей в угоду зрелищности и динамике происходящего. Один из сотрудников Google рассказал журналистам, что, по его мнению, видеоряд показывает нереалистичную картину. Другой отметил, что не был удивлён такой демонстрации, потому что привык к маркетинговой шумихе — по его словам, «все компании так делают». (Отсюда.)
В Google, кстати, признали, что ролик был постановочным, и что Gemini отвечал с помощью оставленных за кадром подсказок. Также в процессе монтажа итогового ролика задержка при обработке запроса нейросетью была уменьшена.
При этом в Google заявили, что их просто неправильно поняли - мол, они в ролике просто демонстрировали интерфейс Gemini, а приведенные примеры не следует воспринимать буквально.
После этого техноблогер Greg Technology решил повторить все запросы из нашумевшего видео без монтажа, но с использованием GPT-4. Он воссоздал несколько сценариев из оригинального ролика Google: попросил распознать жест, определить игру «Камень, ножницы, бумага» и сказать, что нарисовано на листе бумаги. Нейросеть без труда справилась со всеми задачами, не считая задержки в несколько секунд перед выдачей ответа. По словам блогера, он хотел показать, что «смонтированные» возможности Gemini уже доступны в GPT-4. Хоть и работают не так быстро, как в рекламных видео. Но зато безо всякого монтажа и без читерства.


































