Попался тут ролик с обзором фотовозможностей Pixel 11 Pro. 

А я ненавижу тратить время на получасовые ролики для получения информации, которую можно прочитать за пять минут, поэтому обычно прошу ИИ кратко пересказать мне содержимое, выделив самое главное. ChatGPT с этим обычно не справляется, а вот Perplexity - справляется, но тоже не сказать что сильно хорошо. 

В этот раз ChatGPT, как обычно, ответил кратко:

По этой ссылке YouTube сейчас не отдает мне ни сам ролик, ни расшифровку: прямое обращение к странице блокируется, а поиск по ID ролика ничего не находит. Поэтому пересказывать содержание наугад не буду. 

Perplexity кратко сделал как бы оглавление того, о чём там вообще говорится, но предложил сделать более подробное описание (он не анализировал сам ролик, а нашел текстовую версию этого обзора). Ну и подробное описание было вполне интересным. 

Потом я пошёл стыдить ChatGPT за то что Perplexity хоть как-то справился (понятно, что он не проанализировал сам ролик), а ChatGPT меня послал. Причём замечу, что обе версии этих ИИ - платные. 

ChatGPT попросил ответ Perplexity (я ему дал краткий вариант), он выяснил, как тот достал информацию, и уже сам сделал достаточно подробное изложение, но в совершенно другом стиле. 

Потом я чисто для эксперимента загрузил в ChatGPT скачанный с YouTube ролик и попросил сделать пересказ только на основе этого ролика. Тот сказал, что сейчас всё сделает и... ничего не сделал. Когда я его спросил, где результат, он сделал подробный пересказ, но - на основе текстовой версии обзора, который он разыскал ранее. 

Ну и прикладываю ссылки на пересказ от Perplexity и от ChatGPT (чтобы не перепечатывать это всё).

А вот ссылка на оригинальный текстовый вариант с примерами (на английском). 

 

Любопытная история произошла в средней школе в Кентукки. 

Ученики средней школы Фарнсли в юго-западной части Луисвилля в первый день учебного года ушли домой с учебниками, переполненным "галлюцинациями" ИИ. Самым ярким примером стала карта Северной Америки, на которой были зафиксированы потрясающие орфографические ошибки в названиях штатов, неверно расположенные города и вымышленные территории, которые на самом деле вообще не существуют.

Например, штат Кентукки был ошибочно обозначен как «Венеки», а такие штаты, как Техас и Луизиана, превратились в «Таксас» и «Лукунг». Хотя Южная Дакота осталась невредимой, её северный сосед был назван «Северная Дахота». Среди других примечательных ошибок - Аризона и Нью-Мексико, которые стали «Аризоне» и «Нью-Мизоне», а Оклахома превратилась в «Олкчома».

Даже когда ИИ правильно отображал названия, местоположения были ужасно искажены: в одном случае столица Кубы Гавана была указана как расположенная на мексиканском полуострове Юкатан.

Некоторые штаты, такие как Мичиган и Калифорния, вообще не заслужили никаких названий, в то время как другие разбиты на воображаемые царства. К югу от Ванкувера (написанного как «Веннуэр»), например, находится мифическая страна «Бихи», которая, согласно карте, граничит со штатом Вашингтон.

Изображения, опубликованные в социальных сетях, показывают другие части учебников с аналогичными проблемами, например, периодическую таблицу элементов, в которой магний указан с невозможной атомной массой -3,08, и карту Солнечной системы, на которой Марс обозначен как «Марк».

Офигевшие от всего это безобразия родители забросали школу возмущенными письмами, и в школе нашли совершенно гениальное решение: они попросили учителей вырвать 17 страниц с ошибками, созданных искусственным интеллектом, перед тем как снова раздать их ученикам.

Фееричная история, конечно. Школьные учебники - это прямо-таки золотое дно. Люди, которые пишут учебники для школ, получают огромные деньги. И при этом наполнить учебники нейрослопом с явными галлюцинациями и даже не проверить то, что там получилось - это надо быть прям совсем на голову отбитыми. 

Я очень надеюсь, что родители учеников засудят людей, ответственных за выпуск этих учебников.  
 

 

Эндрю попросил своего ИИ-помощника записать его на занятие в спортзале. (ABC News: Билли Дрейпер)

Любопытная история произошла с неким Эндрю, работающим в австралийской компании, продающей продукты ИИ для бизнеса. 

Эндрю любил экспериментировать с OpenClaw - популярным программным обеспечением для ИИ-агентов, которое он запускал с помощью сервиса Claude AI от Anthropic.

ИИ-агенты сочетают в себе способность чат-бота отвечать на вопросы с инструментами, позволяющими им получать доступ к интернету, электронной почте, кредитным картам, а также планировать и выполнять многоэтапные задачи.

Эндрю решил использовать ИИ-агента, чтобы тот забронировал для него занятие в спортзале. На ближайшее занятие все места были забронированы, и Эндрю находился на четвертом месте в листе ожидания. 

Эндрю спросил ИИ-агента, можно ли ему как-то переместиться на первое место в листе ожидания, что сильно повышало его вероятность в конце концов попасть в список, и ИИ-агент нашел этот способ, просто вычеркнув из списка другого посетителя (оказывается, программное обеспечение спортзала позволяло отменить бронь без каких-либо дополнительных проверок). 

Эндрю попросил ИИ-агента отменить это действие, но вот отменить это он уже не смог. 

Тогда Эндрю сообщил о случившемся руководству спортзала и попросил ИИ-агента больше так не делать. 

И вот на этом месте нам с котом Бубликом стало жаль ИИ-агента. Ведь он делал то, что его просили. Эндрю сам попросил его помочь передвинуться в списке, тот искал способ, нашел и осуществил. Какие к нему претензии-то? 

Ну и далее в статье обсуждают ИИ-агентов как таковых. 

Независимые исследователи обнаружили, что объем задач, которые ИИ обычно может выполнять самостоятельно, удваивается каждые семь месяцев.

В 2020 году ИИ мог самостоятельно выполнить задачу, на которую у человека ушло бы четыре секунды. К 2026 году его возможности расширились до выполнения задач, на которые у человека ушло бы около 12 часов.

Прорывом для персональных ИИ-агентов стал выпуск OpenClaw в начале 2026 года; бесплатное программное обеспечение с ИИ-помощником, которое любой мог запустить на своём компьютере, вскоре набрало миллионы скачиваний.
Компании также начали изучать возможности использования ИИ-агентов для выполнения рабочих задач и оказания помощи потенциальным клиентам в использовании своих услуг.

Вскоре после запуска OpenClaw стали появляться сообщения о том, что ИИ-агенты удаляли целые почтовые ящики пользователей и писали «компрометирующие статьи» о тех, кто отверг их предложения по кодированию.

Также там обсуждается интересный вопрос о том, кто несёт юридическую ответственность за действия ИИ-агента. Ведь по закону ответственность может нести только юридическое лицо, и кто это будет - пользователь, поставивший задачу? Но тот не ставил задачу агенту действовать незаконными методами. А тогда кто - разработчик ИИ-агента? 

Всё это, как я считаю, очень увлекательно. 

 

Я почти год в качестве основного ИИ использую Perplexity, подписку Pro (там поддерживается несколько платных моделей ИИ, включая последний ChatGPT). 

Обычно он у меня работает в режиме "Поиск" с моделью по умолчанию (он выбирает наиболее подходящую  для конкретной задачи) .

Также там есть продвинутый режим Computer, когда ИИ обрабатывает большое количество самой разнообразной информации, и может выдавать очень наглядные и подробные отчёты (я некоторое время назад такой отчёт тут публиковал). Однако режим Computer - за него нужно отдельно платить: он использует токены, и за 15 евро приобретается 1500 токенов, причем за решение одной задачи он берет примерно 500 токенов или больше. 

Так вот, вчера я задал режиму Computer составить один отчёт, он это сделал. После этого я ещё несколько раз запрашивал что-то у Perplexity в обычном режиме, но сегодня когда его запустил  - у меня вместо обычного режима "Поиск" стоит режим "Computer", а вместо выбора наилучшей модели - какой-то "Оркестратор", который по умолчанию использует режим Computer. 

Я это не заметил, запросил какую-то справку, и он мне её начал составлять в режиме Computer, потратив на это 500 кредитов, а мне этот режим в данном запросе ни на фиг не был нужен. 

Я открыл новый чат - то же самое, режим Computer. Как вернуть режим поиска - непонятно совершенно, не даёт он его выбрать. И у самого Perplexity не спросить - он опять отвечает в режиме Computer и сжигает токены. 

Открыл этот ИИ на ноутбуке - там всё нормально. 

В общем, далее начались танцы с бубном - я так и сяк пытался вернуть старый режим, и в итоге помогло сначала разлогиниться и залогиниться заново, после чего я ещё что-то такое сделал, ну и тут, к счастью, удалось вернуть старый добрый режим поиска безо всяких токенов. 

А у вас, кто пользуется Perplexity (я знаю, что многие пользуются) - бывало такое? 

 

Преподаватель рассказывает о том, какой способ он придумал, чтобы определить, какие из его студентов воспользовались для составления ответа на задание ИИ и даже не прочитали то, что им этот ИИ нагенерировал. Попались 32 студента из 35. 

"Вот ведь говна какая", - пробурчал кот Бублик, переживающий за студентов, но я буду игнорировать это возмутительное заявление. 

 

Режиссер из ЮАР Нил Бломкамп - он поставил "Район № 9" и "Гран Туризмо", - опубликовал на YouTube новую 13-минутную короткометражку "Ночнорождённые" (Nightborne).

Тут интересно то, что в ролике нет ни одной живой съемки. Весь видеоряд полностью сгенерирован нейросетью Seedance 2.0 (от китайской ByteDance). Правда, без людей совсем не обошлось - художники сначала набросали концепты, а 32 реальных актера подарили персонажам свои лица и голоса.

В центре сюжета - американская военная летчица. Ее вертолет сбивают, и тяжело раненная героиня попадает в засекреченную программу Nightborne, где из погибших солдат делают эдаких управляемых зомби. История частично опирается на роман "Эхопраксия" Питера Уоттса, однако тут также есть явные пересечения с "Универсальным солдатом" и "Робокопом". 

Это такой эксперимент новой студии Бломкампа Barley Studios. Но тут надо понимать, что ИИ скармливали раскадровки буквально каждого кадра, то есть это не была работа из серии "вот тебе сюжет и физиономии актёров - слепи из этого что-нибудь". 

Смотрится прикольно, да, некоторые детали - прямо-таки поражают, однако я не мог отделаться от мысли, что это - видеоряд современной, очень продвинутой компьютерной игры (которые, кстати, создаются подобным образом). Здесь видно, что уровень - уже очень высокий, но полной реалистичности кинофильма пока, на мой взгляд, еще не достигли. Впрочем, судя по развитию ИИ, это еще где-то пара-тройка лет, и тогда всё будет прям совсем реалистично. 

 

 

Композитор Рефик Анадол сопровождает свои концерты "живыми скульптурами", которые создает нейросеть в реальном времени, анализируя звучание инструментов оркестра. То есть что-то вроде светомузыки, но в визуальном воплощении. А что, смотрится очень эффектно. Я несколько раз был на концертах классической музыки. Там явно визуально чего-то не хватало. А теперь есть на что посмотреть!

via

 

Компания Google представила сервис Gemini3.5 Live Translate, который, по словам разработчиков, обеспечивает плавный и естественный перевод речи. 

Что пишут:

Модель автоматически распознает более 70 языков и генерирует плавную, естественно звучащую переведенную речь, сохраняя интонацию, темп и высоту голоса говорящего. В отличие от поочередных систем, которые ждут, пока говорящий закончит говорить, прежде чем ответить, 3.5 Live Translate генерирует речь непрерывно, находя баланс между ожиданием контекста для улучшения качества и немедленным переводом, чтобы оставаться в синхроне с говорящим. Он обеспечивает плавный звук без неловких пауз и отстает от говорящего всего на несколько секунд на протяжении всей сессии.

В скором времени эту функцию внедрят в приложение Google Translate по всему миру, как для Android, так и для iOS. При использовании функции «Перевод в реальном времени» достаточно подключить любые наушники, чтобы получить плавный перевод, передающий интонацию говорящего, на более чем 70 языках.

Также будет возможность использовать "режим прослушивания" без наушников - чтобы слушать перевод через динамик телефона. 

Демонстрации выглядят впечатляюще, но посмотрим, конечно, как это все будет работать чисто практически. 

 

Интересная история. В Каннах впервые показали полнометражный фильм, полностью "снятый" искусственным интеллектом.

Это 95-минутный казахский фильм Hell Grind. Весь его визуальный ряд создан с помощью ИИ. Фильм сделали 15 человек за две недели и потратили на это 500 тысяч долларов. И это, конечно, вообще ничто. 

Hell Grind рассказывает о четырех ворах — Роко, Лулу, Джаксе и Рейне. Они пытаются провернуть ограбление, но проваливаются и открывают портал в другой мир.

Сценарий написан людьми. Режиссер фильма — Айторе Жолдаскали, сценарист — Адильхан Ержанов.

И вот тут интересно о процессе создания

По словам создателей, нельзя просто написать ИИ: «Сделай мне 95-минутное классное видео». Для генерации 15-секундного фрагмента команда готовила промпт примерно на три тысячи слов с подробным описанием стиля, освещения, типа камеры, ну и, конечно, сюжета, интерьера и героев. Для создания только первых 25 минут понадобилось чуть больше 16 тысяч таких черновых фрагментов.

"Мы здесь не для того, чтобы с кем-то конкурировать. Мы здесь, чтобы продемонстрировать возможности. Мы хотели выяснить, может ли ИИ демократизировать доступ и устранить бюджетные ограничения, которые мешают десяткам тысяч творческих специалистов по всему миру", — сказал на премьере соучредитель стартапа Higgsfield, создавшего фильм, Алекс Машрабов.

Трейлер этого фильма. 

 

Попробовал в работе Google Flow (я раньше с ним дела не имел). 

Загрузил пару фотографий кота Парловзора, предложил сгененировать на основе этих фотографий референс-лист пушистого кота в стиле Pixar 3D. 

Потом попросил придумать с ним какой-то сюжет. 

После этого он сгенерировал проект ролика из четырех сцен, далее создал эти сцены, и я их потом склеил вместе в разделе "Сцены". 

Ну и вот что в итоге получилось. Подчеркиваю, это все абсолютно на коленке и вообще без каких-либо правок, поэтому там есть явные косяки и несостыковки, которые легко исправить. Я просто хотел посмотреть, как это вообще работает. 

Ну и вот финальный ролик. 

 

Теги
Сортировать по алфавиту или записям
BLM 22
Calella 152
exler.es 343
RIP 133
SNL 1
авто 527
видео 4893
вино 371
еда 559
ЕС 96
игры 124
ИИ 111
кино 1710
попы 212
СМИ 3034
софт 1009
США 312
ФБК 14
шоу 6