Potion of Intelligence
310 subscribers
6 photos
3 files
88 links
Download Telegram
Весь интернет обсуждает захват американским спецназом диктатора Венесуэлы Николоса Мадуро по приказу Дональда Трампа. Но то, что в этой истории занимает практически всех — легитимность, международное право, потенциальные параллели с другими диктаторами, мне искренне безразлично. Меня интересовал вопрос, который наоборот почти не обсуждают: насколько обоснованы обвинения Венесуэлы в «наркотерроризме»?

Почему именно Венесуэла? Она самая лёгкая цель? Или наркотики это лишь предлог, а единственная реальная цель — смена режима? Меня смущали два соображения.

Я знал, что кокаин — главный, наряду с нефтью, источник дохода Венесуэлы. Но кокаин в моих глазах всегда был наркотиком для богачей. Он очень дорогой и не слишком опасный по меркам наркотиков. В чём смысл атаки на кокаиновый картель, когда люди в основном умирают от синтетических опиоидов (фентанил)?

Венесуэла — не единственный и не главный поставщик наркотиков в США. По объему производства лидируют Мексика и Колумбия, а по поставкам в США, очевидно, доминирует Мексика, имеющая с США сухопутную границу. В чём смысл атаки на второстепенную цель?

Так вот, я провёл небольшое исследование и получил ответы, которые мне удовлетворили.

Во-первых, я сильно недооценивал опасность кокаина. От кокаина ежегодно умирают по 30 тысяч человек в США. Для сравнения, от фентанила в районе 80 тысяч. Дело в том, что кокаин перестал быть чистым: картели массово смешивают его с тем же самым фентанилом, чтобы повысить аддиктивность.

Кроме того, кокаин и синтетические опиоды поставляются одними и теми же картелями по одним и тем же маршрутам. Кокаиновые деньги и логистика переиспользуются для распространения ещё более смертельных наркотиков. Стереотип, что кокаин это не массовый и умеренно вредный наркотик для богачей и знаменитостей, полностью потерял актуальность.

Во-вторых, между Венесуэлой и другими странами Латинской Америки, есть ключевая разница. В Мексике и в Колумбии правительство ведёт войну с картелями. Не очень успешно. Картели коррумпируют и убивают государственных служащих. Но по крайней мере правительства сопротивляются, принимают помощь от США и экстрадируют пойманных лидеров картелей.

А в Венесуэле некому помогать в борьбе с картелями, потому что правительство это и есть картель. Буквально. Война с картелями в случае Венесуэлы это война с самой Венесуэлой, с её политическим руководством.

Так что обвинения в наркотерроризме реальные. Даст ли захват Мадуро какие-то результаты кроме имиджевых не знаю. Сам картель и его руководство никуда не делись, очевидно. Но если оппозиции удастся воспользоваться возможностью и взять власть, Венесуэла по крайней мере сможет перейти от «правительство это и есть картель» к «правительство слабо сопротивляется картелю». А это хотя бы откроет возможности для международной помощи от всё тех же США.
👍9
На днях закончил проходить вторую часть своей любимой игры — The Talos Principle II (2023). Хочу рассказать подробнее об этой серии.

По жанру Talos Principle это трёхмерная бродилка-головоломка (если вы знакомы с Portal, жанр тот же самый). Серия мне безумно нравится как в плане содержания, так и в плане игрового дизайна. Этот пост будет про содержание, а следующий про игровой дизайн.

Содержание

В первом Talos Principle (2014) вы играете за гуманоидного робота, запертого в цифровой симуляции, собранной из кусков античности, древнего Египта и средневековой Европы. Внутри симуляции вы вынуждены решать головоломки, бродя между атмосферных руин. Помимо головоломок вы встречаете большое количество цифровых артефактов: интернет-переписок, документов, аудиозаписей, по которым вы постепенно восстанавливаете предысторию.

Сюжета в привычном понимании почти нет, повествование ретроспективное. Довольно быстро становится понятно, что симуляцию запустили люди из некого Института Прикладной Ноэматики, для решения некого кризиса, с которым столкнулось человечество. Что произошло? Можете ли вы им помочь? Что от вас хотят? Игра состоит из поиска ответов на эти вопросы.

В игре затрагиваются очень близкие мне темы трансгуманизма, постгуманизма, философии сознания. Во второй части к этому добавляется тема поиска смысла жизни в масштабах цивилизации. Я редко встречаю произведения, где эти темы затрагиваются, но совсем уж редко попадаются те, которые затрагивают их с позиций близких мне ценностей. Talos Principle хорошо пополнил мою шкатулку.

Отдельно хочу похвалить нарративный дизайн. Первая часть игры подарила мне образ персонажа, которым я восхищаюсь. И этот персонаж ни разу даже не появляется на экране. Набор цитат, упоминаний, и несколько голосовых сообщений - и этого достаточно, чтобы проникнуться к человеку симпатией и уважением.

Вторая часть игры подарила ряд персонажей, которых я бы назвал своими идейными союзниками. Один из них вообще всегда будто снимает слова у меня с языка. Вторая часть главным образом о конфликте идей, образов будущего. Есть «моя» факция, и есть её противники. Аргументы противников «моей» факции - это аргументы, которые я постоянно встречаю от неглупых людей в реальной жизни. Это не выдуманное соломенное чучело для битья. И игра вовсе не заставляет игрока выбирать «мою» сторону. Но я благодарен уже тому, что «моя» сторона вообще есть, и что она заметная. Гораздо заметнее чем в реальной жизни, увы. Поэтому, мне кажется, разработчики всё-таки симпатизируют «моей» стороне.
❤2🔥1👏1🍾1
(продолжение предыдущего поста)

Игровой Дизайн

Большую часть времени в игре занимают, конечно, головоломки. Дизайн головоломок тут восхитительный, многие я считаю настоящими шедеврами. Головоломки представляют из себя изолированные трёхмерные локации с преградами. Вам нужно попасть в определённое место. Преграды отключаются с помощью разного рода механик, использующих ограниченный арсенал гаджетов. Решение головоломок требует пространственного мышления на уровне «что откуда видно», а также умения планировать и держать в голове, что где будет находиться на каждом шаге.

Базовая игра многим кажется сложной. Но есть и значительное меньшинство, включающее меня, которым базовая игра наоборот показалась простой. В игре есть опциональный контент, заметно более требовательный к находчивости и изобретательности. Он заставил меня как следует попотеть, но в итоге я справился и с ним. И понял: я очень хочу ещё.

И вот для таких как я к игре сделали дополнение Road to Gehenna. В нём нет новых элементов. Но оно требует находить новые, нестандартные применения и взаимодействия старых элементов. И оно намного сложнее. А ещё в нём тоже есть опциональный контент. Который ещё сложнее.

Я не гений головоломок, но мне очень понравилась игра и я никуда не торопился. Многие головоломки в «Геенне» я бросал по нескольку раз, чтобы вернуться к ним на свежую голову и с новыми идеями. Вторую звезду в головоломке «Кратер» я взял только спустя несколько дней, на попытки я суммарно потратил несколько часов реального времени. «Геенну» я в итоге прошёл, сам, без подсказок, и с чувством глубокого удовлетворения. И с уверенностью, что уж «Геенна»-то выжала всё что можно из старых элементов, до дна.

Но в 2025 году вышел ремейк первого Talos Principle, в который добавили совсем небольшой аддон-приквел At the Beginning. Снова без новых элементов. Но оказалось, в старых элементах скрывалось ещё много неиспользованных идей. Почти все головоломки в приквеле сложнее всего, что было в «Геенне». Самое восхитительное — они сложнее не потому что больше. Не за счёт разрастания комбинаторного дерева. Наоборот, в среднем головоломки стали даже меньше, а самая сложная из них содержит всего 3 элемента.

4 головоломки из приквела я считаю шедевром и вершиной дизайна уровней. Они не вызывают ощущения: слишком сложно, я не знаю что делать. Наоборот, они вызывают ощущение: слишком мало элементов, я вижу все возможные действия и решения физически не существует. Не хватает одного элемента. Четыре раза четырьмя разными способами игра вызвала у меня убеждённость, что головоломку нельзя решить, если только не принести каким-то образом дополнительный элемент снаружи. И каждый раз в итоге оказалось, что существует нетривиальный трюк, некий класс действий, который сознание игнорировало, позволяющий обойтись тем что есть.

Вторая часть игры вводит несколько новых механик и расширяет старые. И снова, базовая игра явно рассчитана на то, чтобы казуальный игрок мог её пройти не слишком часто подглядывая решения в интернете. Мне вторая часть показалась проще первой. Но это не важно, ведь для таких как я снова сделали дополнение Road to Elysium, которое будто говорит: прошли сюжет? А теперь давайте решать настоящие головоломки с новыми механиками! Сложность местами не уступает «At the Beginning». Корпел долго, упорно, прошёл всё сам, доволен как слон.
🔥5❤2🎉1🍾1
Сегодня был на концерте, где исполняли музыку композитора-минималиста Людовико Эйнауди. Это было моё первое вдумчивое знакомство с его творчеством. И оно заставило меня задуматься о минимализме и о киношной музыке в целом.

Было время, когда я музыку, подобную творчеству Эйнауди, не переносил вообще (из известного, к ней же отношу, например, Yiruma — River Flows in You). Слишком слащаво, слишком примитивно. Чтобы понять о чём речь, достаточно сравнить эту музыку с любым произведением той же длительности и для того же состава инструментов любого из классиков 19 века.

Проблема в том, что я прямо-таки обожаю акустические и оркестровые саундтреки к аниме и компьютерным играм. А они тоже, безусловно, по сравнению с классикой примитивные и, зачастую, слащавые. То есть как будто бы одно только это меня не должно отпугивать, иначе я не мог бы слушать и музыку из игр и аниме. Так не предъявляю ли я минималистам и киношным композиторам лицемерно завышенные требования? Сегодня я постарался подойти к прослушиванию непредвзято, очистить голову от ожиданий и послушать музыку как есть. Дать ей шанс. И вот что я понял.

Эйнауди, безусловно, имеет очень много общего с современными композиторами аниме и игр, которых я люблю. Что и неудивительно, индустрия саундтреков по сути едина: кино, игры и аниме, конечно, имеют свою специфику, но в крупную клетку требования и подходы одинаковые. Я бы даже сказал что и стиль, в котором пишет Эйнауди, мне близок. Настроения композиций, мелодические ходы, то как он развивает музыкальную тему — всё плюс-минус в моём вкусе. Но есть и проблемы. Я их всегда интуитивно чувствовал, но раньше неправильно понимал в чём именно они состоят.

Претензий к творчеству Эйнауди у меня по сути две и обе, вероятно, относятся не только к нему, но и к большей части минимализма. Во-первых, все до одной композиции, которые я сегодня услышал, на мой взгляд затянуты примерно в два раза. У меня есть интуитивное, трудно формализуемое словами требование к концентрации музыкальных идей на единицу времени в композиции. Одну тему нельзя обыгрывать слишком долго. Есть темы достойные минуты и есть темы достойные пяти минут, но у каждой темы есть свой предел. Хронометраж должен соответствовать содержанию.

В саундтреках к аниме и играм, которые я люблю, средняя длина композиции — минуты две, если вообще не полторы. Для меня они конкурентоспособны даже с классикой именно за счет короткого хронометража. Классика в разы богаче, но она и в разы длиннее. А вот у Эйнауди композиции минут по 5. Но они не тянут на пять минут. В итоге мне становится скучно, я устаю от одной и той же музыкальной темы. Тем более, что 90% услышанного сегодня написано по формуле: постепенное развитие темы до кульминации, потом она как будто заканчивается, звучат финальные отзвуки — и вдруг всё по новой, второй заход.

Собственно это моя вторая претензия к его творчеству — оно невероятно однообразно. Почти в любом саундтреке из тех, что мне нравятся, есть композиции подобные творчеству Эйнауди. Они мне зачастую даже нравятся. Но саундтрек к игре или аниме обычно состоит из разных по содержанию композиций. Есть боевые темы, есть лирические, есть комедийные, есть пафосные. У Эйнауди же, по крайней мере все два часа сегодняшнего концерта, настроение всегда было одно и тоже. Лиричные, слегка меланхоличные композиции. «Боевых» тем нету, трагичных, драматичных тем тоже нет, пафосных тем нет, загадочного эмбиента нет. Возможно, виноваты составители концертной программы, но я думаю, они просто брали самое популярное. И если композитора любят только за один-единственный класс композиций, это для меня само по себе плохо.
❤3✍2
Последние несколько дней активно тестирую открытые (open weights) языковые модели ИИ. И это оказался весьма отрезвляющий опыт, спускающий с небес на землю. Для меня разбился один из ключевых мифов, который я почему-то долго принимал на веру.

Возможно, вы слышали (возможно, даже от меня!), что один из трендов в ИИ — повторение результатов меньшими ресурсами. Давайте разберём на примере. В сентябре 2024 вышла первая «думающая» модель o1 от Open AI. Это была самая «умная» модель на рынке, которая всех побила во всех тестах. Нет открытых данных сколько денег ушло на её обучение и на каком железе она работала. Но по грубым оценкам, обучение стоило в районе 100 млн. долларов, а запускается каждая копия флагманских моделей Open AI на стеках из 8-16 GPU «промышленного» уровня, общей стоимостью в районе 200-400 тысяч долларов.

И вот, спустя примерно полгода китайцы делают первую открытую «думающую» модель DeepSeek R1, которая в тестах примерно на уровне o1. По реалистичным оценкам обучение R1 обошлось китайцам минимум в 5 млн. $, а скорее всего ещё больше. Но это всё равно в 5-10 раз дешевле чем у o1 от Open AI. DeepSeek R1 это открытая модель, в теории любой может её скачать и запускать у себя. Беда в том, что «полная» версия (671B параметров, FP16) требует 1.2 терабайта VRAM, поэтому вам потребуется всё тот же стек из 8+ GPU за сотни тысяч $. Но с открытыми моделями дальше начинаются варианты.

Если вас устраивает что модель будет работать очень медленно, вы можете загрузить её в 1.2 ТБ значительно более медленной «объединённой» памяти Apple, купив стек из 3х Mac Studio за ~30к$. 30k$ это всё ещё безумно дорого для простых смертных, но это хотя бы уже не 300k$. Но это только начало.

Дальше начинается так называемая квантизация. Это технология, позволяющая пожертвовать точностью вычислений в 2-4 раза и сбросить требования к памяти в те же 2-4 раза, лишь незначительно потеряв при этом в «интеллекте». В FP4 нужно уже «всего» 300 GB памяти. Но и это все ещё очень далеко от массового пользователя. У меня, например, на далеко не самом слабом ПК, всего 16 GB быстрой VRAM и ещё 96 GB медленной RAM.

А ещё дальше начинается так называемая дистилляция. Берётся какая-нибудь в 10+ раз более маленькая модель, например, Mistral 14B и дообучается на ответах DeepSeek R1. Вы спросите, разве может маленькая модель вобрать в себя знания и умения в 10 раз более большой? И вот мы подходим к сути мифа.

В тестах («бенчмарках») и на некоторых специфичных задачах, «дистиллированные» модели якобы показывают себя почти на уровне в 10+ более объемных флагманов. Да, мол, потери есть, но даже 70% производительности флагмана это уже очень много. Флагманы ведь тоже на месте не стоят. Сегодняшний «дистиллят» на уровне флагмана прошлого поколения. Завтрашние «дистилляты» уже будут на уровне нынешних флагманов. Суть мифа в двух словах: ChatGPT 5.4 Thinking, лучшая модель сегодня, через год будет запускаться на вашем ПК, а через два года на вашем смартфоне!

Так вот, я сполна убедился, что это всё полная туфта. Реальность очень сильно расходится с хайпом. Продолжение будет в следующем посте.
🔥6✍3
Продолжаю рассказ про свои эксперименты с «народными» (открытыми) LLM.

Я тестировал только писательство и отыгрыш, то есть просил превратить сценарий в полноценный текст, вести диалог от лица заданного персонажа, помогать с проработкой мира, придумывать сюжетные повороты. Почему именно эти задачи? Потому, что именно в них я лучше всего ощущаю уровень «интеллекта». Через глубину, креативность, правдоподобность. Добавлю, что в этих задачах даже флагманские закрытые модели мне не кажутся безупречными. И хорошо чувствуется иерархия, Grok, например, более поверхностный, чем ChatGPT.

Но «народные» модели это ужас. Более-менее приемлемые, содержательные тексты и диалоги получаются только с моделями 70B+. Но даже они значительно хуже чем Grok, который хуже чем ChatGPT. Модели 24B на грани применимости. То есть с трудом тянут на очень скучного, однообразного, глуповатого и ленивого писателя, сценариста или игрока. Общаться или совместно творить с ними совершенно не увлекательно и не интересно, но может быть они всё же не совсем бесполезны для творческих задач. 11B и всё что ниже это совсем мрак. Это хуже чем GPT-4 2023 года, живой сущности на том конце провода не ощущается совсем. Это автоответчик, который возвращает тебе твои же слова, полностью лишённую содержания воду или тривиальные истины.

Отдельная большая беда это размеры контекста. Моего железа хватает только на 8-16k токенов (4 токена = 3 слова), это само по себе очень мало и это серьёзный бич всей лавочки с локальным запуском моделей. Но даже на этих 8-16к модели начинают плыть и забывать детали. С этим, кстати, и у закрытых флагманских моделей есть проблемы, их эффективный контекст на порядок меньше максимального и это видно даже в синтетических тестах. Тут надо смотреть не на примитивные бенчмарки «поиск слова в контексте», а на более продвинутые в духе NoLiMa, RULERv2 или Oolong (поиск по латентным ассоциациям без явного лексического совпадения, агрегация множества локальных наблюдений в длинном контексте и т.п.)

У современных флагманов максимальный контекст 1 млн. токенов, но относительно эффективный в районе 128к. Это хорошая цифра. Для сравнения, Llama 3.1 70B, лежащая в основе многих любимых в народе моделей, начинает сыпаться уже на 4к. Лично мне, по ощущениям, для реальной совместной креативной работы нужно минимум 32к честного, эффективного контекста. Ничего из того, что я могу запустить локально, даже не близко к этой цифре.

Ещё один момент — флагманские модели одинаково хорошо работают почти на любом языке, но народные «дистилляты» только на английском.

Что касается других задач, в первую очередь программирования, я верю, что там ситуация лучше, но мне это не сильно интересно. Мои потребности закрывает Cursor.

Агенты мне тоже не интересны, у меня нет для них работы. Ну то есть как — я бы точно не отказался, например, сделать себе цифрового двойника, у которого лежало бы в контексте подробной информации обо мне тысяч эдак на 100 токенов, и который бы симулировал мои взаимодействия с сайтами, подкастами, товарами, людьми, а потом давал бы мне рекомендации на основе симуляций. Но пытаться сделать двойника или ассистента с интеллектом этих табуреток это себя не уважать. А примитивный чат-бот, присылающий напоминалки или to-do лист, я могу сделать и без всяких локальных ИИ.
👍11
Давно ничего не писал в канал, но встретил хороший повод оформить мысли, которые у меня давно на уме. Я как-то уже упоминал Виктора Таелина, одного из людей, чья деятельность вызывает у меня повышенный интерес. Сейчас очень любопытно наблюдать за трансформацией его отношения к кодинговым ИИ-агентам.

Виктор занимается довольно специфичной областью программирования — пишет высокоуровневый язык, заточенный под запуск на GPU с автоматическим распараллеливанием. Это полезно, например, для радикального ускорения задач символьного поиска программ, формальных верификаций и проверки доказательств. Область Виктора это хардкорный «матан» от программирования. Узкая, с высоким входным барьером, в ней мало экспертов, мало ответов на Stack Overflow, толком не на чем обучать ИИ. А самое главное, в ней нет места для посредственных результатов. Весь смысл в максимальной оптимизации, в экономии микросекунд на операциях. Либо ты делаешь хорошо, либо никак. Интуитивно кажется, что в такой области места для вайб-кодинга практически нет.

Тем не менее, ещё в середине апреля, Виктор писал, что последние несколько месяцев за него весь код пишут ChatGPT Pro и Claude Opus. У него уходило 1000$ в день на токены. Но где-то с мая он начал жаловаться на то, что агенты работают недостаточно быстро (при том, что он использует исключительно быстрый режим по цене x5) и не со всем хорошо справляются, что им требуется всё больше ввода от самого Виктора. И вот вчера он написал, что сравнивая несколько дней работы с агентами и без них, он пришел к выводу, что в одиночку он справляется лучше.

Виктор был одним из самых продвинутых апологетов ИИ-агентов за которыми я слежу. И важно понимать, что он всё ещё скорее апологет. Тем не менее, история, которую я считываю, наблюдая за миром ИИ в последние месяцы, это разочарование из-за невероятно завышенных ожиданий. В начале года все жужжали про OpenClaw, был даже дефицит железа от Apple, потому что все его кинулись скупать под OpenClaw. Сейчас OpenClaw практически исчез из повестки. Фигурирует только в контексте того, что его разработчика сманили к себе Open AI, и он теперь как не в себя рекламирует Open AI Codex.

Важно понимать: поезд идёт только в одну сторону. Слова «оркестраторы», MCP, «мультиагентные системы» звучат из каждого утюга и будут звучать только чаще. Обсуждения кто сколько сотен и тысяч долларов тратит на токены в месяц станут рутиной. Вот об этом я собственно и хотел поговорить.

Агентный инжиниринг (это как вайб-кодинг, только когда вы знаете что делаете) с нами навсегда. С каждым месяцем руками будет писаться всё меньше кода. Затраты на ИИ-агентов в сотни и тысячи долларов станут нормой везде. У кого не станут, те вылетят с рынка прямо скоро.

Но как полно тех, кто игнорирует эту лавину, так полно и тех, у кого ожидания завышены до совершенного абсурда. Полно людей которые искренне считают, что сейчас они купят подписку на Cursor за 20$ и быстренько создадут свой Amazon за несколько вечеров. Как полно и людей которые не могут написать Hello World ни на одном языке программирования, не знают что такое API, и даже обычный ChatGPT последний раз открывали в 2024 и то бесплатный. И вот они приходят и на полном серьёзе говорят: научите меня создавать ИИ-агентов, я хочу автоматизировать свой отдел продаж. И приходится спускать их с небес на землю. Придумывать вежливые формулировки, как им сказать: чувак, ты даже зарегистрировать аккаунт не смог без посторонней помощи, какие тебе к чёрту агенты?
👍6🔥3
Опубликовал у себя в блоге на Medium довольно длинный и глубоко личный пост о том, с чего началось моё увлечение аниме, и почему это увлечение играет такую важную роль в моей жизни.

А ещё я завёл отдельный канал, куда буду выкладывать свои рецензии на аниме и на музыку из аниме. Сюда их дублировать не буду, так как это явно интересно далеко не всем подписчикам.
🍾3🎉2👏1
Задумался о своём отношении к ИИ-творчеству (картинки, музыка, видео). Пришёл к неожиданному для себя выводу. На текущий момент при прочих равных я отношусь к работам лучше, если знаю, что они сгенерированы ИИ. Ключевые слова — при прочих равных.

Предположим, я вижу красиво нарисованную, эстетически привлекательную иллюстрацию. Она не похожа на узнаваемый стиль ChatGPT Image 2 и других известных мне нейросетей. При более внимательном рассмотрении я всё ещё не вижу типичных для ИИ артефактов, в духе проблем с пальцами. Иллюстрация вызывает у меня приятные эмоции. Затем я узнаю, что на самом деле она всё-таки была сгенерирована ИИ. Как меняются мои эмоции в этот момент?

На самом деле происходят две вещи. Сперва я рассматриваю иллюстрацию ещё раз, пытаясь найти характерные артефакты. Когда ты знаешь, что они должны быть, обычно найти их становится проще. Но предположим, я всё равно их не нахожу. Может быть автор исправил что-то руками, а может быть сама генерация была необычайно удачной. Тогда я проникаюсь к создателю уважением и иллюстрация приобретает для меня дополнительную ценность. Я буду ценить её даже выше, чем если бы она была нарисована художником-человеком.

Более экзотический пример с другого конца. Предположим, я вижу явно сгенерированную картинку. Вижу характерные для ИИ артефакты. Потом я узнаю надёжную информацию, что картинка была нарисована человеком вручную. Стану ли я относиться к ней лучше? Нет, я начну относиться к ней даже хуже. Буду думать, что либо человек бездумно срисовывал за ИИ, либо сознательно подражал ИИ. И то, и другое для меня глупая и пустая трата времени, недостойное для человека занятие.

Получается в обоих случаях, при прочих равных, я предпочитаю ИИ. По крайней мере на сегодняшний день. Важно сделать, однако, важную оговорку. В реальности прочих равных практически не бывает. В интернете полно бесполезных тестов, где нужно угадать где ИИ, а где нет, и почти все получают результат, близкий к случайному угадыванию. Но за пределами тестов, все ИИ иллюстрации, которые попадаются на глаза, буквально кричат, что это ИИ. Основная проблема даже не пальцы и не другие артефакты. Основная проблема — стандартный, легко узнаваемый стиль.

Вот почему я испытываю уважение к тем, кто заморачивается и генерирует что-то действительно необычное. Экспериментирует с промптами и референсами, и уж тем более с разными моделями, LoRA и workflow. Казалось бы — это всё ещё в 100 раз более простая работа, чем рисование руками где угодно и на чём угодно. Но, как ни смешно, в реальности художников сейчас на порядок больше чем ИИ-креаторов. Если последними считать только тех, кто реально исследует и экспериментирует, а не просто вбивает запрос и тыкает кнопку. А уж ИИ-креаторов, которые добиваются интересных результатов, вообще ничтожно мало. Поэтому каждый такой результат в моих глазах это исключительная история, заслуживающая внимания. Такой вот парадокс. Вероятно, когда (если) технологии станут лучше, моё отношение изменится.
❤4
Форбс пишет, что Илон Маск стал первым долларовым триллионером в истории. Мой Телеграм подчеркивает слово "триллионер" поскольку его даже нет в его словаре. 😅

Я встречаю довольно разные мнения насчёт этичности самого существования сверхбогатства. Многие считают, что долларовых миллиардеров (и уж тем более триллионеров) вообще не должно существовать. В пользу этой точки зрения есть два основных аргумента: коммунистический и не коммунистический. Коммунистический аргумент состоит условно в том, что детям в Африке кушать нечего. Дескать, пока на планете есть голодные и бездомные дети, планета не может себе позволить миллиардеров. Другими словами, любой человек морально обязан избыточное богатство целиком направлять в пользу страждущих. Опциональное, но весьма популярное дополнение: а если он по тем или иным причинам не делает это сам, то избыточное богатство нужно отнимать и перераспределять насильно.

Моё отношение к этой точки зрения крайне негативное. К сожалению, я не могу сказать, что все люди, которые её разделяют, это люди недалёкие, которых я бы всех с радостью вычеркнул из своей жизни. Её разделяет и часть умных, толковых и порядочных людей. Сама точка зрения вызывает у меня глубокую, нутряную брезгливость граничащую с презрением, но я стараюсь как могу не проецировать по умолчанию эти эмоции на её носителей.

Второй, не коммунистический аргумент, сводится к тому, что слишком много власти в руках одного человека это большой риск. Даже если когда-то человек был хорошим, он может измениться или сойти с ума. Триллион долларов это довольно много. Примерно столько, например, Россия понесла суммарных экономических потерь за первые годы развязанной Путиным агрессивной войны против Украины. Если человек может свободно принимать решения себестоимостью в триллион долларов, он может при желании очень сильно испортить жизни десяткам миллионов людей. А может даже и сотням.

Ко второму аргументу я отношусь серьёзно. Но я не воспринимаю его как аргумент против капиталистического обогащения. Для меня это аргумент об опасности концентрации ресурсов в целом. Но отказаться от концентрации ресурсов нельзя, потому что она ведь нужна не только для войн. Чтобы летать в космос, строить ИИ, создавать технологии продления жизни, она тоже необходима. Значит скорее нужны механизмы, мешающие тратить колоссальные ресурсы на чистый вред, а не мешающие их накапливать.

На мой взгляд, капиталистическая система неплохо справляется с этой задачей. Лично я не считаю случайностью то, что первый долларовый триллионер это человек, который занимается запусками ракет, беспилотными автомобилями, ИИ и нейроинтерфейсами, а также активно продвигает солнечную энергетику и декларирует намерение колонизировать Марс. А не какой-нибудь наследный принц нефтяной монархии.

А ещё я бы не стал переоценивать власть Илона Маска. Если он начнёт тратить свой триллион, это вызовет панику и его активы начнут резко обесцениваться. Если он захочет потратить триллион на создание своей ЧВК, ему либо не дадут этого сделать вообще, либо не дадут ей управлять. Путин формально не является триллионером, но минимум на порядок опаснее Маска, как из-за значительно большего объема ресурсов, которыми он может фактически распоряжаться, так и из-за отсутствия сдерживающих механизмов.

Так что лично я искренне рад за Маска, буду рад если таких как он станет больше и если он сам станет ещё богаче, и я поддерживаю систему, позволяющую таким как он существовать и богатеть. Это точно не то, чего нужно бояться.
👍7
Anthropic скоро начнут маркировать сгенерированный текст. Это довольно интересный поворот. Для картинок, музыки и видео невидимые водяные знаки существовали уже давно, например, SynthID от Google Deepmind, обнародованный ещё в 2023. С медиа-контентом всё относительно просто. На картинке или видео можно незаметно поменять цвет нескольких пикселей, человеческий глаз ничего не увидит, но алгоритмические детекторы сразу распознают. Аналогичным образом можно подмешивать неразличимый уху шум к аудио.

С текстами ситуация принципиально другая. Незаметно подмешать к тексту лишние символы или скрытые буквы невозможно. Если быть точным, невидимые пробелы и спецсимволы существуют, но они могут теряться при копировании, к тому же очень легко написать скрипт, который удаляет весь подобный мусор, оставляя только чистые буквы и нормальные пробелы. Надежную маркировку на скрытых символах не сделаешь.

Вместо этого Anthropic будут использовать статистику и особенности работы самих LLM. Например, у Claude при генерации текста на выбор есть 2 равновероятных варианта продолжения: «он произнёс» и «он сказал». В половине случаев модель выберет один вариант, а в другой половине второй. Причем снаружи вообще не видно, какой из двух вариантов был условно первым, а какой вторым. В разных участках текста они могут меняться местами. Увидеть это можно только заглянув во внутренности самого Claude. Если теперь изменить алгоритм так, чтобы он чаще отдавал предпочтение именно первому варианту, скажем, вместо 50 на 50 станет 51 на 49, снаружи ничего не изменится. И даже изнутри по одному такому выбору ничего сказать нельзя. Но на больших текстах, где подобных выборов было много, статистический сдвиг будет заметен. Чем больше было подобных близких выборов при генерации, тем меньше шансов, что их итоговая статистика случайно совпала с ожидаемой.

Поскольку сам выбор слов в тексте несёт на себе отпечаток алгоритма, он не удаляется при копировании. Более того, переписывание части текста тоже не обманет детектор, максимум снизит его уверенность. Обмануть детектор можно будет только полностью переписав весь текст. Но если делать это руками, это большая работа, частично нивелирующая сам смысл использовать ИИ. Если поручить задачу другому ИИ, его литературный стиль может быть хуже чем у Claude. К тому же у другого ИИ может быть своя собственная маркировка.

Почти одновременно с Claude, главный сервис для генерации ИИ музыки, Suno, тоже объявил, что будет маркировать свою музыку. Причём у Suno всё ещё строже: они будут хранить базу данных цифровых слепков сгенерированной музыки. Изменить тональность на полтона, ускорить на 5%, наложить шумы — всё это не поможет. Чтобы изменить слепок, придётся менять саму мелодию, структуру или звучание композиции. А это уже полноценная творческая работа, требующая владения соответствующими инструментами.

Лично у меня зреет уверенность, что вслед за Anthropic и Suno, остальные крупные игроки тоже начнут вводить маркировку. Тем, кто этого делать не будет, начнут запрещать работу на рынках вроде ЕС. А вслед за волной маркировок, я уверен, начнется волна тотальной фильтрации ИИ контента, его будут если не вычищать, то скрывать для всех, кто не включит где-нибудь в настройках галку «я хочу видеть ИИ контент».

Изменит ли всё это облик интернета? Скорее всего нет. Открытые модели никуда не денутся. Алгоритмы для обмана детекторов появятся очень быстро. Гонка вооружений будет идти какое-то время. К сожалению, фильтры ИИ ударят в основном по массовому, ленивому пользователю ИИ. Но большая часть ИИ контента пишется не людьми, копирующими из ChatGPT, а сетями ботов. Те кто могут себе позволить и умеют поднимать сети ботов, разберутся и с открытыми моделями, и с алгоритмами обмана детекторов. Поэтому, я думаю, пропорция человеческих текстов и комментариев к сгенерированным продолжит уверенно сокращаться.

К сожалению, я думаю, что маркировки ИИ текстов останутся в истории довольно незаметным шагом на пути к единственному реальному решению — интернету по паспорту.
🫡4👍2🤡2❤1🔥1🥰1🤔1🎉1