ИИ Cерафимодальность
620 subscribers
101 photos
43 videos
87 links
Head of product research at Yandex Search & AI. dm: @bdndjcmf
Download Telegram
Великий инсайдер

Прочитал, что Илон Маск убеждает Уолл Стрит покупать подписки на Грок, и подумал, что история может быть интереснее, чем «финансисты это обеспеченная аудитория».

Неделю назад ChatGPT запустил своего финансового советника: анализ бюджета, подсказки по инвестированию, интеграция с Плейд. В принципе, могли бы и не запускать: десятки, если не сотни миллионов людей и так обсуждают с GPT свои финансы. Внешне нет разницы с любым другим массовым сервисом, в котором можно искать финансовую информацию. В Гугле тоже можно искать тикеры, они тоже теперь инсайдеры?

Но ChatGPT позволяет агрегировать владельцем гораздо большее, чем интерес. Он позволяет собирать намерения. Речь даже не идет о том, чтобы напрямую читать переписки; сама по себе LLM технология позволяет в обобщенном виде фильтровать и суммаризовать диалоги по самым сложным условиям. Найти все диалоги, в которых люди собираются покупать тикеры выбранного пула в ближайшие две недели, прикинуть объём рынка, сыграть на опережение. Завести стабилизационный фонд, потихоньку инвестировать, гораздо лучше кого бы то ни было в мире понимая, какой реально будет спрос (а интеграция с Плейд позволит отделить тех, кто просто спрашивает, от тех, кто реально покупает). Даже формально докопаться сложно, персональные данные не публикуются (в отличие от, кстати, статистики поисковых запросов гугла, доступных всем), агрегированные данные используются для улучшения модели, улучшенная модель в рамках внутреннего сейфети тестирования советует Саме, что и как покупать. Ладная схема.

Но вернёмся к Гроку. Процитирую собственный текст «Зачем Маску твиттер», где я рассуждал о том, какие преимущества получает человек, отслеживающий распространение финансовой информации:

Старлинк — компания
Маска по созданию спутникового интернета, пинг которого значительно меньше оптоволокна. с таким пингом информация о, скажем, изменении курса акций будет известна старлинку даже раньше, чем о ней успеют обменяться сами биржи.

разница в десяток миллисекунд не кажется такой уж драматической, пока не задумываешься, сколько микротранзакций можно уместить в этот период: скальпинг, возведенный в абсолют, паразитизм, построенный на несовершенстве скорости обмена данных внутри системы.


Всё ещё верно. Чаще выигрывает тот, кто знает, какие у остальных карты.

https://telegra.ph/zachem-Ilon-Mask-kupil-tvitter-11-12
8
Смешной текст на Wired про то, что шрифты с засечками (которые и так переживали не лучшие времена, спасибо Apple) теперь и вовсе стали ассоциироваться с AI, потому что компании вроде Anthropic или Perplexity используют его, чтобы добавить человечности — а критикам кажется, что это просто «вкусослоп».

https://www.wired.com/story/ai-has-come-for-serif-fonts/

От редакции: мы большие фанаты и шрифтов с засечками, и того, как AI начал их адаптировать в противовес стерильным интерфейсам десятых. По этой же причине в редакции почти отказались от продуктов OpenAI, которых Джонни Айв тоже перевёл на хирургическую беззасечность. Будущее отмеряется зарубками на буквах.
8
Вот так

Бум ИИ породил спрос на новый формат эскортниц в Кремниевой долине — «нёрдок», которые могут поддержать диалоги об айти. Цены на них взлетели за последние пять лет — раньше час мог обходиться в $1000, а теперь же в $3000-$5000. Выходные же обойдутся в $23 000 😳

И это осознанный выбор для многих девушек, которые боялись, что их заменит ИИ. Например, героиня материала Forbes под псевдонимом Meida Marek пошла в мир финансов после университета, но в какой-то момент начала тревожиться: «Что произойдёт, когда ИИ сможет делать мою работу лучше, чем я?»

Тогда она решила отправиться в профессию, которую точно не заменит ИИ — эскорт. В процессе она осознала, что увлечение ИИ, криптой и биохакингом делает её интересным партнёром не только для секса, но и общения, чего не хватает многим разработчикам 🌚

Теперь они стали зависимы от бесед с ней и внимания, так что готовы платить. Meida Marek рассказала, что в последнее время у неё много клиентов из Nvidia
Please open Telegram to view this post
VIEW IN TELEGRAM
😁11
ВЫШЛА
🔥61
в мире ЛЛМ есть свой мкбхд — Итан Моллик. он обозревает все большие релизы человеческим, обывательским языком. у него от нового Клода усвистела нахер фляга.

в качестве теста возможностей он попросил его построить карту изохрон: карта, на которой отображается дистанция, на которую ты можешь отправиться за заданное количество времени из выбранной точки (включая все возможные виды публичного транспорта, от гужевого до синкансёнов). Фэйбл вызвала груду субагентов для поиска информации, и принялась кодить. прежде чем перейти по ссылке — вы можете сами в уме прикинуть, скольких действий бы потребовала у вас такая задача, насколько она комплексная и, местами, противоречивая. но фэйбл справилась.

https://isochronic-passage-chart.netlify.app/#nyc

другой пример пугает меня гораздо сильнее, потому что напрямую касается того, над чем я лично работаю как исследователь. прямая речь:

Самый амбициозный проект, который я сделал с Fable, потребует чуть больше объяснений. Я провожу много исследований, в которых люди дают беспорядочные ответы, и для любого анализа необходимо правильно эти ответы категоризировать: насколько инновационна идея? почему людям нравится эта книга? Чтобы это выяснить, мы привлекали исследователей-людей, которые выносили оценочное суждение о том или ином фрагменте информации, а затем статистически сравнивали их ответы с ответами других, чтобы понять, можно ли доверять данным. Множество недавних исследований показало, что ИИ, возможно, способен выполнять эту важную работу, однако калибровка суждений ИИ и человека до сих пор была сложной и дорогостоящей. Поэтому я попросил Fable решить эту задачу — сначала сгенерировать сложный проектный документ на 19 страниц, а затем реализовать его.

Он работал девять с половиной часов.

Результатом стала чрезвычайно изощрённая программа, которую ИИ назвал Concord и которая могла принимать на вход множество наборов данных, калибровать ответы человека и ИИ, а затем проводить сложный анализ данных по полученным результатам. И снова — она не была идеальной. Как эксперт, я сумел заметить некоторые ошибки и упущения (часть из них — следствие того дизайна, который я сам и запросил), и заставил ИИ их исправить. Но масштаб того, что было сделано в этом проекте, как и во многих других, превзошёл всё, что я видел прежде. В данном случае это была программа, которая была нужна исследователям годами, но которую никогда не было выгодно создавать. Я уверен, что она не идеальна (я потратил на работу с результатами всего час), но инженер-программист устранил бы оставшиеся потенциальные баги, которые я не смог быстро найти (и это одна из причин, по которой в будущем нам могут понадобиться больше, а не меньше программистов — чтобы помочь справиться со взрывным ростом новых способов применения программного обеспечения).
9
и ещё кусочек — простите, что не пересказываю, просто Итан и так охуенно пишет:

В прошлом году я называл это работой волшебником: ты произносишь заклинание — и что-то происходит. С Fable заклинание стало настолько мощным, что я уже не уверен, что волшебник — это я. Я скорее ближе к меценату. Я описываю, чего хочу, я плачу за это и я оцениваю результат. Само колдовство совершается где-то там, где я не могу за ним наблюдать, в сотнях мелких решений, в которых у меня нет права голоса. Работа сместилась от процесса к результату. Я больше не направляю; я заказываю.

Возможно, эта отстранённость временна — всего лишь артефакт интерфейсов, которые ещё не поспели за происходящим, и со временем мы получим более удачные способы заглянуть в то, что делают эти модели, и более удачные способы управлять ими по ходу дела. Но возможно и обратное: что чем способнее модель, тем меньше остаётся того, что человек мог бы осмысленно делать, и что чёрный ящик — это и есть цена её силы. Подозреваю, что именно это с большей вероятностью и случится. Ничто из этого не является потерей контроля в прямом смысле слова. Я по-прежнему могу направлять Fable, и он замечательно следует инструкциям: чем амбициознее инструкция, тем лучше результат. Но направлять — теперь не то же самое, что делать. Я даю модели вводную, она разворачивает собственных агентов, чтобы те вели поиск, писали и проверяли работу друг друга, — и то, что возвращается, уже завершено. Меценат заказывает работу одному художнику. Fable же ближе к целой студии, где я — клиент, который утверждает итоговую работу, ни разу не ступив на порог самого цеха.


https://open.substack.com/pub/oneusefulthing/p/what-it-feels-like-to-work-with-mythos
6
ну и ещё по мелочи: появился новый (ещё более усердный) кодовый режим, который работает по принципу агентских лупов (воркфлоу).
🔥3😁1
У Дарио новое эссе, какое там уже, третье?

https://darioamodei.com/post/policy-on-the-ai-exponential

Самое интересное для нас, конечно, про коалицию демократий: «общая цепочка поставок чипов внутри и отказ в ней противникам, расширенный экспортный контроль, скоординированные правила по рискам, разделение выгод, взаимная оборона»

(кстати, надо достать из черновиков текст о британских истоках технопессесизма Антропиков, там красивая дуга вырисовывается)
6
Не верю ни одному отзыву на Fable, кроме людей у которых был ранний доступ. У меня на максимальной подписке перманентное вот это, все кто рассказывают о чудесах Фейбла не имели никакой возвожномти полноценно её протестировать.

(Но мой предварительный вердикт — это AGI)
🤔7🤣4
Хотел рассказать, как вчера сходил на хакатон Антропика, но сегодняшние новости про блокировку Фэйбла перекрыли всё
😁14😢3
Open Knowledge Format

Гугл Клауд описал OKF — формат для спецификации ллм-вики. Он, если честно, ничем не отличается от формата скиллов, только с чуть более подробными описанными правилами. Но суть та же: папка с маркдаун файлами, оглавление, в начале мд файла — yaml форматтер, все стандартно.

Собственно, единственное, почему это новость — я прочел этот текст глазами, чтобы понять, что конкретно изменилось, и могу с полной убеждённостью сообщить, что вам это делать не обязательно. Достаточно скинуть ссылки своему агенту и сказать что-то типа «впредь надо использовать такие правила для оформления агентской документации сам разберись короче не маленький»

Ссылки вот:
- описание спецификации на Гите (полезное)
- текстовое описание в блоге (довольно бесполезное)
4
Forwarded from e/acc
Перескажу интересную статью о том что нам показывает история с Фейблом.

Главный вывод поста такой: критическое окно возможностей захлопнулось. Anthropic с Mythos / Fable показали качественный скачок - модель, которая ощущается по-другому живой, глубже понимает намерения и лучше продолжает мысль. После этого стало очевидно: мы вошли в фазу, когда передовые модели сами начинают ускорять создание ещё более мощных. Те страны и регионы, которые не успели за последние три года построить собственные frontier-модели (а таких почти все, кроме США и Китая), теперь навсегда останутся в роли зависимых пользователей.

Они будут работать с системами, которые не контролируют и которые при необходимости могут быть в любой момент отобраны. Время, когда ещё можно было догнать и сохранить хотя бы относительную самостоятельность, прошло. Теперь остаётся либо смириться с ролью зрителя, либо пытаться что-то делать уже в совершенно других, гораздо более жёстких условиях.
9
Media is too big
VIEW IN TELEGRAM
Пытался отрефлексировать, что я сам-то думаю про историю с Фейбл (кроме уморительных мемов про лё мистраль котосьён жирабье), и понял, что все свои опасения сформулировал год назад на встрече про то, куда катится мир. С разрешения организатора и за небольшим монтажом — выкладываю двухминутный кусочек из той встречи.
14👍2
Помните психологическую операцию начала года на Супербоуле? Напомню, тогда кто-то слил в твиттер очень дорого выглядяющую рекламу девайса Dime с Александром Скарсгардом.

Что за девайс, кто его производит — неизвестно, но все мгновенно связали его с OpenAI, которые давно грозились выпустить собственные наушники-ассистент. Сами OpenAI тогда вышли с решительным опровержением: «фейкньюз», «выдумки», твёрдо и чётко.

Два часа назад девайс снова всплыл. Дизайнер Apple Туин Кумар (экс Эирбнб, Пульс, Фейсбук) запостил страницу бумажного журнала Work in progress с очень странной рекламой того же самого девайса (сайт, правда там этой рекламы нет).

Неизвестная компания бахвалится, что все остальные используют рендеры, а они создали стальной девайс, который не стыдно фотографировать как есть — что и сделал «швейцарско-немецкий профессиональный фотограф в своей калифорнийской студии» (очень криптический и подозрительно детализированный текст, согласитесь).

У поста 4 комментария, три репоста (один мой), ни одного вхождения этого текста в интернет на момент как я пишу этот пост.

Я всё ещё думаю, что это псиоп от OpenAI.
Media is too big
VIEW IN TELEGRAM
Миджорни представил *сверяется с записями* полнотельный медицинский ультразвуковой сканер с функцией спа.
😁2🤔1
Около года назад все помешались на ИИ-браузерах, при этом зачем они нужны не понял толком никто. Даже я как пользовался Арком, так и продолжил, и ни Диа, ни Комет, ни Атлас, ни тысячи других не вызвали ни малейшего понимания, зачем это всё-таки нужно.

При этом браузер — очень логичная поверхность для доступа ИИ в интернет. Сегодня я наткнулся на очередной ии-браузер с названием Aside, который выглядит как что-то менее тривиальное.

Во-первых, он не пытается навязать мне новую ненужно подписку, а просто предлагает подсоединить мои аккаунты клода и гпт.
Во-вторых, он предлагает mcp для управления собой через КлодКод. Я достаточно регулярно что-то отлаживаю через мсп хрома, и почему-то мне даже в голову не приходило, что в эту точку тоже можно встроиться другим браузером, и сделать тестирование проще.
В-третьих, он предлагает популяризированный гуглом Серкл ту Сёрч, только уже сегодня.
В-чертвёртых, даёт нтп с рутинами, вещь, о которой я лоуки мечтал уже какое-то время: чтобы ри открытие браузера меня ждала выполняющиеся автоматически пока я сплю апдейты по темам, которые мне интересны: появился ли в продаже 6к монитор, который я жду (пока нет), объявили ли цены на гта6 (вот только что объявили, 80 баксов), когда релиз мета дисплей в европе (перенёсся на 2027), начались ли лентние распродажи во Франции (да). Не бесконечная лента всего подряд, а ровно те вещи, которые интересны именно мне, ровно в тот момент, когда они происходят. Не все новости про все мониторы, и не все предложения всех распродаж, понимаете?

И наконец, в-пятых, он выглядит точь-в-точь как Арк, в котором наконец поправили бесячие баги.

https://aside.com/

UPD: нет нормальной переключалки табов по ctrl+tab, как в Арке :(
12
В Париже сильное влияние культуры высокой моды и принятых в ней правил игры, поэтому айтишные мероприятия с большим бюджетом организуют по тому же лекалу. Например, хакатон от Антропиков проходил в галерее Лафайетт, ивент Курсора — в кафе Monocle.

Я, видимо, накопил достаточно очков опыта на открытых ивентах, поэтому сегодня меня позвали на частную "champagne toast and AI panel" с Мистралём, Метой и Кохирой и другими "эйай лидерами", который проходит В РИТЦЕ.

Дополнительная ирония в том, что мероприятие устраивает ии-сейфети компания ActiveFence, которая буквально в начале этого года переименовалась в... Алису. Приду со своим мерчём 🫰
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥11😁113
Очень хорошие названия!
4
Должности будущего по Борису Чёрному (создателю Клод кода)

Поскольку программирование, менеджмент, дизайн, дата саенс и т.д. сливаются в новую разновидность ролей, я размышлял о том, как могут выглядеть роли в будущем. Например, когда я смотрю на команду Claude Code, я вижу, как мне кажется, пять архетипов:

1. Прототипист: придумывает совершенно новые идеи; генерирует множество идей, большинство из которых не реализуется
2. Билдер: быстро превращает прототип/идею в продукт/инфраструктуру производственного уровня
3. Свипер: приводит в порядок UI, упрощает код и систему, отменяет ненужные функции, оптимизирует производительность
4. Гровер: берет уже построенный продукт и итерирует над ним, чтобы улучшить соответствие продукту рынку
5. Мантейнер: отвечает за созданную систему, чтобы сделать ее безопасной, надежной, быстрой и эффективной по мере масштабирования

Многие люди воплощают 2 роли, иногда и 3. Я замечаю, что эти роли не сильно привязаны к должностям — например, в Anthropic некоторые дизайнеры соответствуют категории 1, некоторые 2, некоторые 3; то же самое для программистов, менеджеров, датасаентистов.

Здоровая команда нуждается в смеси этих ролей, в зависимости от продукта:

- Продукт, который новый и еще не достиг PMF (продакт маркет фита), нуждается в людях, сильных в 1+2+3
- Продукт, который растет и уже нашел PMF, нуждается в 2+3+4 и немного 5
- Продукт с сильным PMF нуждается в 3+4+5 и немного 2

Возможно, продуктовые роли будущего будут выглядеть скорее так, чем специализированными по доменам роли сегодняшнего дня?


https://x.com/bcherny/status/2071379474277613732?s=46&t=MNy-LfGucqQvXbR6Iwg3DQ
22