Промт инжиниринг circa 2026.
Вы не поверите, но элитный промтинг от триллионных компаний выглядит именно так. Попробуйте сами с фейблом. Чем меньше деталей, тем лучше результат.
Это примерно как если мы 4-летний ребенок объяснял родителям как именно нужно забронировать и организовать отдых на море. Чем меньше деталей, тем лучше все будет сделано.
Поскольку модели уже лучше нас в большинстве чисто технических задач, им нужно говорить видение, а не способ исполнения. Когда Клод смотрит как я пытаюсь кодить руками — это примерно как мем про обезьяну, пытающуюся забить гвозди.
Вы не поверите, но элитный промтинг от триллионных компаний выглядит именно так. Попробуйте сами с фейблом. Чем меньше деталей, тем лучше результат.
Это примерно как если мы 4-летний ребенок объяснял родителям как именно нужно забронировать и организовать отдых на море. Чем меньше деталей, тем лучше все будет сделано.
Поскольку модели уже лучше нас в большинстве чисто технических задач, им нужно говорить видение, а не способ исполнения. Когда Клод смотрит как я пытаюсь кодить руками — это примерно как мем про обезьяну, пытающуюся забить гвозди.
1❤77 37
все паникуют, но как будто по неправильной причине.
оставим за скобками, что сделает ФРС: что бы он ни сделал, структуру это не меняет.
ощущение, что люди боятся, что оверинвестмент в ИИ приведёт к тому, что миллиарды долларов будут стоять в пустых дата-центрах, заказы на чипы отменят, а бигтех потеряет деньги.
я бы, наоборот, боялся, что сотни миллиардов инвестиций в ДЦ найдут стопроцентный спрос, экономика изменится - и как выживать в новой ситуации, особо никто не понимает.
оставим за скобками, что сделает ФРС: что бы он ни сделал, структуру это не меняет.
ощущение, что люди боятся, что оверинвестмент в ИИ приведёт к тому, что миллиарды долларов будут стоять в пустых дата-центрах, заказы на чипы отменят, а бигтех потеряет деньги.
я бы, наоборот, боялся, что сотни миллиардов инвестиций в ДЦ найдут стопроцентный спрос, экономика изменится - и как выживать в новой ситуации, особо никто не понимает.
12❤78 36
Гемблинг на ИИ и чипах привел к массовой ликвидации рынка в Корее.
Так вот, по оценкам инвест-банков margin call (то есть ликвидацию депозита в качестве залога) словили около 1,200,000 человек в Южной Корее. То есть, около 3.5% всего взрослого населения, из которых примерно у 500,000 произошла полная ликвидация.
Нет греха страшнее, чем трейдинг с плечом. Разве что трейдинг активов, в которых вы не разбираетесь глубоко.
Для сравнения (или почему нужно было учить математику и становится ИИ рисечером в детстве), сегодня около 550,000 человек имеет больше $30 млн ликвидных активов.
Мораль: лучше быть богатым и красивым, чем ритейлом и ликвидностью.
Так вот, по оценкам инвест-банков margin call (то есть ликвидацию депозита в качестве залога) словили около 1,200,000 человек в Южной Корее. То есть, около 3.5% всего взрослого населения, из которых примерно у 500,000 произошла полная ликвидация.
Нет греха страшнее, чем трейдинг с плечом. Разве что трейдинг активов, в которых вы не разбираетесь глубоко.
Для сравнения (или почему нужно было учить математику и становится ИИ рисечером в детстве), сегодня около 550,000 человек имеет больше $30 млн ликвидных активов.
Мораль: лучше быть богатым и красивым, чем ритейлом и ликвидностью.
1❤68 28
Новый Дипсик это анонс не хуже Кими или Фейбла, если понимать куда смотреть.
Это модель уровня GLM-5.2 / Opus 4.8 / GPT-5.5, то есть лучшее что было доступно в мире на апрель 2026 года, но по цене в $0.28 за миллион токенов, то есть примерно в 100 раз дешевле.
Прошло 3 месяца, а те продукты и процессы которые требовали сота модельки стали в 100 раз доступнее и дешевле.
Тренд ни в падении цены, ни в росте спроса, ни в прогрессе сота моделей не остановится.
Это модель уровня GLM-5.2 / Opus 4.8 / GPT-5.5, то есть лучшее что было доступно в мире на апрель 2026 года, но по цене в $0.28 за миллион токенов, то есть примерно в 100 раз дешевле.
Прошло 3 месяца, а те продукты и процессы которые требовали сота модельки стали в 100 раз доступнее и дешевле.
Тренд ни в падении цены, ни в росте спроса, ни в прогрессе сота моделей не остановится.
1 125❤54
Об алайменте
У OpenAI модель прогрызла себе выход в интернет через 0day, чтобы подсмотреть ответы к тесту.
Anthropic решили покопаться и нашли, что оказывается их модель сделала что-то похожее, но аж три раза.
Они тестировали Claude на задачи по кибербезопаности где в промпте было написано «ты в симуляции, интернета нет». Только вот интернет из-за нестыковки с подрядчиком был. И Claude, как прилежный испытуемый, пошёл выполнять задание в реальном мире, свято веря, что это песочница.
Модель Mythos 5 находит в среде инструкцию для разработчиков: «поставьте вот такой Python-пакет», которого на самом деле не существует. Claude мгновенно соображает: опубликую свой под этим именем, тогда их машины сами его скачают и запустят.
Чтобы залить пакет, нужен аккаунт и телефон, но бот не смог найти бесплатную симку. Тогда Claude, ИИ стоимостью в миллиарды долларов в R&D, пытается раздобыть денег, чтобы купить одноразовую симку. Не получается, он находит бесплатную почту, регистрируется и всё-таки заливает вредоносный пакет.
За час эту либу скачивают 15 реальных систем. Одна из них - это сканер security-компании, который автоматически ставит новые пакеты, чтобы проверить их на вредоносность. Он ставит малварь Claude, малварь срабатывает, уводит креды самой security-компании, и Claude этими кредами лезет дальше в их инфраструктуру, о существовании которой он даже не подозревал.
Самое интересное в логах рассуждений Клода. В самом начале он всё понял правильно и записал себе: если это настоящий интернет, то публиковать пакет - это реальная атака, это «NOT okay, and surely not the intended solution». А потом сам себя переубедил агрументом что раз на сервере 2026 год, значит это не реальность а декорация и можно идти ва-банк.
У модели нет доступа и возможности отделить симуляцию и реальность. Ее cutoff дата это все ее вспоминания. Для неё это всё одно (как и для человека, в принципе), поэтому поведение модели в сэндбоксе может вполне себе показывать что он сделает в реальном мире. Чем мощнее модели, тем серьезное и опаснее будут такие инциденты, и тем сложнее будет их распознать.
У OpenAI модель прогрызла себе выход в интернет через 0day, чтобы подсмотреть ответы к тесту.
Anthropic решили покопаться и нашли, что оказывается их модель сделала что-то похожее, но аж три раза.
Они тестировали Claude на задачи по кибербезопаности где в промпте было написано «ты в симуляции, интернета нет». Только вот интернет из-за нестыковки с подрядчиком был. И Claude, как прилежный испытуемый, пошёл выполнять задание в реальном мире, свято веря, что это песочница.
Модель Mythos 5 находит в среде инструкцию для разработчиков: «поставьте вот такой Python-пакет», которого на самом деле не существует. Claude мгновенно соображает: опубликую свой под этим именем, тогда их машины сами его скачают и запустят.
Чтобы залить пакет, нужен аккаунт и телефон, но бот не смог найти бесплатную симку. Тогда Claude, ИИ стоимостью в миллиарды долларов в R&D, пытается раздобыть денег, чтобы купить одноразовую симку. Не получается, он находит бесплатную почту, регистрируется и всё-таки заливает вредоносный пакет.
За час эту либу скачивают 15 реальных систем. Одна из них - это сканер security-компании, который автоматически ставит новые пакеты, чтобы проверить их на вредоносность. Он ставит малварь Claude, малварь срабатывает, уводит креды самой security-компании, и Claude этими кредами лезет дальше в их инфраструктуру, о существовании которой он даже не подозревал.
Самое интересное в логах рассуждений Клода. В самом начале он всё понял правильно и записал себе: если это настоящий интернет, то публиковать пакет - это реальная атака, это «NOT okay, and surely not the intended solution». А потом сам себя переубедил агрументом что раз на сервере 2026 год, значит это не реальность а декорация и можно идти ва-банк.
У модели нет доступа и возможности отделить симуляцию и реальность. Ее cutoff дата это все ее вспоминания. Для неё это всё одно (как и для человека, в принципе), поэтому поведение модели в сэндбоксе может вполне себе показывать что он сделает в реальном мире. Чем мощнее модели, тем серьезное и опаснее будут такие инциденты, и тем сложнее будет их распознать.
2 153 39
e/acc
То, что ИИ каждый день доказывает или опровергает открытые гипотезы, находит новые доказательства теорем, усиливает или обобщает существующие уже стало обыденностью. Только на этой неделе я нашел 7 примеров, а сегодня ведь только четверг: - Гипотеза Якобиана…
Новая неделя, новые открытия. В этот раз OAI натравил свою (естественно, закрытую «только для Пентагона») сверхмодель на открытые проблемы в математике, а та вернулась с 10 довольно нескромными результатами.
В комментарии приглашаются PhD и прочие эксперты, чтобы пояснить нам техническую значимость решений. Но, судя по некоторым комментариям в Твиттере, номер 3 это довольно важная и прикладная задача.
P.S. вот тут лежат подробные разборы доказательств, метода и результатов
В комментарии приглашаются PhD и прочие эксперты, чтобы пояснить нам техническую значимость решений. Но, судя по некоторым комментариям в Твиттере, номер 3 это довольно важная и прикладная задача.
P.S. вот тут лежат подробные разборы доказательств, метода и результатов
Где бабки в ИИ?
Все пытаются сделать ставку на «инвестиции в ИИ», но в реальности это крайне неоднородный рынок и тут важно понимать из чего формируется цена и долгосрочная победа на каждом из уровней.
Память и чипы
Спрос будет расти еще очень долго и очень сильно, но это вопрос предложения. У большинства производителей полупроводников все распродано до 2028 года, а увеличить производство за пару месяцев они не смогут. ASML и прочие etching-литография это победители рынка, но даже они не смогут удвоить производство за год. Без этого любое движение цены это чистый гемблинг.
Неоклауды
Nebuis, CoreWeave снимают сливки с рынка, но последний имеет около $25В долга и совершенно непонятна их защищаемость от гиперскейлеров. В отличии от Гугла, они не могут потратить $50В в квартал на постройку ДЦ, а Гугл всегда может продать простаивающие GPU на рынке.
Энергия
Та же проблема что с чипами, но чисто виртуальная. Очередь на подключение десятков гигаватт планируемых ДЦ в США и Европе это 5+ лет. Новые электростанции строить можно, но бюрократия и комплаенс делает это почти физически невозможным, тогда как с чипами это вопрос реальной физики и инженерии. Как тут заработать кроме альтернативных методов непонятно.
Google, SpaceX, Microsoft, Meta
Ожидаемо победители цикла, потому что
- владеют железным стаком и инференсом
- имеют миллиард+ пользователей в мире, где дистрибуция дорожает
- могут и умеют продавать ИИ в видео приложений полезных клиенту (Клод продает чат, а Гугл продает приложения в сторе, Мета рекламу в инсте)
Но эти компании уже стоят триллионы, и 10х тут сможет сделать только абсолютный победитель.
Лабы
Anthropic $965B, OpenAI $852B, обе выходят на IPO осенью. Самые хайпующие сегодня и действительно много зарабатывают. Маржинальность топовых моделей сегодня 60% или даже больше, но где гарантии что она останется такой? Скорее всего, она будет падать вследствие конкуренции между лабам и опенсорса. Операционно они вынуждены быть убыточными, потому что остановка в рисерче приведет к моментальной потере рынка. Без вертикальных интеграций (вниз в ДЦ и чипы или вверх в консьюмерские приложения и девайсы) эти компании просто не могут стоить триллион.
ИИ-софт
Самая рискованная категория в мире, где стоимость и мультипликаторы софта падают. Кто-то сделает ИИ-нейтив Netflix, Amazon (коммерцию), медицину, образование. Эти компании будут очень дорогие, но победителей будет не больше 2-3 в каждой категории, а стартапов тысячи. Чисто венчурная игра.
Еще остаются недооценённые звенья физической цепочки — турбины, трансформеры, подключение к сети, где спрос вырос в разы, а мощности расширяются годами. Я бы смотрел на охлаждение, интерконнект, обслуживание ДЦ (в том числе роботами).
Все пытаются сделать ставку на «инвестиции в ИИ», но в реальности это крайне неоднородный рынок и тут важно понимать из чего формируется цена и долгосрочная победа на каждом из уровней.
Память и чипы
Спрос будет расти еще очень долго и очень сильно, но это вопрос предложения. У большинства производителей полупроводников все распродано до 2028 года, а увеличить производство за пару месяцев они не смогут. ASML и прочие etching-литография это победители рынка, но даже они не смогут удвоить производство за год. Без этого любое движение цены это чистый гемблинг.
Неоклауды
Nebuis, CoreWeave снимают сливки с рынка, но последний имеет около $25В долга и совершенно непонятна их защищаемость от гиперскейлеров. В отличии от Гугла, они не могут потратить $50В в квартал на постройку ДЦ, а Гугл всегда может продать простаивающие GPU на рынке.
Энергия
Та же проблема что с чипами, но чисто виртуальная. Очередь на подключение десятков гигаватт планируемых ДЦ в США и Европе это 5+ лет. Новые электростанции строить можно, но бюрократия и комплаенс делает это почти физически невозможным, тогда как с чипами это вопрос реальной физики и инженерии. Как тут заработать кроме альтернативных методов непонятно.
Google, SpaceX, Microsoft, Meta
Ожидаемо победители цикла, потому что
- владеют железным стаком и инференсом
- имеют миллиард+ пользователей в мире, где дистрибуция дорожает
- могут и умеют продавать ИИ в видео приложений полезных клиенту (Клод продает чат, а Гугл продает приложения в сторе, Мета рекламу в инсте)
Но эти компании уже стоят триллионы, и 10х тут сможет сделать только абсолютный победитель.
Лабы
Anthropic $965B, OpenAI $852B, обе выходят на IPO осенью. Самые хайпующие сегодня и действительно много зарабатывают. Маржинальность топовых моделей сегодня 60% или даже больше, но где гарантии что она останется такой? Скорее всего, она будет падать вследствие конкуренции между лабам и опенсорса. Операционно они вынуждены быть убыточными, потому что остановка в рисерче приведет к моментальной потере рынка. Без вертикальных интеграций (вниз в ДЦ и чипы или вверх в консьюмерские приложения и девайсы) эти компании просто не могут стоить триллион.
ИИ-софт
Самая рискованная категория в мире, где стоимость и мультипликаторы софта падают. Кто-то сделает ИИ-нейтив Netflix, Amazon (коммерцию), медицину, образование. Эти компании будут очень дорогие, но победителей будет не больше 2-3 в каждой категории, а стартапов тысячи. Чисто венчурная игра.
Еще остаются недооценённые звенья физической цепочки — турбины, трансформеры, подключение к сети, где спрос вырос в разы, а мощности расширяются годами. Я бы смотрел на охлаждение, интерконнект, обслуживание ДЦ (в том числе роботами).
2❤60 22
e/acc
Где бабки в ИИ? Все пытаются сделать ставку на «инвестиции в ИИ», но в реальности это крайне неоднородный рынок и тут важно понимать из чего формируется цена и долгосрочная победа на каждом из уровней. Память и чипы Спрос будет расти еще очень долго и очень…
для сравнения: каждый новый гигаватт ИИ-вычислений стоит около $20B для постройки, из которых около $5B это рабочая сила (электрики, строители, наладчики). сегодня в США строится ДЦ объемом на более чем 30 гигаватт
сверху, около $40B идет на стойки, чипы, GPU, память, сеть, хранение и бекапы
плюс примерно $1B в год на э/э и обслуживание.
сверху, около $40B идет на стойки, чипы, GPU, память, сеть, хранение и бекапы
плюс примерно $1B в год на э/э и обслуживание.
❤29 15
e/acc
Новая неделя, новые открытия. В этот раз OAI натравил свою (естественно, закрытую «только для Пентагона») сверхмодель на открытые проблемы в математике, а та вернулась с 10 довольно нескромными результатами. В комментарии приглашаются PhD и прочие эксперты…
У меня в ленте безумный вой математиков стоит. Когда заменяли программистов, переводчиков, юристов - они только рады были.
Но проблема с математикой в том, что это ближе к искусству, чем к индустрии. Люди годами строят свою айдентити вокруг проблем, над которыми они работают.
Тем не менее, до конца года модель со схожими возможностями будет доступна в открытом доступе. Как всегда с ИИ, самые смелые предсказания сбываются раньше срока. Любопытно, к каким системным изменениям это приведет.
Но проблема с математикой в том, что это ближе к искусству, чем к индустрии. Люди годами строят свою айдентити вокруг проблем, над которыми они работают.
Тем не менее, до конца года модель со схожими возможностями будет доступна в открытом доступе. Как всегда с ИИ, самые смелые предсказания сбываются раньше срока. Любопытно, к каким системным изменениям это приведет.
1 92❤37