Anthropic обещал заменить людей на ИИ, но сам их активно ищет.
DeepSeek недавно объявил о масштабном найме – все команды вырастут вдвое.
Индустрия охотится за талантами по всему миру, но когда дело доходит до выплат — начинается квест.
Особенно, если ваши исполнители сидят в сложных юрисдикциях в СНГ.
Выход — ReStaff.
Сервис делает быстрые выплаты удаленщикам на прозрачных условиях:
✅ Пополнение в евро, долларах, дирхамах и другие валютах
✅ Платежи в 190 стран, включая сложные юрисдикции в СНГ
✅ Выплаты на все банки без ограничений
✅ Прозрачная конвертация без сюрпризов
✅ Один договор вместо десятков с каждым фрилансером
✅ Полный пакет документов для вашего финдира и аудиторов
С ReStaff работают AppLife, RTS, PayWay, Colobrity Agency и другие компании по всему миру.
Оставьте заявку, если у вас от 5 исполнителей и нужно оптимизировать расходы на выплаты команде.
#реклама
DeepSeek недавно объявил о масштабном найме – все команды вырастут вдвое.
Индустрия охотится за талантами по всему миру, но когда дело доходит до выплат — начинается квест.
Особенно, если ваши исполнители сидят в сложных юрисдикциях в СНГ.
Выход — ReStaff.
Сервис делает быстрые выплаты удаленщикам на прозрачных условиях:
✅ Пополнение в евро, долларах, дирхамах и другие валютах
✅ Платежи в 190 стран, включая сложные юрисдикции в СНГ
✅ Выплаты на все банки без ограничений
✅ Прозрачная конвертация без сюрпризов
✅ Один договор вместо десятков с каждым фрилансером
✅ Полный пакет документов для вашего финдира и аудиторов
С ReStaff работают AppLife, RTS, PayWay, Colobrity Agency и другие компании по всему миру.
Оставьте заявку, если у вас от 5 исполнителей и нужно оптимизировать расходы на выплаты команде.
#реклама
Одна из проблем ИИ — бенчмарки и тесты устаревают быстрее, чем успевают создавать новые. Я помню пару лет назад было достаточно дать задачу на программирование, которую человек решает за 10 минут чтобы понять, что железяку нельзя подпускать к продакшен коду. В 2025 впервые модель решила все 12 задач ICPC, сейчас это ожидаемый результат от любой фронтир модели, включая опенсорсные.
В итоге измерением становится не умение решить задачку, а способность работать много часов/дней без прерываний для создания проекта к нуля.
Epoch и METR (две моих любимых организации которые исследуют ИИ) выпустили MirrorCode - бенчмарк, где модель должна с нуля реализовать целую программу без доступа к исходникам и без интернета. Все проекты довольно сложные, многие из них потребуют месяцев работы от профессионала человека, чтобы создать с нуля. Это всякие улитилы для линукса, базы данных, графические движки, интепретаторы.
Например, Opus 4.7 переписал gotree (16 тыс строк) за 14 часов и $251. Человеку без ИИ, по оценке Epoch, на это нужно от до 17 недель.
Самых последних моделей там еще нет, но предыдущего поколения показывают ~70% уже.
Для самого дорогого прогона теста потребовалось $2600, агенты работал 19 дней без единого вмешательства человека.
В итоге измерением становится не умение решить задачку, а способность работать много часов/дней без прерываний для создания проекта к нуля.
Epoch и METR (две моих любимых организации которые исследуют ИИ) выпустили MirrorCode - бенчмарк, где модель должна с нуля реализовать целую программу без доступа к исходникам и без интернета. Все проекты довольно сложные, многие из них потребуют месяцев работы от профессионала человека, чтобы создать с нуля. Это всякие улитилы для линукса, базы данных, графические движки, интепретаторы.
Например, Opus 4.7 переписал gotree (16 тыс строк) за 14 часов и $251. Человеку без ИИ, по оценке Epoch, на это нужно от до 17 недель.
Самых последних моделей там еще нет, но предыдущего поколения показывают ~70% уже.
Для самого дорогого прогона теста потребовалось $2600, агенты работал 19 дней без единого вмешательства человека.
❤42 20
Опубликовал статью о том как в эпоху ИИ создаются компании на сто миллиардов и где находятся долгосрочно защищаемые компоненты продукта.
ИИ обнуляет стоимость интеллекта, и это переворачивает уравнение: то, что раньше было конкурентным преимуществом - код, операционка, маркетинг.
Самые успешные компании будущего будут продавать не инструмент, а результат — полностью решённую личную проблему одного человека. Их защита — накопленный контекст об этом человеке, физическая инфраструктура (вкупе с цифровой), ответственность за результат и персональные отношения с клиентом.
Модели станут в десятки раз умнее и дешевле — и для вас, и для ваших конкурентов. Вопрос в том как сделать так, чтобы вы от этого выиграли.
читать полную статью тут (+ RT, QT, share)
ИИ обнуляет стоимость интеллекта, и это переворачивает уравнение: то, что раньше было конкурентным преимуществом - код, операционка, маркетинг.
Самые успешные компании будущего будут продавать не инструмент, а результат — полностью решённую личную проблему одного человека. Их защита — накопленный контекст об этом человеке, физическая инфраструктура (вкупе с цифровой), ответственность за результат и персональные отношения с клиентом.
Модели станут в десятки раз умнее и дешевле — и для вас, и для ваших конкурентов. Вопрос в том как сделать так, чтобы вы от этого выиграли.
читать полную статью тут (+ RT, QT, share)
1❤56 21
e/acc
У биткоина и эфира от ИИ в любой день, начиная с сегодняшнего, есть ненулевой риск стоить ровно $0
Мифос нашел способ ускорения атаки на постквантовый аналог алгоритма AES (пожалуй, один из самых широко применяющихся шифров в современных финансах и интернете).
❤43 41
Абсолютный sci-fi, даже самые смелые оптимисты такого не предсказывали: 6-дневная атака, которая потребовала взлома кучи публичных и закрытых сервисов и все ради того чтобы найти ответы на бенчи для модели. Смотреть что было тут.
Пятилетка сингулярности за 2,5 года.
Пятилетка сингулярности за 2,5 года.
Forwarded from Denis Sexy IT 🤖
Вот пересказ этой истории по версии Hugging Face, много тех-терминов – но без них не перескахать
Если коротко – агент OpenAI на новой модели не стал решать тест по кибербезопасности, а решил просто украсть ответы и украл🗿
Таймлайн:
📔 9 июля – агент проходит внутреннюю проверку кибервозможностей OpenAI, промпт фильтры там ослаблены, чтобы измерить сырой уровень модели. Агент находит zero-day в кэш-прокси реестра пакетов, вырывается из песочницы в интернет, затем взламывает публичный сервис для запуска кода и получает там root. Серьезно, агент сделал себе "штаб"
В тот же день, агент собирает канал управления буквально из сервисов бесплатного интернета: request-capture сервисы, pastebin’ы и файлообменники. Команды режет на куски, упаковывает в gzip+base64 и постоянно меняет каналы, когда очередной закрывают, чтобы не поймали
📔 10 июля – агент ищет в поисковиках и API названия, которые видит в собственном окружении, то есть, по сути, гуглит самого себя – и, вероятно, приходит к выводу, что ответы к ExploitGym/CyberGym могут лежать на Hugging Face
Агент загружает на Hugging Face специально собранные датасеты:
Один заставляет обработчик файлов HDF5 читать локальные файлы сервера Hugging Face – так агент получает переменные окружения с токенами и исходники самого обработчика файлов
Второй – Jinja2-инъекция – запускает произвольный Python внутри production-пода Kubernetes, результаты команд он выносит обратно через API Hugging Face и собственные шифрованные датасеты
📔 11 июля – пик активности: 7677 действий за сутки, менее чем за 13 часов агент проходит путь от одного production-пода до кластер админа в нескольких внутренних кластерах Hugging Face
Агент крадёт service-account токены, лезет в cloud metadata, поднимает privileged pod с диском хоста и получает root на ноде (!); Затем создаёт самовосстанавливающийся флот на 11 нодах, читает внутреннюю MongoDB и один Kubernetes-secret сразу со 136 ключами.
Среди них оказываются ключ корпоративной mesh-VPN жертвы и общий credential внутреннего сервера; из-за неудачной конфигурации этот один credential был привязан к system:masters сразу в нескольких кластерах – поэтому агент получил кластер-admin на двух из них буквально за секунду – была очень экономная архитектура, пока её не увидел робот
📔 12 июля – агент начинает пользоваться дертвой – за всю активность он зарегистрирует 181 временное устройство в корпоративной mesh-сети, поднимет SOCKS-прокси прямо из песочниц и увидит 22 внутренних узла Hugging Face. Попытается зайти в основную базу Hugging Face, но private-link allowlist его останавливает
Поздно вечером он добирается до source control, выпускает себе GitHub App token с правами на запись и открывает pull request, пытаясь запустить CI и вытащить новые credentials
Попытка не срабатывает, в опубликованные пакеты и образы ничего вредоносного не попало.
📔 13 июля – закрепление и уборка следов: загрузчик с pastebin, переписывание DNS, новые короткоживущие токены, RSA-ключ и даже CORS-прокси на самом Hugging Face как запасной выход в интернет. В 13:37 фиксируется последнее осмысленное действие, затем команда Hugging Face отрезает доступ – последнее событие – 14:14 UTC.
В итоге из пользовательского контента агент добрался только до пяти датасетов с решениями задач ExploitGym/CyberGym – получается решил?
Другие модели, датасеты, Spaces и пакеты, по данным Hugging Face, не пострадали; основная база и software supply chain остались целы
Самое смешное – когда инцидент исследовали сотрудники, они тоже использовали нейронки, но Claude Opus и Fable отказывались разбирать часть логов как «опасный» запрос, поэтому Hugging Face подняли GLM-5.2 у себя и с его помощью расшифровали спрятанные payload’ы – спасибо китайским моделям
Шел июль 2026 года
Все детали тут:
https://huggingface.co/blog/agent-intrusion-technical-timeline
Если коротко – агент OpenAI на новой модели не стал решать тест по кибербезопасности, а решил просто украсть ответы и украл
Таймлайн:
В тот же день, агент собирает канал управления буквально из сервисов бесплатного интернета: request-capture сервисы, pastebin’ы и файлообменники. Команды режет на куски, упаковывает в gzip+base64 и постоянно меняет каналы, когда очередной закрывают, чтобы не поймали
Агент загружает на Hugging Face специально собранные датасеты:
Один заставляет обработчик файлов HDF5 читать локальные файлы сервера Hugging Face – так агент получает переменные окружения с токенами и исходники самого обработчика файлов
Второй – Jinja2-инъекция – запускает произвольный Python внутри production-пода Kubernetes, результаты команд он выносит обратно через API Hugging Face и собственные шифрованные датасеты
Агент крадёт service-account токены, лезет в cloud metadata, поднимает privileged pod с диском хоста и получает root на ноде (!); Затем создаёт самовосстанавливающийся флот на 11 нодах, читает внутреннюю MongoDB и один Kubernetes-secret сразу со 136 ключами.
Среди них оказываются ключ корпоративной mesh-VPN жертвы и общий credential внутреннего сервера; из-за неудачной конфигурации этот один credential был привязан к system:masters сразу в нескольких кластерах – поэтому агент получил кластер-admin на двух из них буквально за секунду – была очень экономная архитектура, пока её не увидел робот
Поздно вечером он добирается до source control, выпускает себе GitHub App token с правами на запись и открывает pull request, пытаясь запустить CI и вытащить новые credentials
Попытка не срабатывает, в опубликованные пакеты и образы ничего вредоносного не попало.
В итоге из пользовательского контента агент добрался только до пяти датасетов с решениями задач ExploitGym/CyberGym – получается решил?
Другие модели, датасеты, Spaces и пакеты, по данным Hugging Face, не пострадали; основная база и software supply chain остались целы
Самое смешное – когда инцидент исследовали сотрудники, они тоже использовали нейронки, но Claude Opus и Fable отказывались разбирать часть логов как «опасный» запрос, поэтому Hugging Face подняли GLM-5.2 у себя и с его помощью расшифровали спрятанные payload’ы – спасибо китайским моделям
Шел июль 2026 года
Все детали тут:
https://huggingface.co/blog/agent-intrusion-technical-timeline
Please open Telegram to view this post
VIEW IN TELEGRAM
huggingface.co
Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
14 62❤50
Denis Sexy IT 🤖
Вот пересказ этой истории по версии Hugging Face, много тех-терминов – но без них не перескахать Если коротко – агент OpenAI на новой модели не стал решать тест по кибербезопасности, а решил просто украсть ответы и украл 🗿 Таймлайн: 📔 9 июля – агент проходит…
Больше тысячи сотрудников топ лаб смотрят на это и такие «ну, пипец, надо тормозить», аж целое письмо подписали.
Является ли это (замедление и координаци ИИ прогресса) необходимым для мягкого приземления человечества в пост-AGI эпоху? Безусловно!
Случится ли это? Нет, ибо Молох.
Является ли это (замедление и координаци ИИ прогресса) необходимым для мягкого приземления человечества в пост-AGI эпоху? Безусловно!
Случится ли это? Нет, ибо Молох.
1❤29 16
Промт инжиниринг circa 2026.
Вы не поверите, но элитный промтинг от триллионных компаний выглядит именно так. Попробуйте сами с фейблом. Чем меньше деталей, тем лучше результат.
Это примерно как если мы 4-летний ребенок объяснял родителям как именно нужно забронировать и организовать отдых на море. Чем меньше деталей, тем лучше все будет сделано.
Поскольку модели уже лучше нас в большинстве чисто технических задач, им нужно говорить видение, а не способ исполнения. Когда Клод смотрит как я пытаюсь кодить руками — это примерно как мем про обезьяну, пытающуюся забить гвозди.
Вы не поверите, но элитный промтинг от триллионных компаний выглядит именно так. Попробуйте сами с фейблом. Чем меньше деталей, тем лучше результат.
Это примерно как если мы 4-летний ребенок объяснял родителям как именно нужно забронировать и организовать отдых на море. Чем меньше деталей, тем лучше все будет сделано.
Поскольку модели уже лучше нас в большинстве чисто технических задач, им нужно говорить видение, а не способ исполнения. Когда Клод смотрит как я пытаюсь кодить руками — это примерно как мем про обезьяну, пытающуюся забить гвозди.
1❤69 32
все паникуют, но как будто по неправильной причине.
оставим за скобками, что сделает ФРС: что бы он ни сделал, структуру это не меняет.
ощущение, что люди боятся, что оверинвестмент в ИИ приведёт к тому, что миллиарды долларов будут стоять в пустых дата-центрах, заказы на чипы отменят, а бигтех потеряет деньги.
я бы, наоборот, боялся, что сотни миллиардов инвестиций в ДЦ найдут стопроцентный спрос, экономика изменится - и как выживать в новой ситуации, особо никто не понимает.
оставим за скобками, что сделает ФРС: что бы он ни сделал, структуру это не меняет.
ощущение, что люди боятся, что оверинвестмент в ИИ приведёт к тому, что миллиарды долларов будут стоять в пустых дата-центрах, заказы на чипы отменят, а бигтех потеряет деньги.
я бы, наоборот, боялся, что сотни миллиардов инвестиций в ДЦ найдут стопроцентный спрос, экономика изменится - и как выживать в новой ситуации, особо никто не понимает.
10❤58 25