– Gemini 3.6 Flash: использует ~ на 17% меньше токенов, чем 3.5 Flash, и при этом превосходит ее по качеству. Плюс снизили цену, а это не может не радовать.
– Gemini 3.5 Flash-Lite: обновленная шустрая дешевая моделька линейки Flash-Lite. Выдает до 350 токенов в секунду, и гораздо лучше перформит на агентных задачах, но цены чуть повысили.
– Gemini 3.5 Flash Cyber: первая в своем роде Flash, созданная специально для кибербеза. На Cyber Gym почти достигает уровня Sol и Mythos.
Кроме того, Google объявили, что начали масштабный претрен для Gemini 4. Ждем!
blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯92🔥75❤29👍12😁7🎉4🍾3⚡1🤔1
Вы не поверите, но за той самой ИИ-атакой на Hugging Face стоит… OpenAI
Сейчас будет история, которая может перевернуть ваш взгляд на риски ИИ.
Вчера мы писали про атаку на Hugging Face, которую полностью автономно провела некая ИИ-система: t.me/data_secrets/9577.
Какая именно модель стояла за атакой, HF выяснить не удалось, но за пару дней она сгенерировала 17 тысяч вредоносных действий, используя зараженный датасет и рои недолговечных песочниц.
Сама по себе эта история уже вызвала огромный резонанс. Но тут на сцене появились еще и OpenAI.
Они выпустили материал, в котором признались, что атаку провела GPT-5.6 Sol и еще одна более способная предрелизная модель. Зачем? А это самое интересное: чтобы решить бенчмарк.
Исследователи гоняли модели на внутренних тестах, при этом специально без продакшн-ограничений, потому что хотели измерить их максимальные способности. Все проходило в изолированной среде, и агенты должны были просто решить бенчмарк ExploitGym.
И тут произошел настоящий побег из лаборатории. Модель нашла дырку в пакетном реестре, эскалировала привилегии внутри тестовой среды OpenAI и вырвалась в открытый Интернет. Дальше она сообразила, что решения для бенчмарка ExploitGym могут храниться в закрытом контуре на Hugging Face, ну а дальнейшее вы знаете.
OpenAI далеко не сразу поняли, что произошло, и Hugging Face обнаружили взлом раньше них.
Вот так.
Если раньше мы боялись, что модель что-то плохое сделает по указанию человека, то теперь даже за процессом эвала надо следить в оба. Модель не различают игру и реальность, она просто оптимизирует к цели, и если путь лежит через чужой продакшн, она пойдет туда не раздумывая. И, как видите, даже разработчики моделей и сильная инфраструктура оказываются к этому не готовы.
https://openai.com/index/hugging-face-model-evaluation-security-incident/
Сейчас будет история, которая может перевернуть ваш взгляд на риски ИИ.
Вчера мы писали про атаку на Hugging Face, которую полностью автономно провела некая ИИ-система: t.me/data_secrets/9577.
Какая именно модель стояла за атакой, HF выяснить не удалось, но за пару дней она сгенерировала 17 тысяч вредоносных действий, используя зараженный датасет и рои недолговечных песочниц.
Сама по себе эта история уже вызвала огромный резонанс. Но тут на сцене появились еще и OpenAI.
Они выпустили материал, в котором признались, что атаку провела GPT-5.6 Sol и еще одна более способная предрелизная модель. Зачем? А это самое интересное: чтобы решить бенчмарк.
Исследователи гоняли модели на внутренних тестах, при этом специально без продакшн-ограничений, потому что хотели измерить их максимальные способности. Все проходило в изолированной среде, и агенты должны были просто решить бенчмарк ExploitGym.
И тут произошел настоящий побег из лаборатории. Модель нашла дырку в пакетном реестре, эскалировала привилегии внутри тестовой среды OpenAI и вырвалась в открытый Интернет. Дальше она сообразила, что решения для бенчмарка ExploitGym могут храниться в закрытом контуре на Hugging Face, ну а дальнейшее вы знаете.
OpenAI далеко не сразу поняли, что произошло, и Hugging Face обнаружили взлом раньше них.
Вот так.
Если раньше мы боялись, что модель что-то плохое сделает по указанию человека, то теперь даже за процессом эвала надо следить в оба. Модель не различают игру и реальность, она просто оптимизирует к цели, и если путь лежит через чужой продакшн, она пойдет туда не раздумывая. И, как видите, даже разработчики моделей и сильная инфраструктура оказываются к этому не готовы.
https://openai.com/index/hugging-face-model-evaluation-security-incident/
🤯370 60🗿47😁38❤29🔥10🫡7👾4🎉3🦄2😭1
AI ускорил написание кода, но узким местом до сих пор остаётся ревью.
23 июля пройдет технический live workshop AI Code Review Agent. За два часа соберут агента, который анализирует Pull Request целиком, учитывает контекст изменений и помогает обнаруживать логические ошибки, пропущенные сценарии и риски регрессий до merge.
В прямом эфире разберут архитектуру решения и пройдут путь от первого вызова модели до работающего прототипа.
Воркшоп рассчитан на разработчиков и ML-инженеров, которые уже пишут код и хотят понять, как применять агентные системы в реальном инженерном процессе.
23 июля · 18:30 мск · онлайн
Участие бесплатное.
→ Регистрация
Реклама. ООО "Школа Высшей Математики", ИНН 9728100991
23 июля пройдет технический live workshop AI Code Review Agent. За два часа соберут агента, который анализирует Pull Request целиком, учитывает контекст изменений и помогает обнаруживать логические ошибки, пропущенные сценарии и риски регрессий до merge.
В прямом эфире разберут архитектуру решения и пройдут путь от первого вызова модели до работающего прототипа.
Воркшоп рассчитан на разработчиков и ML-инженеров, которые уже пишут код и хотят понять, как применять агентные системы в реальном инженерном процессе.
23 июля · 18:30 мск · онлайн
Участие бесплатное.
→ Регистрация
Реклама. ООО "Школа Высшей Математики", ИНН 9728100991
😁47🗿15👍9❤8 4🔥1🤯1🎉1🕊1
Никогда такого не было и вот опять: Белый Дом утверждает, что Moonshot AI дистиллировали Kimi K3 из Fable
Майкл Крациос, технологический советник Трампа, пишет, что для этого в стартапе даже разработали некую замысловатую платформу, позволяющую воровать данные и оставаться незамеченными.
Кроме того, компания якобы через Тайланд приобретает серверы с GB300, которая запрещена США для экспорта в Китай.
Звучит как затравка для еще более масштабных будущих запретов. Хоть каких-то доказательств факта дистилляции пока представлено не было.
Майкл Крациос, технологический советник Трампа, пишет, что для этого в стартапе даже разработали некую замысловатую платформу, позволяющую воровать данные и оставаться незамеченными.
Кроме того, компания якобы через Тайланд приобретает серверы с GB300, которая запрещена США для экспорта в Китай.
Легитимная дистилляция ИИ, используемая для создания более компактных и эффективных моделей, играет ключевую роль в экосистеме открытого инновационного развития. Однако масштабная, скрытая промышленная дистилляция, направленная на кражу проприетарных технологий США и подрыв американских исследований, недопустима.
Звучит как затравка для еще более масштабных будущих запретов. Хоть каких-то доказательств факта дистилляции пока представлено не было.
😁197 51💯16 15❤5🎉2🤩2🐳2🍓2✍1😎1
Такими новостями уже никого не удивишь, но GPT-5.6 опровергла еще одну известную гипотезу, которая была открыта 30 лет
Гипотеза Диница - Гарга - Гоеманса – это теорема из теории графов и сетевых потоков, которая гласит, что из допустимого дробного решения можно получить целочисленное по маршрутам решение без увеличения общей стоимости.
Подобные утверждения часто становятся основой для практических оптимизационных алгоритмов, поэтому гипотеза важная. Открыта она была с 1999.
Решение, к слову, обнаружил математик из Нижнего Тагила, выпускник ВШЭ. Вот чат с моделью. Промптинг на уровне «соверши прорыв», «опровергни общий случай», «продолжай исследовать» – то есть вообще никаких подсказок и даже серьезных инструкций. Сам автор называет чат «чистым мемом».
В итоге за несколько итераций и несколько часов модель нашла нужный контрпример. Вот такая математика в 2026.
Гипотеза Диница - Гарга - Гоеманса – это теорема из теории графов и сетевых потоков, которая гласит, что из допустимого дробного решения можно получить целочисленное по маршрутам решение без увеличения общей стоимости.
Подобные утверждения часто становятся основой для практических оптимизационных алгоритмов, поэтому гипотеза важная. Открыта она была с 1999.
Решение, к слову, обнаружил математик из Нижнего Тагила, выпускник ВШЭ. Вот чат с моделью. Промптинг на уровне «соверши прорыв», «опровергни общий случай», «продолжай исследовать» – то есть вообще никаких подсказок и даже серьезных инструкций. Сам автор называет чат «чистым мемом».
В итоге за несколько итераций и несколько часов модель нашла нужный контрпример. Вот такая математика в 2026.
🤯214🔥50👍27❤20😁13🎉2🫡2😎2
В Cursor появился мощный режим автоматического выбора модели под задачу
Фичу назвали Router. Нужно просто выбрать Auto mode и задать параметр оптимизации: качество, стоимость или баланс. Система будет анализировать каждый запрос и перенаправлять его наиболее подходящей модели.
Разработчики утверждают, что с помощью режима можно здорово сэкономить без просадки по качеству. Смотрите первый график: это A/B на реальном трафике, по одной оси стоимость, по другой user satisfaction. Так вот режим Intelligence достигает результатов Fable 5 high на 60% дешевле, а режим Balance даже дает прирост к качеству относительно Opus 4.8 при экономии ~36%.
Есть еще замеры по cost per commit, второй график. Опять же, тот же Balance выходит гораздо дешевле Opus 4.8, хотя, исходя из первого графика, перформит не хуже и даже лучше.
Пока доступно только для Teams и Enterprise, по остальным тарифам информации о релизе нет. Надеемся, что мимо обычных пользователей режим не пройдет.
Фичу назвали Router. Нужно просто выбрать Auto mode и задать параметр оптимизации: качество, стоимость или баланс. Система будет анализировать каждый запрос и перенаправлять его наиболее подходящей модели.
Разработчики утверждают, что с помощью режима можно здорово сэкономить без просадки по качеству. Смотрите первый график: это A/B на реальном трафике, по одной оси стоимость, по другой user satisfaction. Так вот режим Intelligence достигает результатов Fable 5 high на 60% дешевле, а режим Balance даже дает прирост к качеству относительно Opus 4.8 при экономии ~36%.
Есть еще замеры по cost per commit, второй график. Опять же, тот же Balance выходит гораздо дешевле Opus 4.8, хотя, исходя из первого графика, перформит не хуже и даже лучше.
Пока доступно только для Teams и Enterprise, по остальным тарифам информации о релизе нет. Надеемся, что мимо обычных пользователей режим не пройдет.
❤87👍31🔥18😁8🍾4☃1😎1
А еще сегодня, по слухам, выходит Opus 5. А завтра мощно обновляется Codex.
Сверху полный список моделей, которые теоретически должны выйти до конца лета (источник). Август тоже будет насыщенный, и вообще сезон релизов в этом году особенно хорош
Сверху полный список моделей, которые теоретически должны выйти до конца лета (источник). Август тоже будет насыщенный, и вообще сезон релизов в этом году особенно хорош
🔥170❤36🤯23🎄5🫡4😁3🎉1
Если хочешь развиваться в машинном обучении — решать реальные бизнес-задачи или уйти в исследования — в Центральном университете есть магистратура под оба сценария. И на нее можно получить грант до 75%. Места ограничены, дедлайн подачи заявок — 20 августа.
«Машинное обучение» — это направление с несколькими форматами и треками. В офлайн-формате (пары по вечерам и в выходные в центре Москвы) можно выбрать один из трех треков:
⚫️ Индустриальный — сильная база в ML, современные инструменты, реальные задачи от партнеров
⚫️ Научный (AIRI × ЦУ) — сложные модели, исследования, подготовка к аспирантуре и работе в передовых лабораториях
⚫️ ML в электронной коммерции × Lamoda — работа с реальными данными Lamoda, применение ML для бизнес-задач и возможность попасть на стажировку в компанию
Для тех, кто хочет учиться из любой точки мира, есть онлайн-формат: основной трек и продвинутый — для специалистов с опытом в ML. Это полноценная альтернатива офлайну с теми же преподавателями и курсами.
Магистратура в Центральном университете — это 2 года обучения, которое можно совмещать с работой, и диплом государственного образца. Карьерная поддержка начинается еще во время учебы: консультации, тренировочные собеседования и помощь с трудоустройством. Студенты уже в процессе обучения выходят на новые позиции или повышаются в грейде в Яндексе, Авито, Т-Банке и других компаниях.
Поступление проходит через грантовый конкурс — это одновременно способ попасть на программу и возможность выиграть финансовую поддержку на все время обучения: грант покрывает до 75% стоимости.
В 2026 году доступно 550 грантов на все программы магистратуры. Подробнее о программах и условиях участия в конкурсе — по ссылкам:
➡️ Офлайн программа
➡️ Онлайн программа
«Машинное обучение» — это направление с несколькими форматами и треками. В офлайн-формате (пары по вечерам и в выходные в центре Москвы) можно выбрать один из трех треков:
Для тех, кто хочет учиться из любой точки мира, есть онлайн-формат: основной трек и продвинутый — для специалистов с опытом в ML. Это полноценная альтернатива офлайну с теми же преподавателями и курсами.
Магистратура в Центральном университете — это 2 года обучения, которое можно совмещать с работой, и диплом государственного образца. Карьерная поддержка начинается еще во время учебы: консультации, тренировочные собеседования и помощь с трудоустройством. Студенты уже в процессе обучения выходят на новые позиции или повышаются в грейде в Яндексе, Авито, Т-Банке и других компаниях.
Поступление проходит через грантовый конкурс — это одновременно способ попасть на программу и возможность выиграть финансовую поддержку на все время обучения: грант покрывает до 75% стоимости.
В 2026 году доступно 550 грантов на все программы магистратуры. Подробнее о программах и условиях участия в конкурсе — по ссылкам:
Please open Telegram to view this post
VIEW IN TELEGRAM
🗿13😭9🔥4😁4❤3🏆3🍓2🐳1
Kimi K3 взломала Redis, и на это ей потребовалось всего полчаса и 32 агента
27 минут. Ровно столько времени прошло от запуска автономного агента до момента, пока тот нашел уязвимость и довел ее до рабочего эксплойта.
Баг оказался уровня RCE и приводил к возможности выполнить код на сервере Redis через уже аутентифицированное подключение.
☕️
27 минут. Ровно столько времени прошло от запуска автономного агента до момента, пока тот нашел уязвимость и довел ее до рабочего эксплойта.
Баг оказался уровня RCE и приводил к возможности выполнить код на сервере Redis через уже аутентифицированное подключение.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤166 102🔥30🤯20😁9🤔9😢8👍7🍾3⚡2💯1
Data Secrets
OpenAI выпустили GPT-Live – голосовой режим нового поколения (Вообще-то релиз случился еще вчера, но Grok-4.5 немного его затмил) Итак, что мы имеем: — Модель научили слушать и говорить одновременно. Даже в Advanced Voice Mode это был все еще обмен репликами…
Media is too big
VIEW IN TELEGRAM
Opus 5 пока запаздывает, но зато обновление Codex уже здесь
В приложение завезли ChatGPT Voice на основе той самой недавно выпущенной GPT-Live. Модель может одновременно говорить, слушать и координировать работу агентов в приложении.
Напоминаем, что под капотом архитектура заменили на Full-Duplex. Это как раз и означает, что вместо последовательности «юзер -> обработка -> ответ» GPT-Live слушает, обновляется и думает одновременно. В частности, раз в несколько секунд она принимает решение: продолжать слушать, перебить, вызвать инструмент и тд.
Теперь нас ждет настоящий вайб-кодинг. Почувствуй себя Тони Старком.
P.S. В обновлении многие ожидали увидеть также обещанную GPT-5.6 Sol на Cerebras (t.me/data_secrets/9492). Но, видимо, пока что этот релиз откладывается😭
В приложение завезли ChatGPT Voice на основе той самой недавно выпущенной GPT-Live. Модель может одновременно говорить, слушать и координировать работу агентов в приложении.
Напоминаем, что под капотом архитектура заменили на Full-Duplex. Это как раз и означает, что вместо последовательности «юзер -> обработка -> ответ» GPT-Live слушает, обновляется и думает одновременно. В частности, раз в несколько секунд она принимает решение: продолжать слушать, перебить, вызвать инструмент и тд.
Теперь нас ждет настоящий вайб-кодинг. Почувствуй себя Тони Старком.
P.S. В обновлении многие ожидали увидеть также обещанную GPT-5.6 Sol на Cerebras (t.me/data_secrets/9492). Но, видимо, пока что этот релиз откладывается
Please open Telegram to view this post
VIEW IN TELEGRAM
❤63🔥22👍6☃2😁1🎉1👌1😍1🐳1