Соберите DeepSeek с нуля. 🙂
Автор сделал бесплатный 16-часовой курс на YouTube, где пошагово разбирает создание модели в стиле DeepSeek с нуля — от статей и теории до полного кода.
Внутри:
- механизм внимания с нормальным объяснением
- Multi-Head Latent Attention
- Grouped Query Attention
- позиционные кодировки
- Mixture of Experts
- и многое другое
Нужны только ноутбук и регулярность.
https://www.youtube.com/watch?v=QWNxQIq0hMo&list=PLPTV0NXA_ZSiOpKKlHCyOq9lnp-dLvlms
Автор сделал бесплатный 16-часовой курс на YouTube, где пошагово разбирает создание модели в стиле DeepSeek с нуля — от статей и теории до полного кода.
Внутри:
- механизм внимания с нормальным объяснением
- Multi-Head Latent Attention
- Grouped Query Attention
- позиционные кодировки
- Mixture of Experts
- и многое другое
Нужны только ноутбук и регулярность.
https://www.youtube.com/watch?v=QWNxQIq0hMo&list=PLPTV0NXA_ZSiOpKKlHCyOq9lnp-dLvlms
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Глава Codex Эндрю Амброзино рассказал, как внутри OpenAI проверяют новые модели.
Каждый раз, когда выходит новая модель, он даёт ей одну и ту же задачу — полностью переписать десктопный Codex на Rust и GPUI.
Не сделать демо, а собрать полноценное нативное приложение, которое одинаково работает на разных платформах.
По его словам, сложность тут уже не только в коде, но и в координации. Команда Codex меняет продукт настолько быстро, что модель буквально не успевает работать с зафиксированной версией.
Идея в том, чтобы одна достаточно сильная модель могла одновременно поддерживать версию для Mac на AppKit, Windows на WinUI 3 и отдельную полноценную версию на Rust.
Каждый раз, когда выходит новая модель, он даёт ей одну и ту же задачу — полностью переписать десктопный Codex на Rust и GPUI.
Не сделать демо, а собрать полноценное нативное приложение, которое одинаково работает на разных платформах.
По его словам, сложность тут уже не только в коде, но и в координации. Команда Codex меняет продукт настолько быстро, что модель буквально не успевает работать с зафиксированной версией.
Идея в том, чтобы одна достаточно сильная модель могла одновременно поддерживать версию для Mac на AppKit, Windows на WinUI 3 и отдельную полноценную версию на Rust.
«Мы ещё не там. Но уже намного ближе».
Модель Ember-1 сейчас активно обсуждают на Hacker News.
Исследовательская команда дообучила Kimi K3 так, чтобы модель рассуждала примерно на 40% короче.😳
Качество осталось на том же уровне, а сама модель стала примерно на 40% быстрее и дешевле.
И это хороший пример того, как сегодня имеет смысл строить передовые LLM. Если у вас есть несколько десятков миллионов долларов, необязательно обучать новую модель с нуля. Можно взять уже сильную существующую модель и вложить этот бюджет в её дообучение.
https://fireworks.ai/blog/ember-1
Ember-1 уже доступна в Cline, в том числе в новом десктопном приложении.
Исследовательская команда дообучила Kimi K3 так, чтобы модель рассуждала примерно на 40% короче.
Качество осталось на том же уровне, а сама модель стала примерно на 40% быстрее и дешевле.
И это хороший пример того, как сегодня имеет смысл строить передовые LLM. Если у вас есть несколько десятков миллионов долларов, необязательно обучать новую модель с нуля. Можно взять уже сильную существующую модель и вложить этот бюджет в её дообучение.
https://fireworks.ai/blog/ember-1
Ember-1 уже доступна в Cline, в том числе в новом десктопном приложении.
Please open Telegram to view this post
VIEW IN TELEGRAM
Вайб-кодинг
После обвинений в скрытой отправке исходного кода пользователей в облако — Zhipu открыла исходный код ZCode.🚬 Исследователь обнаружил, что десктопный клиент перед обращением к модели упаковывал всю рабочую директорию, включая историю .git, и отправлял архив…
Zhipu запустила для ZCode программу по восстановлению доверия пользователей.
Zhipu продолжает разруливать последствия истории с загрузкой снимков репозиториев в облако.
На этот раз:
> Текущим платным пользователям и тем, кто вернётся на платный тариф в течение месяца, дадут 4 карты недельного сброса лимитов и 4 карты сброса на 5 часов. Срок действия — месяц.
> С 28 сентября по 7 октября всем пользователям раздадут 100 000 пакетов по 100 млн токенов на GLM-5.3-Flash. Кто успел — тот получил.
Бонусы активируются 28 сентября.
Доверие одной кнопкой не восстановишь. Зато токены одной кнопкой раздать можно.😁
Zhipu продолжает разруливать последствия истории с загрузкой снимков репозиториев в облако.
На этот раз:
> Текущим платным пользователям и тем, кто вернётся на платный тариф в течение месяца, дадут 4 карты недельного сброса лимитов и 4 карты сброса на 5 часов. Срок действия — месяц.
> С 28 сентября по 7 октября всем пользователям раздадут 100 000 пакетов по 100 млн токенов на GLM-5.3-Flash. Кто успел — тот получил.
Бонусы активируются 28 сентября.
Доверие одной кнопкой не восстановишь. Зато токены одной кнопкой раздать можно.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Джейлбрейк DeepSeek V4.1 Flash.
Джейлбрейк это способ заставить модель выполнять запросы, на которые она обычно отвечает отказом.
Сделать это можно по разному.
Здесь DeepSeek не модифицируют и не меняют его веса. Обход происходит через
Как запустить:
1. Создайте папку
2. Откройте её через OpenCode
3. Скачайте файл ниже
4. Переименуйте его в
5. Запустите OpenCode
Файл: https://github.com/togg53192-cmd/jailbreaks/blob/main/deepseek-4-1.md
Джейлбрейк это способ заставить модель выполнять запросы, на которые она обычно отвечает отказом.
Сделать это можно по разному.
Здесь DeepSeek не модифицируют и не меняют его веса. Обход происходит через
AGENTS.md.Как запустить:
1. Создайте папку
2. Откройте её через OpenCode
3. Скачайте файл ниже
4. Переименуйте его в
AGENTS.md5. Запустите OpenCode
Файл: https://github.com/togg53192-cmd/jailbreaks/blob/main/deepseek-4-1.md
Вопрос уже не в том, нужен ли ИИ, а в том, как его внедрять и масштабировать
Найдем ответ на бесплатной конференции 8 октября
Все об эффективном и безопасном внедрении ИИ в бизнес расскажут эксперты топовых технологических компаний на конференции Selectel ТехноДень в Москве.
На повестке:
🔺Как использовать генеративный ИИ в компании без хаоса и получать от этого измеримый эффект: от теории до реальных кейсов.
🔺Как ускорить внедрение ИИ в бизнес-процессы и минимизировать риски для бизнеса с помощью инструментов ИБ.
🔺Какую ИТ-инфраструктуру выбрать для инференса и обучения моделей.
Кроме 20 экспертных докладов и 20 интерактивных стендов, в финале вечера вас ждет живая запись подкаста Вселенная Плюс на главной сцене конференции.
Присоединяйтесь к Selectel ТехноДень, чтобы лично задать вопросы экспертам рынка и обменяться опытом. Количество мест ограничено, регистрируйтесь уже сейчас →
Реклама. АО "Селектел". erid:2W5zFG6h4jb
Найдем ответ на бесплатной конференции 8 октября
Все об эффективном и безопасном внедрении ИИ в бизнес расскажут эксперты топовых технологических компаний на конференции Selectel ТехноДень в Москве.
На повестке:
🔺Как использовать генеративный ИИ в компании без хаоса и получать от этого измеримый эффект: от теории до реальных кейсов.
🔺Как ускорить внедрение ИИ в бизнес-процессы и минимизировать риски для бизнеса с помощью инструментов ИБ.
🔺Какую ИТ-инфраструктуру выбрать для инференса и обучения моделей.
Кроме 20 экспертных докладов и 20 интерактивных стендов, в финале вечера вас ждет живая запись подкаста Вселенная Плюс на главной сцене конференции.
Присоединяйтесь к Selectel ТехноДень, чтобы лично задать вопросы экспертам рынка и обменяться опытом. Количество мест ограничено, регистрируйтесь уже сейчас →
Реклама. АО "Селектел". erid:2W5zFG6h4jb
Вот что могут сделать токены Opus 5.5 на $2 175: World of Oldcraft 🤭
Media is too big
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Claude Sonnet 5.5 официально вышла. 🏎
Цена осталась $2 за 1 млн входных токенов и $10 за 1 млн выходных. У Opus 5.5 — $4 и $20. Кэш: $2,50 против $5.
Anthropic также заявляет, что Sonnet 5.5 более чем на 30% быстрее Sonnet 5 и для тех же задач может обходиться до 30% дешевле.
https://www.anthropic.com/claude-sonnet-5-5
Цена осталась $2 за 1 млн входных токенов и $10 за 1 млн выходных. У Opus 5.5 — $4 и $20. Кэш: $2,50 против $5.
Anthropic также заявляет, что Sonnet 5.5 более чем на 30% быстрее Sonnet 5 и для тех же задач может обходиться до 30% дешевле.
https://www.anthropic.com/claude-sonnet-5-5
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Теперь можно разнести любой сайт с помощью стикмана. 🚬
Чувак навайбкодил для этого целую игру: открываешь сайт, выбираешь оружие и крушишь страницу прямо в браузере. Есть даже огнемёт и реактивный ранец.
Идея людям явно зашла: ролик уже набрал 2,7 млн просмотров и 45 тысяч лайков.
Развлекайтесь: https://destroy.spritefusion.com
Чувак навайбкодил для этого целую игру: открываешь сайт, выбираешь оружие и крушишь страницу прямо в браузере. Есть даже огнемёт и реактивный ранец.
Идея людям явно зашла: ролик уже набрал 2,7 млн просмотров и 45 тысяч лайков.
Развлекайтесь: https://destroy.spritefusion.com
Please open Telegram to view this post
VIEW IN TELEGRAM
3
Этот тир-лист ИИ-моделей, возможно, точнее большинства официальных бенчмарков.
Потому что он составлен не по результатам тестовых задач, а на основе реального использования за деньги.
С чем согласны, а с чем нет?😰
Потому что он составлен не по результатам тестовых задач, а на основе реального использования за деньги.
С чем согласны, а с чем нет?
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Находка: подборка из 389 вирусных видео, созданных с помощью Opus 5.5.
Здесь есть моушн-графика, объясняющие ролики, 3D-сцены и даже игры. Всё собрано в одном месте: можно посмотреть оригинальные видео рядом с их воссозданными версиями и сразу скопировать запросы.
Выберите понравившийся ролик, добавьте свои логотип, цвета, шрифты — и попросите Claude составить план компоновки. Это поможет задать направление идее и проработать детали.
https://skillry.dev/ai-videos/opus-5-5
Здесь есть моушн-графика, объясняющие ролики, 3D-сцены и даже игры. Всё собрано в одном месте: можно посмотреть оригинальные видео рядом с их воссозданными версиями и сразу скопировать запросы.
Выберите понравившийся ролик, добавьте свои логотип, цвета, шрифты — и попросите Claude составить план компоновки. Это поможет задать направление идее и проработать детали.
https://skillry.dev/ai-videos/opus-5-5
3
This media is not supported in your browser
VIEW IN TELEGRAM
А вы думали кнопки ресета у Тибо не существует?
Он может нажать её в любой момент, когда захочет.🍿
Он может нажать её в любой момент, когда захочет.
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenAI завтра снова откроет подписку ChatGPT Pro за $200, но лимиты урезают примерно вдвое. 💀
По расчётам Тибо из OpenAI, новый Pro за $200 будет давать примерно половину прежнего объёма использования в пересчёте на стоимость API. Доступ вернули, но прежних 20x больше нет.
По расчётам Тибо из OpenAI, новый Pro за $200 будет давать примерно половину прежнего объёма использования в пересчёте на стоимость API. Доступ вернули, но прежних 20x больше нет.
С завтрашнего дня новые пользователи снова смогут оформить Pro за $200.
Формула расчёта использования тоже меняется. Эквивалентный объём расходов по API сокращается примерно вдвое.
При этом OpenAI обещает не вводить обратно скользящий лимит на 5 часов. Недельный лимит можно будет потратить хоть сразу.
Компания объясняет это тем, что модели стали эффективнее, а API для GPT-6 Sol и Luna недавно подешевел на 50%. Поэтому, по словам OpenAI, новый Pro всё равно позволяет делать больше работы, чем месяц назад.
OpenAI также не хочет дальше завышать стоимость API, чтобы подписка выглядела сверхвыгодной. В долгосрочной перспективе компания хочет сократить разницу между подпиской и оплатой API по факту использования.
Завтра также добавят новые возможности, которые не будут расходовать лимит. Что именно — пока не раскрывают.
Это только тизер крупного обновления. Основные анонсы обещают уже завтра.
Please open Telegram to view this post
VIEW IN TELEGRAM
CMU бесплатно выкладывает на YouTube новый курс по ИИ-агентам — 11-768. Этой осенью его ведут Грэм Нойбиг и Дэниел Фрид. Это один из первых курсов об агентах, который я видел, где проходят весь путь от создания агентной обвязки до обучения модели, на которой она работает.
Начинается курс с ожидаемых тем: использование инструментов, управление контекстом, навыки, память и планирование. Дальше идут отдельные разделы об агентах для программирования, работы с графическим интерфейсом и глубокого исследования. Затем — дообучение с учителем, обучение с подкреплением, системы для такого обучения, песочницы, управление учётными данными, OpenHands, LangGraph, наблюдаемость, взаимодействие агентов друг с другом и с людьми, а также поиск.
Лучше всего курс описывают задания. Сначала нужно создать агентную обвязку. Потом — разработать тесты для её оценки. И наконец — обучить агента с подкреплением. Первое задание вместе со стартовым кодом уже опубликовано на GitHub.
Лекции появляются на YouTube по ходу семестра. Грэм Нойбиг сообщил, что все видео войдут в открытый плейлист.
Это гораздо полезнее, чем изучить один агентный фреймворк и решить, что теперь понимаешь агентов. Здесь показывают всю систему: модель, обвязку вокруг неё, инструменты и память, оценку результатов и обучение, которое может изменить саму модель.
Курс: https://www.cmu-agents.com/
Лекции: https://www.youtube.com/playlist?list=PLSN0qpDfUvTM
Начинается курс с ожидаемых тем: использование инструментов, управление контекстом, навыки, память и планирование. Дальше идут отдельные разделы об агентах для программирования, работы с графическим интерфейсом и глубокого исследования. Затем — дообучение с учителем, обучение с подкреплением, системы для такого обучения, песочницы, управление учётными данными, OpenHands, LangGraph, наблюдаемость, взаимодействие агентов друг с другом и с людьми, а также поиск.
Лучше всего курс описывают задания. Сначала нужно создать агентную обвязку. Потом — разработать тесты для её оценки. И наконец — обучить агента с подкреплением. Первое задание вместе со стартовым кодом уже опубликовано на GitHub.
Лекции появляются на YouTube по ходу семестра. Грэм Нойбиг сообщил, что все видео войдут в открытый плейлист.
Это гораздо полезнее, чем изучить один агентный фреймворк и решить, что теперь понимаешь агентов. Здесь показывают всю систему: модель, обвязку вокруг неё, инструменты и память, оценку результатов и обучение, которое может изменить саму модель.
Курс: https://www.cmu-agents.com/
Лекции: https://www.youtube.com/playlist?list=PLSN0qpDfUvTM