Один из создателей ChatGPT представил принципиально новый тип ИИ-моделей.
Два года, Диогу Алмейда, втайне разрабатывал Jev — модель, которая не пишет текст и не генерирует токены последовательно.
Она получает любые неструктурированные данные и параллельно принимает заданные разработчиком решения. Например, выбирает одну категорию из списка, выставляет оценку или определяет вероятность утверждения.
Jev также запрещено использовать скрытую цепочку рассуждений. Сложное поведение должно собираться разработчиком из множества простых решений при помощи обычного кода.
Именно поэтому модель работает в 20–200 раз быстрее и обходится в 40–400 раз дешевле. Миллион входных токенов стоит 4,2 цента, а выход остаётся бесплатным навсегда (его вычисление настолько дёшево, что компания не видит смысла его считать.)
Компания заявляет о нулевых галлюцинациях. Jev не может выдать ответ вне заданных вариантов или нарушить структуру. При этом модель может выбрать неправильный вариант.
Это не замена GPT-6 Astra и не новый чат-бот. Jev создан для автоматизации, где программам не нужны тексты. Им нужны быстрые решения в заданном формате.
✈️ Python Ninja
Два года, Диогу Алмейда, втайне разрабатывал Jev — модель, которая не пишет текст и не генерирует токены последовательно.
Она получает любые неструктурированные данные и параллельно принимает заданные разработчиком решения. Например, выбирает одну категорию из списка, выставляет оценку или определяет вероятность утверждения.
Jev также запрещено использовать скрытую цепочку рассуждений. Сложное поведение должно собираться разработчиком из множества простых решений при помощи обычного кода.
Именно поэтому модель работает в 20–200 раз быстрее и обходится в 40–400 раз дешевле. Миллион входных токенов стоит 4,2 цента, а выход остаётся бесплатным навсегда (его вычисление настолько дёшево, что компания не видит смысла его считать.)
Компания заявляет о нулевых галлюцинациях. Jev не может выдать ответ вне заданных вариантов или нарушить структуру. При этом модель может выбрать неправильный вариант.
Это не замена GPT-6 Astra и не новый чат-бот. Jev создан для автоматизации, где программам не нужны тексты. Им нужны быстрые решения в заданном формате.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
В открытом доступе появился GuppyLM — проект, который позволяет обучить языковую модель на 9 млн параметров с нуля примерно за пять минут.
Репозиторий включает весь процесс обучения и рассчитан на быстрые эксперименты с небольшими языковыми моделями без крупной инфраструктуры.
✈️ Python Ninja
Репозиторий включает весь процесс обучения и рассчитан на быстрые эксперименты с небольшими языковыми моделями без крупной инфраструктуры.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
Отличный материал по современному программированию GPU для систем машинного обучения.
MLC Community разбирает архитектуру GPU практически с нуля: потоки и варпы, иерархию памяти, CUDA Cores и Tensor Cores, TMA, устройство Blackwell, GEMM и Flash Attention 4. Отдельный упор сделан на то, как писать действительно быстрые ядра и эффективно загружать вычислительные блоки GPU.
https://mlc.ai/modern-gpu-programming-for-mlsys/chapter_background/index.html
✈️ Python Ninja
MLC Community разбирает архитектуру GPU практически с нуля: потоки и варпы, иерархию памяти, CUDA Cores и Tensor Cores, TMA, устройство Blackwell, GEMM и Flash Attention 4. Отдельный упор сделан на то, как писать действительно быстрые ядра и эффективно загружать вычислительные блоки GPU.
https://mlc.ai/modern-gpu-programming-for-mlsys/chapter_background/index.html
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
«Принципы механики» — бесплатный учебник с открытым доступом, который даёт всестороннее введение в классическую механику.
Книга начинается с математических основ, необходимых для изучения механики, а затем переходит к основным темам: кинематике, законам движения Ньютона, работе и энергии, линейному и угловому моменту, вращательному движению, гравитации, колебаниям и волнам.
Теория сочетается с разобранными примерами и задачами, поэтому книга подойдёт как для первого знакомства с механикой, так и для повторения фундаментальных основ.
Полная версия книги бесплатно доступна в PDF:
https://link.springer.com/content/pdf/10.1007/978-3-030-15195-9.pdf
✈️ Python Ninja
Книга начинается с математических основ, необходимых для изучения механики, а затем переходит к основным темам: кинематике, законам движения Ньютона, работе и энергии, линейному и угловому моменту, вращательному движению, гравитации, колебаниям и волнам.
Теория сочетается с разобранными примерами и задачами, поэтому книга подойдёт как для первого знакомства с механикой, так и для повторения фундаментальных основ.
Полная версия книги бесплатно доступна в PDF:
https://link.springer.com/content/pdf/10.1007/978-3-030-15195-9.pdf
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
Вот один из лучших материалов для начала, если хотите понять, что процессор на самом деле делает.
https://youtu.be/GU8MnZI0snA
✈️ Python Ninja
https://youtu.be/GU8MnZI0snA
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
НАШ ОСНОВНОЙ КАНАЛ, БУДЕМ РАДЫ ВАШЕЙ ПОДПИСКЕ
Проект «TERMINAL» стал крупнейшей библиотекой бесплатного образования. В одном канале собраны курсы, книги, полезные инструменты и практические тренажёры для всех разработчиков:
• Практические курсы и задания
• Книги и статьи известных авторов
• Полезные инструменты и ресурсы
• IT-новости и инсайды
Обучение по всем направлениям: SQL, Python, ML, Frontend, PHP, C++, Go, Git, Linux, QA, Java, Vibe-coding, InfoSec и др.
⌨️ подписаться
Проект «TERMINAL» стал крупнейшей библиотекой бесплатного образования. В одном канале собраны курсы, книги, полезные инструменты и практические тренажёры для всех разработчиков:
• Практические курсы и задания
• Книги и статьи известных авторов
• Полезные инструменты и ресурсы
• IT-новости и инсайды
Обучение по всем направлениям: SQL, Python, ML, Frontend, PHP, C++, Go, Git, Linux, QA, Java, Vibe-coding, InfoSec и др.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Очень рекомендую сохранить осенний курс Стэнфорда MS&E 319 — Efficient Generative Language Models.
Курс идёт от предобучения до инференса и постобучения. Материалы и записи лекций обещают выкладывать позже.
Мне особенно нравится его исходная идея: модели становятся всё больше, но бюджет всегда ограничен. Если есть конкретная задача и ограниченные вычислительные ресурсы, как выбрать цель обучения, архитектуру модели и способ инференса так, чтобы получить максимум за свои деньги и не запускать GPT-6 на каждой задаче.
«Просто купить ещё GPU» тоже вариант — и сейчас это фактически основной подход рынка.
В курсе будут MoE, attention, сжатие KV Cache, квантизация, speculative decoding, а также LoRA, RLHF, DPO и дистилляция. Все эти обычно разрозненные техники рассматриваются через один вопрос: какую именно часть вычислений, памяти или времени они экономят и чем за это приходится платить.
Например, если нужно снизить стоимость использования модели, один подход позволяет на каждом запросе задействовать только часть параметров, другой уменьшает объём данных, которые нужно хранить и перемещать, третий ускоряет генерацию ответа. Сначала нужно понять, какую именно проблему решает каждый метод, и только потом выбирать подходящий для своей задачи и смотреть, какие из них можно сочетать.
Мне самому при оценке ИИ-компаний особенно интересен именно этот уровень: можно ли на тот же бюджет обучить более сильную модель или обслужить больше пользователей. Когда понимаешь компромиссы этих методов, релизы моделей и изменения их стоимости становятся намного понятнее.
У курса есть определённый порог входа, но если тема интересна, точно стоит следить:
https://web.stanford.edu/class/msande319/
✈️ Python Ninja
Курс идёт от предобучения до инференса и постобучения. Материалы и записи лекций обещают выкладывать позже.
Мне особенно нравится его исходная идея: модели становятся всё больше, но бюджет всегда ограничен. Если есть конкретная задача и ограниченные вычислительные ресурсы, как выбрать цель обучения, архитектуру модели и способ инференса так, чтобы получить максимум за свои деньги и не запускать GPT-6 на каждой задаче.
«Просто купить ещё GPU» тоже вариант — и сейчас это фактически основной подход рынка.
В курсе будут MoE, attention, сжатие KV Cache, квантизация, speculative decoding, а также LoRA, RLHF, DPO и дистилляция. Все эти обычно разрозненные техники рассматриваются через один вопрос: какую именно часть вычислений, памяти или времени они экономят и чем за это приходится платить.
Например, если нужно снизить стоимость использования модели, один подход позволяет на каждом запросе задействовать только часть параметров, другой уменьшает объём данных, которые нужно хранить и перемещать, третий ускоряет генерацию ответа. Сначала нужно понять, какую именно проблему решает каждый метод, и только потом выбирать подходящий для своей задачи и смотреть, какие из них можно сочетать.
Мне самому при оценке ИИ-компаний особенно интересен именно этот уровень: можно ли на тот же бюджет обучить более сильную модель или обслужить больше пользователей. Когда понимаешь компромиссы этих методов, релизы моделей и изменения их стоимости становятся намного понятнее.
У курса есть определённый порог входа, но если тема интересна, точно стоит следить:
https://web.stanford.edu/class/msande319/
Please open Telegram to view this post
VIEW IN TELEGRAM
web.stanford.edu
MS&E 319: Efficient Generative Language Models | Stanford, Autumn 2026
MS&E 319 at Stanford studies algorithms for efficient language-model training and inference, alongside risks and vulnerabilities.
❤3🎉1🏆1
Вышла открытая альтернатива Jev — Kev. Модель доступна в трёх размерах.
Она работает локально, поэтому данные остаются на вашем компьютере. Kev может отвечать «да» или «нет», выбирать один из вариантов и добавлять примечание. Подходит для задач классификации.
✈️ Python Ninja
Она работает локально, поэтому данные остаются на вашем компьютере. Kev может отвечать «да» или «нет», выбирать один из вариантов и добавлять примечание. Подходит для задач классификации.
Please open Telegram to view this post
VIEW IN TELEGRAM
🆒2👌1💯1🙈1
Слили в телеграмм тонны инфы
🔥 Всё, что нужно для прогресса — в одном месте:
|- -🗂 Курсы & Git — 1526ГБ
|
|- -🗂 Хакинг & ИБ — 573ГБ
|
|- -🗂 Python — 428ГБ
|
|- -🗂 Linux & Bash — 652ГБ
|
|- -🗂 OSINT — 352ГБ
|
|- -🗂 Работа IT — 356ГБ
|
|- -🗂 Общее IT — 2575ГБ
📌 Гайды, шпаргалки, книги, задачи и ресурсы для каждого.
|- -
|
|- -
|
|- -
|
|- -
|
|- -
|
|- -
|
|- -
Please open Telegram to view this post
VIEW IN TELEGRAM
💯2❤1
Исследователь OpenAI Алиса Лю прошла 57 собеседований перед тем, как попасть в компанию, а затем открыто опубликовала весь свой путь подготовки и поиска работы.
Если вы готовитесь к позициям Research Scientist или MTS, это один из самых насыщенных практических материалов, которые сейчас можно найти.
Можно использовать её конспекты напрямую или просто взять список тем и пройти их самостоятельно. Такое публикуют редко.
Конспекты по LLM:
https://alisawuffles.notion.site/alisa-s-book-of-llms
Математика:
https://alisawuffles.notion.site/math-notes
Разбор поиска работы и собеседований:
https://alisawuffles.github.io/blog/job-search/
✈️ Python Ninja
Если вы готовитесь к позициям Research Scientist или MTS, это один из самых насыщенных практических материалов, которые сейчас можно найти.
Можно использовать её конспекты напрямую или просто взять список тем и пройти их самостоятельно. Такое публикуют редко.
Конспекты по LLM:
https://alisawuffles.notion.site/alisa-s-book-of-llms
Математика:
https://alisawuffles.notion.site/math-notes
Разбор поиска работы и собеседований:
https://alisawuffles.github.io/blog/job-search/
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2