Forwarded from Градиент обреченный (Sergei Averkiev)
LLM и черные дыры
Игрался тут на выходных — просил разные модели сгенерировать код для отрисовки черной дыры с аккреционным диском как в Интерстелларе.
Была надежда, что получится, потому что, во-первых, есть статья с кучей формул — Gravitational Lensing by Spinning Black Holes, где в соавторах указан Кип Торн, делавший расчеты для фильма (даже книгу про это написал). Во-вторых, есть клевое видео, где человек делится своей версией подобной трассировки и выкладывает упрощенную версию кода.
В итоге ничего похожего не получилось. DeepResearch'и, рассуждения и подкладывание дополнительных материалов в контекст не помогли. Хотя может я все делал не правильно и у вас получится. Если так, то поделитесь.
P.S. Некоторые модели писали очень изощренный код, который минут за 30 рисовал квадрат Малевича.
Игрался тут на выходных — просил разные модели сгенерировать код для отрисовки черной дыры с аккреционным диском как в Интерстелларе.
Была надежда, что получится, потому что, во-первых, есть статья с кучей формул — Gravitational Lensing by Spinning Black Holes, где в соавторах указан Кип Торн, делавший расчеты для фильма (даже книгу про это написал). Во-вторых, есть клевое видео, где человек делится своей версией подобной трассировки и выкладывает упрощенную версию кода.
В итоге ничего похожего не получилось. DeepResearch'и, рассуждения и подкладывание дополнительных материалов в контекст не помогли. Хотя может я все делал не правильно и у вас получится. Если так, то поделитесь.
P.S. Некоторые модели писали очень изощренный код, который минут за 30 рисовал квадрат Малевича.
👍2😁1
#open_source@dm_projects_log
Замутил новую минилибу. Идея проста и банальна, но мне не хватало такой тулзы. Собственно идея в том, чтобы держать небольшую базу знаний по моделям, для подбора моделей в целях локального развертывания. Либа анализирует состояние системы (количество оперативы, места на диске, гпу и врам) и предлагает подходящие модели. Пока есть конфигурации для диффузионок и ЛЛМ. Знания складываются в YAML файлы. Пока они там больше ради примера, чем действительно для использования. Так же присутствует ранжирование. Ранг настраиваются вручную в конфигах, но идейно должны формироваться из реальных лидербордов.
Git | pip
Замутил новую минилибу. Идея проста и банальна, но мне не хватало такой тулзы. Собственно идея в том, чтобы держать небольшую базу знаний по моделям, для подбора моделей в целях локального развертывания. Либа анализирует состояние системы (количество оперативы, места на диске, гпу и врам) и предлагает подходящие модели. Пока есть конфигурации для диффузионок и ЛЛМ. Знания складываются в YAML файлы. Пока они там больше ради примера, чем действительно для использования. Так же присутствует ранжирование. Ранг настраиваются вручную в конфигах, но идейно должны формироваться из реальных лидербордов.
Git | pip
GitHub
GitHub - Dmatryus/bm_configurator: The configurator allows you to collect knowledge about models in configs and select among them…
The configurator allows you to collect knowledge about models in configs and select among them suitable for local deployment on certain devices. - Dmatryus/bm_configurator
#open_source@dm_projects_log
#myproject@dm_projects_log
Для курса по статистике баловался с визуализацией случайных величин. Затея не на 100% увенчалась успехом в рамках курса, но добавил эту минифичу в miniutils. Может потом удалю. Пример можно посмотреть здесь.
#myproject@dm_projects_log
Для курса по статистике баловался с визуализацией случайных величин. Затея не на 100% увенчалась успехом в рамках курса, но добавил эту минифичу в miniutils. Может потом удалю. Пример можно посмотреть здесь.
#book@dm_projects_log
Новая книга! На этот раз геймдев. Это просто не закрытый гештальт. Каждый год я собираюсь сделать игру и каждый год не захожу особо далеко в этом стремлении. Мне всегда казалось, что такие вещи нужно изучать не в книгах, а на курсах, но уж очень любопытно было, как зайти через книгу, к тому же это намного более бюджетный вариант. Данная книга про последнюю на сегодня версию Unity, так что несколько лет будет актуальна, но проблема в том, что её актуальность непременно пройдет.
https://www.piter.com/collection/all/product/razrabotka-igr-na-unity-4-e-izd
Новая книга! На этот раз геймдев. Это просто не закрытый гештальт. Каждый год я собираюсь сделать игру и каждый год не захожу особо далеко в этом стремлении. Мне всегда казалось, что такие вещи нужно изучать не в книгах, а на курсах, но уж очень любопытно было, как зайти через книгу, к тому же это намного более бюджетный вариант. Данная книга про последнюю на сегодня версию Unity, так что несколько лет будет актуальна, но проблема в том, что её актуальность непременно пройдет.
https://www.piter.com/collection/all/product/razrabotka-igr-na-unity-4-e-izd
Dmatryusофрения
#review Китайский сериал "Задача трёх тел". Недавно вышел ещё на Netflix. Но эту версию, вероятно, я смотреть не буду. Просмотр китайского сериала - необычный опыт. Мне потребовалось пару часов, чтобы научиться отличать персонажей, да и китайский на фоне…
#review
Я так и не посмотрел сериал от Netflix, но посмотрел обзор на него. В общих чертах убедился, что лично мне, как тому ещё душниле, лучше подходит китайский сериал, который довольно близок к книге.
Сериал от Netflix более зрелищный и наверное лучше подходит для нормисов. Там опущено большинство физических концепций, и все очень сильно упрощено, иногда до абсурда. Однако именно, как сериал на посмотреть после работы подходит гораздо лучше, так как он короче, проще и зрелищнее, но в то же время упущено значительное количество идей, заложенных автором. Я его врядли буду смотреть, так как нахожу кайфовым некоторую долю занудства в китайском сериале, и в нем видится изначальная склонность автора книги придерживаться близости к научному представлению вещей.
В целом, это не научная фантастика, а просто фантастика, но ещё раз могу рекомендовать к ознакомлению.
Я так и не посмотрел сериал от Netflix, но посмотрел обзор на него. В общих чертах убедился, что лично мне, как тому ещё душниле, лучше подходит китайский сериал, который довольно близок к книге.
Сериал от Netflix более зрелищный и наверное лучше подходит для нормисов. Там опущено большинство физических концепций, и все очень сильно упрощено, иногда до абсурда. Однако именно, как сериал на посмотреть после работы подходит гораздо лучше, так как он короче, проще и зрелищнее, но в то же время упущено значительное количество идей, заложенных автором. Я его врядли буду смотреть, так как нахожу кайфовым некоторую долю занудства в китайском сериале, и в нем видится изначальная склонность автора книги придерживаться близости к научному представлению вещей.
В целом, это не научная фантастика, а просто фантастика, но ещё раз могу рекомендовать к ознакомлению.
#open_source
#model
https://nvlabs.github.io/Sana/
Вышла новая интересная диффузионка о Nvidia Sana!
Ключевой особенностью является то, что она способна выдавать высокого качества изображения и при этом не требовательна к ресурсам! Пишут, что качество сопостовимо с Flux-12b, но при этом модель в 7.5 раз меньше и в 100 раз быстрее. Это действительно впечатляет.
Вот вам примеры генерации волков.
Лично меня качество пока не впечатляет. Но это быстрая генерация без заморочек. На каждое изображение ушло примерно 2 секунды. Можно добавить шагов инференса при локальном развертывание и может стать лучше.
#model
https://nvlabs.github.io/Sana/
Вышла новая интересная диффузионка о Nvidia Sana!
Ключевой особенностью является то, что она способна выдавать высокого качества изображения и при этом не требовательна к ресурсам! Пишут, что качество сопостовимо с Flux-12b, но при этом модель в 7.5 раз меньше и в 100 раз быстрее. Это действительно впечатляет.
Вот вам примеры генерации волков.
Лично меня качество пока не впечатляет. Но это быстрая генерация без заморочек. На каждое изображение ушло примерно 2 секунды. Можно добавить шагов инференса при локальном развертывание и может стать лучше.
#open_source
Слишком годный пост, чтобы что-то дополнительно комментить.
Слишком годный пост, чтобы что-то дополнительно комментить.
Forwarded from эйай ньюз
Все модели мультимодальные — нативно воспринимают текст, изображения и видео. Тренировали на 30 триллионах токенов, причём токенов с других языков теперь в 10x больше по сравнению с Llama 3. Идёт в трёх размерах:
Scout (109B)— модель с 10 миллионами токенов контекста, что рекорд для релизнутой модели. По бенчам бьёт Gemma 3 и Gemini 2.0 Flash Lite, слегка не дотягивая до полноценной Flash 2.0. Это MoE модель с 16 экспертами, 109B параметров при 17B активных. С квантизацией влезает в одну GPU.
Maverick (400B)— лучше Gemini 2.0 Flash с GPT 4o, примерно на одном уровне с обновлённым DeepSeek V3, но при этом модель мультимодальная и заметно меньше в размерах. Контекст — 1 миллион токенов, меньше чем у Scout, но сильно лучше чем у других конкурентов. Активных параметров всё те же 17B, но экспертов уже 128, поэтому и 400B параметров, Модель можно запустить в fp8 на одной ноде с 8xH100.
Behemoth — гигантская модель на два триллиона параметров (288B активных, 16 экспертов). Бьёт вообщё все Instruct модели с заметным отрывом. Бегемота ещё тренируют, но его ранние версии уже были дистиллированы в Scout и Maverick, что сильно бустануло их перформанс.
Это всё ещё Instruct релиз, но Llama 4 Reasoning тоже скоро будет.
Веса
@ai_newz
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2
Dmatryusофрения
#open_source@dm_projects_log #myproject@dm_projects_log Для курса по статистике баловался с визуализацией случайных величин. Затея не на 100% увенчалась успехом в рамках курса, но добавил эту минифичу в miniutils. Может потом удалю. Пример можно посмотреть…
#open_source@dm_projects_log
#myproject@dm_projects_log
Поразмыслив, решил, что визуализация статистики все же не укладывается в концепцию миниутилок. Так что выпелил.
Зато навайбкодил XML валидатор. https://github.com/Dmatryus/miniutils
#myproject@dm_projects_log
Поразмыслив, решил, что визуализация статистики все же не укладывается в концепцию миниутилок. Так что выпелил.
Зато навайбкодил XML валидатор. https://github.com/Dmatryus/miniutils
GitHub
GitHub - Dmatryus/miniutils: A set of small scripts for simple tasks.
A set of small scripts for simple tasks. Contribute to Dmatryus/miniutils development by creating an account on GitHub.
👍2
#iron #llm
Наконец нашёл способ использовать свои 2 RTX 3090 вместе. Что позволяет запускать некоторые модели 70B. В частности на скрине запустил codellama-70b. Модель на моем тесте отработала разочаровательно.
Пробовал запустить deepseek-r1-70b, но там немного не влезает в память GPU из-за чего чрезмерно долго работает.
Других кандидатов на 2 видяхи не пробовал ещё.
Наконец нашёл способ использовать свои 2 RTX 3090 вместе. Что позволяет запускать некоторые модели 70B. В частности на скрине запустил codellama-70b. Модель на моем тесте отработала разочаровательно.
Пробовал запустить deepseek-r1-70b, но там немного не влезает в память GPU из-за чего чрезмерно долго работает.
Других кандидатов на 2 видяхи не пробовал ещё.
🤔3
#llm
Столько шума вокруг ИИ и вайбкодинга. Я около месяца исследую тему и вот мои выводы:
1. Выйбкодинг - это весело, если делаешь что-нибудь интересное, что нравится.
2. LLM все ещё не способны сами писать работающий код, только его небольшие куски.
3. Это абсолютно бесполезное занятие, если сам не понимаешь, что надо делать и потому не в состоянии поправить тот бред, что выдаёт нейронка.
Я тут решил ради опыта попробовать написать программу на незнакомом языке, фреймворке, а вдобавок я вообще не представляю, как эту программу написать. На первых шагах самые примитивные функции написать получилось, но навайбкодить хотябы MVP таким образом не выйдет.
Столько шума вокруг ИИ и вайбкодинга. Я около месяца исследую тему и вот мои выводы:
1. Выйбкодинг - это весело, если делаешь что-нибудь интересное, что нравится.
2. LLM все ещё не способны сами писать работающий код, только его небольшие куски.
3. Это абсолютно бесполезное занятие, если сам не понимаешь, что надо делать и потому не в состоянии поправить тот бред, что выдаёт нейронка.
Я тут решил ради опыта попробовать написать программу на незнакомом языке, фреймворке, а вдобавок я вообще не представляю, как эту программу написать. На первых шагах самые примитивные функции написать получилось, но навайбкодить хотябы MVP таким образом не выйдет.
Dmatryusофрения
#iron #llm Наконец нашёл способ использовать свои 2 RTX 3090 вместе. Что позволяет запускать некоторые модели 70B. В частности на скрине запустил codellama-70b. Модель на моем тесте отработала разочаровательно. Пробовал запустить deepseek-r1-70b, но там…
#iron #llm
2 видяхи круто для кодинга, так как одновременно можно хостить достаточно большую модель, как для автокомплитинга в коде, так и для встроенный в IDE контекстный чат. На одной видеокарте приходится идти на компромиссы.
2 видяхи круто для кодинга, так как одновременно можно хостить достаточно большую модель, как для автокомплитинга в коде, так и для встроенный в IDE контекстный чат. На одной видеокарте приходится идти на компромиссы.
🔥2