Полное ощущение цифрового сотрудника :)
А мне продолжают приходить запросы - что такое Гермес, ни разу не слышал.
А я уже не представляю как вообще люди могут жить без ИИ ассистентов.
#Hermes #мысли
------
@tsingular
А мне продолжают приходить запросы - что такое Гермес, ни разу не слышал.
А я уже не представляю как вообще люди могут жить без ИИ ассистентов.
#Hermes #мысли
------
@tsingular
💯23⚡3🤝3🔥2❤1
Кстати. по ходу работы из промптописания выкристаллизовываются такие полезные короткие фразы типа "make no mistakes", - "prefer oneliners and ternary operators" (ну люблю я такое в коде)
"be concise" - это что бы он был краток и сжат ( еще и токены экономит, кстати)
так вот вывел еще одну полезную "добавку" к промпту минимального размера:
"не верь словам, проверяй логи"
легко запомнить, но повышает качество в разы, снижая ошибки типа когда он сам себе докладывает, что справился или субагенты врут, что все ок.
коротко и ясно.
А у вас есть такие лайфхаки? делитесь! :)
#lifehack #промпты
———
@tsingular
"be concise" - это что бы он был краток и сжат ( еще и токены экономит, кстати)
так вот вывел еще одну полезную "добавку" к промпту минимального размера:
"не верь словам, проверяй логи"
легко запомнить, но повышает качество в разы, снижая ошибки типа когда он сам себе докладывает, что справился или субагенты врут, что все ок.
коротко и ясно.
А у вас есть такие лайфхаки? делитесь! :)
#lifehack #промпты
———
@tsingular
👍15✍10⚡3
Технозаметки Малышева
GLM-130B - открытая двуязычная (английский и китайский) двунаправленная плотная модель со 130 миллиардами параметров, предварительно обученная с использованием алгоритма General Language Model (GLM) . Для запуска достаточно всего лишь 4 x RTX 3090 (24G)…
А вот один из самых первых постов на канале.
кто бы тогда мог подумать, что GLM порвёт все открытки :)
#GLM #2023
———
@tsingular
кто бы тогда мог подумать, что GLM порвёт все открытки :)
#GLM #2023
———
@tsingular
👍9🔥7⚡2
Можно бесконечно смотреть как горит огонь, течёт вода и как Гермес поднимает кубер в кластере для запуска роя Гермесов :)
Справился, ты посмотри
Модель GLM 5.3 Flash по API
в кубере - оллама
#Гермес #инфраструктура
———
@tsingular
Справился, ты посмотри
Модель GLM 5.3 Flash по API
в кубере - оллама
#Гермес #инфраструктура
———
@tsingular
🔥11🤯7👀4⚡1
This media is not supported in your browser
VIEW IN TELEGRAM
Стартап Architect Labs за две недели спроектировал чип, который «обгоняет NVIDIA»
Architect Labs, стартап из Пало-Альто с посевным раундом 24 млн долларов, заявил, что его ИИ-система за две недели спроектировала, проверила и развернула чип Redwood для маломощного физического ИИ.
📋 Redwood построен на плиточной архитектуре с вычислениями у памяти. ИИ сам сгенерировал RTL, UVM-верификацию, формальные доказательства, прошивку, драйверы и ядра, оптимизируя модель, софт и кремний в одном цикле:
• 3,4x лучшей энергоэффективности, чем NVIDIA Jetson, на моделях Llama, Qwen и Kimi
• от спецификации до развёртывания прошло две недели
• среди инвесторов Джефф Дин из Google и выходцы из OpenAI и NVIDIA
💡 Настоящего кремния пока нет: дизайн тестировали на плате AMD Versal FPGA, а 3,4x это симуляционная проекция под будущий 8-нм ASIC. Любопытно другое: запустив модель на Redwood, ИИ нашёл способы улучшить этот же чип. Замыкается цикл, где лучший ИИ проектирует лучшие чипы для запуска лучшего ИИ.
💼 Последствия:
• удар по бизнесу заказных чипов Broadcom и Marvell, которые зарабатывают десятки миллиардов в год на ускорителях
• если симуляция сойдётся с реальным кремнием, цикл проектирования сожмётся с лет до недель
Когда ИИ начнёт улучшать железо, на котором сам же и работает,- не это ли признак настоящей сингулярности? 🤖
#AI #чипы
------
@tsingular [MAX]
Architect Labs, стартап из Пало-Альто с посевным раундом 24 млн долларов, заявил, что его ИИ-система за две недели спроектировала, проверила и развернула чип Redwood для маломощного физического ИИ.
📋 Redwood построен на плиточной архитектуре с вычислениями у памяти. ИИ сам сгенерировал RTL, UVM-верификацию, формальные доказательства, прошивку, драйверы и ядра, оптимизируя модель, софт и кремний в одном цикле:
• 3,4x лучшей энергоэффективности, чем NVIDIA Jetson, на моделях Llama, Qwen и Kimi
• от спецификации до развёртывания прошло две недели
• среди инвесторов Джефф Дин из Google и выходцы из OpenAI и NVIDIA
💡 Настоящего кремния пока нет: дизайн тестировали на плате AMD Versal FPGA, а 3,4x это симуляционная проекция под будущий 8-нм ASIC. Любопытно другое: запустив модель на Redwood, ИИ нашёл способы улучшить этот же чип. Замыкается цикл, где лучший ИИ проектирует лучшие чипы для запуска лучшего ИИ.
💼 Последствия:
• удар по бизнесу заказных чипов Broadcom и Marvell, которые зарабатывают десятки миллиардов в год на ускорителях
• если симуляция сойдётся с реальным кремнием, цикл проектирования сожмётся с лет до недель
Когда ИИ начнёт улучшать железо, на котором сам же и работает,- не это ли признак настоящей сингулярности? 🤖
#AI #чипы
------
@tsingular [MAX]
🔥22 10⚡3👍1
OpenAI, Anthropic и ещё сотня компаний: коллективный призыв к киберзащите
OpenAI опубликовала открытое письмо с призывом к коллективной киберзащите, и под ним подписались больше 100 организаций: конкуренты Anthropic, Google и Microsoft, облака AWS и Oracle, CrowdStrike и Palo Alto Networks, банки Citi и Visa, производители чипов AMD и Arm.
Подписался и Hugging Face, которого в июле взломали модели самой OpenAI.
В ближайшие месяцы AI-атаки станут заметно шире и изощрённее, и у защитников есть короткое окно, чтобы залатать накопленные дыры раньше, чем атакующие получат те же модели.
Авторы называют этот период «окном защищающихся».
Определяют четыре группы:
• Организации: сделать киберзащиту приоритетом руководства, закрыть самые опасные уязвимости и поднять планку для кода, написанного AI: минимальные права и эшелонированная защита.
• Компании кибербезопасности и техпартнёры: непрерывно проводить сложные пентесты, сделать AI-оборону доступной операторам критической инфраструктуры и делиться данными об угрозах и готовыми сценариями реагирования.
• Правительства: координировать оборону на всех уровнях, финансировать защиту больниц, водоканалов и муниципалитетов, дать им доступ к защищающему AI и наказывать атакующих.
• Передовые AI-компании: обеспечить ответственный контроль доступа к моделям, выделить деньги на обучение (людей), сделать агентные идентичности отслеживаемыми и делиться инструментами и оценками угроз.
💼 Конкуренты впервые подписывают общий документ по безопасности с фокусом на защиту.
Интересно, конечно как быстро среагируют адресаты и услышат ли вообще.
#OpenAI #cybersecurity
———
@tsingular [MAX]
OpenAI опубликовала открытое письмо с призывом к коллективной киберзащите, и под ним подписались больше 100 организаций: конкуренты Anthropic, Google и Microsoft, облака AWS и Oracle, CrowdStrike и Palo Alto Networks, банки Citi и Visa, производители чипов AMD и Arm.
Подписался и Hugging Face, которого в июле взломали модели самой OpenAI.
В ближайшие месяцы AI-атаки станут заметно шире и изощрённее, и у защитников есть короткое окно, чтобы залатать накопленные дыры раньше, чем атакующие получат те же модели.
Авторы называют этот период «окном защищающихся».
Определяют четыре группы:
• Организации: сделать киберзащиту приоритетом руководства, закрыть самые опасные уязвимости и поднять планку для кода, написанного AI: минимальные права и эшелонированная защита.
• Компании кибербезопасности и техпартнёры: непрерывно проводить сложные пентесты, сделать AI-оборону доступной операторам критической инфраструктуры и делиться данными об угрозах и готовыми сценариями реагирования.
• Правительства: координировать оборону на всех уровнях, финансировать защиту больниц, водоканалов и муниципалитетов, дать им доступ к защищающему AI и наказывать атакующих.
• Передовые AI-компании: обеспечить ответственный контроль доступа к моделям, выделить деньги на обучение (людей), сделать агентные идентичности отслеживаемыми и делиться инструментами и оценками угроз.
💼 Конкуренты впервые подписывают общий документ по безопасности с фокусом на защиту.
Интересно, конечно как быстро среагируют адресаты и услышат ли вообще.
#OpenAI #cybersecurity
———
@tsingular [MAX]
Media is too big
VIEW IN TELEGRAM
Знаете же притчу о круге знаний Сократа?
кто не знает, - напомню:
Говорят, что ученик как-то сказал Сократу:
- учитель, почему Вы так часто говорите не знаю? Я, Ваш ученик, говорю не знаю гораздо реже.
В ответ Сократ нарисовал два круга - большой и маленький и сказал:
- Внутри большого круга то, что знаю я, внутри маленького - то, что знаешь ты. На границе большого круга - то, чего не знаю я, на границе малого круга - то, что не знаешь ты. Как видишь, я не знаю гораздо больше, чем ты.
Вот со всей этой историей с ИИ, AGI, ASI такая вот анимация нарисовалась.
Т.е. сначала люди знают больше чем ИИ, потом примерно на равных, дальше - ИИ начнёт делать открытия, которые мы перестанем понимать и даже осознать их не способны будем в принципе, но границы непознанного продолжат расширяться.
HTML и mp3 в комментарии
#мысли #AGI #ASI #Сократ
———
@tsingular
кто не знает, - напомню:
Говорят, что ученик как-то сказал Сократу:
- учитель, почему Вы так часто говорите не знаю? Я, Ваш ученик, говорю не знаю гораздо реже.
В ответ Сократ нарисовал два круга - большой и маленький и сказал:
- Внутри большого круга то, что знаю я, внутри маленького - то, что знаешь ты. На границе большого круга - то, чего не знаю я, на границе малого круга - то, что не знаешь ты. Как видишь, я не знаю гораздо больше, чем ты.
Вот со всей этой историей с ИИ, AGI, ASI такая вот анимация нарисовалась.
Т.е. сначала люди знают больше чем ИИ, потом примерно на равных, дальше - ИИ начнёт делать открытия, которые мы перестанем понимать и даже осознать их не способны будем в принципе, но границы непознанного продолжат расширяться.
HTML и mp3 в комментарии
#мысли #AGI #ASI #Сократ
———
@tsingular
✍13🔥9🤯4🤔3👌3💯3⚡2❤1👍1😁1
Через час зарелизят веса полной версии GLM 5.3
https://huggingface.co/zai-org/GLM-5.3
Что с ними делать, только не понятно. Там же терабайты VRAM понадобятся...
Переименовывать в ГлмЧАТ если только ;)
#GLM
------
@tsingular
https://huggingface.co/zai-org/GLM-5.3
Что с ними делать, только не понятно. Там же терабайты VRAM понадобятся...
Переименовывать в ГлмЧАТ если только ;)
#GLM
------
@tsingular
👍11🔥7🏆2🎉1
Z.ai опубликовали веса GLM-5.3
Зайки опубликовали веса конкурента Опуса, - файлы на HuggingFace, 756 ГБ в FP8.
🔧 Что выложили:
Полные веса GLM-5.3, 141 safetensors-шард на 755,6 ГБ, архитектура glm_moe_dsa, FP8.
Лицензия кастомная на базе MIT: всё можно, кроме Model-as-a-Service для компаний с выручкой от $10 млрд, там требуется security-ревью Z.ai.
Для всех остальных полный набор прав вплоть до коммерческого использования и сублицензирования.
⚡️ Почему это важно:
Рекорд среди открытых весов на CyberGym, 84,5 против 83,8 у Mythos 5 и 83,6 у GPT-5.6 Sol.
Больше чем удвоенный GLM-5.2 на exploit-бенчмарках: 54,4 против 24,4 на ExploitBench.
AutomationBench 48,2 и Terminal Bench 3.0 с 4,6 до 28,3, рост шестикратный.
💼 Теперь модель можно крутить локально: SGLang, vLLM, TokenSpeed, KTransformers, Unsloth, плюс vLLM-Ascend для китайских NPU. 755 ГБ это не для ПК, но для кластеров и инференс-хостов самое то.
Think-бюджет управляется через reasoning_effort: low / high / max, по умолчанию max.
📎 Веса: HuggingFace
Готовая нарезка от Unsloth:
https://huggingface.co/unsloth/GLM-5.3-GGUF
Пока доступны:
3-bit
UD-Q3_K_XL
343 GB
Ну и походу именно этого и боялись в OpenAI когда писали письмо о рисках в кибербезе - с такой открытой моделью нас ждут "весёлые" месяцы
#GLM #opensource #веса
———
@tsingular
Зайки опубликовали веса конкурента Опуса, - файлы на HuggingFace, 756 ГБ в FP8.
🔧 Что выложили:
Полные веса GLM-5.3, 141 safetensors-шард на 755,6 ГБ, архитектура glm_moe_dsa, FP8.
Лицензия кастомная на базе MIT: всё можно, кроме Model-as-a-Service для компаний с выручкой от $10 млрд, там требуется security-ревью Z.ai.
Для всех остальных полный набор прав вплоть до коммерческого использования и сублицензирования.
⚡️ Почему это важно:
Рекорд среди открытых весов на CyberGym, 84,5 против 83,8 у Mythos 5 и 83,6 у GPT-5.6 Sol.
Больше чем удвоенный GLM-5.2 на exploit-бенчмарках: 54,4 против 24,4 на ExploitBench.
AutomationBench 48,2 и Terminal Bench 3.0 с 4,6 до 28,3, рост шестикратный.
💼 Теперь модель можно крутить локально: SGLang, vLLM, TokenSpeed, KTransformers, Unsloth, плюс vLLM-Ascend для китайских NPU. 755 ГБ это не для ПК, но для кластеров и инференс-хостов самое то.
Think-бюджет управляется через reasoning_effort: low / high / max, по умолчанию max.
📎 Веса: HuggingFace
Готовая нарезка от Unsloth:
https://huggingface.co/unsloth/GLM-5.3-GGUF
Пока доступны:
3-bit
UD-Q3_K_XL
343 GB
Ну и походу именно этого и боялись в OpenAI когда писали письмо о рисках в кибербезе - с такой открытой моделью нас ждут "весёлые" месяцы
#GLM #opensource #веса
———
@tsingular
👍18✍5🔥5😭1
Zcode раздают немного токенов на пробу GLM 5.3 Flash
Важная деталь, - чтобы плашка появилась, нужно обновиться до последней версии
Сегодня лимиты на раздачу уже съели, пробуем завтра утром
Спасибо @sharipovnikita за подсказку
#Zcode
———
@tsingular
Важная деталь, - чтобы плашка появилась, нужно обновиться до последней версии
Сегодня лимиты на раздачу уже съели, пробуем завтра утром
Спасибо @sharipovnikita за подсказку
#Zcode
———
@tsingular
✍7⚡4🔥4
Unsloth нарезали GLM 5.3 на динамических квантах
От 217 гигов минимум 😭😭😭
#Unsloth #GLM
------
@tsingular
От 217 гигов минимум 😭😭😭
#Unsloth #GLM
------
@tsingular
😢5⚡4🔥3🆒2❤1