Forwarded from эйай ньюз
Bonsai Image 4B — чудеса квантизации
Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.
Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.
Инференс в браузере
Веса
@ai_newz
Стартап PrismML, специализирующийся на экстремальном сжатии моделек, сделал квантизированную до одного бита FLUX.2 Klein 4B, вышло на удивление достойно. С таким уровнем квантизации Diffusion Transformer занимает всего лишь 930 мегабайт в 1-битном варианте и 1.2 гигабайта в тернарном варианте. Текстовый энкодер настолько же сильно ужать не удалось, поэтому весь комплект весит ~3.5 гига.
Такая квантизация позволяет запускать модель прямо в браузере и на телефонах, используя лишь 2 гигабайта оперативки. На генерацию 512x512 картинки на iPhone 17 Pro Max с такой моделью уходит 9.4 секунды при 4 шагах, что неплохо если учитывать факт офлоадинга. Ждём моделек побольше, для локального деплоймента.
Инференс в браузере
Веса
@ai_newz
Claude code выпустил плагин для проверки безопасности кода. Не Mythos, но хотя бы так…
Claude Code Docs
Catch security issues as Claude writes code - Claude Code Docs
Install the security-guidance plugin to have Claude review its own code changes for vulnerabilities and fix them in the same session.
Ну, кстати, немного поясню, почему вернулся к дорогой подписке на Антропик.
Во-первых, потому что могу - с другого эккаунта, но платежи проходят. Дорого, но тут уж как наркоману отказаться от такой дозы?
Во-вторых, все-таки Клод гораздо понятнее пишет. Вроде ChatGPT и старается, но иногда пишет так, что я реально ничего не понимаю. Клод как-то даже жаргон понятнее применяет.
В-третьих, я и подписку ChatGPT стал высаживать легко и непринужденно. Дошел до того, что поставил себе OpenCode с DeepSeek - подключил за базу даже не основную модель, а флеш. Кстати, интерфейс опенкода прямо понравился. Основное ощущение от дипсика - медленный. Но стоит копейки, за сегодня потратил с ним 15 рублей... Пожалуй, буду использовать его как агента для экономии токенов у Клода и ГПТ.
Кстати, продолжаю использовать и OpenClaw - в основном, в таком режиме: закидываю ему новость, а он мне подробно рассказывает что почем.
Ах, да. Еще тестирую работу не в терминале, а с десктопными приложениями Codex и Claude. Ну, симпатично, но прямо плюшек каких-то нет. А недостаток в том, что вся работа с десктопом у меня пишется в память, а с приложениями - нет. Серьезный недостаток, видимо, вернусь в терминал.
Все, пошел жечь токены
Во-первых, потому что могу - с другого эккаунта, но платежи проходят. Дорого, но тут уж как наркоману отказаться от такой дозы?
Во-вторых, все-таки Клод гораздо понятнее пишет. Вроде ChatGPT и старается, но иногда пишет так, что я реально ничего не понимаю. Клод как-то даже жаргон понятнее применяет.
В-третьих, я и подписку ChatGPT стал высаживать легко и непринужденно. Дошел до того, что поставил себе OpenCode с DeepSeek - подключил за базу даже не основную модель, а флеш. Кстати, интерфейс опенкода прямо понравился. Основное ощущение от дипсика - медленный. Но стоит копейки, за сегодня потратил с ним 15 рублей... Пожалуй, буду использовать его как агента для экономии токенов у Клода и ГПТ.
Кстати, продолжаю использовать и OpenClaw - в основном, в таком режиме: закидываю ему новость, а он мне подробно рассказывает что почем.
Ах, да. Еще тестирую работу не в терминале, а с десктопными приложениями Codex и Claude. Ну, симпатично, но прямо плюшек каких-то нет. А недостаток в том, что вся работа с десктопом у меня пишется в память, а с приложениями - нет. Серьезный недостаток, видимо, вернусь в терминал.
Все, пошел жечь токены
По ощущениям новый Opus 5.8 ну прямо хорош. Видимо, и лимиты по началу жирные.
👾1
Вышла любопытная модель LFM2.5-8B-A1B для запуска на локальном компе. Претендует на SOTA. От таких моделей не надо ждать, что они будут такими же умными как Клод. Но вот если рутинные типовые задачки удастся переложить на них, экономия токенов для того же Клода будет колоссальна.
Liquid AI
LFM2.5-8B-A1B: An Even Better On-Device Mixture of Experts | Blog
Explore Liquid AI’s LFM2.5-8B-A1B, an on-device Mixture of Experts model with 128K context, fast tool calling, and strong AI benchmarks.
Смешно. В Х пишут, что у нового Клода лезут следы дистилляции Qwen. Со своей стороны скажу - да иероглифы местами лезут, раньше такого не видел ))
Forwarded from Анализ данных (Data analysis)
StepFun выпустили Step 3.7 Flash - открытую MoE-модель под Apache 2.0, заточенную не просто под чат, а под агентные сценарии: кодинг, поиск, работу с инструментами, документами, интерфейсами и изображениями.
По заявленным бенчмаркам модель выглядит серьёзно:
- #1 на ClawEval-1.1 - 67.1
- #1 на SimpleVQA Search - 79.2
- #2 на SWE-PRO - 56.3
- 95.3 на V* Python
Что внутри:
- 198B параметров всего
- около 11B активных параметров
- до 400 токенов в секунду
- контекст 256K
- 3 уровня reasoning
- открытые веса под Apache 2.0
Главный акцент - не «самая большая модель», а модель, которая быстро и стабильно работает внутри агента.
Она должна понимать UI, графики, документы и изображения, после чего писать код, вызывать инструменты и продолжать задачу без постоянного развала tool calls.
Отдельно заявлена совместимость с Claude Code, KiloCode, Hermes Agent, OpenClaw и протоколами вроде MCP. Локальный запуск тоже в фокусе: Mac Studio M4 Max, DGX Spark, AMD AI Max+ 395.
GitHub: http://github.com/stepfun-ai/Step-3.7-Flash
HuggingFace: http://huggingface.co/stepfun-ai/Step-3.7-Flash
GGUF: http://huggingface.co/stepfun-ai/Step-3.7-Flash-GGUF
ModelScope: http://modelscope.cn/models/stepfun-ai/Step-3.7-Flash
API: http://platform.stepfun.ai
Blog: http://static.stepfun.com/blog/step-3.7-flash/
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Tips AI | IT & AI
Сегодня у Codex парочка интересных обновлений:
Computer Use заработал теперь и на Windows: агент видит экран, управляет мышью, печатает текст и тд.
Запускать и управлять им можно через мобильное приложение, в которое под это тоже добавили функции из десктопа по типу команды /side.
А еще Codex теперь может сам управлять историей чатов:
- искать, переименовывать, закреплять
- создавать новые и читать старые
- работать параллельно сразу в нескольких
Правда есть минус в том, что на винде ты не можешь пользоваться компом пока работает Computer Use.
Потому что он полностью забирает управление, а не работает в фоне как на macOS.
@tips_ai #news
Computer Use заработал теперь и на Windows: агент видит экран, управляет мышью, печатает текст и тд.
Запускать и управлять им можно через мобильное приложение, в которое под это тоже добавили функции из десктопа по типу команды /side.
А еще Codex теперь может сам управлять историей чатов:
- искать, переименовывать, закреплять
- создавать новые и читать старые
- работать параллельно сразу в нескольких
Правда есть минус в том, что на винде ты не можешь пользоваться компом пока работает Computer Use.
Потому что он полностью забирает управление, а не работает в фоне как на macOS.
@tips_ai #news
Forwarded from Вайб-кодинг
This media is not supported in your browser
VIEW IN TELEGRAM
Dynamic Workflows теперь и в Codex: чувак запилил для этого скилл. 😂
1. Скопируйте инструкцию по установке:
2. Выполните команду
Он воспроизводит ту же логику оркестрации, что и Claude Dynamic Workflows:
- Генерирует сценарий оркестрации.
- Запускает рой подагентов.
- Переходит в режим
Бесплатно и с открытым исходным кодом.
1. Скопируйте инструкцию по установке:
Install the AI agent skill at https://github.com/DannyMac180/skills/tree/main/codex-dynamic-workflows2. Выполните команду
/dynamic, чтобы запустить этот навык.Он воспроизводит ту же логику оркестрации, что и Claude Dynamic Workflows:
- Генерирует сценарий оркестрации.
- Запускает рой подагентов.
- Переходит в режим
/goal для выполнения поставленной задачи.Бесплатно и с открытым исходным кодом.
Please open Telegram to view this post
VIEW IN TELEGRAM
Плюс Codex - большие лимиты. Плюс Claude code - общение более легкое, меньше недопонимания, плюс лучшая работа с дизайнами. Мне нравится использовать и то, и другое - обычно оркестрирует Клод, а работает - Кодекс.
https://t.me/seeallochnaya/3667
https://t.me/seeallochnaya/3667
Telegram
Сиолошная
Ребята из Nebius обновили SWE-rebench после двухмесячного перерыва, добавив 110 новых задач. В отличии от многих других бенчей, наконец-то добавляют запуски в Codex и Claude Code. Просто писать «GPT-5.5 в очередной раз статистически значимо лучше моделей…
Антропик обнулил лимиты, что приятно, так как за два дня я выбрал недельные лимиты на 2 дня вперед. Легко и непринужденно, даже не запуская в параллели множество сессий.
Зато когда Антропик обнуляет лимит, полные лимиты действуют на оставшееся до конца периода время. А вот OpenAI вместе с обнулением лимитов обнуляет и всю неделю - она начинает течь сначала - и если вы оставляли себе побольше лимитов, скажем, на выходные, они просто сгорят.
Поэтому не стоит оставлять лимиты на потом - тратьте сейчас, и если повезет, они обнулятся, в последнее время обе конторы нас этими обнулениями балуют.
Зато когда Антропик обнуляет лимит, полные лимиты действуют на оставшееся до конца периода время. А вот OpenAI вместе с обнулением лимитов обнуляет и всю неделю - она начинает течь сначала - и если вы оставляли себе побольше лимитов, скажем, на выходные, они просто сгорят.
Поэтому не стоит оставлять лимиты на потом - тратьте сейчас, и если повезет, они обнулятся, в последнее время обе конторы нас этими обнулениями балуют.