Forwarded from Stas in *Ops
В opus 4.7 антропики обновили токенизатор. В официальном анонсе указано, что объем вводимых данных в токенах вырос в 1.0–1.35 раза. Я надеялся, что они понизили language tax и улучшили выразительность для нелатинских языков, но, похоже, что это просто сокращение словаря.
Результаты тестов
Сравнение Opus 4.6, 4.7 и Haiku 4.5 на 53 языках и 12 типах данных показало:
- Без изменений: русский, арабский, иврит, хинди, языки CJK, цифры, пробелы и JSON.
- Рост количества токенов:
- Английская проза: +31%
- Программный код: +22%
- Markdown: +21%
- Переменные в camelCase (например,
Похоже, что из словаря удалили длинные цепочки английских слов (BPE-мерджи). Теперь вместо одного сложного токена модель использует несколько коротких.
Судя по тому, что ни для одного языка или популярного формата показатели не улучшились, причина в чем-то другом. Гипотезы:
1. Мультимодальность: резерв слотов под обработку изображений (вход расширен в 3 раза) и аудио.
2. Архитектура: уменьшение физического размера словаря для оптимизации весов модели.
В итоге
1. Рост стоимости: работа с английским текстом и кодом подорожала на 20–28%. Цена за 1 млн токенов осталась прежней ($5/$25), но для обработки того же объема текста теперь требуется больше токенов.
2. Сжатие контекста: эффективный объем контекстного окна сократился на 20%. Текст на английском языке, который раньше занимал 200 000 токенов, теперь занимает около 240 000.
Заодно обновил бенчмарки по токенизаторам tokenizers.korchasa.dev
#anthropic #claude #tokens #models #benchmark
Результаты тестов
Сравнение Opus 4.6, 4.7 и Haiku 4.5 на 53 языках и 12 типах данных показало:
- Без изменений: русский, арабский, иврит, хинди, языки CJK, цифры, пробелы и JSON.
- Рост количества токенов:
- Английская проза: +31%
- Программный код: +22%
- Markdown: +21%
- Переменные в camelCase (например,
getUserByEmail): +51%Похоже, что из словаря удалили длинные цепочки английских слов (BPE-мерджи). Теперь вместо одного сложного токена модель использует несколько коротких.
Судя по тому, что ни для одного языка или популярного формата показатели не улучшились, причина в чем-то другом. Гипотезы:
1. Мультимодальность: резерв слотов под обработку изображений (вход расширен в 3 раза) и аудио.
2. Архитектура: уменьшение физического размера словаря для оптимизации весов модели.
В итоге
1. Рост стоимости: работа с английским текстом и кодом подорожала на 20–28%. Цена за 1 млн токенов осталась прежней ($5/$25), но для обработки того же объема текста теперь требуется больше токенов.
2. Сжатие контекста: эффективный объем контекстного окна сократился на 20%. Текст на английском языке, который раньше занимал 200 000 токенов, теперь занимает около 240 000.
Заодно обновил бенчмарки по токенизаторам tokenizers.korchasa.dev
#anthropic #claude #tokens #models #benchmark
👍2
https://x.com/benioff/status/2044981547267395620?s=46
Одни выпускают «дизайнеров» для UI, другие отменяют UI.
Веселее с каждым днем.
Одни выпускают «дизайнеров» для UI, другие отменяют UI.
Веселее с каждым днем.
❤1
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
CRYPTON | Биткоин, DeFi, WEB 3
🚬 Хакер может убить Aave, KelpDAO и LayerZero
Оттоки из Aave на фоне взлома KelpDAO продолжаются и уже перевалили за $6 млрд.
▪️ Причины таких массивных оттоков:
— Заморозка рынков с $RSETH и $WETH в Aave V3/V4 и многих других протоколах.
— Волна хейта…
Оттоки из Aave на фоне взлома KelpDAO продолжаются и уже перевалили за $6 млрд.
▪️ Причины таких массивных оттоков:
— Заморозка рынков с $RSETH и $WETH в Aave V3/V4 и многих других протоколах.
— Волна хейта…
😁1
CodeSpec
Нам срочно необходимо громкое банкротство. Ждемс.
Дождались наконец-то! 🗿
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1
CodeSpec
https://t.me/crypton_off/17046 Mythos, ну не бей лежачего, отстань 😬
Crypto, Vercel, Lovable, что там еще…ну норм модель, доказано на практике)
🤝1
CodeSpec
https://t.me/crypto_hd/28416 Трейдеры есть? США меняют правила для дейтрейдеров. Скоро, не нужно будет 25к, пока не понятно как это будет работать, но выглядит как бесконечный праздник для лудиков трейдеров. Наверное, не будет лучшего дня для того чтобы…
4 июня PDT (когда трейдерам нужно минимум 25к для дейтрейдинга) официально уберут.
Грядут шальные времена.
Грядут шальные времена.
CodeSpec
Crypto, Vercel, Lovable, что там еще…ну норм модель, доказано на практике)
Please open Telegram to view this post
VIEW IN TELEGRAM
CodeSpec
А что это я пропустил главную новость вчерашнего года 🧐 Gensyn уже в Апреле...главное чтобы не первого.
Please open Telegram to view this post
VIEW IN TELEGRAM
https://x.com/aaronjmars/status/2047017251270734309?s=46
Мужик «делал» погоду и зарабатывал на Полике.
Если конечно правда, точно, президентом будет.
Мужик «делал» погоду и зарабатывал на Полике.
Если конечно правда, точно, президентом будет.
🔥1
Please open Telegram to view this post
VIEW IN TELEGRAM
Telegram
Осцилляции WaveCut
🐳 DeepSeek V4 (Preview)
Пока западные лабы надувают свою важность удваивают цены на API, китайцы просто дропают веса двух новых SOTA моделей в опенсорс даже не обновив официальный вебсайт, лол.
В релизе сразу две версии: гигантская V4-Pro на 1.6T параметров…
Пока западные лабы надувают свою важность удваивают цены на API, китайцы просто дропают веса двух новых SOTA моделей в опенсорс даже не обновив официальный вебсайт, лол.
В релизе сразу две версии: гигантская V4-Pro на 1.6T параметров…
Все так хвалят новую модель для изображений от OpenAI...
Ну да, хорошо первая картинка получается, а редактировать слабо как это делают гугловские "бананы"?
Или я делаю что-то не так?
UPD:
Ну да, хорошо первая картинка получается, а редактировать слабо как это делают гугловские "бананы"?
Или я делаю что-то не так?
UPD:
ну тебе обещали красивую генерацию, а не редактирование 😂
Forwarded from LakoMoor
QClaw-4B — это языковая модель, дообученная для агентных задач и работы с инструментами в рамках OpenClaw-совместимых фреймворков. Основана на Qwen3.5-4B.
Несмотря на компактный размер, модель достигает результатов уровня значительно более крупных моделей — на ClawBench набрала 84.8 / 100 (Pass Rate 73.5%), вплотную к Kimi K2.5 и GLM-4.5. На Ru-Arena-General — 80.7% winrate, SOTA в классе ≤4B.
🔗 Карточка модели: https://huggingface.co/LakoMoor/QClaw-4B
🔗 GGUF (llama.cpp / Ollama / LM Studio): https://huggingface.co/LakoMoor/QClaw-4B-GGUF
⚖️ Лицензия: apache-2.0
Отдельная благодарность @lovedeathtransformers за ресурсы под обучение и прогон бенчмарков
Несмотря на компактный размер, модель достигает результатов уровня значительно более крупных моделей — на ClawBench набрала 84.8 / 100 (Pass Rate 73.5%), вплотную к Kimi K2.5 и GLM-4.5. На Ru-Arena-General — 80.7% winrate, SOTA в классе ≤4B.
🔗 Карточка модели: https://huggingface.co/LakoMoor/QClaw-4B
🔗 GGUF (llama.cpp / Ollama / LM Studio): https://huggingface.co/LakoMoor/QClaw-4B-GGUF
⚖️ Лицензия: apache-2.0
Отдельная благодарность @lovedeathtransformers за ресурсы под обучение и прогон бенчмарков
CodeSpec
Оно живое?! 😱
Please open Telegram to view this post
VIEW IN TELEGRAM
https://t.me/salikov_i/3198
Есть официальный плагин от Anthropic под названием claude-code-setup. Он рассказывает, какие автоматизации ты можешь настроить (хуки, навыки, серверы MCP, субагенты…) и как их конфигурировать шаг за шагом. По сути, анализирует твой проект и рекомендует, что активировать.
Чтобы установить:
ну думаю, дай попробую.
Угу...😶
Есть официальный плагин от Anthropic под названием claude-code-setup. Он рассказывает, какие автоматизации ты можешь настроить (хуки, навыки, серверы MCP, субагенты…) и как их конфигурировать шаг за шагом. По сути, анализирует твой проект и рекомендует, что активировать.
Чтобы установить:
/plugin install claude-code-setup@claude-plugins-official
ну думаю, дай попробую.
Угу...
Please open Telegram to view this post
VIEW IN TELEGRAM
🤯1