Посмотрел тут на результаты работы Sol - и что-то совсем разочарован. Токены уничтожены, все откатываю обратно. Видно, придется учиться более тщательно подбирать модель и усилия, чтобы держаться в лимитах, но ведь и результат пока не особо радует.. в отличие от Fable. Придется больше времени потратить на донастройку
Не только я заметил растрату токенов. OpenAI отменяет 5-часовые лимиты и перенастраивает Sol. Будем надеяться, станет работать лучше. А пока идет настройка, стоит следить за размером контекста и все-таки не злоупотреблять с max, ultra - как минимум, на Sol
https://t.me/vibecoding_tg/3470
https://t.me/vibecoding_tg/3470
Telegram
Вайб-кодинг
Хорошие новости от OpenAI: подвезли обновления для Codex и ChatGPT Work.
> внедрили оптимизации инференса и передали полученную экономию всем подписчикам GPT-5.6 Sol. В результате доступный объем использования должен увеличиться примерно на 10%.
> обнаружили…
> внедрили оптимизации инференса и передали полученную экономию всем подписчикам GPT-5.6 Sol. В результате доступный объем использования должен увеличиться примерно на 10%.
> обнаружили…
Я подобные модели использую активно - у меня стоит программка Handy, в которой живет Sber Salut - это для русского лучше чем Whisper. Но модель уже не менял давно. Видимо, пришло время
https://t.me/lovedeathtransformers/10857
https://t.me/lovedeathtransformers/10857
Telegram
Love. Death. Transformers.
GigaChat Audio и GigaAM Multilingual: новые Open Source модели с поддержкой длинного контекста и языков СНГ 🔥
Полноценные audio-native LLM — пока редкость в опенсорсе, а почти весь прогресс в Speech AI сфокусирован на английском языке и коротких аудио. Качество…
Полноценные audio-native LLM — пока редкость в опенсорсе, а почти весь прогресс в Speech AI сфокусирован на английском языке и коротких аудио. Качество…
И моделька, которая метит в лидеры по распознаванию текстов. Компактная, на 1В параметров
https://huggingface.co/ATH-MaaS/OvisOCR2
https://huggingface.co/ATH-MaaS/OvisOCR2
huggingface.co
ATH-MaaS/OvisOCR2 · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
Если вам нужна мощная бесплатная модель - это Hy3. На OpenRouter сейчас это самая популярная модель. Правда, все бесплатное там когда-то заканчивается. Модель весит всего 295В, так что это в теории можно будет запускать и локально на мощных Mac Studio.
https://openrouter.ai/tencent/hy3:free
https://openrouter.ai/tencent/hy3:free
openrouter.ai
Hy3 - API Pricing & Benchmarks
Hy3 is a 295B-parameter Mixture-of-Experts model from Tencent (21B active, 192 experts with top-8 routing) built for reasoning, agentic workflows, and real-world production use. $0.07 per million input tokens, $0.29 per million output tokens. 262,144 token…
Клод отлично ищет уязвимости. Остается только один вопрос - обо всех ли уязвимостях рассказывает Claude, и не остается ли какая-то часть за кадром, в рамках программы взаимодействия с правительством США?
Уязвимости поискать хочется, только как доверять эту работу проприетарным моделям?
https://t.me/machinelearning_interview/2873
Уязвимости поискать хочется, только как доверять эту работу проприетарным моделям?
https://t.me/machinelearning_interview/2873
Telegram
Machine learning Interview
🚀 Anthropic выложили reference harness для поиска и исправления уязвимостей с Claude
Очень недооценённый репозиторий для defensive security.
Идея простая: Claude проходит полный цикл работы с уязвимостью:
* threat model
* поиск подозрительных мест
* проверка…
Очень недооценённый репозиторий для defensive security.
Идея простая: Claude проходит полный цикл работы с уязвимостью:
* threat model
* поиск подозрительных мест
* проверка…
Иметь большую модель, обученную под себя? Это интересно. Проблема в том, что цена обучения с ростом модели растет. нелинейно, и обучать большие модели дорого. Но может это уже как-то порешали?
Команда этим занимается серьезная - бывшие боссы OpenAI
https://t.me/ai_machinelearning_big_data/10528
Команда этим занимается серьезная - бывшие боссы OpenAI
https://t.me/ai_machinelearning_big_data/10528
Telegram
Machinelearning
Thinking Machines Lab выкатила Inkling - свою первую open-weights модель.
И это сразу тяжёлый релиз:
* 975B total params
* 41B active
* 1M context
* обучение на 45T токенов
* текст, изображения, аудио и видео
* рядом идёт preview Inkling-Small с 12B active…
И это сразу тяжёлый релиз:
* 975B total params
* 41B active
* 1M context
* обучение на 45T токенов
* текст, изображения, аудио и видео
* рядом идёт preview Inkling-Small с 12B active…
За последнюю неделю у меня человек пять спросило, в чем я делаю презентации. В Claude Design.
Уже писал, что эта программа пару месяцев назад сделала большой скачок вперед. Для успешной работы надо потратить пару часов для подготовки типового макета. На тарифе в 20 долларов рисовать можно, но токены тратятся быстро, может не хватать 5-часового лимита. В Sonnet я не очень верю, сам использую для рисования Opus, и вам того же советую.
Сама программа тоже меняется, я бы сказал, немного упрощается. Процесс подготовки презентации выглядит, конечно иначе - вместо рисования, постоянно словами говоришь, что править. Но к этому привыкаешь, рисовать больше не хочется.
Можно, кстати, писать презентации и прямо в Claude Code. Я загрузил туда шаблон, и презентация программируется Клодом на питоне. Это тоже работает, и неплохо. По ощущениям, даже как-то более экономно по токенам. Советую попробовать.
Похожие функции есть и в последнем ChatGPT Work, но честно скажу, не пробовал. Исправлюсь, как будет больше времени.
Уже писал, что эта программа пару месяцев назад сделала большой скачок вперед. Для успешной работы надо потратить пару часов для подготовки типового макета. На тарифе в 20 долларов рисовать можно, но токены тратятся быстро, может не хватать 5-часового лимита. В Sonnet я не очень верю, сам использую для рисования Opus, и вам того же советую.
Сама программа тоже меняется, я бы сказал, немного упрощается. Процесс подготовки презентации выглядит, конечно иначе - вместо рисования, постоянно словами говоришь, что править. Но к этому привыкаешь, рисовать больше не хочется.
Можно, кстати, писать презентации и прямо в Claude Code. Я загрузил туда шаблон, и презентация программируется Клодом на питоне. Это тоже работает, и неплохо. По ощущениям, даже как-то более экономно по токенам. Советую попробовать.
Похожие функции есть и в последнем ChatGPT Work, но честно скажу, не пробовал. Исправлюсь, как будет больше времени.
О, у Apple, судя по всему, через неделю будет событие, посвященное AI. Учитывая, что с продажи на официальном сайте сняли последние Mac Studio, надеюсь, это будет запуск новой линейки Mac mini и Mac Studio с М5. Сейчас это лучшее железо для локального ИИ.
Кстати, планируется, что максимальный студио будет с 770 Гб памяти - это позволит раскатывать на одной машине реально большие модели типа квантованной GLM-5.2.
Кстати, планируется, что максимальный студио будет с 770 Гб памяти - это позволит раскатывать на одной машине реально большие модели типа квантованной GLM-5.2.
Forwarded from Вайб-кодинг
This media is not supported in your browser
VIEW IN TELEGRAM
Эта бесплатная тулза позволяет Claude автоматически собирать данные из Google Maps.
Укажите Claude город и тип бизнеса — он запустит локальный скрапер и вернёт чистый список компаний с названиями, телефонами, email-адресами, сайтами, рейтингами и отзывами.
Есть встроенная защита от превышения лимитов запросов и поддержка прокси для более крупных задач
Открытый исходный код.👀
Укажите Claude город и тип бизнеса — он запустит локальный скрапер и вернёт чистый список компаний с названиями, телефонами, email-адресами, сайтами, рейтингами и отзывами.
Есть встроенная защита от превышения лимитов запросов и поддержка прокси для более крупных задач
Открытый исходный код.
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Data Secrets
Kimi K3 здесь
2.8T параметров, 1М контекста. Официальных бенчмарков пока нет, но вроде как модель бьет Fable и Sol на BrowseCamp и выходит на 3 место на GDPval.
https://www.kimi.com/
2.8T параметров, 1М контекста. Официальных бенчмарков пока нет, но вроде как модель бьет Fable и Sol на BrowseCamp и выходит на 3 место на GDPval.
https://www.kimi.com/
Похоже, что китайцы реально догоняют Антропиков и ОпенЭйАй. Забавно будет, если новый Gemini 3.5 Pro не дотянется до Кими 3. Впрочем, это будет не сильно удивительно. Будет ли в таких условиях Антропик отрубать Fable? Даже после выхода Opus 5 на следующей неделе? Не уверен
Увидел тут рекламку локального российского инференса на серверах MWS. Не для слабонервных.
GLM-5.2 стоит 2300 руб за входящий и исходящий трафик, про кэш ничего не сказано. 30 баксов - примерно в 10-30 раз дороже того, что можно взять у китайцев.
Самое смешное, что и qwen на 30В стоит 12 баксов. Это моделька, которую можно развернуть на Mac Studio за 4 тысячи.
В общем, шок контент. Ждем новых студио от Apple и ставим все у себя.
GLM-5.2 стоит 2300 руб за входящий и исходящий трафик, про кэш ничего не сказано. 30 баксов - примерно в 10-30 раз дороже того, что можно взять у китайцев.
Самое смешное, что и qwen на 30В стоит 12 баксов. Это моделька, которую можно развернуть на Mac Studio за 4 тысячи.
В общем, шок контент. Ждем новых студио от Apple и ставим все у себя.
Антропик продлил использование Fable (я сижу на тарифе Max), лимит 50% от общего расхода.
Вчера как раз запустил Fable делать исследование - и что вы думаете, 30 мин и мой часовой лимит на нуле. В общем, придется использовать точечно.
Решил попробовать новый Kimi 3 . Даром, что китайская модель, регистрироваться по российскому телефону не дает. Такие у нас друзья
Вчера как раз запустил Fable делать исследование - и что вы думаете, 30 мин и мой часовой лимит на нуле. В общем, придется использовать точечно.
Решил попробовать новый Kimi 3 . Даром, что китайская модель, регистрироваться по российскому телефону не дает. Такие у нас друзья
Qwen 3.8, говорят, скоро и новая модель от GLM…
Моделей больше, чем времени…
https://t.me/ai_machinelearning_big_data/10552
Моделей больше, чем времени…
https://t.me/ai_machinelearning_big_data/10552
Telegram
Machinelearning
🚀 Qwen3.8 скоро выйдет в open-weight
Новая модель Alibaba получит 2,4 трлн параметров. Разработчики называют её одной из самых мощных моделей на рынке и ставят рядом с ведущими frontier-моделями.
Предварительную версию Qwen3.8-Max-Preview уже можно протестировать…
Новая модель Alibaba получит 2,4 трлн параметров. Разработчики называют её одной из самых мощных моделей на рынке и ставят рядом с ведущими frontier-моделями.
Предварительную версию Qwen3.8-Max-Preview уже можно протестировать…
Супероблегченная модель Google стоит дороже DeepSeek в три раза и едва дешевле GLM-5.2. Стоит ли использовать? Сильно сомневаюсь. А обещанной Gemini 3.5 Pro и не пахнет - видимо, на фоне последних релизов смотрится бледно..
Я бы даже не исключал, что так запустили модель про, обещанную в июне.
https://t.me/vibecoding_tg/3540
Я бы даже не исключал, что так запустили модель про, обещанную в июне.
https://t.me/vibecoding_tg/3540
Telegram
Вайб-кодинг
Вот и Google проснулись: запустили три новые модели — Gemini 3.6 Flash, Gemini 3.5 Flash-Lite и Gemini 3.5 Flash Cyber.
Gemini 3.6 Flash называют самой интеллектуальной Flash-моделью компании на сегодняшний день для агентных задач и программирования.
При…
Gemini 3.6 Flash называют самой интеллектуальной Flash-моделью компании на сегодняшний день для агентных задач и программирования.
При…
А помните мы макросы в экселе записывали? Теперь такие макросы можно делать почти для чего угодно
https://t.me/vibecoding_tg/3543
https://t.me/vibecoding_tg/3543
Telegram
Вайб-кодинг
Новое в Claude Cowork: теперь Claude можно обучить собственному скиллу.
Запишите экран во время выполнения задачи и по ходу объясняйте, что именно вы делаете. Claude превратит этот процесс в скилл, который затем сможет запускать самостоятельно.
Функция…
Запишите экран во время выполнения задачи и по ходу объясняйте, что именно вы делаете. Claude превратит этот процесс в скилл, который затем сможет запускать самостоятельно.
Функция…