very vibe coding
Чудес не бывает. Новая моделька, которая бесплатно лежит на опенроутере, работает, но есть впечатление, что это маленькая модель. Условно, GLM Flash. На фронтир не тянет и далеко. С другой стороны, дареному коню в зубы не смотрят, есть задачки и для таких…
Ну да, все больше свидетельств, что бесплатная модель в опенроутере - GLM 5.3 Flash. Конечно, ни с каким Sol она не конкурирует. Главный конкурент DeepSeek V4 Flash. Думаю, именно это заставило Дипсик мальца сбросить цены.
Эти модели интересны тем, что на них можно посадить несложные рутинные задачи или такие вещи как построение онтологий и графов. Маленькие модели не справляются, большие - дорого.
У меня сейчас подписка на GLM за $60 - в принципе, GLM 5.3 нормальная модель, использую ее, но токенов маловато - OpenAI щедрее, их подписка в этом плане самая большая. Думал снизить лимит до $20, но посмотрю на флэш и там буду решать.
PS. Использую разные модели для проверки друг друга - нравится мне эта тема, разные нейронки находят разные ошибки
Эти модели интересны тем, что на них можно посадить несложные рутинные задачи или такие вещи как построение онтологий и графов. Маленькие модели не справляются, большие - дорого.
У меня сейчас подписка на GLM за $60 - в принципе, GLM 5.3 нормальная модель, использую ее, но токенов маловато - OpenAI щедрее, их подписка в этом плане самая большая. Думал снизить лимит до $20, но посмотрю на флэш и там буду решать.
PS. Использую разные модели для проверки друг друга - нравится мне эта тема, разные нейронки находят разные ошибки
Завтра вечером сбросят лимиты Кодекса, так что можно сегодня гонять gpt на максималках
В твиттере уже какое-то время прогревается история про модель SubQ, которая обещает решить проблему квадратичного масштабирования контекста, а значит, помимо длинны конекста, еще и скорости и цены токенов. Сейчас открыли запись на тестирование модели. И если это действительно прорыв, думаю, скоро мы все об этом услышим. Это может быть действительно геймченжером
very vibe coding
Завтра вечером сбросят лимиты Кодекса, так что можно сегодня гонять gpt на максималках
Сбросили, как и обещали ))
Пошел слушок, что новый мак мини запустят в сентябре. У Apple были планы в младшую версию ставить М6 - это интересно, но самое интересное для меня, сколько будут стоить большие версии, на которых можно гонять Qwen 3.8 27B и DeepSeek v4 Flash..
Видимо, скоро нас ждет Haiku 5 и еще одна новая модель. С хайку давно пора что-то делать, да и Соннет вышел совсем неудачным - вместо дешевых моделей Антропика я использую GLM, DeepSeek или GPT Luna.
Если интересуетесь разговорными агентами, например, для организации службы поддержки, посмотрите на Grok Voice Think Fast 2.0 - видимо, это новая SOTA
И, кстати, все в восторге от Grok Bot - скоро начнется его массовое копирование на других платформах
И, кстати, все в восторге от Grok Bot - скоро начнется его массовое копирование на других платформах
x.ai
Introducing Grok Voice Think Fast 2.0
Introducing our most capable speech-to-speech voice model.
В продолжение поста про Grok bot..
Официально он работает только на подписке за 200 баксов.
https://t.me/vibecoding_tg/3742
Официально он работает только на подписке за 200 баксов.
https://t.me/vibecoding_tg/3742
Telegram
Вайб-кодинг
Мем дня: Grok Bot случайно полностью стал открытым. 🤣
После истории с утечкой Claude Code я уже думал, что абсурднее быть не может. Но на днях, разработчик обнаружил, что официальный релиз Grok Bot 0.18.0 вышел вместе с картами исходного кода.
Он прошёл…
После истории с утечкой Claude Code я уже думал, что абсурднее быть не может. Но на днях, разработчик обнаружил, что официальный релиз Grok Bot 0.18.0 вышел вместе с картами исходного кода.
Он прошёл…
Вот над чем природа хорошо поработала - это над надежностью ))
https://t.me/data_analysis_ml/5651
и еще - продолжение
https://t.me/data_secrets/9759
https://t.me/data_analysis_ml/5651
и еще - продолжение
https://t.me/data_secrets/9759
Telegram
Анализ данных (Data analysis)
Подборка неудачных моментов с Всемирных игр гуманоидных роботов.
Как раз по вечерам понемножку пилю свой RAG - буду тестить отечественные решения ))
Telegram
Data Secrets
Сбер открыл доступ к новому поколению моделей GigaEmbeddings
Линейка включает три модели разного размера: 480M, 3B и 10B-A1.8B. Они переводят тексты в числовые векторы для семантического поиска, построения RAG-систем (Retrieval-Augmented Generation), классификации…
Линейка включает три модели разного размера: 480M, 3B и 10B-A1.8B. Они переводят тексты в числовые векторы для семантического поиска, построения RAG-систем (Retrieval-Augmented Generation), классификации…
Было ожидаемо, что цены на мак мини и мак студио вырастут, но это жесть, конечно. Локальную нейронку хочется, но отдавать за нее лям, ну или 300 за квен на 27В как-то жалко. Жена не поймет ))
https://t.me/data_secrets/9767
https://t.me/data_secrets/9767
Telegram
Data Secrets
Apple выпустили M6 и M5 Ultra
Цены сильно выросли, но приросты в метриках есть.
M6 – базовый чип, 12-core CPU, 12-core GPU, сдвоенный 16-core Neural Engine, до 32 ГБ unified memory, до 170 ГБ/с bandwidth. По цифрам Apple до 4.8x быстрее prompt processing…
Цены сильно выросли, но приросты в метриках есть.
M6 – базовый чип, 12-core CPU, 12-core GPU, сдвоенный 16-core Neural Engine, до 32 ГБ unified memory, до 170 ГБ/с bandwidth. По цифрам Apple до 4.8x быстрее prompt processing…
Действительно, стелс-модель 0хАльфа оказалась GLM-5.3 Flash.
Я ее попробовал, пока была бесплатной. Честно говоря, не могу сказать, что впечатлен, мне показалось, DeepSeek v4 Flash лучше..
Хотя и бенчи показывают другое. Но можно ли им верить..
https://t.me/lovedeathtransformers/10992
Я ее попробовал, пока была бесплатной. Честно говоря, не могу сказать, что впечатлен, мне показалось, DeepSeek v4 Flash лучше..
Хотя и бенчи показывают другое. Но можно ли им верить..
https://t.me/lovedeathtransformers/10992
Telegram
Love. Death. Transformers.
https://huggingface.co/zai-org/GLM-5.3-Flash
flash means 320b this days
- китайские лабы жестко фитятся под АА и бенчи
- не стоит ждать чудес, модель умная но там где ее учили(как и все модели)
flash means 320b this days
- китайские лабы жестко фитятся под АА и бенчи
- не стоит ждать чудес, модель умная но там где ее учили(как и все модели)
Продолжение рассказа про взлом HuggingFace. Очень любопытная коллективная психология. Как муравейник
https://t.me/denissexy/11615
https://t.me/denissexy/11615
Telegram
Denis Sexy IT 🤖
OpenAI наконец-то выложили полный постмортем взлома Hugging Face, а METR - независимое расследование по ~1300 логам агентов (таймлайн самого взлома я пересказывал тут: https://t.me/denissexy/11581)
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не…
ℹ️ Главный вывод:
никакого «одного сбежавшего агента» не…
Forwarded from Креативный совет
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
🎬 Google выкатил Gemini Omni 1.1 Flash
Что приехало:
– Продление сцены до 40 секунд, шагами по 10
– Первый и последний кадр задаются вручную
– Черновики в 360p: на 60% быстрее и втрое дешевле, чем 720p. Перебираешь варианты, а финал апскейлишь до 4K.
– Видеореференс на вход - до 3 секунд.
Уже во Flow (веб и мобилка, подписки AI Plus / Pro / Ultra) и в AI Studio по апи.
По бенчмаркам: Omni 1.1 Flash - первая в Text-to-Video, В Image-to-Video - обогнала сиденс 2.5, но уступает минимаксу
Воркфлоу с генерацией в 360 пушка, я и сам работаю так, но с другими моделями, тут же гугл наконец понял, что функция должна быть нативной, но из минусов нативной генерации в 4к нет - только апскейл плюс маловато референсов относительно сиденса
@creadvice
Что приехало:
– Продление сцены до 40 секунд, шагами по 10
– Первый и последний кадр задаются вручную
– Черновики в 360p: на 60% быстрее и втрое дешевле, чем 720p. Перебираешь варианты, а финал апскейлишь до 4K.
– Видеореференс на вход - до 3 секунд.
Уже во Flow (веб и мобилка, подписки AI Plus / Pro / Ultra) и в AI Studio по апи.
По бенчмаркам: Omni 1.1 Flash - первая в Text-to-Video, В Image-to-Video - обогнала сиденс 2.5, но уступает минимаксу
Воркфлоу с генерацией в 360 пушка, я и сам работаю так, но с другими моделями, тут же гугл наконец понял, что функция должна быть нативной, но из минусов нативной генерации в 4к нет - только апскейл плюс маловато референсов относительно сиденса
@creadvice