very vibe coding
117 subscribers
460 photos
126 videos
13 files
974 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
very vibe coding
Чудес не бывает. Новая моделька, которая бесплатно лежит на опенроутере, работает, но есть впечатление, что это маленькая модель. Условно, GLM Flash. На фронтир не тянет и далеко. С другой стороны, дареному коню в зубы не смотрят, есть задачки и для таких…
Ну да, все больше свидетельств, что бесплатная модель в опенроутере - GLM 5.3 Flash. Конечно, ни с каким Sol она не конкурирует. Главный конкурент DeepSeek V4 Flash. Думаю, именно это заставило Дипсик мальца сбросить цены.

Эти модели интересны тем, что на них можно посадить несложные рутинные задачи или такие вещи как построение онтологий и графов. Маленькие модели не справляются, большие - дорого.

У меня сейчас подписка на GLM за $60 - в принципе, GLM 5.3 нормальная модель, использую ее, но токенов маловато - OpenAI щедрее, их подписка в этом плане самая большая. Думал снизить лимит до $20, но посмотрю на флэш и там буду решать.

PS. Использую разные модели для проверки друг друга - нравится мне эта тема, разные нейронки находят разные ошибки
Завтра вечером сбросят лимиты Кодекса, так что можно сегодня гонять gpt на максималках
В твиттере уже какое-то время прогревается история про модель SubQ, которая обещает решить проблему квадратичного масштабирования контекста, а значит, помимо длинны конекста, еще и скорости и цены токенов. Сейчас открыли запись на тестирование модели. И если это действительно прорыв, думаю, скоро мы все об этом услышим. Это может быть действительно геймченжером
Пошел слушок, что новый мак мини запустят в сентябре. У Apple были планы в младшую версию ставить М6 - это интересно, но самое интересное для меня, сколько будут стоить большие версии, на которых можно гонять Qwen 3.8 27B и DeepSeek v4 Flash..
Видимо, скоро нас ждет Haiku 5 и еще одна новая модель. С хайку давно пора что-то делать, да и Соннет вышел совсем неудачным - вместо дешевых моделей Антропика я использую GLM, DeepSeek или GPT Luna.
Если интересуетесь разговорными агентами, например, для организации службы поддержки, посмотрите на Grok Voice Think Fast 2.0 - видимо, это новая SOTA

И, кстати, все в восторге от Grok Bot - скоро начнется его массовое копирование на других платформах
Было ожидаемо, что цены на мак мини и мак студио вырастут, но это жесть, конечно. Локальную нейронку хочется, но отдавать за нее лям, ну или 300 за квен на 27В как-то жалко. Жена не поймет ))

https://t.me/data_secrets/9767
Действительно, стелс-модель 0хАльфа оказалась GLM-5.3 Flash.

Я ее попробовал, пока была бесплатной. Честно говоря, не могу сказать, что впечатлен, мне показалось, DeepSeek v4 Flash лучше..
Хотя и бенчи показывают другое. Но можно ли им верить..

https://t.me/lovedeathtransformers/10992
🎬 Google выкатил Gemini Omni 1.1 Flash

Что приехало:

– Продление сцены до 40 секунд, шагами по 10
– Первый и последний кадр задаются вручную
– Черновики в 360p: на 60% быстрее и втрое дешевле, чем 720p. Перебираешь варианты, а финал апскейлишь до 4K.
– Видеореференс на вход - до 3 секунд.

Уже во Flow (веб и мобилка, подписки AI Plus / Pro / Ultra) и в AI Studio по апи.

По бенчмаркам: Omni 1.1 Flash - первая в Text-to-Video, В Image-to-Video - обогнала сиденс 2.5, но уступает минимаксу

Воркфлоу с генерацией в 360 пушка, я и сам работаю так, но с другими моделями, тут же гугл наконец понял, что функция должна быть нативной, но из минусов нативной генерации в 4к нет - только апскейл плюс маловато референсов относительно сиденса

@creadvice