very vibe coding
122 subscribers
464 photos
126 videos
13 files
1K links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
И вот еще нашел прикольную штуку - программулина позволяет в одном интерфейсе общаться с разными моделями. Я это практикую очень часто. Шутят, что с такими ценами на ChatGPT-5 (а они низкие!!) скоро его будут вызывать из Clyde Code вместо Opus.
Видимо это судьба - заниматься не нейронками, а всякой фигней типа сетевого администрирования. Отрубился OpenVPN, причем получается интересно - OpenVPN с дружественного сервера работает, на моем сервере работает Amnezia, а вот сам OpenVPN на моем серваке работать перестал. Пару часов пробовал его поднять, не смог - судя по всему, дело в провайдере. В итоге переключился на Амнезию. Жаль, я уже привык. Мягко говоря, задалбывает, когда все стремятся тебе жизнь усложить, впрочем - не убило, разобрались, будем сильнее
Cursor теперь в терминале - все рванули на площадку Claude Code )) для установки запускайте

curl cursor.com/install -fsS | bash
Понятно, сегодня все ленты забиты gpt-5, и по отзывам это действительно хорошая модель, особенно заметен прогресс в кодировании. У меня уже работает - первые бытовые впечатления: очень быстрая, но на бытовых вопросах и задачах кроме скорости какой-то большой разницы с прошлыми моделями не вижу. Видимо, моделька использовала нейронку попроще - ведь теперь она сама выбирает, под каждый вопрос, какого размера нейронка нужна. Впрочем, это всяко большой позитив, в выходные есть чем побаловаться
Qwen увеличил контекст до 1 млн токенов и это реально круто - маленькое окно быстро становится проблемой. Но помните, качество работы модели при росте контекста падает, поэтому стоит его экономить и регулярно открывать новые диалоги, даже если 1 млн токенов еще не выбран
Qwen Code теперь дает 2000 бесплатных запросов в день. Это модель, работающая в командной строке, как Claude Code. Это интересно, поскольку у того же Gemini надо платить за api, а Claude и GPT-5 работают по подписке. Да, напомню, что на днях Qwen раскатал контекст на 1 млн токенов, который до этого был только у Gemini. При этом и сама модель неплоха. Я бы сказал, что сейчас столько возможностей использовать хороший ИИ бесплатно или совсем задешево, просто удивительно
👍1
OpenAI пришлось оправдываться перед расстроенными пользователями за запуск GPT-5 - нормально не работал роутер, выбирающий модель, были проблемы с повышенной нагрузкой, баги и пр. В итоге на платную подписку вернули даже got-4o и удвоили лимиты по платной подписке. В таких случаях, мне кажется, больше всего подходят слова Аршавина: ваши ожидания - ваши проблемы. Сейчас уже не время больших прорывов, каждый новый шаг лается с трудом, модели становятся лучше, но понемногу. Скорее прогресс идет не в самих моделях, а их окружении и интерфейсе по их использованию. В общем, все по плану, ждем ответов от конкурентов - интересно, как там дела у DeepSeek и их новым ризонером?

В части же gpt-5 есть мнение, что модель хороша в режимах, когда можно выбрать конкретную модель из семейства (кто не знает, gpt-5 это не одна, а несколько моделей в одном интерфейсе) и работать с ней, а вот когда она сама начинает подбирать модель и переключаться между ними, возникают проблемы, прежде всего, связанные с маленьким контекстом в младших моделях.
Claude code получил обновление, которое позволяет запускать в терминале фоновые bash команды при работающем Клоде - полезно, например, для анализа логов при отладке программ.
Поставил себе gpt-oss-20b на mac mini m4 16gb. Работает! Ставил через LM Studio, но потребовалось отключить Model loading guardrails в настройках, без этого модель не запускалась, утверждала, что мало ресурсов. Работает на скорости 18-24 токена. заняло 20 мин времени. Очень доволен.

На первый взгляд, модель не такая уж и тупая. Для использования в диалогах она, конечно, будет сильно проигрывать лучшим моделям, но для большинства автоматизаций, думаю, ее будет более чем достаточно. Единственное, для работы с n8n памяти хватать не должно - тут надо бы еще один мак мини прикупить либо посмотреть на модель с квантованием на 4бита (эта - на 8). При этом Клод утверждает, что если не использовать LM Studio, а идти по хардкору и всю установку делать самостоятельно, то скорость можно поднять до 30-35 токенов, да и настроек, включая файн-тьюнинг можно сделать гораздо больше.
Forwarded from Data Secrets
Нашли тут для вас готовый ноутбук для файнтюна gpt-oss

Внутри все end-to-end, от скачивания модели и подготовки данных до обучения и инференса.

Еще и мощно оптимизировано, кстати. Моделька на 20В вмещается в 14GB видеопамяти. То есть теоретически запустится даже на бесплатных ресурсах колаба.

Ноутбук для 20В (его же можно использовать для 120В)

А вот тут лежат все текстовые пояснения к коду и «теория»:про то, как работает формат Harmony и почему он необходим, например. В общем все, чтобы запускать код не в слепую (хотя так тоже можно), а с достаточно глубоким пониманием.

Занятие на выходные что надо
Для любителей Claude code - как добавить выдачу информации об использованных токенах. Честно скажу, это и обычному Клоду не помешало бы. Крайне раздражает, что диалог заканчивается внезапно и ты не можешь поручить модели сделать саммари контекста для нового диалога.

Добавьте в ~/.claude/settings.json:

{
"statusLine": {
"type": "command",
"command": "bun x ccusage statusline"
}
}
Про эту модельку в интернетах мало информации, но вообще любопытно посмотреть. По части же gpt-oss все пробуют, но GLM и Qwen, похоже, превзойти не удалось

PS Почитал на ollama - это файнтьюненный Qwen 2.5 3B, выпущенный 7 месяцев назад. По меркам ИИ - вечность. Не стоит тратить время
Нашел приложение для запуска локальных моделек… с iPhone! Завезли Qwen 3 с 1,7b параметров и 4-битной квантизацией, модельки LFM от LiquidAI, также есть phi-4, llama-3.2 и даже дистиллированный DeepSeek-R1. Баловство, но прикольно же…

Я так понимаю, это способ с телефона и к моделям на своем сервере подключаться

PS Qwen 3 1.7b у меня не заработал - телефон старенький, а LFM работает примерно так как на фото. Побаловались и хватит
Если вам потребуется работать с моделью по API - есть несколько ограниченно бесплатных вариантов. Во-первых, google дает 100 бесплатных запросов в день к gemini 2.5 pro (после этого на остальные варианты, можно, в общем и не смотреть), во-вторых, бесплатные запросы можно получить через GitHub (150 к маленьким моделькам, и 50 к большим - причем есть и gpt-5, и deepseek, но нет claude, да и к ризонингу доступ не дается, зато есть отдельные 150 запросов на эмбеддинг).

Это может пригодиться, если вы, например, работаете с такими программами как Repo prompt, о которой я писал выше. Штука действительно интересная. Она хранит разные промпты, анализирует проект, и дает сухую выжимку, которую надо передавать в контекст модели - не только для экономии токенов, но и для того, чтобы модель не растекалась по древу и не делала лишнего (а эта проблема у нейронок определенно есть). Кроме того, она позволяет править код по ответам нейронки. В моем случае я планирую так работать с Gemini 2.5 pro - это моя любимая модель для программирования, и да, отказался от курсора, работаю с ней через браузер, и автоматизации рутины по копированию кода туда-сюда очень хотелось бы. Кстати, Карпаты у себя тоже об это пишет ))
Google выкатил из бета-версии своего агента Жюля. Его можно найти по ссылке http://jules.google

Бесплатно доступно 15 обращений в день. Думаю, что у Клода появился серьезный конкурент. Подробности можно посмотреть, например, в этом видосике

Кстати, еще и на гитхабе к нему набор промптов можно посмотреть
От новостей уже начинаешь уставать, но тут на прошлой неделе еще одного агента подогнали - найти можно по адресу http://www.lindy.ai

Плохая новость - бесплатный он только в течение недели..
Никак не получается остановиться - аттракцион невиданной щедрости от OpenAI. Теперь на подписке plus можно выбрать gpt-5 thinking, а не полагаться на выбор модели самой джипитишкой. 3000 обращений в неделю. Другие модели я бы уже и не выбирал. Круто
Иногда пользовался Grok, чтобы узнать альтернативное мнение - моделька неплохая, но по ощущениям Grok 3 все же проигрывал основным конкурентам. Посмотрим, насколько Grok 4 действительно соответствует бенчмаркам, в которых он лидирует - возможности появились
Роскомнадзор в последнее время активизировался с баном легко вычисляемых vpn, работающих через нестандартные порты. Опять будут пляски с бубном.
Ну и whapsapp сегодня не только же у меня нормально позвонить не дает? Видимо, испытания проводятся. А может на постоянку уже решили прижать
Говорят, что скоро выход Gemini 3, и по бенчмаркам она будет рвать gpt-5 и grok 4. Вспоминая прошлые релизы Google, а это можно верить. Интересно, насколько она будет бесплатная..