И вот еще нашел прикольную штуку - программулина позволяет в одном интерфейсе общаться с разными моделями. Я это практикую очень часто. Шутят, что с такими ценами на ChatGPT-5 (а они низкие!!) скоро его будут вызывать из Clyde Code вместо Opus.
Repo Prompt
Repo Prompt – Iterate on code with powerful AI
Repo Prompt - A macOS native app designed to remove all the friction involved in iterating on your code with the most powerful AI models.
Видимо это судьба - заниматься не нейронками, а всякой фигней типа сетевого администрирования. Отрубился OpenVPN, причем получается интересно - OpenVPN с дружественного сервера работает, на моем сервере работает Amnezia, а вот сам OpenVPN на моем серваке работать перестал. Пару часов пробовал его поднять, не смог - судя по всему, дело в провайдере. В итоге переключился на Амнезию. Жаль, я уже привык. Мягко говоря, задалбывает, когда все стремятся тебе жизнь усложить, впрочем - не убило, разобрались, будем сильнее
Cursor теперь в терминале - все рванули на площадку Claude Code )) для установки запускайте
curl cursor.com/install -fsS | bash
curl cursor.com/install -fsS | bash
Понятно, сегодня все ленты забиты gpt-5, и по отзывам это действительно хорошая модель, особенно заметен прогресс в кодировании. У меня уже работает - первые бытовые впечатления: очень быстрая, но на бытовых вопросах и задачах кроме скорости какой-то большой разницы с прошлыми моделями не вижу. Видимо, моделька использовала нейронку попроще - ведь теперь она сама выбирает, под каждый вопрос, какого размера нейронка нужна. Впрочем, это всяко большой позитив, в выходные есть чем побаловаться
Qwen увеличил контекст до 1 млн токенов и это реально круто - маленькое окно быстро становится проблемой. Но помните, качество работы модели при росте контекста падает, поэтому стоит его экономить и регулярно открывать новые диалоги, даже если 1 млн токенов еще не выбран
Telegram
Machine learning Interview
🚀 Qwen3-30B-A3B-2507 и Qwen3-235B-A22B-2507 теперь поддерживают контекст до 1 млн токенов!
🔧 Технологии под капотом:
• Dual Chunk Attention (DCA) — метод экстраполяции длины, который делит длинные последовательности на управляемые блоки, сохраняя глобальную…
🔧 Технологии под капотом:
• Dual Chunk Attention (DCA) — метод экстраполяции длины, который делит длинные последовательности на управляемые блоки, сохраняя глобальную…
Qwen Code теперь дает 2000 бесплатных запросов в день. Это модель, работающая в командной строке, как Claude Code. Это интересно, поскольку у того же Gemini надо платить за api, а Claude и GPT-5 работают по подписке. Да, напомню, что на днях Qwen раскатал контекст на 1 млн токенов, который до этого был только у Gemini. При этом и сама модель неплоха. Я бы сказал, что сейчас столько возможностей использовать хороший ИИ бесплатно или совсем задешево, просто удивительно
GitHub
GitHub - QwenLM/qwen-code: An open-source AI coding agent that lives in your terminal.
An open-source AI coding agent that lives in your terminal. - QwenLM/qwen-code
👍1
OpenAI пришлось оправдываться перед расстроенными пользователями за запуск GPT-5 - нормально не работал роутер, выбирающий модель, были проблемы с повышенной нагрузкой, баги и пр. В итоге на платную подписку вернули даже got-4o и удвоили лимиты по платной подписке. В таких случаях, мне кажется, больше всего подходят слова Аршавина: ваши ожидания - ваши проблемы. Сейчас уже не время больших прорывов, каждый новый шаг лается с трудом, модели становятся лучше, но понемногу. Скорее прогресс идет не в самих моделях, а их окружении и интерфейсе по их использованию. В общем, все по плану, ждем ответов от конкурентов - интересно, как там дела у DeepSeek и их новым ризонером?
В части же gpt-5 есть мнение, что модель хороша в режимах, когда можно выбрать конкретную модель из семейства (кто не знает, gpt-5 это не одна, а несколько моделей в одном интерфейсе) и работать с ней, а вот когда она сама начинает подбирать модель и переключаться между ними, возникают проблемы, прежде всего, связанные с маленьким контекстом в младших моделях.
В части же gpt-5 есть мнение, что модель хороша в режимах, когда можно выбрать конкретную модель из семейства (кто не знает, gpt-5 это не одна, а несколько моделей в одном интерфейсе) и работать с ней, а вот когда она сама начинает подбирать модель и переключаться между ними, возникают проблемы, прежде всего, связанные с маленьким контекстом в младших моделях.
Claude code получил обновление, которое позволяет запускать в терминале фоновые bash команды при работающем Клоде - полезно, например, для анализа логов при отладке программ.
X (formerly Twitter)
Ian Nuttall (@iannuttall) on X
Claude Code 1.0.71 is out 🔥
- Run bash commands in the background with Ctrl+b
- custom status line using /statusline command
- Run bash commands in the background with Ctrl+b
- custom status line using /statusline command
Поставил себе gpt-oss-20b на mac mini m4 16gb. Работает! Ставил через LM Studio, но потребовалось отключить Model loading guardrails в настройках, без этого модель не запускалась, утверждала, что мало ресурсов. Работает на скорости 18-24 токена. заняло 20 мин времени. Очень доволен.
На первый взгляд, модель не такая уж и тупая. Для использования в диалогах она, конечно, будет сильно проигрывать лучшим моделям, но для большинства автоматизаций, думаю, ее будет более чем достаточно. Единственное, для работы с n8n памяти хватать не должно - тут надо бы еще один мак мини прикупить либо посмотреть на модель с квантованием на 4бита (эта - на 8). При этом Клод утверждает, что если не использовать LM Studio, а идти по хардкору и всю установку делать самостоятельно, то скорость можно поднять до 30-35 токенов, да и настроек, включая файн-тьюнинг можно сделать гораздо больше.
На первый взгляд, модель не такая уж и тупая. Для использования в диалогах она, конечно, будет сильно проигрывать лучшим моделям, но для большинства автоматизаций, думаю, ее будет более чем достаточно. Единственное, для работы с n8n памяти хватать не должно - тут надо бы еще один мак мини прикупить либо посмотреть на модель с квантованием на 4бита (эта - на 8). При этом Клод утверждает, что если не использовать LM Studio, а идти по хардкору и всю установку делать самостоятельно, то скорость можно поднять до 30-35 токенов, да и настроек, включая файн-тьюнинг можно сделать гораздо больше.
Forwarded from Data Secrets
Нашли тут для вас готовый ноутбук для файнтюна gpt-oss
Внутри все end-to-end, от скачивания модели и подготовки данных до обучения и инференса.
Еще и мощно оптимизировано, кстати. Моделька на 20В вмещается в 14GB видеопамяти. То есть теоретически запустится даже на бесплатных ресурсах колаба.
Ноутбук для 20В (его же можно использовать для 120В)
А вот тут лежат все текстовые пояснения к коду и «теория»:про то, как работает формат Harmony и почему он необходим, например. В общем все, чтобы запускать код не в слепую (хотя так тоже можно), а с достаточно глубоким пониманием.
Занятие на выходные что надо
Внутри все end-to-end, от скачивания модели и подготовки данных до обучения и инференса.
Еще и мощно оптимизировано, кстати. Моделька на 20В вмещается в 14GB видеопамяти. То есть теоретически запустится даже на бесплатных ресурсах колаба.
Ноутбук для 20В (его же можно использовать для 120В)
А вот тут лежат все текстовые пояснения к коду и «теория»:про то, как работает формат Harmony и почему он необходим, например. В общем все, чтобы запускать код не в слепую (хотя так тоже можно), а с достаточно глубоким пониманием.
Занятие на выходные что надо
Для любителей Claude code - как добавить выдачу информации об использованных токенах. Честно скажу, это и обычному Клоду не помешало бы. Крайне раздражает, что диалог заканчивается внезапно и ты не можешь поручить модели сделать саммари контекста для нового диалога.
Добавьте в ~/.claude/settings.json:
{
"statusLine": {
"type": "command",
"command": "bun x ccusage statusline"
}
}
Добавьте в ~/.claude/settings.json:
{
"statusLine": {
"type": "command",
"command": "bun x ccusage statusline"
}
}
Про эту модельку в интернетах мало информации, но вообще любопытно посмотреть. По части же gpt-oss все пробуют, но GLM и Qwen, похоже, превзойти не удалось
PS Почитал на ollama - это файнтьюненный Qwen 2.5 3B, выпущенный 7 месяцев назад. По меркам ИИ - вечность. Не стоит тратить время
PS Почитал на ollama - это файнтьюненный Qwen 2.5 3B, выпущенный 7 месяцев назад. По меркам ИИ - вечность. Не стоит тратить время
Telegram
Machine learning Interview
🧠 SmallThinker — новая серия LLM, нативно обученная для локального запуска
SmallThinker — это семейство языковых моделей, созданное с нуля для запуска на обычных устройствах:
📉 низкая память, 🐌 медленное хранилище, ❌ без GPU — и всё это без потери качества.…
SmallThinker — это семейство языковых моделей, созданное с нуля для запуска на обычных устройствах:
📉 низкая память, 🐌 медленное хранилище, ❌ без GPU — и всё это без потери качества.…
Нашел приложение для запуска локальных моделек… с iPhone! Завезли Qwen 3 с 1,7b параметров и 4-битной квантизацией, модельки LFM от LiquidAI, также есть phi-4, llama-3.2 и даже дистиллированный DeepSeek-R1. Баловство, но прикольно же…
Я так понимаю, это способ с телефона и к моделям на своем сервере подключаться
PS Qwen 3 1.7b у меня не заработал - телефон старенький, а LFM работает примерно так как на фото. Побаловались и хватит
Я так понимаю, это способ с телефона и к моделям на своем сервере подключаться
PS Qwen 3 1.7b у меня не заработал - телефон старенький, а LFM работает примерно так как на фото. Побаловались и хватит
Если вам потребуется работать с моделью по API - есть несколько ограниченно бесплатных вариантов. Во-первых, google дает 100 бесплатных запросов в день к gemini 2.5 pro (после этого на остальные варианты, можно, в общем и не смотреть), во-вторых, бесплатные запросы можно получить через GitHub (150 к маленьким моделькам, и 50 к большим - причем есть и gpt-5, и deepseek, но нет claude, да и к ризонингу доступ не дается, зато есть отдельные 150 запросов на эмбеддинг).
Это может пригодиться, если вы, например, работаете с такими программами как Repo prompt, о которой я писал выше. Штука действительно интересная. Она хранит разные промпты, анализирует проект, и дает сухую выжимку, которую надо передавать в контекст модели - не только для экономии токенов, но и для того, чтобы модель не растекалась по древу и не делала лишнего (а эта проблема у нейронок определенно есть). Кроме того, она позволяет править код по ответам нейронки. В моем случае я планирую так работать с Gemini 2.5 pro - это моя любимая модель для программирования, и да, отказался от курсора, работаю с ней через браузер, и автоматизации рутины по копированию кода туда-сюда очень хотелось бы. Кстати, Карпаты у себя тоже об это пишет ))
Это может пригодиться, если вы, например, работаете с такими программами как Repo prompt, о которой я писал выше. Штука действительно интересная. Она хранит разные промпты, анализирует проект, и дает сухую выжимку, которую надо передавать в контекст модели - не только для экономии токенов, но и для того, чтобы модель не растекалась по древу и не делала лишнего (а эта проблема у нейронок определенно есть). Кроме того, она позволяет править код по ответам нейронки. В моем случае я планирую так работать с Gemini 2.5 pro - это моя любимая модель для программирования, и да, отказался от курсора, работаю с ней через браузер, и автоматизации рутины по копированию кода туда-сюда очень хотелось бы. Кстати, Карпаты у себя тоже об это пишет ))
Google AI for Developers
Rate limits | Gemini API | Google AI for Developers
Google выкатил из бета-версии своего агента Жюля. Его можно найти по ссылке http://jules.google
Бесплатно доступно 15 обращений в день. Думаю, что у Клода появился серьезный конкурент. Подробности можно посмотреть, например, в этом видосике
Кстати, еще и на гитхабе к нему набор промптов можно посмотреть
Бесплатно доступно 15 обращений в день. Думаю, что у Клода появился серьезный конкурент. Подробности можно посмотреть, например, в этом видосике
Кстати, еще и на гитхабе к нему набор промптов можно посмотреть
jules.google
Jules - An Autonomous Coding Agent
Jules is an Autonomous agent that gets out of your way. It lets you focus on the coding you want to do, meanwhile picking up all the other random tasks that you rather not do.
От новостей уже начинаешь уставать, но тут на прошлой неделе еще одного агента подогнали - найти можно по адресу http://www.lindy.ai
Плохая новость - бесплатный он только в течение недели..
Плохая новость - бесплатный он только в течение недели..
www.lindy.ai
Lindy – The AI Teammate That Lets You Do More
Lindy is the AI employee that connects to all your tools, knows everything about your company, and does real work for the whole team.
Иногда пользовался Grok, чтобы узнать альтернативное мнение - моделька неплохая, но по ощущениям Grok 3 все же проигрывал основным конкурентам. Посмотрим, насколько Grok 4 действительно соответствует бенчмаркам, в которых он лидирует - возможности появились
Telegram
Machinelearning
✔️ Grok 4 доступен бесплатно!
Бесплатным пользователям доступно:
🟢Grok 3 - 15 запроса каждые 2 часа
🟢Grok 4 - 5 запросов каждые 12 часов
Бесплатный доступ, вероятно, является ответом на запуск ChatGPT5, хотя последний в настоящее время имеет более высокие…
Бесплатным пользователям доступно:
🟢Grok 3 - 15 запроса каждые 2 часа
🟢Grok 4 - 5 запросов каждые 12 часов
Бесплатный доступ, вероятно, является ответом на запуск ChatGPT5, хотя последний в настоящее время имеет более высокие…
Роскомнадзор в последнее время активизировался с баном легко вычисляемых vpn, работающих через нестандартные порты. Опять будут пляски с бубном.
Ну и whapsapp сегодня не только же у меня нормально позвонить не дает? Видимо, испытания проводятся. А может на постоянку уже решили прижать
Говорят, что скоро выход Gemini 3, и по бенчмаркам она будет рвать gpt-5 и grok 4. Вспоминая прошлые релизы Google, а это можно верить. Интересно, насколько она будет бесплатная..