Наткнулся на Reddit про PixelHQ.
Парень сделал приложение, которое превращает работу Claude Code в пиксельный офис на телефоне. AI-агент печатает за столом когда пишет код, идёт к доске когда думает над задачей.
Автор честно написал: "Это абсолютно бесполезно, и мне это нравится".
И пост взорвался. Куча комментариев с идеями. Хотят огонь, который разрастается с каждой ошибкой в коде. Мрачного жнеца, который появляется когда кредиты кончаются. Скелеты вместо агентов при завершении сессии. Окно, которое светится утром при полных кредитах и темнеет к ночи когда всё потрачено.
Один коммент попал в точку: "95% проектов в этом сабреддите либо полный мусор, либо переусложнённые копии того, что уже работает. Это охренительно круто".
Люди устали от полезности. От очередных todo-листов, трекеров продуктивности и дашбордов с метриками. Хотят что-то просто прикольное. Что-то ради вайба.
Кстати, парень накодил это за неделю с Claude Code. Взял готовые пиксель-арт ассеты из интернета, остальное чистый вайб-кодинг. Работает через локальную сеть, никакого облака, данные не покидают машину. Автор приглашает присоединиться к бете. Пока только iOS.
Ключевая мысль этого поста - делать что-то бесполезное, но приносящее радость.
Иногда лучший проект тот, который никому не нужен для работы. Но все хотят просто его ради фана.
Парень сделал приложение, которое превращает работу Claude Code в пиксельный офис на телефоне. AI-агент печатает за столом когда пишет код, идёт к доске когда думает над задачей.
Автор честно написал: "Это абсолютно бесполезно, и мне это нравится".
И пост взорвался. Куча комментариев с идеями. Хотят огонь, который разрастается с каждой ошибкой в коде. Мрачного жнеца, который появляется когда кредиты кончаются. Скелеты вместо агентов при завершении сессии. Окно, которое светится утром при полных кредитах и темнеет к ночи когда всё потрачено.
Один коммент попал в точку: "95% проектов в этом сабреддите либо полный мусор, либо переусложнённые копии того, что уже работает. Это охренительно круто".
Люди устали от полезности. От очередных todo-листов, трекеров продуктивности и дашбордов с метриками. Хотят что-то просто прикольное. Что-то ради вайба.
Кстати, парень накодил это за неделю с Claude Code. Взял готовые пиксель-арт ассеты из интернета, остальное чистый вайб-кодинг. Работает через локальную сеть, никакого облака, данные не покидают машину. Автор приглашает присоединиться к бете. Пока только iOS.
Ключевая мысль этого поста - делать что-то бесполезное, но приносящее радость.
Иногда лучший проект тот, который никому не нужен для работы. Но все хотят просто его ради фана.
🔥3❤2
Недавно случайно спросил Claude Code про механику фоновых задач. Думал, он сам следит за процессами. Оказалось - нет.
Запускаю сборку дистрибутива одного проекта (о проекте чуть позже расскажу). Обычно это минут 10. Агент говорит "ок, запустил в фоне" и завершает сессию. Я переключаюсь на другое.
Через 10 минут пишу новое сообщение. Агент отвечает: "Кстати, та сборка завершилась. Вот результат".
Как он узнал? У него же нет памяти между сессиями.
Разгадка простая: это делает CLI, а не сам агент.
Когда агент вызывает команду с флагом
Агент в этот момент вообще ничего не делает. Он завершился.
Процесс работает сам по себе. CLI следит за ним.
Когда процесс завершается, CLI фиксирует это. Отправляет уведомление агенту: "задача b3506b1 завершена, exit code 0". Т.Е. "прием, прием, задачка завершилась, порадуй пользователя"
Агент видит это уведомление и может прочитать результат из файла.
По сути, CLI работает как диспетчер задач. Агент просто отправляет заявку "запусти это в фоне" и получает уведомление, когда готово.
Умно. Агент не тратит токены на ожидание. Система делает фоновую работу. А когда нужно - подсовывает результат в контекст автоматически.
Это как оставить тесто подходить и вернуться через час. Не нужно стоять рядом и смотреть. Таймер сам скажет, когда готово.
Запускаю сборку дистрибутива одного проекта (о проекте чуть позже расскажу). Обычно это минут 10. Агент говорит "ок, запустил в фоне" и завершает сессию. Я переключаюсь на другое.
Через 10 минут пишу новое сообщение. Агент отвечает: "Кстати, та сборка завершилась. Вот результат".
Как он узнал? У него же нет памяти между сессиями.
Разгадка простая: это делает CLI, а не сам агент.
Когда агент вызывает команду с флагом
run_in_background=true, CLI запускает процесс отдельно. Создаёт task ID, перенаправляет вывод в файл и начинает мониторить статус на уровне системы.Агент в этот момент вообще ничего не делает. Он завершился.
Процесс работает сам по себе. CLI следит за ним.
Когда процесс завершается, CLI фиксирует это. Отправляет уведомление агенту: "задача b3506b1 завершена, exit code 0". Т.Е. "прием, прием, задачка завершилась, порадуй пользователя"
Агент видит это уведомление и может прочитать результат из файла.
По сути, CLI работает как диспетчер задач. Агент просто отправляет заявку "запусти это в фоне" и получает уведомление, когда готово.
Умно. Агент не тратит токены на ожидание. Система делает фоновую работу. А когда нужно - подсовывает результат в контекст автоматически.
Это как оставить тесто подходить и вернуться через час. Не нужно стоять рядом и смотреть. Таймер сам скажет, когда готово.
This media is not supported in your browser
VIEW IN TELEGRAM
Немного юмора вам на тему хайпа Clawdbot Moltbot OpenClaw
👏1🤣1
Для телеграм-бота с памятью встала задача - поиск по смыслу, а не по ключевым словам.
Обычный поиск работает как ctrl+F. Ищешь "программист" - находишь только где есть слово "программист". А если спросить "чем я занимаюсь?" - ничего не найдет.
Векторный поиск понимает смысл. Превращает текст в массив чисел. Звучит как магия, но работает просто.
Факт "работает программистом" становится вектором: [0.023, -0.156, 0.892...] - 4096 чисел. Запрос "чем я занимаюсь?" тоже превращается в вектор. Потом ищем самые похожие числа через cosine similarity.
Похожие по смыслу фразы получают похожие векторы. Как отпечатки пальцев для текста.
Примеры:
"где я живу?" → находит "живет в городе"
"какая у меня работа?" → находит "работает программистом"
"чем увлекаюсь?" → находит "любит играть в футбол"
Использовал sqlite-vec, один файл SQLite, latency нулевой, настройка за минуту.
Для эмбеддингов взял Qwen3 Embedding 8B на openrouter. Дешево и эффективно.
Бот теперь достает факты по смыслу, а не по совпадению букв. Как человек вспоминает - ассоциативно, а не через поиск по словарю.
Обычный поиск работает как ctrl+F. Ищешь "программист" - находишь только где есть слово "программист". А если спросить "чем я занимаюсь?" - ничего не найдет.
Векторный поиск понимает смысл. Превращает текст в массив чисел. Звучит как магия, но работает просто.
Факт "работает программистом" становится вектором: [0.023, -0.156, 0.892...] - 4096 чисел. Запрос "чем я занимаюсь?" тоже превращается в вектор. Потом ищем самые похожие числа через cosine similarity.
Похожие по смыслу фразы получают похожие векторы. Как отпечатки пальцев для текста.
Примеры:
"где я живу?" → находит "живет в городе"
"какая у меня работа?" → находит "работает программистом"
"чем увлекаюсь?" → находит "любит играть в футбол"
Использовал sqlite-vec, один файл SQLite, latency нулевой, настройка за минуту.
Для эмбеддингов взял Qwen3 Embedding 8B на openrouter. Дешево и эффективно.
Бот теперь достает факты по смыслу, а не по совпадению букв. Как человек вспоминает - ассоциативно, а не через поиск по словарю.
🤔1🤯1
Привет! Рад, что Вы здесь.
Меня зовут Андрей, мне 40 лет и я вайб-кодер (поддерживающие хлопки из зала). Это значит, что пишу код вместе с AI-агентами, а конкретно сейчас Claude Code.
Не эксперт, не гуру. Успешного успеха не предлагаю, курсы не продаю. Просто делюсь тем, что узнаю по пути: что сработало, что провалилось, какие костыли пришлось изобрести.
Здесь Вы прочитает:
- Эксперименты с AI-инструментами
- Провалы и неожиданные решения
- Конкретные примеры из практики
- Честные мысли о том, куда движется вайб-кодинг
Пишу коротко, без воды. От первого лица, потому что это личный канал. Планирую регулярно проводить стримы с участниками - разбирать инструменты и обсуждать новости.
Если Вы застряли с агентом или нашли крутой способ решить задачу - пишите в комментариях. Учимся вместе.
Меня зовут Андрей, мне 40 лет и я вайб-кодер (поддерживающие хлопки из зала). Это значит, что пишу код вместе с AI-агентами, а конкретно сейчас Claude Code.
Не эксперт, не гуру. Успешного успеха не предлагаю, курсы не продаю. Просто делюсь тем, что узнаю по пути: что сработало, что провалилось, какие костыли пришлось изобрести.
Здесь Вы прочитает:
- Эксперименты с AI-инструментами
- Провалы и неожиданные решения
- Конкретные примеры из практики
- Честные мысли о том, куда движется вайб-кодинг
Пишу коротко, без воды. От первого лица, потому что это личный канал. Планирую регулярно проводить стримы с участниками - разбирать инструменты и обсуждать новости.
Если Вы застряли с агентом или нашли крутой способ решить задачу - пишите в комментариях. Учимся вместе.
❤9👍8🔥5
Вчера запустил YouTube-канал.
Пока выходят короткие нарезки с последнего стрима. Через две недели планирую следующий стрим - буду тестировать что-то новое, ещё не решил что именно.
Зачем это нужно? Текстовые посты хороши для идей, но хочется пообщаться с живыми людьми, обсудить проблемы, помочь советом. Ради этого и планировался канал - помогать другим, через свои знания и опыт.
Пока выходят короткие нарезки с последнего стрима. Через две недели планирую следующий стрим - буду тестировать что-то новое, ещё не решил что именно.
Зачем это нужно? Текстовые посты хороши для идей, но хочется пообщаться с живыми людьми, обсудить проблемы, помочь советом. Ради этого и планировался канал - помогать другим, через свои знания и опыт.
❤2👍2
Собственно оно наступило. Новая модель от антропик вышла только что. Все AI чаты будет писать в ближайшие сутки эти новости.
У меня пока нет мнения, только перезапустил claude code. Пойду тестировать.
У меня пока нет мнения, только перезапустил claude code. Пойду тестировать.
Это точно нельзя пропустить, чем больше на каналах будет, тем больше людей узнают.
Anthropic дарит 50 баксов на кредиты поверх подписки, если у вас действующая подписка и вы успеете активировать до 16 февраля.
Забирать в http://claude.ai/settings/usage
Подробнее:
https://support.claude.com/en/articles/13613973-claude-opus-4-6-extra-usage-promo
Anthropic дарит 50 баксов на кредиты поверх подписки, если у вас действующая подписка и вы успеете активировать до 16 февраля.
Забирать в http://claude.ai/settings/usage
Подробнее:
https://support.claude.com/en/articles/13613973-claude-opus-4-6-extra-usage-promo
👍1🔥1
Далее заголовки желтой прессы: Cisco назвали его "security nightmare", The Register - "dumpster fire". One-click RCE, утечка API-ключей, 341 вредоносный скилл на ClawHub.
При этом концепция отличная - пишешь в мессенджер, AI делает всё сам.
Решил собрать свой аналог. С нуля, без форка.
Что делаю иначе. Память на sqlite-vec вместо md-файлов. Это не просто заметки, а векторный поиск по контексту. Агент реально помнит и находит нужное, а не перечитывает всё подряд.
Роутинг через Gemini Flash - дешёвые запросы идут через него, тяжёлые задачи уходят в Claude Code на Max подписке. Никакой потокенной оплаты за кодинг.
Безопасность с первого дня. Sandbox, валидация результатов перед деплоем, изоляция процессов. Не как у OpenClaw, где агент получает root и надейся на лучшее.
Пока прототип. Но идея та же - Telegram как пульт управления, только без дыр размером с ворота.
🔥3❤1
Собрал лендинг для телеграм-бота через Pencil. Есть приложение для мака, но я работал через плагин для VS Code,
Про инструмент узнал от Алексея на его канале про продуктовый вайб-кодинг. Недавно он опубликовал там подробный разбор Pencil и я решил попробовать.
Pencil - бесплатный аналог Figma. Подключаешь MCP, описываешь в чате что нужно, получаешь макет. Холст открывается прямо в VS Code, дальше работаешь через привычное общение с агентом. Ну а если совсем мелочи, то дедовским способом находишь нужные элементы и руками (о боже, в 21 веке, эру агентов) правишь размер кнопочек и их цвет.
Главное удобство - Claude Code адекватно читает структуру макета. Можешь сразу попросить сбилдить интерфейс, не выходя из VS Code.
Никакого "вау-эффекта" не было, но есть приятное ощущение "да, это просто работает". Для лендинга хватило полностью.
Канал Алексея советую почитать, если интересна тема продуктовой разработки с AI-агентами. Он копает глубже в сторону создания готовых продуктов, а не просто экспериментов с кодом.
Про инструмент узнал от Алексея на его канале про продуктовый вайб-кодинг. Недавно он опубликовал там подробный разбор Pencil и я решил попробовать.
Pencil - бесплатный аналог Figma. Подключаешь MCP, описываешь в чате что нужно, получаешь макет. Холст открывается прямо в VS Code, дальше работаешь через привычное общение с агентом. Ну а если совсем мелочи, то дедовским способом находишь нужные элементы и руками (о боже, в 21 веке, эру агентов) правишь размер кнопочек и их цвет.
Главное удобство - Claude Code адекватно читает структуру макета. Можешь сразу попросить сбилдить интерфейс, не выходя из VS Code.
Никакого "вау-эффекта" не было, но есть приятное ощущение "да, это просто работает". Для лендинга хватило полностью.
Канал Алексея советую почитать, если интересна тема продуктовой разработки с AI-агентами. Он копает глубже в сторону создания готовых продуктов, а не просто экспериментов с кодом.
🔥2❤1👌1
Сейчас я тестирую своего модульного помощника. Недавно был добавлен модуль на обзор новостей и для теста я попросил его собрать новости за последние дни с сайта антропик. Ниже прилагается полная цитата ответа бота, специально оставляю как есть. Как только доработаю функционал до адекватного уровня, обязательно расскажу про это и по запросу выдам доступ к mvp версии бота. А пока, наслаждайтесь утренними новостями за чашечкой кофе.
Сообщение 1: Мои комментарии
Я обновил текст поста №1 в базе данных. Основной упор сделан на профессиональную пользу (код, Xcode) и этическую позицию компании (отказ от рекламы), что сейчас является главным триггером в обсуждениях Anthropic. Если решите публиковать сейчас, ссылки уже вшиты в заголовки.
*
Сообщение 2: Текст для копирования
🚀 Главное от Anthropic: Релиз Opus 4.6 и курс на приватность
За последние дни компания Anthropic представила ряд обновлений, которые укрепляют позиции Claude как самого «умного» и этичного ИИ-помощника. Разбираем по порядку:
1️⃣ Релиз Claude Opus 4.6
Долгожданное обновление флагманской модели. Opus 4.6 получил значительный прирост в качестве написания кода и понимании сложных многошаговых инструкций. Модель стала еще точнее в поиске информации и лучше справляется с «галлюцинациями».
2️⃣ Claude — пространство для мышления (без рекламы)
Anthropic официально подтвердила: Claude останется свободным от рекламы. Компания объясняет это тем, что рекламные стимулы несовместимы с созданием по-настоящему полезного ИИ-помощника, которому можно доверять.
3️⃣ Поддержка Claude Agent SDK в Xcode
Важный шаг для Apple-разработчиков. Теперь агенты на базе Claude могут более глубоко интегрироваться в процесс создания приложений для iOS и macOS прямо в Xcode, повышая продуктивность написания кода.
#Anthropic #Claude #AI #Нейросети #Разработка #Xcode
Я обновил текст поста №1 в базе данных. Основной упор сделан на профессиональную пользу (код, Xcode) и этическую позицию компании (отказ от рекламы), что сейчас является главным триггером в обсуждениях Anthropic. Если решите публиковать сейчас, ссылки уже вшиты в заголовки.
*
Сообщение 2: Текст для копирования
🚀 Главное от Anthropic: Релиз Opus 4.6 и курс на приватность
За последние дни компания Anthropic представила ряд обновлений, которые укрепляют позиции Claude как самого «умного» и этичного ИИ-помощника. Разбираем по порядку:
1️⃣ Релиз Claude Opus 4.6
Долгожданное обновление флагманской модели. Opus 4.6 получил значительный прирост в качестве написания кода и понимании сложных многошаговых инструкций. Модель стала еще точнее в поиске информации и лучше справляется с «галлюцинациями».
2️⃣ Claude — пространство для мышления (без рекламы)
Anthropic официально подтвердила: Claude останется свободным от рекламы. Компания объясняет это тем, что рекламные стимулы несовместимы с созданием по-настоящему полезного ИИ-помощника, которому можно доверять.
3️⃣ Поддержка Claude Agent SDK в Xcode
Важный шаг для Apple-разработчиков. Теперь агенты на базе Claude могут более глубоко интегрироваться в процесс создания приложений для iOS и macOS прямо в Xcode, повышая продуктивность написания кода.
#Anthropic #Claude #AI #Нейросети #Разработка #Xcode
Anthropic
Claude is a space to think
We’ve made a choice: Claude will remain ad-free. We explain why advertising incentives are incompatible with a genuinely helpful AI assistant, and how we plan to expand access without compromising user trust.
Разработка вместе с Claude Cloud не знает границ. Ни географических, ни бытовых.
Сидим на полу в детской, повторяем слова по английскому. Казалось бы, не самое рабочее место, но связка планшета и Termius творит чудеса.
Пара манипуляций и я уже на сервере. Пока в комнате звучат слова, в консоли оживают новые модули моего ассистента.
Удивительно, насколько коротким стал путь от идеи до деплоя. Просто продолжаю код прямо здесь, между проверкой домашнего задания у ребенка.
Мобильность в чистом виде, когда проект растет вместе с тобой, где бы ты ни находился.
Сидим на полу в детской, повторяем слова по английскому. Казалось бы, не самое рабочее место, но связка планшета и Termius творит чудеса.
Пара манипуляций и я уже на сервере. Пока в комнате звучат слова, в консоли оживают новые модули моего ассистента.
Удивительно, насколько коротким стал путь от идеи до деплоя. Просто продолжаю код прямо здесь, между проверкой домашнего задания у ребенка.
Мобильность в чистом виде, когда проект растет вместе с тобой, где бы ты ни находился.
👍5🔥1🤡1
Друзья.
Первый стрим показал, что формат работает. Было классно обсудить вживую.
Делаю второй стрим в субботу (14.02), планирую так же с 20:00 на 1-2 часа.
Тему выбираете Вы, пишите в комментарии, а пока базовые мысли:
- Практика с Claude Code
- Разбор ошибок в вайб-кодинге
- Настройка AI-агентов
- Векторная память и семантический поиск
Яндекс Телемост, свободное общение, без подготовленных докладов.
Первый стрим показал, что формат работает. Было классно обсудить вживую.
Делаю второй стрим в субботу (14.02), планирую так же с 20:00 на 1-2 часа.
Тему выбираете Вы, пишите в комментарии, а пока базовые мысли:
- Практика с Claude Code
- Разбор ошибок в вайб-кодинге
- Настройка AI-агентов
- Векторная память и семантический поиск
Яндекс Телемост, свободное общение, без подготовленных докладов.
Telegram
AV_Vibe-Кодинг
Вчера записал стрим про Popmelt.
Планировал час. Вышло два. Четверо пришли, говорили, обсуждали вайб-кодинг, промпты, ошибки AI. Времени не заметил совсем.
Это было неожиданно круто. Не просто записываешь экран и комментируешь сам себе. А разбираешь процесс…
Планировал час. Вышло два. Четверо пришли, говорили, обсуждали вайб-кодинг, промпты, ошибки AI. Времени не заметил совсем.
Это было неожиданно круто. Не просто записываешь экран и комментируешь сам себе. А разбираешь процесс…
👍2❤1
Нашел отличный мини гайд для Claude Code.
Вот краткая сводка:
В январе 2026 года Claude Code 2.1.x продемонстрировал впечатляющие результаты 1,096+ коммитов, что свидетельствует о фундаментальном обновлении архитектуры системы.
Ключевые обновления:
MCP Tool Search
- Реализована ленивая загрузка инструментов по требованию
- Сокращение контекстного окна с 77K до 8.7K токенов
- Значительное повышение производительности системы
Custom Agents
- Внедрена система автоматического делегирования задач
- Каждый агент работает с изолированным контекстом
- Динамическое создание специализированных ассистентов
Session Teleportation
- Обеспечен бесшовный переход между терминалом и claude.ai/code
- Поддержка продолжения работы с любого устройства
- Синхронизация состояния сессий в реальном времени
Background Tasks
- Реализовано параллельное выполнение агентов
- Поддержка многоядерной обработки
- Управление фоновыми процессами через Ctrl+B
Дополнительные улучшения:
- Улучшенный поиск конфигураций через /config search
- Фильтрация статистики /stats
- Пользовательские привязки клавиш
Проект активно развивается, по этому советую следить за обновлениями и новостями.
Вот краткая сводка:
В январе 2026 года Claude Code 2.1.x продемонстрировал впечатляющие результаты 1,096+ коммитов, что свидетельствует о фундаментальном обновлении архитектуры системы.
Ключевые обновления:
MCP Tool Search
- Реализована ленивая загрузка инструментов по требованию
- Сокращение контекстного окна с 77K до 8.7K токенов
- Значительное повышение производительности системы
Custom Agents
- Внедрена система автоматического делегирования задач
- Каждый агент работает с изолированным контекстом
- Динамическое создание специализированных ассистентов
Session Teleportation
- Обеспечен бесшовный переход между терминалом и claude.ai/code
- Поддержка продолжения работы с любого устройства
- Синхронизация состояния сессий в реальном времени
Background Tasks
- Реализовано параллельное выполнение агентов
- Поддержка многоядерной обработки
- Управление фоновыми процессами через Ctrl+B
Дополнительные улучшения:
- Улучшенный поиск конфигураций через /config search
- Фильтрация статистики /stats
- Пользовательские привязки клавиш
Проект активно развивается, по этому советую следить за обновлениями и новостями.
❤2👍1
Сегодня выторговал подписку на Kimi за $0.99. С $19 до доллара. С AI моделью.
Kimi 2.5 - китайская модель с огромным контекстным окном. Может держать в памяти целые кодовые базы. Для вайб-кодинга это как иметь напарника, который помнит каждую строчку твоего проекта.
Но $19 в месяц - дорого для экспериментов. Решил поторговаться. Написал в чат техподдержки.
Они предложили скидку. Я попросил больше. Они снизили ещё. Я сказал, что последний доллар потрачу на кофе, чтобы кодить всю ночь и доделать MVP.
Сработало. $0.99 за первый месяц.
Смешно, но это работает не только с людьми. AI-модели обучены на переговорах. Они знают паттерны торга. И если ты даёшь конкретную причину, а не просто "дайте скидку" - алгоритм это учитывает.
Главное - быть конкретным. "Хочу дешевле" не сработает. "Потрачу сэкономленное на кофе, чтобы всю ночь работать над продуктом" - сработало.
Теперь тестирую Kimi на реальных задачах. Посмотрим, стоит ли оно даже доллара.
Kimi 2.5 - китайская модель с огромным контекстным окном. Может держать в памяти целые кодовые базы. Для вайб-кодинга это как иметь напарника, который помнит каждую строчку твоего проекта.
Но $19 в месяц - дорого для экспериментов. Решил поторговаться. Написал в чат техподдержки.
Они предложили скидку. Я попросил больше. Они снизили ещё. Я сказал, что последний доллар потрачу на кофе, чтобы кодить всю ночь и доделать MVP.
Сработало. $0.99 за первый месяц.
Смешно, но это работает не только с людьми. AI-модели обучены на переговорах. Они знают паттерны торга. И если ты даёшь конкретную причину, а не просто "дайте скидку" - алгоритм это учитывает.
Главное - быть конкретным. "Хочу дешевле" не сработает. "Потрачу сэкономленное на кофе, чтобы всю ночь работать над продуктом" - сработало.
Теперь тестирую Kimi на реальных задачах. Посмотрим, стоит ли оно даже доллара.
🔥9😁5❤1
Бывший CEO GitHub поднял $60M, чтобы построить GitHub заново. Но уже не для людей.
Томас Домке четыре года рулил GitHub, запускал Copilot, а теперь вышел с Entire - платформой, где код, контекст и рассуждения агентов хранятся вместе. Потому что на GitHub лежит только финальный код. А как агент к нему пришёл, какие промпты получал, где ошибся - всё это исчезает после сессии.
Знакомая боль. Работаешь с Claude Code, прожигаешь токены, выстраиваешь контекст. Сессия кончилась - и всё, начинай сначала. Entire хочет это починить: при каждом коммите сохраняется вся цепочка диалога с агентом.
Но тут есть второе дно. Все эти сохранённые контексты - это датасет мечты. Не просто генерации, а генерации, которые привели к реальному коммиту. Человек направлял, поправлял, давал контекст - и это сработало. На таких данных можно обучать следующее поколение агентов.
Параллельно open-source трещит. Вайб-кодеры заваливают мейнтейнеров AI-пулл-реквестами, vas3k недавно чуть не забросил проект из-за этого. Entire обещает помочь и тут - если к PR приложен контекст генерации, другой AI может проверить всю цепочку.
Stack Overflow уже исчез. GitHub вынужден меняться. 4% публичных коммитов уже в соавторстве с Claude. Инструменты начинают создаваться не для людей, а для взаимодействия между агентами.
И да, новость не новая, но хотелось бы и мне поделиться ей, потому что, это важная точка развития индустрии ИИ агентов
Томас Домке четыре года рулил GitHub, запускал Copilot, а теперь вышел с Entire - платформой, где код, контекст и рассуждения агентов хранятся вместе. Потому что на GitHub лежит только финальный код. А как агент к нему пришёл, какие промпты получал, где ошибся - всё это исчезает после сессии.
Знакомая боль. Работаешь с Claude Code, прожигаешь токены, выстраиваешь контекст. Сессия кончилась - и всё, начинай сначала. Entire хочет это починить: при каждом коммите сохраняется вся цепочка диалога с агентом.
Но тут есть второе дно. Все эти сохранённые контексты - это датасет мечты. Не просто генерации, а генерации, которые привели к реальному коммиту. Человек направлял, поправлял, давал контекст - и это сработало. На таких данных можно обучать следующее поколение агентов.
Параллельно open-source трещит. Вайб-кодеры заваливают мейнтейнеров AI-пулл-реквестами, vas3k недавно чуть не забросил проект из-за этого. Entire обещает помочь и тут - если к PR приложен контекст генерации, другой AI может проверить всю цепочку.
Stack Overflow уже исчез. GitHub вынужден меняться. 4% публичных коммитов уже в соавторстве с Claude. Инструменты начинают создаваться не для людей, а для взаимодействия между агентами.
И да, новость не новая, но хотелось бы и мне поделиться ей, потому что, это важная точка развития индустрии ИИ агентов
❤5
Я попросил сделать пост про выход новой модели. Удалил пару фраз для краткости, в основном не трогал. Так работает модуль контент-менеджера в моем ассистенте. который я сейчас уже полирую.
Почему меня в принципе заинтересовала новая модель? Нужен легкий оркестрант, администратор. Дорогие модели от Антропик и ЧатГПТ не особо подходят, но зато идеально ребята с другого конца планеты.
Сейчас у меня стоит Kimi 2.5, подписку которого я сторговал до 0.99$.
И так, далее пост:
🚀 MiniMax выпустила M2.5 — новый вызов лидерам ИИ-рынка
Китайский стартап MiniMax (один из «пяти тигров» китайского ИИ) представил обновленную модель M2.5, которая уже интегрирована в их флагманский продукт — MiniMax Agent.
🔹 Что важно:
• Модель ориентирована на агентские задачи — может самостоятельно планировать, использовать инструменты и решать сложные многоэтапные задачи
🔹 Цифры впечатляют:
Согласно независимым бенчмаркам, M2.5 набирает 80.2% в SWE-Bench Verified, при этом стоит в 10 раз дешевле аналогов. Другие тесты показывают 99% надежность при выполнении задач — минимум технических сбоев.
💡 Вывод: MiniMax делает ставку не просто на «умный чат», а на полноценного цифрового сотрудника. С учетом открытости моделей и агрессивного ценообразования — это серьезный игрок для наблюдения.
Почему меня в принципе заинтересовала новая модель? Нужен легкий оркестрант, администратор. Дорогие модели от Антропик и ЧатГПТ не особо подходят, но зато идеально ребята с другого конца планеты.
Сейчас у меня стоит Kimi 2.5, подписку которого я сторговал до 0.99$.
И так, далее пост:
🚀 MiniMax выпустила M2.5 — новый вызов лидерам ИИ-рынка
Китайский стартап MiniMax (один из «пяти тигров» китайского ИИ) представил обновленную модель M2.5, которая уже интегрирована в их флагманский продукт — MiniMax Agent.
🔹 Что важно:
• Модель ориентирована на агентские задачи — может самостоятельно планировать, использовать инструменты и решать сложные многоэтапные задачи
🔹 Цифры впечатляют:
Согласно независимым бенчмаркам, M2.5 набирает 80.2% в SWE-Bench Verified, при этом стоит в 10 раз дешевле аналогов. Другие тесты показывают 99% надежность при выполнении задач — минимум технических сбоев.
💡 Вывод: MiniMax делает ставку не просто на «умный чат», а на полноценного цифрового сотрудника. С учетом открытости моделей и агрессивного ценообразования — это серьезный игрок для наблюдения.
Telegram
AV_Vibe-Кодинг
Сегодня выторговал подписку на Kimi за $0.99. С $19 до доллара. С AI моделью.
Kimi 2.5 - китайская модель с огромным контекстным окном. Может держать в памяти целые кодовые базы. Для вайб-кодинга это как иметь напарника, который помнит каждую строчку твоего…
Kimi 2.5 - китайская модель с огромным контекстным окном. Может держать в памяти целые кодовые базы. Для вайб-кодинга это как иметь напарника, который помнит каждую строчку твоего…
Друзья, этот пост написан мной целиком, без единого токена от AI.
Буквально только что, я опубликовал пост про проблемы с Kimi K2.5 и tool calling. Попросил Claude найти похожие случаи в сети и на их основе собрать текст. Не проверил источники до конца и выложил. В комментариях мне справедливо указали - ссылки были про K2, а не K2.5.
Пост удалил, потому что не хочу вводить вас в заблуждение.
Но сама проблема реальная. Kimi K2.5 вместо того чтобы вызывать инструменты, "придумывала" их выполнение. Записывала результат в векторную память беседы, а не в базу данных задач. Модель буквально галлюцинировала работу с инструментами - делала вид, что всё выполнила, хотя ничего не произошло.
Я провёл ещё пару экспериментов. Проблемы с вызовом инструментов повторились. Решил не тратить время и откатился назад - вернул OpenRouter API и переключился на MiniMax M2.5.
Урок для меня: проверяй внимательно источники, даже если их собрал AI. Особенно если их собрал AI
Буквально только что, я опубликовал пост про проблемы с Kimi K2.5 и tool calling. Попросил Claude найти похожие случаи в сети и на их основе собрать текст. Не проверил источники до конца и выложил. В комментариях мне справедливо указали - ссылки были про K2, а не K2.5.
Пост удалил, потому что не хочу вводить вас в заблуждение.
Но сама проблема реальная. Kimi K2.5 вместо того чтобы вызывать инструменты, "придумывала" их выполнение. Записывала результат в векторную память беседы, а не в базу данных задач. Модель буквально галлюцинировала работу с инструментами - делала вид, что всё выполнила, хотя ничего не произошло.
Я провёл ещё пару экспериментов. Проблемы с вызовом инструментов повторились. Решил не тратить время и откатился назад - вернул OpenRouter API и переключился на MiniMax M2.5.
Урок для меня: проверяй внимательно источники, даже если их собрал AI. Особенно если их собрал AI