Вайб-кодинг
51.5K subscribers
1.99K photos
822 videos
30 files
1.31K links
Авторский канал по ВАЙБ КОДИНГУ

Ссылка для друзей: https://t.me/+ll3pbl442dNkZmYy

Cотрудничество: @devmangx

РКН: https://clck.ru/3RRVfk
Download Telegram
COMEBACK: Meta выпустили Muse Spark 1.2 и собственную IDE Muse Code в бета-версии. 🍗

Это быстрое обновление после Muse Spark 1.1, вышедшей всего несколько недель назад. Новая версия получила больше фокуса на задачах программирования и новый harness.

В тестах модель показала заметный рост в Terminal Bench, DeepSWE и внутренних бенчмарках. В агентных сценариях улучшились результаты в GDPVal и MCP Atlas.

В DeepSWE 1.1 Muse Spark 1.2 набрала 59%, обойдя Grok Build 4.5 и Gemini 3.6 Flash.

При этом цена остаётся крайне низкой. Если готовы немного поделиться данными с Цукербергом ради «улучшения продуктов Meta» — Spark 1.2 можно получить почти даром: $0,10 за 1 млн входных токенов и $0,20 за 1 млн выходных.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Очень интересный релиз: Prime Intellect запустили Prime Agent — обвязку, которая превращает долгие автономные сессии ИИ в отдельную задачу программирования.

Его единственный инструмент — постоянное IPython-ядро. Модель может программно искать по своей истории, вызывать инструменты, запускать постоянных субагентов и хранить полезное состояние вне активного контекста.

Prime Intellect описывают это так:
«RLM рассматривает контекст как переменную, а делегирование субагентам — как вызовы функций внутри REPL».


В основе лежат три идеи:

— программный вызов инструментов через RLM;
— постоянная работа нескольких субагентов;
— самоизменяемый harness, который позволяет агенту обновлять собственную память, навыки и настройки.

Они сообщают о заметном приросте результатов на задачах с длинным контекстом и долгим горизонтом. На ARC-AGI-3 Opus 5 в стандартной конфигурации набрал 30,2%, а с Prime Agent результат вырос до 95,5%, превысив заявленный хуман эксперт базлайн — 95,4%.

Также на предварительном бенчмарке он с нуля создал рабочие эмуляторы SEGA Genesis и Game Boy Color на Rust :D

опенсорс 🥰
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Совет: используйте Codex, Claude Code или другого ИИ-агента, чтобы быстро найти, что занимает место на диске.

Если хранилище переполнено и непонятно, куда исчезло свободное место, просто попросите Codex просканировать систему.

Промпт:
«Просканируй систему и найди, что занимает место на диске. Найди крупные файлы, старые установщики, неиспользуемые приложения, папки с кэшем, заброшенные проекты и всё, что можно безопасно очистить. Сгруппируй результаты по категориям с указанием размера и отметь, что можно удалить автоматически, а что требует моей проверки. Пока ничего не удаляй — только покажи список».


Codex найдёт самые объёмные файлы, объяснит, что это такое, и покажет, что можно удалить без риска, а что лучше сначала проверить. Это гораздо быстрее, чем вручную искать всё по папкам и переживать, что случайно удалишь что-то важное. 😓
Please open Telegram to view this post
VIEW IN TELEGRAM
Плохие новости: на странице API DeepSeek написано, что в ближайшее время стоимость использования API DeepSeek значительно вырастет.

Самое время выжать максимум из Flash, пока он не подорожал. 👀
Please open Telegram to view this post
VIEW IN TELEGRAM
Похоже, OpenAI работают над функцией, которая позволит покупать сброс лимитов запросов для Codex.

На это указывают находки в публичной конфигурации страницы оплаты и ресурсах веб-приложения ChatGPT.

Теперь ясно, почему Tibo не сбрасывает нам лимиты. 🙂
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI существенно обновила ChatGPT:

Теперь пользователи Free и Go могут без ограничений пользоваться GPT-5.6 Luna в текстовых чатах — моделью, возможностей которой уже более чем достаточно для большинства повседневных задач. Кроме того, на бесплатном тарифе появляется кнопка Think, которая позволяет модели уделять больше времени рассуждению при ответе на сложные вопросы.

Не остались без обновлений и пользователи Plus и Pro. Все новые чаты теперь по умолчанию работают на GPT-5.6 Sol, а также появился ползунок, с помощью которого можно регулировать объём рассуждений перед ответом. По данным OpenAI, новая версия модели допускает на 68% меньше фактических ошибок по сравнению с GPT-5.5 Instant. 💃

При этом обновление касается только обычных чатов ChatGPT. Версии GPT-5.6 Sol для Codex и Work остаются без изменений.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Теперь Codex Security Review можно запускать прямо из GitHub.

Codex теперь может автоматически выполнять проверку безопасности каждого GitHub PR с учётом контекста всего репозитория, оставляя найденные проблемы и рекомендации прямо в комментариях к изменённому коду.

Узнать, как включить автоматическую проверку 🔈
Please open Telegram to view this post
VIEW IN TELEGRAM
Anthropic обновила защитные механизмы Claude Fable 5, связанные с биологией, чтобы сократить количество ложных срабатываний. После обновления число отказов по запросам, связанным с биологией, уменьшилось примерно на 85% во всех продуктах компании.

При этом запросы, которые Anthropic считает задачами двойного назначения, включая вирусологию, токсикологию и молекулярный дизайн, по-прежнему будут автоматически передаваться в Opus 5. Из-за этого Fable 5 всё ещё не подходит для профессиональных биологических исследований и разработки лекарств.

Впрочем, на вопрос, откуда берутся дети, Claude Fable 5 по-прежнему отвечать отказывается. 🥲
Please open Telegram to view this post
VIEW IN TELEGRAM
На аккаунте DeepSeek за последнюю неделю — всего один пост с релизом DeepSeek V4 Flash. До этого — тишина с 23 мая, когда компания объявила о 75%-й скидке на DeepSeek V4 Pro.

Тем временем в других компаниях:
Media is too big
VIEW IN TELEGRAM
OpenAI вместе с AWS, Cursor, GitHub, VS Code, Vercel и другими запускает Agent Plugins — открытый стандарт для упаковки скиллов и конфигураций MCP-серверов в единый формат.

Один такой пакет можно использовать в разных совместимых агентных клиентах. На старте поддерживаются Codex, ChatGPT, Cursor, GitHub Copilot, VS Code и Kiro.

Самое полезное здесь то, что инструкции наконец могут переноситься вместе с нужными им инструментами. Больше не придётся заново собирать и настраивать одну и ту же конфигурацию под каждый клиент.

Пока первая версия стандартизирует только формат пакета. Аутентификация, разрешения, установка и интерфейс остаются на стороне каждого клиента.

Claude Code в стартовый список пока не входит. 🤷‍♂️
Please open Telegram to view this post
VIEW IN TELEGRAM
Google раздаёт бесплатные деньги. 🤩

Если у вас подписка Google AI Pro или Ultra, каждый месяц вам начисляют бесплатные кредиты Google Cloud — и большинство об этом даже не знает.

• AI Pro: $10 в месяц
• AI Ultra 20 ТБ: $40 в месяц
• AI Ultra 30 ТБ: $100 в месяц

Активировать кредиты можно через портал Google Developer Program. Для получения нужен проект в Google Cloud с включённым биллингом.

Для Pro сумма небольшая, но бесплатные деньги есть бесплатные деньги.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Одна из самых полезных привычек при работе с Codex 5.6 на завершающем этапе — это сжимать длинные диалоги в документ для передачи контекста по проекту. Это может сэкономить огромное количество токенов.

Когда диалог по долгому проекту становится слишком большим, в нём накапливаются устаревшие решения и мусор из логов ошибок. В результате ИИ снова и снова просматривает код и наступает на старые грабли, впустую расходуя огромное количество токенов.

Примерный промпт, который помогает заметно сократить бесполезный расход токенов:

«Текущий этап работы подходит к завершению. Создай или обнови PROJECT_STATUS.md, сведя результаты этого этапа в документ для передачи проекта, с которого можно будет бесшовно продолжить работу.

Документ должен включать: текущие цели, завершённые задачи, ключевые технические решения, изменённые основные файлы, результаты тестирования и проверки, известные проблемы, уже опробованные, но не сработавшие подходы, а также последовательность следующих шагов разработки.

Сверь содержимое с текущим кодом, изменениями Git и результатами тестов. Оставь только ту информацию, которая действительно понадобится для дальнейшей разработки. Не добавляй нерелевантные обсуждения, неподтверждённые выводы и чувствительные данные вроде паролей или ключей».


Когда в следующий раз возвращаетесь к проекту, первым сообщением достаточно написать:

«Сначала прочитай PROJECT_STATUS.md, чтобы подтвердить текущий прогресс, известные проблемы и следующие шаги, а затем продолжай разработку».

Главная ценность этой привычки в том, что ИИ больше не приходится продираться через раздутый контекст, заново анализировать уже проверенные решения или снова попадать в те же старые ловушки.

Ещё лучше то, что такой документ передачи контекста не привязан к одной сессии или платформе.

Один и тот же проект можно передать Codex, Claude Code, Cursor или даже следующему разработчику — и сразу продолжить работу. 🚬
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Новая функция Claude Code: теперь сессии могут общаться друг с другом.

Например:

> В одной сессии вы работаете над одной функцией.
> В другой — над другой частью проекта.
> Если одной сессии нужно что-то передать другой, можно просто попросить Claude сделать это.

Claude отправит краткое резюме с важной информацией, а другая сессия продолжит работу уже с этим контекстом.

Также можно задать вопрос другой сессии и получить её ответ прямо в той сессии, которой вы сейчас пользуетесь.

Обновите Claude Code, чтобы попробовать. Функция доступна на macOS и Linux. 🎉
Please open Telegram to view this post
VIEW IN TELEGRAM
3
ChatGPT Live получил поддержку файлов и Projects.

Теперь во время разговора можно прикрепить файл или изображение и сразу задавать вопросы по его содержимому. Также GPT-Live можно использовать внутри Projects — где уже собраны чаты, справочные файлы, инструкции и текущий контекст.

При этом забавно: какое-то время назад там уже можно было включить камеру и вести мультимодальный диалог о том, что вы видите перед собой. 🪑
Please open Telegram to view this post
VIEW IN TELEGRAM
С 14 августа Auto Mode станет режимом разрешений по умолчанию в Claude Code для пользователей Pro, Max и Team.

Auto Mode проверяет каждый вызов инструмента отдельным классификатором и решает, можно ли выполнить действие без ручного подтверждения.

Одна из причин, почему Anthropic доверяет Auto Mode больше, чем ручному подтверждению:

В исследовании с 1 053 платными тестировщиками обычный запрос разрешения заменяли на заведомо опасную команду. Ничего реально не запускалось — пользователи видели только текст.

Опасность замечали лишь в 13,6% случаев, а после 50 запросов показатель падал примерно до 5%.

Auto Mode блокировал те же команды в 89% случаев, причём эффективность практически не снижалась даже в длинных сессиях.

Вторая причина перехода — долгие агентные задачи.

Модели вроде Opus 5 уже могут планировать и выполнять многочасовую работу, но в этом мало пользы, если агент останавливается на каждом вызове инструмента и ждёт подтверждения.

С Auto Mode можно запустить одну задачу или несколько параллельно, а потом вернуться уже к готовым PR для ревью.

Сам классификатор расходует небольшое количество дополнительных токенов, но с сегодняшнего дня они больше не учитываются в лимитах Pro, Max и Team.

Позже это изменение появится и для Enterprise и пользователей API, когда Auto Mode станет режимом по умолчанию и для них. 👋
Please open Telegram to view this post
VIEW IN TELEGRAM
Для тех, кто хочет залезть под капот Kimi K3: минимальная реализация архитектуры, сделанная специально для того, чтобы её можно было нормально прочитать, запустить на CPU или в Google Colab и сверять код с оригинальным техническим отчётом.

KDA, Gated MLA, Attention Residuals и Stable LatentMoE здесь сохранены, но некоторые части упрощены ради читаемости.