Вайб-кодинг
62.4K subscribers
2.1K photos
878 videos
30 files
1.41K links
Авторский канал по ВАЙБ КОДИНГУ

Ссылка для друзей: https://t.me/+ll3pbl442dNkZmYy

Cотрудничество: @devmangx

РКН: https://clck.ru/3RRVfk
Download Telegram
ChatGPT Work теперь может подхватывать то, что делает ваш стиль письма именно вашим.

Любимые фразы. Ваш очень специфичный способ заканчивать сообщения. Ваши особенности с заглавными и строчными буквами.

Можно подключить инструменты, которыми вы пользуетесь каждый день, например Gmail, Google Drive, Slack и SharePoint, и ChatGPT Work будет учиться вашему стилю по письмам, сообщениям и файлам, а затем использовать его во всём, что вы будете писать дальше.

Для начала откройте ChatGPT в веб-версии. Также это можно настроить через Settings → Personalization → Writing style.

После настройки ваш стиль будет применяться ко всем сообщениям в ChatGPT Work как в веб-версии, так и на мобильных устройствах.

Функция доступна в веб-версии на всех платных тарифах, где есть доступ к ChatGPT Work.
Spotify опубликовал свою схему для Claude Code, которая позволяет сильно сократить расход токенов.

Суть в том, что мощная модель решает основную задачу, а часть работы передаёт более дешёвой.

Вместо того чтобы использовать самую дорогую модель вообще для всего, Spotify распределяет работу так:

1) Когда основной модели нужно изучить большой файл, его читает дешёвая модель и возвращает краткую выжимку с тем, что относится к текущей задаче. В итоге дорогая модель получает только нужную информацию вместо тысяч строк кода.
2) Когда нужно сгенерировать повторяющийся код, дешёвая модель получает описание задачи и пример файла. Она пишет код и сразу сохраняет его в проект, не возвращая весь сгенерированный текст основной модели.
3) Основная модель при этом продолжает разбираться в проблеме и решать, что именно нужно изменить. Если ей требуется отредактировать код, она может прочитать конкретный участок файла и внести изменения.

Изначально правила делегирования прописали в CLAUDE.md, но модель соблюдала их не всегда.

Поэтому Spotify добавил хук: код, который перехватывает действие ещё до его выполнения. Если основная модель пытается целиком прочитать файл длиннее 350 строк, чтение блокируется, а модели предлагается передать эту работу другой модели.

В тестах на чтении больших файлов Claude расходовал примерно на 90% меньше токенов.

Хороший пример того, почему обвязка вокруг модели имеет огромное значение.
DeepSeek объявила о начале внутреннего тестирования новой модели.

Компания сообщила, что начала тестировать промежуточную версию V4.1 Flash.

DeepSeek V4.1 Flash получила новую архитектуру, встроенную мультимодальность, стала мощнее и быстрее, а стоимость работы снизилась. В одном из первых тестов скорость составила почти 400 токенов в секунду.

Для вызова через API достаточно оставить base_url без изменений и указать модель:

deepseek-v4.1-flash-expires-on-0910

Сейчас цена такая же, как у deepseek-v4-flash. Для каждого аккаунта действует ограничение в 20 одновременных запросов.
Текущая ситуация в гонке ИИ:
Media is too big
VIEW IN TELEGRAM
3
Если вам не нравится, что при работе с ИИ история, настройки и данные отправляются на чужие серверы, стоит посмотреть на Apache Maka.

https://github.com/apache/maka

Это локальная обвязка для ИИ-моделей, которая по умолчанию хранит сессии, настройки и журналы выполнения на вашем устройстве.

Можно подключить облачный API, локальную модель или совместимый шлюз.

Maka записывает весь ход работы - ответы модели, вызовы инструментов, решения по разрешениям и завершение задач.

Настольное приложение, TUI и CLI используют один Runtime Host. Если процесс упал, состояние можно восстановить из журнала.

Сам Runtime Host можно держать на своей машине или сервере и подключаться к нему удалённо.

Отдельно стоит посмотреть на архитектуру Maka. Разработчики открыли подробную документацию, где разобраны Runtime Host, хранение состояния, восстановление после сбоев, границы компонентов и удалённые подключения.

Если интересно, как вообще проектировать обвязку для агентов, там очень много полезного.

Пока проект активно развивается, поэтому формат данных, команды и экспериментальные фичи ещё могут меняться.

Есть сборки для macOS, а Windows и Linux пока доступны как превью.

Бесплатный открытый проект под лицензией Apache 2.0.
DeepSeek снижает цены. Максимальное снижение — 60%.

Согласно уведомлению об изменении тарифов, с 10 сентября, DeepSeek изменит стоимость API для серии Flash.

Цены в непиковые часы за 1 млн токенов:

Ввод при промахе кэша: $0,23 → $0,15, снижение примерно на 33%.

Вывод: $0,68 → $0,60, снижение примерно на 11%.

Ввод при попадании в кэш: $0,0075 → $0,003, снижение на 60%.

В часы пик цены по-прежнему будут вдвое выше: ввод — $0,30, вывод — $1,20, ввод при попадании в кэш — $0,006.

При этом максимальное снижение на 60% относится именно к попаданиям в кэш. Насколько уменьшится итоговый счёт за API, зависит от доли ввода, вывода и кэшированных токенов.

И отдельно про график с результатами тестов.

На DeepSWE v1.1 с настройками mini-SWE модель DeepSeek V4.1-Flash в режиме max получила Pass@1 75,1%, немного выше показанных на графике GPT-6 Astra и Claude Opus 5. Если оценивать по горизонтальной оси, средняя стоимость одной попытки выполнения задачи составляет около $0,25.

Теперь остаётся посмотреть, сможет ли модель показать такой же результат при реальной работе с кодом.

p.s: окончательные данные следует сверять с официальным релизом.
Уже и уличные ларьки с Codex появились 🚬
Please open Telegram to view this post
VIEW IN TELEGRAM
Microsoft выпустила tgrep, чтобы ИИ-агенты могли искать по коду в 50 раз быстрее.

✓ Написан на Rust и открыт исходный код
✓ Один раз индексируешь проект — дальше поиск работает почти мгновенно
✓ Есть клиент-серверный режим и отслеживание изменений файлов

Copilot CLI уже использует tgrep внутри:

https://github.com/microsoft/tgrep
3
This media is not supported in your browser
VIEW IN TELEGRAM
META анонсировал персонального агента Muse 😀

Согласно странице продукта, Muse работает внутри постоянно запущенной изолированной виртуальной машины на Linux.

У него есть собственный компьютер с файловой системой и терминалом, поэтому он может писать код и создавать инструменты, необходимые для выполнения задачи. У него также есть доступ к полноценному браузеру, поэтому он может искать информацию, переходить по сайтам, заполнять формы и выполнять транзакции, например бронировать и покупать.

По ощущениям это меньше похоже на Grok Bot или агентов ChatGPT Work и больше на простой способ войти в тему автоматизации для тех, кто уже активно пользуется экосистемой Meta.

Работает на Muse Spark 1.3 и доступен на iOS и Android, но, похоже, пока только в отдельных регионах.

До 100 млн токенов в неделю бесплатно.

https://introducing.muse.ai/
Please open Telegram to view this post
VIEW IN TELEGRAM
— OpenAI решила задачу Навье — Стокса. Математика решена!

— Нет, не решена. Ты вообще знаешь, что такое Навье — Стокс?

— Нет. А ты?

— Нет.
Anthropic выпустила статью про оптимизацию затрат Claude.

На что стоит обратить внимание:

При переходе на новую модель старые промпты тоже нужно пересматривать.

Инструкции, которые когда-то добавлялись как костыли для старых моделей, могут мешать новым. Например, требование отвечать максимально подробно приводило к тому, что модель делала десятки лишних поисков по базе знаний. А принудительное требование писать черновик рассуждений в некоторых случаях приводило к тому, что вызовы инструментов попадали в рассуждения, но фактически не выполнялись.

В одном из тестов на задачах поддержки после очистки таких инструкций средняя стоимость снизилась на 14,6%, а точность выросла на 5,3%.

Максимальный уровень рассуждений может давать совсем небольшой прирост.

На HLE у Fable 5.1 переход на последний уровень max увеличил стоимость на 46%, а результат вырос всего на 0,5%. И то, это улучшение укладывалось в пределы погрешности теста.

При этом на CursorBench 3.2 Fable 5.1 с уровнем low смогла показать результат на уровне Fable 5 с high, но при стоимости примерно в три раза ниже. Более сильной модели иногда выгоднее дать меньше времени на рассуждения, чем заставлять более слабую модель думать на максимуме.

Промах кэша может происходить просто из-за того, что вы добавили временную метку.

Для работы кэша префикс должен совпадать полностью. Постоянно меняющееся время, ID в системном промпте или даже изменение порядка описаний инструментов могут сбросить весь последующий кэш. Если выполнение инструментов в агенте занимает слишком много времени, можно также выйти за срок жизни кэша.

Anthropic уже встроила такие проверки в claude-api skill для Claude Code. Команда /claude-api prompt-audit позволяет проверить промпты, а /claude-api cost-optimize — найти места, где можно снизить расходы на API.

Так что при переходе на новую модель стоит заново проверять старые CLAUDE.md, скиллы и настройки effort. Некоторые правила действительно были полезны раньше, а сейчас могут просто тратить токены.
Please open Telegram to view this post
VIEW IN TELEGRAM
DeepSeek объявила на своей API-платформе, что:

После официального запуска V4.1 Flash все запросы, которые раньше отправлялись в V4 Pro, будут полностью перенаправляться на V4.1 Flash и тарифицироваться по цене V4.1 Flash.

По словам компании, внутренние и внешние тесты показали, что V4.1 Flash уже превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения.

То есть DeepSeek не собирается какое-то время держать Flash и Pro параллельно. Flash сразу заберёт весь трафик Pro.

Большая жирная рыба уплыла на пенсию. 🍺
Please open Telegram to view this post
VIEW IN TELEGRAM
Об этом мало кто написал, НО: Университет в Абу-Даби выпустил сразу ШЕСТЬ ИИ-моделей размером от 0,9 до 375 млрд параметров.

Они называются K2 Horizon. Обучены с нуля и полностью открыты: веса, рецепты обучения, датасеты и код.

До уровня GPT они пока не дотягивают, но модель на 7 млрд параметров набирает 70,6 на SWE-bench. Для сравнения, Qwen3.5-9B набирает 50,8.

🤖: https://huggingface.co/collections/IFM/k2-horizon
Please open Telegram to view this post
VIEW IN TELEGRAM
Голосовой режим ChatGPT теперь может использовать GPT‑5.6 Sol и GPT‑6 Astra.

Можно выбрать модель и уровень рассуждений, а голосовой режим подключит их, когда нужно выполнить поиск или решить сложную задачу.

Одновременно увеличены лимиты GPT‑Live‑1:

Plus — с 1 до 3 часов в день
Pro за $100 — с 12 до 15 часов
Pro за $200 — без ограничений
В топовых университетах начали всерьёз преподавать разработку AI-агентов.

Этой осенью Carnegie Mellon University запустил новый курс 11-768 "AI Agents", и программа близка к тому, чем прямо сейчас занимаются разработчики агентных систем.

Работа с инструментами, управление контекстом, навыки, память, планирование. Дальше идут агенты для программирования, работа с графическими интерфейсами, глубокий поиск, SFT и RL, изоляция среды и безопасность.

Задания здесь интересные.

Сначала студентам нужно собрать собственную агентную оболочку. Затем разработать систему оценки агента. После этого обучить агента с помощью RL. В конце — полноценный исследовательский проект.

По-моему, сама последовательность хорошо показывает, как в 2026 году начали смотреть на разработку агентов.

Просто научиться вызывать модель и давать ей инструменты уже недостаточно. Теперь нужно уметь построить вокруг модели рабочую систему, нормально её измерить, обучить и добиться того, чтобы она надёжно выполняла длинные задачи.

Материалы курса публикуются открыто, а лекции начали выкладывать на YouTube. 🕗

p.s: также 23 сентября в Stanford стартует новый курс CS329Z "Engineering AI Agents", материалы лекций также будут открыто публиковать на сайте по мере выхода.
Please open Telegram to view this post
VIEW IN TELEGRAM
DeepSeek V4.1 Flash официально запущен. Три режима объединили в один.

В приложении и веб-версии больше не нужно самому переключаться между "быстрым", "экспертным" режимом и работой с изображениями.

Теперь это одна нативно мультимодальная модель для обычного диалога, анализа изображений и сложных рассуждений.

Отключение V4 Pro перенесли на понедельник, 14 сентября. После этого все запросы к V4 Pro будут автоматически перенаправляться на V4.1 Flash и тарифицироваться уже по цене Flash. Так будет до выхода V4.1 Pro.

🤖: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Unity выпустила официальный плагин для ИИ-агентов.

Изначально его представили для Claude Code, но сейчас плагин также работает с Codex и Grok. Он добавляет агенту официальные навыки Unity, написанные командами самого движка.

Сейчас доступно 29 навыков для работы с интерфейсом, графикой, звуком, физикой, сценами, мультиплеером, локализацией и другими частями проекта.

В демонстрации ниже Codex работает сразу с Unity MCP и Blender MCP. Агент создаёт модели, делает риг и анимации в Blender, переносит всё в Unity, а затем пишет и запускает автотесты:
This media is not supported in your browser
VIEW IN TELEGRAM
7