Вайб-кодинг
62.4K subscribers
2.1K photos
880 videos
30 files
1.41K links
Авторский канал по ВАЙБ КОДИНГУ

Ссылка для друзей: https://t.me/+ll3pbl442dNkZmYy

Cотрудничество: @devmangx

РКН: https://clck.ru/3RRVfk
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
META анонсировал персонального агента Muse 😀

Согласно странице продукта, Muse работает внутри постоянно запущенной изолированной виртуальной машины на Linux.

У него есть собственный компьютер с файловой системой и терминалом, поэтому он может писать код и создавать инструменты, необходимые для выполнения задачи. У него также есть доступ к полноценному браузеру, поэтому он может искать информацию, переходить по сайтам, заполнять формы и выполнять транзакции, например бронировать и покупать.

По ощущениям это меньше похоже на Grok Bot или агентов ChatGPT Work и больше на простой способ войти в тему автоматизации для тех, кто уже активно пользуется экосистемой Meta.

Работает на Muse Spark 1.3 и доступен на iOS и Android, но, похоже, пока только в отдельных регионах.

До 100 млн токенов в неделю бесплатно.

https://introducing.muse.ai/
Please open Telegram to view this post
VIEW IN TELEGRAM
— OpenAI решила задачу Навье — Стокса. Математика решена!

— Нет, не решена. Ты вообще знаешь, что такое Навье — Стокс?

— Нет. А ты?

— Нет.
Anthropic выпустила статью про оптимизацию затрат Claude.

На что стоит обратить внимание:

При переходе на новую модель старые промпты тоже нужно пересматривать.

Инструкции, которые когда-то добавлялись как костыли для старых моделей, могут мешать новым. Например, требование отвечать максимально подробно приводило к тому, что модель делала десятки лишних поисков по базе знаний. А принудительное требование писать черновик рассуждений в некоторых случаях приводило к тому, что вызовы инструментов попадали в рассуждения, но фактически не выполнялись.

В одном из тестов на задачах поддержки после очистки таких инструкций средняя стоимость снизилась на 14,6%, а точность выросла на 5,3%.

Максимальный уровень рассуждений может давать совсем небольшой прирост.

На HLE у Fable 5.1 переход на последний уровень max увеличил стоимость на 46%, а результат вырос всего на 0,5%. И то, это улучшение укладывалось в пределы погрешности теста.

При этом на CursorBench 3.2 Fable 5.1 с уровнем low смогла показать результат на уровне Fable 5 с high, но при стоимости примерно в три раза ниже. Более сильной модели иногда выгоднее дать меньше времени на рассуждения, чем заставлять более слабую модель думать на максимуме.

Промах кэша может происходить просто из-за того, что вы добавили временную метку.

Для работы кэша префикс должен совпадать полностью. Постоянно меняющееся время, ID в системном промпте или даже изменение порядка описаний инструментов могут сбросить весь последующий кэш. Если выполнение инструментов в агенте занимает слишком много времени, можно также выйти за срок жизни кэша.

Anthropic уже встроила такие проверки в claude-api skill для Claude Code. Команда /claude-api prompt-audit позволяет проверить промпты, а /claude-api cost-optimize — найти места, где можно снизить расходы на API.

Так что при переходе на новую модель стоит заново проверять старые CLAUDE.md, скиллы и настройки effort. Некоторые правила действительно были полезны раньше, а сейчас могут просто тратить токены.
Please open Telegram to view this post
VIEW IN TELEGRAM
DeepSeek объявила на своей API-платформе, что:

После официального запуска V4.1 Flash все запросы, которые раньше отправлялись в V4 Pro, будут полностью перенаправляться на V4.1 Flash и тарифицироваться по цене V4.1 Flash.

По словам компании, внутренние и внешние тесты показали, что V4.1 Flash уже превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения.

То есть DeepSeek не собирается какое-то время держать Flash и Pro параллельно. Flash сразу заберёт весь трафик Pro.

Большая жирная рыба уплыла на пенсию. 🍺
Please open Telegram to view this post
VIEW IN TELEGRAM
Об этом мало кто написал, НО: Университет в Абу-Даби выпустил сразу ШЕСТЬ ИИ-моделей размером от 0,9 до 375 млрд параметров.

Они называются K2 Horizon. Обучены с нуля и полностью открыты: веса, рецепты обучения, датасеты и код.

До уровня GPT они пока не дотягивают, но модель на 7 млрд параметров набирает 70,6 на SWE-bench. Для сравнения, Qwen3.5-9B набирает 50,8.

🤖: https://huggingface.co/collections/IFM/k2-horizon
Please open Telegram to view this post
VIEW IN TELEGRAM
Голосовой режим ChatGPT теперь может использовать GPT‑5.6 Sol и GPT‑6 Astra.

Можно выбрать модель и уровень рассуждений, а голосовой режим подключит их, когда нужно выполнить поиск или решить сложную задачу.

Одновременно увеличены лимиты GPT‑Live‑1:

Plus — с 1 до 3 часов в день
Pro за $100 — с 12 до 15 часов
Pro за $200 — без ограничений
В топовых университетах начали всерьёз преподавать разработку AI-агентов.

Этой осенью Carnegie Mellon University запустил новый курс 11-768 "AI Agents", и программа близка к тому, чем прямо сейчас занимаются разработчики агентных систем.

Работа с инструментами, управление контекстом, навыки, память, планирование. Дальше идут агенты для программирования, работа с графическими интерфейсами, глубокий поиск, SFT и RL, изоляция среды и безопасность.

Задания здесь интересные.

Сначала студентам нужно собрать собственную агентную оболочку. Затем разработать систему оценки агента. После этого обучить агента с помощью RL. В конце — полноценный исследовательский проект.

По-моему, сама последовательность хорошо показывает, как в 2026 году начали смотреть на разработку агентов.

Просто научиться вызывать модель и давать ей инструменты уже недостаточно. Теперь нужно уметь построить вокруг модели рабочую систему, нормально её измерить, обучить и добиться того, чтобы она надёжно выполняла длинные задачи.

Материалы курса публикуются открыто, а лекции начали выкладывать на YouTube. 🕗

p.s: также 23 сентября в Stanford стартует новый курс CS329Z "Engineering AI Agents", материалы лекций также будут открыто публиковать на сайте по мере выхода.
Please open Telegram to view this post
VIEW IN TELEGRAM
DeepSeek V4.1 Flash официально запущен. Три режима объединили в один.

В приложении и веб-версии больше не нужно самому переключаться между "быстрым", "экспертным" режимом и работой с изображениями.

Теперь это одна нативно мультимодальная модель для обычного диалога, анализа изображений и сложных рассуждений.

Отключение V4 Pro перенесли на понедельник, 14 сентября. После этого все запросы к V4 Pro будут автоматически перенаправляться на V4.1 Flash и тарифицироваться уже по цене Flash. Так будет до выхода V4.1 Pro.

🤖: https://huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Unity выпустила официальный плагин для ИИ-агентов.

Изначально его представили для Claude Code, но сейчас плагин также работает с Codex и Grok. Он добавляет агенту официальные навыки Unity, написанные командами самого движка.

Сейчас доступно 29 навыков для работы с интерфейсом, графикой, звуком, физикой, сценами, мультиплеером, локализацией и другими частями проекта.

В демонстрации ниже Codex работает сразу с Unity MCP и Blender MCP. Агент создаёт модели, делает риг и анимации в Blender, переносит всё в Unity, а затем пишет и запускает автотесты:
This media is not supported in your browser
VIEW IN TELEGRAM
7
Гений использовал Fable 5.1, чтобы превратить свой Kindle в Linux-терминал и работать по ночам без синего света.
This media is not supported in your browser
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM