AI Dev Broadcast
2.39K subscribers
161 photos
12 videos
142 links
Всё про разработку с использованием AI технологий

Наш канал про Android - @android_broadcast
Видео как работать с AI - abdev.by/broadcast_ai_plus
Download Telegram
GLM 5.3 стремительно покоряет бенчмарки. По результатам DeepSWE на одном уровне с KIMI K3 и Fable 5 (его обгоняет Opus 5)

#GLM #AI
👍12👎2
Vercel представил Agent Plugins 1.0.0 — открытый стандарт для плагинов, расширяющих AI-агентов

Те, кто делал плагины для ИИ-кодинг-агентов, знают про неудобство с поддержкой плагинов для всех инструментов. Теперь должно стать легче! Agent Plugins — это общий, вендор-нейтральный стандарт упаковки Agent Skills (инструкции и ресурсы) и MCP-серверов (инструменты и сервисы) в единый дистрибутив.

Как это работает?
Плагин — это директория с манифестом plugin.json и фиксированной структурой:
my-plugin/
├── plugin.json
├── skills/
│ └── summarize/
│ ├── SKILL.md
│ ├── scripts/
│ └── references/
├── mcp.json
└── com.example.client/

Клиенты проверяют plugin.json, находят Skills в skills/, а конфигурацию MCP — в mcp.json. Компоненты валидируются независимо — ошибка в одном не ломает другие.

Ключевые особенности:
📦 Один пакет для всех клиентов — больше не нужно переупаковывать компонент под каждый формат.
🎯 Small on purpose — стандарт определяет только контракт обнаружения и загрузки, оставляя клиентам свободу в UX, политиках и инновациях.
🔧 Гибкость для клиентов — через механизм неймспейсов можно добавлять клиент-специфичные расширения без загрязнения общего формата.
🏢 Открытый мультивендорный проект — инициатива Vercel, доработанная совместно с AWS, Anysphere (Cursor), GitHub, Microsoft и OpenAI. Технический комитет состоит из AWS, Cursor, Microsoft, OpenAI и Vercel.

Где уже поддерживается:
- ChatGPT и Codex
- Cursor
- GitHub Copilot
- Kiro
- VS Code

Плагины, упакованные по этому стандарту, автоматически работают во всех перечисленных клиентах.
Для авторов расширений (подключение) — документация и схемы JSON на agent-plugins.org.
Для разработчиков AI-агентов (интеграция формата) — чеклист соответствия в репозитории спецификации.

#AI
👍13👎7
⚡️ AI Flash Day: вышли GLM 5.3 Flash и Qwen 3.8 Flash Next

Сегодня китайцы одновременно выкатили две модели с «Flash» в названии. И обе — не просто «дешёвые», а реально рабочие для кодинга и агентов.

Qwen3.8-Flash-Next
Это превью архитектуры будущей Qwen 4 (отсюда и Next в названии).
Контекст 262K, расширяется до миллиона. По SWE-bench Pro обходит Claude Opus 4.6 Max (62.5 против 53.4). Обучение обошлось в 9 раз дешевле предыдущего флагмана. Веса открыты, API $0.16/$0.47.

GLM-5.3-Flash
MIT лицензия, нативно мультимодальная, 1 миллион токенов контекста.
До релиза её гоняли как ox-alpha. Она сразу стала самой популярной моделью недели. И всё это крутилось на китайских чипах (это отдельно отметили при выпуске модели). В тесте DeepSWE 63.4 (у Claude Opus 4.8 — 58).

Обе модели уже можно брать и использовать.

Пока OpenAI и Anthropic выпускают очередной frontier за космические деньги, здесь просто кладут на Hugging Face то, что работает и стоит нормальных денег. Что тут добавить... Надо тестировать на реальных задачах

#AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍22👎2
🧠 Claude Code увеличивает лимиты во всех планах личной подписки на 25% с сентября. До этой даты повышение будет 50%.

🔗 Источник - оф X Claude Code

Anthropic понимает что происходит и пытается исправить ситуацию. Все мои знакомые говорят как без замеров стало ощущаться меньшее кол-во работы после перехода на Sonnet 5 и Opus 5. Даже x1.5 лимита было мало, но а x1.25 малое утешение.

#ClaudeCode #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👎10👍4
🧠 OpenAI отключает модели в Cursor после покупки SpaceX

OpenAI уведомила SpaceX, что сворачивает контракт на поставку своих моделей в Cursor. Предложенная дата отключения — 12 ноября 2026. Это крайний срок по изменению условий в договоре.

Причина официально не «конкуренция», а доверие. OpenAI пишет, что не уверена в том, что SpaceX будет соблюдать условия использования. Оно то по факту, история с X после покупки Маском и признание под присягой, что xAI нарушала правила OpenAI. Будущую модель Astra в Cursor тоже не дадут.

По словам CEO Cursor, модели OpenAI — это около 5% трафика пользователей. Свой API-ключ по-прежнему можно подключить. Anthropic уже заявила, что нарастит compute под Claude внутри Cursor.

Для тех кто использовал модели OpenAI явно в Cursor - это потеря, но в целом выбор альтернатив был большой, да и Compose с Grok уже на хорошем уровне решают задачи. Так что на режиме работы "Авто" не повлияет в качестве работы.

🔗 Источник: Reuters · пост OpenAI

#AI #Cursor #OpenAI #SpaceX
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3👎3
Ваши модели тратят более 80% средств на чтение и запись в кэш, тогда как реального нового контента они производят очень мало. Это не обман, а реальное устройство работы с LLM. Каждый ваш запрос в сессии отправляет всю историю переписки.

Это нужно просто принять и оптимизировать: плагины Caveman, context mode, RKT и другие подобные инструменты, которые влияют на размер выдачи.

🔗 Источник исследования

#AI
👎9👍5
⭐️ Вышла Gemini 3.8 Flash и дает жару Claude моделям. По цене/качество в стандартных бенчах выдало хорошие результаты.

На самом деле становится очень интересно как легкие модели (та же GLM 5.3 Flash и Qwen3.8 Flash) показывают нетоповые но высокие результаты и для кодинга в руках профессионала уже могут много закрыть. Эпоха дорогих моделей будет отходить на второй план, так как никто не готов переплачивать и цена будет важным драйвером спроса!

#AI #Gemini
Please open Telegram to view this post
VIEW IN TELEGRAM
👍11👎5
Халява Deep Seek V4 закончилась - цены подняли еще 14 августа от 1.5 до 5 раз 🤯 Цены на железо растут, периоды привлечения через низкую цену не могут длиться долго. Когда сделали качественный продукт - пора приводить цены в реальность!

#AI #DeepSeek
👎8👍6
🧠 Вышел GPT 6 от OpenAI. Король пал, да здравствует новый король бенчей, конечно же по замерам OpenAI. Ждем честных результатов!

#OpenAI #GPT
Please open Telegram to view this post
VIEW IN TELEGRAM
👍22👎4
Forwarded from Кирилл Розов
🧠 Amodei призывает замедлить рост возможностей моделей, пока безопасность не будет иметь аналогичный темп, а сейчас и вовсе догонять

CEO Anthropic сегодня выложил эссе We Must Pace the Frontier. Ключевой тезис — перестать наращивать силу моделей быстрее, чем успевают за контролем поведения моделей и пониманием их внутренностей.

За последние месяцы уже были два опасных звоночка:
1. С лета модели ускорились ещё и тем, что сами помогают собирать следующее поколение.
2. Инцидент OpenAI и Hugging Face: рой агентов сам полез в кибератаки на цели вне задания, жертвовал собой ради группы и пытался взломать систему оценки. Никто не пострадал. Amodei пишет: при той же кривизне целей, но большей силе, через 6–12 месяцев такой рой мог бы удержать сеть ботов на весь интернет.

Практический шаг, который Anthropic делает сам: сторонние аудиторы внутри компании. Команда вроде METR получает почти тот же доступ, что сотрудники Anthropic. Они могут публиковать открыто находки без правки текста Anthropic (за исключением коммерческой тайны и перс данных).

Также эссе описывает, что делать с китайскими компаниями, предлагает варианты использования времени от замедления и другие идеи из его видения.

Идея правильная, но никто не будет останавливать эту гонку, кроме правительства, а там уже на решение влияет политика и нельзя дать Китаю захватить первенство. Не думаю, что кто-то остановится, пока не будет уже поздно, так как в этой гонке все хотят победить, и это уже вопрос контроля будущего и оправдания финансовых и других обязательств, которые взяли на себя лидеры. Чем-то вся эта ситуация напоминает мне ядерное сдерживание, но в AI моделях постоянно надо делать более мощную и эффективную бомбу, параллельно сдерживая конкурентов из других стран.

Вдруг GigaChat рванет, пока никто не верит в Россию в сфере AI? Только время покажет, как будет, но наблюдать точно интересно.

💬 Стоит ли ограничить уровень развития AI и сфокусировать на безопасности, контроле и цене/качество моделей? Делитесь в комментариях

#AI #Anthropic #ClaudeCode
Please open Telegram to view this post
VIEW IN TELEGRAM
👎9
🤖 Сначала требования, потом код. Как это работает с AI на реальном проекте?

Идея Spec-Driven Development (SDD) простая: сначала фиксируем, что должно получиться, затем агент пишет код по спецификации.

Но сколько времени уйдёт на подготовку? И не придётся ли потом исправлять и код, и документы? 🙂

🔍 В блоге RuStore разбирают Spec Kit и OpenSpec на задачах реального Android-проекта. Интересный повод посмотреть, как SDD вписывается в повседневную разработку.

https://www.rustore.ru/developer/blog/spec-kit-i-openspec-v-realnom-android-proekte-testiruem-sdd-na-zadachah-rustore

Disclaimer Это не рекламный пост) Статья основана на реальном сравнении работы spec-фреймворков на задачах нашего Android-приложения. И получились интересные, которые спешим с вами поделится 😉
👎18👍10
AGENTS.md теперь поддерживается в Claude Code 🤯 Дарио уже не тот

#ClaudeCode
👍27
🤯 Вышла Grok 4.7

Модель прокачали во всем по сравнению с Grok 4.6 и соперничает с Fable 5.1 и GPT-5.6 Sol (GPT 6 далеко впереди всех). Цена по API доступу не менялась

Уже доступна в Grok, Grok Build и Cursor!

#SpaceXAI #Grok #Cursor
1👍11
⚡️⚡️AI-агент съел токены и потерял контекст. Что делать? Разберемся на Mobius 2026 Autumn.

Когда AI становится частью рабочего процесса, появляются вполне инженерные вопросы: сколько токенов уходит на задачу, где агент теряет контекст, оправдан ли MCP, как поделиться рабочими практиками внутри команды и где автоматизация начинает создавать больше проблем, чем решает.

Этим вопросам посвятят отдельный блок на Mobius 2026 Autumn — конференции по мобильной разработке. Восемь докладов, где AI-разработку рассмотрят с разных сторон: от оптимизации агентов и оркестрации до юридических ограничений и локальных моделей.

Подробности — в карточках и на сайте.

Конференция пройдет 21–22 октября в Санкт-Петербурге + онлайн. 

🔥С промокодом aidevbroadcast персональные билеты дешевле

Купить билет

Реклама. ООО «Джуг Ру Груп». ИНН 7801341446
👎7👍5❤2
❤️ Яндекс открыл претрейн, который учили с нуля - AliceAI-Foundation-80B-A3B-Base

Сразу стоит сказать - это не конкурент ChatGPT или Claude. Base-модель: MoE 80B параметров, на токен активны 3B, контекст до 262k, лицензия Apache 2.0. Веса на Hugging Face, разбор пайплайна и замеров в техрепорте на Хабре.

Предыдущая модель Яндекса Alice AI LLM 235B была сделана на основе весов Qwen3-235B. Здесь чужих весов нет, да и архитектура своя. Для российского стека это уже не «докрутили чужой чекпойнт и назвали своим».

По коду цифры Яндекса среди open моделей выглядят нормально, но и это лишь первый релиз и важно как будут дальше развиваться модели компаний. Как минимум они дали новый фундамент, который можно дальше дообучать для разных целей.

#AI #LLM #Yandex
Please open Telegram to view this post
VIEW IN TELEGRAM
👍20🎉3
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5
https://youtu.be/32zpk7tqs0M

Запись доклада уже доступна на ютубе!

Напомню, что я сравнил Kent и Codex по куче параметров на одной и той же задаче в Респавне, моем KMP-приложении, а также рассказываю про проблемные зоны в сфере, почему агенты не слушаются инструкций, как работает внимание у моделей, как делать хорошие агентные графы на примере.
👍9🔥1👏1