AI for Devs
15K subscribers
301 photos
104 videos
280 links
По сотрудничеству пишите в личные сообщения канала.

Канал для разработчиков про AI. Модели, ИИ-агенты, практические кейсы и новости из мира AI. Всё, что можно применить в работе.

Технологический партнер: veai.ru
Download Telegram
⚡️ Z.ai выпустили крупное обновление ZCode

Альтернатива Claude Code и Codex от создателей GLM-5.2 уже доступна для всех OS.

Их собственный ZCode Agent заточен под GLM-5.2, но через BYOK можно подключить свои подписки OpenAI, Anthropic и других провайдеров.

Новым пользователям дают 5 дней бесплатного доступа с повышенным дневным лимитом: хороший повод протестировать китайский флагман.


Подписчикам GLM Coding Plan квота в ZCode в 1.5 раза выше обычной.

P.S. GLM в ZCode доступна из России без VPN.

@ai_for_devs
1🔥66👍26155🤩2
⚡️ Fable 5 снова в строю: модель уже доступна в Veai

По бенчмаркам отрыв безоговорочный: Fable 5 обходит и Opus 4.8, и GPT-5.5 почти во всём, от кода и работы с компьютером до юридических задач и медицины. На SWE-Bench Pro, например, у неё 80.3% против 69.2% у Opus 4.8, а в кибербезопасности разрыв с Opus почти вдвое.

⚠️ Модель дорогая и "думает" много, поэтому токены на ней сгорают сильно быстрее обычного. Будьте бдительны!


Всем новым пользователям Veai даём 30 дней бесплатного триала. Поделитесь этой инфой с друзьями, они будут благодарны)

https://veai.ru/products

Если Fable 5 покажется слишком прожорливой и долгодумающей, в Veai есть ещё больше десятка моделей: Sonnet 5, Opus 4.8, GPT-5.5, Gemini, GLM, DeepSeek, Kimi. Переключиться можно в любой момент.

@veai_devs
1👌25👍168🔥1
⚡️ Слепые зоны в промптинге: полный гайд по Fable 5

Инженеры из Anthropic порадовали новой статьёй о работе с Fable 5. Главных выводов из этого материала два.

Первый, про важность промпта.

Даже с такими моделями, как Fable 5, результат упирается не в возможности модели, а в то, насколько чётко вы умеете сформулировать, чего хотите. Если пережмёте с конкретикой, то модель послушно идёт по инструкции даже там, где стоило бы свернуть в сторону. Чуть недожмёте, и модель добирает недостающее из усреднённых практик индустрии, которые не всегда подходят именно вам.

Второй, про собственное эго.

Призвайтесь честно, чего вы не знаете. Если задача выходит за рамки вашей экспертизы, быть самым глупым в комнате (даже с бездушными LLM) – нормально.

И в первом и во втором случаях, помогает деление задачи на четыре типа неизвестных:

1. Известное известное: то, что реально прописано в промпте
2. Известное неизвестное: то, что вы осознаёте, что ещё не выяснили
3. Неизвестное известное: то, что очевидно, но вы никогда бы это не записали
4. Неизвестное неизвестное: то, о чём вы вообще не задумывались


Примеры поиска всех типов неизветных в формате Claude Artifacts тут.

📚 Читайте и комментируйте на Хабр: https://habr.com/ru/articles/1055458

@ai_for_devs
Please open Telegram to view this post
VIEW IN TELEGRAM
1🔥35👏1915👍12💯1
🪨 JetBrains протестировали скилл Caveman: обещанные 65% экономии токенов превратились в 8.5%

Caveman — скилл для агентов вроде Claude Code, который переводит текстовые ответы в рубленый «пещерный» стиль без служебных слов. Код и вызовы инструментов не трогает. Целых 85к звёзд на GitHub!

Тест прогнали на бенчмарке SkillsBench, 86 из 87 задач, Claude Sonnet 5 с низким reasoning effort. Сравнивали одни и те же задачи без скилла и с принудительно включённым.

Результат по 82 парным задачам:

1. Экономия output-токенов: 8.5% (592k против 542k), далеко от обещанных 65%. Авторы считали экономию на чатовой прозе, а в агентной работе основную массу токенов занимают код, диффы и тексты ошибок, которые скилл не сжимает.

2. Качество не пострадало: средний скор 0.326 против 0.311, статистически неразличимо (p = 0.82).

3. Экономия $ отсутствует. По логике 8.5% экономии токенов должны были дать скидку около 10% по деньгам. Но один вырожденный случай всё нивелировал: одна задача перешла порог в 200k токенов контекста и попала под дорогой тариф API, её цена выросла с $0.33 до $8.29. Из-за этого прогон со скиллом вышел на 11.6% дороже ($40.60 против $36.39).

Со скиллом или без, результат по сути один и тот же, что по деньгам, что по качеству. Разве что читать ответы веселее)

@ai_for_devs
1🗿64👍4012🤩5💯3🔥1
⚡️ Лайфхак: контролируем лимиты Claude

Скользящее 5-часовое окно может застать врасплох: оно стартует только с вашего первого сообщения.

Чтобы всегда точно знать, когда начнётся 5-часовая сессия и когда обнулится, создайте простейшую routine (ping-pong) на запуск по расписанию. Например, каждый день в 0, 5, 10, 15 и 20 часов (cron 0 0,5,10,15,20 * * *). Тогда окно стартует в фиксированное время, а не когда придётся.

Время можно подогнать под сброс почти вплотную к своим пиковым часам (их, кстати, можно спросить у самого Claude).


В итоге садитесь за комп, сжигаете первую сессию за час и сразу катите следующую — предыдущая стартанула задолго до того, как вы подошли к компу. Profit!

@ai_for_devs
2🔥88👍42👏9🤯76💯2
Anthropic продлили доступ к Fable на всех платных тарифах до 12 июля!

Казнить нельзя помиловать

@ai_for_devs
1🔥80😁2015👍10
⚡️ Российская LLM Koda Pro почти сравнялась с Claude Sonnet и Opus

KodaCode выпустили версию 1.0 своего плагина для VS Code. Вместе с релизом агента обновили и флагманскую LLM.

На SWE-bench Verified новая Koda Pro на основе GLM 5.2 набрала 77.4% (у Claude Sonnet 5 на этом же бенче 78.8%, у Claude Opus 4.8 результат 83%).

В агента для VS Code, JetBrains и CLI добавили маркетплейс MCP и скиллов, просмотр diff прямо в чате и починили зависания на длинных сессиях.

Telegram-интеграция раньше работала только в VS Code, теперь доступна в JetBrains и CLI.


Также выкатили подключение российских провайдеров моделей без VPN.

@ai_for_devs
1👍103🤯58🔥23175
⚡️ Cursor выпустили Grok 4.5: флагман уровня Opus, обучали вместе со SpaceXAI

«Opus-класс, но быстрее, экономнее по токенам и дешевле» — так Маск описал модель в X.

Уже доступна в Grok Build, в Cursor на всех тарифах.

На первую неделю дают двойные лимиты и уточняют: у Grok 4.5 и Composer разные весовые категории.

Composer 2.5 остаётся в строю, новые модели этого размера продолжат выходить отдельно.


Цена: $2/$6 за млн токенов (input/output). Для сравнения, у Opus 4.8 — $5/$25.

@ai_for_devs
1🔥66🤯12👍1075
⚡️ Через 5 минут смотрим релиз GPT-5.6 Sol

Sol — флагманская модель нового поколения от OpenAI, по слухам последняя в серии 5.x. Дальше компания переходит на нейминг 6+.

Модель почти месяц была в закрытом превью для избранных партнёров по запросу властей США, сегодня открывают публичный доступ.

Стрим здесь: https://youtu.be/Wq45rvPGNHs

@ai_for_devs
1👍33🤩14🔥1263
⚡️ Линейку моделей GPT-5.6 раскатили на всех

Модель уже доступна всем пользователям Codex, её добавили в Cursor, JetBrains Air и в десяток других самых популярных агентов.

На части бенчмарков Sol обходит Fable 5, в том числе в кодинге. Главный акцент OpenAI делают на цене и скорости: тех же результатов Sol добивается вдвое быстрее и примерно на треть дешевле.

Цена за 1М токенов: Sol $5/$30, Terra $2.50/$15, Luna $1/$6.

Также OpenAI выпустили аналог Artifacts у Claude Code — назвали ChatGPT Sites, собирать сайты и мини-приложения прямо в Codex.

И раскатали ChatGPT Work — по сути слияние ChatGPT и Codex в одном приложении, уже можно скачать на macOS, версии для Windows как обычно обещают позже.


А для тех, кто сидит на Claude, а не на Codex — Anthropic прямо сейчас сбросили недельные лимиты, чтобы никто никуда не переметнулся 😄 В общем, сегодня в плюсе все!

@ai_for_devs
1🔥95👍221412🤯4
⚡️ Поменять модель или повысить effort?

Когда агент не справляется с задачей, первое естественное желание — поменять модель. Причём работает это в обе стороны: то суперумная модель странно тупит на казалось бы лёгкой задаче, то маленькая вообще не отдупляет, что происходит в сложной.

Но модель это не единственная ручка, которую можно покрутить. Может, лучше повысить/понизить effort?

Выбор модели определяет то, что агент знает по умолчанию. Веса любой модели были зафиксированы в процессе обучения, благодаря чему она знает о паттернах, фреймворках, подводных камнях и так далее. Размер модели определяет, насколько много и насколько хорошо она разбирается в различных областях. Если проводить весёлые аналогии, то Fable — Principal Engineer, Opus — Senior, Sonnet — Middle, а Haiku лучше не подпускать к коду.

Effort же определяет, насколько каждый из них будет стараться над решением конкретной задачи. Сколько файлов прочитать, сколько раз перепроверить себя, насколько уверенным быть перед ответом. На одном и том же промпте одна и та же модель с высоким effort может сгенерировать в 7 раз больше токенов, чем с низким.

Отсюда принцип работы с крутилками:

1. Если ошибка от нехватки знаний (тонкий баг, незнакомая область, архитектурное решение, модель уверенно врёт при любом количестве контекста) — берите модель крупнее.
2. Если ошибка от нехватки старания (агент пропустил файл, не прогнал тесты, не перепроверил себя) — поднимайте effort.

Подробнее про механику выбора, влияние на расход токенов и качество результата, читайте в новой статье на Хабре.

@ai_for_devs
161👍34🔥14👏2
⚡️ GitHub перестал работать в России

Не работает Git, сам сайт не открывается, а также невозможно получить доступ к репозиториям.

На глобальный сбой GitHub не похоже, во всех остальных странах сервис функционирует нормально.

UPD: Github, Google и другие сайты снова доступны в России.

@ai_for_devs
1🤯80😱291510🔥8👍7👏4🤩4
😎 Методология работы с ИИ-агентом | Модуль №3

15 июля пройдет третий, финальный вебинар курса Veai «AI-инструменты для разработчиков 2026». Первые два были про выбор инструментов и настройку агента.

Без выстроенного процесса на сложном проекте агент решает не ту задачу и оставляет баги даже под зелёными тестами. Результат через неделю сложно повторить и передать команде.


В прямо эфире Михаил Костицын (Lead Developer) разберет:
— методологию разработки с ИИ-агентами
— подходы к постановке задачи
— обратную связь (feedback loops)
— параллельную работу и субагентов

15 июля (завтра) 🟡 19:00 МСК 🟡 Онлайн

Вебинар бесплатный, главное зарегистрироваться: https://veai.ru/events/agent-methodology/join
Please open Telegram to view this post
VIEW IN TELEGRAM
116👍15🔥9🤩5
⚡️ OpenAI даёт $100 в кредитах Codex за твит

Пишете свой твит о том, что нравится в GPT-5.6 Sol или почему перешли на неё, отправляете ссылку и почту от аккаунта через форму.

За 24 часа заявку подтверждают и присылают ваучер со $100 на почту.

Условие: активная подписка Go, Plus или Pro, на неё и начислят кредиты. $ получат первые 10 000 участников.


switch-to-codex.openai.chatgpt.site

👍 Норм маркетинг
👎 Зашкварно

@ai_for_devs
1👎138👍124🔥86🤩41👏1
⚡️ xAI выложили исходный код Grok Build в open source

Лицензия Apache 2.0, но контрибьютить, заводить тикеты и открывать PR нельзя. Опубликовали исходники из-за скандала с сохранением кода пользователей на серверах xAI.

С 12 июля эту "фичу" отключили по умолчанию для всех, накопленные данные удалили.

Также в качестве бонуса сбросили лимиты всем пользователям.


https://github.com/xai-org/grok-build/tree/main

Прикольно, что часть инструментов Grok Build это адаптированный код из исходников Сodex и OpenCode.

@ai_for_devs
1🔥37👍12107👏1
⚡️ Kimi K3: опенсорс-модель на 2.8 трлн параметров обходит Opus 4.8

Moonshot AI выпустили Kimi K3 — самую крупную открытую модель на сегодня. 2.8 трлн параметров!

Вдвое больше, чем у DeepSeek V4 Pro, и втрое больше, чем у Xiaomi MiMo V2.5 Pro.

Поддерживает контекст в 1 млн токенов, а также нативную работу с изображениями и видео.

По бенчмаркам K3 обходит Claude Opus 4.8. В Frontend Code Arena (независимый рейтинг по голосам пользователей) K3 занял 1-е место, обойдя Fable 5, и это скачок на 17 позиций за одно поколение: предыдущая K2.6 была лишь на 18-й строчке.

Fable 5 и GPT-5.6 Sol по сумме собственных бенчмарков Moonshot K3 всё же уступает. Сами разработчики признают отставание только от этих двух моделей. Разрыв на большинстве тестов от 2 до 5 пунктов.


Стоимость за 1М токенов: $3/$15 ввод/вывод.

Модель уже доступна на kimi.com, в Kimi Code и через API. Полные веса опубликуют 27 июля.

@ai_for_devs
4👍66🔥38🤯2055🤩1
AI for Devs
⚡️ Kimi K3: опенсорс-модель на 2.8 трлн параметров обходит Opus 4.8 Moonshot AI выпустили Kimi K3 — самую крупную открытую модель на сегодня. 2.8 трлн параметров! Вдвое больше, чем у DeepSeek V4 Pro, и втрое больше, чем у Xiaomi MiMo V2.5 Pro. Поддерживает…
Kimi K3 от Moonshot AI доступна в Router AI без VPN и иностранной карты

Цены:
– 305 ₽/1М input, 1527 ₽/1М output
– Кэш: 30 ₽/1М токенов

Контекст 1М токенов, есть поддержка изображений. Модель: moonshotai/kimi-k3

Настройка для Claude Code — routerai.ru/pages/vibe-coding-claude-code
Настройка для OpenCode — routerai.ru/pages/vibe-coding-opencode
Cursor, JetBrains, Cline, и другие — routerai.ru/vibe-coding#where-to-start
3👍3511🔥8👌5🤩3
⚡️ Fable 5 уберут из подписки за $20

Начиная с 20 июля в планах Pro и Team Standard Fable 5 больше не будет входить в подписку, доступ только через usage credits.

На тарифах Max и Team Premium с 20 июля Fable 5 будет включён по умолчанию с лимитом 50% от стандартного.

Пользователям Pro Anthropic обещают компенсировать утрату разовым пополнением usage credits на $100.

@ai_for_devs
1🤯43😢33🔥15👏7🤩622💯2
⚡️ В Claude Cowork завезли запись Skills

Теперь можно включить запись экрана, выполнить задачу и по ходу объяснить, что делаешь.

Cowork запишет экран, клики, клавиатуру и голос, а потом соберёт из этого Skill.

Можно показать, как собирать отчёты, разбирать документы и выполнять другую рабочую рутину, не связанную с написанием кода.


Удивительно, но в Codex это дело завезли раньше, больше месяца назад (видео).

@ai_for_devs
1🔥68👍2717👏4🤩1