⚡️ В Claude Cowork завезли запись Skills
Теперь можно включить запись экрана, выполнить задачу и по ходу объяснить, что делаешь.
Cowork запишет экран, клики, клавиатуру и голос, а потом соберёт из этого Skill.
Удивительно, но в Codex это дело завезли раньше, больше месяца назад (видео).
@ai_for_devs
Теперь можно включить запись экрана, выполнить задачу и по ходу объяснить, что делаешь.
Cowork запишет экран, клики, клавиатуру и голос, а потом соберёт из этого Skill.
Можно показать, как собирать отчёты, разбирать документы и выполнять другую рабочую рутину, не связанную с написанием кода.
Удивительно, но в Codex это дело завезли раньше, больше месяца назад (видео).
@ai_for_devs
1🔥77👍32❤19👏5🤩2
⚡️ Google выпустили сразу три новые Gemini
1. Gemini 3.6 Flash. На DeepSWE она набрала 49% против 37% у прошлой Flash. Для сравнения: Opus 4.8 набирает 59%, GPT-5.6-sol достигла 73%.
2. Gemini 3.5 Flash-Lite. Для простых задач, где скорость в приоритете. Она выдаёт 350 токенов в секунду и стоит $0.30 за миллион входных и $2.50 за миллион выходных токенов.
3. Gemini 3.5 Flash Cyber. Специализированная версия для поиска и исправления уязвимостей. Доступ выдали только правительствам и доверенным партнёрам.
Gemini 3.5 Pro пока тестируют. Для Gemini 4 Google уже запустили самый амбициозный (по их собственным словам) процесс предобучения в своей истории.
@ai_for_devs
1. Gemini 3.6 Flash. На DeepSWE она набрала 49% против 37% у прошлой Flash. Для сравнения: Opus 4.8 набирает 59%, GPT-5.6-sol достигла 73%.
2. Gemini 3.5 Flash-Lite. Для простых задач, где скорость в приоритете. Она выдаёт 350 токенов в секунду и стоит $0.30 за миллион входных и $2.50 за миллион выходных токенов.
3. Gemini 3.5 Flash Cyber. Специализированная версия для поиска и исправления уязвимостей. Доступ выдали только правительствам и доверенным партнёрам.
Gemini 3.5 Pro пока тестируют. Для Gemini 4 Google уже запустили самый амбициозный (по их собственным словам) процесс предобучения в своей истории.
@ai_for_devs
1👍38🔥16⚡10❤10🤯9😁2
⚡️ Claude Code научился запускать и тестировать iOS-приложения
В Claude Code Desktop встроили iOS Simulator. Теперь агент может собрать приложение, установить его, запустить, прокликать нужный сценарий и проверить результат.
Фича доступна в public beta на macOS для тарифов Pro, Max и Team.
@ai_for_devs
В Claude Code Desktop встроили iOS Simulator. Теперь агент может собрать приложение, установить его, запустить, прокликать нужный сценарий и проверить результат.
Можно наблюдать за тестированием или в любой момент перехватить управление: тапать, свайпать, менять устройство, делать скриншоты и записывать экран.
У каждой сессии свой симулятор, поэтому параллельные агенты друг другу не мешают.
Фича доступна в public beta на macOS для тарифов Pro, Max и Team.
@ai_for_devs
2🔥76🤯17👍13❤10⚡3
⚡️ Появился российский аналог Claude Desktop и Codex Desktop
Koda Desktop вышла в бете для Windows, macOS и Linux.
https://download.kodacode.ru
Есть поддержка Skills, MCP и кастомных режимов работы: можно задать агенту свою роль, системный промпт и набор доступных инструментов.
P.S. Работает из России без VPN, подписку можно оплатить российской картой.
@ai_for_devs
Koda Desktop вышла в бете для Windows, macOS и Linux.
https://download.kodacode.ru
Из коробки доступны модели OpenAI, Anthropic и Google, а также китайские флагманы и российские модели Koda.
Есть поддержка Skills, MCP и кастомных режимов работы: можно задать агенту свою роль, системный промпт и набор доступных инструментов.
P.S. Работает из России без VPN, подписку можно оплатить российской картой.
@ai_for_devs
1👍72🤯36🔥25❤5👏3
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Claude Security стал доступен как плагин для Claude Code
Мы уже писали про Claude Code Security, когда инструмент находился в закрытом research preview.
Теперь Anthropic переименовали его в Claude Security и открыли всем пользователям платных тарифов Claude Code.
Установка:
Команда
В отчёт входят сценарий эксплуатации, уровень критичности, уверенность модели и рекомендации по исправлению.
@ai_for_devs
Мы уже писали про Claude Code Security, когда инструмент находился в закрытом research preview.
Теперь Anthropic переименовали его в Claude Security и открыли всем пользователям платных тарифов Claude Code.
Установка:
/plugin install claude-security@claude-plugins-official
Команда
/claude-security позволяет проанализировать весь репозиторий, отдельный компонент, изменения в ветке, pull request или конкретный коммит. В отчёт входят сценарий эксплуатации, уровень критичности, уверенность модели и рекомендации по исправлению.
@ai_for_devs
1🔥58👍25❤13⚡3👏2
Перекличка. Как вы используете ИИ в разработке? Можно выбрать несколько вариантов.
Anonymous Poll
21%
Общаюсь с ИИ в браузере, код переношу вручную
13%
Использую автодополнение кода на базе ИИ
37%
Использую ИИ-агента в IDE
52%
Запускаю ИИ-агента из терминала (CLI)
48%
Использую нативное приложение: Claude Desktop, Codex Desktop, и так далее
56%
Настраиваю агента под себя: задаю Rules, использую Skills, MCP
20%
Собираю собственные агентные или мультиагентные процессы
3%
Пока не использую ИИ в разработке
1❤33👍18🔥5🤯4
⚡️ Anthropic выпустили Claude Opus 5: почти Fable 5 за половину цены
На SWE-bench Pro результат вырос с 69,2% до 79,2% и практически сравнялся с Fable 5 (80%).
Быстрый режим работает примерно в 2,5 раза быстрее, но и стоит вдвое дороже.
На DeepSWE модель всё ещё уступает GPT-5.6 Sol: 68,8% против 72,7%.
@ai_for_devs
На SWE-bench Pro результат вырос с 69,2% до 79,2% и практически сравнялся с Fable 5 (80%).
Цена осталась как у Opus 4.8: $5 за миллион входных и $25 за миллион выходных токенов. Это вдвое дешевле Fable 5.
Быстрый режим работает примерно в 2,5 раза быстрее, но и стоит вдвое дороже.
На DeepSWE модель всё ещё уступает GPT-5.6 Sol: 68,8% против 72,7%.
@ai_for_devs
1🔥66👍28❤10⚡5🤩3
⚡️ Как Anthropic советуют работать с новым поколением Claude
У Anthropic уже вышли Fable 5, Sonnet 5 и Opus 5. Про Haiku, как всегда, забыли)
Вместе с моделями изменились и рекомендации по работе с ними. Команда Claude Code удалила больше 80% системного промпта для Opus 5 и Fable 5, при этом результаты на тестах по программированию не ухудшились.
Anthropic утверждают, что чем умнее модель, тем меньше её нужно душить инструкциями.
По сути, контекстная инженерия для Claude 5 всё больше напоминает хороший дизайн API. Чем понятнее интерфейсы, структура файлов и границы инструментов, тем меньше приходится объяснять модели словами.
@ai_for_devs
У Anthropic уже вышли Fable 5, Sonnet 5 и Opus 5. Про Haiku, как всегда, забыли)
Вместе с моделями изменились и рекомендации по работе с ними. Команда Claude Code удалила больше 80% системного промпта для Opus 5 и Fable 5, при этом результаты на тестах по программированию не ухудшились.
Anthropic утверждают, что чем умнее модель, тем меньше её нужно душить инструкциями.
Вот что они советуют делать теперь:
• Не прописывать жесткие правила на каждый случай, а позволять модели учитывать контекст и принимать решения
• Не объяснять использование инструментов десятками примеров, а проектировать понятные и выразительные интерфейсы
• Не загружать весь контекст заранее, а использовать прогрессивное раскрытие через Skills и отложенную загрузку инструментов
• Не повторять одни и те же инструкции в системном промпте и описаниях инструментов
• Не превращатьCLAUDE.mdв энциклопедию проекта, оставить там назначение репозитория и действительно неочевидные особенности
• Использовать код, тесты, HTML-макеты и целые кодовые базы как референсы вместо длинных текстовых спецификаций
По сути, контекстная инженерия для Claude 5 всё больше напоминает хороший дизайн API. Чем понятнее интерфейсы, структура файлов и границы инструментов, тем меньше приходится объяснять модели словами.
@ai_for_devs
1👍77❤24🔥14⚡3👏1
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Kimi выложили в открытый доступ 2,8 триллиона параметров K3
Kimi K3 получилась настолько хорошей, что на фоне её релиза CEO Anthropic Дарио Амодеи пришлось отдельно объяснять позицию компании по открытым моделям.
Формально его текст стал ответом на совместное письмо, которым Дженсен Хуанг поделился в своём первом посте в X. Письмо подписали 25 организаций, включая NVIDIA, Microsoft, Meta, IBM, Mistral, Hugging Face, Mozilla, Palantir и Y Combinator. Anthropic среди подписантов не было.
Авторы письма предупредили, что ограничения открытых моделей вытолкнут инновации из США, а дистилляцию назвали стандартным методом разработки, который нельзя автоматически приравнивать к краже данных.
В общем, если после релиза открытой модели CEO Anthropic снова приходится объяснять, почему китайцам нужно дать меньше чипов и меньше доступа к ответам Claude, значит модель действительно удалась :)
Веса модели
Технический отчёт
@ai_for_devs
Kimi K3 получилась настолько хорошей, что на фоне её релиза CEO Anthropic Дарио Амодеи пришлось отдельно объяснять позицию компании по открытым моделям.
Формально его текст стал ответом на совместное письмо, которым Дженсен Хуанг поделился в своём первом посте в X. Письмо подписали 25 организаций, включая NVIDIA, Microsoft, Meta, IBM, Mistral, Hugging Face, Mozilla, Palantir и Y Combinator. Anthropic среди подписантов не было.
Авторы письма предупредили, что ограничения открытых моделей вытолкнут инновации из США, а дистилляцию назвали стандартным методом разработки, который нельзя автоматически приравнивать к краже данных.
Амодеи в ответ подчеркнул, что Anthropic не требует запрещать модели с открытыми весами и даже считает "безопасные" из них общественным благом.
Но дальше всё по классике: не продавать Китаю мощные чипы и оборудование для их производства, бороться с контрабандой и пресекать промышленную дистилляцию, которая, по его словам, позволяет КПК держаться всего в нескольких месяцах от американского AI-фронтира.
В общем, если после релиза открытой модели CEO Anthropic снова приходится объяснять, почему китайцам нужно дать меньше чипов и меньше доступа к ответам Claude, значит модель действительно удалась :)
Веса модели
Технический отчёт
@ai_for_devs
1🔥77💯32👍15🤯9❤3