Практически все там - обычная GitHub-рутина, которую любая команда и так закрыла себе через Actions и скрипты (CI, PR, конфликты, статус работы). Если у вас это уже настроено, открытий тут не будет.
Но пара штук реально цепляет:
✅ verify-this: агент не пишет "готово", а доказывает результат на паре baseline/treatment. Дисциплина вместо доверия на слово, принцип стоит утащить к себе независимо от Cursor.
⚠️ deslop: самое интересное название, но полез смотреть реальный файл скилла, там пять пунктов и три гардрейла, ни одного примера до/после. Без конкретики агент может резать не то что нужно, перед тем как тащить к себе, погоняйте на своём коде и проверьте.
Чего-то сокровенного вы не узнаете из наработок, это срез того, как команда Cursor вообще мыслит про то, что заворачивать в скилл. Смотреть как источник вдохновения.
#AI #Cursor #AIAgents #DevTools
Please open Telegram to view this post
VIEW IN TELEGRAM
👍6👎4
Forwarded from Nek.12 | Сбросы лимитов OpenAI [RU]
Вышла Kimi K3 - опенсорсная китайская модель которая
• Сильнейшая в мире по фронтенд-дизайну
• Стоит как Sonnet, а по уровню превосходит Opus 4.8 во всём (который стоит втрое дороже)
• По уровню чуть ниже Fable, в ~половине бенчмарков побеждает 5.6 Sol
• На 20% меньше токенов тратит чем 2.6
• Контекстное окно 1М токенов
Это удар по антропик невероятного масштаба... Домашний Fable за 1/10 цены с открытыми весами и на своей инфре. Я хз как они от этого оправятся, если в реальном пользовании модель будет такая же, как по бенчам. Дистилляция не прошла даром.
• Сильнейшая в мире по фронтенд-дизайну
• Стоит как Sonnet, а по уровню превосходит Opus 4.8 во всём (который стоит втрое дороже)
• По уровню чуть ниже Fable, в ~половине бенчмарков побеждает 5.6 Sol
• На 20% меньше токенов тратит чем 2.6
• Контекстное окно 1М токенов
Это удар по антропик невероятного масштаба... Домашний Fable за 1/10 цены с открытыми весами и на своей инфре. Я хз как они от этого оправятся, если в реальном пользовании модель будет такая же, как по бенчам. Дистилляция не прошла даром.
👍23👎2
Страх перед GPT 5.6 и KIMI K3 дает о себе знать. На мой взгляд, компания теряет уверенность в своих силах и подходах
#Claude #Anthropic #Fable5
Please open Telegram to view this post
VIEW IN TELEGRAM
👍18👎3
3.6 Flash — рабочая лошадка линейки. По данным Google на 17% меньше выходных токенов на задачу, чем у 3.5 Flash.
3.5 Flash-Lite — самая быстрая и предзначена для тех кому нужен быстрый ответ: 350 токенов в секунду. По собственным бенчам Google, по качеству обгоняет даже 3 Flash на части агентных задач.
⚠️ 3.5 Flash Cyber (поиск и патч уязвимостей) публично не доступна только правительствам и «доверенным партнёрам» в закрытом пилоте, что уже становится трендом. И это не разовая история — у крупных вендоров всё чаще самые мощные и специализированные модели закрываются от обычных разработчиков сразу на старте, а не спустя время после релиза. Тенденция, за которой стоит следить отдельно от самих моделей.
Бенчмаркам на анонсе я доверяю слабо в принципе, и это касается не только Google: любой вендор на релизе подбирает цифры так, чтобы показать себя с лучшей стороны.
Главный вопрос качество/цена работы а не цена за токены в отрыве от скорости и качества.
Я это уже проходил с GLM 5.2 недавно: дешёвый токен ничего не гарантирует, если модель тратит их в разы больше на ту же задачу, и итоговая стоимость решения оказывается выше, чем у дорогой, но эффективной модели. Смотреть надо на стоимость выполнения задачи целиком, а не на прайс-лист за 1M токенов.
3.6 Flash и Flash-Lite уже можно пробовать в Android Studio через Gemini API и оценить на ваших задачах.
#AI #Gemini #LLM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5👎4
#Claude #iOS #ClaudeCode #AI
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5👎3
Регайтесь в KIMI Code пока совсем не закрыли всё. Доступ по API токенам дешевый и вполне подъемный.
👎20👍2