#fyi Проанализировал траты на Kimi K3 — это дорого, но оно того стоит. В экспертном режиме ассистента модель думает много: у меня частенько вылезает за 16к токенов рассуждений. Но проработка кода отличная.
Основная моя модель — GLM 5.2. Умная, быстрая, недорогая, но в деталях может ошибаться. Я могу легко помочь ей сам, но если мне кажется, что нужен детальный разбор, прошу поревьювить код в Kimi. Такой запрос может стоить 5-10 юаней и вашего времени минут 5-10. Это инструмент не на фулл-тайм, но находит крайние случаи, которые можно упустить из виду.
Чтобы не сливать баланс, подправил правила работы с ним:
🎯 K3 — дорогой эксперт. Ему требуется отлаженный системный промпт, который не сокращает его способности, а направляет и уточняет задачу.
🚀 Он должен выдавать результат, а не просто вывод «хорошо/не хорошо». Будет очень обидно, если запрос прошел, а в ответ вы получили лишь текстовый отчет об ошибках. Нужен исправленный код.
⚡️ Не стоит экономить на лимитах — дайте то, что ему нужно. Если он выходит за 16к — дайте 30к сразу. Его задача — детально проанализировать код и дать результат. Если он не вложится в лимит, его поток сознания просто оборвется, и вы переплатите за еще один запрос.
К Kimi K3 стоит обращаться, когда у вас есть сомнения, и вы хотите максимально надежный результат в важном блоке. Не во всем коде важна высокая детализация, но встречаются места, где нужно совместить свои знания и максимальную помощь от LLM. Вот тут он отличный помощник.
Основная моя модель — GLM 5.2. Умная, быстрая, недорогая, но в деталях может ошибаться. Я могу легко помочь ей сам, но если мне кажется, что нужен детальный разбор, прошу поревьювить код в Kimi. Такой запрос может стоить 5-10 юаней и вашего времени минут 5-10. Это инструмент не на фулл-тайм, но находит крайние случаи, которые можно упустить из виду.
Чтобы не сливать баланс, подправил правила работы с ним:
🎯 K3 — дорогой эксперт. Ему требуется отлаженный системный промпт, который не сокращает его способности, а направляет и уточняет задачу.
🚀 Он должен выдавать результат, а не просто вывод «хорошо/не хорошо». Будет очень обидно, если запрос прошел, а в ответ вы получили лишь текстовый отчет об ошибках. Нужен исправленный код.
⚡️ Не стоит экономить на лимитах — дайте то, что ему нужно. Если он выходит за 16к — дайте 30к сразу. Его задача — детально проанализировать код и дать результат. Если он не вложится в лимит, его поток сознания просто оборвется, и вы переплатите за еще один запрос.
К Kimi K3 стоит обращаться, когда у вас есть сомнения, и вы хотите максимально надежный результат в важном блоке. Не во всем коде важна высокая детализация, но встречаются места, где нужно совместить свои знания и максимальную помощь от LLM. Вот тут он отличный помощник.
👍6🔥2
Forwarded from Банкста
Сбер представил ГигаАгента, — по заявлению компании, первого в России автономного универсального ИИ-агента. Он решает повседневные задачи: управляет календарём, работает с документами, ведёт переписку, исследует информацию, создаёт отчёты и презентации.
В отличие от диалоговых интерфейсов, ИИ-агент работает автономно и в фоновом режиме, запоминает контекст и накапливает опыт между сессиями, а при необходимости сам задаёт уточняющие вопросы.
ГигаАгент уже доступен для выбора в Agents Space — пространстве для создания и использования персональных ИИ-агентов без настройки моделей, серверов и среды запуска. При этом все технические сложные процессы автоматизированны. Пользователю достаточно выбрать подходящего агента или создать собственного, чтобы использовать ИИ для решения конкретных задач. @banksta
В отличие от диалоговых интерфейсов, ИИ-агент работает автономно и в фоновом режиме, запоминает контекст и накапливает опыт между сессиями, а при необходимости сам задаёт уточняющие вопросы.
ГигаАгент уже доступен для выбора в Agents Space — пространстве для создания и использования персональных ИИ-агентов без настройки моделей, серверов и среды запуска. При этом все технические сложные процессы автоматизированны. Пользователю достаточно выбрать подходящего агента или создать собственного, чтобы использовать ИИ для решения конкретных задач. @banksta
Банкста
Сбер представил ГигаАгента, — по заявлению компании, первого в России автономного универсального ИИ-агента. Он решает повседневные задачи: управляет календарём, работает с документами, ведёт переписку, исследует информацию, создаёт отчёты и презентации. В…
Он же Гога, он же Гига, он же Гора, он же Жора =)
😁10
#fyi Модель с русским промтом тупеет?
Как модель «думает», если коротко. Внутри у неё нет русского, английского или китайского отдела — есть одно общее пространство смыслов, куда складывается всё. Но кормили её в основном английским: GitHub, StackOverflow... Поэтому пространство это плотнее всего именно там, где английские слова. Отсюда два налога на русский.
Налог на ум. Спросили по-русски — модель всё равно достаёт знания из "английской" части памяти, cross-lingual transfer работает. Но с потерями: у топовых моделей 1–3%, заметно только на задачах, где она и так на пределе. У слабых моделей разрыв больше.
Налог на токены. Модель читает текст не словами, а токенами — кусочками. Английский режется экономно, русский — в 1.5–2 раза мельче. Один и тот же смысл занимает вдвое больше места: окно на 200k токенов вмещает меньше русского текста, чем английского, и кончается раньше, в API тот же текст дороже в полтора-два раза, ответ генерируется дольше.
Как модель «думает», если коротко. Внутри у неё нет русского, английского или китайского отдела — есть одно общее пространство смыслов, куда складывается всё. Но кормили её в основном английским: GitHub, StackOverflow... Поэтому пространство это плотнее всего именно там, где английские слова. Отсюда два налога на русский.
Налог на ум. Спросили по-русски — модель всё равно достаёт знания из "английской" части памяти, cross-lingual transfer работает. Но с потерями: у топовых моделей 1–3%, заметно только на задачах, где она и так на пределе. У слабых моделей разрыв больше.
Налог на токены. Модель читает текст не словами, а токенами — кусочками. Английский режется экономно, русский — в 1.5–2 раза мельче. Один и тот же смысл занимает вдвое больше места: окно на 200k токенов вмещает меньше русского текста, чем английского, и кончается раньше, в API тот же текст дороже в полтора-два раза, ответ генерируется дольше.
🔥4😱4
#fyi Подбил логи GLM 5.2 за 12 дней. Если K3 — это снайпер, то GLM — это пулемет.
📊 Масштаб: 1650 запросов (~137 в день), 2 млн токенов в ответах и почти 50 млн суммарно. По прайсу это потянуло бы на ~175 юаней.
🎯 Умная и быстрая: 87% всех потраченных токенов — это Cache Hit. Иногда не хочется скидывать чат, чтобы объяснять модели контекст заново, и работа выходит за рамки обычной сессии.
🚀 Сложные задачи — расход больше: В обычные дни уходит 1-2 млн токенов. Но когда даешь модели объемный контекст для глубокого разбора, расход взлетает до 10 млн в день.
Я доволен этой моделью. Сколько потратил? Я купил пакет на 100 лямов токенов, и ни в чем себе не отказываю =)
📊 Масштаб: 1650 запросов (~137 в день), 2 млн токенов в ответах и почти 50 млн суммарно. По прайсу это потянуло бы на ~175 юаней.
🎯 Умная и быстрая: 87% всех потраченных токенов — это Cache Hit. Иногда не хочется скидывать чат, чтобы объяснять модели контекст заново, и работа выходит за рамки обычной сессии.
🚀 Сложные задачи — расход больше: В обычные дни уходит 1-2 млн токенов. Но когда даешь модели объемный контекст для глубокого разбора, расход взлетает до 10 млн в день.
Я доволен этой моделью. Сколько потратил? Я купил пакет на 100 лямов токенов, и ни в чем себе не отказываю =)
👍4🔥2❤1
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5
Forwarded from Банкста
США хотят запретить Европе использовать китайский ИИ. Согласно полученному Reuters проекту письма, страны, которые присоединились к пекинской модели ИИ, потеряют доступ к возглавляемой США инициативе Pax Silica. В проекте говорится, что членство в Pax Silica не может сосуществовать с конкурирующими инициативами. Pax Silica также затрагивает полупроводники, критически важные минералы, инвестиции и экспортный контроль, поэтому членство влияет не только на доступ к моделям. Страны, которые хотят использовать американские чипы и капитал, должны отказаться от проектов с Китаем. @banksta
🤣8
Банкста
США хотят запретить Европе использовать китайский ИИ. Согласно полученному Reuters проекту письма, страны, которые присоединились к пекинской модели ИИ, потеряют доступ к возглавляемой США инициативе Pax Silica. В проекте говорится, что членство в Pax Silica…
Рыночная экономика: или у вас не наша ИИ-вундервафля (wunderwaffe), а китайская, но тогда хрен вам, а не печатный станок.
🤣1
Vitaliy Zarubin | @keygenqt
API уже отдаёт новую GLM-5.3, но при отправке запросов пока выдаёт Access Denied. Ждем.
🔥3
🔥 Vibe Action: CLI v0.2.0 + Plugins Update
Новый релиз — навел порядок, прокачал ввод/вывод и сделал работу со скриншотами умнее.
👉 Авто-скриншоты: если в буфере нет изображения, команда сама понимает, когда нужно сделать скриншот
👉 Новый ввод/вывод: переработали систему, добавили тег
👉 Полные прогоны: добавили выполнения пайплайнов с фикстурами. Убрали метод
👉 Синхронизация с плагином: синхронизировали все доступные экшены и пайплайны, а сам плагин обновили под новый формат вывода приложения
🔗 Vibe Action
🔗 Vibe Action Plugins
📕 https://vibe-action.keygenqt.com
Новый релиз — навел порядок, прокачал ввод/вывод и сделал работу со скриншотами умнее.
👉 Авто-скриншоты: если в буфере нет изображения, команда сама понимает, когда нужно сделать скриншот
👉 Новый ввод/вывод: переработали систему, добавили тег
query — он упрощает и систематизирует данные для разных источников (CLI/API)👉 Полные прогоны: добавили выполнения пайплайнов с фикстурами. Убрали метод
bench — теперь это часть внутренней кухни👉 Синхронизация с плагином: синхронизировали все доступные экшены и пайплайны, а сам плагин обновили под новый формат вывода приложения
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4
Vitaliy Zarubin | @keygenqt
🔥 Vibe Action: CLI v0.2.0 + Plugins Update Новый релиз — навел порядок, прокачал ввод/вывод и сделал работу со скриншотами умнее. 👉 Авто-скриншоты: если в буфере нет изображения, команда сама понимает, когда нужно сделать скриншот 👉 Новый ввод/вывод: переработали…
Чат — это место, где вы думаете. Vibe Action — это место, где вы без усилий контролируете контекст с помощью локальных или не дорогих моделей, чтобы ваш чат оставался чистым и недорогим. 😎
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4👍1
Подбил расходы на API за 15 дней при использовании топовых моделей (в своих весовых категориях). Использую их как ассистентов с точечным контекстом — не без косяков, работу ещё отлаживаю.
По официальным тарифам за 15 дней набежало 301 ¥. По факту выходит сильно дешевле за счёт пакетов и бонусов. В 500 укладываюсь легко. И это не что попало — это топовый уровень моделей.
Kimi K3 при 1.6% токенов съела 14% стоимости — у неё вывод дорогой. Часто думала за 25к токенов и отрубалась — приходилось перезапускать (есть параметры, которые прикручивают её мыслительный поток). 90% токенов — GLM 5.2, боевая LLM, основное идёт через кэш — без него счёт был бы совсем другим. DeepSeek flash/pro помогает в Vibe Action. Подсчёт по тарифам API в xlsx, бонусы и скидки не учитывал.
По официальным тарифам за 15 дней набежало 301 ¥. По факту выходит сильно дешевле за счёт пакетов и бонусов. В 500 укладываюсь легко. И это не что попало — это топовый уровень моделей.
Kimi K3 при 1.6% токенов съела 14% стоимости — у неё вывод дорогой. Часто думала за 25к токенов и отрубалась — приходилось перезапускать (есть параметры, которые прикручивают её мыслительный поток). 90% токенов — GLM 5.2, боевая LLM, основное идёт через кэш — без него счёт был бы совсем другим. DeepSeek flash/pro помогает в Vibe Action. Подсчёт по тарифам API в xlsx, бонусы и скидки не учитывал.
🔥2👍1
Vitaliy Zarubin | @keygenqt
Подбил расходы на API за 15 дней при использовании топовых моделей (в своих весовых категориях). Использую их как ассистентов с точечным контекстом — не без косяков, работу ещё отлаживаю. По официальным тарифам за 15 дней набежало 301 ¥. По факту выходит…
table_2026-08-16_182941.xlsx
39.7 KB
🔥 Vibe Action: CLI v0.2.2
Стабильность, контроль версий и качество экшенов.
👉 Переработана и актуализирована документация
👉 Добавлено версионирование кеша
👉 Добавлено версионирование интерфейса экшенов
👉 Автоматическое обновление встроенных экшенов
👉 Экшен commit: улучшено качество генерации сообщений
👉 Общие фиксы и оптимизация производительности
🔗 Vibe Action
🔗 Vibe Action Plugins
📕 https://vibe-action.keygenqt.com
Стабильность, контроль версий и качество экшенов.
👉 Переработана и актуализирована документация
👉 Добавлено версионирование кеша
👉 Добавлено версионирование интерфейса экшенов
👉 Автоматическое обновление встроенных экшенов
👉 Экшен commit: улучшено качество генерации сообщений
👉 Общие фиксы и оптимизация производительности
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🔥2
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🔥1
Forwarded from Банкста
Китай запустил альтернативу YouTube и начал на мировую экспансию. BiliBili запустил международную версию с поддержкой русской языка.
Приложение уже доступно в Google Play — iOS, веб-версия появятся позже.
YouTube уже испугался и начал предлагать некоторым авторам эксклюзивные соглашения на «миллионы долларов», чтобы они не публиковали видео на других платформах, узнал Bloomberg. @banksta
Приложение уже доступно в Google Play — iOS, веб-версия появятся позже.
YouTube уже испугался и начал предлагать некоторым авторам эксклюзивные соглашения на «миллионы долларов», чтобы они не публиковали видео на других платформах, узнал Bloomberg. @banksta
🔥9👏4👍1
Vitaliy Zarubin | @keygenqt
GLM 5.3 заработал через API (без подписки, с кредитами) 🎉
Обкатал 5.3, разницы с 5.2 особой не заметил, по-прежнему K3 ее делает как щенка =)
🔥4
🔥 Vibe Action: App v0.2.3 + Plugins v0.0.6
Свежий апдейт — поддержка нотификаций экшенов, фиксы багов.
👉 Добавил поддержку confirm экшена в плагин.
👉 Изолировал инстансы плагина при вызове из двух IDE.
🔗 Vibe Action
🔗 Vibe Action Plugins
📕 https://vibe-action.keygenqt.com
Свежий апдейт — поддержка нотификаций экшенов, фиксы багов.
👉 Добавил поддержку confirm экшена в плагин.
👉 Изолировал инстансы плагина при вызове из двух IDE.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍3🔥1
Vitaliy Zarubin | @keygenqt
🔥 Vibe Action: App v0.2.3 + Plugins v0.0.6 Свежий апдейт — поддержка нотификаций экшенов, фиксы багов. 👉 Добавил поддержку confirm экшена в плагин. 👉 Изолировал инстансы плагина при вызове из двух IDE. 🔗 Vibe Action 🔗 Vibe Action Plugins 📕 https://vibe…
Наконец-то Vibe Action стал таким, каким я его хотел видеть: надежный плагин и гибкие экшены. Закрыл все свои хотелки, но в стейбл пока не перевожу — это всё же пет-проект, который уже тянет на 20к строк кода. Статус беты оставил для страховки и жду фидбека: ведь мог что-то упустить.
Это бета, но проект работает и выполняет свои задачи: упрощает рутину, разгружает ассистента и помогает готовить контекст. Ассистент и агент — это фундаментально разные способы взаимодействия с LLM, два разных контракта, которые определяют автора кода.
Сейчас мало кто развивает направление ассистентов, но я уже сделал свой первый пулл-реквест в Cherry Studio и планирую добавить больше возможностей именно для этого паттерна.
Vibe Action получился хорошим, достаточно сложным (если глянуть исходники) и не очень большим. Что такое 20к строк в наше время? Я делал это после работы — для себя и для людей. На самом деле, если присмотреться, его возможности выходят далеко за рамки создания коммитов или добавления комментариев в код.
Это бета, но проект работает и выполняет свои задачи: упрощает рутину, разгружает ассистента и помогает готовить контекст. Ассистент и агент — это фундаментально разные способы взаимодействия с LLM, два разных контракта, которые определяют автора кода.
Сейчас мало кто развивает направление ассистентов, но я уже сделал свой первый пулл-реквест в Cherry Studio и планирую добавить больше возможностей именно для этого паттерна.
Vibe Action получился хорошим, достаточно сложным (если глянуть исходники) и не очень большим. Что такое 20к строк в наше время? Я делал это после работы — для себя и для людей. На самом деле, если присмотреться, его возможности выходят далеко за рамки создания коммитов или добавления комментариев в код.
👍6🔥6