Vitaliy Zarubin | @keygenqt
459 subscribers
1.19K photos
294 videos
3 files
606 links
Привет! Я инженер-программист компании ОМП. За свою карьеру я сменил много платформ и языков, и продолжаю учить новые. На канале рассказываю о своей работе и моих pet-проектах.
Download Telegram
#fyi Если кто-то думает, что западные модели мощнее китайских — я вас разочарую. Запад совершенно не держит удар по соотношению цена/качество. Самой лучшей модели не существует, а тесты… ну, а у вас какой IQ? Тесты несовершенны.
💯6👍3
Forwarded from Банкста
This media is not supported in your browser
VIEW IN TELEGRAM
Технический директор (СТО) Skyeng заявляет: уволим тех, кто не адаптировался к ИИ – нам этот балласт не нужен. При этом через 15 секунд она призналась, что адаптация сложна и для неё: «я могу пользоваться только Mac, я всю жизнь на нём, я так привыкла». @banksta
🤣14🤯1
vibe-cluster v0.0.6

Библиотека для LLM-кластеров на Rust. Один API — Ollama, DeepSeek, Qwen, Kimi, Zhipu.

🖥️ Новые провайдеры — Kimi и Zhipu с поддержкой vision
👁️ Vision-модели — авто-роутинг для Qwen-VL, GLM-4V, Kimi
💬 System prompt — глобальный контекст для запросов
🧹 Чистые ответы — методы удаления markdown-блоков
Асинхронные методы — models(), hosts(), providers()
🔍 Обработка ошибок — точные сообщения, меньше шума

🔗 https://crates.io/crates/vibe-cluster
Please open Telegram to view this post
VIEW IN TELEGRAM
👍4🔥2
🔥 Vibe Action: IDE Plugin v0.0.1 (alpha) + CLI v0.1.2 (beta)

Главный релиз — плагины для IDE! Vibe Action выходит за пределы терминала и переезжает прямо в редактор. Плагины на Compose Multiplatform для VS Code, и для IntelliJ. Плагин и бекенд — независимые проекты (Kotlin/Compose для UI, Rust для ядра), но общаются напрямую.

🧩 IDE Плагин v0.0.1 (Alpha):
👉 Context Awareness: плагин сам передает выделенный в редакторе текст или буфер обмена в YAML-пайплайн
👉 Seamless Output: результат работы экшена может автоматически заменить выделенный код в редакторе, попасть в буфер или всплыть в нативном окне
👉 Auto-discovery: плагин сам находит все доступные actions/flows (встроенные и кастомные)
👉 Нативный UI: живой фидбек выполнения прямо в вашей IDE

⚙️ CLI v0.1.2 (Beta):
👉 Блок api в YAML: теперь экшены сами знают, как им взаимодействовать с IDE
👉 Мощное ядро на Rust: shell + LLM пайплайны, граф зависимостей по {tag}, when/then условия
👉 Продвинутые фичи: AST-парсинг, Vision (скриншоты/изображения), Batch LLM для кластеров
👉 Process Guard: новые запуски автоматически отменяют старые, состояние всегда предсказуемо

🔗 Vibe Action
🔗 Vibe Action Plugins

📕 https://vibe-action.keygenqt.com
Please open Telegram to view this post
VIEW IN TELEGRAM
👍5🔥2
#fyi Цена агента

Агенты стали главным инструментом, который продают программистам. Желание переложить задачи на LLM понятно: человек медленнее и не всегда реализует задачу лучше модели. Мы, программисты, любим автоматизацию, но у неё всегда есть цена: любую автоматизацию нужно поддерживать в актуальном состоянии, заниматься ей как отдельным проектом. Наращивая уровень абстракции, мы строим дополнительные контуры, которые живут по своим законам. LLM не исключение.

Агент — автоматизация разработки, для многих — замена программиста. Чтобы агент начал работать, ему нужно объяснить, что делать. Уровень детализации промта напрямую определяет точность результата: от «сделай мне хорошо» до готового кода в самом промте, где модель — курьер. Но промт — не спецификация, а вход для интерпретации. Агент может задать важные, по его мнению, вопросы — важные по его карте задачи, не по твоей — и начать работу. Если результат не тот, дорабатываешь промт и повторяешь итерацию. За полную цену.

Пока агент работает, программист превращается в доставщика контекста. Ты думаешь не как написать оптимальный код, а как написать промт, который сработает с первого раза. Твоя задача — полная автоматизация, код перестаёт тебя интересовать. Это другая профессия, с программированием связанная косвенно. Программист, развиваясь в работе с агентами, деградирует в понимании кода — джун так не станет сеньором. Спросят: а надо ли? Зависит от того, что ты продаёшь. Если продаёшь результат и код для тебя расходник — то не надо. Но найм покупает инженера, а не код: это деградация главного актива.

У LLM есть слабости. Галлюцинации можно вылечить — инструментами, проверками, практикой. Остаются еще две важные. Первая: модель заполняет пробелы типичным решением, центром распределения. Агентный код конвергирует к усреднённому стилю — рабочему, но чужому твоему проекту. Вторая: модель может проверить формальную корректность — тесты, линтер, компилятор, — но не соответствие твоему намерению. Отсюда фирменный жанр агентных прогонов: модель кругами гоняет тесты, которые сама же и написала. Тесты зелёные, задача решена не та.

Это не новая ситуация. До LLM был WordPress: сайт за пять минут на CMS или разработка на фреймворке вроде Laravel. Оба варианта работают, но добавить специфичную функцию в CMS дороже, чем в фреймворке. Заказчик выбирал между простотой на входе и гибкостью на будущее. Повышая уровень абстракции, мы всегда понижаем гибкость. Агент — тот же выбор, только теперь под абстракцию уходит не код, а понимание кода.

За крайностями — код руками без LLM или полная ставка на агентов — есть вариант дешевле и оптимальнее. LLM как ассистент. Такими ассистентами раньше были поиск, форумы, коллеги — сейчас их закрывает чат. Ты остаёшься программистом: пропускаешь проект через себя, точечно даёшь контекст, снимаешь с себя рутину. Ревью мерж-реквеста перестаёт быть проблемой — это твой код, написанный с применением LLM, каждую строку ты понял по ходу работы. Сложное переписываешь сам: модель не всегда справляется, и иногда промт — это уже готовый код. Модель понимает тебя не через разовый промт на старте, а через контекст совместной работы.

И это дешевле. Модели не нужно перелопачивать проект грепом в поиске нужных токенов. Ошибка стоит мелкую итерацию в чате, а не прогон агента. Цена агента — зависимость, деградация навыков, гибкость проекта. Цена ассистента — твоё внимание на каждом шаге. Выбирая между ними, ты выбираешь не только код, который получишь, но и инженера, которым станешь.
🔥3👌21
#fyi Вы тоже встречали в LLM проблемы с идентичностью? Модели путаются, кто они. Почему такое может происходить?

Первое, что приходит на ум — дистилляция на синтетических данных, сгенерированных Claude. Ответ кажется простым, но на деле мы не можем знать точно, как именно попали данные о Claude в модель.

Еще вариант — «вирусные данные», когда в общедоступные датасеты намеренно закладываются триггеры в духе «я модель Claude», которые ИИ бездумно заглатывает при обучении. Если компания жжет книги, чтобы они не достались другим, я уже ничему не удивлюсь.

Еще есть вероятность простой замусоренности самих данных — будь то миллиарды страниц из интернета или базовые модели и веса, которые уже забиты контентом от Anthropic. Возможно, все эти факторы накладываются друг на друга, ломают ассоциативные связи, и модель выдает чужой шаблон идентичности.
🔥4
This media is not supported in your browser
VIEW IN TELEGRAM
Роман Аляутдин в эфире телеканала Россия 24

Директор по разработке ОС Аврора рассказал о взаимодействии с облачной платформой МосХаб для успешного развития индустриального, системного и инженерного программного обеспечения.

Open Source-проекты для ОС Аврора стали доступны на МосХаб в прошлом году. Независимые разработчики, представители академического сообщества и студенты могут запускать и развивать свои проекты на базе надежного российского ресурса, что устраняет риски и барьеры, связанные с использованием зарубежных сервисов.


📲 Аврора в MAX
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥6
Говорят, Qwen 3.8 Max уступает только Claude Fable 5. Проверим, насколько он хорош.
🔥7
Vitaliy Zarubin | @keygenqt
Говорят, Qwen 3.8 Max уступает только Claude Fable 5. Проверим, насколько он хорош.
Немного поработал с Qwen 3.8 Max — поискали с ним решения задачи на уровне идей. Честно говоря, ожидал большего. Кажется, Fable 5 просто заперли с ним, провели тест, и Qwen нехотя уступил.
🔥6😁1
Forwarded from Банкста
Китайский разработчик ИИ DeepSeek уведомил пользователей о планах повысить цены на свои услуги, сообщает Bloomberg. Компания не назвала точное увеличение стоимости, но заявила, что оно будет существенным, и призвала клиентов это учитывать. @banksta
😱4
🔥 Vibe Action: CLI v0.1.4 + Plugins Update

Небольшой релиз — навел порядок в выводе и пофиксили баги.

👉 Форматирование кода в терминале
👉 Полный прогресс выполнения в логах

🔗 Vibe Action
🔗 Vibe Action Plugins

📕 https://vibe-action.keygenqt.com
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥3👍2
This media is not supported in your browser
VIEW IN TELEGRAM
Дарим зрение текстовым LLM 👀
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥3👍2
#fyi Проанализировал траты на Kimi K3 — это дорого, но оно того стоит. В экспертном режиме ассистента модель думает много: у меня частенько вылезает за 16к токенов рассуждений. Но проработка кода отличная.

Основная моя модель — GLM 5.2. Умная, быстрая, недорогая, но в деталях может ошибаться. Я могу легко помочь ей сам, но если мне кажется, что нужен детальный разбор, прошу поревьювить код в Kimi. Такой запрос может стоить 5-10 юаней и вашего времени минут 5-10. Это инструмент не на фулл-тайм, но находит крайние случаи, которые можно упустить из виду.

Чтобы не сливать баланс, подправил правила работы с ним:

🎯 K3 — дорогой эксперт. Ему требуется отлаженный системный промпт, который не сокращает его способности, а направляет и уточняет задачу.

🚀 Он должен выдавать результат, а не просто вывод «хорошо/не хорошо». Будет очень обидно, если запрос прошел, а в ответ вы получили лишь текстовый отчет об ошибках. Нужен исправленный код.

⚡️ Не стоит экономить на лимитах — дайте то, что ему нужно. Если он выходит за 16к — дайте 30к сразу. Его задача — детально проанализировать код и дать результат. Если он не вложится в лимит, его поток сознания просто оборвется, и вы переплатите за еще один запрос.

К Kimi K3 стоит обращаться, когда у вас есть сомнения, и вы хотите максимально надежный результат в важном блоке. Не во всем коде важна высокая детализация, но встречаются места, где нужно совместить свои знания и максимальную помощь от LLM. Вот тут он отличный помощник.
👍5🔥2
Forwarded from Банкста
Сбер представил ГигаАгента, — по заявлению компании, первого в России автономного универсального ИИ-агента. Он решает повседневные задачи: управляет календарём, работает с документами, ведёт переписку, исследует информацию, создаёт отчёты и презентации.

В отличие от диалоговых интерфейсов, ИИ-агент работает автономно и в фоновом режиме, запоминает контекст и накапливает опыт между сессиями, а при необходимости сам задаёт уточняющие вопросы.

ГигаАгент уже доступен для выбора в Agents Space — пространстве для создания и использования персональных ИИ-агентов без настройки моделей, серверов и среды запуска. При этом все технические сложные процессы автоматизированны. Пользователю достаточно выбрать подходящего агента или создать собственного, чтобы использовать ИИ для решения конкретных задач. @banksta
#fyi Модель с русским промтом тупеет?

Как модель «думает», если коротко. Внутри у неё нет русского, английского или китайского отдела — есть одно общее пространство смыслов, куда складывается всё. Но кормили её в основном английским: GitHub, StackOverflow... Поэтому пространство это плотнее всего именно там, где английские слова. Отсюда два налога на русский.

Налог на ум. Спросили по-русски — модель всё равно достаёт знания из "английской" части памяти, cross-lingual transfer работает. Но с потерями: у топовых моделей 1–3%, заметно только на задачах, где она и так на пределе. У слабых моделей разрыв больше.

Налог на токены. Модель читает текст не словами, а токенами — кусочками. Английский режется экономно, русский — в 1.5–2 раза мельче. Один и тот же смысл занимает вдвое больше места: окно на 200k токенов вмещает меньше русского текста, чем английского, и кончается раньше, в API тот же текст дороже в полтора-два раза, ответ генерируется дольше.
🔥1😱1