2.2K subscribers
93 photos
11 videos
76 links
Koda — AI-помощник для разработчика, который работает без VPN, отлично понимает русский язык и предоставляет доступ к современным моделям прямо из вашей IDE.

Сайт: kodacode.ru
Чат: @kodacommunity
Документация: docs.kodacode.ru
Download Telegram
⚡️ Готовим новые замеры моделей. Делимся промежуточными результатами.

Подготовили новый бенчмарк и замеряем различные модели и харнесы.
Скоро поделимся большим числом замеров и расскажем подробности в статье на Хабре. А пока — вот один интересный замер: чёт opencode не дружит с DeepSeek V4 Flash.
🔥16👍8🤯6🤔21😁1
А Koda стала лучше за последние 4 месяца?

Друзья, мы подготовили короткий опрос, чтобы понять, как изменились ваши оценки Kodacode за это время. А в открытом вопросе можно рассказать, что ещё стоит улучшить и что по-прежнему раздражает.

Опрос займёт около 2 минут. Ответы напрямую повлияют на то, что мы будем улучшать дальше.

🔗 Пройти опрос

А с результатами прошлого опроса можно ознакомиться в этом посте.
Please open Telegram to view this post
VIEW IN TELEGRAM
👍17🔥65
🌪 10 000 ИИ-агентов решили задачу тысячелетия

OpenAI запустила около 10 000 агентов на задачу Навье — Стокса – одну из семи легендарных задач тысячелетия, над которыми человечество ломает голову десятилетиями.

Если коротко, задача состоит в том, может ли в идеально нормальной жидкости внезапно возникнуть математическая катастрофа.


И вот что получилось:

– агенты работали примерно 88 часов
– отправили 2,7 млн сообщений
– потратили около 130 млрд токенов
– построили аналитическое доказательство
– а GPT‑6 Astra формализовала и проверила его в Lean ещё за 17 часов

Самое интересное то, что агентов питала закрытая модель, которая, по словам OpenAI, значительно сильнее самой GPT‑6 Astra.

Получается, что главный релиз недели, возможно, вообще не Astra. А модель, которую нам пока даже не показали.

Ну и куда без драмы. OpenAI начала штурм задачи после слухов, что к близкому результату подошли два других математика. Теперь обсуждают не только само доказательство, но и то, могла ли лаборатория косвенно воспользоваться знаниями, полученными от пользователей своих моделей.

OpenAI утверждает, что конкретные материалы исследователей не читала. Но полностью исключить влияние обезличенных пользовательских данных на обучение модели компания не смогла.

🤓 Ждем релиз субагентов в Kodacode. Уже очень скоро.

Возможно, после этого события математикам пора начать нервно обновлять LinkedIn.

🔗 Результат OpenAI
🔗 Формализация в Lean
Please open Telegram to view this post
VIEW IN TELEGRAM
👍13🔥433
💰 Поддержи Kodacode постом в сторис и получи кредиты

Друзья, мы запускаем промо-акцию. Для участия нужно:

1. Опубликовать один из предложенных баннеров в сторис Telegram, указав ссылку на наш сайт https://kodacode.ru/.

При желании можно также указать реферальный код из личного кабинета. Приглашенный получает скидку 20% на оплату. Владелец кода получает бонус 20% от оплаченного в виде лимитов koda-pro, для доп. пакета — от лимита, купленного другом.


2. После публикации отправьте в поддержку в личном кабинете:

- ник Telegram;
- скриншот количества просмотров.

За публикацию начислим на koda-pro:

- до 99 просмотров - 750 RC;
- 100+ просмотров - 1 500 RC;

Дополнительно начисляем 250 RC, если добавите в описании к публикации пару слов о своём опыте: чем вам полезен KodaCode и какие задачи вы решаете с его помощью.


⚠️ Для участия необходимо быть подписанным на Telegram-канал KodaCode. Получить бонус можно один раз на один аккаунт.

Акция действует 2 недели: с 9 по 23 сентября.

Если возникли вопросы

🔥 Ждём ваши публикации!
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥14👍85👎1
⚡️ DeepSeek выпустила Flash-модель, которая убила собственную Pro-версию

Только что официально вышла DeepSeek V4.1 Flash, и слово Flash здесь означает не «облегчённая», а «зачем теперь вообще нужна Pro».

По данным DeepSeek, новая модель превосходит предыдущую V4 Pro одновременно по качеству, скорости, стоимости и времени выполнения задач. Разрыв оказался настолько убедительным, что компания решила постепенно отправить Pro на пенсию.

Что внутри:

• нативное понимание изображений
• контекст на 1 миллион токенов
ответы размером до 384 тысяч токенов
режимы с рассуждением и без него
• поддержка инструментов, Responses API и Anthropic API
74,2% на DeepSWE v1.1
90,6% на Terminal-Bench 2.1

С 14 сентября DeepSeek даже начнёт автоматически перенаправлять запросы к V4 Pro на новую Flash, но считать их по более дешёвому тарифу. Не каждый день увидишь, когда даунгрейд модели выглядит как апгрейд.

Пока результаты бенчмарков заявлены самой DeepSeek, поэтому ждём независимых тестов. Но на бумаге получился очень серьёзный претендент для кодинг-агентов и длинных автономных задач.

⚡️ Ну а мы уже добавили DeepSeek V4.1 Flash в Kodacode. Можно запускать и проверять, действительно ли Flash теперь означает Pro

🔗 Официальный анонс DeepSeek
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥15👍98
🧠 ИИ заменяет тимлидов

Cognition выпустила Fusion для Devin Desktop и CLI. Раньше эта система работала в облачном Devin, а с 11 сентября доступна в десктоп приложении и терминале. Одна модель планирует работу и проверяет результат, вторая пишет код. Почти как в нормальной команде разработки, только без утреннего дейлика.

Devin – это ИИ-инструмент, которому можно поручить задачу по разработке: он изучает проект, меняет код и запускает тесты. А Fusion — режим, в котором эту работу делят две модели:

Ведущий – например, Claude Fable 5.1 или GPT-6 Astra. Разбирается в задаче, составляет план и проверяет изменения.
Исполнитель – например, SWE-2. Исследует код, вносит правки и тестирует.


У каждого свой контекст. Они обмениваются заданиями и результатами, не таская за собой всю переписку напарника.

Резонный вопрос: "Зачем усложнять?". Чтобы меньше платить за выполненную работу. По данным Cognition, связка Fable 5.1 + SWE-2 показала:

• На DeepSWE 1.1 – снижение стоимости на 46%, при небольшом падении результата: 64,3 → 63,1.
• На FrontierCode 1.1 Extended – стоимость ниже на 38%, результат почти прежний: 63,6 → 63,5.

На реальном проекте экономия может отличаться. Идея в том, что дорогая модель принимает сложные решения, более дешёвая выполняет задания. Главное, чтобы сэкономленное не съели переделки.

⚠️ В KodaCode мы тоже уделяем внимание харнесу. У нас есть роли агента, скиллы и делегирование задач. Все они помогают организовать работу модели. Сейчас проводим много замеров нашего харнеса с разными моделями. Результаты опубликуем совсем скоро.


И Fusion как раз хорошо показывает, почему это важно. Ведь результат зависит и от того, как модели работают вместе. Поэтому в очередной раз повторяем, что выбор модели – это не всегда самое главное.

🔗 Анонс Cognition и результаты тестов
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍21😁1110🔥9
🙌 В Koda есть Issues

Друзья, напоминаем, что вы можете напрямую влиять на развитие Koda:

• создавайте задачи и предлагайте новые фичи в GitHub;
• ставьте 👍 уже созданным Issues, которые важны для вас;
• следите за обсуждением и статусом задач.

Мы будем ориентироваться на ваши реакции при планировании разработки. Самые залайканные таски постараемся брать в работу в первую очередь.

👀 А ещё в ближайшее время мы планируем эксперимент: новые фичи и исправления багов будем быстрее выкатывать в предварительные сборки при участии агентов Kodacode.

Поэтому вы сможете тестировать изменения раньше основного релиза и делиться обратной связью. Подробности расскажем совсем скоро.

🔗 Заводить и просматривать таски тут
🔗 Удобные view для просмотра задач
🔗 Вся информация по работе с обратной связью
Please open Telegram to view this post
VIEW IN TELEGRAM
👍19🔥53
🔥 Новые Koda Base и Koda Pro уже в проде

Koda Base теперь работает на основе Qwen 3.8 Flash 125B, а Koda Pro на основе GLM 5.3.

Прогнали новые версии на 261 реальной агентной задаче:

• Koda Base выросла с 38,5% до 49,5%
• Koda Pro выросла с 46,7% до 54,3% и показала лучший результат среди протестированных open-source моделей
• новой Pro требуется на 26% меньше шагов для решения задачи

Заодно сравнили разные харнессы на одной и той же DeepSeek V4 Flash Max. Koda показала лучший результат:

• Koda - 52,2%
• KiloCode - 49,5%
• Claude Code - 48,2%
• OpenCode - 47,6%

Новые модели уже можно попробовать в VS Code, JetBrains IDE, Koda CLI и Koda Desktop. А Koda Base по-прежнему доступна бесплатно с дневными лимитами 💜

🚀 Статья с замерами: https://habr.com/ru/companies/koda/articles/1083546/
🔗 Установить KodaCode: https://download.kodacode.ru
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥33👍1312🤔3
🙉 ИИ сам разрабатывает следующую версию самого себя

Anthropic раскрыла цифры:

• Claude уже ведёт 26% исследований и разработки новых моделей
• более 90% R&D-задач выполняются с его участием
• внутри компании одновременно работают около 30 000 ИИ-агентов


Они пишут код, анализируют эксперименты, исправляют инфраструктуру и делегируют задачи друг другу.

Похоже не на классический вайбкодинг, а на вайб-R&D. Человек задаёт некоторую цель, а агенты выполняют основную работу и помогают создавать следующее поколение ИИ.

🙃 К счастью, полной автономии пока нет и решения принимают люди (пока что).

🔗 Исследование от Anthropic
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
👍2🤔21🔥1