Вайб-кодинг
60.8K subscribers
2.04K photos
846 videos
30 files
1.35K links
Авторский канал по ВАЙБ КОДИНГУ

Ссылка для друзей: https://t.me/+ll3pbl442dNkZmYy

Cотрудничество: @devmangx

РКН: https://clck.ru/3RRVfk
Download Telegram
Лечение рака ускоряется.

Впервые персонализированное лечение рака на основе мРНК, созданное с помощью ИИ, успешно прошло испытание 3-й фазы.

Moderna и Merck секвенируют опухоль каждого пациента и сравнивают её со здоровой ДНК. Затем ИИ помогает определить, какие мутации опухоли с наибольшей вероятностью способны вызвать иммунный ответ.

На основе этих мишеней Moderna создаёт индивидуальное мРНК-лечение, кодирующее до 34 неоантигенов, чтобы обучить иммунную систему распознавать и атаковать раковые клетки.

"Более ранние результаты фазы 2b уже были впечатляющими: через пять лет 68,8% пациентов оставались без рака по сравнению с 49,1% при использовании только KEYTRUDA. При этом комбинация снизила риск рецидива или смерти на 49%, а риск отдалённых метастазов или смерти — на 59%".

Теперь успешно завершилось и гораздо более крупное испытание 3-й фазы INTerpath-001 с участием 1 137 пациентов.

"Intismeran autogene (V940) от Merck и Moderna в сочетании с KEYTRUDA (пембролизумаб) значительно улучшила выживаемость без рецидива и выживаемость без отдалённых метастазов по сравнению с одной KEYTRUDA у пациентов с полностью удалённой меланомой стадий IIB–IV".

Испытание 3-й фазы достигло как основной конечной точки по выживаемости без рецидива, так и ключевой вторичной конечной точки по выживаемости без отдалённых метастазов.
24
This media is not supported in your browser
VIEW IN TELEGRAM
Qwen3.8-27B теперь работает со скоростью 70 токенов/с прямо на ноутбуке.

Вышел DFlash 2 — новое поколение спекулятивного декодирования на основе блочной диффузии.

DFlash 2 разгоняет Qwen3.8-27B до 70 токенов/с на MacBook Pro с M5 Max. Ускорение авторегрессионного декодирования достигает 4,6 раза, а итоговый вывод остаётся полностью идентичным исходной модели — буквально ни одного отличающегося токена. ⚡️

Уже доступны новые черновые модели для Qwen3.8-27B с нативной поддержкой SGLang, vLLM, llama.cpp и oMLX.

Суть подхода: https://inco.ai/blog/dflash2/
Please open Telegram to view this post
VIEW IN TELEGRAM
В стилях ответов Claude Code появился новый вариант — Concise. 🏎

Он делает ответы короткими и добавляет подробности только тогда, когда они нужны.

Включить его можно через /configOutput style или указать "outputStyle": "Concise" в settings.json.

https://code.claude.com/docs/en/output-styles
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Все топовые нейросети в одном окне без оплаты зарубежными картами

Нужно внедрить ИИ в команде за часы без регистрации и смс инженеров, валютных вложений и контрактов с разными вендорами? Сделайте это в пару кликов с помощью ИИ-роутера от Selectel.

Сервис дает доступ к большинству актуальных генеративных моделей с оплатой в рублях по потреблению.

Чем хорош сервис?

300+ ведущих ИИ-моделей от мировых вендоров;
один ключ для доступа ко всем моделям;
удобное управление расходами с возможностью установить лимиты для каждой нейросети;
политика нулевого хранения данных: промпты и ответы не хранятся и не используются для дообучения.

Внедрите ИИ в команде в пару кликов: https://slc.tl/krxr4

Реклама. АО "Селектел". erid:2W5zFHjSs2y
This media is not supported in your browser
VIEW IN TELEGRAM
Vercel выпустила своего агента для программирования под названием fx. 😏

Он идёт против нынешнего тренда — весит всего 6,3 МБ и запускается примерно за 10 микросекунд.

fx написан на Zig и распространяется как один автономный файл. Ему не нужны Node.js, Python и другие среды выполнения, а подключить его можно к любой модели — локальной или облачной.

Благодаря такой минималистичной архитектуре fx подходит для песочниц, тестирования моделей, оценки качества, обучения и внутренней инфраструктуры продуктов.

Есть даже версия для WebAssembly, которая весит меньше основной сборки: fx.sh/try

Исходный код открыт.

btw: GLM 5.2 можно использовать бесплатно до 27 августа, а GPT-5.6 Sol сейчас доступен со скидкой 50% в AI Gateway.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI добавили встроенную интеграцию с iMessage — теперь ChatGPT может читать и отправлять сообщения за вас.🤗

Он также умеет анализировать переписки.

Например, можно посмотреть, с кем вы общаетесь чаще всего и какие темы чаще всего обсуждаете с разными людьми.

А если связать iMessage с автоматизацией Codex на Mac, то ему можно буквально написать как человеку — он подхватит сообщение, выполнит задачу и пришлёт ответ обратно.
Please open Telegram to view this post
VIEW IN TELEGRAM
4
Please open Telegram to view this post
VIEW IN TELEGRAM
В OpenCode и OpenRouter появилась загадочная новая ИИ-модель: Ox Alpha 👍

Ее уже прогнали через 10 задач DeepSWE, и она набрала больше 80% против 65% у Fable и 52% у GPT-5.6 Sol.

Модель предлагает контекстное окно на 1 млн токенов, мультимодальные возможности, нулевое хранение данных и почти неограниченное использование в течение целой недели.

Скорее всего, за ней стоит китайская компания.

Бесплатно: https://openrouter.ai/stealth/ox-alpha
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
4
25 августа встречаемся на Agentic Coding Meetup в Сбер.Среде и в онлайне⚡️

AI-агенты уже умеют писать код. Но самое интересное начинается дальше — когда вместе с инструментами меняются роли инженеров, команды и сам процесс разработки.

🔥 Поговорим о том, как agentic coding выглядит на практике: новые инженерные роли и модели команд, SDD и трансформация процессов, coding-агенты и инструменты, подходы к постановке задач и управлению контекстом, а также опыт внедрения AI в разработку больших технологических компаний.

Начало в 17:00, встреча очных гостей — в 16:00.

Количество очных мест ограничено — успейте зарегистрироваться!
Сегодня день релизов 😨

DeepSeek выпустила DeepSeek-V4-Flash-Vision-Exp — экспериментальную мультимодальную модель, созданную для агентов, которым нужно видеть.

И по качеству на тестах визуальных агентов она уже вплотную приближается к Opus 4.8, а местами даже превосходит её. Хотя это всего лишь Flash-модель.

https://api-docs.deepseek.com/guides/vision/
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Codex достиг 20 миллионов активных пользователей.

В честь этого все пользователи Codex и ChatGPT Work получают кнопку сохранённого сброса лимита на выходные. 🤓
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Claude Mythos 5 впервые стал доступен за пределами Project Glasswing. 😨

Anthropic подключила свою самую мощную модель для кибербезопасности к Claude Security.

Достаточно указать репозиторий на GitHub, после чего Mythos 5 может проверить всю кодовую базу, отслеживать передачу данных между файлами, анализировать взаимодействие компонентов, находить уязвимости и предлагать исправления.
Please open Telegram to view this post
VIEW IN TELEGRAM
10
Forwarded from Data Portal | DS & ML
Офигеть, теперь даже игровой ПК может запускать передовые модели с интерактивной скоростью, используя официальные веса без экстремального квантования.

Исследователи из UC Berkeley, MIT и UT Austin открыли исходный код FreeToken — системы, специально созданной для запуска сверхбольших MoE-моделей на обычных компьютерах.

В статье они показывают очень впечатляющие результаты:

Qwen3.6 35B → ноутбук с RTX 4060 8 ГБ → 39 токенов/с

DeepSeek-V4-Flash 284B → RTX 5090 → 22–25 токенов/с

GLM-5.2 753B → RTX PRO 6000 → 15 токенов/с

По сравнению с Ollama скорость генерации выше в 3–4 раза, а обработка входного контекста — в 6–30 раз быстрее.

То есть игровой ноутбук всего с 8 ГБ видеопамяти уже может запускать модель на 35 млрд параметров почти на 40 токенах в секунду.

И это даже быстрее медианной скорости генерации Codex в 33 токена/с, которую авторы приводят в статье.

Главная идея FreeToken в том, чтобы заставить GPU, CPU, оперативную память и PCIe работать вместе.

Поскольку MoE-модели для каждого токена активируют только небольшую часть экспертов, нет необходимости постоянно держать сотни миллиардов параметров в видеопамяти.

FreeToken сам решает, какие части модели оставить в VRAM, какие временно переносить из оперативной памяти на GPU, а какие вообще считать на CPU.

На этапе обработки входного контекста система заранее загружает экспертов следующего слоя. Во время генерации она динамически распределяет вычисления в зависимости от текущей скорости CPU, GPU и PCIe.

Есть даже отдельный Agent State Cache.

Когда агент вызывает инструменты, меняет контекст или продолжает старую задачу, FreeToken может пропускать большую часть повторной обработки контекста.

FreeToken поставляется с полноценным графическим интерфейсом.

Не нужно конвертировать модели в GGUF или собирать проект из исходного кода.

Также в FreeToken Desktop уже встроены агентные обвязки - выбираете модель, выбираете приложение и запускаете.

https://arxiv.org/abs/2608.16157
Обновление по лимитам Codex.

OpenAI всё-таки нашла возможную причину того, почему у части пользователей на этой неделе лимиты начали улетать заметно быстрее.

Оказалось, у некоторых пользователей снизилась доля попаданий в кэш. А поскольку кэш сильно влияет на расход токенов, это вполне могло ускорить расход лимита.

В OpenAI уже разбираются и обещают завести обновление завтра.

Ну что ж.

Пять сохранённых сбросов каждому — и мы квиты.
This media is not supported in your browser
VIEW IN TELEGRAM
Инженер Anthropic, Тарик Шихипар, поделился навыком, который команда Claude Code в последнее время часто использует внутри компании — ELI5.

Он просит Claude объяснить тему так, будто человек вообще ничего о ней не знает, и создать для этого HTML-Artifact с крупными иллюстрациями и минимумом текста.

Использование:

/eli5 <тема, которую нужно объяснить>

Установка:

claude plugin marketplace add anthropics/claude-plugins-community

claude plugin install eli5@claude-community
6
Да ладно. Теперь Antigravity можно использовать прямо внутри VS Code. 🤯

Google выпустила официальное расширение Antigravity для VS Code.

То есть больше не нужно переходить в другой редактор — возможности Antigravity для программирования с ИИ теперь можно подключить прямо к VS Code.

И самое интересное, на бесплатном тарифе доступны Gemini, Claude Sonnet 4.6, Claude Opus 4.6 и GPT-OSS-120B, правда с лимитами на использование.

Забавно, что ещё несколько месяцев назад все обсуждали, как Antigravity заменит VS Code.

А теперь они буквально работают вместе. 😂
Please open Telegram to view this post
VIEW IN TELEGRAM
4
This media is not supported in your browser
VIEW IN TELEGRAM
Remote Control в Claude Code заметно прокачали. 👀

Теперь сессию можно запускать прямо со смартфона. Если на компьютере запущен claude remote-control, он появится карточкой устройства в верхней части вкладки Code. Нажимаете на неё, выбираете папку — и Claude Code запускается на этом компьютере.

Синхронизацию между телефоном и компьютером тоже улучшили. Если продолжить сессию на ПК, на смартфоне она останется активной и не уйдёт автоматически в архив. После завершения Claude Code статус "не в сети" появляется уже через несколько секунд.

При обрыве соединения Remote Control теперь переподключается автоматически. Например, если закрыть ноутбук или переключиться на другую сеть Wi-Fi.

Модель и уровень усилий теперь синхронизируются между смартфоном и командной строкой, а тяжёлые сессии на iOS открываются быстрее.

Команды с / на телефоне тоже улучшили.

/clear сбрасывает отображение
/compact показывает отметки сжатия контекста
/diff открывает встроенное окно с изменениями

Подробная документация - https://code.claude.com/docs/en/remote-control
Please open Telegram to view this post
VIEW IN TELEGRAM
2