very vibe coding
121 subscribers
462 photos
126 videos
13 files
990 links
Канал Алексея Макрушина об экспериментах в области vibe coding и всего интересного, что есть в области AI, ML и тому подобного
Download Telegram
Forwarded from Machinelearning
🚀 OpenAI представила GPT-5.5 -

Она заметно сильнее в самом главном: код, ресёрч, аналитика и работа с документами. И почти во всём обходит конкурентов - например, на Terminal-Bench выбивает 82,7% против 69% у свежей Claude.
GPT-5.5 уже доступна пользователям Plus, Pro, Business и Enterprise - в ChatGPT и Codex.

Тестим! 🔥

https://openai.com/index/introducing-gpt-5-5/
О, ну наконец. И DeepSeek V4 тоже вышел )) большой и маленький - на 1.6Т и 284В параметров..

Ну что можно сказать.. Программировать будем, как и раньше, с Клодом да Джипити (больше с последним), а для остального появилась умная и недорогая модель.

Это для тех, кому нужен API..
🔥1
Не дипсиком единым.. У Xiaomi тоже вышла интересная опенсорсная модель MiMo V2.5 Pro уровня DeepSeek V4. Если не ошибаюсь, они как раз переманили крутых ребят из самого дипсика..
⚡️ Вместо того чтобы сегодня вечером смотреть сериалы, потрать день на прокачку Claude.

Claude 101:
http://claude101.com

→ Уровень 1 - 24 минуты: база

Claude для новичков:
https://ruben.substack.com/p/claude-for-dummies

Настройка Claude:
http://how-to-claude.ai

→ Уровень 2 - 1 час: реальные workflows

Claude Cowork:
http://claude-co.work

Claude для команд:
http://how-claude.team

Claude Design:
http://claudedesign.free

Cowork + Projects:
https://ruben.substack.com/p/claude-cowork-project

Claude для слайдов:
http://how-to-gamma.ai

Claude Skills:
http://claude-skills.free

→ Уровень 3 - 3,5 часа: pro-приемы

Как избегать подхалимства модели:
https://ruben.substack.com/p/i-love-to-be-right

Claude Code:
http://claudecode.free

Claude 101:
https://anthropic.skilljar.com/claude-101

Как не упираться в лимиты Claude:
https://ruben.substack.com/p/how-to-stop-hitting-claude-usage

Хватит просто промптить:
https://ruben.substack.com/p/stop-prompting-claude

→ Уровень 4 - 8 часов: экспертный режим

Claude Computer:
https://ruben.substack.com/p/claude-computer

Разработка с Claude API:
https://anthropic.skilljar.com/claude-with-the-anthropic-api
Please open Telegram to view this post
VIEW IN TELEGRAM
❤1👍1🔥1
В начале года кассу сорвал OpenClaw, теперь вирусится другой агент - Hermes. Фишка в том, что в него встроен цикл самоулучшения. Народ хвалит при локальном использовании с Qwen 3.6 27B

https://github.com/NousResearch/hermes-agent
🤖 Everything Claude Code: AI Agent Optimization System

Мощная система оптимизации для AI-агентов, победитель хакатона Anthropic. Включает навыки, память, безопасность и непрерывное обучение, обеспечивая готовых к производству агентов и конфигурации. Поддерживает Claude Code, Codex и другие.

🚀 Основные моменты:
- Полная система для AI-агентов
- Оптимизация памяти и навыков
- Безопасность и сканирование уязвимостей
- Поддержка нескольких языков программирования
- Интенсивно использовалась для реальных продуктов

📌 GitHub: https://github.com/affaan-m/everything-claude-code
Для любителей попробовать что-то новенькое. DeepSeek до 5 мая снизил цены на свои модели по API в 4 раза, при том, что они и раньше были одними из самых дешевых на рынке. Получается меньше доллара за выходящий миллион токенов (для сравнения - у GPT 5.5 это стоит 30 долларов).

Плюс к этому еще и выложил специальный раздел по API для Антропика - чтобы использовать модели вместе с Claude code. Пробуем?

https://api-docs.deepseek.com/quick_start/pricing
Forwarded from Machinelearning
📌 Гайд по промптингу GPT-5.5: старые промпты придётся переписать.

GPT-5.5 отличается от GPT-5.2 или GPT-5.4 в части промптнинга. Миграцию OpenAI советует начинать с минимального промпта, который решает задачу, и только потом донастраивать reasoning effort, описания инструментов и формат вывода.

GPT-5.5 рассуждает эффективнее предшественников, поэтому сначала стоит проверять уровни «low» и «medium», а к более высоким тянуться только при необходимости.

Старые промпты часто расписывают процесс шаг за шагом: прежним моделям требовались подробные инструкции. Для GPT-5.5 это сужает пространство поиска и как следствие даст механические ответы.

OpenAI предлагает прописывать целевой результат, критерии успеха, ограничения и доступный контекст, а как добраться до результата, модель решит сама.

Слова «ALWAYS» и «NEVER» советуют беречь для настоящих инвариантов: правил безопасности и обязательных полей вывода. Для остального - правила и явные ограничители, чтобы модель не зацикливалась в бесконечных лупах.


Рекомендованная структура промпта открывается ролью и контекстом, дальше идут Personality, Goal, Success criteria, Constraints, Output и Stop rules.

Внутри блока Personality гайд просит разделять 2 измерения: как ассистент звучит (тон, формальность, юмор) и как он работает - когда уточнять, когда делать допущения и как обходиться с неопределённостью.

Поведение при поиске и цитировании

OpenAI вводит понятие retrieval budgets: один широкий поиск по коротким ключевым словам, повторный - только если не хватает фактов, нужен конкретный документ или пользователь просил исчерпывающий обзор.

Для презентаций и маркетинговых текстов руководство рекомендует чётко делить утверждения: где нужны источники, а где можно писать свободно.

Для стриминговых интерфейсов гайд предлагает preambles — короткие пользовательские апдейты в одно-два предложения перед первым вызовом инструментов. Они не ускоряют модель, но заметно сокращают воспринимаемую задержку.

Переписывать всё вручную не обязательно. OpenAI опубликовала собственный Skill для Codex и других кодинг-агентов - он применяет правила нового гайда одной командой.


@ai_machinelearning_big_data

#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Поставил себе новомодного агента - Hermes. Чем дальше, тем проще все ставится. Подключил к ChatGPT по подписке (можно Gemini). А вот Антропик, хоть и подключается к Claude code, работает по API. Жгучее желание есть перейти на GPT, но подписка за 20 баксов расходуется так экономно, что ее пока хватает..
👍2
О, меня забанил Антропик. Интересно с чего это. Подпишусь на большую подписку у ChatGPT, а вот подписываться ли на Антропик с другого эккаунта - подумаю... свет клином не сошелся
Привык, конечно, к Клоду. Но может, пришло время экспериментов..
Выйти из зоны комфорта..
Forwarded from эйай ньюз
У Сбера вышел Kandinsky 6.0 Image Pro.

Главный апдейт тут в editing. В side-by-side модель сравнивают с Flux 2 Max и GPT Image 1.5, причём оценивают конкретные вещи: как правка встраивается в сцену, сохраняются ли стиль, геометрия, лицо, фон и локальная консистентность. Именно на этом обычно сыпятся image editing модели.

По скорости тоже прирост: больше 40% к прошлой версии за счёт MoE, распараллеливания инференса и оптимизации внимания.

Самая интересная часть — Image RAG. Модель подтягивает релевантные изображения в контекст и точнее попадает в специфические штуки, которые в обычной генерации легко превращаются во «что-то примерно славянское».

Из кейсов: удаление объектов и надписей, замена предметов с сохранением стиля, стилизация с сохранением лица, реставрация архивных фото, интерьеры по плану и фасады одним промтом.

Анонс

@ai_newz
В связи с баном от Антропика встает вопрос - что дальше. Подписчики хотят, чтобы потестил локальные модели - я тоже хочу, но жду выхода Mac Studio M5 Ultra. Должны выпустить в июне, но могут и отложить из-за дефицита памяти. Но вообще, предложения интересные по железу есть..
Очень интересная тема - пытался сделать что-то похожее, но как у вайбкодеров принято, остановился на полпути. Файловая система с графами и RAG

https://x.com/supermemory/status/2049330931564208249?s=46
32 тысячи звёзд на GitHub всего за 10 часов!

Терминал Warp открыли в open-source.

Это одна из самых заметных agentic development environment: терминалом уже пользуются больше 1 млн разработчиков по всему миру. Теперь проект хотят развивать быстрее за счёт комьюнити, внешних контрибьюторов и прозрачной разработки.

open-source-релиз стал возможен при поддержке OpenAI, которые выступили главным спонсором проекта.

Реакция комьюнити мощная: репозиторий за несколько часов собрал уже 30+ тысяч звёзд на GitHub.

И, конечно же, он написан на Rust.

https://github.com/warpdotdev/warp
Forwarded from Machinelearning
This media is not supported in your browser
VIEW IN TELEGRAM
⚡️ Sakana AI научила голосовой ИИ думать на ходу

Японская Sakana AI показала KAME - систему, которая может заметно изменить голосовых ассистентов. Работу уже приняли на ICASSP 2026, и идея там очень простая: ИИ должен не сначала долго думать, а потом говорить, а думать прямо во время разговора.

Сейчас у голосовых моделей есть неприятный компромисс. Быстрые speech-to-speech системы отвечают почти мгновенно, но часто звучат поверхностно. А если подключить мощную языковую модель, ответ становится умнее, но появляется пауза, которая ломает живой диалог.

KAME пытается убрать этот выбор между скоростью и качеством.

Авторы взяли за основу то, как говорят люди. Мы редко строим идеальную фразу целиком перед тем как ее сказать. Обычно начинаем говорить, а мысль уточняется уже по ходу предложения. Sakana AI перенесла этот принцип в архитектуру голосового ИИ.

Система работает в два потока. Лёгкая речевая модель сразу начинает отвечать, чтобы не было неловкой задержки. А параллельно большая языковая модель думает глубже и в реальном времени подмешивает более сильные варианты в речь. Получается, что ассистент не просто выдаёт готовую реплику после паузы, а ведёт разговор и дорабатывает мысль на лету.

Отдельно интересно, что бэкенд можно менять. Нужна логика - подключаешь Claude. Нужна скорость - берёшь Gemini Flash. Нужен другой стиль ответа - ставишь GPT. При этом сам голосовой слой не приходится пересобирать.

В экспериментах разные модели показали себя по-разному: Claude лучше справлялся с задачами на рассуждение, GPT сильнее выглядел в гуманитарных вопросах. То есть движок можно выбирать под конкретный сценарий, а не пытаться одной моделью закрыть всё.

KAME уже выложили на Hugging Face. Это идея из статьи, а штука, которую можно проверить руками.

Если подход взлетит, голосовые ассистенты станут гораздо ближе к нормальному разговору: без долгих пауз, но и без ощущения, что модель просто быстро болтает ни о чём.

Blog: https://pub.sakana.ai/kame/
Paper: https://arxiv.org/abs/2510.02327

@ai_machinelearning_big_data

#sakana
Please open Telegram to view this post
VIEW IN TELEGRAM