Данил Щуцкий | CutCode AI
139 subscribers
7 photos
2 videos
97 links
Внедряю AI в бизнес-процессы без хаоса и бесполезных демо.
Инженерный подход:
процесс → данные → MVP → внедрение.
Малый и средний бизнес.
✉️ - @leeto_telegram
Download Telegram
У Codex появились питомцы 🐾

В Codex добавили Codex Pets - маленьких анимированных персонажей, которые показывают статус агента.

Работает агент, ждет ответа или уже готов к ревью - теперь это можно понять не только по логам, но и по питомцу.

Включается через /pet, настройки Appearance → Pets или командное меню Cmd/Ctrl + K.

Питомцев можно создавать самому.
А еще появился отдельный сайт-каталог codex-pets.net. Там можно выбрать питомца и добавить его в терминал одной командой.

Выглядит как игрушка, но фича полезная: когда агент работает в фоне, важно быстро понимать, что с ним происходит.

Раньше были логи и статусы.
Теперь - котик, который сообщает, что Codex закончил задачу.

Tamagotchi-driven development подъехал.
🥰3😍3💯32🤩2👍1🎉1
🔥 AI-дайджест от CutCode за 7 мая

🤖 Anthropic выпустила шаблоны агентов для финансовых задач
Anthropic показала десять готовых шаблонов агентов для финансовых сервисов: от подготовки pitchbook и проверки KYC-файлов до закрытия книг в конце месяца. Обновление связано с Claude Opus 4.7, который набрал 64.37% в бенчмарке Vals AI Finance Agent benchmark.

🍎 Apple согласилась выплатить 250 миллионов долларов по иску о Siri
Apple заключила мировое соглашение на 250 миллионов долларов по коллективному иску о задержке функций более персонализированной Siri. Владельцы iPhone 15 и iPhone 16 в США, купившие устройства между июнем 2024 года и мартом 2025 года, смогут получить от 25 до 95 долларов за устройство.

💸 OpenAI планирует потратить 50 миллиардов долларов на вычисления в 2026 году
OpenAI, по словам Грега Брокмана, собирается направить около 50 миллиардов долларов на вычислительную инфраструктуру в 2026 году. В оценке отдельно упоминаются закупки чипов и рост расходов на инференс, что показывает масштаб подготовки компании к следующему этапу обучения и запуска моделей.

#CutCode #AI #AIAgents #AIНовости #Anthropic

Подписывайся - @CutCode_AI
💯6🥰43🔥2🤩2👍1😍1❤‍🔥1
🔥 Reddit-дайджест от CutCode за 7 мая

📊 Автор собрал harness-bench для llama.cpp и проверил Qwen3.6-27B на 16 задачах
Автор собрал бенчмарк harness-bench для local LLM в llama.cpp llama-server и прогнал 1360 запусков на одном M3 Max с 128 ГБ памяти. Связка Qwen3.6-27B и pi стала единственной, которая закрыла все 16 задач; один прогон занимал около 207 секунд.

🧠 Пользователь собрал три браузерные игры с Claude, одна из них набрала 25 млн запусков
Автор пишет, что раньше не умел кодить, а первый рабочий прототип игры получил через шесть часов после промпта в Claude через Cursor. Две из трёх игр выросли до HTML-файлов по 8000 строк, а одна из них набрала 25 млн запусков.

🧰 Пользователь ускорил Qwen3.6-27B до 50 токенов в секунду на RTX 3090
Автор показывает запуск Qwen3.6-27B с контекстом 100000 на RTX 3090 и получает 50 токенов в секунду в llama.cpp. В посте также указан GGUF-сборка и патч из запроса на слияние 22673 для llama.cpp.

#CutCode #AI #AIРазработка #LocalLLM #Qwen

Подписывайся - @CutCode_AI
👍3🥰3🔥2❤‍🔥21🎉1🤩1😍1
🧠 Anthropic и SpaceX договорились о вычислительных мощностях — и это уже влияет на Claude

Anthropic получил доступ ко всей вычислительной мощности Colossus 1 в Мемфисе. Это больше 300 мегаватт ресурсов, а в перспективе компания ещё рассматривает гигаваттные мощности в космосе.

По сути это значит одно: у Anthropic становится больше вычислительных ресурсов, а значит меньше шансов, что Claude Code упрётся в лимиты в самый неудобный момент.

Что уже изменили:

1. В тарифах Pro, Max и Team удвоили 5-часовые лимиты Claude Code;
2. В Pro и Max убрали снижение лимитов в часы пик;
3. Для программного интерфейса с моделями Opus лимиты тоже заметно подняли.

На этом фоне сделка особенно заметна: раньше Маск открыто критиковал Anthropic, а вокруг Colossus 1 были скандалы из-за экологии и газовых турбин без нужных разрешений. Теперь же два игрока, которые ещё недавно были по разные стороны конфликта, фактически завязаны на одной инфраструктурной теме.

Итог: Claude становится стабильнее в работе, Anthropic усиливает позиции в гонке с OpenAI и Google, а конкуренция на рынке ИИ только ускоряется. 🚀
🔥7😍4🎉3🥰2🤩2❤‍🔥2💯21
🔥 AI-дайджест от CutCode за 8 мая

💼 Anthropic подняла лимиты Claude и заключила сделку со SpaceX по вычислениям
Anthropic сообщила о партнёрстве со SpaceX и доступе к более чем 300 мегаваттам новой мощности в дата-центре Colossus 1, что включает свыше 220 000 GPU NVIDIA. Компания также удвоила пятичасовые лимиты Claude Code для Pro, Max, Team и seat-based Enterprise, а для Claude Opus заметно подняла API rate limits. Дата анонса — 6 мая 2026 года.

🤖 Google закрыла Project Mariner и перенесла его функции в Gemini Agent
Google отключила Project Mariner: на странице проекта указано, что его закрыли 4 мая 2026 года, а технологии переехали в другие продукты компании. Раньше эксперимент умел выполнять до 10 задач одновременно, а его возможности теперь встроены в Gemini Agent и AI Mode.

⚖️ Mira Murati заявила суду, что Sam Altman говорил ей неправду о проверке модели
Бывшая техническая директор OpenAI дала показания под присягой в деле Musk v. Altman и сказала, что Sam Altman сообщил ей неверные сведения о безопасности новой модели. В показаниях также фигурирует упоминание 52-страничной записки и спор о том, должна ли модель проходить через совет по деплою.

🛠️ Spotify запустила бета-инструмент для импорта подкастов от агентов
Spotify разрешила загружать в приложение персональные подкасты, созданные агентами вроде Codex, Claude Code и OpenClaw, через новый CLI-инструмент в бете. После импорта выпуски появляются в личной библиотеке и остаются недоступны другим пользователям. Материал опубликован 7 мая 2026 года.

#CutCode #AI #AIAgents #AIНовости #Anthropic

Подписывайся - @CutCode_AI
🎉4👍3🥰3😍31🔥1❤‍🔥1💯1
🔥 Reddit-дайджест от CutCode за 8 мая

🔒 Google Chrome незаметно установил 4 ГБ ИИ-модель на устройства пользователей
Исследователь пишет, что Google Chrome записывает на диск файл с ИИ-моделью размером 4 ГБ без запроса на согласие. В материале это сравнивают с похожим поведением вокруг Claude Desktop, где расширения и мосты появлялись на машинах пользователей без отдельного диалога.

#CutCode #AI #Google #LocalLLM #Безопасность

Подписывайся - @CutCode_AI
4🔥2🎉2❤‍🔥2👍1🥰1🤩1😍1💯1
🔥 AI-дайджест от CutCode за 9 мая

⚖️ Anthropic Institute опубликовал повестку исследований ИИ
Anthropic Institute изложил четыре направления работы: экономическое распространение, угрозы и устойчивость, ИИ в реальной среде и ИИ-исследования. В документе от 7 мая 2026 года команда пишет, что уже видит, как в Anthropic меняются задачи вроде разработки софта и ускоряется собственное R&D ИИ.

🧠 OpenAI выпустила три новых голосовых модели для Realtime API
OpenAI добавила GPT-Realtime-2, GPT-Realtime-Translate и GPT-Realtime-Whisper для рассуждений, перевода и распознавания речи в реальном времени. У GPT-Realtime-2 контекстное окно выросло с 32 000 до 128 000 токенов, а режим рассуждений доступен на пяти уровнях.

📱 Google превратила Fitbit в приложение Google Health
Google перевела приложение Fitbit в Google Health app и открыла доступ к новому ИИ-коучу для здоровья. Обновление начнёт раскатываться 19 мая, а данные о фитнесе и самочувствии соберут в одном интерфейсе с четырьмя вкладками.

🚀 Google показала экранный Fitbit Air за 100 долларов
Google представила Fitbit Air — браслет без экрана за 100 долларов, который измеряет пульс, вариабельность сердечного ритма, насыщение крови кислородом и фазы сна. Устройство весит 12 граммов и работает до недели, а быстрая зарядка за 5 минут даёт ещё день автономности.

💼 Cloudflare сокращает более 1100 сотрудников из-за ИИ
Cloudflare объявила о сокращении более 1100 сотрудников, то есть примерно 20% штата, и связала решение с агентным ИИ. В первом квартале выручка компании составила 640 миллионов долларов против 622 миллионов по ожиданиям аналитиков, а доля использования ИИ за три месяца выросла более чем на 600%.

💸 Nintendo поднимает цену Switch 2 на 50 долларов
Nintendo повысит цену Switch 2 в США с 449,99 до 499,99 доллара с 1 сентября и ожидает продажи 16,5 миллиона устройств в 2027 финансовом году. Компания связала пересмотр цен с дефицитом памяти и ростом цен на чипы на фоне глобального строительства дата-центров для ИИ.

#CutCode #AI #AIНовости #Hardware #AIAgents

Подписывайся - @CutCode_AI
🔥4🎉4🤩4💯4😍3👍2🥰2
🔥 Reddit-дайджест от CutCode за 9 мая

🧠 Сообщество выложило Qwen3.6 35B A3B с сохранённым Native MTP и новыми форматами
Автор публикации выложил Qwen3.6 35B A3B в варианте uncensored heretic с сохранённым Native MTP. В описании указаны KLD 0.0015, 10 из 100 отказов и сохранение всех 19 MTP. Модель доступна в safetensors, GGUF, NVFP4, NVFP4 GGUF и GPTQ-Int4.

#CutCode #AI #LocalLLM #OpenSource #Qwen

Подписывайся - @CutCode_AI
❤‍🔥4👍3🥰3🎉3🤩2😍2🔥1💯1
🔥 Reddit-дайджест от CutCode за 10 мая

📊 Пользователь показал 80 токенов в секунду и контекст 128К на 12 ГБ видеопамяти
В связке с последней сборкой llama.cpp и патчем MTP пользователь получил свыше 80 токенов в секунду на 12 ГБ видеопамяти. В тесте он также отметил более 80% принятия черновиков и контекстное окно 128К.

#CutCode #AI #LlamaCpp #LocalLLaMA #Бенчмарки

Подписывайся - @CutCode_AI
😍43🤩3💯3🔥2🥰2👍1🎉1
🎙️ OpenAI собрала работу с голосом в один рабочий контур
GPT-Realtime-2, GPT-Realtime-Translate и GPT-Realtime-Whisper закрывают разговор, перевод и streaming speech-to-text.

И вот здесь уже видно, зачем это разработчику. Один Realtime-стек убирает лишнюю склейку между диалогом, переводом и транскрипцией. Меньше отдельных сервисов вокруг, меньше мест, где всё ломается на задержке или теряется контекст.

GPT-Realtime-2 держит разговор и тянет более сложные запросы с GPT-5-class reasoning. GPT-Realtime-Translate переводит речь в реальном времени с 70+ входных языков в 13 выходных. GPT-Realtime-Whisper делает live speech-to-text, пока спикер говорит.

Отдельный практический момент, который уже нельзя списать на маркетинг: Realtime API поддерживает EU Data Residency и стоит на 20% дешевле gpt-4o-realtime-preview. Для продакшена это как раз те вещи, из-за которых интеграцию обычно откладывают.

Вывод: OpenAI двигает voice из демо в слой, который можно реально встраивать в саппорт, операторские интерфейсы и мультиязычные продукты. И этот стек очень полезен там, где нужен один контур для речи, перевода и текста, а не игрушка для красивого демо.
👉 @CutCode_AI
🎉8👍2🔥21🤩1
🤖 Интересное обновление в Telegram

Telegram открыл ботам вход в любой чат по @, даже если они не участники диалога. Но с ограничением: бот видит только те сообщения, где его упомянули, и ответы на них.

Для меня, как разработчика это уже не «бот в личке», а кусок рабочей схемы внутри обычной переписки. Например, бот-ресепшн принимает запрос, бот-проверка смотрит контекст, бот-исполнитель оформляет результат в том же чате. Человека между ними может не быть вообще. И всё это внутри Telegram.

Самое важное здесь даже не сам вызов по @, а связка bot-to-bot. Это уже нормальная автоматизация внутри живого диалога, а не один скрипт, который отвечает в лоб. Telegram ещё и обновил Bot API, так что это не обходная схема сверху, а новая основа на уровне протокола.

Вывод: Telegram перестал держать ботов в декоративной роли. Теперь это рабочая среда для процессов, где у каждого бота есть границы и маршрут. И это меняет не «умность» ботов, а то, как вообще можно собирать интеграции в мессенджере. Уже начал дорабатывать своего Telegram-агента 😎

👉 @CutCode_AI
🎉12👍7🔥5🤩32
This media is not supported in your browser
VIEW IN TELEGRAM
🛠 Claude Code дал возможность наблюдать за субагентами

Когда агентов несколько, их сложно контролировать: кто ждёт ввод, кто ещё работает, кто уже отдал результат. Agent view собирает это в одном месте и сразу показывает, что происходит с каждой сессией.

В списке видны последняя реплика, время последнего контакта и состояние сессии. Оттуда же можно открыть полный транскрипт.

Для разработчика это меняет повседневную работу в терминале. Вместо россыпи вкладок и ручных пометок остаётся один диспетчер для параллельных задач. Это особенно заметно, когда несколько агентов уже работают одновременно и надо не терять контекст между ними.

Это полезно: Claude Code чинит самое больное место AI-инструментов в разработке, управление параллельным потоком. Сгенерировать агента уже не проблема, а вот удержать контроль над десятком сессий уже совсем другая задача. Именно здесь такие инструменты обычно и ломаются.
👉 @CutCode_AI
🤩54🔥3🎉2👍1
GPT-5.5 против Claude Opus 4.7

Новый ролик на YouTube. Топовые модели получили один и тот же coding benchmark.
Обе проучили reasoning на максимум, и интрига держалась до самого конца.
Кто выиграл — смотри в видео👇
https://youtu.be/97EDYPWEXm0
🔥5👍3🎉3🤩32
⚡️ Andrej Karpathy переходит в Anthropic и, по данным CNBC, сразу подключается к pretraining-команде. Его задача — использовать Claude, чтобы ускорять research и обучение следующего поколения моделей.

Это важный сигнал: AI-гонка всё сильнее смещается от красивых демо к данным, пайплайнам, экспериментам и качеству pretraining. Если подход Anthropic сработает, преимущество будет расти прямо внутри процесса обучения.
🔥94🤩4👍3🎉1
У Google пачка апдейтов, и главное тут три штуки.

1. Gemini 3.5 Flash
Опять обещают прорыв в кодинге — посмотрим в деле.
Но есть ощущение, что модель может получиться сильной. Особенно с учётом того, что Gemini у Google уже умеет хорошо удивлять.

2. Antigravity 2.0
Систему пересобрали, переписали на Go, добавили параллельных агентов, dynamic subagents и Scheduled Tasks.
По сути, просто догнали Claude Code и Codex.
Хотя важный нюанс: Antigravity сейчас лёг, так что протестить всё это пока нельзя.

3. Gemini Omni
Похоже, это новая SOTA-модель для генерации видео.
Формулировка простая: Nano Banana, но для видео. И это уже звучит интересно.

Вывод:
Самое вкусное тут не Antigravity, а связка Gemini 3.5 Flash + Omni. Особенно если Flash реально окажется сильной мультимодальной моделью.
4👍3🎉3🤩2🔥1
🇨🇳 Alibaba выкатили Qwen3.7-Max - и это уже не просто очередной чат-апдейт, а модель под агентные задачи.

Самый жирный кейс из релиза:
35 часов автономной работы, 1158+ tool calls и самостоятельная оптимизация CUDA-ядра под длинный контекст.
Итог - x10 ускорение инференса.

По цифрам тоже ок:

• 1M токенов контекста
• только текст
• мультимодальности нет

На SWE-bench Pro - 60.6%. Это выше DeepSeek V4-Pro, но ниже Claude Opus 4.7.

Интересно и то, что Qwen прогнали через OpenClaw, Claude Code и Hermes - разброс всего около 6 пунктов. Значит, модель довольно стабильна.

Главный вопрос теперь не про чат, а про реальную кодовую задачу: дотянет ли модель фронт, бэк, отладку и многошаговые tool calls до конца.

В целом Qwen двигается в правильную сторону. Но решать по-прежнему будет не только модель, а вся обвязка вокруг неё.
7🤩5👍2🔥2🎉2
Сегодня весь день Claude и Codex работали над сложной задачей и в итоге впервые оба отчитались, что не смогли найти решение. Я такого еще не видел, но задача была действительно нелегкой. Примечательно, что Claude в итоге исправил README проекта, где указал этот кейс и сообщил о том, что задача невыполнима. Поскольку я готовлю баттл Gemini/Qwen/GPT/Opus и у меня открыт Antigravity CLI, то просто ради эксперимента закинул такую же задачу. По инпуту она была один в один, так как работал велась через ai-factory, и план не менялся! Ну, в целом, я в шоке. Gemini 3.5 Flash (medium) за 2 итерации решил проблему, а на 3-й довёл её до идеала. Я при этом следил за tool calling и настолько глубокого исследования проблемы еще не встречал ни в одном агенте. В итоге я просто просидел минут 10 вот с такими глазами 😳! Можно подумать, что очередной рандом, но Claude и Codex пыхтели весь день, там под 30 итераций и никак! Честно говоря, на Gemini вообще не было ставки. Теперь интересно, как он себя покажет на баттле.
15👍12🔥5🎉4🤩3🤯1
Новый coding battle на CutCode

Новые модели пришли с красивыми фирменными бенчмарками, где они доминируют по всем показателям. Поэтому я взял нашего чемпиона GPT-5.5 против новичков - Gemini 3.5 Flash и Qwen 3.7 Max и отправил их не в синтетическую табличку со столбиками, а в реальную задачу: endpoints, PDF, ограничения по версиям, Postgres, Docker sandbox, performance и ревью качества кода.

На старте у каждой модели есть причина выглядеть фаворитом. В ролике есть дисквалификации, второй шанс и финал, который лучше не спойлерить:
https://www.youtube.com/watch?v=NaEoiWCOdGs
🤩9👍86🔥5🎉3
⚙️ Claude Opus 4.8 вышел с штукой, которая для продакшн-агентов важнее любой красивой цифры — теперь можно управлять effort

То есть модель можно просить работать легче или, наоборот, выкладываться по максимуму прямо внутри продукта. Без лишней обвязки вокруг промпта.

И это реально меняет практику.
Где задача простая — не жжёшь лишние ресурсы.
Где ошибка дорогая — включаешь тяжёлый режим.
Тут уже речь не про “умнее”, а про то, насколько модель можно нормально контролировать в бою.

В Claude Code ещё добавили dynamic workflows для очень больших задач. И вот это, пожалуй, самое прикладное в релизе: длинные цепочки шагов, инструменты, промежуточные решения, риск потерять контекст — всё то, где agentic-сценарии обычно и разваливаются.

Anthropic также пишет, что ранние тестеры считают Opus 4.8 более надёжным и более точным в agentic tasks.
А fast mode теперь работает в 2.5 раза быстрее и стоит в 3 раза дешевле, чем у прошлых моделей.

И вот это уже не косметика, а вполне практичный апдейт: такие вещи реально делают автоматизации дешевле и проще в проде.

Мой вывод: Opus 4.8 важен не самими бенчмарками, а тем, что делает агентные сценарии более предсказуемыми и менее дорогими. Но настоящая ценность раскроется только там, где уже есть нормальная обвязка, контроль шагов и процесс. Один промпт тут не спасёт.
9🎉9🔥5👍2🤩2