Данил Щуцкий | CutCode AI
139 subscribers
7 photos
2 videos
97 links
Внедряю AI в бизнес-процессы без хаоса и бесполезных демо.
Инженерный подход:
процесс → данные → MVP → внедрение.
Малый и средний бизнес.
✉️ - @leeto_telegram
Download Telegram
🔥 Reddit-дайджест от CutCode за 4 мая

🧠 Пользователь дообучил Qwen3-32B под более «человечный» стиль ответа
Автор описывает версию Assistant_Pepe_32B на базе Qwen3-32B, которую настраивали под асистента без привычного «ассистентского» поведения. В основе — смещение в сторону негативного уклона, чтобы снизить поддакивание и сделать ответы менее сглаженными.

💼 В сети всплыл AMD Ryzen AI Max Pro 495 с 192 ГБ памяти
Утечка приписывает Ryzen AI Max Pro 495 встроенную графику Radeon 8065S и конфигурацию с 192 ГБ памяти. В обсуждении это связывают с более тяжелыми локальными моделями и запасом под большие плотные веса.

#CutCode #AI #AMD #Hardware #LLM

Подписывайся - @CutCode_AI
🔥52🤩2👍1🥰1😍1❤‍🔥1
🔥 AI-дайджест от CutCode за 5 мая

📊 Исследователи Harvard сравнили OpenAI o1 с врачами на 76 случаях из приёмного покоя
В работе, опубликованной 30 апреля 2026 года в Science, OpenAI o1 проверили на 76 экстренных случаях из больницы Beth Israel в Бостоне. На этапе сортировки модель дала точный или почти точный диагноз в 67% случаев против 55% и 50% у двух врачей, а затем её сравнили ещё на этапе первого контакта и перевода в отделение.

#CutCode #AI #LLM #OpenAI #Бенчмарки

Подписывайся - @CutCode_AI
🔥4👍3🤩3🥰2❤‍🔥2💯1
🔥 AI-дайджест от CutCode за 6 мая

💼 Coinbase сократит 14 процентов штата и перестроит работу вокруг AI
Coinbase увольняет около 700 сотрудников, то есть 14 процентов штата, и закладывает на это $50–60 млн расходов на выходные пособия. Компания также урезает уровни управления до пяти ступеней ниже CEO и COO и тестирует «команды из одного человека» с AI-инструментами.

💼 Anthropic запустит сервисную компанию для внедрения Claude в бизнесе
Anthropic, Blackstone, Hellman & Friedman и Goldman Sachs объявили о создании новой AI-сервисной компании для средних предприятий. В сообщении от 4 мая 2026 года говорится, что команда Anthropic будет помогать строить кастомные решения и внедрять Claude в ключевые процессы клиентов.

🧠 Сооснователь Anthropic оценил шанс самопостроения AI к 2028 году
Джек Кларк написал 4 мая 2026 года, что вероятность автономного AI-исследования, которое сможет построить своего преемника, он оценивает выше 60 процентов к концу 2028 года. В тексте он связывает это с уже видимым переходом части R&D-задач к AI-системам.

🍎 Apple ищет Intel и Samsung для выпуска своих чипов в США
Apple ведет ранние переговоры с Intel и Samsung, чтобы получить запасные варианты для выпуска основных чипов в США. В материале также сказано, что TSMC делает примерно три четверти мировой полупроводниковой продукции, а Apple уже осматривала завод Samsung в Тейлоре стоимостью $17 млрд.

💸 Грег Брокман оценил свою долю в OpenAI почти в 30 миллиардов долларов
В суде Грег Брокман заявил, что его доля в OpenAI стоит почти $30 млрд. Он также рассказал о финансовых связях с Сэмом Альтманом, а защита Илона Маска использует эти данные, чтобы спорить о независимости Брокмана.

⚖️ Сотрудники Google DeepMind проголосовали за профсоюз из-за военных контрактов
В лондонском офисе Google DeepMind за объединение в профсоюз проголосовали 98 процентов членов CWU. Инициатива охватывает как минимум 1000 сотрудников и направлена против использования технологий лаборатории в интересах армии США и Израиля.

🔒 Meta начала проверять возраст пользователей по фото и видео с помощью AI
Meta запускает AI-проверку возраста по фото и видео в США, 27 странах ЕС и Бразилии. Система ищет визуальные признаки вроде роста и строения костей, чтобы выявлять аккаунты пользователей младше 13 лет и удалять их.

#CutCode #AI #AIНовости #ИИвБизнесе #Anthropic

Подписывайся - @CutCode_AI
🔥4🥰3🎉2😍2❤‍🔥2💯2
🔥 Reddit-дайджест от CutCode за 6 мая

🧪 Google выпустила MTP-черновики для Gemma 4 и ускорила инференс до 3 раз
Google представила Multi-Token Prediction для семейства Gemma 4 и пишет, что такие drafter-модели дают до 3× ускорения без потери качества вывода и логики рассуждений. В статье также указано, что за первые недели Gemma 4 набрала более 60 миллионов загрузок. Ускорение проверяли на LiteRT-LM, MLX, Hugging Face Transformers и vLLM.

⚖️ США договорились проверять модели Google DeepMind, Microsoft и xAI до публичного релиза
CAISI, подразделение Минторга США, объявило соглашения с Google DeepMind, Microsoft и xAI о проверке ранних версий моделей перед публикацией. Ведомство уже провело более 40 таких оценок, включая тесты для не выпущенных моделей. Проверка сосредоточена на рисках кибербезопасности, биобезопасности и химического оружия.

🚀 DeepSeek запустила V4 Preview с контекстом 1M и моделями до 1,6T параметров
DeepSeek-V4 Preview уже доступна и открыта, а стандартный контекст у официальных сервисов теперь составляет 1M токенов. В линейке есть DeepSeek-V4-Pro с 1,6T общих и 49B активных параметров, а также DeepSeek-V4-Flash с 284B общих и 13B активных параметров. В документации отдельно сказано, что API обновлён и доступен сегодня.

#CutCode #AI #Google #DeepSeek #Gemma

Подписывайся - @CutCode_AI
❤‍🔥7🤩4😍2👍1🔥1🥰1🎉1
У Codex появились питомцы 🐾

В Codex добавили Codex Pets - маленьких анимированных персонажей, которые показывают статус агента.

Работает агент, ждет ответа или уже готов к ревью - теперь это можно понять не только по логам, но и по питомцу.

Включается через /pet, настройки Appearance → Pets или командное меню Cmd/Ctrl + K.

Питомцев можно создавать самому.
А еще появился отдельный сайт-каталог codex-pets.net. Там можно выбрать питомца и добавить его в терминал одной командой.

Выглядит как игрушка, но фича полезная: когда агент работает в фоне, важно быстро понимать, что с ним происходит.

Раньше были логи и статусы.
Теперь - котик, который сообщает, что Codex закончил задачу.

Tamagotchi-driven development подъехал.
🥰3😍3💯32🤩2👍1🎉1
🔥 AI-дайджест от CutCode за 7 мая

🤖 Anthropic выпустила шаблоны агентов для финансовых задач
Anthropic показала десять готовых шаблонов агентов для финансовых сервисов: от подготовки pitchbook и проверки KYC-файлов до закрытия книг в конце месяца. Обновление связано с Claude Opus 4.7, который набрал 64.37% в бенчмарке Vals AI Finance Agent benchmark.

🍎 Apple согласилась выплатить 250 миллионов долларов по иску о Siri
Apple заключила мировое соглашение на 250 миллионов долларов по коллективному иску о задержке функций более персонализированной Siri. Владельцы iPhone 15 и iPhone 16 в США, купившие устройства между июнем 2024 года и мартом 2025 года, смогут получить от 25 до 95 долларов за устройство.

💸 OpenAI планирует потратить 50 миллиардов долларов на вычисления в 2026 году
OpenAI, по словам Грега Брокмана, собирается направить около 50 миллиардов долларов на вычислительную инфраструктуру в 2026 году. В оценке отдельно упоминаются закупки чипов и рост расходов на инференс, что показывает масштаб подготовки компании к следующему этапу обучения и запуска моделей.

#CutCode #AI #AIAgents #AIНовости #Anthropic

Подписывайся - @CutCode_AI
💯6🥰43🔥2🤩2👍1😍1❤‍🔥1
🔥 Reddit-дайджест от CutCode за 7 мая

📊 Автор собрал harness-bench для llama.cpp и проверил Qwen3.6-27B на 16 задачах
Автор собрал бенчмарк harness-bench для local LLM в llama.cpp llama-server и прогнал 1360 запусков на одном M3 Max с 128 ГБ памяти. Связка Qwen3.6-27B и pi стала единственной, которая закрыла все 16 задач; один прогон занимал около 207 секунд.

🧠 Пользователь собрал три браузерные игры с Claude, одна из них набрала 25 млн запусков
Автор пишет, что раньше не умел кодить, а первый рабочий прототип игры получил через шесть часов после промпта в Claude через Cursor. Две из трёх игр выросли до HTML-файлов по 8000 строк, а одна из них набрала 25 млн запусков.

🧰 Пользователь ускорил Qwen3.6-27B до 50 токенов в секунду на RTX 3090
Автор показывает запуск Qwen3.6-27B с контекстом 100000 на RTX 3090 и получает 50 токенов в секунду в llama.cpp. В посте также указан GGUF-сборка и патч из запроса на слияние 22673 для llama.cpp.

#CutCode #AI #AIРазработка #LocalLLM #Qwen

Подписывайся - @CutCode_AI
👍3🥰3🔥2❤‍🔥21🎉1🤩1😍1
🧠 Anthropic и SpaceX договорились о вычислительных мощностях — и это уже влияет на Claude

Anthropic получил доступ ко всей вычислительной мощности Colossus 1 в Мемфисе. Это больше 300 мегаватт ресурсов, а в перспективе компания ещё рассматривает гигаваттные мощности в космосе.

По сути это значит одно: у Anthropic становится больше вычислительных ресурсов, а значит меньше шансов, что Claude Code упрётся в лимиты в самый неудобный момент.

Что уже изменили:

1. В тарифах Pro, Max и Team удвоили 5-часовые лимиты Claude Code;
2. В Pro и Max убрали снижение лимитов в часы пик;
3. Для программного интерфейса с моделями Opus лимиты тоже заметно подняли.

На этом фоне сделка особенно заметна: раньше Маск открыто критиковал Anthropic, а вокруг Colossus 1 были скандалы из-за экологии и газовых турбин без нужных разрешений. Теперь же два игрока, которые ещё недавно были по разные стороны конфликта, фактически завязаны на одной инфраструктурной теме.

Итог: Claude становится стабильнее в работе, Anthropic усиливает позиции в гонке с OpenAI и Google, а конкуренция на рынке ИИ только ускоряется. 🚀
🔥7😍4🎉3🥰2🤩2❤‍🔥2💯21
🔥 AI-дайджест от CutCode за 8 мая

💼 Anthropic подняла лимиты Claude и заключила сделку со SpaceX по вычислениям
Anthropic сообщила о партнёрстве со SpaceX и доступе к более чем 300 мегаваттам новой мощности в дата-центре Colossus 1, что включает свыше 220 000 GPU NVIDIA. Компания также удвоила пятичасовые лимиты Claude Code для Pro, Max, Team и seat-based Enterprise, а для Claude Opus заметно подняла API rate limits. Дата анонса — 6 мая 2026 года.

🤖 Google закрыла Project Mariner и перенесла его функции в Gemini Agent
Google отключила Project Mariner: на странице проекта указано, что его закрыли 4 мая 2026 года, а технологии переехали в другие продукты компании. Раньше эксперимент умел выполнять до 10 задач одновременно, а его возможности теперь встроены в Gemini Agent и AI Mode.

⚖️ Mira Murati заявила суду, что Sam Altman говорил ей неправду о проверке модели
Бывшая техническая директор OpenAI дала показания под присягой в деле Musk v. Altman и сказала, что Sam Altman сообщил ей неверные сведения о безопасности новой модели. В показаниях также фигурирует упоминание 52-страничной записки и спор о том, должна ли модель проходить через совет по деплою.

🛠️ Spotify запустила бета-инструмент для импорта подкастов от агентов
Spotify разрешила загружать в приложение персональные подкасты, созданные агентами вроде Codex, Claude Code и OpenClaw, через новый CLI-инструмент в бете. После импорта выпуски появляются в личной библиотеке и остаются недоступны другим пользователям. Материал опубликован 7 мая 2026 года.

#CutCode #AI #AIAgents #AIНовости #Anthropic

Подписывайся - @CutCode_AI
🎉4👍3🥰3😍31🔥1❤‍🔥1💯1
🔥 Reddit-дайджест от CutCode за 8 мая

🔒 Google Chrome незаметно установил 4 ГБ ИИ-модель на устройства пользователей
Исследователь пишет, что Google Chrome записывает на диск файл с ИИ-моделью размером 4 ГБ без запроса на согласие. В материале это сравнивают с похожим поведением вокруг Claude Desktop, где расширения и мосты появлялись на машинах пользователей без отдельного диалога.

#CutCode #AI #Google #LocalLLM #Безопасность

Подписывайся - @CutCode_AI
4🔥2🎉2❤‍🔥2👍1🥰1🤩1😍1💯1
🔥 AI-дайджест от CutCode за 9 мая

⚖️ Anthropic Institute опубликовал повестку исследований ИИ
Anthropic Institute изложил четыре направления работы: экономическое распространение, угрозы и устойчивость, ИИ в реальной среде и ИИ-исследования. В документе от 7 мая 2026 года команда пишет, что уже видит, как в Anthropic меняются задачи вроде разработки софта и ускоряется собственное R&D ИИ.

🧠 OpenAI выпустила три новых голосовых модели для Realtime API
OpenAI добавила GPT-Realtime-2, GPT-Realtime-Translate и GPT-Realtime-Whisper для рассуждений, перевода и распознавания речи в реальном времени. У GPT-Realtime-2 контекстное окно выросло с 32 000 до 128 000 токенов, а режим рассуждений доступен на пяти уровнях.

📱 Google превратила Fitbit в приложение Google Health
Google перевела приложение Fitbit в Google Health app и открыла доступ к новому ИИ-коучу для здоровья. Обновление начнёт раскатываться 19 мая, а данные о фитнесе и самочувствии соберут в одном интерфейсе с четырьмя вкладками.

🚀 Google показала экранный Fitbit Air за 100 долларов
Google представила Fitbit Air — браслет без экрана за 100 долларов, который измеряет пульс, вариабельность сердечного ритма, насыщение крови кислородом и фазы сна. Устройство весит 12 граммов и работает до недели, а быстрая зарядка за 5 минут даёт ещё день автономности.

💼 Cloudflare сокращает более 1100 сотрудников из-за ИИ
Cloudflare объявила о сокращении более 1100 сотрудников, то есть примерно 20% штата, и связала решение с агентным ИИ. В первом квартале выручка компании составила 640 миллионов долларов против 622 миллионов по ожиданиям аналитиков, а доля использования ИИ за три месяца выросла более чем на 600%.

💸 Nintendo поднимает цену Switch 2 на 50 долларов
Nintendo повысит цену Switch 2 в США с 449,99 до 499,99 доллара с 1 сентября и ожидает продажи 16,5 миллиона устройств в 2027 финансовом году. Компания связала пересмотр цен с дефицитом памяти и ростом цен на чипы на фоне глобального строительства дата-центров для ИИ.

#CutCode #AI #AIНовости #Hardware #AIAgents

Подписывайся - @CutCode_AI
🔥4🎉4🤩4💯4😍3👍2🥰2
🔥 Reddit-дайджест от CutCode за 9 мая

🧠 Сообщество выложило Qwen3.6 35B A3B с сохранённым Native MTP и новыми форматами
Автор публикации выложил Qwen3.6 35B A3B в варианте uncensored heretic с сохранённым Native MTP. В описании указаны KLD 0.0015, 10 из 100 отказов и сохранение всех 19 MTP. Модель доступна в safetensors, GGUF, NVFP4, NVFP4 GGUF и GPTQ-Int4.

#CutCode #AI #LocalLLM #OpenSource #Qwen

Подписывайся - @CutCode_AI
❤‍🔥4👍3🥰3🎉3🤩2😍2🔥1💯1
🔥 Reddit-дайджест от CutCode за 10 мая

📊 Пользователь показал 80 токенов в секунду и контекст 128К на 12 ГБ видеопамяти
В связке с последней сборкой llama.cpp и патчем MTP пользователь получил свыше 80 токенов в секунду на 12 ГБ видеопамяти. В тесте он также отметил более 80% принятия черновиков и контекстное окно 128К.

#CutCode #AI #LlamaCpp #LocalLLaMA #Бенчмарки

Подписывайся - @CutCode_AI
😍43🤩3💯3🔥2🥰2👍1🎉1
🎙️ OpenAI собрала работу с голосом в один рабочий контур
GPT-Realtime-2, GPT-Realtime-Translate и GPT-Realtime-Whisper закрывают разговор, перевод и streaming speech-to-text.

И вот здесь уже видно, зачем это разработчику. Один Realtime-стек убирает лишнюю склейку между диалогом, переводом и транскрипцией. Меньше отдельных сервисов вокруг, меньше мест, где всё ломается на задержке или теряется контекст.

GPT-Realtime-2 держит разговор и тянет более сложные запросы с GPT-5-class reasoning. GPT-Realtime-Translate переводит речь в реальном времени с 70+ входных языков в 13 выходных. GPT-Realtime-Whisper делает live speech-to-text, пока спикер говорит.

Отдельный практический момент, который уже нельзя списать на маркетинг: Realtime API поддерживает EU Data Residency и стоит на 20% дешевле gpt-4o-realtime-preview. Для продакшена это как раз те вещи, из-за которых интеграцию обычно откладывают.

Вывод: OpenAI двигает voice из демо в слой, который можно реально встраивать в саппорт, операторские интерфейсы и мультиязычные продукты. И этот стек очень полезен там, где нужен один контур для речи, перевода и текста, а не игрушка для красивого демо.
👉 @CutCode_AI
🎉8👍2🔥21🤩1
🤖 Интересное обновление в Telegram

Telegram открыл ботам вход в любой чат по @, даже если они не участники диалога. Но с ограничением: бот видит только те сообщения, где его упомянули, и ответы на них.

Для меня, как разработчика это уже не «бот в личке», а кусок рабочей схемы внутри обычной переписки. Например, бот-ресепшн принимает запрос, бот-проверка смотрит контекст, бот-исполнитель оформляет результат в том же чате. Человека между ними может не быть вообще. И всё это внутри Telegram.

Самое важное здесь даже не сам вызов по @, а связка bot-to-bot. Это уже нормальная автоматизация внутри живого диалога, а не один скрипт, который отвечает в лоб. Telegram ещё и обновил Bot API, так что это не обходная схема сверху, а новая основа на уровне протокола.

Вывод: Telegram перестал держать ботов в декоративной роли. Теперь это рабочая среда для процессов, где у каждого бота есть границы и маршрут. И это меняет не «умность» ботов, а то, как вообще можно собирать интеграции в мессенджере. Уже начал дорабатывать своего Telegram-агента 😎

👉 @CutCode_AI
🎉12👍7🔥5🤩32
This media is not supported in your browser
VIEW IN TELEGRAM
🛠 Claude Code дал возможность наблюдать за субагентами

Когда агентов несколько, их сложно контролировать: кто ждёт ввод, кто ещё работает, кто уже отдал результат. Agent view собирает это в одном месте и сразу показывает, что происходит с каждой сессией.

В списке видны последняя реплика, время последнего контакта и состояние сессии. Оттуда же можно открыть полный транскрипт.

Для разработчика это меняет повседневную работу в терминале. Вместо россыпи вкладок и ручных пометок остаётся один диспетчер для параллельных задач. Это особенно заметно, когда несколько агентов уже работают одновременно и надо не терять контекст между ними.

Это полезно: Claude Code чинит самое больное место AI-инструментов в разработке, управление параллельным потоком. Сгенерировать агента уже не проблема, а вот удержать контроль над десятком сессий уже совсем другая задача. Именно здесь такие инструменты обычно и ломаются.
👉 @CutCode_AI
🤩54🔥3🎉2👍1
GPT-5.5 против Claude Opus 4.7

Новый ролик на YouTube. Топовые модели получили один и тот же coding benchmark.
Обе проучили reasoning на максимум, и интрига держалась до самого конца.
Кто выиграл — смотри в видео👇
https://youtu.be/97EDYPWEXm0
🔥5👍3🎉3🤩32
⚡️ Andrej Karpathy переходит в Anthropic и, по данным CNBC, сразу подключается к pretraining-команде. Его задача — использовать Claude, чтобы ускорять research и обучение следующего поколения моделей.

Это важный сигнал: AI-гонка всё сильнее смещается от красивых демо к данным, пайплайнам, экспериментам и качеству pretraining. Если подход Anthropic сработает, преимущество будет расти прямо внутри процесса обучения.
🔥94🤩4👍3🎉1
У Google пачка апдейтов, и главное тут три штуки.

1. Gemini 3.5 Flash
Опять обещают прорыв в кодинге — посмотрим в деле.
Но есть ощущение, что модель может получиться сильной. Особенно с учётом того, что Gemini у Google уже умеет хорошо удивлять.

2. Antigravity 2.0
Систему пересобрали, переписали на Go, добавили параллельных агентов, dynamic subagents и Scheduled Tasks.
По сути, просто догнали Claude Code и Codex.
Хотя важный нюанс: Antigravity сейчас лёг, так что протестить всё это пока нельзя.

3. Gemini Omni
Похоже, это новая SOTA-модель для генерации видео.
Формулировка простая: Nano Banana, но для видео. И это уже звучит интересно.

Вывод:
Самое вкусное тут не Antigravity, а связка Gemini 3.5 Flash + Omni. Особенно если Flash реально окажется сильной мультимодальной моделью.
4👍3🎉3🤩2🔥1
🇨🇳 Alibaba выкатили Qwen3.7-Max - и это уже не просто очередной чат-апдейт, а модель под агентные задачи.

Самый жирный кейс из релиза:
35 часов автономной работы, 1158+ tool calls и самостоятельная оптимизация CUDA-ядра под длинный контекст.
Итог - x10 ускорение инференса.

По цифрам тоже ок:

• 1M токенов контекста
• только текст
• мультимодальности нет

На SWE-bench Pro - 60.6%. Это выше DeepSeek V4-Pro, но ниже Claude Opus 4.7.

Интересно и то, что Qwen прогнали через OpenClaw, Claude Code и Hermes - разброс всего около 6 пунктов. Значит, модель довольно стабильна.

Главный вопрос теперь не про чат, а про реальную кодовую задачу: дотянет ли модель фронт, бэк, отладку и многошаговые tool calls до конца.

В целом Qwen двигается в правильную сторону. Но решать по-прежнему будет не только модель, а вся обвязка вокруг неё.
7🤩5👍2🔥2🎉2
Сегодня весь день Claude и Codex работали над сложной задачей и в итоге впервые оба отчитались, что не смогли найти решение. Я такого еще не видел, но задача была действительно нелегкой. Примечательно, что Claude в итоге исправил README проекта, где указал этот кейс и сообщил о том, что задача невыполнима. Поскольку я готовлю баттл Gemini/Qwen/GPT/Opus и у меня открыт Antigravity CLI, то просто ради эксперимента закинул такую же задачу. По инпуту она была один в один, так как работал велась через ai-factory, и план не менялся! Ну, в целом, я в шоке. Gemini 3.5 Flash (medium) за 2 итерации решил проблему, а на 3-й довёл её до идеала. Я при этом следил за tool calling и настолько глубокого исследования проблемы еще не встречал ни в одном агенте. В итоге я просто просидел минут 10 вот с такими глазами 😳! Можно подумать, что очередной рандом, но Claude и Codex пыхтели весь день, там под 30 итераций и никак! Честно говоря, на Gemini вообще не было ставки. Теперь интересно, как он себя покажет на баттле.
15👍12🔥5🎉4🤩3🤯1