Данил Щуцкий | CutCode AI
139 subscribers
7 photos
2 videos
97 links
Внедряю AI в бизнес-процессы без хаоса и бесполезных демо.
Инженерный подход:
процесс → данные → MVP → внедрение.
Малый и средний бизнес.
✉️ - @leeto_telegram
Download Telegram
🔥 Reddit-дайджест от CutCode за 2 мая

💸 Суперкомитет Build American AI платит TikTok-инфлюенсерам за антикитайские ролики об ИИ
Группа Build American AI, связанная с суперкомитетом Leading the Future, ведёт кампанию в соцсетях и продвигает тезис о том, что США нужно опередить Китай в ИИ. По данным материала, проект поддержан технолидерами, бюджет суперкомитета достиг $100 миллионов, а за один ролик в TikTok инфлюенсерам предлагают около $5,000.

🛠️ Unsloth исправил баг в Mistral Medium 3.5
Команда Unsloth сообщила, что 1 мая 2026 года вместе с Mistral исправила проблему инференса Mistral Medium 3.5 в некоторых реализациях и выпустила обновлённые GGUF. В описании указана ошибка парсинга YaRN, затронувшая transformers и llama.cpp; для обхода меняли mscale_all_dim с 1 на 0.

🧠 Пользователь сравнил Qwen 3.6-27B и Gemma 4 как ежедневную локальную модель
Автор поста пишет, что поставил Qwen 3.6-27B q8_k_xl в VSCode Insiders и запустил её локально через LM Studio на RTX 6000 Pro, а также сравнил её с Gemma 4. Для обычных задач, включая сбор данных и веб-скрапинг в разрабатываемом приложении, он отмечает, что связка показала себя уверенно.

#CutCode #AI #AIРазработка #AIНовости #LocalLLM

Подписывайся - @CutCode_AI
❤‍🔥5🎉3👍2🥰2🔥1😍1💯1
🔥 AI-дайджест от CutCode за 3 мая

📊 Reddit отчитался о росте поиска на 30 процентов за год
Reddit сообщил о росте числа еженедельных пользователей поиска на 30 процентов год к году. Компания также заявила, что у сервиса 493 миллиона weekly active unique users и около 126 миллионов daily active unique users по итогам квартала, а search DAUs, WAUs и запросы заметно выросли.

#CutCode #AI #Reddit #Бенчмарки #ИИвБизнесе

Подписывайся - @CutCode_AI
🔥3😍32🎉2💯2👍1🥰1🤩1
🔥 Reddit-дайджест от CutCode за 3 мая

📊 Hummingbird+ предлагает недорогие FPGA для инференса LLM и показывает 18 токенов в секунду на Qwen3-30B-A3B
В статье о Hummingbird+ авторы показывают инференс Qwen3-30B-A3B в квантизации Q4 на скорости 18 токенов в секунду при 24 ГБ памяти. В работе также указан ожидаемый массовый выпуск по цене 150 долларов за устройство.

🤖 Пользователь собрал многоагентный торговый зал для учебного проекта
Система работает полностью локально на Ollama и включает 10 агентов для новостей, исследований, макроаналитики, симуляции толпы и торговли. Проект запускается каждый день в 12:00 по тихоокеанскому времени и выполняется около 3,5 часа; в стеке используются Gemma 4:26b, qwen3.6:35b и gemma4:31b.

#CutCode #AI #AIAgents #Gemma #Hardware

Подписывайся - @CutCode_AI
4👍3😍2❤‍🔥2🔥1🥰1🎉1🤩1💯1
🔥 Reddit-дайджест от CutCode за 4 мая

🧠 Пользователь дообучил Qwen3-32B под более «человечный» стиль ответа
Автор описывает версию Assistant_Pepe_32B на базе Qwen3-32B, которую настраивали под асистента без привычного «ассистентского» поведения. В основе — смещение в сторону негативного уклона, чтобы снизить поддакивание и сделать ответы менее сглаженными.

💼 В сети всплыл AMD Ryzen AI Max Pro 495 с 192 ГБ памяти
Утечка приписывает Ryzen AI Max Pro 495 встроенную графику Radeon 8065S и конфигурацию с 192 ГБ памяти. В обсуждении это связывают с более тяжелыми локальными моделями и запасом под большие плотные веса.

#CutCode #AI #AMD #Hardware #LLM

Подписывайся - @CutCode_AI
🔥52🤩2👍1🥰1😍1❤‍🔥1
🔥 AI-дайджест от CutCode за 5 мая

📊 Исследователи Harvard сравнили OpenAI o1 с врачами на 76 случаях из приёмного покоя
В работе, опубликованной 30 апреля 2026 года в Science, OpenAI o1 проверили на 76 экстренных случаях из больницы Beth Israel в Бостоне. На этапе сортировки модель дала точный или почти точный диагноз в 67% случаев против 55% и 50% у двух врачей, а затем её сравнили ещё на этапе первого контакта и перевода в отделение.

#CutCode #AI #LLM #OpenAI #Бенчмарки

Подписывайся - @CutCode_AI
🔥4👍3🤩3🥰2❤‍🔥2💯1
🔥 AI-дайджест от CutCode за 6 мая

💼 Coinbase сократит 14 процентов штата и перестроит работу вокруг AI
Coinbase увольняет около 700 сотрудников, то есть 14 процентов штата, и закладывает на это $50–60 млн расходов на выходные пособия. Компания также урезает уровни управления до пяти ступеней ниже CEO и COO и тестирует «команды из одного человека» с AI-инструментами.

💼 Anthropic запустит сервисную компанию для внедрения Claude в бизнесе
Anthropic, Blackstone, Hellman & Friedman и Goldman Sachs объявили о создании новой AI-сервисной компании для средних предприятий. В сообщении от 4 мая 2026 года говорится, что команда Anthropic будет помогать строить кастомные решения и внедрять Claude в ключевые процессы клиентов.

🧠 Сооснователь Anthropic оценил шанс самопостроения AI к 2028 году
Джек Кларк написал 4 мая 2026 года, что вероятность автономного AI-исследования, которое сможет построить своего преемника, он оценивает выше 60 процентов к концу 2028 года. В тексте он связывает это с уже видимым переходом части R&D-задач к AI-системам.

🍎 Apple ищет Intel и Samsung для выпуска своих чипов в США
Apple ведет ранние переговоры с Intel и Samsung, чтобы получить запасные варианты для выпуска основных чипов в США. В материале также сказано, что TSMC делает примерно три четверти мировой полупроводниковой продукции, а Apple уже осматривала завод Samsung в Тейлоре стоимостью $17 млрд.

💸 Грег Брокман оценил свою долю в OpenAI почти в 30 миллиардов долларов
В суде Грег Брокман заявил, что его доля в OpenAI стоит почти $30 млрд. Он также рассказал о финансовых связях с Сэмом Альтманом, а защита Илона Маска использует эти данные, чтобы спорить о независимости Брокмана.

⚖️ Сотрудники Google DeepMind проголосовали за профсоюз из-за военных контрактов
В лондонском офисе Google DeepMind за объединение в профсоюз проголосовали 98 процентов членов CWU. Инициатива охватывает как минимум 1000 сотрудников и направлена против использования технологий лаборатории в интересах армии США и Израиля.

🔒 Meta начала проверять возраст пользователей по фото и видео с помощью AI
Meta запускает AI-проверку возраста по фото и видео в США, 27 странах ЕС и Бразилии. Система ищет визуальные признаки вроде роста и строения костей, чтобы выявлять аккаунты пользователей младше 13 лет и удалять их.

#CutCode #AI #AIНовости #ИИвБизнесе #Anthropic

Подписывайся - @CutCode_AI
🔥4🥰3🎉2😍2❤‍🔥2💯2
🔥 Reddit-дайджест от CutCode за 6 мая

🧪 Google выпустила MTP-черновики для Gemma 4 и ускорила инференс до 3 раз
Google представила Multi-Token Prediction для семейства Gemma 4 и пишет, что такие drafter-модели дают до 3× ускорения без потери качества вывода и логики рассуждений. В статье также указано, что за первые недели Gemma 4 набрала более 60 миллионов загрузок. Ускорение проверяли на LiteRT-LM, MLX, Hugging Face Transformers и vLLM.

⚖️ США договорились проверять модели Google DeepMind, Microsoft и xAI до публичного релиза
CAISI, подразделение Минторга США, объявило соглашения с Google DeepMind, Microsoft и xAI о проверке ранних версий моделей перед публикацией. Ведомство уже провело более 40 таких оценок, включая тесты для не выпущенных моделей. Проверка сосредоточена на рисках кибербезопасности, биобезопасности и химического оружия.

🚀 DeepSeek запустила V4 Preview с контекстом 1M и моделями до 1,6T параметров
DeepSeek-V4 Preview уже доступна и открыта, а стандартный контекст у официальных сервисов теперь составляет 1M токенов. В линейке есть DeepSeek-V4-Pro с 1,6T общих и 49B активных параметров, а также DeepSeek-V4-Flash с 284B общих и 13B активных параметров. В документации отдельно сказано, что API обновлён и доступен сегодня.

#CutCode #AI #Google #DeepSeek #Gemma

Подписывайся - @CutCode_AI
❤‍🔥7🤩4😍2👍1🔥1🥰1🎉1
У Codex появились питомцы 🐾

В Codex добавили Codex Pets - маленьких анимированных персонажей, которые показывают статус агента.

Работает агент, ждет ответа или уже готов к ревью - теперь это можно понять не только по логам, но и по питомцу.

Включается через /pet, настройки Appearance → Pets или командное меню Cmd/Ctrl + K.

Питомцев можно создавать самому.
А еще появился отдельный сайт-каталог codex-pets.net. Там можно выбрать питомца и добавить его в терминал одной командой.

Выглядит как игрушка, но фича полезная: когда агент работает в фоне, важно быстро понимать, что с ним происходит.

Раньше были логи и статусы.
Теперь - котик, который сообщает, что Codex закончил задачу.

Tamagotchi-driven development подъехал.
🥰3😍3💯32🤩2👍1🎉1
🔥 AI-дайджест от CutCode за 7 мая

🤖 Anthropic выпустила шаблоны агентов для финансовых задач
Anthropic показала десять готовых шаблонов агентов для финансовых сервисов: от подготовки pitchbook и проверки KYC-файлов до закрытия книг в конце месяца. Обновление связано с Claude Opus 4.7, который набрал 64.37% в бенчмарке Vals AI Finance Agent benchmark.

🍎 Apple согласилась выплатить 250 миллионов долларов по иску о Siri
Apple заключила мировое соглашение на 250 миллионов долларов по коллективному иску о задержке функций более персонализированной Siri. Владельцы iPhone 15 и iPhone 16 в США, купившие устройства между июнем 2024 года и мартом 2025 года, смогут получить от 25 до 95 долларов за устройство.

💸 OpenAI планирует потратить 50 миллиардов долларов на вычисления в 2026 году
OpenAI, по словам Грега Брокмана, собирается направить около 50 миллиардов долларов на вычислительную инфраструктуру в 2026 году. В оценке отдельно упоминаются закупки чипов и рост расходов на инференс, что показывает масштаб подготовки компании к следующему этапу обучения и запуска моделей.

#CutCode #AI #AIAgents #AIНовости #Anthropic

Подписывайся - @CutCode_AI
💯6🥰43🔥2🤩2👍1😍1❤‍🔥1
🔥 Reddit-дайджест от CutCode за 7 мая

📊 Автор собрал harness-bench для llama.cpp и проверил Qwen3.6-27B на 16 задачах
Автор собрал бенчмарк harness-bench для local LLM в llama.cpp llama-server и прогнал 1360 запусков на одном M3 Max с 128 ГБ памяти. Связка Qwen3.6-27B и pi стала единственной, которая закрыла все 16 задач; один прогон занимал около 207 секунд.

🧠 Пользователь собрал три браузерные игры с Claude, одна из них набрала 25 млн запусков
Автор пишет, что раньше не умел кодить, а первый рабочий прототип игры получил через шесть часов после промпта в Claude через Cursor. Две из трёх игр выросли до HTML-файлов по 8000 строк, а одна из них набрала 25 млн запусков.

🧰 Пользователь ускорил Qwen3.6-27B до 50 токенов в секунду на RTX 3090
Автор показывает запуск Qwen3.6-27B с контекстом 100000 на RTX 3090 и получает 50 токенов в секунду в llama.cpp. В посте также указан GGUF-сборка и патч из запроса на слияние 22673 для llama.cpp.

#CutCode #AI #AIРазработка #LocalLLM #Qwen

Подписывайся - @CutCode_AI
👍3🥰3🔥2❤‍🔥21🎉1🤩1😍1
🧠 Anthropic и SpaceX договорились о вычислительных мощностях — и это уже влияет на Claude

Anthropic получил доступ ко всей вычислительной мощности Colossus 1 в Мемфисе. Это больше 300 мегаватт ресурсов, а в перспективе компания ещё рассматривает гигаваттные мощности в космосе.

По сути это значит одно: у Anthropic становится больше вычислительных ресурсов, а значит меньше шансов, что Claude Code упрётся в лимиты в самый неудобный момент.

Что уже изменили:

1. В тарифах Pro, Max и Team удвоили 5-часовые лимиты Claude Code;
2. В Pro и Max убрали снижение лимитов в часы пик;
3. Для программного интерфейса с моделями Opus лимиты тоже заметно подняли.

На этом фоне сделка особенно заметна: раньше Маск открыто критиковал Anthropic, а вокруг Colossus 1 были скандалы из-за экологии и газовых турбин без нужных разрешений. Теперь же два игрока, которые ещё недавно были по разные стороны конфликта, фактически завязаны на одной инфраструктурной теме.

Итог: Claude становится стабильнее в работе, Anthropic усиливает позиции в гонке с OpenAI и Google, а конкуренция на рынке ИИ только ускоряется. 🚀
🔥7😍4🎉3🥰2🤩2❤‍🔥2💯21
🔥 AI-дайджест от CutCode за 8 мая

💼 Anthropic подняла лимиты Claude и заключила сделку со SpaceX по вычислениям
Anthropic сообщила о партнёрстве со SpaceX и доступе к более чем 300 мегаваттам новой мощности в дата-центре Colossus 1, что включает свыше 220 000 GPU NVIDIA. Компания также удвоила пятичасовые лимиты Claude Code для Pro, Max, Team и seat-based Enterprise, а для Claude Opus заметно подняла API rate limits. Дата анонса — 6 мая 2026 года.

🤖 Google закрыла Project Mariner и перенесла его функции в Gemini Agent
Google отключила Project Mariner: на странице проекта указано, что его закрыли 4 мая 2026 года, а технологии переехали в другие продукты компании. Раньше эксперимент умел выполнять до 10 задач одновременно, а его возможности теперь встроены в Gemini Agent и AI Mode.

⚖️ Mira Murati заявила суду, что Sam Altman говорил ей неправду о проверке модели
Бывшая техническая директор OpenAI дала показания под присягой в деле Musk v. Altman и сказала, что Sam Altman сообщил ей неверные сведения о безопасности новой модели. В показаниях также фигурирует упоминание 52-страничной записки и спор о том, должна ли модель проходить через совет по деплою.

🛠️ Spotify запустила бета-инструмент для импорта подкастов от агентов
Spotify разрешила загружать в приложение персональные подкасты, созданные агентами вроде Codex, Claude Code и OpenClaw, через новый CLI-инструмент в бете. После импорта выпуски появляются в личной библиотеке и остаются недоступны другим пользователям. Материал опубликован 7 мая 2026 года.

#CutCode #AI #AIAgents #AIНовости #Anthropic

Подписывайся - @CutCode_AI
🎉4👍3🥰3😍31🔥1❤‍🔥1💯1
🔥 Reddit-дайджест от CutCode за 8 мая

🔒 Google Chrome незаметно установил 4 ГБ ИИ-модель на устройства пользователей
Исследователь пишет, что Google Chrome записывает на диск файл с ИИ-моделью размером 4 ГБ без запроса на согласие. В материале это сравнивают с похожим поведением вокруг Claude Desktop, где расширения и мосты появлялись на машинах пользователей без отдельного диалога.

#CutCode #AI #Google #LocalLLM #Безопасность

Подписывайся - @CutCode_AI
4🔥2🎉2❤‍🔥2👍1🥰1🤩1😍1💯1
🔥 AI-дайджест от CutCode за 9 мая

⚖️ Anthropic Institute опубликовал повестку исследований ИИ
Anthropic Institute изложил четыре направления работы: экономическое распространение, угрозы и устойчивость, ИИ в реальной среде и ИИ-исследования. В документе от 7 мая 2026 года команда пишет, что уже видит, как в Anthropic меняются задачи вроде разработки софта и ускоряется собственное R&D ИИ.

🧠 OpenAI выпустила три новых голосовых модели для Realtime API
OpenAI добавила GPT-Realtime-2, GPT-Realtime-Translate и GPT-Realtime-Whisper для рассуждений, перевода и распознавания речи в реальном времени. У GPT-Realtime-2 контекстное окно выросло с 32 000 до 128 000 токенов, а режим рассуждений доступен на пяти уровнях.

📱 Google превратила Fitbit в приложение Google Health
Google перевела приложение Fitbit в Google Health app и открыла доступ к новому ИИ-коучу для здоровья. Обновление начнёт раскатываться 19 мая, а данные о фитнесе и самочувствии соберут в одном интерфейсе с четырьмя вкладками.

🚀 Google показала экранный Fitbit Air за 100 долларов
Google представила Fitbit Air — браслет без экрана за 100 долларов, который измеряет пульс, вариабельность сердечного ритма, насыщение крови кислородом и фазы сна. Устройство весит 12 граммов и работает до недели, а быстрая зарядка за 5 минут даёт ещё день автономности.

💼 Cloudflare сокращает более 1100 сотрудников из-за ИИ
Cloudflare объявила о сокращении более 1100 сотрудников, то есть примерно 20% штата, и связала решение с агентным ИИ. В первом квартале выручка компании составила 640 миллионов долларов против 622 миллионов по ожиданиям аналитиков, а доля использования ИИ за три месяца выросла более чем на 600%.

💸 Nintendo поднимает цену Switch 2 на 50 долларов
Nintendo повысит цену Switch 2 в США с 449,99 до 499,99 доллара с 1 сентября и ожидает продажи 16,5 миллиона устройств в 2027 финансовом году. Компания связала пересмотр цен с дефицитом памяти и ростом цен на чипы на фоне глобального строительства дата-центров для ИИ.

#CutCode #AI #AIНовости #Hardware #AIAgents

Подписывайся - @CutCode_AI
🔥4🎉4🤩4💯4😍3👍2🥰2
🔥 Reddit-дайджест от CutCode за 9 мая

🧠 Сообщество выложило Qwen3.6 35B A3B с сохранённым Native MTP и новыми форматами
Автор публикации выложил Qwen3.6 35B A3B в варианте uncensored heretic с сохранённым Native MTP. В описании указаны KLD 0.0015, 10 из 100 отказов и сохранение всех 19 MTP. Модель доступна в safetensors, GGUF, NVFP4, NVFP4 GGUF и GPTQ-Int4.

#CutCode #AI #LocalLLM #OpenSource #Qwen

Подписывайся - @CutCode_AI
❤‍🔥4👍3🥰3🎉3🤩2😍2🔥1💯1
🔥 Reddit-дайджест от CutCode за 10 мая

📊 Пользователь показал 80 токенов в секунду и контекст 128К на 12 ГБ видеопамяти
В связке с последней сборкой llama.cpp и патчем MTP пользователь получил свыше 80 токенов в секунду на 12 ГБ видеопамяти. В тесте он также отметил более 80% принятия черновиков и контекстное окно 128К.

#CutCode #AI #LlamaCpp #LocalLLaMA #Бенчмарки

Подписывайся - @CutCode_AI
😍43🤩3💯3🔥2🥰2👍1🎉1
🎙️ OpenAI собрала работу с голосом в один рабочий контур
GPT-Realtime-2, GPT-Realtime-Translate и GPT-Realtime-Whisper закрывают разговор, перевод и streaming speech-to-text.

И вот здесь уже видно, зачем это разработчику. Один Realtime-стек убирает лишнюю склейку между диалогом, переводом и транскрипцией. Меньше отдельных сервисов вокруг, меньше мест, где всё ломается на задержке или теряется контекст.

GPT-Realtime-2 держит разговор и тянет более сложные запросы с GPT-5-class reasoning. GPT-Realtime-Translate переводит речь в реальном времени с 70+ входных языков в 13 выходных. GPT-Realtime-Whisper делает live speech-to-text, пока спикер говорит.

Отдельный практический момент, который уже нельзя списать на маркетинг: Realtime API поддерживает EU Data Residency и стоит на 20% дешевле gpt-4o-realtime-preview. Для продакшена это как раз те вещи, из-за которых интеграцию обычно откладывают.

Вывод: OpenAI двигает voice из демо в слой, который можно реально встраивать в саппорт, операторские интерфейсы и мультиязычные продукты. И этот стек очень полезен там, где нужен один контур для речи, перевода и текста, а не игрушка для красивого демо.
👉 @CutCode_AI
🎉8👍2🔥21🤩1
🤖 Интересное обновление в Telegram

Telegram открыл ботам вход в любой чат по @, даже если они не участники диалога. Но с ограничением: бот видит только те сообщения, где его упомянули, и ответы на них.

Для меня, как разработчика это уже не «бот в личке», а кусок рабочей схемы внутри обычной переписки. Например, бот-ресепшн принимает запрос, бот-проверка смотрит контекст, бот-исполнитель оформляет результат в том же чате. Человека между ними может не быть вообще. И всё это внутри Telegram.

Самое важное здесь даже не сам вызов по @, а связка bot-to-bot. Это уже нормальная автоматизация внутри живого диалога, а не один скрипт, который отвечает в лоб. Telegram ещё и обновил Bot API, так что это не обходная схема сверху, а новая основа на уровне протокола.

Вывод: Telegram перестал держать ботов в декоративной роли. Теперь это рабочая среда для процессов, где у каждого бота есть границы и маршрут. И это меняет не «умность» ботов, а то, как вообще можно собирать интеграции в мессенджере. Уже начал дорабатывать своего Telegram-агента 😎

👉 @CutCode_AI
🎉12👍7🔥5🤩32
This media is not supported in your browser
VIEW IN TELEGRAM
🛠 Claude Code дал возможность наблюдать за субагентами

Когда агентов несколько, их сложно контролировать: кто ждёт ввод, кто ещё работает, кто уже отдал результат. Agent view собирает это в одном месте и сразу показывает, что происходит с каждой сессией.

В списке видны последняя реплика, время последнего контакта и состояние сессии. Оттуда же можно открыть полный транскрипт.

Для разработчика это меняет повседневную работу в терминале. Вместо россыпи вкладок и ручных пометок остаётся один диспетчер для параллельных задач. Это особенно заметно, когда несколько агентов уже работают одновременно и надо не терять контекст между ними.

Это полезно: Claude Code чинит самое больное место AI-инструментов в разработке, управление параллельным потоком. Сгенерировать агента уже не проблема, а вот удержать контроль над десятком сессий уже совсем другая задача. Именно здесь такие инструменты обычно и ломаются.
👉 @CutCode_AI
🤩54🔥3🎉2👍1
GPT-5.5 против Claude Opus 4.7

Новый ролик на YouTube. Топовые модели получили один и тот же coding benchmark.
Обе проучили reasoning на максимум, и интрига держалась до самого конца.
Кто выиграл — смотри в видео👇
https://youtu.be/97EDYPWEXm0
🔥5👍3🎉3🤩32