Данил Щуцкий | CutCode AI
139 subscribers
7 photos
2 videos
97 links
Внедряю AI в бизнес-процессы без хаоса и бесполезных демо.
Инженерный подход:
процесс → данные → MVP → внедрение.
Малый и средний бизнес.
✉️ - @leeto_telegram
Download Telegram
🔥 Reddit-дайджест от CutCode за 21 апреля

🧪 PrismML выпустила Ternary Bonsai с ternary-весами и версиями 8B, 4B и 1,7B
PrismML представила семейство Ternary Bonsai в трёх размерах: 8B, 4B и 1,7B параметра. Модели используют ternary-веса {-1, 0, +1} и занимают примерно в 9 раз меньше памяти, чем стандартные 16-битные. Версия 8B набрала 75,5 балла в среднем по бенчмаркам, обойдя исходную Bonsai 8B с 70,5.

🧠 Пользователь сравнил Kimi K2.6 с Claude Opus 4.7 и отметил хорошую замену
Автор тестировал Kimi K2.6 на собственных задачах и обратной связи от клиентов и считает его рабочей заменой Claude Opus 4.7 примерно для 85% сценариев. Он отдельно отмечает поддержку зрения, сильную работу с браузером и устойчивость на длинных задачах.

#CutCode #AI #LLM #LocalLLM

Подписывайся - @CutCode_AI
🤩6🔥4👍32😁2🎉2🍓2🥰1👏1🙏11
🔥 Reddit-дайджест от CutCode за 25 апреля

📊 Пользователь сравнил кванты Qwen3.6-35B-A3B на 3070 и увидел рост качества
На связке 3070 с 8 ГБ и 64 ГБ DDR4 он сначала запускал Qwen3.6-35B-A3B-UD-IQ4_XS.gguf размером около 18 ГБ и получал 25–30 токенов в секунду при контекстном окне 32k. Затем он попробовал Qwen3.6-35B-A3B-UD-Q4_K_XL.gguf примерно на 23 ГБ, чтобы уменьшить зацикливание в режиме рассуждений.

#CutCode #AI #LocalLLM #Qwen #Бенчмарки

Подписывайся - @CutCode_AI
👍4🙏3😁2🔥1😎1
🔥 Reddit-дайджест от CutCode за 29 апреля

🧠 Mistral готовит Medium с 128B параметров
В обсуждении пишут, что у будущей модели Mistral Medium будет 128B параметров. Авторы допускают два варианта: плотная архитектура или менее разрежённая MoE-схема, чем у Mistral Small.

#CutCode #AI #LLM #LocalLLM #Mistral

Подписывайся - @CutCode_AI
🥰4🔥21🎉1🤩1💯1
🔥 Reddit-дайджест от CutCode за 2 мая

💸 Суперкомитет Build American AI платит TikTok-инфлюенсерам за антикитайские ролики об ИИ
Группа Build American AI, связанная с суперкомитетом Leading the Future, ведёт кампанию в соцсетях и продвигает тезис о том, что США нужно опередить Китай в ИИ. По данным материала, проект поддержан технолидерами, бюджет суперкомитета достиг $100 миллионов, а за один ролик в TikTok инфлюенсерам предлагают около $5,000.

🛠️ Unsloth исправил баг в Mistral Medium 3.5
Команда Unsloth сообщила, что 1 мая 2026 года вместе с Mistral исправила проблему инференса Mistral Medium 3.5 в некоторых реализациях и выпустила обновлённые GGUF. В описании указана ошибка парсинга YaRN, затронувшая transformers и llama.cpp; для обхода меняли mscale_all_dim с 1 на 0.

🧠 Пользователь сравнил Qwen 3.6-27B и Gemma 4 как ежедневную локальную модель
Автор поста пишет, что поставил Qwen 3.6-27B q8_k_xl в VSCode Insiders и запустил её локально через LM Studio на RTX 6000 Pro, а также сравнил её с Gemma 4. Для обычных задач, включая сбор данных и веб-скрапинг в разрабатываемом приложении, он отмечает, что связка показала себя уверенно.

#CutCode #AI #AIРазработка #AIНовости #LocalLLM

Подписывайся - @CutCode_AI
❤‍🔥5🎉3👍2🥰2🔥1😍1💯1
🔥 Reddit-дайджест от CutCode за 7 мая

📊 Автор собрал harness-bench для llama.cpp и проверил Qwen3.6-27B на 16 задачах
Автор собрал бенчмарк harness-bench для local LLM в llama.cpp llama-server и прогнал 1360 запусков на одном M3 Max с 128 ГБ памяти. Связка Qwen3.6-27B и pi стала единственной, которая закрыла все 16 задач; один прогон занимал около 207 секунд.

🧠 Пользователь собрал три браузерные игры с Claude, одна из них набрала 25 млн запусков
Автор пишет, что раньше не умел кодить, а первый рабочий прототип игры получил через шесть часов после промпта в Claude через Cursor. Две из трёх игр выросли до HTML-файлов по 8000 строк, а одна из них набрала 25 млн запусков.

🧰 Пользователь ускорил Qwen3.6-27B до 50 токенов в секунду на RTX 3090
Автор показывает запуск Qwen3.6-27B с контекстом 100000 на RTX 3090 и получает 50 токенов в секунду в llama.cpp. В посте также указан GGUF-сборка и патч из запроса на слияние 22673 для llama.cpp.

#CutCode #AI #AIРазработка #LocalLLM #Qwen

Подписывайся - @CutCode_AI
👍3🥰3🔥2❤‍🔥21🎉1🤩1😍1
🔥 Reddit-дайджест от CutCode за 8 мая

🔒 Google Chrome незаметно установил 4 ГБ ИИ-модель на устройства пользователей
Исследователь пишет, что Google Chrome записывает на диск файл с ИИ-моделью размером 4 ГБ без запроса на согласие. В материале это сравнивают с похожим поведением вокруг Claude Desktop, где расширения и мосты появлялись на машинах пользователей без отдельного диалога.

#CutCode #AI #Google #LocalLLM #Безопасность

Подписывайся - @CutCode_AI
4🔥2🎉2❤‍🔥2👍1🥰1🤩1😍1💯1
🔥 Reddit-дайджест от CutCode за 9 мая

🧠 Сообщество выложило Qwen3.6 35B A3B с сохранённым Native MTP и новыми форматами
Автор публикации выложил Qwen3.6 35B A3B в варианте uncensored heretic с сохранённым Native MTP. В описании указаны KLD 0.0015, 10 из 100 отказов и сохранение всех 19 MTP. Модель доступна в safetensors, GGUF, NVFP4, NVFP4 GGUF и GPTQ-Int4.

#CutCode #AI #LocalLLM #OpenSource #Qwen

Подписывайся - @CutCode_AI
❤‍🔥4👍3🥰3🎉3🤩2😍2🔥1💯1