🔥 Reddit-дайджест от CutCode за 21 апреля
🧪 PrismML выпустила Ternary Bonsai с ternary-весами и версиями 8B, 4B и 1,7B
PrismML представила семейство Ternary Bonsai в трёх размерах: 8B, 4B и 1,7B параметра. Модели используют ternary-веса {-1, 0, +1} и занимают примерно в 9 раз меньше памяти, чем стандартные 16-битные. Версия 8B набрала 75,5 балла в среднем по бенчмаркам, обойдя исходную Bonsai 8B с 70,5.
🧠 Пользователь сравнил Kimi K2.6 с Claude Opus 4.7 и отметил хорошую замену
Автор тестировал Kimi K2.6 на собственных задачах и обратной связи от клиентов и считает его рабочей заменой Claude Opus 4.7 примерно для 85% сценариев. Он отдельно отмечает поддержку зрения, сильную работу с браузером и устойчивость на длинных задачах.
#CutCode #AI #LLM #LocalLLM
Подписывайся - @CutCode_AI
🧪 PrismML выпустила Ternary Bonsai с ternary-весами и версиями 8B, 4B и 1,7B
PrismML представила семейство Ternary Bonsai в трёх размерах: 8B, 4B и 1,7B параметра. Модели используют ternary-веса {-1, 0, +1} и занимают примерно в 9 раз меньше памяти, чем стандартные 16-битные. Версия 8B набрала 75,5 балла в среднем по бенчмаркам, обойдя исходную Bonsai 8B с 70,5.
🧠 Пользователь сравнил Kimi K2.6 с Claude Opus 4.7 и отметил хорошую замену
Автор тестировал Kimi K2.6 на собственных задачах и обратной связи от клиентов и считает его рабочей заменой Claude Opus 4.7 примерно для 85% сценариев. Он отдельно отмечает поддержку зрения, сильную работу с браузером и устойчивость на длинных задачах.
#CutCode #AI #LLM #LocalLLM
Подписывайся - @CutCode_AI
🤩6🔥4👍3❤2😁2🎉2🍓2🥰1👏1🙏1☃1
🔥 Reddit-дайджест от CutCode за 25 апреля
📊 Пользователь сравнил кванты Qwen3.6-35B-A3B на 3070 и увидел рост качества
На связке 3070 с 8 ГБ и 64 ГБ DDR4 он сначала запускал Qwen3.6-35B-A3B-UD-IQ4_XS.gguf размером около 18 ГБ и получал 25–30 токенов в секунду при контекстном окне 32k. Затем он попробовал Qwen3.6-35B-A3B-UD-Q4_K_XL.gguf примерно на 23 ГБ, чтобы уменьшить зацикливание в режиме рассуждений.
#CutCode #AI #LocalLLM #Qwen #Бенчмарки
Подписывайся - @CutCode_AI
📊 Пользователь сравнил кванты Qwen3.6-35B-A3B на 3070 и увидел рост качества
На связке 3070 с 8 ГБ и 64 ГБ DDR4 он сначала запускал Qwen3.6-35B-A3B-UD-IQ4_XS.gguf размером около 18 ГБ и получал 25–30 токенов в секунду при контекстном окне 32k. Затем он попробовал Qwen3.6-35B-A3B-UD-Q4_K_XL.gguf примерно на 23 ГБ, чтобы уменьшить зацикливание в режиме рассуждений.
#CutCode #AI #LocalLLM #Qwen #Бенчмарки
Подписывайся - @CutCode_AI
👍4🙏3😁2🔥1😎1
🔥 Reddit-дайджест от CutCode за 29 апреля
🧠 Mistral готовит Medium с 128B параметров
В обсуждении пишут, что у будущей модели Mistral Medium будет 128B параметров. Авторы допускают два варианта: плотная архитектура или менее разрежённая MoE-схема, чем у Mistral Small.
#CutCode #AI #LLM #LocalLLM #Mistral
Подписывайся - @CutCode_AI
🧠 Mistral готовит Medium с 128B параметров
В обсуждении пишут, что у будущей модели Mistral Medium будет 128B параметров. Авторы допускают два варианта: плотная архитектура или менее разрежённая MoE-схема, чем у Mistral Small.
#CutCode #AI #LLM #LocalLLM #Mistral
Подписывайся - @CutCode_AI
🥰4🔥2❤1🎉1🤩1💯1
🔥 Reddit-дайджест от CutCode за 2 мая
💸 Суперкомитет Build American AI платит TikTok-инфлюенсерам за антикитайские ролики об ИИ
Группа Build American AI, связанная с суперкомитетом Leading the Future, ведёт кампанию в соцсетях и продвигает тезис о том, что США нужно опередить Китай в ИИ. По данным материала, проект поддержан технолидерами, бюджет суперкомитета достиг $100 миллионов, а за один ролик в TikTok инфлюенсерам предлагают около $5,000.
🛠️ Unsloth исправил баг в Mistral Medium 3.5
Команда Unsloth сообщила, что 1 мая 2026 года вместе с Mistral исправила проблему инференса Mistral Medium 3.5 в некоторых реализациях и выпустила обновлённые GGUF. В описании указана ошибка парсинга YaRN, затронувшая transformers и llama.cpp; для обхода меняли mscale_all_dim с 1 на 0.
🧠 Пользователь сравнил Qwen 3.6-27B и Gemma 4 как ежедневную локальную модель
Автор поста пишет, что поставил Qwen 3.6-27B q8_k_xl в VSCode Insiders и запустил её локально через LM Studio на RTX 6000 Pro, а также сравнил её с Gemma 4. Для обычных задач, включая сбор данных и веб-скрапинг в разрабатываемом приложении, он отмечает, что связка показала себя уверенно.
#CutCode #AI #AIРазработка #AIНовости #LocalLLM
Подписывайся - @CutCode_AI
💸 Суперкомитет Build American AI платит TikTok-инфлюенсерам за антикитайские ролики об ИИ
Группа Build American AI, связанная с суперкомитетом Leading the Future, ведёт кампанию в соцсетях и продвигает тезис о том, что США нужно опередить Китай в ИИ. По данным материала, проект поддержан технолидерами, бюджет суперкомитета достиг $100 миллионов, а за один ролик в TikTok инфлюенсерам предлагают около $5,000.
🛠️ Unsloth исправил баг в Mistral Medium 3.5
Команда Unsloth сообщила, что 1 мая 2026 года вместе с Mistral исправила проблему инференса Mistral Medium 3.5 в некоторых реализациях и выпустила обновлённые GGUF. В описании указана ошибка парсинга YaRN, затронувшая transformers и llama.cpp; для обхода меняли mscale_all_dim с 1 на 0.
🧠 Пользователь сравнил Qwen 3.6-27B и Gemma 4 как ежедневную локальную модель
Автор поста пишет, что поставил Qwen 3.6-27B q8_k_xl в VSCode Insiders и запустил её локально через LM Studio на RTX 6000 Pro, а также сравнил её с Gemma 4. Для обычных задач, включая сбор данных и веб-скрапинг в разрабатываемом приложении, он отмечает, что связка показала себя уверенно.
#CutCode #AI #AIРазработка #AIНовости #LocalLLM
Подписывайся - @CutCode_AI
❤🔥5🎉3👍2🥰2🔥1😍1💯1
🔥 Reddit-дайджест от CutCode за 7 мая
📊 Автор собрал harness-bench для llama.cpp и проверил Qwen3.6-27B на 16 задачах
Автор собрал бенчмарк harness-bench для local LLM в llama.cpp llama-server и прогнал 1360 запусков на одном M3 Max с 128 ГБ памяти. Связка Qwen3.6-27B и pi стала единственной, которая закрыла все 16 задач; один прогон занимал около 207 секунд.
🧠 Пользователь собрал три браузерные игры с Claude, одна из них набрала 25 млн запусков
Автор пишет, что раньше не умел кодить, а первый рабочий прототип игры получил через шесть часов после промпта в Claude через Cursor. Две из трёх игр выросли до HTML-файлов по 8000 строк, а одна из них набрала 25 млн запусков.
🧰 Пользователь ускорил Qwen3.6-27B до 50 токенов в секунду на RTX 3090
Автор показывает запуск Qwen3.6-27B с контекстом 100000 на RTX 3090 и получает 50 токенов в секунду в llama.cpp. В посте также указан GGUF-сборка и патч из запроса на слияние 22673 для llama.cpp.
#CutCode #AI #AIРазработка #LocalLLM #Qwen
Подписывайся - @CutCode_AI
📊 Автор собрал harness-bench для llama.cpp и проверил Qwen3.6-27B на 16 задачах
Автор собрал бенчмарк harness-bench для local LLM в llama.cpp llama-server и прогнал 1360 запусков на одном M3 Max с 128 ГБ памяти. Связка Qwen3.6-27B и pi стала единственной, которая закрыла все 16 задач; один прогон занимал около 207 секунд.
🧠 Пользователь собрал три браузерные игры с Claude, одна из них набрала 25 млн запусков
Автор пишет, что раньше не умел кодить, а первый рабочий прототип игры получил через шесть часов после промпта в Claude через Cursor. Две из трёх игр выросли до HTML-файлов по 8000 строк, а одна из них набрала 25 млн запусков.
🧰 Пользователь ускорил Qwen3.6-27B до 50 токенов в секунду на RTX 3090
Автор показывает запуск Qwen3.6-27B с контекстом 100000 на RTX 3090 и получает 50 токенов в секунду в llama.cpp. В посте также указан GGUF-сборка и патч из запроса на слияние 22673 для llama.cpp.
#CutCode #AI #AIРазработка #LocalLLM #Qwen
Подписывайся - @CutCode_AI
👍3🥰3🔥2❤🔥2❤1🎉1🤩1😍1
🔥 Reddit-дайджест от CutCode за 8 мая
🔒 Google Chrome незаметно установил 4 ГБ ИИ-модель на устройства пользователей
Исследователь пишет, что Google Chrome записывает на диск файл с ИИ-моделью размером 4 ГБ без запроса на согласие. В материале это сравнивают с похожим поведением вокруг Claude Desktop, где расширения и мосты появлялись на машинах пользователей без отдельного диалога.
#CutCode #AI #Google #LocalLLM #Безопасность
Подписывайся - @CutCode_AI
🔒 Google Chrome незаметно установил 4 ГБ ИИ-модель на устройства пользователей
Исследователь пишет, что Google Chrome записывает на диск файл с ИИ-моделью размером 4 ГБ без запроса на согласие. В материале это сравнивают с похожим поведением вокруг Claude Desktop, где расширения и мосты появлялись на машинах пользователей без отдельного диалога.
#CutCode #AI #Google #LocalLLM #Безопасность
Подписывайся - @CutCode_AI
❤4🔥2🎉2❤🔥2👍1🥰1🤩1😍1💯1
🔥 Reddit-дайджест от CutCode за 9 мая
🧠 Сообщество выложило Qwen3.6 35B A3B с сохранённым Native MTP и новыми форматами
Автор публикации выложил Qwen3.6 35B A3B в варианте uncensored heretic с сохранённым Native MTP. В описании указаны KLD 0.0015, 10 из 100 отказов и сохранение всех 19 MTP. Модель доступна в safetensors, GGUF, NVFP4, NVFP4 GGUF и GPTQ-Int4.
#CutCode #AI #LocalLLM #OpenSource #Qwen
Подписывайся - @CutCode_AI
🧠 Сообщество выложило Qwen3.6 35B A3B с сохранённым Native MTP и новыми форматами
Автор публикации выложил Qwen3.6 35B A3B в варианте uncensored heretic с сохранённым Native MTP. В описании указаны KLD 0.0015, 10 из 100 отказов и сохранение всех 19 MTP. Модель доступна в safetensors, GGUF, NVFP4, NVFP4 GGUF и GPTQ-Int4.
#CutCode #AI #LocalLLM #OpenSource #Qwen
Подписывайся - @CutCode_AI
❤🔥4👍3🥰3🎉3🤩2😍2🔥1💯1