И если кто-то соберется покупать под нейронку Mac Studio, имейте ввиду, m3 ultra рулит по сравнению с m4 max. Неожиданно, но это и количество камней, и, главное - организация памяти. Видосик на эту тему
YouTube
Ditch 512 GB Monster…this M3 Ultra Just Redefined “Enough”
See how the humble base Mac Studio surprisingly beats its bigger sibling and my RTX beast in real-world AI tasks.
Check out ChatLLM: https://chatllm.abacus.ai/ltf
🛒 Gear Links 🛒
* 📦🎮 Mini Rack: https://amzn.to/4dXfwan
* 💻🔄 The GmkTec EVO X2: https://amzn.to/4l5BHOh…
Check out ChatLLM: https://chatllm.abacus.ai/ltf
🛒 Gear Links 🛒
* 📦🎮 Mini Rack: https://amzn.to/4dXfwan
* 💻🔄 The GmkTec EVO X2: https://amzn.to/4l5BHOh…
Ну что, похоже революция отменяется. Народ модельки попробовал, и в целом в сетях царит скорее разочарование - прорыва по сравнению с сущетвующим зоопарком открытых моделей не случилочь. Kimi, GLM, Qwen, devstral и пр. - вполне достойные альтернативы. Ну что же, ждем теперь когда наконец сделает свой релиз DeepSeek. Тем не менее, верю, что модельки таких размеров скоро будут очень и очень хороши, в конце концом мозг человека - это всего 80B нейронов...
а вот тут и контекст для Квена расширили...
а вот тут и контекст для Квена расширили...
Telegram
Machinelearning
🚀 Qwen3-4B-Instruct-2507 и Qwen3-4B-Thinking-2507 — ловите еще один апдейт от Qwen: LLM с поддержкой 256K контекста
🧠 Qwen3-4B-Instruct — идеально подойдёт для:
• генерации текстов
• многоязычных задач
• сложных промптов
🧠 Qwen3-4B-Thinking — заточен…
🧠 Qwen3-4B-Instruct — идеально подойдёт для:
• генерации текстов
• многоязычных задач
• сложных промптов
🧠 Qwen3-4B-Thinking — заточен…
Forwarded from Анализ данных (Data analysis)
🎯 Записывает и транскрибирует всё, что вы слышите и говорите, сохраняет это на ваш сервер. Через мобильное/веб‑приложение вы общаетесь с ADeus уже в контексте — никаких сторонних облаков.
🔧 Состав:
• ACM‑металлическое устройство
• Мобильное/веб UI
• Supabase backend + LLM интеграция
💰 Стоимость ≈ 100 USD (DIY) за устройство и открытый код
⭐ Более 3 200 звёзд на GitHub, 19 контрибьюторов, активные фичи: Bluetooth, diarization, voice‑activity detection и UI‑улучшения.
📚 Подробнее:
• GitHub: https://github.com/adamcohenhillel/ADeus
• Документация: https://docs.adeus.ai/
@data_analysis_ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Любопытная статистика. Claude Code догоняет Cursor, но на пятки наступает Gemini code assist, о котором вообще мало говорят - это такой же помощник, работающий с командной строкой, как и Claude Code. Правда, мне надо платить за апи при его использовании (подписки платной на Google у меня нет), а Claude code можно пользоваться в рамках платной подписки, не тратясь на апи. В общем, есть повод задуматься. И заметьте - codex от OpenAI отсутствует здесь как класс…
Для тех, кто работает со своими моделями и обучением нейронок - агент, который дообучает нейронки при работе с МСР серверами. Звучит очень перспективно
GitHub
GitHub - OpenPipe/ART: Agent Reinforcement Trainer: train multi-step agents for real-world tasks using GRPO. Give your agents on…
Agent Reinforcement Trainer: train multi-step agents for real-world tasks using GRPO. Give your agents on-the-job training. Reinforcement learning for Qwen3.6, GPT-OSS, Llama, and more! - OpenPipe/ART
Маленькая локальная модель, оптимизированная для поиска - может быть интересно для тех, кто использует n8n и другие автоматизации
ii.inc
II-Search - Intelligent Internet
Introduction
The II-Researcher framework is dedicated to producing powerful, open-source agents for complex research. Our latest additions to this initiative are II-Search-4B and II-Search-CIR-4B, two 4-billion-parameter language models designed to tackle…
The II-Researcher framework is dedicated to producing powerful, open-source agents for complex research. Our latest additions to this initiative are II-Search-4B and II-Search-CIR-4B, two 4-billion-parameter language models designed to tackle…
Курс по использованию Claude Code со звездным составом преподавателей
www.deeplearning.ai
Claude Code: A Highly Agentic Coding Assistant
Explore, build, and refine codebases with Claude Code.
👍1
Forwarded from Machine learning Interview
💾 Awesome-Efficient-LLM — коллекция методов оптимизации больших языковых моделей. Этот репозиторий объединяет последние исследования по ускорению и сжатию LLM: от квантования и sparse-методов до архитектурных оптимизаций. Особенно полезны разделы про speculative inference и mixture-of-experts — ключевые направления для реального развертывания моделей.
Проект полезен инженерам, которые хотят внедрить LLM в production с минимальными затратами ресурсов. Все работы отсортированы по дате публикации и области применения.
🤖 GitHub
@machinelearning_interview
Проект полезен инженерам, которые хотят внедрить LLM в production с минимальными затратами ресурсов. Все работы отсортированы по дате публикации и области применения.
🤖 GitHub
@machinelearning_interview
Говорят, новая GPT-5 чудо как хороша а кодинге..
Telegram
Denis Sexy IT 🤖
Так, вышла GPT5 – спасибо JetBrains, партнеру OpenAI который подключил ее один из первых и в продуктах которого она будет доступна в течение часа по дефолту, где я ее и тестил
Бенчмарки постить не буду, хочу начать со своего опыта использования:
– GPT5…
Бенчмарки постить не буду, хочу начать со своего опыта использования:
– GPT5…
И вот еще нашел прикольную штуку - программулина позволяет в одном интерфейсе общаться с разными моделями. Я это практикую очень часто. Шутят, что с такими ценами на ChatGPT-5 (а они низкие!!) скоро его будут вызывать из Clyde Code вместо Opus.
Repo Prompt
Repo Prompt – Iterate on code with powerful AI
Repo Prompt - A macOS native app designed to remove all the friction involved in iterating on your code with the most powerful AI models.
Видимо это судьба - заниматься не нейронками, а всякой фигней типа сетевого администрирования. Отрубился OpenVPN, причем получается интересно - OpenVPN с дружественного сервера работает, на моем сервере работает Amnezia, а вот сам OpenVPN на моем серваке работать перестал. Пару часов пробовал его поднять, не смог - судя по всему, дело в провайдере. В итоге переключился на Амнезию. Жаль, я уже привык. Мягко говоря, задалбывает, когда все стремятся тебе жизнь усложить, впрочем - не убило, разобрались, будем сильнее
Cursor теперь в терминале - все рванули на площадку Claude Code )) для установки запускайте
curl cursor.com/install -fsS | bash
curl cursor.com/install -fsS | bash
Понятно, сегодня все ленты забиты gpt-5, и по отзывам это действительно хорошая модель, особенно заметен прогресс в кодировании. У меня уже работает - первые бытовые впечатления: очень быстрая, но на бытовых вопросах и задачах кроме скорости какой-то большой разницы с прошлыми моделями не вижу. Видимо, моделька использовала нейронку попроще - ведь теперь она сама выбирает, под каждый вопрос, какого размера нейронка нужна. Впрочем, это всяко большой позитив, в выходные есть чем побаловаться
Qwen увеличил контекст до 1 млн токенов и это реально круто - маленькое окно быстро становится проблемой. Но помните, качество работы модели при росте контекста падает, поэтому стоит его экономить и регулярно открывать новые диалоги, даже если 1 млн токенов еще не выбран
Telegram
Machine learning Interview
🚀 Qwen3-30B-A3B-2507 и Qwen3-235B-A22B-2507 теперь поддерживают контекст до 1 млн токенов!
🔧 Технологии под капотом:
• Dual Chunk Attention (DCA) — метод экстраполяции длины, который делит длинные последовательности на управляемые блоки, сохраняя глобальную…
🔧 Технологии под капотом:
• Dual Chunk Attention (DCA) — метод экстраполяции длины, который делит длинные последовательности на управляемые блоки, сохраняя глобальную…
Qwen Code теперь дает 2000 бесплатных запросов в день. Это модель, работающая в командной строке, как Claude Code. Это интересно, поскольку у того же Gemini надо платить за api, а Claude и GPT-5 работают по подписке. Да, напомню, что на днях Qwen раскатал контекст на 1 млн токенов, который до этого был только у Gemini. При этом и сама модель неплоха. Я бы сказал, что сейчас столько возможностей использовать хороший ИИ бесплатно или совсем задешево, просто удивительно
GitHub
GitHub - QwenLM/qwen-code: An open-source AI coding agent that lives in your terminal.
An open-source AI coding agent that lives in your terminal. - QwenLM/qwen-code
👍1
OpenAI пришлось оправдываться перед расстроенными пользователями за запуск GPT-5 - нормально не работал роутер, выбирающий модель, были проблемы с повышенной нагрузкой, баги и пр. В итоге на платную подписку вернули даже got-4o и удвоили лимиты по платной подписке. В таких случаях, мне кажется, больше всего подходят слова Аршавина: ваши ожидания - ваши проблемы. Сейчас уже не время больших прорывов, каждый новый шаг лается с трудом, модели становятся лучше, но понемногу. Скорее прогресс идет не в самих моделях, а их окружении и интерфейсе по их использованию. В общем, все по плану, ждем ответов от конкурентов - интересно, как там дела у DeepSeek и их новым ризонером?
В части же gpt-5 есть мнение, что модель хороша в режимах, когда можно выбрать конкретную модель из семейства (кто не знает, gpt-5 это не одна, а несколько моделей в одном интерфейсе) и работать с ней, а вот когда она сама начинает подбирать модель и переключаться между ними, возникают проблемы, прежде всего, связанные с маленьким контекстом в младших моделях.
В части же gpt-5 есть мнение, что модель хороша в режимах, когда можно выбрать конкретную модель из семейства (кто не знает, gpt-5 это не одна, а несколько моделей в одном интерфейсе) и работать с ней, а вот когда она сама начинает подбирать модель и переключаться между ними, возникают проблемы, прежде всего, связанные с маленьким контекстом в младших моделях.
Claude code получил обновление, которое позволяет запускать в терминале фоновые bash команды при работающем Клоде - полезно, например, для анализа логов при отладке программ.
X (formerly Twitter)
Ian Nuttall (@iannuttall) on X
Claude Code 1.0.71 is out 🔥
- Run bash commands in the background with Ctrl+b
- custom status line using /statusline command
- Run bash commands in the background with Ctrl+b
- custom status line using /statusline command
Поставил себе gpt-oss-20b на mac mini m4 16gb. Работает! Ставил через LM Studio, но потребовалось отключить Model loading guardrails в настройках, без этого модель не запускалась, утверждала, что мало ресурсов. Работает на скорости 18-24 токена. заняло 20 мин времени. Очень доволен.
На первый взгляд, модель не такая уж и тупая. Для использования в диалогах она, конечно, будет сильно проигрывать лучшим моделям, но для большинства автоматизаций, думаю, ее будет более чем достаточно. Единственное, для работы с n8n памяти хватать не должно - тут надо бы еще один мак мини прикупить либо посмотреть на модель с квантованием на 4бита (эта - на 8). При этом Клод утверждает, что если не использовать LM Studio, а идти по хардкору и всю установку делать самостоятельно, то скорость можно поднять до 30-35 токенов, да и настроек, включая файн-тьюнинг можно сделать гораздо больше.
На первый взгляд, модель не такая уж и тупая. Для использования в диалогах она, конечно, будет сильно проигрывать лучшим моделям, но для большинства автоматизаций, думаю, ее будет более чем достаточно. Единственное, для работы с n8n памяти хватать не должно - тут надо бы еще один мак мини прикупить либо посмотреть на модель с квантованием на 4бита (эта - на 8). При этом Клод утверждает, что если не использовать LM Studio, а идти по хардкору и всю установку делать самостоятельно, то скорость можно поднять до 30-35 токенов, да и настроек, включая файн-тьюнинг можно сделать гораздо больше.
Forwarded from Data Secrets
Нашли тут для вас готовый ноутбук для файнтюна gpt-oss
Внутри все end-to-end, от скачивания модели и подготовки данных до обучения и инференса.
Еще и мощно оптимизировано, кстати. Моделька на 20В вмещается в 14GB видеопамяти. То есть теоретически запустится даже на бесплатных ресурсах колаба.
Ноутбук для 20В (его же можно использовать для 120В)
А вот тут лежат все текстовые пояснения к коду и «теория»:про то, как работает формат Harmony и почему он необходим, например. В общем все, чтобы запускать код не в слепую (хотя так тоже можно), а с достаточно глубоким пониманием.
Занятие на выходные что надо
Внутри все end-to-end, от скачивания модели и подготовки данных до обучения и инференса.
Еще и мощно оптимизировано, кстати. Моделька на 20В вмещается в 14GB видеопамяти. То есть теоретически запустится даже на бесплатных ресурсах колаба.
Ноутбук для 20В (его же можно использовать для 120В)
А вот тут лежат все текстовые пояснения к коду и «теория»:про то, как работает формат Harmony и почему он необходим, например. В общем все, чтобы запускать код не в слепую (хотя так тоже можно), а с достаточно глубоким пониманием.
Занятие на выходные что надо