Пишу мало, потому что путешествую в отпуске по загнивающим Европам. Времени на занятия ИИ нет, но зато пользуюсь Claude каждый день, чтобы спланировать путешествие и заказать отель. Визы мы получили за три дня до вылета (французы - молодцы, справились за три недели и дали на год), билеты и гостиницы я заранее не заказывал и даже не смотрел. Так что теперь каждый вечер сидим с Клодом и смотрим, где остановиться завтра. Впечатления такие: во-первых, полезно. Во-вторых, контекст заканчивается буквально за три-четыре запроса - видимо, в поиске много информации потребляется. Когда поставил research, Клод изучил 289(!) источников. Поэтому сделал проект с общим описанием задачи и каждый раз запускаю новый поиск.
При этом цены на отели пишет неправильные, доступность номеров на 3 человек - тоже та еще проблема. Когда совсем беда - бросаю интеллект и бучу сам. Правда, как показала практика, в половине отелей на их сайтах заказывать гораздо дешевле )) Можно было бы, конечно, заморочиться всякими агентами и пр., но лень - это просто выбор пути и отелей (задачка комбинаторной сложности..)
В общем, есть еще куда совершенствоваться
При этом цены на отели пишет неправильные, доступность номеров на 3 человек - тоже та еще проблема. Когда совсем беда - бросаю интеллект и бучу сам. Правда, как показала практика, в половине отелей на их сайтах заказывать гораздо дешевле )) Можно было бы, конечно, заморочиться всякими агентами и пр., но лень - это просто выбор пути и отелей (задачка комбинаторной сложности..)
В общем, есть еще куда совершенствоваться
🍾2
Инсайдеры говорят, что память для Клода близка к выходу - сначала будет поиск по старым сообщения, а там, глядишь и пошире раскатают. Но это браузерная версия.
А текущий хит - Claude Code. Тут хорошие и плохие новости. Хорошие - появились субагенты, каждый может специализироваться на своем. А плохая - вводят недельные лимиты против тех, кто юзает его 24/7. А таких, говорят, много. Вот для него память тоже можно делать, но пока кастомно, тоже ждем официального продукта.
А текущий хит - Claude Code. Тут хорошие и плохие новости. Хорошие - появились субагенты, каждый может специализироваться на своем. А плохая - вводят недельные лимиты против тех, кто юзает его 24/7. А таких, говорят, много. Вот для него память тоже можно делать, но пока кастомно, тоже ждем официального продукта.
Прикольно. По ссылочке в гитхаб инструкция по модификации системного промпта для ChatGPT. Может бы и занялся, но в последнее время плотно пересел на Claude и Gemini. Но может кому пригодится
https://github.com/DenisSergeevitch/chatgpt-custom-instructions
https://t.me/denissexy/10529
https://github.com/DenisSergeevitch/chatgpt-custom-instructions
https://t.me/denissexy/10529
GitHub
GitHub - DenisSergeevitch/chatgpt-custom-instructions: My own Prompts for Custom instructions ChatGPT
My own Prompts for Custom instructions ChatGPT. Contribute to DenisSergeevitch/chatgpt-custom-instructions development by creating an account on GitHub.
❤1
Очередные мини-модели от китайцев для установки на свои мощности. Конечно, пока все это достаточно спорно, но через год-полтора модели уровня сегодняшних топ вполне смогут размещаться на домашних серверах..
Telegram
Machinelearning
🚀 Tencent расширяет экосистему Hunyuan LLM и выкладывают в открытый доступ еще 4 компактных моделей — 0.5B, 1.8B, 4B и 7B!
Эти модели заточены под low-power устройства: ПК, смартфоны, авто, умные дома и пользовательские GPU.
Модели легко настраиваются…
Эти модели заточены под low-power устройства: ПК, смартфоны, авто, умные дома и пользовательские GPU.
Модели легко настраиваются…
Плюс открытая моделька для генерации изображений от Qwen..
Telegram
Machinelearning
✔️ Qwen-Image — новая открытая модель MMDiT 20B для генерации изображений.
Особенно эффективна для создания картинок с нативным текстом.
🔍 Основные моменты:
🔹 Рендеринг текста SOTA показатели — конкурирует с GPT-4o на английском языке, лучший в своем классе…
Особенно эффективна для создания картинок с нативным текстом.
🔍 Основные моменты:
🔹 Рендеринг текста SOTA показатели — конкурирует с GPT-4o на английском языке, лучший в своем классе…
❤1
Пожалуй, самые интересные новости сегодняшнего утра - GitHub выкатил формат, позволяющий запускать модели из кода или командной строки, причем это универсальный формат, совместимый с OpenAI SDK (т.е. все будет работать с большинством агентов). API от ChatGPT, Anthropic и пр. не нужны, достаточно API от GitHub с бесплатной подпиской. По ней будут работать бесплатные модели, по платной - работают модели покруче с контекстом побольше. Бонус в том, что над кодом можно работать не тратя деньги на подписки и установку собственных моделей, при этом можно практически мгновенно переключиться на собственные или проплаченные модели.
И тут же похожая новость от HuggingFace, которые дают возможность запускать автоматизированные задачи из терминала и скриптов. Как это работает, пока мне менее понятно, и подписка нужна платная, но тренд понятен - в связи с ростом популярности Claude Code и других аналогичных инструментов, работающих в терминале, для них создается все больше и больше инструментов, дающих доступ ко всему и вся. То, что доктор прописал, очень круто
И тут же похожая новость от HuggingFace, которые дают возможность запускать автоматизированные задачи из терминала и скриптов. Как это работает, пока мне менее понятно, и подписка нужна платная, но тренд понятен - в связи с ростом популярности Claude Code и других аналогичных инструментов, работающих в терминале, для них создается все больше и больше инструментов, дающих доступ ко всему и вся. То, что доктор прописал, очень круто
Telegram
Анализ данных (Data analysis)
🚀 GitHub решил главную боль open-source ИИ-проектов — теперь inference доступен всем
Новая инициатива GitHub Models позволяет запускать LLM прямо из кода или CI,
⚡️ без API-ключей OpenAI, без развёртывания моделей, без костылей.
🔧 Как это работает:
-…
Новая инициатива GitHub Models позволяет запускать LLM прямо из кода или CI,
⚡️ без API-ключей OpenAI, без развёртывания моделей, без костылей.
🔧 Как это работает:
-…
❤1
Forwarded from Anton Vdovitchenko — One Man Enterprise
Свершилось чудо! Ребята из OpenAI выпустили в Open Source модели, называются gpt-oss-120b и gpt-oss-20b.
Судя по тому, что они сами пишут в бенчмарках, это лучшие модели подобного форм-фактора на сегодняшний день.
Элементом является то, что модели включают в себя reasoning и вызов инструментов (tool use). Это означает, что их можно использовать в агентных приложениях в собственных продуктах.
Модели уже завезли в Ollama, так что можно поменять где-нибудь в системе автоматизации название модели с чего-нибудь на gpt-oss:latest и посмотреть, что будет :-)
Пробуем тут: https://www.gpt-oss.com/
Хороший день.
Судя по тому, что они сами пишут в бенчмарках, это лучшие модели подобного форм-фактора на сегодняшний день.
Элементом является то, что модели включают в себя reasoning и вызов инструментов (tool use). Это означает, что их можно использовать в агентных приложениях в собственных продуктах.
Модели уже завезли в Ollama, так что можно поменять где-нибудь в системе автоматизации название модели с чего-нибудь на gpt-oss:latest и посмотреть, что будет :-)
Пробуем тут: https://www.gpt-oss.com/
Хороший день.
👍2❤1
Ну и, кстати, новость поменьше Claude Opus обновили до 4.1, уже доступен в Claude Code и на платных подписках. Ждем chstGPT-5 и новостей от Gemini.
И бонусом промпт в одно предложение, который существенно ограничивает фантазию Клода, если вы понимаете о чем я
И бонусом промпт в одно предложение, который существенно ограничивает фантазию Клода, если вы понимаете о чем я
X (formerly Twitter)
Ian Nuttall (@iannuttall) on X
It's amazing how effective this one sentence prompt is to stop Claude from overengineering or refactoring your codebase
В целом тренд на маленькие модели набирает обороты и новые модельки от OpenAI грозят стать отраслевым стандартом надолго, как llama 3. Для многих это будут первые модели к себя на компах. Посмотрим, как будет в жизни, но выглядит релиз очень многообещающе
❤1
OpenAI выложили инструкцию по файнтьюнингу открытых моделек. Молодцы
Openai
Fine-tuning with gpt-oss and Hugging Face Transformers | OpenAI Cookbook
Authored by: Edward Beeching, Quentin Gallouédec, and Lewis Tunstall Large reasoning models like OpenAI o3 generate a chain-of-thought to...
И еще нюансы - для работы с моделью надо использовать Harmony формат, который OpenAI выложили на GitHub. С чем это едят, до конца не понял, но есть ощущение, что без этого нормально не заработает - как я понял, это форматирование сообщений, передаваемых модели, и правильная разбивка их на токены
GitHub
GitHub - openai/harmony: Renderer for the harmony response format to be used with gpt-oss
Renderer for the harmony response format to be used with gpt-oss - openai/harmony
Попользовался немного Opus 4.1 - тема бытовая: что лучше поставить - кластер из 4 mac mini или один mac studio с 64 Гб для работы с моделями. В целом неплохо (но оно и раньше хорошо было), расскажу чуть позже, но тут такая тема. Пока Клод отвечал на вопросы и изучал интернет, у него кончились бесплатные токены по подписке. Я не успел задать и 10 вопросов, контекст даже одного диалога не выбран.. Видимо, цена модели такая, что лишний раз трогать ее не нужно, когда достаточно и Соннета.
❤1
С выходом открытой модели от OpenAI, думаю, многие задумались - а можно ли ее запустить дома, и сколько это стоит. Вариант очевидный - Mac studio. В силу организации памяти, на нем такие модели работают во многих случаях быстрее, чем на видеокартах, а про объем памяти я и не говорю (основное ограничение здесь - память). Проблема здесь в том, что с ростом памяти стоимость компьютера растет в разы. Если базовая версия с 36Гб стоит около 200 т.р., то с 64Гб - уже более 300. В принципе, самый дешевый способ набрать памяти - купить себе стопку минимальных Mac mini c 16Гб каждый, по 45 тыс. руб. И, самое главное, в этом кластере модель работать будет - надо использовать пакет Exo Labs. Проблема в том, что из-за сетевых задержек модель будет работать сильно медленнее при одиночном запросе, так как токен проходит через все машины, используемые в системе. А вот при множественных работа будет распараллеливаться, и общее количество токенов в секунду будет больше. Так что, если к модели запросов много, стойка мини не только дешевле, но и быстрее. Вопрос в том, что скорость по отдельному запросу в 10-12 токенов слишком низка. Подожду, когда появятся видосики и комментарии от умельцев, которые погоняли все на практике. Уже близко к тому, чтобы разворачивать сетку дома, но цена в 300 тыс. руб. (и то пока не уверен, что машина потянет) колется. И да, это все на основе анализа от Клода, надо проверять
👍1
И если кто-то соберется покупать под нейронку Mac Studio, имейте ввиду, m3 ultra рулит по сравнению с m4 max. Неожиданно, но это и количество камней, и, главное - организация памяти. Видосик на эту тему
YouTube
Ditch 512 GB Monster…this M3 Ultra Just Redefined “Enough”
See how the humble base Mac Studio surprisingly beats its bigger sibling and my RTX beast in real-world AI tasks.
Check out ChatLLM: https://chatllm.abacus.ai/ltf
🛒 Gear Links 🛒
* 📦🎮 Mini Rack: https://amzn.to/4dXfwan
* 💻🔄 The GmkTec EVO X2: https://amzn.to/4l5BHOh…
Check out ChatLLM: https://chatllm.abacus.ai/ltf
🛒 Gear Links 🛒
* 📦🎮 Mini Rack: https://amzn.to/4dXfwan
* 💻🔄 The GmkTec EVO X2: https://amzn.to/4l5BHOh…
Ну что, похоже революция отменяется. Народ модельки попробовал, и в целом в сетях царит скорее разочарование - прорыва по сравнению с сущетвующим зоопарком открытых моделей не случилочь. Kimi, GLM, Qwen, devstral и пр. - вполне достойные альтернативы. Ну что же, ждем теперь когда наконец сделает свой релиз DeepSeek. Тем не менее, верю, что модельки таких размеров скоро будут очень и очень хороши, в конце концом мозг человека - это всего 80B нейронов...
а вот тут и контекст для Квена расширили...
а вот тут и контекст для Квена расширили...
Telegram
Machinelearning
🚀 Qwen3-4B-Instruct-2507 и Qwen3-4B-Thinking-2507 — ловите еще один апдейт от Qwen: LLM с поддержкой 256K контекста
🧠 Qwen3-4B-Instruct — идеально подойдёт для:
• генерации текстов
• многоязычных задач
• сложных промптов
🧠 Qwen3-4B-Thinking — заточен…
🧠 Qwen3-4B-Instruct — идеально подойдёт для:
• генерации текстов
• многоязычных задач
• сложных промптов
🧠 Qwen3-4B-Thinking — заточен…
Forwarded from Анализ данных (Data analysis)
🎯 Записывает и транскрибирует всё, что вы слышите и говорите, сохраняет это на ваш сервер. Через мобильное/веб‑приложение вы общаетесь с ADeus уже в контексте — никаких сторонних облаков.
🔧 Состав:
• ACM‑металлическое устройство
• Мобильное/веб UI
• Supabase backend + LLM интеграция
💰 Стоимость ≈ 100 USD (DIY) за устройство и открытый код
⭐ Более 3 200 звёзд на GitHub, 19 контрибьюторов, активные фичи: Bluetooth, diarization, voice‑activity detection и UI‑улучшения.
📚 Подробнее:
• GitHub: https://github.com/adamcohenhillel/ADeus
• Документация: https://docs.adeus.ai/
@data_analysis_ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Любопытная статистика. Claude Code догоняет Cursor, но на пятки наступает Gemini code assist, о котором вообще мало говорят - это такой же помощник, работающий с командной строкой, как и Claude Code. Правда, мне надо платить за апи при его использовании (подписки платной на Google у меня нет), а Claude code можно пользоваться в рамках платной подписки, не тратясь на апи. В общем, есть повод задуматься. И заметьте - codex от OpenAI отсутствует здесь как класс…
Для тех, кто работает со своими моделями и обучением нейронок - агент, который дообучает нейронки при работе с МСР серверами. Звучит очень перспективно
GitHub
GitHub - OpenPipe/ART: Agent Reinforcement Trainer: train multi-step agents for real-world tasks using GRPO. Give your agents on…
Agent Reinforcement Trainer: train multi-step agents for real-world tasks using GRPO. Give your agents on-the-job training. Reinforcement learning for Qwen3.6, GPT-OSS, Llama, and more! - OpenPipe/ART
Маленькая локальная модель, оптимизированная для поиска - может быть интересно для тех, кто использует n8n и другие автоматизации
ii.inc
II-Search - Intelligent Internet
Introduction
The II-Researcher framework is dedicated to producing powerful, open-source agents for complex research. Our latest additions to this initiative are II-Search-4B and II-Search-CIR-4B, two 4-billion-parameter language models designed to tackle…
The II-Researcher framework is dedicated to producing powerful, open-source agents for complex research. Our latest additions to this initiative are II-Search-4B and II-Search-CIR-4B, two 4-billion-parameter language models designed to tackle…