GPT-5.6 Sol: первые отзывы попробовавших
OpenAI выпустила GPT-5.6 в ChatGPT, Codex и API. В линейке три модели: Sol для длинной агентной работы, Terra для баланса цены и качества, Luna для быстрых массовых задач.
По свежим X-отзывам Sol сейчас обсуждают не как «самого умного собеседника». Его описывают как исполнителя: держит маршрут, сам добирает контекст, режет работу на шаги, использует инструменты и реже бросает задачу перед финишем.
Peter Gostev делит роли так: Fable сильнее в архитектурном разговоре и текстах, Sol лучше уходит в реализацию. Arrakis AI пишет похожее: при ясной цели Sol упорно идёт к результату, поднимает субагентов и хорошо ложится на агентное программирование с AGENTS.md и навыками.
Полевые примеры выглядят убедительнее бенчмарков:
┈ правка маленького бага: проверки, поиск затронутых мест, тест, исправление и минимальный патч;
┈ формальная верификация: лучше видит архитектурные проблемы в коде;
┈ управление компьютером: Moonlight примерно с 15 до 193 кадр/с;
┈ планирование поездки: Google Maps, сайты кемпингов, сверка дат и уточняющие вопросы.
Но Fable по отзывам остаётся сильнее в написании текста, фронтенде и широком размышлении. Sol иногда медленнее GPT-5.5, слабее пишет сообщения коммитов и комментарии, может тащить старые инструкции или построить лишнюю механику. В Codex отдельно спорят про маршрутизацию субагентов.
Для оператора меняется постановка задачи. Sol лучше раскрывается, когда получает проверяемую цель, доступ к репозиторию и файлам, заданный размер системы, критерии готовности, поэтапные коммиты и финальный аудит. Без этих опор его настойчивость легко превращается в лишнюю работу.
Источник: OpenAI / X-отзывы: Peter Gostev, Every, Arrakis AI, Perry Metzger, Nish.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
OpenAI выпустила GPT-5.6 в ChatGPT, Codex и API. В линейке три модели: Sol для длинной агентной работы, Terra для баланса цены и качества, Luna для быстрых массовых задач.
По свежим X-отзывам Sol сейчас обсуждают не как «самого умного собеседника». Его описывают как исполнителя: держит маршрут, сам добирает контекст, режет работу на шаги, использует инструменты и реже бросает задачу перед финишем.
Peter Gostev делит роли так: Fable сильнее в архитектурном разговоре и текстах, Sol лучше уходит в реализацию. Arrakis AI пишет похожее: при ясной цели Sol упорно идёт к результату, поднимает субагентов и хорошо ложится на агентное программирование с AGENTS.md и навыками.
Полевые примеры выглядят убедительнее бенчмарков:
┈ правка маленького бага: проверки, поиск затронутых мест, тест, исправление и минимальный патч;
┈ формальная верификация: лучше видит архитектурные проблемы в коде;
┈ управление компьютером: Moonlight примерно с 15 до 193 кадр/с;
┈ планирование поездки: Google Maps, сайты кемпингов, сверка дат и уточняющие вопросы.
Но Fable по отзывам остаётся сильнее в написании текста, фронтенде и широком размышлении. Sol иногда медленнее GPT-5.5, слабее пишет сообщения коммитов и комментарии, может тащить старые инструкции или построить лишнюю механику. В Codex отдельно спорят про маршрутизацию субагентов.
Для оператора меняется постановка задачи. Sol лучше раскрывается, когда получает проверяемую цель, доступ к репозиторию и файлам, заданный размер системы, критерии готовности, поэтапные коммиты и финальный аудит. Без этих опор его настойчивость легко превращается в лишнюю работу.
Источник: OpenAI / X-отзывы: Peter Gostev, Every, Arrakis AI, Perry Metzger, Nish.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Reve 2.1: изображение сначала собирается в план
Reve представила модель 2.1. Главный трюк с официальной страницы: сцена сначала раскладывается как управляемая структура, потом рендерится.
Reve называет это «изображением как кодом». В промежуточном представлении сидят композиция, связи между объектами, стиль, текст и положение элементов. Поэтому кадр можно править через план сцены, а не пытаться заново выбить удачную генерацию промптом.
Заявленный пакет: 4K × 4K, 16 мегапикселей, более стабильные итерации при редактировании и отдельный контроль текста внутри композиции.
Пример с «Bestiary of Mammals» показывает почему это работает. Большая сцена держится: десятки животных, подписи, карточки, единый стиль. Мелкий текст всё ещё течёт — в фактах и подписях видны артефакты.
Проверять Reve 2.1 стоит по рабочим правкам: заменить объект, сохранить композицию, поправить текст и пройти несколько итераций без деградации. Если выдерживает, перед нами рабочий интерфейс для сборки визуальных материалов.
А пока не проверим, gpt-image-2 наш базовый минимум.
🧱 🔧 🧬 📈 💎 🟣 🟢
Источник: Reve.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Reve представила модель 2.1. Главный трюк с официальной страницы: сцена сначала раскладывается как управляемая структура, потом рендерится.
Reve называет это «изображением как кодом». В промежуточном представлении сидят композиция, связи между объектами, стиль, текст и положение элементов. Поэтому кадр можно править через план сцены, а не пытаться заново выбить удачную генерацию промптом.
Заявленный пакет: 4K × 4K, 16 мегапикселей, более стабильные итерации при редактировании и отдельный контроль текста внутри композиции.
Пример с «Bestiary of Mammals» показывает почему это работает. Большая сцена держится: десятки животных, подписи, карточки, единый стиль. Мелкий текст всё ещё течёт — в фактах и подписях видны артефакты.
Проверять Reve 2.1 стоит по рабочим правкам: заменить объект, сохранить композицию, поправить текст и пройти несколько итераций без деградации. Если выдерживает, перед нами рабочий интерфейс для сборки визуальных материалов.
А пока не проверим, gpt-image-2 наш базовый минимум.
Источник: Reve.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4💯1
Прячем основную почту от спама
⠀
Burner Mail создаёт одноразовые почтовые адреса прямо в браузере.
⠀
На сайте указываешь временный адрес вместо настоящего ящика. Письма пересылаются на основную почту, а настоящий адрес остаётся скрытым.
⠀
Если сервис начинает слать мусор, не надо чистить ящик, отписываться по ссылкам и гадать, кто слил базу. Отключаешь конкретный временный адрес и создаёшь новый.
⠀
Удобно для регистраций, тестов, скидочных форм, сомнительных SaaS и всех мест, где почту требуют раньше, чем появляется доверие.
⠀
Берём на вооружение.
⠀
Источник: Burner Mail / Chrome Web Store
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
⠀
Burner Mail создаёт одноразовые почтовые адреса прямо в браузере.
⠀
На сайте указываешь временный адрес вместо настоящего ящика. Письма пересылаются на основную почту, а настоящий адрес остаётся скрытым.
⠀
Если сервис начинает слать мусор, не надо чистить ящик, отписываться по ссылкам и гадать, кто слил базу. Отключаешь конкретный временный адрес и создаёшь новый.
⠀
Удобно для регистраций, тестов, скидочных форм, сомнительных SaaS и всех мест, где почту требуют раньше, чем появляется доверие.
⠀
Берём на вооружение.
⠀
Источник: Burner Mail / Chrome Web Store
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Vysor показывает телефон. OMG-Agent пытается им управлять
Vysor — это ручной доступ к телефону с компьютера. Он выводит экран мобильного устройства на десктоп и позволяет управлять им мышью и клавиатурой.
Такой инструмент нужен для поддержки, демонстраций, тестирования приложений и работы без постоянного переключения между экранами. В README есть клиенты для Windows, Linux, ChromeOS и устройств Apple, а также зеркалирование уведомлений и звука.
OMG-Agent находится уровнем выше. Это десктопный клиент для моделей, которые работают с мобильным интерфейсом: он получает скриншоты Android через ADB, передаёт их модели и пытается выполнить команду, данную обычным языком. Например, открыть приложение, найти нужный экран и пройти последовательность действий.
Поддерживаются AutoGLM, GELab-Zero, OpenAI-совместимые API и Android-эмуляторы.
Разница практическая: с Vysor оператором остаётся человек. OMG-Agent пытается передать эту роль ИИ. Поэтому Vysor нужен, когда важны точный ручной контроль и наблюдение, а OMG-Agent — для экспериментов с автоматизацией задач внутри Android-интерфейса, даже если у приложения нет удобного API.
Но OMG-Agent не стоит воспринимать как готовый автопилот. Проект ориентирован на Android, требует ADB, USB-отладки и ADBKeyboard. В README он заявлен только для обучения, исследований и технических экспериментов; лицензия Apache 2.0 с Commons Clause запрещает коммерческое использование.
🧱 🔧 🧬 📈 💎 🟣 🟢
Источник: Vysor GitHub / OMG-Agent GitHub.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Vysor — это ручной доступ к телефону с компьютера. Он выводит экран мобильного устройства на десктоп и позволяет управлять им мышью и клавиатурой.
Такой инструмент нужен для поддержки, демонстраций, тестирования приложений и работы без постоянного переключения между экранами. В README есть клиенты для Windows, Linux, ChromeOS и устройств Apple, а также зеркалирование уведомлений и звука.
OMG-Agent находится уровнем выше. Это десктопный клиент для моделей, которые работают с мобильным интерфейсом: он получает скриншоты Android через ADB, передаёт их модели и пытается выполнить команду, данную обычным языком. Например, открыть приложение, найти нужный экран и пройти последовательность действий.
Поддерживаются AutoGLM, GELab-Zero, OpenAI-совместимые API и Android-эмуляторы.
Разница практическая: с Vysor оператором остаётся человек. OMG-Agent пытается передать эту роль ИИ. Поэтому Vysor нужен, когда важны точный ручной контроль и наблюдение, а OMG-Agent — для экспериментов с автоматизацией задач внутри Android-интерфейса, даже если у приложения нет удобного API.
Но OMG-Agent не стоит воспринимать как готовый автопилот. Проект ориентирован на Android, требует ADB, USB-отладки и ADBKeyboard. В README он заявлен только для обучения, исследований и технических экспериментов; лицензия Apache 2.0 с Commons Clause запрещает коммерческое использование.
Источник: Vysor GitHub / OMG-Agent GitHub.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Pirate Bay для открытых LLM-моделей
Hugging Bay выглядит как место, где кто-то скрестил Hugging Face с эстетикой старого интернета. По вайбу — Pirate Bay (легендарный торрент-трекер) для открытых моделей. По факту — проверяемый реестр и система доставки открытых ИИ-артефактов.
В каталоге собраны модели, датасеты, приложения, инструменты и тесты. Для записей показываются происхождение, лицензия, уровень доверия и состояние зеркал. У доступных файлов есть манифесты и SHA-256: набор можно скачать через CLI и потом проверить целостность.
При этом большая часть каталога хранит только метаданные и ведёт к исходным площадкам. Собственные зеркала есть только у отобранной части артефактов, которые разрешено распространять. Hugging Bay не обходит закрытый доступ и не размещает модели, чьи лицензии запрещают зеркалирование.
BitTorrent здесь тоже без магии. Резервные торрент- и магнит-раздачи предусмотрены лишь для отдельных подходящих проверенных пакетов: полных, проверенных и привязанных к конкретному хешу. Общей раздачи для всего каталога нет.
OpenAPI и MCP дают агентам рабочий вход: искать артефакты, проверять происхождение, лицензии, доверие, готовность зеркала и доступные файлы. Для поисковиков и агентов есть машиночитаемое описание сервиса, пакеты для ответов и пакеты для цитирования.
Hugging Bay превращает открытые ИИ-артефакты из россыпи ссылок в проверяемую инфраструктуру для людей и агентов.
🧱 🔧 🧬 📈 💎 🟣 🟢
Источник: Hugging Bay.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Hugging Bay выглядит как место, где кто-то скрестил Hugging Face с эстетикой старого интернета. По вайбу — Pirate Bay (легендарный торрент-трекер) для открытых моделей. По факту — проверяемый реестр и система доставки открытых ИИ-артефактов.
В каталоге собраны модели, датасеты, приложения, инструменты и тесты. Для записей показываются происхождение, лицензия, уровень доверия и состояние зеркал. У доступных файлов есть манифесты и SHA-256: набор можно скачать через CLI и потом проверить целостность.
При этом большая часть каталога хранит только метаданные и ведёт к исходным площадкам. Собственные зеркала есть только у отобранной части артефактов, которые разрешено распространять. Hugging Bay не обходит закрытый доступ и не размещает модели, чьи лицензии запрещают зеркалирование.
BitTorrent здесь тоже без магии. Резервные торрент- и магнит-раздачи предусмотрены лишь для отдельных подходящих проверенных пакетов: полных, проверенных и привязанных к конкретному хешу. Общей раздачи для всего каталога нет.
OpenAPI и MCP дают агентам рабочий вход: искать артефакты, проверять происхождение, лицензии, доверие, готовность зеркала и доступные файлы. Для поисковиков и агентов есть машиночитаемое описание сервиса, пакеты для ответов и пакеты для цитирования.
Hugging Bay превращает открытые ИИ-артефакты из россыпи ссылок в проверяемую инфраструктуру для людей и агентов.
Источник: Hugging Bay.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
❤7 1
Предстоит поездка в Дананг на три недели
Взял самый популярный чат Travel Ask по этому вьетнамскому городу. Выкачал содержимое за год с telegram-chip, это мой кастомный скил, который аккуратно, в рамках лимитов Telegram, выкачивает любые твои чаты и каналы в архив (можете поставить себе в рамках воркшопа Человек 2.0). Берёт даже приватные чаты со всем содержимым — главное, чтобы твоя учётка там состояла.
Превратил в базу данных с векторным и граф-поиском с помощью Cognee. База постоянно пополняется свежими сообщениями.
Создал GoClaw бота в телеграме, который отвечает на любые вопросы по Данангу, собирая всю информацию, что проскальзывала в чате.
С утра присылает в бота дайджест, что полезного для нас обсуждали участники.
Отвечает на любые вопросы. Под капотом — почти бесплатная Minimax M3, быстрая и достаточно умная для этих целей модель.
И всё вышеперечисленное — это отдельный скил, который делает всё, достаточно скормить ему только ссылку на чат (чаты) и токен от бота, полученный в botfather. Всё.
В какие времена живём :))
🧠 🚀 ✅ 🐾 💬
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Взял самый популярный чат Travel Ask по этому вьетнамскому городу. Выкачал содержимое за год с telegram-chip, это мой кастомный скил, который аккуратно, в рамках лимитов Telegram, выкачивает любые твои чаты и каналы в архив (можете поставить себе в рамках воркшопа Человек 2.0). Берёт даже приватные чаты со всем содержимым — главное, чтобы твоя учётка там состояла.
Превратил в базу данных с векторным и граф-поиском с помощью Cognee. База постоянно пополняется свежими сообщениями.
Создал GoClaw бота в телеграме, который отвечает на любые вопросы по Данангу, собирая всю информацию, что проскальзывала в чате.
С утра присылает в бота дайджест, что полезного для нас обсуждали участники.
Отвечает на любые вопросы. Под капотом — почти бесплатная Minimax M3, быстрая и достаточно умная для этих целей модель.
И всё вышеперечисленное — это отдельный скил, который делает всё, достаточно скормить ему только ссылку на чат (чаты) и токен от бота, полученный в botfather. Всё.
В какие времена живём :))
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥10❤3🏆1
Оранжевый кролик или при чём здесь Hermes
rabbit r1 — отдельное карманное ИИ-устройство компании Rabbit за $199. Это маленькая оранжевая железка с экраном, камерой, колесом управления и кнопкой для голосовых команд. Это не смартфон и не приложение: r1 сделали как отдельный интерфейс для разговоров с ИИ, переводов, записей, саммари и агентских действий на ходу.
В rabbitOS 2.3 на r1 появился Hermes Agent от Nous Research. Для подключения нужно поставить rabbit agent на компьютер через rabbithole > nodes, на r1 свайпнуть влево до страницы Hermes и подключиться. Сам Hermes не живёт локально на устройстве. r1 работает как карманный пульт, а компьютер даёт агенту среду и ресурсы.
По отзывам реальных пользователей и обозревателей картина смешанная. В обзоре 2024 года r1 ругали за медленные ответы, неточные результаты, слабую батарею и ощущение бета-версии. Tom’s Guide тогда прямо советовал не покупать устройство.
После серии обновлений тон стал мягче: в 2025 году тот же Tom’s Guide написал, что r1 стал заметно лучше, а батарея и функции зрения подтянулись. При этом WIRED в свежем тесте 2026 года всё ещё описывает опыт как раздражающий и почти бесполезный для обычных задач, которые телефон решает быстрее.
Поэтому новость про Hermes важна не тем, что r1 внезапно стал заменой смартфону. Он не стал. Интереснее другое: Rabbit всё сильнее превращает эту оранжевую железку в физический вход к агентам на компьютере. Если агентская часть реально работает, r1 получает конкретную работу: быть кнопкой, экраном и голосом для агента.
А вы бы взяли себе такую?
🧩 📣 🔥 💡 🪄
Источник: официальный X Rabbit / WIRED / Tom’s Guide
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
rabbit r1 — отдельное карманное ИИ-устройство компании Rabbit за $199. Это маленькая оранжевая железка с экраном, камерой, колесом управления и кнопкой для голосовых команд. Это не смартфон и не приложение: r1 сделали как отдельный интерфейс для разговоров с ИИ, переводов, записей, саммари и агентских действий на ходу.
В rabbitOS 2.3 на r1 появился Hermes Agent от Nous Research. Для подключения нужно поставить rabbit agent на компьютер через rabbithole > nodes, на r1 свайпнуть влево до страницы Hermes и подключиться. Сам Hermes не живёт локально на устройстве. r1 работает как карманный пульт, а компьютер даёт агенту среду и ресурсы.
По отзывам реальных пользователей и обозревателей картина смешанная. В обзоре 2024 года r1 ругали за медленные ответы, неточные результаты, слабую батарею и ощущение бета-версии. Tom’s Guide тогда прямо советовал не покупать устройство.
После серии обновлений тон стал мягче: в 2025 году тот же Tom’s Guide написал, что r1 стал заметно лучше, а батарея и функции зрения подтянулись. При этом WIRED в свежем тесте 2026 года всё ещё описывает опыт как раздражающий и почти бесполезный для обычных задач, которые телефон решает быстрее.
Поэтому новость про Hermes важна не тем, что r1 внезапно стал заменой смартфону. Он не стал. Интереснее другое: Rabbit всё сильнее превращает эту оранжевую железку в физический вход к агентам на компьютере. Если агентская часть реально работает, r1 получает конкретную работу: быть кнопкой, экраном и голосом для агента.
А вы бы взяли себе такую?
Источник: официальный X Rabbit / WIRED / Tom’s Guide
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3 2🔥1
Сколько стоит превратить два Telegram-чата в бота, который отвечает со ссылками на исходные сообщения
Резонный вопрос, стоит ли игра свеч? Для моего экспертного бота по Данангу мы обработали сразу два больших чата по Вьетнаму: 96 386 сообщений в за год. Представьте, читать это самому? А вы так и делаете с вашими чатами, пока не передадите это агентам.
Очистили историю от шлака, сохранили даты, ветки ответов и точные ссылки на каждое сообщение, затем построили векторный индекс.
Подготовка корпуса оказалась почти бесплатной. 9.66 млн токенов эмбеддингов обошлись в $1.26, или примерно 97 ₽. С учётом первичных проверок бота и деплоя весь подготовительный этап стоил $1.40, около 107 ₽.
Дальше мы сравнили три модели на главной задаче бота:
• MiniMax M3;
• GPT-5.5 Luna Low;
• GPT-5.5 Luna High.
Собрали 10 реальных сценариев: прямой поиск факта, объединение нескольких сообщений, SIM-карты, банкоматы, визы, трансфер из аэропорта, поздние поправки в чате, клиники, коворкинги и контрольный вопрос без ответа в архиве.
Все модели получали один и тот же найденный контекст. Ответы оценивал слепой судья без названий моделей. Порядок ответов полностью развернули и повторили проверку, чтобы убрать перекос позиции. Каждую Telegram-ссылку прогнали по полному корпусу отдельно.
Результаты:
MiniMax M3: 8.90/10, медиана 12.51 секунды, 105 из 105 валидных ссылок.
Luna Low: 9.55/10, медиана 14.28 секунды, 106 из 106 валидных ссылок.
Luna High: 9.60/10, медиана 35.69 секунды, 95 из 95 валидных ссылок.
Все три модели отработали 10 из 10 запросов и правильно отказались отвечать на контрольный вопрос без источника.
Основной моделью стала Luna Low. Она уступила High всего 0.05 балла, зато отвечала в 2.5 раза быстрее. M3 была быстрее Low лишь на 1.77 секунды, но потеряла 0.65 балла качества, прежде всего на сложных запросах с несколькими источниками и поправками.
То есть, новая модель GPT 5.6 хороша даже в "минимальной комплектации" Luna low thinking.
Теперь экономика одного запроса. Расчёт основан на среднем расходе токенов из теста и тарифах OpenRouter на 11 июля 2026 года:
• MiniMax M3: $0.0039 ≈ 0.30 ₽ за запрос;
• Luna Low: $0.050 ≈ 3.84 ₽;
• Luna High: $0.086 ≈ 6.61 ₽.
На тысячу таких запросов это примерно 297 ₽, 3 840 ₽ и 6 608 ₽ соответственно. Поиск по векторной базе добавляет доли копейки.
Два чата мы превратили в готовую базу знаний дешевле обычного обеда. Основные расходы начинаются позже, когда бот каждый день отвечает пользователям.
High как модель по умолчанию здесь не оправдывает себя: почти незаметная прибавка качества обходится в 2.5 раза большей задержкой и примерно на 72% более дорогим ответом. Luna Low даёт лучший баланс качества, скорости и цены.
Это же дорого, скажете вы. Но в нашей сборке Luna работала через квоту Codex без отдельного списания за каждый ответ. OpenRouter здесь просто используется как единая публичная шкала для сравнения моделей.
Подписки субсидируются х20 от обычных цен и спасают вайбкодеров от разорения :)
Цены рассчитаны по официальным тарифам OpenRouter и средней длине запросов в этом тесте. Итог зависит от объёма контекста и ответа: короткий запрос будет дешевле, большой контекст обойдётся дороже.
Бот, о котором речь: https://t.me/human20/395.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Резонный вопрос, стоит ли игра свеч? Для моего экспертного бота по Данангу мы обработали сразу два больших чата по Вьетнаму: 96 386 сообщений в за год. Представьте, читать это самому? А вы так и делаете с вашими чатами, пока не передадите это агентам.
Очистили историю от шлака, сохранили даты, ветки ответов и точные ссылки на каждое сообщение, затем построили векторный индекс.
Подготовка корпуса оказалась почти бесплатной. 9.66 млн токенов эмбеддингов обошлись в $1.26, или примерно 97 ₽. С учётом первичных проверок бота и деплоя весь подготовительный этап стоил $1.40, около 107 ₽.
Дальше мы сравнили три модели на главной задаче бота:
• MiniMax M3;
• GPT-5.5 Luna Low;
• GPT-5.5 Luna High.
Собрали 10 реальных сценариев: прямой поиск факта, объединение нескольких сообщений, SIM-карты, банкоматы, визы, трансфер из аэропорта, поздние поправки в чате, клиники, коворкинги и контрольный вопрос без ответа в архиве.
Все модели получали один и тот же найденный контекст. Ответы оценивал слепой судья без названий моделей. Порядок ответов полностью развернули и повторили проверку, чтобы убрать перекос позиции. Каждую Telegram-ссылку прогнали по полному корпусу отдельно.
Результаты:
MiniMax M3: 8.90/10, медиана 12.51 секунды, 105 из 105 валидных ссылок.
Luna Low: 9.55/10, медиана 14.28 секунды, 106 из 106 валидных ссылок.
Luna High: 9.60/10, медиана 35.69 секунды, 95 из 95 валидных ссылок.
Все три модели отработали 10 из 10 запросов и правильно отказались отвечать на контрольный вопрос без источника.
Основной моделью стала Luna Low. Она уступила High всего 0.05 балла, зато отвечала в 2.5 раза быстрее. M3 была быстрее Low лишь на 1.77 секунды, но потеряла 0.65 балла качества, прежде всего на сложных запросах с несколькими источниками и поправками.
То есть, новая модель GPT 5.6 хороша даже в "минимальной комплектации" Luna low thinking.
Теперь экономика одного запроса. Расчёт основан на среднем расходе токенов из теста и тарифах OpenRouter на 11 июля 2026 года:
• MiniMax M3: $0.0039 ≈ 0.30 ₽ за запрос;
• Luna Low: $0.050 ≈ 3.84 ₽;
• Luna High: $0.086 ≈ 6.61 ₽.
На тысячу таких запросов это примерно 297 ₽, 3 840 ₽ и 6 608 ₽ соответственно. Поиск по векторной базе добавляет доли копейки.
Два чата мы превратили в готовую базу знаний дешевле обычного обеда. Основные расходы начинаются позже, когда бот каждый день отвечает пользователям.
High как модель по умолчанию здесь не оправдывает себя: почти незаметная прибавка качества обходится в 2.5 раза большей задержкой и примерно на 72% более дорогим ответом. Luna Low даёт лучший баланс качества, скорости и цены.
Это же дорого, скажете вы. Но в нашей сборке Luna работала через квоту Codex без отдельного списания за каждый ответ. OpenRouter здесь просто используется как единая публичная шкала для сравнения моделей.
Подписки субсидируются х20 от обычных цен и спасают вайбкодеров от разорения :)
Цены рассчитаны по официальным тарифам OpenRouter и средней длине запросов в этом тесте. Итог зависит от объёма контекста и ответа: короткий запрос будет дешевле, большой контекст обойдётся дороже.
Бот, о котором речь: https://t.me/human20/395.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Telegram
Человек 2.0
Предстоит поездка в Дананг на три недели
Взял самый популярный чат Travel Ask по этому вьетнамскому городу. Выкачал содержимое за год с telegram-chip, это мой кастомный скил, который аккуратно, в рамках лимитов Telegram, выкачивает любые твои чаты и каналы…
Взял самый популярный чат Travel Ask по этому вьетнамскому городу. Выкачал содержимое за год с telegram-chip, это мой кастомный скил, который аккуратно, в рамках лимитов Telegram, выкачивает любые твои чаты и каналы…
❤8🏆1
This media is not supported in your browser
VIEW IN TELEGRAM
AI Hedge Fund 2.0 под капотом
Virat Singh объявил AI Hedge Fund 2.0. Механика из анонса выглядит так: выбираешь акции, ИИ-инвесторы делают ресёрч, quant models торгуют, а каждое решение получает объяснение.
В 14-секундном видео показан PEAD BACKTEST: long the beats / short the misses. Бэктест использует point-in-time earnings и заявляет no lookahead. Интерфейс выводит equity curve, Sharpe, drawdown, win rate и список сделок.
На GitHub проект открыт: Python, лицензия MIT, 61 184 звезды и 10 828 форков на момент проверки. Внутри уже есть агенты с разными инвестиционными персонами, риск-менеджер, портфельный менеджер, CLI, веб-приложение и движки для бэктестов и event study.
README прямо называет систему proof of concept и educational only. Она не предназначена для реальной торговли или инвестиций и сейчас вообще не совершает сделок.
Roadmap ещё сырой: run_cycle, fund object, ledger, risk model, broker protocol, paper/live broker, scheduler и observability в основном planned.
Сейчас это ранний исследовательский и бэктестовый каркас для финансовых агентов. Он интересен как инженерный шаблон для проверяемого цикла «отчёты → оценка модели → риск → портфель → объяснение», но до готового автономного фонда для реальных денег проект ещё не дошёл.
📊 💹 🧮 💰 🪙 🏦 ⚙ 📉 💵
Источник: X / GitHub
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Virat Singh объявил AI Hedge Fund 2.0. Механика из анонса выглядит так: выбираешь акции, ИИ-инвесторы делают ресёрч, quant models торгуют, а каждое решение получает объяснение.
В 14-секундном видео показан PEAD BACKTEST: long the beats / short the misses. Бэктест использует point-in-time earnings и заявляет no lookahead. Интерфейс выводит equity curve, Sharpe, drawdown, win rate и список сделок.
На GitHub проект открыт: Python, лицензия MIT, 61 184 звезды и 10 828 форков на момент проверки. Внутри уже есть агенты с разными инвестиционными персонами, риск-менеджер, портфельный менеджер, CLI, веб-приложение и движки для бэктестов и event study.
README прямо называет систему proof of concept и educational only. Она не предназначена для реальной торговли или инвестиций и сейчас вообще не совершает сделок.
Roadmap ещё сырой: run_cycle, fund object, ledger, risk model, broker protocol, paper/live broker, scheduler и observability в основном planned.
Сейчас это ранний исследовательский и бэктестовый каркас для финансовых агентов. Он интересен как инженерный шаблон для проверяемого цикла «отчёты → оценка модели → риск → портфель → объяснение», но до готового автономного фонда для реальных денег проект ещё не дошёл.
Источник: X / GitHub
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
❤5🔥1
🚀 Нас уже 1 000!
Для «Человек 2.0» это первая важная отметка. Здесь собрались люди, которым интересно не просто следить за развитием ИИ, а применять его в работе и получать реальные результаты.
В честь первой тысячи запускаем викторину для подписчиков.
🎁 Пять победителей получат месяц доступа в Среду внедрения ИИ.
Это закрытый формат «Человек 2.0», где участники приходят со своей рабочей задачей и доводят её до результата с помощью ИИ.
Вопросы будут про ИИ-агентов и практику внедрения. Проверим, насколько хорошо вы ориентируетесь в теме 😉
👉 Пройти викторину
Ну а первую тысячу давайте отметим как следует, ставьте 🔥 в реакциях!
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Для «Человек 2.0» это первая важная отметка. Здесь собрались люди, которым интересно не просто следить за развитием ИИ, а применять его в работе и получать реальные результаты.
В честь первой тысячи запускаем викторину для подписчиков.
🎁 Пять победителей получат месяц доступа в Среду внедрения ИИ.
Это закрытый формат «Человек 2.0», где участники приходят со своей рабочей задачей и доводят её до результата с помощью ИИ.
Вопросы будут про ИИ-агентов и практику внедрения. Проверим, насколько хорошо вы ориентируетесь в теме 😉
👉 Пройти викторину
Ну а первую тысячу давайте отметим как следует, ставьте 🔥 в реакциях!
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
🔥22 2❤1🏆1
Неделю назад CHIP провёл открытую AMA-сессию вместе со своим ИИ-агентом SIGURD.
В прямом эфире разобрали, почему одной языковой модели недостаточно для реальной работы и какую обвязку надо собрать вокруг него.
Поговорили о том:
• как устроены персональные агенты;
• какую роль играет обвязка вокруг модели;
• как внедрять ИИ с учётом российских ограничений;
• что важно для безопасности данных и работы под NDA;
• как агент может писать код и подключаться к новым сервисам;
• как использовать его в повседневных задачах, вплоть до организации сложного семейного путешествия.
Отдельная часть встречи была посвящена Среде внедрения ИИ и воркшопу по созданию собственного агента на базе Codex и Hermes.
Это хороший вводный эфир для тех, кто хочет увидеть разницу между обычным чатом с нейросетью и персональным агентом, встроенным в реальные процессы.
Посмотреть запись AMA:
Присоединиться к Среде внедрения ИИ — клик
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
❤2🔥2
Если у вас есть платная подписка ChatGPT и Твиттер, вы можете получить аирдроп кредитов на 100 долларов, если закинете свой твит на тему "почему я люблю GPT 5.6 Sol" по адресу: https://switch-to-codex.openai.chatgpt.site/
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
❤10 2
Codex Micro: агенты Codex получили физический пульт
OpenAI вместе с Work Louder выпустила компактный контроллер Codex Micro за $230. Серия ограниченная.
Управление агентами вынесли из окна Codex на стол. Цвет клавиш показывает, что происходит с задачей: ожидание, размышление, завершение, нужен ввод или возникла ошибка. Отдельными кнопками можно принять либо отклонить изменения, открыть новый чат и включить голосовой ввод.
Джойстик запускает до четырёх навыков. Поворотный регулятор меняет глубину рассуждений: меньше вычислений для короткой задачи, больше для сложной. Состояние видишь по цвету, изменения принимаешь кнопкой, глубину рассуждений регулируешь ручкой.
На корпусе установлены 13 механических клавиш, сенсорная кнопка, регулятор и джойстик. В комплект входят 32 сменные клавиши с иконками. Подключение: Bluetooth или USB-C. Поддерживаются Mac и Windows.
Назначения кнопок и раскладку можно менять внутри Codex. Программа Work Louder Input добавляет шесть программируемых наборов команд.
OpenAI выпустили клавиатуру для вайбкодинга
Свичи модные, низкопрофильные, на выбор есть кликающие и тихие, в комплекте также идёт 32 кастомных кикапа на разные случаи жизни.
@ai_newz
$230 — цена нишевой профессиональной периферии вроде механических клавиатур с хорошими свичами. Но, учитывая, сколько времени мы проводим за вайбкодингом, это инвестиция в комфорт.
🧩 📣 🔥 💡 🪄
Источник: Work Louder / OpenAI Developers
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
OpenAI вместе с Work Louder выпустила компактный контроллер Codex Micro за $230. Серия ограниченная.
Управление агентами вынесли из окна Codex на стол. Цвет клавиш показывает, что происходит с задачей: ожидание, размышление, завершение, нужен ввод или возникла ошибка. Отдельными кнопками можно принять либо отклонить изменения, открыть новый чат и включить голосовой ввод.
Джойстик запускает до четырёх навыков. Поворотный регулятор меняет глубину рассуждений: меньше вычислений для короткой задачи, больше для сложной. Состояние видишь по цвету, изменения принимаешь кнопкой, глубину рассуждений регулируешь ручкой.
На корпусе установлены 13 механических клавиш, сенсорная кнопка, регулятор и джойстик. В комплект входят 32 сменные клавиши с иконками. Подключение: Bluetooth или USB-C. Поддерживаются Mac и Windows.
Назначения кнопок и раскладку можно менять внутри Codex. Программа Work Louder Input добавляет шесть программируемых наборов команд.
OpenAI выпустили клавиатуру для вайбкодинга
Свичи модные, низкопрофильные, на выбор есть кликающие и тихие, в комплекте также идёт 32 кастомных кикапа на разные случаи жизни.
@ai_newz
$230 — цена нишевой профессиональной периферии вроде механических клавиатур с хорошими свичами. Но, учитывая, сколько времени мы проводим за вайбкодингом, это инвестиция в комфорт.
Источник: Work Louder / OpenAI Developers
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4🔥3
This media is not supported in your browser
VIEW IN TELEGRAM
Codex научился нарезать. Теперь не только код
Freecut ставится как скилл в Claude Code, Codex или Hermes. Кидаете агенту папку с материалами и объясняете, какой ролик нужен. Он изучает файлы, предлагает план и ждёт вашего «да».
Дальше начинается монтажная рутина: агент выбрасывает оговорки и затянутые паузы, соединяет удачные дубли, правит цвет, накладывает субтитры и анимацию. Whisper размечает речь по времени, FFmpeg собирает ролик. Когда текста мало, агент открывает контактные листы с кадрами и звуковой волной.
После экспорта агент проходит по монтажным стыкам. Картинка дёрнулась, в звуке щёлкнуло, анимация закрыла субтитры — исправляет и собирает заново. Максимум три круга. Решения остаются в памяти проекта, поэтому следующая сессия не начинается с нуля.
Базовая версия работает без API-ключей. За бесплатность платит ваш компьютер: расшифровка и сборка ролика идут на его ресурсах. Для записей с несколькими спикерами понадобится внешний VibeVoice-ASR или ElevenLabs.
🧱 🔧 🧬 📈 💎 🟣 🟢
Источник: GitHub
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Freecut ставится как скилл в Claude Code, Codex или Hermes. Кидаете агенту папку с материалами и объясняете, какой ролик нужен. Он изучает файлы, предлагает план и ждёт вашего «да».
Дальше начинается монтажная рутина: агент выбрасывает оговорки и затянутые паузы, соединяет удачные дубли, правит цвет, накладывает субтитры и анимацию. Whisper размечает речь по времени, FFmpeg собирает ролик. Когда текста мало, агент открывает контактные листы с кадрами и звуковой волной.
После экспорта агент проходит по монтажным стыкам. Картинка дёрнулась, в звуке щёлкнуло, анимация закрыла субтитры — исправляет и собирает заново. Максимум три круга. Решения остаются в памяти проекта, поэтому следующая сессия не начинается с нуля.
Базовая версия работает без API-ключей. За бесплатность платит ваш компьютер: расшифровка и сборка ролика идут на его ресурсах. Для записей с несколькими спикерами понадобится внешний VibeVoice-ASR или ElevenLabs.
Источник: GitHub
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
❤10
🏆 Через 25 минут объявим победителей!
Результаты викторины зафиксируем на видео. Среди участников, которые дошли до конца и выполнили условия, мы определим 5 победителей.
Имена опубликуем здесь в 15:00, вместе с видео самого розыгрыша.
Оставайтесь на связи!
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Результаты викторины зафиксируем на видео. Среди участников, которые дошли до конца и выполнили условия, мы определим 5 победителей.
Имена опубликуем здесь в 15:00, вместе с видео самого розыгрыша.
Оставайтесь на связи!
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
❤6
🏆 Итоги розыгрыша
Наш ИИ-помощник сделал выбор. Вот имена тех, кому сегодня улыбнулась удача:
1. @minilim
2. @Magellanas
3. @alexfin771
4. @VladdWelder
5. @IlyaPaltcev
В прикреплённом видео весь процесс розыгрыша. Ничего не переигрывали, результат зафиксирован с первого запуска.
🎉 Поздравляем счастливчиков! Перейдите в бота @human20salesbot. Победителям придёт уведомление с доступом.
Спасибо всем, кто принял участие и дошёл до финала. Впереди будет ещё много полезного и интересного.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Наш ИИ-помощник сделал выбор. Вот имена тех, кому сегодня улыбнулась удача:
1. @minilim
2. @Magellanas
3. @alexfin771
4. @VladdWelder
5. @IlyaPaltcev
В прикреплённом видео весь процесс розыгрыша. Ничего не переигрывали, результат зафиксирован с первого запуска.
🎉 Поздравляем счастливчиков! Перейдите в бота @human20salesbot. Победителям придёт уведомление с доступом.
Спасибо всем, кто принял участие и дошёл до финала. Впереди будет ещё много полезного и интересного.
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
🏆5🔥4 2❤1
This media is not supported in your browser
VIEW IN TELEGRAM
Kimi K3: 2,8 трлн параметров. Самая мощная китайская модель
Moonshot AI уже запустила Kimi K3 в Kimi.com, Kimi Work, Kimi Code и API. Полных весов пока нет: их вместе с техническим отчётом обещают опубликовать 27 июля 2026 года.
У модели 2,8 трлн параметров, но на каждом токене активируются 16 из 896 экспертов. Контекст вмещает 1 млн токенов, а единая архитектура работает с текстом, изображениями и видео.
В демонстрациях K3 создаёт 3D-игры, воксельную арену и интерактивные исследования. Собственный тизер модель собрала из 56 клипов: выбрала кадры, синхронизировала монтаж с ритмом, обработала звук и внесла правки после нескольких раундов замечаний.
Будущая публикация весов не означает, что вы сможете запустить их даже на двух мак студио. Moonshot рекомендует конфигурации с 64 (!) и более ускорителями — открытая модель такого масштаба рассчитана на серверную инфраструктуру.
API стоит $3 за 1 млн входных токенов и $15 за 1 млн выходных. В три раза дешевле Fable при сходном лучшем качестве.
Сама Moonshot указывает, что K3 по общей производительности уступает Claude Fable 5 и GPT 5.6 Sol, а на длинных задачах способна проявлять лишнюю инициативу. Проверить продукт и API можно уже сейчас; 27 июля откроется возможность проверить и саму модель за пределами сервисов компании.
🧩 📣 🔥 💡 🪄
Источник: Moonshot AI
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Moonshot AI уже запустила Kimi K3 в Kimi.com, Kimi Work, Kimi Code и API. Полных весов пока нет: их вместе с техническим отчётом обещают опубликовать 27 июля 2026 года.
У модели 2,8 трлн параметров, но на каждом токене активируются 16 из 896 экспертов. Контекст вмещает 1 млн токенов, а единая архитектура работает с текстом, изображениями и видео.
В демонстрациях K3 создаёт 3D-игры, воксельную арену и интерактивные исследования. Собственный тизер модель собрала из 56 клипов: выбрала кадры, синхронизировала монтаж с ритмом, обработала звук и внесла правки после нескольких раундов замечаний.
Будущая публикация весов не означает, что вы сможете запустить их даже на двух мак студио. Moonshot рекомендует конфигурации с 64 (!) и более ускорителями — открытая модель такого масштаба рассчитана на серверную инфраструктуру.
API стоит $3 за 1 млн входных токенов и $15 за 1 млн выходных. В три раза дешевле Fable при сходном лучшем качестве.
Сама Moonshot указывает, что K3 по общей производительности уступает Claude Fable 5 и GPT 5.6 Sol, а на длинных задачах способна проявлять лишнюю инициативу. Проверить продукт и API можно уже сейчас; 27 июля откроется возможность проверить и саму модель за пределами сервисов компании.
Источник: Moonshot AI
Среда внедрения ИИ:
Внедрить | ТГ | ВК | YouTube
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4