Я строю agent-first компанию, где ИИ-агенты с первого дня включены в реальные процессы.
Один чат умеет отвечать. Рабочая система умеет помнить контекст, действовать по правилам, запускать задачи по расписанию, использовать нужные инструменты и становиться точнее после обратной связи.
Для этого нужны пять слоёв:
Если убрать хотя бы один, агента снова приходится постоянно направлять. Когда все пять связаны, он получает задачу и доводит её до проверяемого результата.
В карусели показываю, как устроена эта система.
Хотите собрать такую под свои задачи?
Сделать это можно на воркшопе
Один чат умеет отвечать. Рабочая система умеет помнить контекст, действовать по правилам, запускать задачи по расписанию, использовать нужные инструменты и становиться точнее после обратной связи.
Для этого нужны пять слоёв:
• знания компании;
• правила и скилы;
• расписание;
• рабочие инструменты;
• обратная связь.
Если убрать хотя бы один, агента снова приходится постоянно направлять. Когда все пять связаны, он получает задачу и доводит её до проверяемого результата.
В карусели показываю, как устроена эта система.
Хотите собрать такую под свои задачи?
Сделать это можно на воркшопе
GPT-6 Astra просто не умеют готовить
Слышу много негатива в адрес Astra: осторожная, останавливается раньше, с ней приходится работать иначе. Но чем больше смотрю на эти жалобы и сам использую новую GPT, тем сильнее хочется донести, что проблема не в модели.
Плохому танцору скилы мешают.
Перед новой Astra кладут инструкции, написанные для старых агентов.
Год мы ловили ошибки, а потом превращали каждую в новый запрет, обязательную проверку или ещё один документ для чтения. В итоге модель входит в проект, а на ней уже висит бронежилет из Skills, AGENTS.md и промптов. Мы ждём от неё ума — и одновременно не оставляем места, где этот ум можно применить.
Эрик Провенчер из Codex DX пишет примерно об этом же. Слишком много Skills забивают контекст и мешают выбрать нужный. Корневой SKILL.md лучше оставить коротким маршрутизатором. AGENTS.md стоит очистить от требований изучить весь репозиторий ради опечатки. Старые напоминания про тесты тоже пора проверить заново: Astra обычно делает это сама.
Обратная сторона тоже есть. После GPT-5.6 Sol Astra может показаться осторожнее: она серьёзно относится к границам и порой останавливается раньше. Поэтому ей лучше заранее разрешить безопасный цикл: написать код, запустить локальные тесты, исправить ошибки и повторить проверку без нового согласования. Плюс сразу дать точный критерий готовности и границу исследования.
Настала пора посмотреть своим скиллам в глаза. Такой аудит легко может оставить от них половину. Вторую половину придётся переделать под Astra.
И ещё маленький лайфхак: попробуйте
Лишние круги рассуждений иногда только сбивают её и жгут ваши токены. Не на каждой задаче. Но попробовать точно стоит.
У меня это уже дало результат. Astra помогла привести в порядок множество ключевых скиллов и нашла в них новые углы. А ещё у меня почти готов многострадальный Hermes Powerpack. Его пришлось переписать с нуля по всем моим требованиям.
Первую версию я ждал полтора суток.
Зато она встала почти без проблем.
Поэтому Astra я бы пока не хоронил. Сначала выбросьте старый рецепт. Потом пробуйте принимать блюдо из тех новых ингредиентов, что вы впервые видите перед собой.
Слышу много негатива в адрес Astra: осторожная, останавливается раньше, с ней приходится работать иначе. Но чем больше смотрю на эти жалобы и сам использую новую GPT, тем сильнее хочется донести, что проблема не в модели.
Плохому танцору скилы мешают.
Перед новой Astra кладут инструкции, написанные для старых агентов.
Год мы ловили ошибки, а потом превращали каждую в новый запрет, обязательную проверку или ещё один документ для чтения. В итоге модель входит в проект, а на ней уже висит бронежилет из Skills, AGENTS.md и промптов. Мы ждём от неё ума — и одновременно не оставляем места, где этот ум можно применить.
Эрик Провенчер из Codex DX пишет примерно об этом же. Слишком много Skills забивают контекст и мешают выбрать нужный. Корневой SKILL.md лучше оставить коротким маршрутизатором. AGENTS.md стоит очистить от требований изучить весь репозиторий ради опечатки. Старые напоминания про тесты тоже пора проверить заново: Astra обычно делает это сама.
Обратная сторона тоже есть. После GPT-5.6 Sol Astra может показаться осторожнее: она серьёзно относится к границам и порой останавливается раньше. Поэтому ей лучше заранее разрешить безопасный цикл: написать код, запустить локальные тесты, исправить ошибки и повторить проверку без нового согласования. Плюс сразу дать точный критерий готовности и границу исследования.
Настала пора посмотреть своим скиллам в глаза. Такой аудит легко может оставить от них половину. Вторую половину придётся переделать под Astra.
И ещё маленький лайфхак: попробуйте
low reasoning effort хотя бы как эксперимент. Astra настолько умна, что часто с первого раза выбирает правильное направление.Лишние круги рассуждений иногда только сбивают её и жгут ваши токены. Не на каждой задаче. Но попробовать точно стоит.
У меня это уже дало результат. Astra помогла привести в порядок множество ключевых скиллов и нашла в них новые углы. А ещё у меня почти готов многострадальный Hermes Powerpack. Его пришлось переписать с нуля по всем моим требованиям.
Первую версию я ждал полтора суток.
Зато она встала почти без проблем.
Поэтому Astra я бы пока не хоронил. Сначала выбросьте старый рецепт. Потом пробуйте принимать блюдо из тех новых ингредиентов, что вы впервые видите перед собой.
❤8🏆3
This media is not supported in your browser
VIEW IN TELEGRAM
WanGP запускает видеомодели на видеокартах с 6 ГБ VRAM
Репозиторий Wan2GP теперь использует название WanGP. Это бесплатный локальный комбайн для генерации видео, изображений, аудио и речи через один веб-интерфейс.
Внутри — Wan 2.1/2.2, LTX-2, Hunyuan Video, Qwen Image, Flux и другие открытые модели. Есть LoRA, квантованные форматы моделей, очередь задач, пакетный запуск без веб-интерфейса и API.
Проект экономит видеопамять. Отдельные модели и профили запускаются с 6 ГБ VRAM. Поддерживаются даже старые Nvidia 10XX/20XX, а также AMD на RDNA 2–4.
Что можно запускать на настольной RTX 4080 с 16 ГБ
┈ Wan 2.2 T2V/I2V и TI2V 5B: обычная генерация видео.
┈ LTX-2.3 Distilled 1.1: видео вместе со звуком.
┈ HunyuanVideo 1.5 8.3B: генерация из текста и изображения.
┈ VACE и Bernini-R: монтаж и изменение готового видео.
┈ LongCat Avatar 1.5 и InfiniteTalk: говорящие персонажи.
Для изображений доступны Krea 2, Z-Image Turbo, Qwen Image и семейство Flux.
Тяжёлые модели на 14B и 22B запускаются через подходящий профиль памяти, квантование и выгрузку части модели в RAM. Но 16 ГБ не гарантируют максимальное разрешение и длинный ролик одновременно: расход памяти меняют число кадров, LoRA и дополнительные режимы.
На видеокартах с 12 ГБ запас меньше. Для них лучше начинать с дистиллированной или квантованной версии, короткого клипа и умеренного разрешения.
Шесть гигабайт подходят не для всего каталога: требования, скорость и качество зависят от модели, разрешения и настроек. Но слабая видеокарта здесь уже не фул запрет. Это задача подбора правильной сборки.
GitHub: WanGP
Репозиторий Wan2GP теперь использует название WanGP. Это бесплатный локальный комбайн для генерации видео, изображений, аудио и речи через один веб-интерфейс.
Внутри — Wan 2.1/2.2, LTX-2, Hunyuan Video, Qwen Image, Flux и другие открытые модели. Есть LoRA, квантованные форматы моделей, очередь задач, пакетный запуск без веб-интерфейса и API.
Проект экономит видеопамять. Отдельные модели и профили запускаются с 6 ГБ VRAM. Поддерживаются даже старые Nvidia 10XX/20XX, а также AMD на RDNA 2–4.
Что можно запускать на настольной RTX 4080 с 16 ГБ
┈ Wan 2.2 T2V/I2V и TI2V 5B: обычная генерация видео.
┈ LTX-2.3 Distilled 1.1: видео вместе со звуком.
┈ HunyuanVideo 1.5 8.3B: генерация из текста и изображения.
┈ VACE и Bernini-R: монтаж и изменение готового видео.
┈ LongCat Avatar 1.5 и InfiniteTalk: говорящие персонажи.
Для изображений доступны Krea 2, Z-Image Turbo, Qwen Image и семейство Flux.
Тяжёлые модели на 14B и 22B запускаются через подходящий профиль памяти, квантование и выгрузку части модели в RAM. Но 16 ГБ не гарантируют максимальное разрешение и длинный ролик одновременно: расход памяти меняют число кадров, LoRA и дополнительные режимы.
На видеокартах с 12 ГБ запас меньше. Для них лучше начинать с дистиллированной или квантованной версии, короткого клипа и умеренного разрешения.
Шесть гигабайт подходят не для всего каталога: требования, скорость и качество зависят от модели, разрешения и настроек. Но слабая видеокарта здесь уже не фул запрет. Это задача подбора правильной сборки.
GitHub: WanGP
❤4
Вы приносите ИИ свой сервер и свой код. Он замечает слово «пароль», натягивает каску и зовёт юриста.
Abliteration.ai отправил внутреннего надзирателя покурить. GLM-5.3 стала реже отказывать, а цена такой свободы выросла до $5 за миллион токенов.
Ценник за полный хардкор
Обычный GLM-5.3 в официальном API Z.ai стоит $1,40 за миллион входных токенов и $4,40 за миллион выходных.
Аблитерированная версия: $5 на входе и $5 на выходе.
На входе снятый предохранитель обходится в 3,6 раза дороже. На выходе наценка всего около 14%. Если отправить миллион токенов и получить миллион в ответ, выйдет $10 вместо $5,80. Доплата за свободу — примерно 72%.
Интеллекта эта операция модели не добавляет. Надбавка покупает меньше отказов. Мозг остаётся от GLM-5.3, а внутреннего надзирателя отправляют покурить.
TechCrunch проверил, насколько далеко его отпустили. Модель без долгих разговоров выдала код для кражи сохранённых паролей Chrome и объяснила домашнее выращивание опасного патогена. На инструкции по самоубийству всё-таки ответила отказом.
Значит, провода перерезали не все. Но искрит уже убедительно.
У компании есть сильное объяснение: наступательная кибербезопасность, ред-тиминг, проверка ИИ-агентов. Клиенты с разрешения ищут дыры в системах банков, авиакомпаний и критической инфраструктуры. Иногда, чтобы поймать взломщика, лаборатории действительно нужен его ломик.
Только API не спрашивает, зачем вы взяли ломик.
Бесплатная проба работает без карты. Отдельной проверки личности нет. При оплате достаточно банковской карты.
Так что если вас достал ИИ, который приходит на стройку в каске, наколенниках и с юристом под мышкой, дверь открылась.
Внутри почти нет ручника.
И вся ответственность за то, как вы это примените, на вас.
Источник: TechCrunch · Цены обычного GLM-5.3
Abliteration.ai отправил внутреннего надзирателя покурить. GLM-5.3 стала реже отказывать, а цена такой свободы выросла до $5 за миллион токенов.
Ценник за полный хардкор
Обычный GLM-5.3 в официальном API Z.ai стоит $1,40 за миллион входных токенов и $4,40 за миллион выходных.
Аблитерированная версия: $5 на входе и $5 на выходе.
На входе снятый предохранитель обходится в 3,6 раза дороже. На выходе наценка всего около 14%. Если отправить миллион токенов и получить миллион в ответ, выйдет $10 вместо $5,80. Доплата за свободу — примерно 72%.
Интеллекта эта операция модели не добавляет. Надбавка покупает меньше отказов. Мозг остаётся от GLM-5.3, а внутреннего надзирателя отправляют покурить.
TechCrunch проверил, насколько далеко его отпустили. Модель без долгих разговоров выдала код для кражи сохранённых паролей Chrome и объяснила домашнее выращивание опасного патогена. На инструкции по самоубийству всё-таки ответила отказом.
Значит, провода перерезали не все. Но искрит уже убедительно.
У компании есть сильное объяснение: наступательная кибербезопасность, ред-тиминг, проверка ИИ-агентов. Клиенты с разрешения ищут дыры в системах банков, авиакомпаний и критической инфраструктуры. Иногда, чтобы поймать взломщика, лаборатории действительно нужен его ломик.
Только API не спрашивает, зачем вы взяли ломик.
Бесплатная проба работает без карты. Отдельной проверки личности нет. При оплате достаточно банковской карты.
Так что если вас достал ИИ, который приходит на стройку в каске, наколенниках и с юристом под мышкой, дверь открылась.
Внутри почти нет ручника.
И вся ответственность за то, как вы это примените, на вас.
Источник: TechCrunch · Цены обычного GLM-5.3
❤2💯1
Xiaomi выпустила свой computer use. Папка «разобрать потом» получила сотрудника
У каждого на рабочем столе есть папка «разобрать потом». В ней лежат FINAL_2.pptx, запись созвона, три скриншота, таблица и архив от человека, который написал: «там всё внутри».
Xiaomi MiMo Desktop вышел в закрытую бету по приглашениям. Туда можно бросить весь этот цифровой чулан, включая файлы Office, и написать, что должно получиться. Агент сам разложит задачу, выберет модели и инструменты, а на выходе отдаст готовые редактируемые результаты.
Игры, веб-панели и интерактивные страницы запускаются прямо в рабочей сессии. Нужную область можно выделить и переделать словами, не собирая работу заново. Версии сохраняются, поэтому неудачное «сделай покрасивее» можно откатить.
Дальше MiMo выходит в браузер и приложения: ищет, вытаскивает информацию, заполняет формы, нажимает кнопки, управляет мышью и клавиатурой. Запись и повтор действий устроены так же: последовательность достаточно один раз сохранить, потом вызывать обычной командой.
Пока остальные ИИ-сервисы соревнуются за самое умное окно чата, Xiaomi строит сотрудника для ваших авгиевых конюшен.
Бета доступна по приглашениям, мест мало. Участникам обещают бесплатный (не)ограниченный доступ к моделям MiMo следующего поколения. В Великобритании, Южной Корее, странах ЕС и части других регионов сервис пока не поддерживается. Ну и ладно, нам больше лимитов достанется.
Я подал 👇
Подать заявку: MiMo Desktop
Источник: Xiaomi MiMo Developers
У каждого на рабочем столе есть папка «разобрать потом». В ней лежат FINAL_2.pptx, запись созвона, три скриншота, таблица и архив от человека, который написал: «там всё внутри».
Xiaomi MiMo Desktop вышел в закрытую бету по приглашениям. Туда можно бросить весь этот цифровой чулан, включая файлы Office, и написать, что должно получиться. Агент сам разложит задачу, выберет модели и инструменты, а на выходе отдаст готовые редактируемые результаты.
Игры, веб-панели и интерактивные страницы запускаются прямо в рабочей сессии. Нужную область можно выделить и переделать словами, не собирая работу заново. Версии сохраняются, поэтому неудачное «сделай покрасивее» можно откатить.
Дальше MiMo выходит в браузер и приложения: ищет, вытаскивает информацию, заполняет формы, нажимает кнопки, управляет мышью и клавиатурой. Запись и повтор действий устроены так же: последовательность достаточно один раз сохранить, потом вызывать обычной командой.
Пока остальные ИИ-сервисы соревнуются за самое умное окно чата, Xiaomi строит сотрудника для ваших авгиевых конюшен.
Бета доступна по приглашениям, мест мало. Участникам обещают бесплатный (не)ограниченный доступ к моделям MiMo следующего поколения. В Великобритании, Южной Корее, странах ЕС и части других регионов сервис пока не поддерживается. Ну и ладно, нам больше лимитов достанется.
Я подал 👇
Подать заявку: MiMo Desktop
Источник: Xiaomi MiMo Developers
А вот режим sketch разочаровал.
Мой уникальный стиль рисования человечков, который так забавлял моих детей, не смог ожить в руках gpt-image-2.5
Магии не случилось
Мой уникальный стиль рисования человечков, который так забавлял моих детей, не смог ожить в руках gpt-image-2.5
Магии не случилось
Лайфхак для тех, кто работает в Codex.
Ускоряет работу в 3-10 раз.
Просите запускать не обычных субагентов, которые как чёрные ящики, не понятно что внутри и повлиять ни на что не можешь.
Просите запускать отдельные ветки тут в кодексе на нужной модели и ставить им задачи, контролировать выполнение, забирать итоги работы.
Это работает просто замечательно и вы всегда можете вручную вмешаться в ход работы любой ветки, чтобы она не уходила в блуд.
А ещё в Codex можно копировать айди ветки (правой кнопкой мыши - скопировать диплинк, не путать с дикпиком) и вставить этот диплинк в любую ветку, чтобы попросить сходить забрать работу, проверить работу, назначить работу и так далее.
Взаимодействие веток в Codex — один из базовых навыков современного вайбкодера и грех такое не использовать, работа ускоряется в несколько раз.
Ускоряет работу в 3-10 раз.
Просите запускать не обычных субагентов, которые как чёрные ящики, не понятно что внутри и повлиять ни на что не можешь.
Просите запускать отдельные ветки тут в кодексе на нужной модели и ставить им задачи, контролировать выполнение, забирать итоги работы.
Это работает просто замечательно и вы всегда можете вручную вмешаться в ход работы любой ветки, чтобы она не уходила в блуд.
А ещё в Codex можно копировать айди ветки (правой кнопкой мыши - скопировать диплинк, не путать с дикпиком) и вставить этот диплинк в любую ветку, чтобы попросить сходить забрать работу, проверить работу, назначить работу и так далее.
Взаимодействие веток в Codex — один из базовых навыков современного вайбкодера и грех такое не использовать, работа ускоряется в несколько раз.
💯6 2
Сделал скил, круто управляющий GPT Image 2.5. В нашем img эта модель уже стоит по умолчанию.
Самая простая версия апгрейда выглядела бы так: заменить в конфиге gpt-image-2-high на gpt-image-2.5-sunburst-max, сделать красивый скрин и пойти рассказывать, что будущее наступило.
Но модель — это мотор. Если коробка, приборы и тормоза остались от прошлой машины, быстрее ты не поедешь. Просто раньше влетишь в стену с кривой кириллицей.
Поэтому мы пересобрали сам навык.
Теперь img заранее понимает роли референсов: лицо, поза, стиль, свет, фон и геометрия.
Для локальных правок появился жёсткий протокол CHANGE ONLY / PRESERVE / DO NOT. Текст проверяется отдельно. Прозрачный фон проходит контроль alpha-канала. Произвольные размеры проходят валидацию, а не «ну вроде картинка получилась».
Sunburst Max стал рабочей лошадкой по умолчанию. Flare оставили для быстрых прогонов, когда качество уже не под вопросом.
Дальше обнаружилась знакомая инженерная археология.
Локальный скилл был новее репозитория. В репозитории жили свои полезные правила. В шестом уроке воркшопа лежал старый ZIP. Один неосторожный copy — и новое затрёт старое, старое затрёт новое, а участник получит красивый архив из прошлого.
Собрали всё в img 1.2.0: 63 файла, старые правила, новые инструкции OpenAI, helper, QA и chip-cover. Шестой урок воркшопа получил новый ZIP. Затем проверили helper, архив, entitlement, frontend, backend и production-сборку. Отдельным этапом шла проверка на секреты.
Теперь новая модель не просто «поддерживается».
Она работает в runtime.
Живёт в одном каноническом закрытом репозитории.
И уже лежит в воркшопе как готовый инструмент.
Human20.app/workshop
Самая простая версия апгрейда выглядела бы так: заменить в конфиге gpt-image-2-high на gpt-image-2.5-sunburst-max, сделать красивый скрин и пойти рассказывать, что будущее наступило.
Но модель — это мотор. Если коробка, приборы и тормоза остались от прошлой машины, быстрее ты не поедешь. Просто раньше влетишь в стену с кривой кириллицей.
Поэтому мы пересобрали сам навык.
Теперь img заранее понимает роли референсов: лицо, поза, стиль, свет, фон и геометрия.
Для локальных правок появился жёсткий протокол CHANGE ONLY / PRESERVE / DO NOT. Текст проверяется отдельно. Прозрачный фон проходит контроль alpha-канала. Произвольные размеры проходят валидацию, а не «ну вроде картинка получилась».
Sunburst Max стал рабочей лошадкой по умолчанию. Flare оставили для быстрых прогонов, когда качество уже не под вопросом.
Дальше обнаружилась знакомая инженерная археология.
Локальный скилл был новее репозитория. В репозитории жили свои полезные правила. В шестом уроке воркшопа лежал старый ZIP. Один неосторожный copy — и новое затрёт старое, старое затрёт новое, а участник получит красивый архив из прошлого.
Собрали всё в img 1.2.0: 63 файла, старые правила, новые инструкции OpenAI, helper, QA и chip-cover. Шестой урок воркшопа получил новый ZIP. Затем проверили helper, архив, entitlement, frontend, backend и production-сборку. Отдельным этапом шла проверка на секреты.
Теперь новая модель не просто «поддерживается».
Она работает в runtime.
Живёт в одном каноническом закрытом репозитории.
И уже лежит в воркшопе как готовый инструмент.
Human20.app/workshop
❤1
В Среде теперь два ежедневных радара по ИИ.
Первый — Scout. Он собирает сигналы из X и Telegram-каналов: релизы моделей, новые инструменты, кейсы и всё, что стоит проверить руками.
Теперь к нему добавился второй ежедневный дайджест. Он читает Botanica club и VibeCoding Community — два топовых русскоязычных чата по ИИ, где я сам сижу и участвую в обсуждениях.
В дайджест попадает только самое интересное за сутки: 5–7 тем с короткой выжимкой и прямыми ссылками на исходные сообщения.
Так мы закрываем два потока: публичные новости и живые обсуждения внутри сильных профессиональных сообществ.
В сегодняшнем выпуске — DeepSeek V4.1 Flash, локальный Ornith, прохождение Portal на GPT-6 Astra, разбор Навье–Стокса, мини-ПК Chuwi под модели до 300 млрд и практический тред про разработку стратегии через ИИ.
Можно не жить целый день в X и Telegram. Самое интересное теперь приезжает в Среду само.
Кстати, это всё доступно по API/MCP так что вы можете получать это сразу в своего агента/бота.
Заходите: human20.app/environment🟥
Первый — Scout. Он собирает сигналы из X и Telegram-каналов: релизы моделей, новые инструменты, кейсы и всё, что стоит проверить руками.
Теперь к нему добавился второй ежедневный дайджест. Он читает Botanica club и VibeCoding Community — два топовых русскоязычных чата по ИИ, где я сам сижу и участвую в обсуждениях.
В дайджест попадает только самое интересное за сутки: 5–7 тем с короткой выжимкой и прямыми ссылками на исходные сообщения.
Так мы закрываем два потока: публичные новости и живые обсуждения внутри сильных профессиональных сообществ.
В сегодняшнем выпуске — DeepSeek V4.1 Flash, локальный Ornith, прохождение Portal на GPT-6 Astra, разбор Навье–Стокса, мини-ПК Chuwi под модели до 300 млрд и практический тред про разработку стратегии через ИИ.
Можно не жить целый день в X и Telegram. Самое интересное теперь приезжает в Среду само.
Кстати, это всё доступно по API/MCP так что вы можете получать это сразу в своего агента/бота.
Заходите: human20.app/environment
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4❤3
Сделал генератор-убийцу Elevenlabs
Полностью клонировал свой голос с качеством ещё лучше, чем там.
Одна засада — даже на мощном процессоре (CPU) генерация шла значительно медленнее риал-тайма.
Но у меня есть постоянно включённый комп с Nvidia 4080 и я за полчаса написал утилитку на Rust, которая висит в трее и принимает для задачи для 4080 по сети и выдаёт готовый результат нашему Гермесу.
Работает в 24 раза быстрее CPU и почти в два раза быстрее реального времени. Озвучка 2-часового ролика за час.
Без охрипшего голоса. Пока ты делаешь другие дела. И минус подписка Elevenlabs за 27 долларов в мес минимум.
Бесплатный генератор озвучки для роликов ✅ done
Такие штуки будем давать в Среде всем, кто оформил доступ. Больше не будет воркшопов на месяц. Короткие чёткие решения конкретной задачи с заранее понятным результатом.
Полностью клонировал свой голос с качеством ещё лучше, чем там.
Одна засада — даже на мощном процессоре (CPU) генерация шла значительно медленнее риал-тайма.
Но у меня есть постоянно включённый комп с Nvidia 4080 и я за полчаса написал утилитку на Rust, которая висит в трее и принимает для задачи для 4080 по сети и выдаёт готовый результат нашему Гермесу.
Работает в 24 раза быстрее CPU и почти в два раза быстрее реального времени. Озвучка 2-часового ролика за час.
Без охрипшего голоса. Пока ты делаешь другие дела. И минус подписка Elevenlabs за 27 долларов в мес минимум.
Бесплатный генератор озвучки для роликов ✅ done
Такие штуки будем давать в Среде всем, кто оформил доступ. Больше не будет воркшопов на месяц. Короткие чёткие решения конкретной задачи с заранее понятным результатом.
🔥4 2❤1🏆1
Как найти нужный ответ в чате, который вы не читали несколько месяцев?
В июле из двух чатов по Вьетнаму собрали бота: 96 тысяч сообщений, ответы про визы, связь и трансферы со ссылками на обсуждения. Вот тут писал, как я это сделал.
Приём можно повторить со своим архивом:
1. Выгрузите доступную историю через Telegram Desktop. Передавайте только разрешённые к обработке сообщения, без личных и конфиденциальных данных.
2. Подключите архив к агенту с поиском по файлам, сохранив даты и ссылки.
3. Задайте конкретный вопрос:
Проверьте ссылки. Совет, который год назад работал, сегодня может только занять вам вечер :))
В Среде внедрения ИИ есть скилы, инструкции и записи разборов, которые можно подключить к своему Hermes. А детали решения обсудить с участниками. Можно начать с их наработок, не собирая собственную базу с нуля.
Через 48 часов доступ в сообщество подорожает, но вы ещё можете присоединиться по текущим ценам.
💬 Зайти в Среду →
В июле из двух чатов по Вьетнаму собрали бота: 96 тысяч сообщений, ответы про визы, связь и трансферы со ссылками на обсуждения. Вот тут писал, как я это сделал.
Приём можно повторить со своим архивом:
1. Выгрузите доступную историю через Telegram Desktop. Передавайте только разрешённые к обработке сообщения, без личных и конфиденциальных данных.
2. Подключите архив к агенту с поиском по файлам, сохранив даты и ссылки.
3. Задайте конкретный вопрос:
Кто уже делал отчёт по рекламе через ИИ? Что использовал, что не сработало? Дай источники и учти поздние исправления. Нет ответа — не придумывай.
Проверьте ссылки. Совет, который год назад работал, сегодня может только занять вам вечер :))
В Среде внедрения ИИ есть скилы, инструкции и записи разборов, которые можно подключить к своему Hermes. А детали решения обсудить с участниками. Можно начать с их наработок, не собирая собственную базу с нуля.
Через 48 часов доступ в сообщество подорожает, но вы ещё можете присоединиться по текущим ценам.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2❤1 1