AIматизация | ИИ в жизни и бизнесе
302 subscribers
33 photos
16 videos
4 files
23 links
Про реальные кейсы внедрения AI -> повышения продуктивности в жизни и бизнесе. Максимум инсайтов из практики, минимум теории

База знаний:
https://aimatization.io/knowledge

Внедрение в бизнес:
https://aimatization.io/services

Контакт: @aimatization_nick
Download Telegram
AI как оружие - больше не спекуляция

Claude выпустили ту самую нашумевшую модель Mythos, которая взломала Пентагон нашла уязвимости в сотнях крупнейших opensource проектов и которую не давали никому, кроме «good guys» 😒

Правда, выпустили с существенными ограничениями и мониторингом каждого запроса, особо подозрительные из которых будут просматриваться людьми. И назвали по-другому - Claude Fable 5.

В текущих Claude-подписках доступна пока временно (до 22 июня). И по стоимости за токены - в 2 раза выше последнего Opus.

А ещё запросы, связанные с кибербезопасностью, биологией и вообще чувствительными темами, будут автоматически переключаться на предыдущее поколение (Opus 4.8).

По бенчмаркам, ожидаемо, самая сильная модель на сегодняшний день. На 5–8% опережает Claude Opus 4.8 по показателям кодинга, а сам Opus 4.8 по бенчмаркам в 2 раза превосходит GPT-5.5.

Если сделать шаг в сторону и посмотреть, как антропики разыгрывают свою карту - сложно не признать результативность их подхода к маркетингу на протяжении всего года (капитализация выросла почти в 15 (!) раз за последние 14 месяцев)

Текущий выпуск Fable - ещё один гениальный ход. Сначала выпустить в закрытом режиме, заставив всех обсуждать и хотеть - и когда рынок сам за тебя уже её распиарил на всевозможных слухах и «утечках» - выпустить в общий релиз (и то не полностью).

Стив Джобс нервно перевернулся, глядя на их способность продавать и приучать людей хотеть то, о чем они ещё полгода назад даже не знали (а также на практически полное поражение Apple в гонке ИИ)
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥2😱1
Media is too big
VIEW IN TELEGRAM
Codex: Record & Replay

Я уже писал ранее, что Codex от OpenAI уже давно стал инструментом не только для разработчиков, и компания продолжает расширять позиционирование и развивать инструментарий. На днях добавили простую, но крайне важную фичу - Record & Replay.

Теперь можно буквально делать любые действия на своём компьютере «под запись», а агент научится самостоятельно их воспроизводить - и выполнять как по просьбе, так и по расписанию.

И это не буквальная запись и повтор движений мыши, как в софте из 2010х - агент сам проанализирует происходящее на экране, разложит на шаги и распишет подробный skill, сохранив его для будущих сессий.

Многие скажут, что инновации здесь никакой нет, что и раньше можно было пройти с агентом по шагам, а затем попросить оформить успешно пройденный воркфлоу в скилл, и будут частично правы. Но это зачастую отнимает приличный объём времени и нервов - со всеми ошибками и повторами агента. А теперь можно просто один раз показать - а дальше уже пусть сам разбирается. Главное, чтобы в конце был понятный и измеримый результат, по которому агент сможет идентифицировать свои действия как успешные.

P.S. В приложенном официальном видео показан пример, как агент учится выкладывать видео на ютуб - но этот кейс, как и множество других, которые захочется автоматизировать таким образом - на практике эффективнее и надёжнее реализовывать через API, MCP и CLI (то есть по сути через исполняемый код и вызовы официальных программных методов).

Тогда агент будет работать намного предсказуемее и быстрее, а потреблять на порядки меньше токенов. Т.к. визуальный анализ - это один из самых затратных по себестоимости, работает медленно и требует постоянно включённого компьютера.

Но в целом, для того, чтобы просто решить задачу здесь и сейчас - вполне отличный инструмент.
🔥21👍1
Make Gemini Great Again

Небольшой полезный плагин для тех, кто работает с Google Gemini в браузере.

Добавляет функционал, который там должен быть и давно есть в ChatGPT и Claude:
• Папки и подпапки для чатов
• Быстрые действия по правому клику мыши (Дублирование, удаление и переименование)
• Поиск внутри конкретной папки
• Визуальное таймлайн-дерево чата для мгновенного прыжка к любому шагу.
• Сохранение промптов и ответов в и с синхронизацией на Google Диск.
• Экспорт в Markdown, JSON или длинный скриншот.
• Возможность смотреть скрытый Thinking process из Deep Research.
• Визуализация блок-схем и ментальных карт прямо в окне чата (Mermaid-схемы)
• Экспорт сложных формул в один клик без поломки верстки
• Показ оставшихся лимитов в реальном времени
• Настройка визуала, шрифтов и т.д.

И на десерт: Удаление водяных знаков с изображений от Nano Banana

Про безопасность - полностью открытый исходный код и проверен сообществом.
В общем, рекомендасьон.

Есть для всех основных браузеров - Chrome, Safari, Mozilla, Edge и все, сделанные на Chromium (Opera, Brave, Яндекс и т.д.)
👍2🔥2
Бесплатный DeepSeek

Сейчас в OpenModel временная акция - бесплатно раздают DeepSeek 4 Flash, которая весьма неплохая в текстах, креативе и агентских задачах. После регистрации сразу можно получить API-ключ и скормить его своему агенту, попросив сделать интеграцию (у них есть классический OpenAI-совместимый ендпоинт).

В OpenClaw / Hermes встанет легко как custom provider, в Claude придётся немного заморочиться с кастомным гейтвеем (про это напишу в отдельном посте).

Постараюсь в ближайшее время сделать подробную инструкцию по настройке собственного гейтвея, чтобы использовать такие халявы, а также выложу подборку ещё 10+ провайдеров, где можно брать токены бесплатно
👍9
OpenRouter - крупнейший агрегатор ИИ, щедро раздающий токены.

Про эту платформу, собирающую у себя все топовые нейронки, скорее всего, многие уже слышали. Но не все знают, что если положить и держать на балансе от $10, то они дают до 1000 запросов ежедневно на модели, которые в данный момент помечены как free.

А так как платформа большая и популярная, многие провайдеры используют это как маркетинговый инструмент и общественный тест-драйв для своих новых моделей. А мы можем строить на этом систему оптимизации бюджета.

Например, из сильных и бесплатных моделей сейчас доступны Nemotron 3 Ultra от NVidia и Laguna M.1 от Poolside, нового быстрорастущего стартапа из США.

Можно также добавить свой ключ через раздел BYOK, чтобы, например, использовать как прокси-сервер с отдельным ip для бесплатных ключей от Google (про них в следующем посте)

Рекомендую сразу в настройках оповещений включить Low Balance Alerts и выставить $10 - если какой-то агент решит использовать платную модель (или бесплатная перестанет быть таковой) и спишется несколько центов - лимит free tier упадёт всего до 50 запросов в сутки, а своевременное оповещение позволит этот момент отследить.

P.S. Хотел написать, что без проблем работает из рф, но буквально в конце июня они объявили, что перестают работать с ip из рф (но, полагаю, для большинства людей такие ограничения уже давно не являются непреодолимыми)
👍63🔥2
upd: уже разобрали все. Кто успел, тот молодец :)
😁21🔥1
«Тот, кто к полудню не исчерпал свой лимит в Claude, — зря потратил утро».


— Клодиус Максимус
😁8🔥32
big-pickle-stealth-is-deepseek-report.pdf
398.3 KB
Dragon v.s. Eagle

Китайские модели уже не просто наступают на пятки американцам, а активно догоняют их и практически сравнялись по возможностям. При этом распространяются по лицензии opensource, не ставят палки в колеса в виде guardrails и ограниченных доступов и стоят существенно дешевле.

За последние две недели вышли GLM 5.2 и Kimi K3, которые уже успели нашуметь и даже превзойти Claude Opus в некоторых тестах, а сегодня Qwen анонсировал выход Qwen 3.8.

Давно не было релизов от DeepSeek, четвёртая версия которого, в своё время, стала прорывом и бесспорным лидером в тот момент по соотношению цена-качество. Должны запустить вот-вот, уже есть анонс, но сегодня я проводил ресерчи и обнаружил, где её можно потестировать уже сейчас, причём абсолютно бесплатно.

Выше я уже рассказывал, что многие провайдеры часто делают «обкатку» своих моделей через популярные интеграторы. Ещё одним таким интегратором, по совместимости харнессом (оболочкой для агентов) и средой разработки является Opencode - opensource инструмент для разработки, который предоставляет внутри своего приложения free tier для некоторых моделей.

Сегодня я заметил, что среди них доступна новая stealth-модель под названием Big Pickle. Мне стало интересно, что там под капотом, и недолгий ресерч показал, что модель иногда в ответах выдаёт себя и шаблонные ответы об ошибках, присущие DeepSeek.

Мне этого было мало и я решил сравнить все доступные сейчас бесплатные модели в OpenCode, включая эту - по итогу новый DeepSeek оказался на голову сильнее всех доступных во free tier.

Ознакомиться с отчётом эксперимента можно во вложенном PDF или на обновлённом сайте.

В общем, рекомендую к использованию, пока доступна - неплохая экономия за счёт бесплатных токенов сильной модели.
🔥5👍31🤔1
AIматизация | ИИ в жизни и бизнесе
Ускоряем печать, переходя на голос Судя по трендам в X, Threads и GitHub, текущий месяц стал месяцем разработки собственных инструментов автоматизации голосового ввода. Каждый уважающий себя разработчик (и не только) написал собственную «диктовалку» и гордо…
This media is not supported in your browser
VIEW IN TELEGRAM
Писал ранее, что использовал WisprFlow - но бесплатный тариф ограничивает быстрое распознавание лимитом 2000 слов в неделю. Решил поискать бесплатный opensource аналог, чтобы имел все те же функции и работало как локально, так и облачно на супербыстром и бесплатном groq, который у меня и так используется в собственной системе транскрипции звонков и в Hermes-агентах в телеграм для голосовых.

Попробовал разные и остановился на небольшом и пока малоизвестном FreeFlow. Имеет все те же функции, как в платных аналогах, но, как говорится, все бесплатно, без регистрации и смс 🙂

Особенно важными для меня были учёт контекста приложений и постобработка текста после распознавания - благодаря чему он правильно и на лету понимает все, что говорю, и корректно пишет все термины, названия и команды. Использует сразу тот же ключ Groq для работы.

Сборка в данный момент только на MacOS (причём старые на intel тоже поддерживаются), но проект активно развивается и в PR на гитхабе уже есть сборка под windows. Ждём в релиз)

В общем, пока полёт нормальный, распознавание за милисекунды, всем доволен и рекомендую
🔥52
Новая тёмная лошадка

В агрегаторы добавили новую мощную и таинственную модель - Ox Alpha. Известно, что модель от китайцев, а также то, что она уделывает Fable и GPT 5.6 Sol. Возможно, что это новая модель семейства GLM, но это не точно.

Самое вкусное, что сейчас её можно использовать совершенно бесплатно сразу в трёх агрегаторах:
Opencode
Openrouter
Commandcode

Встроить их можно в любой (почти) харнесс для своих агентов и существенно оптимизировать расходы на токены и подписки
🔥3👀2
Продукты на автопилоте

ВкусВилл запустил официальный MCP-сервер:

https://mcp.vkusvill.ru/mcp

Теперь можно подключить в своего агента и голосом заказывать любые продукты, пока едешь домой, чтобы по прибытию сразу встретить курьера.

А еще настроить регулярные автозакупки с умным подбором замены, если чего-то нет в наличии.

Полагаю, что MCP запустили в экспериментальном режиме, потому что api явно не адаптировали и агент быстро ловит 429 ошибку (превышен лимит запросов в моменте).

Но радует, что AI наконец-то начинает проникать в традиционный ретейл и выводит качество повседневного опыта на новый уровень.

В удивительное время живем.
🔥3👍1🤯1
Лучшая бесплатная модель для транскрипции?

Google без громких анонсов выкатил модель для транскрибации голоса в текст и выложил её в бесплатный доступ на AI Studio.

Мало того, что эта модель намного качественнее распознает речь (особенно русскую), чем Whisper и аналоги, так она ещё и умеет сразу вырезать все «эээ», «ммм» и слова-паразиты, а также редактировать до финальной мысли, если в процессе диктовки ошибся и меняешь мнение/тезис. И делает это молниеносно быстро (версия Live).

А та, что обычная (не лайв), умеет в диаризацию - это когда она сама распознает голоса и понимает, где заканчивается речь одного собеседника и начинается другого.

Первая (live) идеально применима для мгновенных распознаваний - например, голосовой ввод текста или распознавание голосовушек в телеграм.
Вторая - для анализа звонков, зумов, митингов и прочих онлайн и даже оффлайн собраний, где говорящих более одного.

Кроме того, в сочетании с Gemini Flash Live открывается путь для создания полностью живых разговорных агентов, умеющих общаться без заметной задержки и при этом делающих что-то ещё в реальном времени (например, голосовые ai-сотрудники поддержки по телефону).

У live сейчас полный безлимит по использованию. У второй - до 500 вызовов в сутки. Хватит на распознавание до 12.5 часов с диаризацией ежедневно.

В общем, рекомендую к тестированию. Я себе уже внедрил в анализ звонков и в голосовой ввод, скорость и качество удивительно высокие.
👍6🔥5👏1
«Да, Вы совершенно правы, я понял задачу неправильно…»
😁7🤣5
Китайские братушки в ZCode в очередной раз на уикенд раздают каждому по 300 млн токенов на свою последнюю модель GLM-5.3-Flash.

Все, что нужно - скачать последнюю версию с официального сайта, авторизоваться/зарегистрироваться и нажать кнопку Claim.

Акция проводится с вечера пятницы до вечера воскресенья. Затем неиспользованные подарочные токены сгорят.

Да, умеют в FOMO 😁
🔥4👍21
Media is too big
VIEW IN TELEGRAM
Мало кто знает, но на Руси издавна использовали ИИ агентов для автоматизации рутины в работе и быту, задолго до того, как это стало мейнстримом. Просто вайбкодеров тогда называли иначе 😁
😁6🔥4