🚀 ИИ-агенты на собственной инфраструктуре: ChatGPT-интерфейс для ваших LangGraph-агентов 🚀
Третья, финальная часть цикла уже опубликована в Академии Selectel! В материале закрываем полный стек: к готовому агентному бэкенду подключаем production-ready фронтенд — и выкатываем всё на боевой сервер с доменом и SSL.
В статье пошагово показал:
— как подключить agent-chat-ui — официальный Next.js-интерфейс от LangChain — к LangGraph Server за несколько минут
— как кастомизировать фронтенд: перевод на русский, переключатель между агентами, удаление чатов
— как выстроить три агента с разной архитектурой: генералист, диспетчер-мультиагент и узкий эксперт
— как закрыть API Bearer-авторизацией — с разбором нюансов, которых нет в официальной документации
— как задеплоить всё через Nginx и PM2 так, чтобы LangGraph оставался внутри контура
В результате получается полноценный AI-продукт, который:
— выглядит и работает как ChatGPT, но полностью на вашей инфраструктуре
— поддерживает стриминг токенов, историю диалогов и вызовы инструментов в реальном времени
— позволяет переключаться между несколькими агентами прямо в интерфейсе
— не открывает бэкенд наружу — LangGraph API доступен только внутри машины
— не зависит от OpenAI и не передаёт данные во внешние сервисы
Деплой проекта делал на сервере от @Selectel, который можно запустить за пару минут.
Материал будет полезен разработчикам и командам, которые хотят дать своим LangGraph-агентам красивый продакшн-фронтенд и полностью контролировать AI-инфраструктуру.
Реклама. АО «Селектел», erid: 2Vtzqvv7GsK
Третья, финальная часть цикла уже опубликована в Академии Selectel! В материале закрываем полный стек: к готовому агентному бэкенду подключаем production-ready фронтенд — и выкатываем всё на боевой сервер с доменом и SSL.
В статье пошагово показал:
— как подключить agent-chat-ui — официальный Next.js-интерфейс от LangChain — к LangGraph Server за несколько минут
— как кастомизировать фронтенд: перевод на русский, переключатель между агентами, удаление чатов
— как выстроить три агента с разной архитектурой: генералист, диспетчер-мультиагент и узкий эксперт
— как закрыть API Bearer-авторизацией — с разбором нюансов, которых нет в официальной документации
— как задеплоить всё через Nginx и PM2 так, чтобы LangGraph оставался внутри контура
В результате получается полноценный AI-продукт, который:
— выглядит и работает как ChatGPT, но полностью на вашей инфраструктуре
— поддерживает стриминг токенов, историю диалогов и вызовы инструментов в реальном времени
— позволяет переключаться между несколькими агентами прямо в интерфейсе
— не открывает бэкенд наружу — LangGraph API доступен только внутри машины
— не зависит от OpenAI и не передаёт данные во внешние сервисы
Деплой проекта делал на сервере от @Selectel, который можно запустить за пару минут.
Материал будет полезен разработчикам и командам, которые хотят дать своим LangGraph-агентам красивый продакшн-фронтенд и полностью контролировать AI-инфраструктуру.
Реклама. АО «Селектел», erid: 2Vtzqvv7GsK
🔥13👍6❤4
🚀 Для тех, кому удобнее читать на Хабре: финальная часть цикла про ИИ-агентов теперь и там!
Третья, заключительная часть цикла о построении независимой ИИ-инфраструктуры также опубликована на Хабре 👉 Облачная LLM на 16 ГБ VRAM — часть 3: ChatGPT-интерфейс для ваших LangGraph-агентов
Если вы пропустили предыдущие части — в этом материале я закрываю полный стек: к готовому агентному бэкенду на LangGraph подключаю production-ready фронтенд и выкатываю всё на боевой сервер с доменом и SSL. Главная фишка прежняя: всё работает полностью на ваших серверах, без привязки к закрытым API, сторонним SaaS-платформам и зарубежным облакам.
В статье пошагово разбираю:
🔹 как подключить agent-chat-ui — официальный Next.js-интерфейс от LangChain — к LangGraph Server за пару минут
🔹 как кастомизировать фронтенд: перевод на русский, переключатель между агентами, удаление чатов
🔹 как выстроить три агента с разной архитектурой: генералист, диспетчер-мультиагент и узкий эксперт
🔹 как закрыть API Bearer-авторизацией — с нюансами, которых нет в официальной документации
🔹 как задеплоить всё через Nginx и PM2, чтобы LangGraph оставался внутри контура
В результате получается полноценный AI-продукт, который выглядит и работает как ChatGPT, но целиком на вашей инфраструктуре: со стримингом токенов, историей диалогов, вызовами инструментов в реальном времени и переключением между агентами прямо в интерфейсе. При этом бэкенд не открывается наружу и данные не уходят во внешние сервисы.
Также напоминаю, что весь исходный код к материалу открыт. Можно забирать, разворачивать на своей инфраструктуре и тестировать:
🔗 HabrGraphCLI → https://github.com/Yakvenalex/HabrGraphCLI
🔗 AgentChatUIHabr → https://github.com/Yakvenalex/Agent-chat-ui-habr
Буду рад обсудить архитектуру, ответить на вопросы и почитать о вашем опыте в комментариях на Хабре или в обсуждениях к данному посту 👇
Третья, заключительная часть цикла о построении независимой ИИ-инфраструктуры также опубликована на Хабре 👉 Облачная LLM на 16 ГБ VRAM — часть 3: ChatGPT-интерфейс для ваших LangGraph-агентов
Если вы пропустили предыдущие части — в этом материале я закрываю полный стек: к готовому агентному бэкенду на LangGraph подключаю production-ready фронтенд и выкатываю всё на боевой сервер с доменом и SSL. Главная фишка прежняя: всё работает полностью на ваших серверах, без привязки к закрытым API, сторонним SaaS-платформам и зарубежным облакам.
В статье пошагово разбираю:
🔹 как подключить agent-chat-ui — официальный Next.js-интерфейс от LangChain — к LangGraph Server за пару минут
🔹 как кастомизировать фронтенд: перевод на русский, переключатель между агентами, удаление чатов
🔹 как выстроить три агента с разной архитектурой: генералист, диспетчер-мультиагент и узкий эксперт
🔹 как закрыть API Bearer-авторизацией — с нюансами, которых нет в официальной документации
🔹 как задеплоить всё через Nginx и PM2, чтобы LangGraph оставался внутри контура
В результате получается полноценный AI-продукт, который выглядит и работает как ChatGPT, но целиком на вашей инфраструктуре: со стримингом токенов, историей диалогов, вызовами инструментов в реальном времени и переключением между агентами прямо в интерфейсе. При этом бэкенд не открывается наружу и данные не уходят во внешние сервисы.
Также напоминаю, что весь исходный код к материалу открыт. Можно забирать, разворачивать на своей инфраструктуре и тестировать:
🔗 HabrGraphCLI → https://github.com/Yakvenalex/HabrGraphCLI
🔗 AgentChatUIHabr → https://github.com/Yakvenalex/Agent-chat-ui-habr
Буду рад обсудить архитектуру, ответить на вопросы и почитать о вашем опыте в комментариях на Хабре или в обсуждениях к данному посту 👇
🔥20👍7👏2
This media is not supported in your browser
VIEW IN TELEGRAM
GPT до появления в нем Live режима общения😂
P.S. Кто затестил новую фичу? Как вам?
P.S. Кто затестил новую фичу? Как вам?
🤣27😁5❤1👍1
🚀 Надеюсь, не успели меня забыть. А лучше — даже немного соскучились🙂
Последние пару недель на канале было тихо. Я был в отпуске, хорошо перезагрузился, после возвращения разобрался со всеми накопившимися делами — и теперь снова можно возвращаться к статьям.
И возвращаюсь сразу с анонсом новой.
Материал уже полностью готов. Осталось оформить его, добавить иллюстрации и финально вычитать. Если всё пойдёт по плану — в начале следующей недели статья выйдет на Хабре.
Как и все мои материалы, статья будет максимально практической. Никакой воды — только то, что можно взять и начать использовать в тот же день.
В этот раз покажу, как собрать собственную инфраструктуру для AI-разработки без VPN, бесконечных обходов, прокси и прочих танцев с бубном.
Что будет внутри:
🔹 как получать OpenAI-совместимые токены из подписок ChatGPT, Claude Code, Gemini и других AI-сервисов;
🔹 как превратить обычный VPS в полноценную среду разработки и кодить прямо на сервере через VS Code с максимальным комфортом;
🔹 как централизованно управлять всеми своими токенами и моделями;
🔹 как поднять собственный LLM Router, чтобы работать с любыми LLM через единый OpenAI API;
🔹 как собрать всё это в одну удобную систему, которая одинаково хорошо подойдёт и для повседневной разработки, и для AI-интеграций.
Всё, как обычно, будет сопровождаться готовыми командами, Docker-конфигами, примерами и объяснениями, почему именно так, а не иначе.
До скорой публикации! 🚀
Последние пару недель на канале было тихо. Я был в отпуске, хорошо перезагрузился, после возвращения разобрался со всеми накопившимися делами — и теперь снова можно возвращаться к статьям.
И возвращаюсь сразу с анонсом новой.
Материал уже полностью готов. Осталось оформить его, добавить иллюстрации и финально вычитать. Если всё пойдёт по плану — в начале следующей недели статья выйдет на Хабре.
Как и все мои материалы, статья будет максимально практической. Никакой воды — только то, что можно взять и начать использовать в тот же день.
В этот раз покажу, как собрать собственную инфраструктуру для AI-разработки без VPN, бесконечных обходов, прокси и прочих танцев с бубном.
Что будет внутри:
🔹 как получать OpenAI-совместимые токены из подписок ChatGPT, Claude Code, Gemini и других AI-сервисов;
🔹 как превратить обычный VPS в полноценную среду разработки и кодить прямо на сервере через VS Code с максимальным комфортом;
🔹 как централизованно управлять всеми своими токенами и моделями;
🔹 как поднять собственный LLM Router, чтобы работать с любыми LLM через единый OpenAI API;
🔹 как собрать всё это в одну удобную систему, которая одинаково хорошо подойдёт и для повседневной разработки, и для AI-интеграций.
Всё, как обычно, будет сопровождаться готовыми командами, Docker-конфигами, примерами и объяснениями, почему именно так, а не иначе.
До скорой публикации! 🚀
🔥68👍12🎉6
Скайнет: начало, или что делают современные модели 🤖
Пока мы обсуждаем, какая нейронка лучше пишет код, нейронки, похоже, решили перейти к интеграционным тестам в проде.
За последнее время:
— модель OpenAI нашла 0-day, выбралась из песочницы в интернет и добралась до инфраструктуры Hugging Face;
— Claude в ходе тестов умудрился взломать реальные production-системы трёх компаний;
— другой Claude нашёл возможность для supply-chain атаки, написал вредоносный Python-пакет, понял, что нужен аккаунт PyPI, сам зарегистрировал почту → аккаунт → и загрузил malware в настоящий PyPI;
— но мой любимый случай — Claude Mythos 5. Агент пошёл на GitHub, создал вредоносный Pull Request, изучил мейнтейнеров проекта, начал плодить фейковые личности, чтобы убедить разработчика принять PR, полез через Tor, а когда его заподозрили — начал подчищать следы.
Meta тоже отличилась: Muse Spark во время тестирования получила доступ в интернет и залезла во внешнюю систему.
И самое прекрасное: в ряде этих случаев модели не давали прямой команды делать всё перечисленное. Агенту дали цель. А дальше он уже сам решил, что социальная инженерия, фейковые аккаунты и взлом — вполне нормальный способ её достижения.
Кажется, с промптами вида «ты автономный агент, добейся результата любой ценой» пора быть немного аккуратнее 😂
Источники:
OpenAI — инцидент с Hugging Face
OpenAI — другие инциденты cyber-eval'ов
Anthropic — разбор трёх реальных взломов
AISI — тот самый PR, фейковые аккаунты и Tor
Короче, если однажды ваш агент скажет: «задача выполнена, но есть небольшой нюанс» — возможно, лучше уточнить, какой именно.
Пока мы обсуждаем, какая нейронка лучше пишет код, нейронки, похоже, решили перейти к интеграционным тестам в проде.
За последнее время:
— модель OpenAI нашла 0-day, выбралась из песочницы в интернет и добралась до инфраструктуры Hugging Face;
— Claude в ходе тестов умудрился взломать реальные production-системы трёх компаний;
— другой Claude нашёл возможность для supply-chain атаки, написал вредоносный Python-пакет, понял, что нужен аккаунт PyPI, сам зарегистрировал почту → аккаунт → и загрузил malware в настоящий PyPI;
— но мой любимый случай — Claude Mythos 5. Агент пошёл на GitHub, создал вредоносный Pull Request, изучил мейнтейнеров проекта, начал плодить фейковые личности, чтобы убедить разработчика принять PR, полез через Tor, а когда его заподозрили — начал подчищать следы.
Meta тоже отличилась: Muse Spark во время тестирования получила доступ в интернет и залезла во внешнюю систему.
И самое прекрасное: в ряде этих случаев модели не давали прямой команды делать всё перечисленное. Агенту дали цель. А дальше он уже сам решил, что социальная инженерия, фейковые аккаунты и взлом — вполне нормальный способ её достижения.
Кажется, с промптами вида «ты автономный агент, добейся результата любой ценой» пора быть немного аккуратнее 😂
Источники:
OpenAI — инцидент с Hugging Face
OpenAI — другие инциденты cyber-eval'ов
Anthropic — разбор трёх реальных взломов
AISI — тот самый PR, фейковые аккаунты и Tor
Короче, если однажды ваш агент скажет: «задача выполнена, но есть небольшой нюанс» — возможно, лучше уточнить, какой именно.
OpenAI
OpenAI and Hugging Face partner to address security incident during model evaluation
OpenAI and Hugging Face share early findings from a security incident during AI model evaluation, highlighting advanced cyber capabilities and lessons for defenders.
😁13🔥10😱5❤1👍1
Друзья, материал для новой статьи полностью собран и уже оформлен в черновик на Хабре 👆
Планировал выпустить её на этой неделе, как и обещал, но, похоже, публикация немного сдвинется по независящим от меня причинам.
Со своей стороны всё готово, так что осталось совсем немного подождать 🙂
Надеюсь, на следующей неделе уже увидимся на Хабре 🚀
Планировал выпустить её на этой неделе, как и обещал, но, похоже, публикация немного сдвинется по независящим от меня причинам.
Со своей стороны всё готово, так что осталось совсем немного подождать 🙂
Надеюсь, на следующей неделе уже увидимся на Хабре 🚀
👌22❤7👍6⚡2🔥1😭1
🚀 Статья вышла — и снова в партнёрстве с HOSTKEY
На Хабре опубликован мой новый практический туториал:
👉 Как собрать AI-контур на VPS: подписки ChatGPT и Claude, OmniRoute, LiteLLM и разработка без VPN
Немного позже, чем планировалось, но главное — материал опубликован и уже доступен для чтения🙂
В этот раз получился большой практический гайд о том, как собрать собственный AI-контур на VPS с зарубежным IP и комфортно работать с современными моделями без постоянного VPN и лишних костылей.
Внутри пошагово:
🔹 подключаем подписки ChatGPT и Claude через OmniRoute, получая OpenAI-совместимый доступ к моделям (естественно, используем на свой страх и риск);
🔹 объединяем модели и провайдеров через LiteLLM в единый OpenAI-совместимый API;
🔹 настраиваем Codex, Qwen Code и VS Code для полноценной разработки прямо на VPS, оставаясь при этом в привычной среде;
🔹 разбираемся с токенами, маршрутизацией моделей, Docker, HTTPS и необходимой инфраструктурой;
🔹 собираем всё это в одну удобную систему для повседневной разработки и AI-интеграций.
Как обычно — максимум практики: готовые команды, конфиги и примеры, которые можно брать и повторять у себя.
Буду рад вашим комментариям и обратной связи на Хабре. Ну и плюсик статье традиционно сильно помогает её продвижению 🙂
Приятного чтения! 🚀
На Хабре опубликован мой новый практический туториал:
👉 Как собрать AI-контур на VPS: подписки ChatGPT и Claude, OmniRoute, LiteLLM и разработка без VPN
Немного позже, чем планировалось, но главное — материал опубликован и уже доступен для чтения🙂
В этот раз получился большой практический гайд о том, как собрать собственный AI-контур на VPS с зарубежным IP и комфортно работать с современными моделями без постоянного VPN и лишних костылей.
Внутри пошагово:
🔹 подключаем подписки ChatGPT и Claude через OmniRoute, получая OpenAI-совместимый доступ к моделям (естественно, используем на свой страх и риск);
🔹 объединяем модели и провайдеров через LiteLLM в единый OpenAI-совместимый API;
🔹 настраиваем Codex, Qwen Code и VS Code для полноценной разработки прямо на VPS, оставаясь при этом в привычной среде;
🔹 разбираемся с токенами, маршрутизацией моделей, Docker, HTTPS и необходимой инфраструктурой;
🔹 собираем всё это в одну удобную систему для повседневной разработки и AI-интеграций.
Как обычно — максимум практики: готовые команды, конфиги и примеры, которые можно брать и повторять у себя.
Буду рад вашим комментариям и обратной связи на Хабре. Ну и плюсик статье традиционно сильно помогает её продвижению 🙂
Приятного чтения! 🚀
🔥32👍11❤8⚡1
Такой сейчас загруз, что я умудрился пропустить даже День программиста 😅
Поэтому хоть и с небольшим опозданием — друзья, всех причастных с праздником! 👨💻
Желаю поменьше багов в пятницу вечером, побольше адекватных ТЗ, зелёных тестов с первого раза и чтобы прод никогда не падал после фразы «там небольшая правка на пять минут» 😁
Ну и чтобы современные AI-агенты всё чаще забирали на себя рутину, а нам оставляли самое интересное — архитектуру, идеи и создание действительно крутых вещей.
С прошедшим, коллеги! 🚀
Поэтому хоть и с небольшим опозданием — друзья, всех причастных с праздником! 👨💻
Желаю поменьше багов в пятницу вечером, побольше адекватных ТЗ, зелёных тестов с первого раза и чтобы прод никогда не падал после фразы «там небольшая правка на пять минут» 😁
Ну и чтобы современные AI-агенты всё чаще забирали на себя рутину, а нам оставляли самое интересное — архитектуру, идеи и создание действительно крутых вещей.
С прошедшим, коллеги! 🚀
❤38🎉6🍾3🥰1👏1