NAITION AI: Спрос на работу с ИИ-агентами вырос в сотни раз за год. Свежий Stanford AI Index 2026 показал, что навык AI Agents стал №1 среди самых востребованных инженерных скиллов.
Рынок можно догнать!
Naition запускает новый, обновленный в июле поток буткемпа по AI-driven разработке уже 21 июля.
Максимум пользы получат middle+ разработчики и команды, нацеленные на апгрейд производительности инженерного процесса.
IT-специалисты других профессий тоже могут себя попробовать.
За 12 недель вы встроите ИИ во все процессы:
Формат: 17 уроков, 5 модулей, живые вечерние эфиры + практика между ними. Минимум теории, максимум разборов кейсов и групповой практики прямо на вебинаре.
👉 Забронировать место — naition.ai
А по промокоду PYTHON PORTAL для подписчиков — скидка 20% до 17 июля.
• Упоминания «Agentic systems» в вакансиях за год выросли на 10854% (!) — это не опечатка.
• «AI agents» — +2113%.
• Вывод простой: компаниям массово нужны не «написатели кода», а архитекторы мультиагентных систем.Главный скилл в 2026 году — строить долгоживущие автономные процессы, управлять контекстом и верифицировать работу десятков агентов.
Рынок можно догнать!
Naition запускает новый, обновленный в июле поток буткемпа по AI-driven разработке уже 21 июля.
Максимум пользы получат middle+ разработчики и команды, нацеленные на апгрейд производительности инженерного процесса.
IT-специалисты других профессий тоже могут себя попробовать.
За 12 недель вы встроите ИИ во все процессы:
• Соберёте своё ядро — MCP под задачи, RAG, мультиагентную систему с сабагентами и оркестрацией.
• Внедрите агентов в кодовые базы на 100К+ строк — автоматизируете индексацию кода, рефакторинг и изменение архитектуры.
• Научитесь масштабировать AI-практики на всю команду.
Ведут практики с 15-20 годами опыта: ex-Yandex Cloud, staff-инженер Google, CEO Symbioway (центр по найму разработчиков) — люди из эпицентра трансформации рынка.
Формат: 17 уроков, 5 модулей, живые вечерние эфиры + практика между ними. Минимум теории, максимум разборов кейсов и групповой практики прямо на вебинаре.
👉 Забронировать место — naition.ai
А по промокоду PYTHON PORTAL для подписчиков — скидка 20% до 17 июля.
Что ещё стоит знать:
• Приведёте друга или коллегу — вы вместе получите доп. скидку 10% сверху (в сумме 30%).
• Можно оплатить частями, а начать даже с одного модуля.
• Если вы бизнес, можно прокачать всю команду разом.
😁7❤1
Создавай Python-пакеты за пару секунд с
Python-пакеты позволяют вынести код в переиспользуемые модули и шарить их между проектами.
Обычно это возня с
UV, быстрый установщик и резолвер зависимостей для Python, упрощает всё до двух команд:
•
•
Полная статья: https://bit.ly/3Jyqtok
👉 @PythonPortal
uv init --package Python-пакеты позволяют вынести код в переиспользуемые модули и шарить их между проектами.
Обычно это возня с
setuptools, настройка билд-системы и разбор всей этой кухни с дистрибуцией.UV, быстрый установщик и резолвер зависимостей для Python, упрощает всё до двух команд:
•
uv init --package сразу поднимает структуру пакета•
uv build и uv publish собирают и отправляют пакет на PyPIПолная статья: https://bit.ly/3Jyqtok
Please open Telegram to view this post
VIEW IN TELEGRAM
❤8
Это всё нам: серия блокнотов Jupyter, которые последовательно знакомят с основами машинного обучения и глубокого обучения на Python с использованием Scikit-Learn и TensorFlow. 🚬
https://github.com/ageron/handson-ml3
👉 @PythonPortal
https://github.com/ageron/handson-ml3
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - ageron/handson-ml3: A series of Jupyter notebooks that walk you through the fundamentals of Machine Learning and Deep…
A series of Jupyter notebooks that walk you through the fundamentals of Machine Learning and Deep Learning in Python using Scikit-Learn, Keras and TensorFlow 2. - ageron/handson-ml3
👍6❤4
Средний Python — вот что выдает LLM по умолчанию
Из индустриальных данных: разработчики считают, что ИИ пишет около 41% их кода. А без правок принимают только 26,9%. Между этими двумя числами — работа инженера, а не подбор более сильной модели.
Разница в подходах: можно принимать все, что предложила LLM (большие языковые модели), и править за ней вручную. А можно один раз собрать обвязку — правила проекта, стандарт тестов, автопроверку — и получать корректный результат с первого прогона.
16 июля в 19:00 мск на бесплатном вебинаре karpovꓸcourses «ИИ-агенты и профессиональная разработка на Python» Алексей Жиряков разбирает эту обвязку на живом демо поверх готового репозитория. Один и тот же запрос без правил и с правилами: в первом случае код падает на первом тесте, во втором — типизированный код и зеленые тесты.
Спикер — исполнительный директор в Сбере, ех-технический директор направления в KION, 15+ лет в серверной разработке.
После регистрации — получите гайд «Почему ваш ИИ пишет не то: LLM против ИИ-агента» + запись вебинара.
Соберите обвязку, при которой модель работает по стандартам команды: https://clc.to/erid_2W5zFGNNwww
Реклама. ООО «КАРПОВ КУРСЫ». ИНН 7811764627. erid: 2W5zFGNNwww
Из индустриальных данных: разработчики считают, что ИИ пишет около 41% их кода. А без правок принимают только 26,9%. Между этими двумя числами — работа инженера, а не подбор более сильной модели.
Разница в подходах: можно принимать все, что предложила LLM (большие языковые модели), и править за ней вручную. А можно один раз собрать обвязку — правила проекта, стандарт тестов, автопроверку — и получать корректный результат с первого прогона.
16 июля в 19:00 мск на бесплатном вебинаре karpovꓸcourses «ИИ-агенты и профессиональная разработка на Python» Алексей Жиряков разбирает эту обвязку на живом демо поверх готового репозитория. Один и тот же запрос без правил и с правилами: в первом случае код падает на первом тесте, во втором — типизированный код и зеленые тесты.
Спикер — исполнительный директор в Сбере, ех-технический директор направления в KION, 15+ лет в серверной разработке.
После регистрации — получите гайд «Почему ваш ИИ пишет не то: LLM против ИИ-агента» + запись вебинара.
Соберите обвязку, при которой модель работает по стандартам команды: https://clc.to/erid_2W5zFGNNwww
Реклама. ООО «КАРПОВ КУРСЫ». ИНН 7811764627. erid: 2W5zFGNNwww
❤6👍4
This media is not supported in your browser
VIEW IN TELEGRAM
Чувак заменил Datadog одним бинарником и за одну ночь сократил расходы на инфраструктуру на 98%.
Он называется OpenObserve. Логи, метрики, трейсы и мониторинг фронтенда в одном инструменте с самостоятельным развертыванием. Он создан специально для того, чтобы остановить рост счетов при добавлении каждого нового хоста, пользователя или пользовательской метрики.
→ Один бинарник, запуск менее чем за 2 минуты. Никакого кластера и отдельных компонентов для логов, метрик и трейсов
→ Написан на Rust и использует движок запросов DataFusion, поэтому сохраняет высокую производительность даже при работе с петабайтами данных
→ Использует колоночный формат Parquet и S3-совместимое объектное хранилище вместо проприетарного формата — именно это и обеспечивает основную экономию
→ Запросы выполняются через SQL или PromQL, а не через проприетарный синтаксис вендора, поэтому вашей команде не придётся изучать новый язык запросов только ради просмотра дашбордов
→ Полная совместимость с OpenTelemetry: для подключения уже существующей инструментации не требуются проприетарные агенты
→ Библиотека дашбордов от сообщества на GitHub для Kubernetes, Docker, Postgres, AWS и наблюдаемости LLM — можно сразу подключить вместо того, чтобы создавать всё с нуля
Согласно опубликованному самим OpenObserve бенчмарку, одна и та же нагрузка из 16 сервисов обходилась в $174 в день в Datadog и в $3 в день при самостоятельном развертывании — сокращение на 98%, ещё до учёта платы за каждый хост или пользовательскую лицензию.
Более 18 000 звёзд на GitHub. Один бинарник. Самостоятельное развертывание без платы за каждый хост или пользователя.
Снижение затрат на 98% — серьёзная цифра. Её нужно чем-то подтвердить.🚬
👉 @PythonPortal
Он называется OpenObserve. Логи, метрики, трейсы и мониторинг фронтенда в одном инструменте с самостоятельным развертыванием. Он создан специально для того, чтобы остановить рост счетов при добавлении каждого нового хоста, пользователя или пользовательской метрики.
→ Один бинарник, запуск менее чем за 2 минуты. Никакого кластера и отдельных компонентов для логов, метрик и трейсов
→ Написан на Rust и использует движок запросов DataFusion, поэтому сохраняет высокую производительность даже при работе с петабайтами данных
→ Использует колоночный формат Parquet и S3-совместимое объектное хранилище вместо проприетарного формата — именно это и обеспечивает основную экономию
→ Запросы выполняются через SQL или PromQL, а не через проприетарный синтаксис вендора, поэтому вашей команде не придётся изучать новый язык запросов только ради просмотра дашбордов
→ Полная совместимость с OpenTelemetry: для подключения уже существующей инструментации не требуются проприетарные агенты
→ Библиотека дашбордов от сообщества на GitHub для Kubernetes, Docker, Postgres, AWS и наблюдаемости LLM — можно сразу подключить вместо того, чтобы создавать всё с нуля
Согласно опубликованному самим OpenObserve бенчмарку, одна и та же нагрузка из 16 сервисов обходилась в $174 в день в Datadog и в $3 в день при самостоятельном развертывании — сокращение на 98%, ещё до учёта платы за каждый хост или пользовательскую лицензию.
Более 18 000 звёзд на GitHub. Один бинарник. Самостоятельное развертывание без платы за каждый хост или пользователя.
Снижение затрат на 98% — серьёзная цифра. Её нужно чем-то подтвердить.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤10👍7
Google представила Open Knowledge Format.
Это открытый стандарт для обмена знаниями между людьми и ИИ-агентами с использованием Markdown.
Идея в том, чтобы он стал живой вики-базой знаний вашей компании, которую ИИ сможет постоянно читать и обновлять.
Именно «живая вики-база знаний»: Google описывает OKF как открытый, переносимый и совместимый формат для хранения контекста, метаданных и курируемых знаний, понятный как людям, так и ИИ-агентам.
По сути, они стандартизировали Obsidian.😂
👉 @PythonPortal
Это открытый стандарт для обмена знаниями между людьми и ИИ-агентами с использованием Markdown.
Идея в том, чтобы он стал живой вики-базой знаний вашей компании, которую ИИ сможет постоянно читать и обновлять.
Именно «живая вики-база знаний»: Google описывает OKF как открытый, переносимый и совместимый формат для хранения контекста, метаданных и курируемых знаний, понятный как людям, так и ИИ-агентам.
По сути, они стандартизировали Obsidian.
Please open Telegram to view this post
VIEW IN TELEGRAM
🌚4👀2❤1
В Steam появилась игра про техподдержку в аду — I.T. Never Ends
Инди-студия Dadbod Games готовит мрачную комедийную игру, в которой игроку предстоит работать системным администратором в компании, управляемой космическими ужасами.
Игровой процесс построен вокруг обработки тикетов: решения принимаются свайпами влево или вправо, примерно как в
Сами заявки соответствуют обстановке: пользователь не может найти собственную душу, принтер снова дышит, а этаж 3.5 отказывается прекращать существование.
Разработчики описывают проект как смесь симулятора рабочего стола, корпоративного хоррора и чёрной комедии. Полный релиз запланирован на август 2026 года, а бесплатная демоверсия уже доступна в Steam.
👉 @PythonPortal
Инди-студия Dadbod Games готовит мрачную комедийную игру, в которой игроку предстоит работать системным администратором в компании, управляемой космическими ужасами.
Игровой процесс построен вокруг обработки тикетов: решения принимаются свайпами влево или вправо, примерно как в
Reigns. Параллельно придётся следить за оборудованием и инфраструктурой, поддерживать работу офиса и разбираться, почему сотрудники продолжают погибать.Сами заявки соответствуют обстановке: пользователь не может найти собственную душу, принтер снова дышит, а этаж 3.5 отказывается прекращать существование.
Разработчики описывают проект как смесь симулятора рабочего стола, корпоративного хоррора и чёрной комедии. Полный релиз запланирован на август 2026 года, а бесплатная демоверсия уже доступна в Steam.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥9🤯1👀1
Агенты не дают сбой из-за одного сообщения.
Сбои возникают в ходе нескольких диалогов, вызовов инструментов и изменений контекста.
Giskard — это Python-библиотека с открытым исходным кодом, созданная специально для тестирования подобных сценариев.
👉 @PythonPortal
Сбои возникают в ходе нескольких диалогов, вызовов инструментов и изменений контекста.
Giskard — это Python-библиотека с открытым исходным кодом, созданная специально для тестирования подобных сценариев.
Please open Telegram to view this post
VIEW IN TELEGRAM
GitHub
GitHub - Giskard-AI/giskard-oss at opensourceprojects.dev
🐢 Open-Source Evaluation & Testing library for LLM Agents - Giskard-AI/giskard-oss
❤7🌚1
Открытый-фреймворк для создания голосовых ИИ-агентов, работающих в реальном времени
Pipecat — это Python-фреймворк для оркестрации аудио, видео, ИИ-сервисов, транспортов и диалоговых пайплайнов. Архитектура построена по принципу voice-first и поддерживает подключаемые компоненты.
Что можно создавать:
• голосовых ассистентов;
• ИИ-компаньонов;
• мультимодальные интерфейсы;
• интерактивные истории;
• бизнес-агентов для поддержки клиентов и первичного сбора данных;
• сложные диалоговые системы.
Фреймворк берёт на себя распознавание речи, синтез речи, логику диалога и взаимодействие в реальном времени. Поддержка транспортов WebRTC и WebSocket встроена. Сверхнизкая задержка позволяет вести естественные разговоры.
Почему Pipecat:
• Voice-first: объединяет STT, TTS и обработку диалога в одном фреймворке
• Подключаемая архитектура: поддерживает нескольких поставщиков ИИ-сервисов для каждой возможности
• Компонуемые пайплайны: позволяют собирать сложное поведение из модульных компонентов
• Работа в реальном времени: взаимодействие с низкой задержкой и потоковой передачей аудио и видео
Поддерживаемые сервисы:
• Speech-to-Text: Deepgram, AssemblyAI, OpenAI Whisper, Groq, Azure, AWS, Google и другие
• LLM: OpenAI, Anthropic, Gemini, Groq, Mistral, Ollama, AWS, Azure и другие
• Text-to-Speech: OpenAI, ElevenLabs, Deepgram, Cartesia, Azure, AWS, Google и другие
• Speech-to-Speech: OpenAI Realtime, Gemini Multimodal Live, AWS Nova Sonic, Ultravox, Grok Voice Agent
Недавно автор написал подробный туториал по созданию продакшен-агента голосовой поддержки клиентов. В нём разобраны определение момента передачи реплики, обработка перебиваний, телефонные кодеки и добавление актуального бизнес-контекста в каждый звонок.
Ссылка на статью😳
👉 @PythonPortal
Pipecat — это Python-фреймворк для оркестрации аудио, видео, ИИ-сервисов, транспортов и диалоговых пайплайнов. Архитектура построена по принципу voice-first и поддерживает подключаемые компоненты.
Что можно создавать:
• голосовых ассистентов;
• ИИ-компаньонов;
• мультимодальные интерфейсы;
• интерактивные истории;
• бизнес-агентов для поддержки клиентов и первичного сбора данных;
• сложные диалоговые системы.
Фреймворк берёт на себя распознавание речи, синтез речи, логику диалога и взаимодействие в реальном времени. Поддержка транспортов WebRTC и WebSocket встроена. Сверхнизкая задержка позволяет вести естественные разговоры.
Почему Pipecat:
• Voice-first: объединяет STT, TTS и обработку диалога в одном фреймворке
• Подключаемая архитектура: поддерживает нескольких поставщиков ИИ-сервисов для каждой возможности
• Компонуемые пайплайны: позволяют собирать сложное поведение из модульных компонентов
• Работа в реальном времени: взаимодействие с низкой задержкой и потоковой передачей аудио и видео
Поддерживаемые сервисы:
• Speech-to-Text: Deepgram, AssemblyAI, OpenAI Whisper, Groq, Azure, AWS, Google и другие
• LLM: OpenAI, Anthropic, Gemini, Groq, Mistral, Ollama, AWS, Azure и другие
• Text-to-Speech: OpenAI, ElevenLabs, Deepgram, Cartesia, Azure, AWS, Google и другие
• Speech-to-Speech: OpenAI Realtime, Gemini Multimodal Live, AWS Nova Sonic, Ultravox, Grok Voice Agent
Недавно автор написал подробный туториал по созданию продакшен-агента голосовой поддержки клиентов. В нём разобраны определение момента передачи реплики, обработка перебиваний, телефонные кодеки и добавление актуального бизнес-контекста в каждый звонок.
Ссылка на статью
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥5❤2🤔1
Целостное руководство по проектированию ML-систем
Практическое руководство по созданию поддерживаемых систем машинного обучения, охватывающее всё — от зависимостей в данных до инструментов MLOps.
Книга Чип Хуен посвящена ключевым архитектурным решениям, необходимым для разработки готовых к промышленной эксплуатации ML-систем, способных работать и масштабироваться под реальной нагрузкой.
👉 @PythonPortal
Практическое руководство по созданию поддерживаемых систем машинного обучения, охватывающее всё — от зависимостей в данных до инструментов MLOps.
Книга Чип Хуен посвящена ключевым архитектурным решениям, необходимым для разработки готовых к промышленной эксплуатации ML-систем, способных работать и масштабироваться под реальной нагрузкой.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3
This media is not supported in your browser
VIEW IN TELEGRAM
Энтузиаст создал свой «второй мозг» с помощью Hermes Agent. 😯
Он запоминает людей, компании, проекты и принятые решения. Берёт данные из заметок со встреч, документов и всего, что ему передают, и каждый раз указывает источник.
Это репозиторий под названием Gbrain, который выложил в открытый доступ президент Y Combinator Гарри Тан.
Чтобы установить его, вставьте в Hermes:
>
Добавьте MCP-сервер, чтобы Hermes мог обращаться к нему напрямую:
>
Граф знаний строится автоматически. Система находит связи между людьми и компаниями, которые уже упоминаются в ваших заметках. По их собственному бенчмарку, точность на 31 пункт выше, чем у обычного векторного поиска.
Открытый исходный код. Работает локально, без сервера и Docker.
👉 @PythonPortal
Он запоминает людей, компании, проекты и принятые решения. Берёт данные из заметок со встреч, документов и всего, что ему передают, и каждый раз указывает источник.
Это репозиторий под названием Gbrain, который выложил в открытый доступ президент Y Combinator Гарри Тан.
Чтобы установить его, вставьте в Hermes:
>
Установи Gbrain, следуя инструкциям из репозитория: http://github.com/garrytan/gbrain. Настрой провайдера эмбеддингов, затем выполни команды gbrain init и gbrain doctor, чтобы проверить корректность установки.Добавьте MCP-сервер, чтобы Hermes мог обращаться к нему напрямую:
>
Добавь MCP-сервер Gbrain в конфигурацию Hermes и перезапусти Hermes, чтобы изменения вступили в силу.Граф знаний строится автоматически. Система находит связи между людьми и компаниями, которые уже упоминаются в ваших заметках. По их собственному бенчмарку, точность на 31 пункт выше, чем у обычного векторного поиска.
Открытый исходный код. Работает локально, без сервера и Docker.
Please open Telegram to view this post
VIEW IN TELEGRAM
👀6🤔2❤1🏆1
This media is not supported in your browser
VIEW IN TELEGRAM
Гениальный сетап: парень из Китая зарабатывает на жизнь, путешествуя по криптоконференциям с Mac Mini в рюкзаке.
На Mac Mini запущен OpenClaw, а питание обеспечивает компактный аккумулятор CUKTECH 10 Mini. Пока другие авторы ждут возвращения в отель, чтобы разобрать записи, обработать материал и подготовить пост, он делает всё прямо на месте.
Его портативный ИИ записывает выступления, выделяет ключевые мысли и помогает публиковать контент ещё до окончания конференции — пока остальные всё ещё сидят в зале.
В мире, где инсайды устаревают за часы, скорость становится главным преимуществом.👽
👉 @PythonPortal
На Mac Mini запущен OpenClaw, а питание обеспечивает компактный аккумулятор CUKTECH 10 Mini. Пока другие авторы ждут возвращения в отель, чтобы разобрать записи, обработать материал и подготовить пост, он делает всё прямо на месте.
Его портативный ИИ записывает выступления, выделяет ключевые мысли и помогает публиковать контент ещё до окончания конференции — пока остальные всё ещё сидят в зале.
В мире, где инсайды устаревают за часы, скорость становится главным преимуществом.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤20🔥11
This media is not supported in your browser
VIEW IN TELEGRAM
Гении воссоздали интерфейсы Claude Code, Codex и Grok в виде переиспользуемых компонентов ShadCN. 🤯
Эта open-source-библиотека позволяет просто добавить красиво воссозданные компоненты AI-интерфейсов прямо в свои приложения или CLI-проекты.
Внутри есть компоненты для:
→ промптов и сообщений чата
→ вызовов инструментов
→ diff’ов кода
→ диалогов запроса разрешений
→ списков задач
→ slash-команд
→ и многого другого...
Отлично подойдёт тем, кто разрабатывает AI-приложения, терминальные интерфейсы (TUI) или CLI-инструменты для разработчиков и не хочет собирать всё с нуля :)
github.com/theswerd/brainless
👉 @PythonPortal
Эта open-source-библиотека позволяет просто добавить красиво воссозданные компоненты AI-интерфейсов прямо в свои приложения или CLI-проекты.
Внутри есть компоненты для:
→ промптов и сообщений чата
→ вызовов инструментов
→ diff’ов кода
→ диалогов запроса разрешений
→ списков задач
→ slash-команд
→ и многого другого...
Отлично подойдёт тем, кто разрабатывает AI-приложения, терминальные интерфейсы (TUI) или CLI-инструменты для разработчиков и не хочет собирать всё с нуля :)
github.com/theswerd/brainless
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥7
This media is not supported in your browser
VIEW IN TELEGRAM
Илон Маск предупреждает: времени остаётся всё меньше.
Максимум через три года ещё можно будет зарабатывать, продавая свой труд. После этого ИИ автоматизирует большинство задач, и платить человеку за его время больше не будет смысла.
Модель последних 200 лет — «я плачу тебе зарплату в обмен на твоё время» — подходит к концу.
Это приведёт к крупнейшему перераспределению богатства в современной истории. Те, кто уже перестраивается, это понимают. Те, кто ждёт, пока об этом начнут говорить в новостях, опоздают.
В ближайшие три года самый разумный шаг — превратить своё время в активы, которые искусственный интеллект не сможет заменить или бесконечно масштабировать: биткоин и другие дефицитные цифровые активы, землю и энергоресурсы, инфраструктуру, сети контактов и способность самостоятельно производить то, что вам действительно нужно.
В конечном счёте важно не то, сколько вы работаете, а то, чем вы владеете. Те, кто сделает этот переход сейчас, в 2035–2036 годах будут оглядываться назад и говорить: «Я знал, что так будет».
👉 @PythonPortal
Максимум через три года ещё можно будет зарабатывать, продавая свой труд. После этого ИИ автоматизирует большинство задач, и платить человеку за его время больше не будет смысла.
Модель последних 200 лет — «я плачу тебе зарплату в обмен на твоё время» — подходит к концу.
Это приведёт к крупнейшему перераспределению богатства в современной истории. Те, кто уже перестраивается, это понимают. Те, кто ждёт, пока об этом начнут говорить в новостях, опоздают.
В ближайшие три года самый разумный шаг — превратить своё время в активы, которые искусственный интеллект не сможет заменить или бесконечно масштабировать: биткоин и другие дефицитные цифровые активы, землю и энергоресурсы, инфраструктуру, сети контактов и способность самостоятельно производить то, что вам действительно нужно.
В конечном счёте важно не то, сколько вы работаете, а то, чем вы владеете. Те, кто сделает этот переход сейчас, в 2035–2036 годах будут оглядываться назад и говорить: «Я знал, что так будет».
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣37❤12👀3🤔2🤝1
This media is not supported in your browser
VIEW IN TELEGRAM
Unlimited-OCR — это модель на 3 млрд параметров, которая может распарсить целый PDF на 100 страниц за один проход — без разбиения по страницам и без потери контекста.
* контекстное окно 32K, читает весь документ за один проход
+ 93% на стандартных бенчмарках парсинга, на 6 пунктов выше baseline
* уровень ошибок ниже 0,11 после 40-й страницы — там, где все остальные OCR-инструменты начинают разваливаться
* мультиязычность из коробки, локальный запуск через Transformers, Ollama, llama.cpp или Docker
* Textract, Google Vision и Azure Document Intelligence берут от $1,50 до $15 за 1 000 страниц
1,9 млн скачиваний на Hugging Face, и при этом большинство людей о ней даже не слышали.
Она работает прямо на вашем компьютере. Бесплатно. Навсегда.
Ссылка на модель: http://huggingface.co/baidu/Unlimited-OCR
👉 @PythonPortal
* контекстное окно 32K, читает весь документ за один проход
+ 93% на стандартных бенчмарках парсинга, на 6 пунктов выше baseline
* уровень ошибок ниже 0,11 после 40-й страницы — там, где все остальные OCR-инструменты начинают разваливаться
* мультиязычность из коробки, локальный запуск через Transformers, Ollama, llama.cpp или Docker
* Textract, Google Vision и Azure Document Intelligence берут от $1,50 до $15 за 1 000 страниц
1,9 млн скачиваний на Hugging Face, и при этом большинство людей о ней даже не слышали.
Она работает прямо на вашем компьютере. Бесплатно. Навсегда.
Ссылка на модель: http://huggingface.co/baidu/Unlimited-OCR
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥12👍7❤4