#новости
Вышла GLM-5.2 — топовая модель для создания презентаций, отчетов и макетов сайтов. В бенчмарке Design Arena она обошла даже Claude Fable 5.
У модели 1 млн контекста, она легко работает с большими проектами, не теряя важные детали. Помимо дизайна неплохо показывает себя в кодинге и агентских задачах. И ее можно напрямую интегрировать в Claude Code.
Пользуемся по ссылке.
Вышла GLM-5.2 — топовая модель для создания презентаций, отчетов и макетов сайтов. В бенчмарке Design Arena она обошла даже Claude Fable 5.
У модели 1 млн контекста, она легко работает с большими проектами, не теряя важные детали. Помимо дизайна неплохо показывает себя в кодинге и агентских задачах. И ее можно напрямую интегрировать в Claude Code.
Пользуемся по ссылке.
#новости
Claude Design обновили — и теперь это уже не просто генератор красивых макетов.
Главное: Claude может подтянуть дизайн-систему прямо из репозитория, дизайн-файлов или кодовой базы. То есть использовать реальные компоненты проекта, а не рисовать «примерно похоже, но потом верстальщик плачет».
Ещё докрутили редактор: элементы можно двигать, менять размер и выравнивать прямо на холсте.
Связка с Claude Code тоже стала плотнее. Можно отправить макет в разработку или наоборот — начать с кода и синхронизировать дизайн из терминала.
Плюсом добавили экспорт в PDF и PowerPoint, а также новые интеграции.
Claude Design сейчас в бете и доступен на платных тарифах в вебе и десктопе.
Похоже, Anthropic аккуратно собирает связку: дизайн → код → презентация → обратно в работу. Уже не игрушка для «сделай красиво», а рабочий инструмент для проекта.
Claude Design обновили — и теперь это уже не просто генератор красивых макетов.
Главное: Claude может подтянуть дизайн-систему прямо из репозитория, дизайн-файлов или кодовой базы. То есть использовать реальные компоненты проекта, а не рисовать «примерно похоже, но потом верстальщик плачет».
Ещё докрутили редактор: элементы можно двигать, менять размер и выравнивать прямо на холсте.
Связка с Claude Code тоже стала плотнее. Можно отправить макет в разработку или наоборот — начать с кода и синхронизировать дизайн из терминала.
Плюсом добавили экспорт в PDF и PowerPoint, а также новые интеграции.
Claude Design сейчас в бете и доступен на платных тарифах в вебе и десктопе.
Похоже, Anthropic аккуратно собирает связку: дизайн → код → презентация → обратно в работу. Уже не игрушка для «сделай красиво», а рабочий инструмент для проекта.
#новости
В Codex появилась полезная фича — Record & Replay.
Смысл простой: один раз показываешь Codex, как выполняешь повторяющуюся задачу, а он сохраняет процесс и превращает его в переиспользуемый скилл.
Например:
скачать счета с сайта, выгрузить отчёт из админки, переименовать файл и положить его в нужную папку.
Раньше это приходилось каждый раз объяснять промптом.
Теперь можно просто показать руками один раз — и дальше запускать как автоматизацию.
Вот это уже ближе не к “напиши мне код”, а к нормальному помощнику, который запоминает рутину и забирает её на себя.
Источник: https://developers.openai.com/codex/changelog#codex-2026-06-18-app
В Codex появилась полезная фича — Record & Replay.
Смысл простой: один раз показываешь Codex, как выполняешь повторяющуюся задачу, а он сохраняет процесс и превращает его в переиспользуемый скилл.
Например:
скачать счета с сайта, выгрузить отчёт из админки, переименовать файл и положить его в нужную папку.
Раньше это приходилось каждый раз объяснять промптом.
Теперь можно просто показать руками один раз — и дальше запускать как автоматизацию.
Вот это уже ближе не к “напиши мне код”, а к нормальному помощнику, который запоминает рутину и забирает её на себя.
Источник: https://developers.openai.com/codex/changelog#codex-2026-06-18-app
ChatGPT Learn
Codex changelog | ChatGPT Learn
Latest updates to Codex, OpenAI’s coding agent
#новости
GitHub Copilot начал понимать "AGENTS.md".
Это файл с инструкциями для AI-агентов внутри конкретного репозитория.
Зачем он нужен?
Чтобы Copilot на ревью понимал не только сам код, но и правила проекта:
— какой стиль использовать
— какие тесты запускать
— какие паттерны не трогать
— как устроена архитектура
— что в этом репозитории считается нормой, а что лучше не делать
По сути, "AGENTS.md" становится чем-то вроде README, только не для людей, а для робота.
И это важный сдвиг.
Потому что агент без правил — это джун, который очень быстро печатает.
Может сделать много.
Может даже красиво.
Но без контекста легко уедет не туда и уверенно привезёт техдолг.
Так что если вы используете Copilot, Claude Code, Codex или Cursor в реальном проекте — такой файл уже стоит завести.
ИИ пишет лучше, когда ему не просто говорят “помоги”, а дают нормальную карту местности.
Источник: The GitHub Blog
GitHub Copilot начал понимать "AGENTS.md".
Это файл с инструкциями для AI-агентов внутри конкретного репозитория.
Зачем он нужен?
Чтобы Copilot на ревью понимал не только сам код, но и правила проекта:
— какой стиль использовать
— какие тесты запускать
— какие паттерны не трогать
— как устроена архитектура
— что в этом репозитории считается нормой, а что лучше не делать
По сути, "AGENTS.md" становится чем-то вроде README, только не для людей, а для робота.
И это важный сдвиг.
Потому что агент без правил — это джун, который очень быстро печатает.
Может сделать много.
Может даже красиво.
Но без контекста легко уедет не туда и уверенно привезёт техдолг.
Так что если вы используете Copilot, Claude Code, Codex или Cursor в реальном проекте — такой файл уже стоит завести.
ИИ пишет лучше, когда ему не просто говорят “помоги”, а дают нормальную карту местности.
Источник: The GitHub Blog
The GitHub Blog
Home
Updates, ideas, and inspiration from GitHub to help developers build and design software.
#полезное
Datalab открыла исходники Lift — 9B-модели для извлечения структурированных данных из документов.
Проще говоря: берёте PDF или другой документ, задаёте нужную структуру через JSON Schema — и модель пытается вытащить данные сразу в нормальном виде, а не кашей из текста.
По заявлению разработчиков, на их бенчмарке Lift показывает 90,2% точности.
Для сравнения:
• Gemini 3.5 Flash — 91,3%
• NuExtract3 — 81,5%
То есть модель почти догоняет Gemini и заметно обходит специализированные open-source решения.
Ещё один плюс — простой запуск:
pip install lift-pdf
Медианное время обработки — около 9,5 секунды.
Звучит интересно для задач, где нужно вытаскивать данные из счетов, актов, договоров, анкет, отчётов и прочей PDF-бюрократии, которую обычно хочется не читать, а сразу отправить в базу.
Как всегда, бенчмарки — это одно, реальные документы клиентов — совсем другое. Но инструмент точно стоит добавить в список для теста.
Блог: https://www.datalab.to/blog/introducing-lift
Модель: https://huggingface.co/datalab-to/lift
Код: https://github.com/datalab-to/lift
Datalab открыла исходники Lift — 9B-модели для извлечения структурированных данных из документов.
Проще говоря: берёте PDF или другой документ, задаёте нужную структуру через JSON Schema — и модель пытается вытащить данные сразу в нормальном виде, а не кашей из текста.
По заявлению разработчиков, на их бенчмарке Lift показывает 90,2% точности.
Для сравнения:
• Gemini 3.5 Flash — 91,3%
• NuExtract3 — 81,5%
То есть модель почти догоняет Gemini и заметно обходит специализированные open-source решения.
Ещё один плюс — простой запуск:
pip install lift-pdf
Медианное время обработки — около 9,5 секунды.
Звучит интересно для задач, где нужно вытаскивать данные из счетов, актов, договоров, анкет, отчётов и прочей PDF-бюрократии, которую обычно хочется не читать, а сразу отправить в базу.
Как всегда, бенчмарки — это одно, реальные документы клиентов — совсем другое. Но инструмент точно стоит добавить в список для теста.
Блог: https://www.datalab.to/blog/introducing-lift
Модель: https://huggingface.co/datalab-to/lift
Код: https://github.com/datalab-to/lift
huggingface.co
datalab-to/lift · Hugging Face
We’re on a journey to advance and democratize artificial intelligence through open source and open science.
❤1
🔥 Сразу 5 топовых китайских ИИ-моделей бесплатно — без банковской карты
Через NVIDIA можно получить доступ к нескольким сильнейшим моделям сразу:
• DeepSeek V4 Flash
• MiniMax M3
• Qwen 3.5 397B
• Kimi K2.6
• GLM 5.1
По возможностям они конкурируют с GPT-5.5 и Claude Opus 4.8, а пользоваться ими можно бесплатно.
Что для чего:
⚡ DeepSeek V4 Flash — очень быстрые ответы и минимальная стоимость запросов.
🧠 Qwen 3.5 397B — сложные рассуждения, анализ и задачи с высокой нагрузкой на логику.
🤖 Kimi K2.6 — агентные сценарии и многошаговые рабочие процессы. Модель с заявленным масштабом около 1 трлн параметров.
💻 MiniMax M3 — кодинг-ассистент для редакторов кода и IDE.
🎯 GLM 5.1 — универсальная модель на каждый день.
Все модели совместимы с API OpenAI, поэтому большинство инструментов работают без изменений — достаточно заменить Base URL и указать новую модель.
Как подключить:
1️⃣ Зарегистрироваться на build.nvidia.com (нужен только номер телефона).
2️⃣ В разделе API создать ключ формата nvapi-...
3️⃣ Указать Base URL:
integrate.api.nvidia.com/v1
4️⃣ Выбрать модель:
• minimaxai/minimax-m3
• qwen/qwen3.5-397b-a17b
• moonshotai/kimi-k2.6
• zhipuai/glm-5.1
• deepseek/deepseek-v4-flash
Работает с Claude Code, Cursor, Cline, OpenCode, Hermes и другими OpenAI-совместимыми клиентами.
Что важно:
• около 40 запросов в минуту на бесплатном тарифе;
• один ключ открывает доступ более чем к 100 моделям;
• для продакшена с высокой нагрузкой бесплатный тариф не рассчитан.
Пока многие платят $20–200 в месяц за доступ к одной модели, здесь можно протестировать сразу несколько флагманов бесплатно. 🚀
Через NVIDIA можно получить доступ к нескольким сильнейшим моделям сразу:
• DeepSeek V4 Flash
• MiniMax M3
• Qwen 3.5 397B
• Kimi K2.6
• GLM 5.1
По возможностям они конкурируют с GPT-5.5 и Claude Opus 4.8, а пользоваться ими можно бесплатно.
Что для чего:
⚡ DeepSeek V4 Flash — очень быстрые ответы и минимальная стоимость запросов.
🧠 Qwen 3.5 397B — сложные рассуждения, анализ и задачи с высокой нагрузкой на логику.
🤖 Kimi K2.6 — агентные сценарии и многошаговые рабочие процессы. Модель с заявленным масштабом около 1 трлн параметров.
💻 MiniMax M3 — кодинг-ассистент для редакторов кода и IDE.
🎯 GLM 5.1 — универсальная модель на каждый день.
Все модели совместимы с API OpenAI, поэтому большинство инструментов работают без изменений — достаточно заменить Base URL и указать новую модель.
Как подключить:
1️⃣ Зарегистрироваться на build.nvidia.com (нужен только номер телефона).
2️⃣ В разделе API создать ключ формата nvapi-...
3️⃣ Указать Base URL:
integrate.api.nvidia.com/v1
4️⃣ Выбрать модель:
• minimaxai/minimax-m3
• qwen/qwen3.5-397b-a17b
• moonshotai/kimi-k2.6
• zhipuai/glm-5.1
• deepseek/deepseek-v4-flash
Работает с Claude Code, Cursor, Cline, OpenCode, Hermes и другими OpenAI-совместимыми клиентами.
Что важно:
• около 40 запросов в минуту на бесплатном тарифе;
• один ключ открывает доступ более чем к 100 моделям;
• для продакшена с высокой нагрузкой бесплатный тариф не рассчитан.
Пока многие платят $20–200 в месяц за доступ к одной модели, здесь можно протестировать сразу несколько флагманов бесплатно. 🚀
❤1🎉1
#полезное
Кажется, скоро появится ещё один способ ломать привычные RAG-системы.
Ребята из PixelRAG решили задать простой вопрос: зачем вообще парсить HTML, если нейросеть умеет смотреть на картинки?
Вместо работы с DOM, разметкой и тонной костылей они просто показывают модели страницу такой, какой её видит человек после загрузки.
То есть таблица остаётся таблицей, график — графиком, а не превращается в набор сломанных тегов и потерянного текста.
Для проверки идеи авторы построили визуальный индекс всей Википедии. Да, всей. Получилось больше 30 миллионов скриншотов.
Самое забавное, что эта штука смогла обойти сильные текстовые RAG-пайплайны в задачах поиска и ответов на вопросы.
Ещё интереснее другое.
Если завтра выйдет более мощная мультимодальная модель, индекс не придётся собирать заново. Меняется только "чтец", а данные остаются прежними.
Также выпустили плагин для Claude Code. Теперь агент может анализировать страницу через её визуальное представление, а не пытаться разобраться в километрах HTML и JavaScript.
Пока выглядит как один из самых нестандартных AI-проектов за последнее время.
Иногда лучший способ решить проблему — просто перестать её решать привычным способом.
Забираем тут
Кажется, скоро появится ещё один способ ломать привычные RAG-системы.
Ребята из PixelRAG решили задать простой вопрос: зачем вообще парсить HTML, если нейросеть умеет смотреть на картинки?
Вместо работы с DOM, разметкой и тонной костылей они просто показывают модели страницу такой, какой её видит человек после загрузки.
То есть таблица остаётся таблицей, график — графиком, а не превращается в набор сломанных тегов и потерянного текста.
Для проверки идеи авторы построили визуальный индекс всей Википедии. Да, всей. Получилось больше 30 миллионов скриншотов.
Самое забавное, что эта штука смогла обойти сильные текстовые RAG-пайплайны в задачах поиска и ответов на вопросы.
Ещё интереснее другое.
Если завтра выйдет более мощная мультимодальная модель, индекс не придётся собирать заново. Меняется только "чтец", а данные остаются прежними.
Также выпустили плагин для Claude Code. Теперь агент может анализировать страницу через её визуальное представление, а не пытаться разобраться в километрах HTML и JavaScript.
Пока выглядит как один из самых нестандартных AI-проектов за последнее время.
Иногда лучший способ решить проблему — просто перестать её решать привычным способом.
Забираем тут
GitHub
PixelRAG/assets/pixelrag-paper.pdf at main · StarTrail-org/PixelRAG
The end of web parsing. The beginning of scalable pixel-native search. link: https://pixelrag.ai/ - StarTrail-org/PixelRAG
Китайцы решили устроить раздачу.
До 28 июня платформа OpenModel бесплатно выдаёт доступ к API DeepSeek-V4-Flash — одной из самых производительных моделей этого года.
Что умеет:
• работа с агентами;
• обработка изображений;
• высокая скорость генерации — более 100 токенов в секунду;
• подходит для чат-ботов, автоматизации и AI-приложений.
Для получения API-ключа достаточно зарегистрировать аккаунт.
Если давно хотели протестировать DeepSeek без затрат на запросы — сейчас редкий момент, когда за эксперименты платить не придётся.
Забираем тут
До 28 июня платформа OpenModel бесплатно выдаёт доступ к API DeepSeek-V4-Flash — одной из самых производительных моделей этого года.
Что умеет:
• работа с агентами;
• обработка изображений;
• высокая скорость генерации — более 100 токенов в секунду;
• подходит для чат-ботов, автоматизации и AI-приложений.
Для получения API-ключа достаточно зарегистрировать аккаунт.
Если давно хотели протестировать DeepSeek без затрат на запросы — сейчас редкий момент, когда за эксперименты платить не придётся.
Забираем тут
👍3
#полезное
Большинство разработчиков думают, что быстро упираются в лимиты ИИ из-за дорогих моделей.
На самом деле они просто неправильно ими пользуются.
Недавно вокруг GLM 5.2 начали массово жаловаться на ограничения и быстрое сгорание квот.
Но есть нюанс.
Подписка считает не токены.
Она считает запросы.
Один запрос на 20 000 символов и один запрос из двух слов стоят одинаково.
Из-за этого многие тратят лимиты на десятки мелких сообщений:
❌ «Переименуй переменную» ❌ «Исправь импорт» ❌ «Добавь типы» ❌ «Обнови тесты»
Хотя всё это можно отправить одним сообщением.
Чем опытнее разработчик работает с ИИ, тем меньше запросов он делает.
Парадокс современного AI-кодинга:
Побеждает не тот, у кого больше токенов.
Побеждает тот, кто умеет ставить задачи так, чтобы модель понимала всё с первого раза.
Сегодня самый дорогой ресурс — уже не вычисления.
Самый дорогой ресурс — хороший промпт.
Большинство разработчиков думают, что быстро упираются в лимиты ИИ из-за дорогих моделей.
На самом деле они просто неправильно ими пользуются.
Недавно вокруг GLM 5.2 начали массово жаловаться на ограничения и быстрое сгорание квот.
Но есть нюанс.
Подписка считает не токены.
Она считает запросы.
Один запрос на 20 000 символов и один запрос из двух слов стоят одинаково.
Из-за этого многие тратят лимиты на десятки мелких сообщений:
❌ «Переименуй переменную» ❌ «Исправь импорт» ❌ «Добавь типы» ❌ «Обнови тесты»
Хотя всё это можно отправить одним сообщением.
Чем опытнее разработчик работает с ИИ, тем меньше запросов он делает.
Парадокс современного AI-кодинга:
Побеждает не тот, у кого больше токенов.
Побеждает тот, кто умеет ставить задачи так, чтобы модель понимала всё с первого раза.
Сегодня самый дорогой ресурс — уже не вычисления.
Самый дорогой ресурс — хороший промпт.
❤1
🎵 Нашёл музыкальный плеер, который реально удивил — Mimose
После очередного поиска нормальной замены привычным сервисам наткнулся на Mimose. И пока это один из самых интересных бесплатных музыкальных плееров, которые мне попадались.
🔥 Что понравилось:
• Полностью бесплатный — без рекламы, ограничений и навязчивых подписок. Премиум есть, но базовых возможностей хватает с головой.
• Работает без VPN.
• Огромная библиотека музыки. Треки подтягиваются сразу из нескольких источников: Spotify, YouTube Music, SoundCloud и других сервисов.
• Много музыки доступно без цензуры.
• Можно быстро перенести свои плейлисты из других музыкальных сервисов.
• Есть тексты песен и моментальный перевод иностранных треков прямо во время прослушивания.
• Работают персональные рекомендации — что-то вроде «Моей волны».
• Интеграция с Discord: друзья смогут видеть, что вы сейчас слушаете.
• Интерфейс выглядит дорого и современно, плюс хорошо настраивается под себя.
Судя по всему, разработчики сделали то, что давно должны были сделать крупные музыкальные сервисы.
🎧 Попробовать можно здесь: mimose.fun
После очередного поиска нормальной замены привычным сервисам наткнулся на Mimose. И пока это один из самых интересных бесплатных музыкальных плееров, которые мне попадались.
🔥 Что понравилось:
• Полностью бесплатный — без рекламы, ограничений и навязчивых подписок. Премиум есть, но базовых возможностей хватает с головой.
• Работает без VPN.
• Огромная библиотека музыки. Треки подтягиваются сразу из нескольких источников: Spotify, YouTube Music, SoundCloud и других сервисов.
• Много музыки доступно без цензуры.
• Можно быстро перенести свои плейлисты из других музыкальных сервисов.
• Есть тексты песен и моментальный перевод иностранных треков прямо во время прослушивания.
• Работают персональные рекомендации — что-то вроде «Моей волны».
• Интеграция с Discord: друзья смогут видеть, что вы сейчас слушаете.
• Интерфейс выглядит дорого и современно, плюс хорошо настраивается под себя.
Судя по всему, разработчики сделали то, что давно должны были сделать крупные музыкальные сервисы.
🎧 Попробовать можно здесь: mimose.fun
Вышла Qwythos-9B-Claude-Mythos-5 с контекстным окном до 1 миллиона токенов.
Команда Empero представила новую reasoning-модель, созданную на базе глубоко модифицированной версии Qwen3.5-9B. Разработчики провели полный fine-tune модели и дополнительно обучили её более чем на 500 миллионах токенов данных Claude Mythos и Claude Fable.
Что известно:
• Контекстное окно увеличено до 1 миллиона токенов.
• Для обучения использовались синтетические Chain of Thought (CoT), созданные на основе сессий Mythos-5 и Fable-5.
• Выполнен полный fine-tune всех параметров модели.
• Основной акцент сделан на улучшение способностей к рассуждению и работе со сложными задачами.
Интересный момент: всё чаще открытые модели обучаются на данных, сгенерированных более мощными ИИ-системами. В результате качество open-source решений продолжает быстро сокращать разрыв с закрытыми моделями.
Модель уже доступна на Hugging Face:
https://huggingface.co/empero-ai/Qwythos-9B-Claude-Mythos-5-1M
Команда Empero представила новую reasoning-модель, созданную на базе глубоко модифицированной версии Qwen3.5-9B. Разработчики провели полный fine-tune модели и дополнительно обучили её более чем на 500 миллионах токенов данных Claude Mythos и Claude Fable.
Что известно:
• Контекстное окно увеличено до 1 миллиона токенов.
• Для обучения использовались синтетические Chain of Thought (CoT), созданные на основе сессий Mythos-5 и Fable-5.
• Выполнен полный fine-tune всех параметров модели.
• Основной акцент сделан на улучшение способностей к рассуждению и работе со сложными задачами.
Интересный момент: всё чаще открытые модели обучаются на данных, сгенерированных более мощными ИИ-системами. В результате качество open-source решений продолжает быстро сокращать разрыв с закрытыми моделями.
Модель уже доступна на Hugging Face:
https://huggingface.co/empero-ai/Qwythos-9B-Claude-Mythos-5-1M
Вчера Anthropic выпустили полезный воркшоп, где Борис Черны рассказывает, как эффективно использовать Claude Code на практике и делится рабочими подходами к написанию промптов.
Я сделал полный перевод этого материала на русский язык, чтобы вам не пришлось смотреть его на английском.
В ролике:
💬 Практические советы по работе с Claude Code
💬Подходы к написанию промптов
💬Работа с контекстом проекта
💬Полезные техники для разработки
💬Рекомендации от одного из создателей Claude Code
🎬Видео уже на YouTube.
Приятного просмотра!
Я сделал полный перевод этого материала на русский язык, чтобы вам не пришлось смотреть его на английском.
В ролике:
💬 Практические советы по работе с Claude Code
💬Подходы к написанию промптов
💬Работа с контекстом проекта
💬Полезные техники для разработки
💬Рекомендации от одного из создателей Claude Code
🎬Видео уже на YouTube.
Приятного просмотра!
YouTube
Как пользоваться Claude Code — гайд от создателей
В этом видео разбираем официальный гайд по Claude Code от создателей инструмента. Я перевел и адаптировал основные идеи на русский язык, чтобы вы могли быстро разобраться в подходах к работе с Claude Code без необходимости смотреть оригинальный материал на…
👍1
У Claude крупный сбой по всему миру — все сервисы Anthropic оказались не доступны..
Сегодня не вайбкодим.
Сегодня не вайбкодим.
Claude
Claude Status
Welcome to Claude's home for real-time and historical data on system performance.
Айтишник потратил $80 000 на токены ради брейнрот-шутера. Проблема была в том, что платил не он.
Финтех-компания Slash призвала сотрудников активнее использовать ИИ и вайбкодить без ограничений. Один из разработчиков воспринял это как руководство к действию и начал генерировать игру, не особо следя за расходами.
Результат — счёт за токены почти на $80 тысяч.
Чтобы объяснить затраты, разработчику пришлось срочно встроить в игру реферальную ссылку на открытие счёта в Slash и представить проект как маркетинговую кампанию.
Пожалуй, это первый случай, когда брейнрот-шутер официально стал корпоративным маркетингом.
Финтех-компания Slash призвала сотрудников активнее использовать ИИ и вайбкодить без ограничений. Один из разработчиков воспринял это как руководство к действию и начал генерировать игру, не особо следя за расходами.
Результат — счёт за токены почти на $80 тысяч.
Чтобы объяснить затраты, разработчику пришлось срочно встроить в игру реферальную ссылку на открытие счёта в Slash и представить проект как маркетинговую кампанию.
Пожалуй, это первый случай, когда брейнрот-шутер официально стал корпоративным маркетингом.
This media is not supported in your browser
VIEW IN TELEGRAM
#новости
Вышел Mistral OCR 4. И похоже, это новый лидер среди OCR-моделей.
Модель умеет распознавать документы на 170 языках и работает не только с текстом, но и со структурой документа целиком.
Что показали тесты:
• Более 600 реальных документов на 12+ языках сравнили с другими OCR-системами.
• Независимые аннотаторы оценивали результаты вслепую.
• Mistral OCR 4 обошёл всех конкурентов со средним винрейтом 72%.
• На бенчмарке OlmOCRBench модель набрала 85.2 балла.
Самое интересное началось на рукописном экзамене по математическому анализу.
Модели дали фотографию страницы с формулами, вычислениями и графиком. OCR 4 не просто прочитал почерк, а восстановил весь документ в структурированный LaTeX.
Причём график она не проигнорировала и не превратила в случайный набор символов. Модель определила его как отдельный объект и пометила в структуре документа как chart.
На обработку страницы ушло 5.1 секунды при стоимости около $0.09.
Если раньше OCR был про извлечение текста, то новые модели всё больше начинают пони
Вышел Mistral OCR 4. И похоже, это новый лидер среди OCR-моделей.
Модель умеет распознавать документы на 170 языках и работает не только с текстом, но и со структурой документа целиком.
Что показали тесты:
• Более 600 реальных документов на 12+ языках сравнили с другими OCR-системами.
• Независимые аннотаторы оценивали результаты вслепую.
• Mistral OCR 4 обошёл всех конкурентов со средним винрейтом 72%.
• На бенчмарке OlmOCRBench модель набрала 85.2 балла.
Самое интересное началось на рукописном экзамене по математическому анализу.
Модели дали фотографию страницы с формулами, вычислениями и графиком. OCR 4 не просто прочитал почерк, а восстановил весь документ в структурированный LaTeX.
Причём график она не проигнорировала и не превратила в случайный набор символов. Модель определила его как отдельный объект и пометила в структуре документа как chart.
На обработку страницы ушло 5.1 секунды при стоимости около $0.09.
Если раньше OCR был про извлечение текста, то новые модели всё больше начинают пони
This media is not supported in your browser
VIEW IN TELEGRAM
Claude теперь можно добавить в Slack как обычного сотрудника.
Anthropic представила Claude Tag — достаточно упомянуть ИИ в сообщении, и он сам разберётся с задачей: напишет код, создаст или сольёт PR, проанализирует данные или поможет разобраться с инцидентом. Ответ появится прямо в ветке обсуждения.
Главная особенность — Claude запоминает контекст канала. Ему не нужно каждый раз объяснять проект заново, а любой участник команды может продолжить работу с того места, где остановился коллега.
Есть и режим Ambient, в котором ИИ сам подключается к обсуждениям, напоминает о незавершённых задачах и сообщает о важных событиях из связанных сервисов.
По данным Anthropic, уже 65% кода внутри компании пишется с помощью внутренней версии Claude Tag.
И самое интересное: почти сразу после анонса появилась открытая альтернатива — Open Tag, совместимая с любыми ИИ-моделями и агентными фреймворками. Похоже, скоро цифровые сотрудники станут привычной частью рабочих чатов.
#полезное #новости@codautomat
#claude
Anthropic представила Claude Tag — достаточно упомянуть ИИ в сообщении, и он сам разберётся с задачей: напишет код, создаст или сольёт PR, проанализирует данные или поможет разобраться с инцидентом. Ответ появится прямо в ветке обсуждения.
Главная особенность — Claude запоминает контекст канала. Ему не нужно каждый раз объяснять проект заново, а любой участник команды может продолжить работу с того места, где остановился коллега.
Есть и режим Ambient, в котором ИИ сам подключается к обсуждениям, напоминает о незавершённых задачах и сообщает о важных событиях из связанных сервисов.
По данным Anthropic, уже 65% кода внутри компании пишется с помощью внутренней версии Claude Tag.
И самое интересное: почти сразу после анонса появилась открытая альтернатива — Open Tag, совместимая с любыми ИИ-моделями и агентными фреймворками. Похоже, скоро цифровые сотрудники станут привычной частью рабочих чатов.
#полезное #новости@codautomat
#claude
❤3
Нашли интересный подход к работе с Git, который может сэкономить немало времени на ревью.
В репозитории git push no-mistakes предлагают не отправлять код в PR сразу, а сначала полностью проверить его локально.
Перед
• ИИ анализирует изменения и ищет потенциальные ошибки.
• Запускаются тесты.
• Проверяется код линтером.
• Обновляется документация.
• Выполняются все проверки, которые обычно проходят в CI.
Всё это происходит в отдельном Git Worktree, поэтому основная рабочая ветка остаётся нетронутой, а разработка не блокируется.
Если все этапы проходят успешно — создаётся уже готовый к ревью pull request.
По сути, идея простая: чем больше ошибок отлавливается до открытия PR, тем меньше времени команда тратит на бесконечные правки и повторные проверки.
#полезное #новости@codautomat
#git #claude
В репозитории git push no-mistakes предлагают не отправлять код в PR сразу, а сначала полностью проверить его локально.
Перед
git push автоматически запускается целая цепочка проверок:• ИИ анализирует изменения и ищет потенциальные ошибки.
• Запускаются тесты.
• Проверяется код линтером.
• Обновляется документация.
• Выполняются все проверки, которые обычно проходят в CI.
Всё это происходит в отдельном Git Worktree, поэтому основная рабочая ветка остаётся нетронутой, а разработка не блокируется.
Если все этапы проходят успешно — создаётся уже готовый к ревью pull request.
По сути, идея простая: чем больше ошибок отлавливается до открытия PR, тем меньше времени команда тратит на бесконечные правки и повторные проверки.
#полезное #новости@codautomat
#git #claude
❤1
Нашли способ запускать GLM-5.2 бесплатно через Cloudflare Workers AI.
Автор заявляет: без лимитов, без карты, через OpenAI-совместимый API. Мы не проверяли — воспринимайте как эксперимент.
Что обещают:
• контекст до 262 тыс. токенов;
• Tool Use и Function Calling;
• совместимость с OpenCode, Cursor, Aider, Claude Code, Hermes.
Настройка (~5 минут):
1. Создайте аккаунт Cloudflare.
2. В Workers AI скопируйте Account ID.
3. Создайте API Token.
4. Добавьте провайдер с Base URL:
5. Укажите модель:
Если работает — это удобный бесплатный вариант для тестов ИИ-агентов.
Проверяли? Напишите в комментариях.
#полезное #новости@codautomat #glm
Автор заявляет: без лимитов, без карты, через OpenAI-совместимый API. Мы не проверяли — воспринимайте как эксперимент.
Что обещают:
• контекст до 262 тыс. токенов;
• Tool Use и Function Calling;
• совместимость с OpenCode, Cursor, Aider, Claude Code, Hermes.
Настройка (~5 минут):
1. Создайте аккаунт Cloudflare.
2. В Workers AI скопируйте Account ID.
3. Создайте API Token.
4. Добавьте провайдер с Base URL:
https://api.cloudflare.com/client/v4/accounts/ВАШ_ACCOUNT_ID/ai/v15. Укажите модель:
@cf/zai-org/glm-5.2Если работает — это удобный бесплатный вариант для тестов ИИ-агентов.
Проверяли? Напишите в комментариях.
#полезное #новости@codautomat #glm
Нашли интересный open-source мессенджер — SimpleX Chat.
В отличие от Telegram, WhatsApp и Signal, здесь вообще не нужен номер телефона, email или логин. Каждый новый чат создаётся по одноразовой ссылке или QR-коду, поэтому у сервиса нет единого списка пользователей и контактов.
Что умеет:
• без регистрации и номера телефона; • сквозное шифрование сообщений; • переписка хранится только на ваших устройствах; • приложения для Android, iOS, Windows, macOS, Linux и терминала; • можно поднять собственный сервер.
Если давно искали максимально приватный мессенджер без привязки к личности — стоит попробовать.
GitHub: https://github.com/simplex-chat/simplex-chat
#полезное @codautomat
В отличие от Telegram, WhatsApp и Signal, здесь вообще не нужен номер телефона, email или логин. Каждый новый чат создаётся по одноразовой ссылке или QR-коду, поэтому у сервиса нет единого списка пользователей и контактов.
Что умеет:
• без регистрации и номера телефона; • сквозное шифрование сообщений; • переписка хранится только на ваших устройствах; • приложения для Android, iOS, Windows, macOS, Linux и терминала; • можно поднять собственный сервер.
Если давно искали максимально приватный мессенджер без привязки к личности — стоит попробовать.
GitHub: https://github.com/simplex-chat/simplex-chat
#полезное @codautomat
Похоже, Prompt Engineering постепенно уходит в прошлое.
На GitHub появился проект Loop Engineering, который предлагает другой подход к работе с ИИ-агентами.
Идея простая: вместо того чтобы постоянно писать новые промпты и контролировать каждый шаг агента, вы создаёте цикл, в котором он сам выполняет задачи, проверяет результат, исправляет ошибки и при необходимости эскалирует проблему.
В репозитории уже есть готовые циклы для:
• code review и PR;
• CI/CD;
• обработки Issues;
• обновления зависимостей;
• генерации changelog;
• ежедневного анализа репозитория.
Также доступны CLI-инструменты для создания собственных циклов, оценки расхода токенов, аудита проекта и безопасного запуска агентов через GitHub Actions.
Если Prompt Engineering учил писать хорошие промпты, то Loop Engineering учит строить систему, в которой ИИ работает практически без постоянного участия человека.
GitHub: https://github.com/cobusgreyling/loop-engineering
#полезное #гайды
На GitHub появился проект Loop Engineering, который предлагает другой подход к работе с ИИ-агентами.
Идея простая: вместо того чтобы постоянно писать новые промпты и контролировать каждый шаг агента, вы создаёте цикл, в котором он сам выполняет задачи, проверяет результат, исправляет ошибки и при необходимости эскалирует проблему.
В репозитории уже есть готовые циклы для:
• code review и PR;
• CI/CD;
• обработки Issues;
• обновления зависимостей;
• генерации changelog;
• ежедневного анализа репозитория.
Также доступны CLI-инструменты для создания собственных циклов, оценки расхода токенов, аудита проекта и безопасного запуска агентов через GitHub Actions.
Если Prompt Engineering учил писать хорошие промпты, то Loop Engineering учит строить систему, в которой ИИ работает практически без постоянного участия человека.
GitHub: https://github.com/cobusgreyling/loop-engineering
#полезное #гайды
👍1
Недавно я перевёл выступление Бориса Черного — инженера, который работает над Claude Code. Ролик неожиданно зашёл многим, так что я собрал из него короткую выжимку.
На карточках — 6 главных принципов работы с Claude Code, которыми Борис пользуется сам каждый день.
Если совсем коротко:
• сначала план — потом код;
• короткий CLAUDE.md лучше огромной инструкции;
• заставляйте модель проверять саму себя;
• работайте в нескольких сессиях параллельно;
• превращайте рутину в команды;
• не стройте сложные костыли под текущую модель.
📖 [Полный разбор — с пояснениями и примерами]
⸻
⚡️ И небольшая новость.
[Сайт] сейчас в активной разработке — но уже можно зайти, осмотреться и попробовать основное: рейтинг ИИ-моделей, сравнения нейросетей, промпты и глоссарий.
Если заметите недочёт или появится идея — нажмите кнопку «Обратная связь» внизу сайта и напишите, что добавить или улучшить. Читаем всё и постепенно внедряем.
Полноценный анонс платформы сделаем чуть позже, когда подготовим ещё больше возможностей. 🚀
На карточках — 6 главных принципов работы с Claude Code, которыми Борис пользуется сам каждый день.
Если совсем коротко:
• сначала план — потом код;
• короткий CLAUDE.md лучше огромной инструкции;
• заставляйте модель проверять саму себя;
• работайте в нескольких сессиях параллельно;
• превращайте рутину в команды;
• не стройте сложные костыли под текущую модель.
📖 [Полный разбор — с пояснениями и примерами]
⸻
⚡️ И небольшая новость.
[Сайт] сейчас в активной разработке — но уже можно зайти, осмотреться и попробовать основное: рейтинг ИИ-моделей, сравнения нейросетей, промпты и глоссарий.
Если заметите недочёт или появится идея — нажмите кнопку «Обратная связь» внизу сайта и напишите, что добавить или улучшить. Читаем всё и постепенно внедряем.
Полноценный анонс платформы сделаем чуть позже, когда подготовим ещё больше возможностей. 🚀
❤2