This media is not supported in your browser
VIEW IN TELEGRAM
Google открыла исходный код ARTEMIS — инструмента, который позволяет ИИ управлять Android-смартфоном. ◝(ᵔᗜᵔ)◜
Его можно использовать для автоматизации действий на телефоне и тестирования приложений.
Работает с Claude Code, Codex, Cursor и другими инструментами.
Google утверждает, что ARTEMIS справляется более чем с 99% задач.
Правда, вокруг проекта уже успел возникнуть небольшой скандал.💀
Его можно использовать для автоматизации действий на телефоне и тестирования приложений.
Работает с Claude Code, Codex, Cursor и другими инструментами.
Google утверждает, что ARTEMIS справляется более чем с 99% задач.
Правда, вокруг проекта уже успел возникнуть небольшой скандал.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic запустила Projects в Claude Code.
Теперь одну большую задачу можно вести как единый проект. Claude сам разбивает работу на отдельные ветки, запускает их параллельно в облаке, передаёт между ними контекст и продолжает работу даже после того, как вы закрыли ноутбук.
Пока Projects доступны в предварительном доступе для части пользователей Pro и Max. Если функции ещё нет, можно записаться в список ожидания.
Локальные сценарии обещают добавить совсем скоро.
https://code.claude.com/docs/en/claude-projects🎉
Теперь одну большую задачу можно вести как единый проект. Claude сам разбивает работу на отдельные ветки, запускает их параллельно в облаке, передаёт между ними контекст и продолжает работу даже после того, как вы закрыли ноутбук.
Пока Projects доступны в предварительном доступе для части пользователей Pro и Max. Если функции ещё нет, можно записаться в список ожидания.
Локальные сценарии обещают добавить совсем скоро.
https://code.claude.com/docs/en/claude-projects
Please open Telegram to view this post
VIEW IN TELEGRAM
Вайб-кодинг
Один из создателей ChatGPT представил принципиально новый тип ИИ-моделей. Два года, Диогу Алмейда, втайне разрабатывал Jev — модель, которая не пишет текст и не генерирует токены последовательно. Она получает любые неструктурированные данные и параллельно…
Media is too big
VIEW IN TELEGRAM
Jev уже пробуют применять в автономном вождении.
По словам автора эксперимента, меньше чем за час на новой модели удалось собрать в симуляции полный цикл принятия решений для машины.
Повороты, перестроения, проезд перекрёстков, выезд на шоссе. Для каждого действия модель возвращает не текст, а типизированные вероятности возможных решений вместе с уровнем уверенности.
В этом и отличие Jev от обычных чат-моделей. На вход подаётся состояние системы, на выходе получается набор допустимых действий и их вероятности.
Если такой подход действительно хорошо масштабируется, порог входа в создание систем автономного вождения может заметно снизиться.
По словам автора эксперимента, меньше чем за час на новой модели удалось собрать в симуляции полный цикл принятия решений для машины.
Повороты, перестроения, проезд перекрёстков, выезд на шоссе. Для каждого действия модель возвращает не текст, а типизированные вероятности возможных решений вместе с уровнем уверенности.
В этом и отличие Jev от обычных чат-моделей. На вход подаётся состояние системы, на выходе получается набор допустимых действий и их вероятности.
Если такой подход действительно хорошо масштабируется, порог входа в создание систем автономного вождения может заметно снизиться.
Очень хороший прогресс для локальных моделей.
PrismML выпустила Bonsai 2 27B на базе Qwen3.8 27B. После трёхзначного квантования модель занимает всего 5,9 ГБ, примерно в девять раз меньше полной версии.
По тестам разработчиков она сохраняет 98,2% исходного результата, при этом поддерживает работу с изображениями и вызов инструментов. Модель открыта под Apache 2.0.
PrismML выпустила Bonsai 2 27B на базе Qwen3.8 27B. После трёхзначного квантования модель занимает всего 5,9 ГБ, примерно в девять раз меньше полной версии.
По тестам разработчиков она сохраняет 98,2% исходного результата, при этом поддерживает работу с изображениями и вызов инструментов. Модель открыта под Apache 2.0.
This media is not supported in your browser
VIEW IN TELEGRAM
Вышел Inspo — MCP-сервер, который помогает агентам создавать качественный дизайн.
Он ищет подходящие примеры среди более чем 800 красивых сайтов и передаёт их Claude Code, Codex или OpenCode как ориентир для будущего интерфейса.
Теперь агенту можно поручить найти примеры под конкретный экран, стиль или продукт, а затем на их основе собрать собственный дизайн.
Проект бесплатный и с открытым исходным кодом.
Он ищет подходящие примеры среди более чем 800 красивых сайтов и передаёт их Claude Code, Codex или OpenCode как ориентир для будущего интерфейса.
Теперь агенту можно поручить найти примеры под конкретный экран, стиль или продукт, а затем на их основе собрать собственный дизайн.
Проект бесплатный и с открытым исходным кодом.
npx inspo-mcp install5
This media is not supported in your browser
VIEW IN TELEGRAM
Orca с открытым исходным кодом идеально подходит для координации нескольких агентов для вайбкодинга: Claude Code, Codex, Opencode, Antigravity и других.
Например, Claude создаёт посадочную страницу, а Codex оценивает её по шкале от 1 до 10. Если оценка ниже 9, он запрашивает изменения, повторяя цикл со скриншотами и кодом.
Результат получается намного лучше первой версии.
Например, Claude создаёт посадочную страницу, а Codex оценивает её по шкале от 1 до 10. Если оценка ниже 9, он запрашивает изменения, повторяя цикл со скриншотами и кодом.
Результат получается намного лучше первой версии.
MiniMax открывает исходный код MiniMax Code.
Руководитель разработки и исследований компании, Ронни, анонсировал публикацию проекта на GitHub словами:
То есть MiniMax Code сначала создавали вместе с разработчиками, а теперь сам продукт переводят в открытую разработку.
Особенно интересно это на фоне свежих тестов компании. На одной и той же модели и наборе из 30 задач MiniMax Code показал 76,7% успешных выполнений против 66,7% у Codex и 63,3% у Claude Code.
Среднее время выполнения составило 4 минуты 33 секунды против 6 минут 43 секунд у Codex и 9 минут 38 секунд у Claude Code.
Стоимость одного запуска — $1,83 против $3,47 у Codex и $18,34 у Claude Code.
Теперь можно будет посмотреть, как устроена эта обвязка и за счёт чего она даёт такую разницу.🤔
Руководитель разработки и исследований компании, Ронни, анонсировал публикацию проекта на GitHub словами:
«Создано вместе с разработчиками. Теперь создаётся открыто. Увидимся на GitHub».
То есть MiniMax Code сначала создавали вместе с разработчиками, а теперь сам продукт переводят в открытую разработку.
Особенно интересно это на фоне свежих тестов компании. На одной и той же модели и наборе из 30 задач MiniMax Code показал 76,7% успешных выполнений против 66,7% у Codex и 63,3% у Claude Code.
Среднее время выполнения составило 4 минуты 33 секунды против 6 минут 43 секунд у Codex и 9 минут 38 секунд у Claude Code.
Стоимость одного запуска — $1,83 против $3,47 у Codex и $18,34 у Claude Code.
Теперь можно будет посмотреть, как устроена эта обвязка и за счёт чего она даёт такую разницу.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Навайбкодить AI-агента сейчас можно за вечер. А вот довести его до прода так, чтобы он не выбирал неправильные тулы, не работал с устаревшими данными и не выполнял опасные действия без ограничений – уже совсем другая история 😵💫
Как раз про этот разрыв между демкой и нормальной системой сделали курс «AI-агенты» в Школе Высшей Математики.
Ведут его инженеры, которые запускали агентные системы в Revolut, Wildberries и Точка Банке. В программе разберут всё, что нужно агенту уже в реальной эксплуатации:
— трейсы, логи и отладка агентов
— метрики и оценка качества
— ограничения для опасных действий
— RAG, LangGraph, MCP и Langfuse
— мультиагентные системы и деплой
Курс идёт 12 недель, занятия живые + домашки с фидбэком от преподавателей. Нужны Python и опыт работы с API, опыт разработки агентов не обязателен.
Старт нового потока — 24 сентября.
Если пока не уверены, что курс вам подходит, у ребят есть бесплатное вводное занятие и воркшоп про AI-агентов в BigTech.
По промокоду🍯
Реклама.
О рекламодателе.
Как раз про этот разрыв между демкой и нормальной системой сделали курс «AI-агенты» в Школе Высшей Математики.
Ведут его инженеры, которые запускали агентные системы в Revolut, Wildberries и Точка Банке. В программе разберут всё, что нужно агенту уже в реальной эксплуатации:
— трейсы, логи и отладка агентов
— метрики и оценка качества
— ограничения для опасных действий
— RAG, LangGraph, MCP и Langfuse
— мультиагентные системы и деплой
Курс идёт 12 недель, занятия живые + домашки с фидбэком от преподавателей. Нужны Python и опыт работы с API, опыт разработки агентов не обязателен.
Старт нового потока — 24 сентября.
Если пока не уверены, что курс вам подходит, у ребят есть бесплатное вводное занятие и воркшоп про AI-агентов в BigTech.
По промокоду
VIBE дают скидку. Программа и отзывы – по ссылке Реклама.
О рекламодателе.
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Media is too big
VIEW IN TELEGRAM
AgentCloak запускает бесплатное расширение для браузера, которое помогает не передавать личные данные в запросах к ИИ.
По словам разработчика, небольшая ИИ-модель работает локально прямо в браузере, находит такие данные, как имена и номера счетов, и заменяет их на подставные значения перед отправкой запроса. После получения ответа расширение возвращает исходные данные обратно.
Поддерживаются ChatGPT, Claude, Gemini, Grok, DeepSeek и другие модели. Регистрация не требуется.
https://incountry.com/
По словам разработчика, небольшая ИИ-модель работает локально прямо в браузере, находит такие данные, как имена и номера счетов, и заменяет их на подставные значения перед отправкой запроса. После получения ответа расширение возвращает исходные данные обратно.
Поддерживаются ChatGPT, Claude, Gemini, Grok, DeepSeek и другие модели. Регистрация не требуется.
https://incountry.com/
Рекомендую попробовать Codex вместе с Jev. В связке они ускоряют работу с браузером в 5–10 раз.
Обычно когда Codex сам работает со страницей, ему на каждом шаге приходится читать DOM, рассуждать и вызывать инструмент. Каждый такой цикл добавляет задержку.
Теперь действия вроде нажатий, переходов, переключений и прокрутки можно отдать Jev, а Codex оставить рассуждения, ввод текста и проверку результата по изображению.
Основные преимущества:
> Jev последовательно выполняет действия, а Codex подключается только когда нужно что-то ввести или проверить изображение
> Чем меньше обращений к модели, тем ниже задержка и расход
Как настроить:
1) Подготовить Codex с браузером/CUA, Node.js 22+ и ключом TypeSafe API
2) Установить Skill: передать репозиторий Codex или выполнить
3) Загрузить
4) Когда требуется принять решение или ввести текст, управление возвращается Codex. После этого Jev продолжает выполнение
5) Проверить всё на реальной странице продукта или в автоматизированном тесте
Тем, кто самостоятельно разрабатывает продукты и каждый день прогоняет тесты через браузер, стоит попробовать.
Skill открыт: http://github.com/vlad-terin/jev-use
Обычно когда Codex сам работает со страницей, ему на каждом шаге приходится читать DOM, рассуждать и вызывать инструмент. Каждый такой цикл добавляет задержку.
Теперь действия вроде нажатий, переходов, переключений и прокрутки можно отдать Jev, а Codex оставить рассуждения, ввод текста и проверку результата по изображению.
Основные преимущества:
> Jev последовательно выполняет действия, а Codex подключается только когда нужно что-то ввести или проверить изображение
> Чем меньше обращений к модели, тем ниже задержка и расход
Как настроить:
1) Подготовить Codex с браузером/CUA, Node.js 22+ и ключом TypeSafe API
2) Установить Skill: передать репозиторий Codex или выполнить
npm run install:codex -- --env-file .env3) Загрузить
jev-use, чтобы Jev взял на себя нажатия, переходы и прокрутку4) Когда требуется принять решение или ввести текст, управление возвращается Codex. После этого Jev продолжает выполнение
5) Проверить всё на реальной странице продукта или в автоматизированном тесте
Тем, кто самостоятельно разрабатывает продукты и каждый день прогоняет тесты через браузер, стоит попробовать.
Skill открыт: http://github.com/vlad-terin/jev-use
GitHub
GitHub - vlad-terin/jev-use: Jev-powered browser and desktop workflows with fewer Codex round trips.
Jev-powered browser and desktop workflows with fewer Codex round trips. - vlad-terin/jev-use