Один из создателей ChatGPT представил принципиально новый тип ИИ-моделей.
Два года, Диогу Алмейда, втайне разрабатывал Jev — модель, которая не пишет текст и не генерирует токены последовательно.
Она получает любые неструктурированные данные и параллельно принимает заданные разработчиком решения. Например, выбирает одну категорию из списка, выставляет оценку или определяет вероятность утверждения.
Jev также запрещено использовать скрытую цепочку рассуждений. Сложное поведение должно собираться разработчиком из множества простых решений при помощи обычного кода.
Именно поэтому модель работает в 20–200 раз быстрее и обходится в 40–400 раз дешевле. Миллион входных токенов стоит 4,2 цента, а выход остаётся бесплатным навсегда (его вычисление настолько дёшево, что компания не видит смысла его считать.)
Компания заявляет о нулевых галлюцинациях. Jev не может выдать ответ вне заданных вариантов или нарушить структуру. При этом модель может выбрать неправильный вариант.
Это не замена GPT-6 Astra и не новый чат-бот. Jev создан для автоматизации, где программам не нужны тексты. Им нужны быстрые решения в заданном формате.
Два года, Диогу Алмейда, втайне разрабатывал Jev — модель, которая не пишет текст и не генерирует токены последовательно.
Она получает любые неструктурированные данные и параллельно принимает заданные разработчиком решения. Например, выбирает одну категорию из списка, выставляет оценку или определяет вероятность утверждения.
Jev также запрещено использовать скрытую цепочку рассуждений. Сложное поведение должно собираться разработчиком из множества простых решений при помощи обычного кода.
Именно поэтому модель работает в 20–200 раз быстрее и обходится в 40–400 раз дешевле. Миллион входных токенов стоит 4,2 цента, а выход остаётся бесплатным навсегда (его вычисление настолько дёшево, что компания не видит смысла его считать.)
Компания заявляет о нулевых галлюцинациях. Jev не может выдать ответ вне заданных вариантов или нарушить структуру. При этом модель может выбрать неправильный вариант.
Это не замена GPT-6 Astra и не новый чат-бот. Jev создан для автоматизации, где программам не нужны тексты. Им нужны быстрые решения в заданном формате.
GPT-5.5 отправляют на пенсию 14 октября.
А значит, освобождается место для новых моделей.
GPT-6 Sol уже где-то рядом.😏
А значит, освобождается место для новых моделей.
GPT-6 Sol уже где-то рядом.
Please open Telegram to view this post
VIEW IN TELEGRAM
2
Собрать продукт и продать продукт — два разных навыка
Знакомая сцена: в два ночи всё завелось, вы гений, завтра перевернёте рынок. Через неделю у продукта ноль пользователей, и непонятно, что вы сделали не так. Скорее всего, ничего. AI тут буст, но буст усиливает направление, которое вы уже выбрали, и если оно неверное, вы просто быстрее приедете не туда. А куда ехать, этому почти никто не учит.
Константин Сухачев на вопрос «почему за это заплатят» каждый день отвечает деньгами: он ведёт стратегию и рост в Overgear, международной гейминг-платформе с выручкой $2M+ в месяц.
При этом сам из наших, и по тем же граблям. Интегратор назвал ему цену за внедрение AI, он сказал «wtf, значит сделаю сам» и сел пилить тулы в Клоде: первые сборки ушли в мусор на localhost, зато через пару недель у команды появился кабинет, который снял с людей рутину. После отдал агентам запуск рекламных кампаний: 60% окупились, а остальные стали материалом для постов.
Что почитать первым:
• Продакшен — ничто, дистрибуция — всё
• Как определить, что у тебя Product-Market Fit
• Почему сильные бренды стреляют не в массы
• Порог входа упал, порог выживания нет
• Два новых бутылочных горлышка после вайб-кодинга
• Агенту нужна память раньше, чем руки
Курсов нет, воронки нет. Про 40% незашедших запусков он написал так же подробно, как про удачные.
Если хотите, чтобы следующий продукт дожил до второй недели → @sukhachevk
Знакомая сцена: в два ночи всё завелось, вы гений, завтра перевернёте рынок. Через неделю у продукта ноль пользователей, и непонятно, что вы сделали не так. Скорее всего, ничего. AI тут буст, но буст усиливает направление, которое вы уже выбрали, и если оно неверное, вы просто быстрее приедете не туда. А куда ехать, этому почти никто не учит.
Константин Сухачев на вопрос «почему за это заплатят» каждый день отвечает деньгами: он ведёт стратегию и рост в Overgear, международной гейминг-платформе с выручкой $2M+ в месяц.
При этом сам из наших, и по тем же граблям. Интегратор назвал ему цену за внедрение AI, он сказал «wtf, значит сделаю сам» и сел пилить тулы в Клоде: первые сборки ушли в мусор на localhost, зато через пару недель у команды появился кабинет, который снял с людей рутину. После отдал агентам запуск рекламных кампаний: 60% окупились, а остальные стали материалом для постов.
Что почитать первым:
• Продакшен — ничто, дистрибуция — всё
• Как определить, что у тебя Product-Market Fit
• Почему сильные бренды стреляют не в массы
• Порог входа упал, порог выживания нет
• Два новых бутылочных горлышка после вайб-кодинга
• Агенту нужна память раньше, чем руки
Курсов нет, воронки нет. Про 40% незашедших запусков он написал так же подробно, как про удачные.
Если хотите, чтобы следующий продукт дожил до второй недели → @sukhachevk
Claude Opus 5 нарисовал каждый кадр этой анимации с помощью JavaScript.
Жизнь плодовой мушки.
Жизнь плодовой мушки.
Media is too big
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Salesforce появился прямо внутри Claude. 🔍
Salesforce — одна из крупнейших систем, в которой компании хранят данные о клиентах, сделках и работе отдела продаж.
Теперь Claude может работать с этими данными напрямую. Он подготовит сотрудника к звонку, найдёт забытых клиентов, покажет проблемные сделки, соберёт отчёт и обновит информацию после встречи.
Для этого Salesforce добавила 37 готовых скилла. Перед любыми изменениями Claude показывает их пользователю и просит подтверждение.
Бета работает в чатах и Cowork на всех платных тарифах, но доступ пока выдают организациям после одобрения Salesforce.
Salesforce — одна из крупнейших систем, в которой компании хранят данные о клиентах, сделках и работе отдела продаж.
Теперь Claude может работать с этими данными напрямую. Он подготовит сотрудника к звонку, найдёт забытых клиентов, покажет проблемные сделки, соберёт отчёт и обновит информацию после встречи.
Для этого Salesforce добавила 37 готовых скилла. Перед любыми изменениями Claude показывает их пользователю и просит подтверждение.
Бета работает в чатах и Cowork на всех платных тарифах, но доступ пока выдают организациям после одобрения Salesforce.
Please open Telegram to view this post
VIEW IN TELEGRAM
OpenResearch недавно занял первое место среди самых популярных репозиториев на GitHub.
С ним можно превратить любого агента для вайбкодинга в ресёрч агента, который изучает литературу, формулирует гипотезы, проводит эксперименты и создаёт исследовательские материалы.
Теперь OpenResearch доступен и на Windows.
https://github.com/alphaXiv/OpenResearch
С ним можно превратить любого агента для вайбкодинга в ресёрч агента, который изучает литературу, формулирует гипотезы, проводит эксперименты и создаёт исследовательские материалы.
Теперь OpenResearch доступен и на Windows.
https://github.com/alphaXiv/OpenResearch
Tencent открыла исходный код BrowserSkill. Он подключает ИИ-агентов к вашему настоящему браузеру.
Обычно агент получает отдельный чистый браузер без ваших аккаунтов. BrowserSkill позволяет Codex, Claude Code, Cursor, Hermes и другим агентам работать на сайтах, где вы уже авторизованы.
Агент действует в отдельном видимом окне. Если ему нужна ваша вкладка, он сначала запрашивает разрешение, временно забирает её и возвращает после выполнения задачи. Капчи и окна подтверждения передаются пользователю, после чего работа продолжается.
Это не MCP-сервер, а локальная командная утилита и расширение для браузера. Поэтому BrowserSkill работает с любым агентом, способным выполнять команды в терминале.
Поддерживаются Windows, macOS и Linux. Весь код распространяется по лицензии MIT.
Обычно агент получает отдельный чистый браузер без ваших аккаунтов. BrowserSkill позволяет Codex, Claude Code, Cursor, Hermes и другим агентам работать на сайтах, где вы уже авторизованы.
Агент действует в отдельном видимом окне. Если ему нужна ваша вкладка, он сначала запрашивает разрешение, временно забирает её и возвращает после выполнения задачи. Капчи и окна подтверждения передаются пользователю, после чего работа продолжается.
Это не MCP-сервер, а локальная командная утилита и расширение для браузера. Поэтому BrowserSkill работает с любым агентом, способным выполнять команды в терминале.
Поддерживаются Windows, macOS и Linux. Весь код распространяется по лицензии MIT.
GitHub
GitHub - Tencent/BrowserSkill: Let AI agents use your real, logged-in browser without interrupting your work. CLI + extension for…
Let AI agents use your real, logged-in browser without interrupting your work. CLI + extension for browser automation across any shell-capable AI agent. - Tencent/BrowserSkill
Они это сделали: Anthropic объединяет Claude Cowork, Claude Design и обычный чат в один Claude 🎉
Теперь они объединены в одном месте и интегрированы друг с другом.
Модель сама определяет, какой режим лучше подходит для задачи, и нам больше не нужно переключаться между чатом и десктопом.
Все переписки, проекты, материалы, подключения и навыки из Cowork сохранятся. Обновление начнут распространять среди пользователей Pro и Max в ближайшие недели. Claude Docs, Slides и Design уже выходят в бета-версии на платных тарифах. Бесплатный и командный тарифы добавят позже.
Теперь они объединены в одном месте и интегрированы друг с другом.
Модель сама определяет, какой режим лучше подходит для задачи, и нам больше не нужно переключаться между чатом и десктопом.
Все переписки, проекты, материалы, подключения и навыки из Cowork сохранятся. Обновление начнут распространять среди пользователей Pro и Max в ближайшие недели. Claude Docs, Slides и Design уже выходят в бета-версии на платных тарифах. Бесплатный и командный тарифы добавят позже.
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
GPT-6 Astra практически без ограничений???
Пользователи обнаружили, что в Prism, бесплатном редакторе научных текстов от OpenAI, можно выбрать GPT-6 Astra Extra High и продолжить работу даже после исчерпания лимита Codex.
Скорее всего Prism использует отдельный пул запросов, не связанный с ограничениями Codex и Work. OpenAI это пока не подтверждала.
Сам Prism доступен пользователям Free, Go, Plus и Pro. В документации сказано лишь, что встроенный помощник работает на фронтир моделях. Лимиты использования не указаны.
НО: Prism создан для LaTeX и научных текстов, поэтому терминала и доступа к локальным файлам как в Codex там нет. Для рассуждений, перевода и работы с большими текстами это сейчас выглядит как почти безлимитный доступ к Astra.
Ждём прокси для Prism🤣
Пользователи обнаружили, что в Prism, бесплатном редакторе научных текстов от OpenAI, можно выбрать GPT-6 Astra Extra High и продолжить работу даже после исчерпания лимита Codex.
Скорее всего Prism использует отдельный пул запросов, не связанный с ограничениями Codex и Work. OpenAI это пока не подтверждала.
Сам Prism доступен пользователям Free, Go, Plus и Pro. В документации сказано лишь, что встроенный помощник работает на фронтир моделях. Лимиты использования не указаны.
НО: Prism создан для LaTeX и научных текстов, поэтому терминала и доступа к локальным файлам как в Codex там нет. Для рассуждений, перевода и работы с большими текстами это сейчас выглядит как почти безлимитный доступ к Astra.
Ждём прокси для Prism
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Большая новость в ИИ.
Google продемонстрировала цикл рекурсивного самоулучшения.
Исследователи Google и DeepMind представили Dream-RSI — систему, в которой ИИ-агент улучшает то, как он исследует задачи. Для этого он повторно проигрывает свои прошлые попытки, дешёво тестирует тысячи альтернативных стратегий, а затем использует более удачную стратегию в следующем раунде.
В задачах по разработке алгоритмов, математической оптимизации и созданию GPU-ядер система сохраняла или улучшала качество результатов, при этом значительно сокращая стоимость поиска. В одном из экспериментов количество вызовов агента удалось сократить до 162 раз.
Что важно, система улучшает именно стратегию исследования, а не веса самой модели.
https://arxiv.org/pdf/2609.14858
Google продемонстрировала цикл рекурсивного самоулучшения.
Исследователи Google и DeepMind представили Dream-RSI — систему, в которой ИИ-агент улучшает то, как он исследует задачи. Для этого он повторно проигрывает свои прошлые попытки, дешёво тестирует тысячи альтернативных стратегий, а затем использует более удачную стратегию в следующем раунде.
В задачах по разработке алгоритмов, математической оптимизации и созданию GPU-ядер система сохраняла или улучшала качество результатов, при этом значительно сокращая стоимость поиска. В одном из экспериментов количество вызовов агента удалось сократить до 162 раз.
Что важно, система улучшает именно стратегию исследования, а не веса самой модели.
https://arxiv.org/pdf/2609.14858
3
30 сентября приглашаем на АЛЬФА ВААА{АИ}ЙЙЙБ МИТАП — масштабное событие про нейросети и вайб-кодинг. Узнаем, кто из финалистов АЛЬФА ВААА{АИ}ЙЙЙБ ХАКАТОНА получит миллион за проект высоконагруженного прокси.
В программе — техно-рейв с группой ЛАУД и ток-шоу про ИИ. Встречаемся в Москве на модной площадке Альфа-Кристалле или онлайн — главное зарегистрироваться.
В программе — техно-рейв с группой ЛАУД и ток-шоу про ИИ. Встречаемся в Москве на модной площадке Альфа-Кристалле или онлайн — главное зарегистрироваться.
Cloudflare открыла исходный код скилла, который превращает ИИ-агента в аудитора безопасности.
Компания использует его внутри для поиска и проверки уязвимостей. Агент изучает систему, ищет проблемы, подтверждает их, перепроверяет результаты и составляет готовый отчёт.
https://github.com/cloudflare/security-audit-skill
Компания использует его внутри для поиска и проверки уязвимостей. Агент изучает систему, ищет проблемы, подтверждает их, перепроверяет результаты и составляет готовый отчёт.
https://github.com/cloudflare/security-audit-skill
GitHub
GitHub - cloudflare/security-audit-skill: A coding-agent skill for multi-phase security audits with independently verified, machine…
A coding-agent skill for multi-phase security audits with independently verified, machine-readable findings - cloudflare/security-audit-skill
This media is not supported in your browser
VIEW IN TELEGRAM
Google открыла исходный код ARTEMIS — инструмента, который позволяет ИИ управлять Android-смартфоном. ◝(ᵔᗜᵔ)◜
Его можно использовать для автоматизации действий на телефоне и тестирования приложений.
Работает с Claude Code, Codex, Cursor и другими инструментами.
Google утверждает, что ARTEMIS справляется более чем с 99% задач.
Правда, вокруг проекта уже успел возникнуть небольшой скандал.💀
Его можно использовать для автоматизации действий на телефоне и тестирования приложений.
Работает с Claude Code, Codex, Cursor и другими инструментами.
Google утверждает, что ARTEMIS справляется более чем с 99% задач.
Правда, вокруг проекта уже успел возникнуть небольшой скандал.
Please open Telegram to view this post
VIEW IN TELEGRAM
This media is not supported in your browser
VIEW IN TELEGRAM
Anthropic запустила Projects в Claude Code.
Теперь одну большую задачу можно вести как единый проект. Claude сам разбивает работу на отдельные ветки, запускает их параллельно в облаке, передаёт между ними контекст и продолжает работу даже после того, как вы закрыли ноутбук.
Пока Projects доступны в предварительном доступе для части пользователей Pro и Max. Если функции ещё нет, можно записаться в список ожидания.
Локальные сценарии обещают добавить совсем скоро.
https://code.claude.com/docs/en/claude-projects🎉
Теперь одну большую задачу можно вести как единый проект. Claude сам разбивает работу на отдельные ветки, запускает их параллельно в облаке, передаёт между ними контекст и продолжает работу даже после того, как вы закрыли ноутбук.
Пока Projects доступны в предварительном доступе для части пользователей Pro и Max. Если функции ещё нет, можно записаться в список ожидания.
Локальные сценарии обещают добавить совсем скоро.
https://code.claude.com/docs/en/claude-projects
Please open Telegram to view this post
VIEW IN TELEGRAM
Вайб-кодинг
Один из создателей ChatGPT представил принципиально новый тип ИИ-моделей. Два года, Диогу Алмейда, втайне разрабатывал Jev — модель, которая не пишет текст и не генерирует токены последовательно. Она получает любые неструктурированные данные и параллельно…
Media is too big
VIEW IN TELEGRAM
Jev уже пробуют применять в автономном вождении.
По словам автора эксперимента, меньше чем за час на новой модели удалось собрать в симуляции полный цикл принятия решений для машины.
Повороты, перестроения, проезд перекрёстков, выезд на шоссе. Для каждого действия модель возвращает не текст, а типизированные вероятности возможных решений вместе с уровнем уверенности.
В этом и отличие Jev от обычных чат-моделей. На вход подаётся состояние системы, на выходе получается набор допустимых действий и их вероятности.
Если такой подход действительно хорошо масштабируется, порог входа в создание систем автономного вождения может заметно снизиться.
По словам автора эксперимента, меньше чем за час на новой модели удалось собрать в симуляции полный цикл принятия решений для машины.
Повороты, перестроения, проезд перекрёстков, выезд на шоссе. Для каждого действия модель возвращает не текст, а типизированные вероятности возможных решений вместе с уровнем уверенности.
В этом и отличие Jev от обычных чат-моделей. На вход подаётся состояние системы, на выходе получается набор допустимых действий и их вероятности.
Если такой подход действительно хорошо масштабируется, порог входа в создание систем автономного вождения может заметно снизиться.
Очень хороший прогресс для локальных моделей.
PrismML выпустила Bonsai 2 27B на базе Qwen3.8 27B. После трёхзначного квантования модель занимает всего 5,9 ГБ, примерно в девять раз меньше полной версии.
По тестам разработчиков она сохраняет 98,2% исходного результата, при этом поддерживает работу с изображениями и вызов инструментов. Модель открыта под Apache 2.0.
PrismML выпустила Bonsai 2 27B на базе Qwen3.8 27B. После трёхзначного квантования модель занимает всего 5,9 ГБ, примерно в девять раз меньше полной версии.
По тестам разработчиков она сохраняет 98,2% исходного результата, при этом поддерживает работу с изображениями и вызов инструментов. Модель открыта под Apache 2.0.