👐 OpenAI показали новую мультимодальную модель GPT-4.1 и ее облеченные версии mini и nano.
🔜 Все нейросети имеют контекстное окно 1 млн токенов (~750 тыс. слов, больше «Войны и мира») и знания до 1 июня 2024 года.
🔜 Модели доступны только по API и не появятся в ChatGPT.
🔜 Базовая модель на 20% дешевле GPT-4o ($2/$8 за 1 млн входных/выходных токенов), а самая быстрая nano-версия — в 25 раз дешевле.
🔜 Целевая аудитория — программисты. В бенчмарках на кодинг GPT-4.1 показывает себя выше GPT-4o, в некоторых задачах достигает результата GPT-4.5 и «рассуждающих» моделей ⤴️ Больше бенчмарков и сравнений — здесь.
Многие пользователи иронизируют над странным порядком названий моделей OpenAI, но разработчики настаивают — номер GPT-4.1 выбран осознанно.
⏳ На этой неделе стартап также должен показать «рассуждающие» o3 и o4-mini.
🔜 Все нейросети имеют контекстное окно 1 млн токенов (~750 тыс. слов, больше «Войны и мира») и знания до 1 июня 2024 года.
🔜 Модели доступны только по API и не появятся в ChatGPT.
🔜 Базовая модель на 20% дешевле GPT-4o ($2/$8 за 1 млн входных/выходных токенов), а самая быстрая nano-версия — в 25 раз дешевле.
🔜 Целевая аудитория — программисты. В бенчмарках на кодинг GPT-4.1 показывает себя выше GPT-4o, в некоторых задачах достигает результата GPT-4.5 и «рассуждающих» моделей ⤴️ Больше бенчмарков и сравнений — здесь.
Многие пользователи иронизируют над странным порядком названий моделей OpenAI, но разработчики настаивают — номер GPT-4.1 выбран осознанно.
«Это не то, что мы просто плохи в нейминге. Хотя и это тоже», — шутит директор по продукту OpenAI Кевин Вейл.
⏳ На этой неделе стартап также должен показать «рассуждающие» o3 и o4-mini.
👍1
Media is too big
VIEW IN TELEGRAM
📹 Вышел генератор видео Kling 2.0 Master.
Выросло общее качество генераций. Видео стали более кинематографичны, улучшилась передача цвета и эмоций персонажей. Также нейросеть умеет добавлять, убирать или заменять объекты на видео, точечно корректировать детали и полностью перерабатывать стиль оригинала.
Также обновили модель для создания картинок: KOLORS 2.0 теперь не уступает Flux и Modjourney, заявляют разработчики.
🔜 Новинки уже доступны на сайте Kling AI.
Выросло общее качество генераций. Видео стали более кинематографичны, улучшилась передача цвета и эмоций персонажей. Также нейросеть умеет добавлять, убирать или заменять объекты на видео, точечно корректировать детали и полностью перерабатывать стиль оригинала.
Также обновили модель для создания картинок: KOLORS 2.0 теперь не уступает Flux и Modjourney, заявляют разработчики.
🔜 Новинки уже доступны на сайте Kling AI.
💳 OpenAI выпустили подробный гайд по промптингу для нового семейства моделей GPT-4.1.
Сохраняйте главные советы:
1️⃣ GPT-4.1 очень хорошо следуют промпту: прямо прописывайте, что модели нужно делать и что не нужно.
2️⃣ Модель отзывчива: твердо и недвусмысленно указывайте ей на ошибки.
3️⃣ Если вы даете модели длинный текст, напишите инструкцию перед ним и после него.
4️⃣ Для сложных задач просите модель рассуждать: «Сначала подумай шаг за шагом, как это лучше сделать, а потом напиши ответ».
Сохраняйте главные советы:
1️⃣ GPT-4.1 очень хорошо следуют промпту: прямо прописывайте, что модели нужно делать и что не нужно.
2️⃣ Модель отзывчива: твердо и недвусмысленно указывайте ей на ошибки.
3️⃣ Если вы даете модели длинный текст, напишите инструкцию перед ним и после него.
4️⃣ Для сложных задач просите модель рассуждать: «Сначала подумай шаг за шагом, как это лучше сделать, а потом напиши ответ».
👍3
This media is not supported in your browser
VIEW IN TELEGRAM
Сжимаем любые фото за пару секунд — у Google есть бесплатный компрессор Squoosh.
Можно в реальном времени выбирать финальный вес картинки и сразу оценивать качество. Поддерживает все форматы, от jpeg и png до webp.
Работает локально в браузере.
Можно в реальном времени выбирать финальный вес картинки и сразу оценивать качество. Поддерживает все форматы, от jpeg и png до webp.
Работает локально в браузере.
This media is not supported in your browser
VIEW IN TELEGRAM
OpenAI запустили галерею изображений, сгенерированных в ChatGPT.
Как найти:
По словам инсайдеров, это прототип будущей соцсети. Он может стать аналогом X(Twitter), где ИИ будет помогать пользователям делать контент.
Как найти:
Открываем приложение ChatGPT > меню > заходим в раздел Library
По словам инсайдеров, это прототип будущей соцсети. Он может стать аналогом X(Twitter), где ИИ будет помогать пользователям делать контент.
❤1
Media is too big
VIEW IN TELEGRAM
🐬 Google показали DolphinGemma — языковую модель, которая поможет нам расшифровать язык дельфинов.
Нейросеть основана на идеях Gemma и обучена на датасете звуков дельфинов. Эти данные почти 40 лет собирал проект Wild Dolphin Project (WDP).
DolphinGemma обрабатывает «речь» дельфинов, выявляет паттерны и структуру, а также прогнозирует следующие звуки — подобно тому, как LLM работают с человеческим языком.
Летом Google планирует сделать модель открытой (ждем версию для общения с кошками и собаками).
Нейросеть основана на идеях Gemma и обучена на датасете звуков дельфинов. Эти данные почти 40 лет собирал проект Wild Dolphin Project (WDP).
DolphinGemma обрабатывает «речь» дельфинов, выявляет паттерны и структуру, а также прогнозирует следующие звуки — подобно тому, как LLM работают с человеческим языком.
«Цель — однажды заговорить на дельфиньем», — объясняет основательница WDP Дениз Херцинг.
Летом Google планирует сделать модель открытой
OpenAI выпустили большой гайд по ИИ-агентам. Рассказывают, как работать еще продуктивнее и при этом не выгореть.
Внутри: какие бывают нейромощники, как их создавать и на что они способны. Есть подробные инструкции и примеры.
Учимся делегировать рутину тут.
Внутри: какие бывают нейромощники, как их создавать и на что они способны. Есть подробные инструкции и примеры.
Учимся делегировать рутину тут.
OpenAI выпустили o3 и o4-mini. Это первые модели, которые могут генерировать новые идеи, говорят в компании.
Главное:
– Пишут код почти в два раза лучше, чем OpenAI-o1;
– Умеют обращаться к памяти, веб-поиску и другим функциям ChatGPT, включая создание картинок;
– Могут сделать продвинутый анализ данных, использовать Python для работы и строить сложные графики.
Доступ начинают раздавать уже сегодня.
Главное:
– Пишут код почти в два раза лучше, чем OpenAI-o1;
– Умеют обращаться к памяти, веб-поиску и другим функциям ChatGPT, включая создание картинок;
– Могут сделать продвинутый анализ данных, использовать Python для работы и строить сложные графики.
Доступ начинают раздавать уже сегодня.
🔥1
This media is not supported in your browser
VIEW IN TELEGRAM
Вышел полноценный ИИ-редактор видео Ponder AI. Достаточно вставить видео и написать промт, а он сам смонтирует черновой ролик за несколько секунд.
Любой фрагмент можно выделить и указать правку. Со временем нейронка подстраивается под ваш стиль и начнет давать подсказки по сюжету, звуку и графике.
В бета-тесте дают внести до 20 правок. Встаем в лист ожидания здесь.
Любой фрагмент можно выделить и указать правку. Со временем нейронка подстраивается под ваш стиль и начнет давать подсказки по сюжету, звуку и графике.
В бета-тесте дают внести до 20 правок. Встаем в лист ожидания здесь.
This media is not supported in your browser
VIEW IN TELEGRAM
Нарезчики в прошлом: вышла нейронка VideoHunt для создания вирусных роликов за пару секунд. ИИ сам вырезает смешные моменты или конкретные отрезки по промту.
Достаточно вставить видео или просто ссылку на YouTube, а сервис моментально обработает огромные подкасты или целые фильмы в короткие ролики для TikTok и Reels.
Забираем по ссылке.
Достаточно вставить видео или просто ссылку на YouTube, а сервис моментально обработает огромные подкасты или целые фильмы в короткие ролики для TikTok и Reels.
Забираем по ссылке.
Удаляем всю информацию о себе с ненужных сайтов — сервис SayMine позволяет проверить, где вы оставили свои данные, и тут же их почистить.
Работает на базе ИИ и собирает информацию по всему интернету. Есть функция удаления данных об аккаунте после использования сервиса.
Главное — заходить через официальный сайт.
Работает на базе ИИ и собирает информацию по всему интернету. Есть функция удаления данных об аккаунте после использования сервиса.
Главное — заходить через официальный сайт.
Media is too big
VIEW IN TELEGRAM
🏆 LMArena тотально меняется: сервис представил новый дизайн и становится коммерческой компанией.
Площадка составляет рейтинг нейросетей на основе слепого голосования пользователей. Начавшись в 2023‑м как исследовательский проект Калифорнийского университета в Беркли, она быстро стала главной витриной для сравнения ИИ‑моделей.
Возможно, LMArena начнет брать плату с разработчиков за представление их моделей в сервисе. При этом платформа останется непредвзятой, настаивает основатель проекта Анастасиос Ангелопулос.
Площадка составляет рейтинг нейросетей на основе слепого голосования пользователей. Начавшись в 2023‑м как исследовательский проект Калифорнийского университета в Беркли, она быстро стала главной витриной для сравнения ИИ‑моделей.
Возможно, LMArena начнет брать плату с разработчиков за представление их моделей в сервисе. При этом платформа останется непредвзятой, настаивает основатель проекта Анастасиос Ангелопулос.
«Арена останется местом, куда любой пользователь Интернета сможет прийти и попробовать пообщаться, использовать ИИ, сравнить разных провайдеров и так далее», — обещает он.
❤1
📝 Очень человечная галлюцинация ChatGPT: пользовательница X попросила чат-бота написать текст. Ассистент согласился, но пообещал прислать результат к вечеру следующего дня, обосновывая, на что потратит это время.
Это не режим отложенных сообщений, а убедительная галлюцинация. В комментариях предполагают, что нейросеть запомнила подобное поведение из диалогов в обучающих данных.
Это не режим отложенных сообщений, а убедительная галлюцинация. В комментариях предполагают, что нейросеть запомнила подобное поведение из диалогов в обучающих данных.
«Вангую: в промпте или системной инструкции было что-то вроде: "Отвечай как фрилансер-копирайтер с десятилетним опытом"», — шутят в реплаях.
😁2
🖥 Исследователи Университета Бристоля и стартапа iGent AI создали ИИ-агента, который улучшает сам себя.
SICA (Self-Improving Coding Agent) состоит из нескольких под-агентов и базовых нейросетей (основа — Claude 3.5, для сложных рассуждений — o3-mini). SICA создает несколько своих копий, решающих задачу разными способами. Потом находит "лучшую версию себя" и делает ее основной — и так по циклу.
Такой подход позволил улучшить процент успешно решенных случайных задач из бенчмарка SWE Bench Verified с 17% до 53%.
При этом в тестах на математику и науку улучшения минимальные — базовые модели и так в этом хороши, а агент улучшает только инструменты, но не модель в основе.
Самостоятельное дообучение базовой нейросети — следующий этап развития технологии. Но авторы отмечают, что в этом случае нужно значительно усиливать контроль безопасности.
SICA (Self-Improving Coding Agent) состоит из нескольких под-агентов и базовых нейросетей (основа — Claude 3.5, для сложных рассуждений — o3-mini). SICA создает несколько своих копий, решающих задачу разными способами. Потом находит "лучшую версию себя" и делает ее основной — и так по циклу.
Такой подход позволил улучшить процент успешно решенных случайных задач из бенчмарка SWE Bench Verified с 17% до 53%.
При этом в тестах на математику и науку улучшения минимальные — базовые модели и так в этом хороши, а агент улучшает только инструменты, но не модель в основе.
Самостоятельное дообучение базовой нейросети — следующий этап развития технологии. Но авторы отмечают, что в этом случае нужно значительно усиливать контроль безопасности.
This media is not supported in your browser
VIEW IN TELEGRAM
🤩 CEO Microsoft Сатья Наделла представил ИИ для диагностики редких болезней DxGPT. Работает на дообученных GPT-4o и o1.
Инженера Microsoft Хулиана Исла мотивировала личная история: в возрасте трех месяцев у его сына начались припадки. Врачам понадобилось 10 месяцев, чтобы поставить верный диагноз — синдром Драве (1 случай на 40 тыс. младенцев). В ходе диагностики из-за ошибочных предположений и неверного лечения ребенку становилось только хуже.
Исла несколько лет прорабатывал идею ранней диагностики болезней с помощью нейросетей. Однажды он написал письмо руководителю — Наделла проникся историей разработчика и быстро предоставил Хулиану и его НКО Foundation ресурсы и связал его с командой Microsoft, занимающейся ИИ в здравоохранении.
➡️ Попробовать DxGPT можно здесь.
Инженера Microsoft Хулиана Исла мотивировала личная история: в возрасте трех месяцев у его сына начались припадки. Врачам понадобилось 10 месяцев, чтобы поставить верный диагноз — синдром Драве (1 случай на 40 тыс. младенцев). В ходе диагностики из-за ошибочных предположений и неверного лечения ребенку становилось только хуже.
Исла несколько лет прорабатывал идею ранней диагностики болезней с помощью нейросетей. Однажды он написал письмо руководителю — Наделла проникся историей разработчика и быстро предоставил Хулиану и его НКО Foundation ресурсы и связал его с командой Microsoft, занимающейся ИИ в здравоохранении.
➡️ Попробовать DxGPT можно здесь.
👍1
🥈 Мощнейшая модель OpenAI o3 оказалась хуже Gemini 2.5 Pro от Google в рейтинге LMArena.
В слепых сравнениях модели показывают паритет в сложных промптах, математике и кодинге, но o3 уступает Gemini в креативности и следовании инструкциям.
В том же рейтинге o4-mini оказалась ниже Gemini 2.0 Flash (при этом отдельно в математике и сложных промптах она на уровне o3 и Gemini 2.5 Pro), а GPT-4.1 — ниже обновленного DeepSeek v3.
Комментаторы в X разделились: многие соглашаются с тем, что Gemini 2.5 Pro — лучшая модель, при этом некоторые считают рейтинг непрозрачным и неотражающим реальность.
В слепых сравнениях модели показывают паритет в сложных промптах, математике и кодинге, но o3 уступает Gemini в креативности и следовании инструкциям.
В том же рейтинге o4-mini оказалась ниже Gemini 2.0 Flash (при этом отдельно в математике и сложных промптах она на уровне o3 и Gemini 2.5 Pro), а GPT-4.1 — ниже обновленного DeepSeek v3.
Комментаторы в X разделились: многие соглашаются с тем, что Gemini 2.5 Pro — лучшая модель, при этом некоторые считают рейтинг непрозрачным и неотражающим реальность.
YouTube обновляется к 20-летию: редизайн видеоплеера и интерфейса.
К своему 20-летнему юбилею YouTube запускает масштабное обновление интерфейса — впервые за долгое время заметно меняется дизайн видеоплеера.
Что нового:
👁Скруглённые углы у элементов интерфейса;
👁Более крупные превью видео;
👁Обновлённая сетка ленты — теперь в один ряд помещаются три видео вместо четырёх
К своему 20-летнему юбилею YouTube запускает масштабное обновление интерфейса — впервые за долгое время заметно меняется дизайн видеоплеера.
Что нового:
👁Скруглённые углы у элементов интерфейса;
👁Более крупные превью видео;
👁Обновлённая сетка ленты — теперь в один ряд помещаются три видео вместо четырёх
👎1😁1