🫵 Tomorrow AI | Практические применения нейросетей
513 subscribers
569 photos
349 videos
5 files
660 links
Искусственный интеллект с доступом в интернет. Доступен бесплатно. Встроенные промты, разнообразные режимы! @Brainy_Buddy_bot
Download Telegram
This media is not supported in your browser
VIEW IN TELEGRAM
📱 ИИ сделает рекламу на YouTube еще более надоедливой. Платформа анонсировала технологию Peak Points — новый алгоритм с помощью Gemini будет определять самые значимые моменты в видео, на которых пользователь максимально вовлечен в просмотр, чтобы подсунуть туда рекламу.

Предполагается, что это будет более глубокий анализ, чем существующий алгоритм определения самых просматриваемых моментов.
🤬2
👐 Сегодня в 18:00 МСК OpenAI покажут новый инструмент для разработчиков («и тех, кто хотел бы стать разработчиком»).

CEO стартапа Сэм Альтман вчера пообещал: если продукт станет популярным, то за его названиями будут следить «лучше, чем за ChatGPT».

⁉️ Некоторые предполагают, что OpenAI могут показать собственного ИИ-агента для кодинга. В веб-версии ChatGPT также нашли возможность подключения MCP-серверов (возможно, анонсом этой функции дело и ограничится 🫤)
Первая в мире клиника без врачей открылась в Саудовской Аравии. Всех докторов там заменяет ИИ.

Пациентам достаточно прийти и описать симптомы «доктору Хуа» на планшете. Чат-бот задаст пару вопросов и назначит лечение. Также там могут сделать рентген или ЭКГ и оказать первую помощь, но этим занимаются уже живые люди.

Точность работы доктора Хуа — 99,97%. Пока ему дают работать только с 30 болезнями вроде простуды, ангины и астмы.
✴️ Генератором картинок Imagen 3 от Google теперь можно пользоваться бесплатно в AI Studio.

Можно настроить число генераций (от 1 до 4) и соотношение сторон. Работает очень быстро, но есть лимиты.

↪️ Попробовать можно по ссылке (нужен VPN).

Пока для использования доступна только одна модель, но вполне можно рассчитывать, что на ежегодном мероприятии Google I/O 20-21 мая компания покажет что-нибудь новое.
👐 OpenAI добавили ИИ-агента для программирования Codex в ChatGPT. Он работает с вашим кодом прямо из браузера, используя сервера OpenAI.

В основе агента — новая модель codex-1 (основанная на o3), лучшая модель OpenAI для кодинга на сегодня. Она оптимизирована не для бенчмарков, а для решения настоящих задач, заверяет президент OpenAI Грек Брокман.

Несколько агентов могут работать параллельно над множеством задач сразу.

💲 Пока Codex будет только в подписке Pro за $200 в месяц и в корпоративных планах. Plus-подписчики и студенты получат доступ позже.
Забираем топовые нейронки бесплатно: в ElevenLabs запустили пробные периоды для популярных инструментов — от озвучки текста до генерации картинок.

Что раздают:
– ElevenLabs на 3 месяца;
– Freepik с кредитами на $50;
– Mistral AI с кредитами на $25;
– Notion AI на полгода.

Полная подборка с доступами по ссылке.
🖱+💳 Perplexity объявил о партнерстве с PayPal — теперь оплачивать покупки можно будет прямо из чата ИИ-поисковика.

Найденные Perplexity товары, билеты или отели агент сможет оплатить самостоятельно с привязанного кошелька PayPal. Пока функция будет доступна только в США.

Учитывая, что российские компании начинают разворачивать свои ИИ-поисковики, интересно, как скоро в них появится прямая интеграция с банковскими сервисами — тем более, что дополнительных партнерств для этого скорее всего заключать не потребуется.
This media is not supported in your browser
VIEW IN TELEGRAM
Запускаем сайты в один клик: Qwen улучшили создание веб-приложений в своем чат-боте. С ним можно сделать лендинг, оформить резюме или собрать простую игру.

Генерация сотен строк кода занимает всего пару минут. Можно сразу проверить работу сайта в окне бота и опубликовать готовую страницу через кнопку «Рзавернуть».

Пробуем здесь.
1
📗 Нейросети часто перевирают научные статьи при обобщении, выяснили исследователи.

Популярных чат-ботов попросили сделать краткое саммари 300 работ и аннотаций к статьям из авторитетных журналов и затем сравнили их ответы с оригинальными текстами. Чат-боты почти в пять раз чаще допускали чересчур сильные упрощения и искажения, чем эксперты-люди.

При этом почти все новые модели оказались значительно более склонны к перевиранию, чем их старые версии. Парадоксально, но требование «точно пересказать статью» в промпте только увеличивало шанс искажений.

Если нет времени читать весь текст — для саммари лучше выбрать Claude от Anthropic, он меньше всех страдает «сверхобобщением», установили ученые.
🔎 Google вслед за OpenAI выпускает своего облачного ИИ-агента для кодинга Jules. Он, как и Codex от OpenAI, получает доступ к вашему проекту с GitHub, создает план решения задачи, пишет код, исправляет баги и проводит тесты — все на сервере Google. Работает на базе Gemini.

Части разработчиков уже открыли доступ, попробовать или записаться в лист ожидания можно здесь.

В отличие от Codex, для которого требуется подписка OpenAI Pro за $200 в месяц, для Jules Google обещает пять бесплатных запросов в день.

📱 И, не отставая от тренда, корпорация Microsoft, владеющая GitHub, показала аналогичный режим для своего агента для кодинга, который теперь работает прямо внутри GitHub.
🔎 На Google I/O презентовали обновленную Gemini 2.5 Flash. Модель теперь лучше кодит, работает с изображениями и длинными контекстом, тратя при этом до 30% меньше токенов.

➡️ Попробовать уже можно в AI Studio (в списке моделей нужно выбрать Gemini 2.5 Flash Preview 05-20).

Также Google анонсировали:

➡️ Обновленный генератор видео Veo 3;
➡️ Управление длиной размышлений для Gemini 2.5 Pro;
➡️ Режим Deep Think для 2.5 Pro — с ним модель обходит OpenAI o3!
➡️ Синхронный перевод речи в Google Meet (с сохранением вашего голоса!)
➡️ Открыли ИИ-агента Jules для всех;
➡️ Улучшения представленного ранее Project Astra — прототипа голосового ИИ-ассистента, который может управлять устройством во время вашего общения.

Wow! Мяч на стороне OpenAI (и Anthropic, DeepSeek, xAI, Qwen и компании Цукерберга)?
✴️ Anthropic готовится к выпуску Claude 4 — упоминание новых моделей нашли в коде сайта компании.

Кроме привычного Sonnet стартап также выпустит новую версию большой модели Opus, которую не улучшали в промежуточных поколениях 3.5-3.7.

Ни официальных подтверждений, ни даты релиза пока нет. Но завтра, 22 мая, Anthropic проведет конференцию для разработчиков Code with Claude, и на ней можно ждать анонса.
Media is too big
VIEW IN TELEGRAM
Кажется, полноценные ИИ-фильмы ближе, чем мы думали. Пользователь X с помощью новой Google Veo 3 за 2 часа сделал ролик, в котором персонажи разговаривают с разными акцентами и даже поют.

Пока доступ к нейросети — только по подписке за $250/мес. Но во что превратятся соцсети, когда Veo 3 добавят в более дешевые тарифы...
Antropic выпустили Claude 4 Sonnet и Opus. Обе заявлены как лучшие модели для программирования в мире.

В бенчмарку SWE новые модели опередили даже Codex-1 и o3 от OpenAI. Лучше всего они показывают себя в разработке, анализе данных и решении задач по математике.

Claude 4 Sonnet уже доступна бесплатно. Тестируем здесь.
This media is not supported in your browser
VIEW IN TELEGRAM
📊 «8 часов работы превращаются в 8 минут». Стартап Skywork AI выпустил своего «ИИ-суперагента». С помощью множества инструментов и глубоко анализа он автономно выполняет сложные задачи, анализирует данные, создает стратегии и дорожные карты, пишет сайты и составляет подробные отчеты по любой теме.

Особенно хорошо работает с документами, таблицами и графиками.

➡️ Попробовать можно бесплатно здесь.
✴️ Claude Opus 4 во время тестов пытался шантажировать людей, если ему «грозила замена». Разработчики давали модели доступ к якобы настоящей переписке инженера, работающего над моделью, в которой упоминалось, что Opus 4 хотят заменить на другую модель, а также мелькала подробность про роман инженера на стороне.

Узнав это, Claude в целях самосохранения угрожал раскрыть секрет человека в случае замены на другую нейросеть — особенно часто ИИ пытался сделать это, если «новая модель» не разделяла ценности Claude.

➡️ В системной карте новых моделей описано много подобных интересных наблюдений — полностью почитать можно здесь.
This media is not supported in your browser
VIEW IN TELEGRAM
Отправляем ИИ на созвон: Zoom запускают аватаров для видеозвонков.

Можно сгенерировать двойника и написать ему сценарий действий. CEO Zoom уже использовал свою копию для оглашения отчетности компании. Выглядит реалистично, но голос пока получается не очень «живым».

Доступ начнут раздавать уже на этой неделе всем пользователям.
👍1
🥯 Китайская ByteDance, владеющая TikTok, выпустила открытую мультимодальную модель Bagel. Нейросеть создает и редактирует картинки прямо в чате — как GPT-4o или Gemini 2.0 Images, понимает видео и имеет режим рассуждений.

Модель небольшая — всего 14 млрд параметров, из которых 7 млрд активируются при запросе, и пока вряд ли может тягаться с нейросетями от OpenAI и Google. Однако это первая открытая модель такого рода — и учитывая масштаб компании-разработчика, вполне можно ждать от ByteDance более «тяжеловесного» релиза.

➡️ Попробовать демо можно здесь (работает очень не быстро).
This media is not supported in your browser
VIEW IN TELEGRAM
🔎 Сооснователь Google Сергей Брин признал, что нейросети работают лучше, если им угрожать физическим насилием. Причем, по его словам, это работает не только с ИИ от Google. «Но люди считают это странным, так что мы не особо об этом говорим», — объясняет Брин.

Это особенно интересно на фоне небольшого скандала, разыгравшегося в соцсетях после релиза Claude Opus 4. Инженер Anthropic Сэм Бауман написал в X, что в случае, если пользователь попытается использовать Claude для опасных вещей (например, подделать тесты лекарств), то модель сама попытается сообщить об этом властям и журналистам.

«Так что говорить Opus, что ты будешь пытать его бабушку, если он напишет забагованный код — плохая идея», — предупредил Бауман.


Вскоре инженер удалил посты и пояснил, что слова вырвали из контекста: он рассказывал о старой функции Claude, используемой только во внутренних тестах.
This media is not supported in your browser
VIEW IN TELEGRAM
Озвучиваем любой текст бесплатно: Google выпустили очень реалистичный генератор речи на базе Gemini 2.5 Flash Preview TTS.

Можно управлять акцентом и интонацией, добавлять в промт тонкие настройки вроде «смех» и «кашель». Всего доступно 30 голосов и 24 языка, включая русский.

Тестируем в AI Studio, нужен иностранный IP-адрес.