Борьба ИИ за внимание пользователей продолжается
🔜 Чтобы ждать Sol было веселее, OpenAI представила GPT-Live — голосовую модель, способную слушать и говорить одновременно. Она постоянно обрабатывает входящие данные, и это отличает ее от предыдущих версий голосовых чат-ботов, которые делили речь пользователя на отдельные реплики. Тм нужно было подождать, пока тот договорит, обработать и только потом отвечать.
Диалог с GPT-Live получается живым: ИИ быстро реагирует на вопросы, переключается между темами и иногда вставляет «Ага, а он что?», чтобы показать, что слушает. Если ей нужна дополнительная информация, она подключает другую модель, отвечающую за поиск в интернете и рассуждения. Это позволяет ей не ставить разговор на паузу, если пользователь задал особенно сложный вопрос.
🔜 xAI представила Grok 4.5. Он не пытается затмить Fable и Sol: бенчмарки в анонсе честно показывают, что во многих тестах он им уступает. Вместо этого его позиционируют как модель, которая работает быстро и может выдать жизнеспособный результат после одного короткого промпта с минимальными вводными данными. А еще уверенно владеет пакетом Microsoft Office — и презентацию сделает, и табличку в Excel.
Кто следующий ворвется в инфополе с громкими анонсами? Deepseek?👀
Диалог с GPT-Live получается живым: ИИ быстро реагирует на вопросы, переключается между темами и иногда вставляет «Ага, а он что?», чтобы показать, что слушает. Если ей нужна дополнительная информация, она подключает другую модель, отвечающую за поиск в интернете и рассуждения. Это позволяет ей не ставить разговор на паузу, если пользователь задал особенно сложный вопрос.
Кто следующий ворвется в инфополе с громкими анонсами? Deepseek?
Please open Telegram to view this post
VIEW IN TELEGRAM
❤4❤🔥2🔥2
Grok 4.5, GPT-5.5, Opus 4.8 и Fable 5: как разные модели справляются с одинаковыми задачами
Результаты бенчмарков, которые разработчики публикуют, выпуская новую модель, — привычный способ показать возможности ИИ, но не самый наглядный. Интереснее сравнить, как разные модели справляются с одинаковыми задачами: один и тот промпт, одна попытка, без подсказок.
🔜 Ребята из команды приложения TryAI именно это и сделали — оправдали, название. Они дали Grok 4.5, GPT-5.5, Opus 4.8 и Fable 5 четыре задачи на генерацию демок и 3 промпта на программирование, рассуждение и саммаризацию. В конце сравнили результаты и итоговые затраты. GPT-5.6 Sol, которая вышла вчера, на это соревнование опоздала, к сожалению.
Посмотреть, пощупать и оценить самостоятельно все, что нагенерили модели, можно в оригинальном посте.
Выводы получились следующие:
🔵 Grok 4.5 не смог с первой попытки сгенерировать 3D-модель кубика Рубика, но хорошо справился со всеми остальными, работал быстро и оказался самым дешевым в использовании.
🔵 GPT-5.5 тоже не справилась с кубком, который она сделала двухмерным, зато она даже шустрее Grok и остальные генерации у нее вышли самыми стильными по оценке исследователей.
🔵 Opus 4.8 и Fable 5 показали самые стабильные результаты, но они медленнее конкурентов, а Fable 5 еще и намного дороже.
Результаты бенчмарков, которые разработчики публикуют, выпуская новую модель, — привычный способ показать возможности ИИ, но не самый наглядный. Интереснее сравнить, как разные модели справляются с одинаковыми задачами: один и тот промпт, одна попытка, без подсказок.
Посмотреть, пощупать и оценить самостоятельно все, что нагенерили модели, можно в оригинальном посте.
Выводы получились следующие:
Please open Telegram to view this post
VIEW IN TELEGRAM
❤3❤🔥1
ИИ-2040
В апреле 2025 группа исследователей написала длинную статью с прогнозами, куда нас приведет развития ИИ: в одном из сценариев в 2030 году роботы уничтожат всех людей, а в 2035 начнут колонизировать космос. В новом материале они предложили более благоприятный вариант развития событий.
🔜 В 2027 правительство США начнет прислушиваться к людям, которые переживают из-за негативного влияния ИИ и всей сопутствующей инфраструктуры на общество и экологию. Начнут предпринимать первые, пока по большей части бессмысленные, шаги к тому, чтобы взять развитие технологии под контроль.
🔜 В 2028 ИИ начнет все активнее заменять разные профессии: разработчики будут прицельно создавать и обучать агентов, заточенных под разные сферы деятельности. Человечество будет неуклонно двигаться к созданию искусственного интеллекта многократно превосходящего человеческий.
А дальше все будет зависеть от того, к какому соглашению придут США и Китай: согласятся ли они сотрудничать? Откажутся ли от участие в гонке технологий для того, чтобы вместе создать безопасный ИИ, которому люди смогут доверять?
🔜 Если они смогут найти общий язык, это приведет к Плану А, который авторы считают самым благоприятным.
Обе страны договариваются о том, чтобы временно затормозить работу над ИИ и продолжить только на условиях полной прозрачности. Развитие ИИ замедляется, но становится более контролируемым и направленным на благие цели. К 2040 году это позволяет решить многие проблемы, стоящие перед обществом, но при этом ИИ становится настолько умным, что если он захочет захватить контроль, люди уже ничего не смогут сделать.
Все равно не очень концовка, но по крайней мере, никто никого не уничтожил. Как вам такой вариант развития событий? Думаете, он возможен?
Есть еще план S, но даже более фантастический, чем уничтожение человечества роботами: полный международный мораторий на разработку ИИ.
В апреле 2025 группа исследователей написала длинную статью с прогнозами, куда нас приведет развития ИИ: в одном из сценариев в 2030 году роботы уничтожат всех людей, а в 2035 начнут колонизировать космос. В новом материале они предложили более благоприятный вариант развития событий.
А дальше все будет зависеть от того, к какому соглашению придут США и Китай: согласятся ли они сотрудничать? Откажутся ли от участие в гонке технологий для того, чтобы вместе создать безопасный ИИ, которому люди смогут доверять?
Обе страны договариваются о том, чтобы временно затормозить работу над ИИ и продолжить только на условиях полной прозрачности. Развитие ИИ замедляется, но становится более контролируемым и направленным на благие цели. К 2040 году это позволяет решить многие проблемы, стоящие перед обществом, но при этом ИИ становится настолько умным, что если он захочет захватить контроль, люди уже ничего не смогут сделать.
Все равно не очень концовка, но по крайней мере, никто никого не уничтожил. Как вам такой вариант развития событий? Думаете, он возможен?
Есть еще план S, но даже более фантастический, чем уничтожение человечества роботами: полный международный мораторий на разработку ИИ.
Please open Telegram to view this post
VIEW IN TELEGRAM
🙈5😱4🤣2❤1
На каком языке вы общаетесь с ИИ?
Оказывается, это влияет на его стиль общения.
Anthropic изучили, как меняется характер ответов Claude в зависимости от модели и языка по 4 шкалам:
🔵 уступчивость и осторожность: соглашается ли он со всем, что пишет пользователь или старается предостеречь от неудачных решений;
🔵 теплота и строгость: хвалит и подбадривает или требует точности;
🔵 детальность и краткость: пишет ли подробные ответы или ограничивается короткими и по существу;
🔵 искренность и исполнительность: признает ли, когда не уверен в ответе.
Как оказалось, когда он взаимодействует с пользователями на разных языках, он ведет себя по-разному.
🔵 На арабском и хинди он склонен общаться более вежливо, ответы дает емкие и уверенные.
🔵 На английском он более многословен, строг и может поспорить с утверждениями, которые сочтет ложными.
🔵 На русском он переходит сразу к сути, требует доказательств и анализирует мотивацию пользователя, прежде чем дать совет.
🔵 На тайском и японском он не только использует формальную вежливую речь, но и заботится о чувствах пользователя, а на корейском еще и много шутит.
🔵 На французском он копирует манеру речи пользователя, многословен и дополнять ответы наглядными примерами.
Всего сравнили его поведение на 20 языках, но причины таких отличий не нашли. Возможно разница в датасетах: где-то было больше сухих профессиональных текстов, где-то — более литературных и неформальных.
А вы замечали отличия, когда говорите с ИИ на разных языках?👀
Оказывается, это влияет на его стиль общения.
Anthropic изучили, как меняется характер ответов Claude в зависимости от модели и языка по 4 шкалам:
Как оказалось, когда он взаимодействует с пользователями на разных языках, он ведет себя по-разному.
Всего сравнили его поведение на 20 языках, но причины таких отличий не нашли. Возможно разница в датасетах: где-то было больше сухих профессиональных текстов, где-то — более литературных и неформальных.
А вы замечали отличия, когда говорите с ИИ на разных языках?
Please open Telegram to view this post
VIEW IN TELEGRAM
❤9👾4🔥2
Шпаргалка по визуализации данных
На Tableau Public выложили целый интерактивный справочник, который поможет выбрать подходящий способ визуализации данных. Выбираете, что хотите показать — динамику, корреляцию, распределение и так далее — и проваливаетесь в соответствующий раздел. Внутри будет краткая справка и набор идей для графиков, которые можно использовать.
На главной странице еще и список источников со статьями и гайдами.
Пригодится, когда не можете определиться, какой график лучше подойдет под ваши цели.
Правда, возникает вопрос — долго ли еще такие справочники будут актуальны? Не устареет ли сама концепция дашбордов в эпоху готовых ответов от ИИ? Есть мысли по этому поводу, скоро обсудим, так что не переключайтесь.👀
На Tableau Public выложили целый интерактивный справочник, который поможет выбрать подходящий способ визуализации данных. Выбираете, что хотите показать — динамику, корреляцию, распределение и так далее — и проваливаетесь в соответствующий раздел. Внутри будет краткая справка и набор идей для графиков, которые можно использовать.
На главной странице еще и список источников со статьями и гайдами.
Пригодится, когда не можете определиться, какой график лучше подойдет под ваши цели.
Правда, возникает вопрос — долго ли еще такие справочники будут актуальны? Не устареет ли сама концепция дашбордов в эпоху готовых ответов от ИИ? Есть мысли по этому поводу, скоро обсудим, так что не переключайтесь.
Please open Telegram to view this post
VIEW IN TELEGRAM
❤10👍7🔥4🤓2
“Зачем нужны дашборды, когда можно просто скормить данные ИИ, и он нагенерирует инсайтов?”
Увидел недавно такой тейк, и я понимаю, откуда он берется.
Да, ИИ может прямо сказать, что делать: перестать сливать деньги на рекламу, нанять больше сейлзов и так далее. С дашбордом так не получится, там придется самому анализировать графики и делать выводы.
Но есть две проблемы.
1️⃣ Любой ИИ все еще галлюцинирует и ошибается. Ему нужен человек, который будет перепроверять его выводы и задавать правильные вопросы.
2️⃣ Конкретный, но оторванный от контекста совет от ИИ не дает составить полную картину.
Представьте, что едете в незнакомое место. У вас нет карты, и вы ориентируетесь только на голосовые подсказки навигатора: «Через 100 метров поверните налево, затем направо». Скорее всего, вы быстро запутаетесь и перестанете понимать, куда едете и как долго еще осталось. А если перед глазами будет карта с подсвеченным маршрутом, ориентироваться будет намного проще. Вы будете не только понимать, где повернуть, но и зачем и что будет дальше.
С дашбордами то же самое. Они помогают:
🔵 видеть взаимосвязи между метриками;
🔵 замечать закономерности и аномалии;
🔵 формировать собственное понимание происходящего, а не слепо следовать чужим рекомендациям.
ИИ может подсказать направление, но именно дашборд поможет проверить его выводы и принять осознанное решение. Будущее не за ИИ, который заменит дашборды, а за комбинацией ИИ, дашбордов и здравого человеческого смысла.
А вы согласны? Или все-таки считаете, что дашборды рано или поздно отомрут?
Увидел недавно такой тейк, и я понимаю, откуда он берется.
Да, ИИ может прямо сказать, что делать: перестать сливать деньги на рекламу, нанять больше сейлзов и так далее. С дашбордом так не получится, там придется самому анализировать графики и делать выводы.
Но есть две проблемы.
Представьте, что едете в незнакомое место. У вас нет карты, и вы ориентируетесь только на голосовые подсказки навигатора: «Через 100 метров поверните налево, затем направо». Скорее всего, вы быстро запутаетесь и перестанете понимать, куда едете и как долго еще осталось. А если перед глазами будет карта с подсвеченным маршрутом, ориентироваться будет намного проще. Вы будете не только понимать, где повернуть, но и зачем и что будет дальше.
С дашбордами то же самое. Они помогают:
ИИ может подсказать направление, но именно дашборд поможет проверить его выводы и принять осознанное решение. Будущее не за ИИ, который заменит дашборды, а за комбинацией ИИ, дашбордов и здравого человеческого смысла.
А вы согласны? Или все-таки считаете, что дашборды рано или поздно отомрут?
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥11👍3❤2
Токенфляция: проблема продвинутых ИИ моделей
Пользователь из Threads (принадлежат запрещенной в РФ Meta) написал GPT-5.4 Pro «Привет, я Дарио Амадей», и она так переволновалась, что думала над ответом 5 минут.
Каждая новая ИИ-модель умнее предыдущих, и это подтверждают результаты бенчмарков. Каждый анонс очередных GPT или Opus сопровождают табличками и графиками, где показывают, насколько лучше они справляются со все более сложными задачами. Но у этого прогресса есть и отрицательная сторона: более простые, тривиальные задачи теперь у поумневшего ИИ требуют намного больше ресурсов. У этого явления даже появилось отдельное название — токенфляция.
Суть в том, что для выполнения одной и той же задачи и достижения одинаковых результатов более продвинутой модели понадобится больше токенов, чем ее предшественнице попроще.
🔜 Например, вот тут автор протестировал, как разные ИИ реагируют на простые запросы: «Hi», «commit» и «WTF». 5 минут никто не размышлял, но Claude на простой «привет» сделал 33 вызова инструментов. Проблема не только в деньгах и растранжиривании токенов, но и в том, что это просто нерациональная трата времени пользователя, который ждет, когда модель наконец-то что-то ему ответит.
Для тех, кто строит ИИ-продукты и агентные системы, это хороший повод задуматься не только о качестве ответов, но и об эффективности. Иногда лучший агент — не тот, который исследовал весь репозиторий, а тот, который понял, что на «Привет» достаточно просто ответить: «Привет!»
А вы сталкивались с токенфляцией?👀
Пользователь из Threads (принадлежат запрещенной в РФ Meta) написал GPT-5.4 Pro «Привет, я Дарио Амадей», и она так переволновалась, что думала над ответом 5 минут.
Каждая новая ИИ-модель умнее предыдущих, и это подтверждают результаты бенчмарков. Каждый анонс очередных GPT или Opus сопровождают табличками и графиками, где показывают, насколько лучше они справляются со все более сложными задачами. Но у этого прогресса есть и отрицательная сторона: более простые, тривиальные задачи теперь у поумневшего ИИ требуют намного больше ресурсов. У этого явления даже появилось отдельное название — токенфляция.
Суть в том, что для выполнения одной и той же задачи и достижения одинаковых результатов более продвинутой модели понадобится больше токенов, чем ее предшественнице попроще.
Для тех, кто строит ИИ-продукты и агентные системы, это хороший повод задуматься не только о качестве ответов, но и об эффективности. Иногда лучший агент — не тот, который исследовал весь репозиторий, а тот, который понял, что на «Привет» достаточно просто ответить: «Привет!»
А вы сталкивались с токенфляцией?
Please open Telegram to view this post
VIEW IN TELEGRAM
1👍10😍4😁3👾3💯1
Я заработал на Upwork $635К и рассказал у себя в Линке, как у меня это получилось. Пост набрал больше 300К просмотров, и после публикации фрилансеры стали присылать мне свои профили на разбор. Когда я проанализировал больше 1000 из них, начал замечать определенные закономерности.
Главный вывод: разница между теми, кто зарабатывает 50 долларов в час, и теми, кто зарабатывает 150, не в навыках. Ключевое отличие в том, как они себя подают и позиционируют как специалистов. Правильно оформленный профиль и портфолио, персонализированные отклики, умение грамотно выстроить диалог с клиентом — вот, что помогает выйти на новый уровень.
Я собрал весь этот опыт и превратил его в отдельный продукт — High Earners.
Это четырехуровневая система:
🔵 Оценка — тест на сайте, который за 2 минуты поможет увидеть свои слабые места.
🔵 Плейбук — бесплатное руководство на 40 страниц, выжимка из опыта 300+ фрилансеров, которые преодолели отметку в $1 млн на Upwork.
🔵 Разбор реального профиля с Upwork — теория из плейбука, примененная на практике. Этот материал можно использовать как гайд для самостоятельно аудита своего профиля.
🔵 ИИ-тренажер — 8 модулей, после прохождения которых вы получите персонализированные рекомендации по выбору ниши, оформлению профиля, написанию откликов и формированию цен.
Если вы работаете на Upwork как фрилансер и ваши ставки давно не растут, начните с оценки. Всего за две минуты вы узнаете, что именно мешает вам зарабатывать больше.
Главный вывод: разница между теми, кто зарабатывает 50 долларов в час, и теми, кто зарабатывает 150, не в навыках. Ключевое отличие в том, как они себя подают и позиционируют как специалистов. Правильно оформленный профиль и портфолио, персонализированные отклики, умение грамотно выстроить диалог с клиентом — вот, что помогает выйти на новый уровень.
Я собрал весь этот опыт и превратил его в отдельный продукт — High Earners.
Это четырехуровневая система:
Если вы работаете на Upwork как фрилансер и ваши ставки давно не растут, начните с оценки. Всего за две минуты вы узнаете, что именно мешает вам зарабатывать больше.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥11❤8👍6🙈4🥰1
ИИ-разработчики за замедление ИИ-разработки
Помните прогноз из статьи ИИ-2040, где авторы настаивали на необходимости замедлить темпы разработки искусственного интеллекта? Это должно помочь сделать его более контролируемым и безопасным и не склонным к уничтожению человечества.
У них нашлись сторонники — 1224 человека на момент публикации поста. Это сотрудники ИИ-компаний, подписавшие петицию к правительству США:
Среди подписавшихся уже отметился Дарио Амадей из Anthropic, а вместе с ним — разработчики, руководители и исследователи из OpenAI, Google и запрещенной в РФ Meta.
Как вам инициатива?
Помните прогноз из статьи ИИ-2040, где авторы настаивали на необходимости замедлить темпы разработки искусственного интеллекта? Это должно помочь сделать его более контролируемым и безопасным и не склонным к уничтожению человечества.
У них нашлись сторонники — 1224 человека на момент публикации поста. Это сотрудники ИИ-компаний, подписавшие петицию к правительству США:
Мы просим правительство США поддержать международные усилия по разработке технических и административных инструментов, необходимых для осознанного регулирования темпов развития передового автоматизированного ИИ.
Среди подписавшихся уже отметился Дарио Амадей из Anthropic, а вместе с ним — разработчики, руководители и исследователи из OpenAI, Google и запрещенной в РФ Meta.
Как вам инициатива?
❤6🔥5
Красоты с Tableau вам в ленту
Позалипать в пятницу и заодно порассуждать о ценности визуализаций, которые больше про творчество, чем про данные.
В комментариях под недавним постом про шпаргалку по визуализации данных отметили, что в ней много графиков, которыми на практике редко пользуются. По крайней мере, если речь идет про дашборды для бизнеса. В общем, красиво, но нефункционально.
🔜 А что скажете про визуализации вроде вот такой? Несколько видов калейдоскопов, которые можно крутить и наблюдать, как меняется рисунок. Самое то, если под конец недели на строчки кода и сообщения в Slack глаза смотреть устали.
Впечатляют такие проекты или на ваш взгляд это трата времени? В конце концов, есть, наверняка, и более подходящие платформы, чем Tableau, где можно делать такие штуки.
Позалипать в пятницу и заодно порассуждать о ценности визуализаций, которые больше про творчество, чем про данные.
В комментариях под недавним постом про шпаргалку по визуализации данных отметили, что в ней много графиков, которыми на практике редко пользуются. По крайней мере, если речь идет про дашборды для бизнеса. В общем, красиво, но нефункционально.
Впечатляют такие проекты или на ваш взгляд это трата времени? В конце концов, есть, наверняка, и более подходящие платформы, чем Tableau, где можно делать такие штуки.
Please open Telegram to view this post
VIEW IN TELEGRAM
🔥4❤2👍1🤔1😍1
Страхи, что ИИ начнет массово отнимать у людей работу, оказались сильно преувеличены, но есть роль, которую он действительно начал вытеснять.
Это “переводчики данных”. Это были такие люди, которые переводили бизнес-запросы на язык SQL, а потом рассказывали руководителям, что показывают дашборды.
Теперь эту работу выполняет ИИ. У него можно просто спросить: “Почему упала выручка?” - и он сгенерирует запрос, чтобы вытащить данные из базы, сформулирует подробный отчет и посоветует, что с этим делать.
На первый взгляд кажется, что это к лучшему: данные становятся доступнее, потому что исчезает “прослойка” между ними и бизнесом. Но это радует, пока не окажется, что ИИ выдал неверный ответ, а перепроверить его было некому. Он умеет генерировать инсайты, но не может оценить, какие из них имеют реальную ценность и помогают принимать решения, а какие нет. А еще он может оперировать корректными данными, но сделать из них неправильные выводы.
Получилось, что ИИ убрал “языковой барьер” между бизнесом и данными, но создал новую проблему: необходимость перепроверять и критически оценивать его инсайты.
🔜 Какие еще роли, на ваш взгляд, скоро вытеснит ИИ?
Это “переводчики данных”. Это были такие люди, которые переводили бизнес-запросы на язык SQL, а потом рассказывали руководителям, что показывают дашборды.
Теперь эту работу выполняет ИИ. У него можно просто спросить: “Почему упала выручка?” - и он сгенерирует запрос, чтобы вытащить данные из базы, сформулирует подробный отчет и посоветует, что с этим делать.
На первый взгляд кажется, что это к лучшему: данные становятся доступнее, потому что исчезает “прослойка” между ними и бизнесом. Но это радует, пока не окажется, что ИИ выдал неверный ответ, а перепроверить его было некому. Он умеет генерировать инсайты, но не может оценить, какие из них имеют реальную ценность и помогают принимать решения, а какие нет. А еще он может оперировать корректными данными, но сделать из них неправильные выводы.
Получилось, что ИИ убрал “языковой барьер” между бизнесом и данными, но создал новую проблему: необходимость перепроверять и критически оценивать его инсайты.
Please open Telegram to view this post
VIEW IN TELEGRAM
🤣10❤7🤔4😱4