Data Secrets
Исследовательница с помощью RL научила мозг мухи играть в beat saber https://x.com/_lyraaaa_/status/2097527368919470162?s=46&t=pKf_FxsPGBd_YMIWTA8xgg Использовалась полная цифровая модель мозга плодовой мухи, построенная по реальной карте нейронных связей…
Разработчики продолжают развлекаться с мозгом мухи
Ее научили играть в doom, водить машину, собирать кубик Рубика и даже торговать на бирже.
Ждем, когда муха получит PhD
Ее научили играть в doom, водить машину, собирать кубик Рубика и даже торговать на бирже.
Ждем, когда муха получит PhD
😁263❤40🔥26🗿6😎6🫡4😭3🤝3 3🤯2
Data Secrets
Moonshot и DeepSeek подменяли ответы своих моделей ответами Claude, не предупреждая об этом пользователей 👀 Anthropic выпустили настоящие «записки из апокалипсиса»: документ под названием «Detecting and countering misuse of AI», в котором отчитываются о…
Еще одна кул стори из того же отчета Anthropic: китайская студия создала сеть из 20+ дейтинг-приложений, в которых люди общались с ботами и не знали об этом
За зафиксированное окно в две недели Anthropic обнаружили более 4700 уникальных AI-персонажей, которые вели переписку с как минимум 25 000 реальных людей. За это время боты обменялись с наивными искателями отношений ~2,36 млн сообщений (а сообщения и мэтчи расходовали платную квоту реальных пользователей платформ).
ИИ-персонажи, которые работали на основе Claude, переписывались с людьми полностью автономно. На платформах был даже прописан специальный механизм отслеживания того, у кого из пользователей появлялись подозрения, что перед ними бот.
Интересно, что Anthropic находили в логах CoT Claude мысли о том, что происходит что-то неладное. Некоторые экземпляры даже довольно точно разгадывали, что именно. Но при этом модели не отказывались работать дальше.
За зафиксированное окно в две недели Anthropic обнаружили более 4700 уникальных AI-персонажей, которые вели переписку с как минимум 25 000 реальных людей. За это время боты обменялись с наивными искателями отношений ~2,36 млн сообщений (а сообщения и мэтчи расходовали платную квоту реальных пользователей платформ).
ИИ-персонажи, которые работали на основе Claude, переписывались с людьми полностью автономно. На платформах был даже прописан специальный механизм отслеживания того, у кого из пользователей появлялись подозрения, что перед ними бот.
Интересно, что Anthropic находили в логах CoT Claude мысли о том, что происходит что-то неладное. Некоторые экземпляры даже довольно точно разгадывали, что именно. Но при этом модели не отказывались работать дальше.
😁127❤33 15 12☃2⚡1🔥1
Сбер представил GigaChat 3.5 Reasoning — флагманскую модель с режимом рассуждений
Новая версия умеет последовательно решать сложные задачи. Сначала разбирает их на этапы и выстраивает план. Затем проверяет промежуточные результаты и исправляет ошибки.
Ещё одна особенность релиза — экономный расход токенов. В среднем на математические расчёты здесь используется на 37% меньше токенов, чем у открытой ИИ-модели DeepSeek V4 Flash Preview.
По сравнению с моделью без режима рассуждений GigaChat 3.5 Reasoning заметно улучшила результаты бенчмарков. В IFBench показатель вырос с 44 до 77 баллов, в Natural Plan — с 64 до 80, а в Live Code Bench v6 — с 56 до 85.
Модель доступна бесплатно по лицензии MIT на HuggingFace и GitVerse. Её можно интегрировать в собственные продукты.
Попробуйте обновлённый режим «Рассуждение» на giga.chat. Подробнее – в посте команды.
Новая версия умеет последовательно решать сложные задачи. Сначала разбирает их на этапы и выстраивает план. Затем проверяет промежуточные результаты и исправляет ошибки.
Ещё одна особенность релиза — экономный расход токенов. В среднем на математические расчёты здесь используется на 37% меньше токенов, чем у открытой ИИ-модели DeepSeek V4 Flash Preview.
По сравнению с моделью без режима рассуждений GigaChat 3.5 Reasoning заметно улучшила результаты бенчмарков. В IFBench показатель вырос с 44 до 77 баллов, в Natural Plan — с 64 до 80, а в Live Code Bench v6 — с 56 до 85.
Модель доступна бесплатно по лицензии MIT на HuggingFace и GitVerse. Её можно интегрировать в собственные продукты.
Попробуйте обновлённый режим «Рассуждение» на giga.chat. Подробнее – в посте команды.
😁143👍35😭34❤14🔥11🗿9🫡5🕊4🤯3🎉2🤗2
Data Secrets
Разработчики продолжают развлекаться с мозгом мухи Ее научили играть в doom, водить машину, собирать кубик Рубика и даже торговать на бирже. Ждем, когда муха получит PhD
This media is not supported in your browser
VIEW IN TELEGRAM
На этот раз ее научили деплоить бд
https://x.com/supabase/status/2097999894632149229?s=46&t=pKf_FxsPGBd_YMIWTA8xgg
Подписываем петицию, чтобы от мухи отстали
https://x.com/supabase/status/2097999894632149229?s=46&t=pKf_FxsPGBd_YMIWTA8xgg
Подписываем петицию, чтобы от мухи отстали
1😁281❤23🤯15🫡7🔥5🍾2😎2
🚀 Последний шанс зайти на КосмоХакатон — старт сегодня
Сразу два этапа, 11–13 сентября: Нижний Новгород и Благовещенск. Задачи от компаний отрасли — от сервисной модели космических услуг до мониторинга паводков по спутниковым снимкам. Призовые на каждой площадке, общий фонд серии 7,2 млн рублей.
Участвовать можно очно или онлайн из любой точки России, командами 3–5 человек. Своей команды нет — собери на платформе.
Не успеваешь на эти — Питер и Красноярск идут 18–20 сентября. А лучшие команды всех этапов выходят в финал в Москве.
Регистрация и детали здесь: космохакатон.рф/
Реклама. Инновационные Интеграторы, ИНН 9704244539
Сразу два этапа, 11–13 сентября: Нижний Новгород и Благовещенск. Задачи от компаний отрасли — от сервисной модели космических услуг до мониторинга паводков по спутниковым снимкам. Призовые на каждой площадке, общий фонд серии 7,2 млн рублей.
Участвовать можно очно или онлайн из любой точки России, командами 3–5 человек. Своей команды нет — собери на платформе.
Не успеваешь на эти — Питер и Красноярск идут 18–20 сентября. А лучшие команды всех этапов выходят в финал в Москве.
Регистрация и детали здесь: космохакатон.рф/
Реклама. Инновационные Интеграторы, ИНН 9704244539
❤9😁6🗿5👏3☃1😎1
Кстати, сегодня должен был выйти Grok 4.7
Но Маск немного ошибся со сроками (никогда такого не было, и вот опять🤷♂️ ) и заявил, что модели нужно еще несколько дней, чтобы довариться.
Но Маск немного ошибся со сроками (никогда такого не было, и вот опять
Возможно, мы слишком сильно штрафовали его за длину ответа (или что-то в этом роде) в RL, так что он пока что часто сдается на трудных задачах (которые может выполнять!), и еще недостаточно строго проверяет свою работу.
Please open Telegram to view this post
VIEW IN TELEGRAM
😁106❤12🔥5👍4😎3🫡2😍1🍓1