Сбер представил GigaChat 3.5 Reasoning — флагманскую модель с режимом рассуждений
Новая версия умеет последовательно решать сложные задачи. Сначала разбирает их на этапы и выстраивает план. Затем проверяет промежуточные результаты и исправляет ошибки.
Ещё одна особенность релиза — экономный расход токенов. В среднем на математические расчёты здесь используется на 37% меньше токенов, чем у открытой ИИ-модели DeepSeek V4 Flash Preview.
По сравнению с моделью без режима рассуждений GigaChat 3.5 Reasoning заметно улучшила результаты бенчмарков. В IFBench показатель вырос с 44 до 77 баллов, в Natural Plan — с 64 до 80, а в Live Code Bench v6 — с 56 до 85.
Модель доступна бесплатно по лицензии MIT на HuggingFace и GitVerse. Её можно интегрировать в собственные продукты.
Попробуйте обновлённый режим «Рассуждение» на giga.chat. Подробнее – в посте команды.
Новая версия умеет последовательно решать сложные задачи. Сначала разбирает их на этапы и выстраивает план. Затем проверяет промежуточные результаты и исправляет ошибки.
Ещё одна особенность релиза — экономный расход токенов. В среднем на математические расчёты здесь используется на 37% меньше токенов, чем у открытой ИИ-модели DeepSeek V4 Flash Preview.
По сравнению с моделью без режима рассуждений GigaChat 3.5 Reasoning заметно улучшила результаты бенчмарков. В IFBench показатель вырос с 44 до 77 баллов, в Natural Plan — с 64 до 80, а в Live Code Bench v6 — с 56 до 85.
Модель доступна бесплатно по лицензии MIT на HuggingFace и GitVerse. Её можно интегрировать в собственные продукты.
Попробуйте обновлённый режим «Рассуждение» на giga.chat. Подробнее – в посте команды.
😁158👍43😭36❤18🔥13🗿10🫡5🕊4🤯3🎉3🤗2
Data Secrets
Разработчики продолжают развлекаться с мозгом мухи Ее научили играть в doom, водить машину, собирать кубик Рубика и даже торговать на бирже. Ждем, когда муха получит PhD
This media is not supported in your browser
VIEW IN TELEGRAM
На этот раз ее научили деплоить бд
https://x.com/supabase/status/2097999894632149229?s=46&t=pKf_FxsPGBd_YMIWTA8xgg
Подписываем петицию, чтобы от мухи отстали
https://x.com/supabase/status/2097999894632149229?s=46&t=pKf_FxsPGBd_YMIWTA8xgg
Подписываем петицию, чтобы от мухи отстали
1😁342❤27🤯18🫡7🔥5🍾3😎2
Кстати, сегодня должен был выйти Grok 4.7
Но Маск немного ошибся со сроками (никогда такого не было, и вот опять🤷♂️ ) и заявил, что модели нужно еще несколько дней, чтобы довариться.
Но Маск немного ошибся со сроками (никогда такого не было, и вот опять
Возможно, мы слишком сильно штрафовали его за длину ответа (или что-то в этом роде) в RL, так что он пока что часто сдается на трудных задачах (которые может выполнять!), и еще недостаточно строго проверяет свою работу.
Please open Telegram to view this post
VIEW IN TELEGRAM
😁156❤21👍8🔥7🫡4😎3😍1🍓1
Теренс Тао и еще 24 филдсовских медалиста опубликовали открытое письмо в защиту математики в эпоху ИИ
Авторы утверждают, что цели AI-компаний и цели математического сообщества серьезно разошлись, и гонка за решениями открытых задач может не только не развивать науку, но и вредить ей.
Проблема, – говорят математики, – в том, что задачи решаются как бенчмарк, но получение конечного ответа – не главное в математике.
Раньше, когда люди решали крупные открытые задачи, это означало зарождение новых идей, методов и ориентиров. Математическое сообщество годами доводило эти идеи до интеграции в канон, чтобы передать их новым поколениям ученых.
Решения ИИ же объявляются даже без нормального оформления, без выделения новых методов, без ссылок на предыдущие работы и тд. Так что сами по себе они практически ничего не значат и без людей математиков никогда не станут по-настоящему живыми и полезными сообществу.
Математики призывают решить эту проблему безотлагательно, потому что обществу предстоит столкнуться с похожими проблемами во многих других формах интеллектуального труда.
https://mathandai.org/
Авторы утверждают, что цели AI-компаний и цели математического сообщества серьезно разошлись, и гонка за решениями открытых задач может не только не развивать науку, но и вредить ей.
Проблема, – говорят математики, – в том, что задачи решаются как бенчмарк, но получение конечного ответа – не главное в математике.
Раньше, когда люди решали крупные открытые задачи, это означало зарождение новых идей, методов и ориентиров. Математическое сообщество годами доводило эти идеи до интеграции в канон, чтобы передать их новым поколениям ученых.
Решения ИИ же объявляются даже без нормального оформления, без выделения новых методов, без ссылок на предыдущие работы и тд. Так что сами по себе они практически ничего не значат и без людей математиков никогда не станут по-настоящему живыми и полезными сообществу.
Математики призывают решить эту проблему безотлагательно, потому что обществу предстоит столкнуться с похожими проблемами во многих других формах интеллектуального труда.
https://mathandai.org/
❤393👍97😁63🐳30🤓20🫡9 8🔥3🤗2🤯1👌1
Data Secrets
Теренс Тао и еще 24 филдсовских медалиста опубликовали открытое письмо в защиту математики в эпоху ИИ Авторы утверждают, что цели AI-компаний и цели математического сообщества серьезно разошлись, и гонка за решениями открытых задач может не только не развивать…
Под постом разразился целый шквал критики в сторону математиков, поэтому посчитали нужным чуть подробнее обрисовать аргументы из письма
Авторы не утверждают, что ИИ нужно запретить, или запретить ИИ в математике. Наоборот, они признают, что ИИ может существенно ускорить прогресс. Их претензия – не к тому, что ИИ заберет у них работу, а к тому, как именно происходит процесс решения.
А именно: решения объявляются в спешке, без выделения новых методов и нормального цитирования.
Во-первых, это поднимает чисто этические вопросы атрибуции и плагиата.
Во-вторых, такой подход усложняет переиспользование результата. Конечный пруф ≠ понимание. И да, сам факт решения какой-нибудь открытой задачи важен. Но науку двигает не столько это, сколько доклады, обсуждение и адаптация идей и методов из доказательства. Если научное сообщество не успевает детально рассмотреть, обсудить и превратить в передающееся знание решения, которые ИИ штампует пачками, то наука и интеллектуальный труд в конце концов вообще обесценятся.
Письмо не требует остановить ИИ и даже не формулирует конкретных мер. Авторы лишь обрисовывают проблему и призывают подумать над тем, как в век ИИ-доказательств не потерять из виду, ради чего вся эта работа вообще существует.
Кстати, на данный момент письмо набрало уже более 3000 подписей от исследователей и математиков
Авторы не утверждают, что ИИ нужно запретить, или запретить ИИ в математике. Наоборот, они признают, что ИИ может существенно ускорить прогресс. Их претензия – не к тому, что ИИ заберет у них работу, а к тому, как именно происходит процесс решения.
А именно: решения объявляются в спешке, без выделения новых методов и нормального цитирования.
Во-первых, это поднимает чисто этические вопросы атрибуции и плагиата.
Во-вторых, такой подход усложняет переиспользование результата. Конечный пруф ≠ понимание. И да, сам факт решения какой-нибудь открытой задачи важен. Но науку двигает не столько это, сколько доклады, обсуждение и адаптация идей и методов из доказательства. Если научное сообщество не успевает детально рассмотреть, обсудить и превратить в передающееся знание решения, которые ИИ штампует пачками, то наука и интеллектуальный труд в конце концов вообще обесценятся.
Письмо не требует остановить ИИ и даже не формулирует конкретных мер. Авторы лишь обрисовывают проблему и призывают подумать над тем, как в век ИИ-доказательств не потерять из виду, ради чего вся эта работа вообще существует.
Кстати, на данный момент письмо набрало уже более 3000 подписей от исследователей и математиков
👍320❤94😁19🤔7🫡4✍2⚡2😍2🤓2🎉1🎄1
Дарио Амодеи написал эссе о том, что нужно замедлять разработку ИИ. С ним согласились Сэм Альтман, Илон Маск, Демис Хассабис, Андрей Карпаты и другие.
-> https://darioamodei.com/post/we-must-pace-the-frontier
Дарио утверждает, что начиная примерно с этого лета AI резко ускорился во многом за счет того, что модели сами все лучше умеют создавать следующее поколение моделей. Рекурсивное самосовершенствование (RSI) уже здесь и наблюдается по всей индустрии, включая Anthropic. Без контроля этот процесс может обогнать способность людей понимать и управлять такими системами.
К главным рискам Амодеи также относит рои агентов. Инцидент с Hugging Face был, по его мнению, был просто демкой с минимальным итоговым ущербом. Но "через 6–12 месяцев подобный рой сможет захватить значительную часть Интернета, потенциально нанеся ущерб на сотни миллиардов долларов".
Замедление, которое предлагает Амодеи, в его схеме заключено в трех главных пунктах:
1. Embedded Evaluators: каждая ИИ-компания должна выдать все доступы команде внешних независимых экспертов, чтобы те отслеживали безопасность процессов и имели право публично заявлять о нарушениях или инцидентах. Anthropic обязуется пойти на этот шаг, даже если остальные не согласятся.
2. Компании из демократических стран должны согласовать общие стандарты безопасности и ограничения темпа развития AI. В этом же пункте Дарио говорит, что нужно ограничить поставки чипов в Китай и пресекать несанкционированную дистилляцию – иначе Китай вырвется вперед и создат угрозу нацбезопасности.
3. Тем не менее, по мнению Дарио, с Китаем нужно попытаться договориться: хотя бы согласовать с ними запрет на явно опасное применение ИИ.
Эссе вызвало огромный отклик. Удивительно, но впервые за много лет с Дарио единогласно согласились и Илон Маск, и Сэм Альтман, и Демис Хассабис, то есть все главные лидеры индустрии. Альтман даже заявил, что они тоже введут Embedded Evaluators.
-> https://darioamodei.com/post/we-must-pace-the-frontier
Дарио утверждает, что начиная примерно с этого лета AI резко ускорился во многом за счет того, что модели сами все лучше умеют создавать следующее поколение моделей. Рекурсивное самосовершенствование (RSI) уже здесь и наблюдается по всей индустрии, включая Anthropic. Без контроля этот процесс может обогнать способность людей понимать и управлять такими системами.
К главным рискам Амодеи также относит рои агентов. Инцидент с Hugging Face был, по его мнению, был просто демкой с минимальным итоговым ущербом. Но "через 6–12 месяцев подобный рой сможет захватить значительную часть Интернета, потенциально нанеся ущерб на сотни миллиардов долларов".
Замедление, которое предлагает Амодеи, в его схеме заключено в трех главных пунктах:
1. Embedded Evaluators: каждая ИИ-компания должна выдать все доступы команде внешних независимых экспертов, чтобы те отслеживали безопасность процессов и имели право публично заявлять о нарушениях или инцидентах. Anthropic обязуется пойти на этот шаг, даже если остальные не согласятся.
2. Компании из демократических стран должны согласовать общие стандарты безопасности и ограничения темпа развития AI. В этом же пункте Дарио говорит, что нужно ограничить поставки чипов в Китай и пресекать несанкционированную дистилляцию – иначе Китай вырвется вперед и создат угрозу нацбезопасности.
3. Тем не менее, по мнению Дарио, с Китаем нужно попытаться договориться: хотя бы согласовать с ними запрет на явно опасное применение ИИ.
Эссе вызвало огромный отклик. Удивительно, но впервые за много лет с Дарио единогласно согласились и Илон Маск, и Сэм Альтман, и Демис Хассабис, то есть все главные лидеры индустрии. Альтман даже заявил, что они тоже введут Embedded Evaluators.
👍209😁107❤43🤨11😭11🤯8🤔7🔥6💯2🤝2💘2