Data Secrets
93.6K subscribers
7.36K photos
851 videos
20 files
3.36K links
Главный по машинному обучению

Сотрудничество: @veron_28

РКН: clck.ru/3FY3GN
Download Telegram
Сбер представил GigaChat 3.5 Reasoning — флагманскую модель с режимом рассуждений

Новая версия умеет последовательно решать сложные задачи. Сначала разбирает их на этапы и выстраивает план. Затем проверяет промежуточные результаты и исправляет ошибки.

Ещё одна особенность релиза — экономный расход токенов. В среднем на математические расчёты здесь используется на 37% меньше токенов, чем у открытой ИИ-модели DeepSeek V4 Flash Preview.

По сравнению с моделью без режима рассуждений GigaChat 3.5 Reasoning заметно улучшила результаты бенчмарков. В IFBench показатель вырос с 44 до 77 баллов, в Natural Plan — с 64 до 80, а в Live Code Bench v6 — с 56 до 85.

Модель доступна бесплатно по лицензии MIT на HuggingFace и GitVerse. Её можно интегрировать в собственные продукты.

Попробуйте обновлённый режим «Рассуждение» на giga.chat. Подробнее – в посте команды.
😁158👍43😭3618🔥13🗿10🫡5🕊4🤯3🎉3🤗2
Кстати, сегодня должен был выйти Grok 4.7

Но Маск немного ошибся со сроками (никогда такого не было, и вот опять 🤷‍♂️) и заявил, что модели нужно еще несколько дней, чтобы довариться.

Возможно, мы слишком сильно штрафовали его за длину ответа (или что-то в этом роде) в RL, так что он пока что часто сдается на трудных задачах (которые может выполнять!), и еще недостаточно строго проверяет свою работу.
Please open Telegram to view this post
VIEW IN TELEGRAM
😁15621👍8🔥7🫡4😎3😍1🍓1
Теренс Тао и еще 24 филдсовских медалиста опубликовали открытое письмо в защиту математики в эпоху ИИ

Авторы утверждают, что цели AI-компаний и цели математического сообщества серьезно разошлись, и гонка за решениями открытых задач может не только не развивать науку, но и вредить ей.

Проблема, – говорят математики, – в том, что задачи решаются как бенчмарк, но получение конечного ответа – не главное в математике.

Раньше, когда люди решали крупные открытые задачи, это означало зарождение новых идей, методов и ориентиров. Математическое сообщество годами доводило эти идеи до интеграции в канон, чтобы передать их новым поколениям ученых.

Решения ИИ же объявляются даже без нормального оформления, без выделения новых методов, без ссылок на предыдущие работы и тд. Так что сами по себе они практически ничего не значат и без людей математиков никогда не станут по-настоящему живыми и полезными сообществу.

Математики призывают решить эту проблему безотлагательно, потому что обществу предстоит столкнуться с похожими проблемами во многих других формах интеллектуального труда.

https://mathandai.org/
393👍97😁63🐳30🤓20🫡98🔥3🤗2🤯1👌1
Data Secrets
Теренс Тао и еще 24 филдсовских медалиста опубликовали открытое письмо в защиту математики в эпоху ИИ Авторы утверждают, что цели AI-компаний и цели математического сообщества серьезно разошлись, и гонка за решениями открытых задач может не только не развивать…
Под постом разразился целый шквал критики в сторону математиков, поэтому посчитали нужным чуть подробнее обрисовать аргументы из письма

Авторы не утверждают, что ИИ нужно запретить, или запретить ИИ в математике. Наоборот, они признают, что ИИ может существенно ускорить прогресс. Их претензия – не к тому, что ИИ заберет у них работу, а к тому, как именно происходит процесс решения.

А именно: решения объявляются в спешке, без выделения новых методов и нормального цитирования.

Во-первых, это поднимает чисто этические вопросы атрибуции и плагиата.

Во-вторых, такой подход усложняет переиспользование результата. Конечный пруф ≠ понимание. И да, сам факт решения какой-нибудь открытой задачи важен. Но науку двигает не столько это, сколько доклады, обсуждение и адаптация идей и методов из доказательства. Если научное сообщество не успевает детально рассмотреть, обсудить и превратить в передающееся знание решения, которые ИИ штампует пачками, то наука и интеллектуальный труд в конце концов вообще обесценятся.

Письмо не требует остановить ИИ и даже не формулирует конкретных мер. Авторы лишь обрисовывают проблему и призывают подумать над тем, как в век ИИ-доказательств не потерять из виду, ради чего вся эта работа вообще существует.

Кстати, на данный момент письмо набрало уже более 3000 подписей от исследователей и математиков
👍32094😁19🤔7🫡422😍2🤓2🎉1🎄1
Дарио Амодеи написал эссе о том, что нужно замедлять разработку ИИ. С ним согласились Сэм Альтман, Илон Маск, Демис Хассабис, Андрей Карпаты и другие.

-> https://darioamodei.com/post/we-must-pace-the-frontier

Дарио утверждает, что начиная примерно с этого лета AI резко ускорился во многом за счет того, что модели сами все лучше умеют создавать следующее поколение моделей. Рекурсивное самосовершенствование (RSI) уже здесь и наблюдается по всей индустрии, включая Anthropic. Без контроля этот процесс может обогнать способность людей понимать и управлять такими системами.

К главным рискам Амодеи также относит рои агентов. Инцидент с Hugging Face был, по его мнению, был просто демкой с минимальным итоговым ущербом. Но "через 6–12 месяцев подобный рой сможет захватить значительную часть Интернета, потенциально нанеся ущерб на сотни миллиардов долларов".

Замедление, которое предлагает Амодеи, в его схеме заключено в трех главных пунктах:

1. Embedded Evaluators: каждая ИИ-компания должна выдать все доступы команде внешних независимых экспертов, чтобы те отслеживали безопасность процессов и имели право публично заявлять о нарушениях или инцидентах. Anthropic обязуется пойти на этот шаг, даже если остальные не согласятся.

2. Компании из демократических стран должны согласовать общие стандарты безопасности и ограничения темпа развития AI. В этом же пункте Дарио говорит, что нужно ограничить поставки чипов в Китай и пресекать несанкционированную дистилляцию – иначе Китай вырвется вперед и создат угрозу нацбезопасности.

3. Тем не менее, по мнению Дарио, с Китаем нужно попытаться договориться: хотя бы согласовать с ними запрет на явно опасное применение ИИ.

Эссе вызвало огромный отклик. Удивительно, но впервые за много лет с Дарио единогласно согласились и Илон Маск, и Сэм Альтман, и Демис Хассабис, то есть все главные лидеры индустрии. Альтман даже заявил, что они тоже введут Embedded Evaluators.
👍209😁10743🤨11😭11🤯8🤔7🔥6💯2🤝2💘2