Forwarded from Machinelearning
Nemotron-Cascade 2 - вторая в мире открытая языковая модель, получившая золотую медаль сразу на 3 соревнованиях 2025 года: IMO, IOI и финале ICPC.
До нее это удавалось только DeepSeek-V3.2-Speciale, модели с 671B параметров и 37B активных. У Nemotron-Cascade 2 параметров в 20 раз меньше: 30B общих, 3B активных.
MoExperts на базе Nemotron-3-Nano-30B-A3B-Base. Отличие от первой версии - расширенный Cascade RL, где обучение с подкреплением проходит последовательно по доменам: сначала следование инструкциям, затем мультидоменное RL, потом дистилляция, RLHF, работа с длинным контекстом, код и, наконец, задачи программной инженерии.
На каждом этапе Cascade RL выбирается лучший промежуточный чекпоинт по конкретному домену и используется как учитель. Поскольку все учителя происходят от одной SFT-инициализации, они делят токенайзер и словарь, что упрощает дистилляцию.
MOPD работает на уровне отдельных токенов, а не последовательностей, и сходится быстрее, чем классический GRPO: на AIME 2025 достигает уровня учителя за 30 шагов оптимизации.
На бенчмарках модель обходит Qwen3.5-35B-A3B и более крупную Nemotron-3-Super-120B-A12B в математике, коде и следованию инструкциям.
Задачи, требующие глубоких знаний (MMLU-Pro, GPQA-Diamond) и агентные сценарии (BFCL v4, τ²-Bench, SWE Verified). Тут Qwen3.5 пока впереди.
NVIDIA обещает подтянуть наукоёмкий претрейн и агентный RL в следующих версиях Nemotron-Cascade.
@ai_machinelearning_big_data
#AI #ML #LLM #Nemotron #Cascade2 #NVIDIA
Please open Telegram to view this post
VIEW IN TELEGRAM
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Machinelearning
В конкурсе приняли участие больше 7 тысяч человек, из них отобрали 111 финалистов и 18 победителей, среди которых впервые появилась девушка и 14-летний школьник.
Участники работали над задачами уровня взрослых разработчиков, создавая алгоритм способный восстанавливать утерянную информацию и сохранять персонализацию сервиса при частичной потере данных.
Победители олимпиады получат возможность поступить в профильные вузы без вступительных экзаменов или получат 100 баллов ЕГЭ по профильному предмету. Также первый запред Сбербанка Александр Ведяхин лично пригласил всех победителей на стажировку в Сбер.
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM
Forwarded from Machinelearning
В декабре 2025 года Anthropic провела масштабное качественное исследование: специальная версия Claude брала интервью у пользователей сервиса по всему миру.
За одну неделю в нем приняли участие 80 508 человек из 159 стран на 70 языках. По заявлению Anthropic, это крупнейшее и наиболее многоязычное исследование, которое когда-либо проводилось.
Методика отличалась от стандартных опросов. Модель спрашивала о надеждах на ИИ, опыте его использования и страхах, а затем адаптировала follow-up вопросы на основе ответов.
Классифицировать и анализировать результаты тоже помогал Claude: он кластеризовал темы, выбирал репрезентативные цитаты и оценивал преобладающие настроения.
Самый распространенный запрос - профессиональная эффективность (19%): людям нужно, чтобы ИИ взял на себя рутину, оставив им стратегические задачи.
На втором месте личностный рост и эмоциональное благополучие (14%), далее - управление бытовыми задачами и когнитивная поддержка (14%).
Примечательно: когда интервьюер спрашивал, что за желанием продуктивности стоит на самом деле, многие раскрывались. Оказывалось, что дело не в работе как таковой, а в том, чтобы успевать к детям, проводить время с родителями или просто жить свою жизнь.
Примерно 81% участников сказали, что ИИ уже в какой-то мере оправдал их ожидания.
Чаще всего называли ускорение рабочих процессов (32%), когнитивное партнерство (17%) и обучение (10%).
Отдельно выделяется категория доступности: люди с нарушениями обучаемости, слуха, речи описывают ИИ как явление, которой у них раньше не было.
Главное беспокойство - ненадежность и галлюцинации (27%), следом идут угрозы занятости (22%) и потеря автономии (22%).
Важный паттерн: опасения, связанные с рынком труда, сильнее всего коррелируют с общим негативным отношением к ИИ.
Исследование зафиксировало 5 устойчивых противоречий, которые люди переживают одновременно, не выбирая одну из сторон:
У пользователей, ценящих ИИ за эмоциональную поддержку, втрое выше страхя зависимости от него.
В Африке, Латинской Америке и Южной Азии смотрят на ИИ заметно оптимистичнее, чем пользователи из Северной Америки и Западной Европы.
В развивающихся регионах ИИ воспринимается прежде всего как инструмент возможностей: для предпринимательства, образования, обхода инфраструктурных ограничений. В богатых странах фокус смещается на управление сложностью уже насыщенной жизни и регуляторные вопросы.
Anthropic
@ai_machinelearning_big_data
#news #ai #ml
Please open Telegram to view this post
VIEW IN TELEGRAM