Forwarded from Цифровой геноцид
Stop Anthropomorphizing Intermediate Tokens as Reasoning/Thinking Traces!
Хватит антропоморфизировать промежуточные токены как размышления или мысли!
https://arxiv.org/abs/2504.09762v2
Вообще интересная статья о том, что продуктовые решения в области ИИ подталкивают к антроморфизации, что, конечно, не так... проблема вообще, конечно, глобальная и касается вообще всего ПО, маркетинга в айти и проблемах технологического PR.
Генерация промежуточных токенов (ITG), когда модель выдает вывод перед решением, была предложена как метод улучшения производительности языковых моделей в задачах, требующих рассуждений. Эти промежуточные токены называли «следами рассуждений» или даже «мыслями» — подразумевая антропоморфизацию модели, намекая, что эти токены напоминают шаги, которые человек мог бы предпринять при решении сложной задачи.
Большие языковые модели (LLM), которые были авторегрессивно обучены на цифровом следе человечества, показали способность генерировать связные текстовые ответы на самые разнообразные запросы. Хотя они демонстрируют впечатляющие способности и превосходят в создании завершений, имитирующих стиль, способности, такие как фактологичность, рассуждения и планирование, остаются неуловимыми целями, если не ахиллесовой пятой
В ответ исследователи разработали новый класс моделей — иногда называемых большими моделями рассуждений (LRM), — которые строятся на архитектурах и рецептах обучения стандартных LLM. Наиболее известны из них модели серии o от OpenAI, o3, R1 от DeepSeek [9], Google Gemini-2.5-pro, Anthropic Claude 3.7 Sonnet, которые показали значительные улучшения производительности в задачах рассуждений и планирования, ранее недоступных для старых возможностей LLM.
Эти модели были построены на основе двух широких, но в основном ортогональных классов идей:
(i) методы масштабирования инференса во время тестирования, которые заставляют LLM выполнять больше работы, чем просто предоставление наиболее вероятного прямого ответа;
(ii) методы постобучения, которые дополняют простое авторегрессивное обучение на веб-корпусах дополнительным обучением на данных промежуточных токенов.
Рассмотрение промежуточных токенов как следов рассуждений/мышления привело к стремлению сделать их «интерпретируемыми» для людей в цикле (не говоря уже о том, что интерпретируемость в основном означала, что следы были на псевдо-английском). Например, DeepSeek [9] экспериментировал с обучением модели только с RL (R1-Zero), но выпустил финальную версию (R1), которая обучалась с дополнительными данными и шагами фильтрации, специально чтобы уменьшить склонность модели по умолчанию генерировать промежуточные последовательности токенов, смешивающие английский и китайский языки!
Это привело к неявному предположению, что правильность/интерпретируемость промежуточных токенов имеет сильную корреляцию или даже причинно-следственную связь с производимым решением.
Хватит антропоморфизировать промежуточные токены как размышления или мысли!
https://arxiv.org/abs/2504.09762v2
Вообще интересная статья о том, что продуктовые решения в области ИИ подталкивают к антроморфизации, что, конечно, не так... проблема вообще, конечно, глобальная и касается вообще всего ПО, маркетинга в айти и проблемах технологического PR.
Генерация промежуточных токенов (ITG), когда модель выдает вывод перед решением, была предложена как метод улучшения производительности языковых моделей в задачах, требующих рассуждений. Эти промежуточные токены называли «следами рассуждений» или даже «мыслями» — подразумевая антропоморфизацию модели, намекая, что эти токены напоминают шаги, которые человек мог бы предпринять при решении сложной задачи.
Большие языковые модели (LLM), которые были авторегрессивно обучены на цифровом следе человечества, показали способность генерировать связные текстовые ответы на самые разнообразные запросы. Хотя они демонстрируют впечатляющие способности и превосходят в создании завершений, имитирующих стиль, способности, такие как фактологичность, рассуждения и планирование, остаются неуловимыми целями, если не ахиллесовой пятой
В ответ исследователи разработали новый класс моделей — иногда называемых большими моделями рассуждений (LRM), — которые строятся на архитектурах и рецептах обучения стандартных LLM. Наиболее известны из них модели серии o от OpenAI, o3, R1 от DeepSeek [9], Google Gemini-2.5-pro, Anthropic Claude 3.7 Sonnet, которые показали значительные улучшения производительности в задачах рассуждений и планирования, ранее недоступных для старых возможностей LLM.
Эти модели были построены на основе двух широких, но в основном ортогональных классов идей:
(i) методы масштабирования инференса во время тестирования, которые заставляют LLM выполнять больше работы, чем просто предоставление наиболее вероятного прямого ответа;
(ii) методы постобучения, которые дополняют простое авторегрессивное обучение на веб-корпусах дополнительным обучением на данных промежуточных токенов.
Рассмотрение промежуточных токенов как следов рассуждений/мышления привело к стремлению сделать их «интерпретируемыми» для людей в цикле (не говоря уже о том, что интерпретируемость в основном означала, что следы были на псевдо-английском). Например, DeepSeek [9] экспериментировал с обучением модели только с RL (R1-Zero), но выпустил финальную версию (R1), которая обучалась с дополнительными данными и шагами фильтрации, специально чтобы уменьшить склонность модели по умолчанию генерировать промежуточные последовательности токенов, смешивающие английский и китайский языки!
Это привело к неявному предположению, что правильность/интерпретируемость промежуточных токенов имеет сильную корреляцию или даже причинно-следственную связь с производимым решением.
arXiv.org
Position: Stop Anthropomorphizing Intermediate Tokens as...
Intermediate token generation (ITG), where a model produces output before the solution, has become a standard method to improve the performance of language models on reasoning tasks. These...
Forwarded from UX Live 🔥
Если в данже нет сундука, то это не данж, а говно
@
Если в данже есть сундук, то там будет мусор
@
Если в данже есть сундук, то там будет мусор
Forwarded from Daily Coding 🔥
🛠 Sticky-Kit - это плагин для jQuery, который позволяет прикреплять элементы к определенной области страницы, не нарушая ее границ. Таким образом, у вас может быть боковая панель, которая всегда видна и прокручивается вместе с остальной частью страницы, но может содержаться в родительском контейнере.
🌍 Сайт
Daily Coding #инструменты #jQuery
🌍 Сайт
Daily Coding #инструменты #jQuery
Forwarded from Адовый UX
Админ канала пытается вместе с партнёром сделать Райский UX в области чтения электронных книг и управления личной библиотекой
Уже можно потрогать бета-версию
Уже можно потрогать бета-версию
Forwarded from Буков
Первая бета-версия!
У нас готова первая бета-версия. Вы можете установить её через систему Apple Test Flight: https://testflight.apple.com/join/R1QreZq8
Будем рады вашим откликам, идеям, критике и, особенно, сообщениям о багах (они точно есть, на то она и бета-версия)
Что работает и что можно тестировать:
— Импорт книг
— Поиск книг и добавление их метаданных в библиотеку
— Книжные полки
— Читалка с выбором тем, шрифтов и настроек макета страницы
— Сохранение цитат
— Экспорт списка книг
Что точно пока не работает:
— Сохранение прогресса чтения в PDF
— Тестовая покупка доступа к расширенному набору иконок (иконков не продаём, просто показываем)
У нас готова первая бета-версия. Вы можете установить её через систему Apple Test Flight: https://testflight.apple.com/join/R1QreZq8
Будем рады вашим откликам, идеям, критике и, особенно, сообщениям о багах (они точно есть, на то она и бета-версия)
Что работает и что можно тестировать:
— Импорт книг
— Поиск книг и добавление их метаданных в библиотеку
— Книжные полки
— Читалка с выбором тем, шрифтов и настроек макета страницы
— Сохранение цитат
— Экспорт списка книг
Что точно пока не работает:
— Сохранение прогресса чтения в PDF
— Тестовая покупка доступа к расширенному набору иконок (иконков не продаём, просто показываем)
Forwarded from ai.dot(ufna, dev)
Выглядит интересно. На мобильной 3080 бюджет 1.5мс *приемлемо мем*.
Смотрели, господа технари, критиковали?
https://www.youtube.com/watch?v=dmdyqzelBIY
Смотрели, господа технари, критиковали?
https://www.youtube.com/watch?v=dmdyqzelBIY
Forwarded from Dezzigners
Forwarded from Дизайн-снайпер
This media is not supported in your browser
VIEW IN TELEGRAM
Минутка геймдизайна:
Предзаказ на игру Adorable Adventures с оригинальной игровой концепцией. Играть за кабанчика Бориса, который по запахам ориентируется по лесу. По сюжету герой потерялся после лесного пожара и по запахам пытается найти своё кабанье семейство. Дизайн интерфейса с запахами можно оценить в ролике. В Стиме можно ждать.
Предзаказ на игру Adorable Adventures с оригинальной игровой концепцией. Играть за кабанчика Бориса, который по запахам ориентируется по лесу. По сюжету герой потерялся после лесного пожара и по запахам пытается найти своё кабанье семейство. Дизайн интерфейса с запахами можно оценить в ролике. В Стиме можно ждать.
Forwarded from Дизайн-снайпер
Минутка нашего:
Антихрупкость выпустила кружки к 100-летию Ленинградского конструктивизма.
Уральский проект Антихрупкость подсветил важную дату для Петербурга. В этом году
исполняется 100 лет Ленинградскому конструктивизму — архитектурному стилю,
сформировавшему облик городских окраин и новый быт советского человека. К этому событию проект выпустил продолжение серии кружек «Фрагменты», посвященной наследию советского авангарда.
В Ленинградскую серию вошли пять зданий — «Красный гвоздильщик», Круглая
баня, ДК им. Г орького, Дом Ленсовета и фабрика «Красное знамя». Авангардную
архитектуру передает минималистичный паттерн — смотрится всё это просто круто и стильно. Создается особое настроение вокруг обычного объекта.
Автор серии — промышленный дизайнер Федор Колпаков.
Антихрупкость выпустила кружки к 100-летию Ленинградского конструктивизма.
Уральский проект Антихрупкость подсветил важную дату для Петербурга. В этом году
исполняется 100 лет Ленинградскому конструктивизму — архитектурному стилю,
сформировавшему облик городских окраин и новый быт советского человека. К этому событию проект выпустил продолжение серии кружек «Фрагменты», посвященной наследию советского авангарда.
В Ленинградскую серию вошли пять зданий — «Красный гвоздильщик», Круглая
баня, ДК им. Г орького, Дом Ленсовета и фабрика «Красное знамя». Авангардную
архитектуру передает минималистичный паттерн — смотрится всё это просто круто и стильно. Создается особое настроение вокруг обычного объекта.
Автор серии — промышленный дизайнер Федор Колпаков.
Forwarded from Оди
Автор канала вместе с партнёром делает iOS-приложения для чтения электронных книг и управления личной библиотекой
Уже можно потрогать бета-версию
Уже можно потрогать бета-версию
Forwarded from Буков
Первая бета-версия!
У нас готова первая бета-версия. Вы можете установить её через систему Apple Test Flight: https://testflight.apple.com/join/R1QreZq8
Будем рады вашим откликам, идеям, критике и, особенно, сообщениям о багах (они точно есть, на то она и бета-версия)
Что работает и что можно тестировать:
— Импорт книг
— Поиск книг и добавление их метаданных в библиотеку
— Книжные полки
— Читалка с выбором тем, шрифтов и настроек макета страницы
— Сохранение цитат
— Экспорт списка книг
Что точно пока не работает:
— Сохранение прогресса чтения в PDF
— Тестовая покупка доступа к расширенному набору иконок (иконков не продаём, просто показываем)
У нас готова первая бета-версия. Вы можете установить её через систему Apple Test Flight: https://testflight.apple.com/join/R1QreZq8
Будем рады вашим откликам, идеям, критике и, особенно, сообщениям о багах (они точно есть, на то она и бета-версия)
Что работает и что можно тестировать:
— Импорт книг
— Поиск книг и добавление их метаданных в библиотеку
— Книжные полки
— Читалка с выбором тем, шрифтов и настроек макета страницы
— Сохранение цитат
— Экспорт списка книг
Что точно пока не работает:
— Сохранение прогресса чтения в PDF
— Тестовая покупка доступа к расширенному набору иконок (иконков не продаём, просто показываем)