Тут недавно вышла Jev от TypeSafe AI, и многие обсуждали сам подход: модель не пишет текст, а принимает решение. Ей передают описание ситуации и вопрос, а в ответ получают выбор из заданных вариантов, оценку или вероятность. Не текст, из которого ещё нужно извлечь ответ, а результат, который программа может сразу использовать.
В том же направлении работает Laya модель принятия решений с открытыми весами от Convai Innovations. Она тоже не генерирует текст, а вычисляет ответы за один проход. Мультиязычная версия построена на mmBERT-base и содержит около 322 млн параметров. Это не chat-based, а модель для задач вроде классификации обращений, оценки срочности и выбора следующего действия.
И я не cмог пройти мимо)
Поэтому новый эксперимент со «Змейкой» 🐍
Здесь Laya получает описание игрового поля и выбирает, куда двигаться: вверх, вниз, влево или вправо. Игра выполняет выбранный ход без подстраховки, даже если он ведёт в стену или собственное тело.
Получается наглядная проверка: модель не рассказывает, как нужно играть, а каждое её решение сразу меняет ситуацию на поле.
Если модель выбирает движение в стену или в собственное тело, змейка погибает. Рядом с полем можно наблюдать вероятности вариантов и время одного прохода модели на CPU.
Для меня здесь интересен переход от ответа модели к его последствиям.
Недостаточно выбрать действие, которое выглядит подходящим прямо сейчас: оно ещё должно оставить возможность сделать следующий ход.
Поэтому я бы воспринимал этот эксперимент не как доказательство «интеллекта», а как наглядную проверку того, что происходит между вероятностью на выходе модели и последствиями её решения.
@nerditru
В том же направлении работает Laya модель принятия решений с открытыми весами от Convai Innovations. Она тоже не генерирует текст, а вычисляет ответы за один проход. Мультиязычная версия построена на mmBERT-base и содержит около 322 млн параметров. Это не chat-based, а модель для задач вроде классификации обращений, оценки срочности и выбора следующего действия.
И я не cмог пройти мимо)
Поэтому новый эксперимент со «Змейкой» 🐍
Здесь Laya получает описание игрового поля и выбирает, куда двигаться: вверх, вниз, влево или вправо. Игра выполняет выбранный ход без подстраховки, даже если он ведёт в стену или собственное тело.
Получается наглядная проверка: модель не рассказывает, как нужно играть, а каждое её решение сразу меняет ситуацию на поле.
Если модель выбирает движение в стену или в собственное тело, змейка погибает. Рядом с полем можно наблюдать вероятности вариантов и время одного прохода модели на CPU.
Для меня здесь интересен переход от ответа модели к его последствиям.
Недостаточно выбрать действие, которое выглядит подходящим прямо сейчас: оно ещё должно оставить возможность сделать следующий ход.
Поэтому я бы воспринимал этот эксперимент не как доказательство «интеллекта», а как наглядную проверку того, что происходит между вероятностью на выходе модели и последствиями её решения.
@nerditru
👍2👏2