OpenAI анонсировала новую функцию Reinforcement Fine-Tuning для своей модели o1. Эта функция позволяет пользователям настраивать поведение модели под конкретные задачи и потребности.
Пока что функция находится в закрытом тестировании, доступ к ней имеют только несколько университетов, которые занимаются экспериментами с ее возможностями.
Reinforcement Fine-Tuning позволит пользователям доучивать o1 на основе своих данных и примеров решения задач в различных областях, что открывает перспективы для создания индивидуализированных решений.
Ожидается, что полная версия платформы станет доступна широкой аудитории в следующем году.
