ИИ-помощник умеет отвечать на вопросы, пользоваться инструментами и выполнять задачи. Но как понять, что новая версия действительно стала лучше? Почему один сценарий работает хорошо, а в другом помощник ошибается? И что нужно изменить в модели или продукте, чтобы это исправить?
Ищем ML-аналитика, которому интересно разбираться в этих вопросах: исследовать поведение ИИ, придумывать способы измерения качества и помогать команде делать помощника полезнее.
Нам нужен ai-native специалист. Человек, для которого работа с ИИ - привычная часть решения задач. Вы умеете поручить агенту написание кода, собрать с его помощью исследовательский пайплайн, быстро проверить несколько гипотез и разобраться, где результату можно доверять. При этом постановка задачи, выбор метода и ответственность за вывод остаются за вами.