← Все новости
Бенчмарк качества англо-русского перевода для ведущих западных и китайских LLM

Бенчмарк качества англо-русского перевода для ведущих западных и китайских LLM

Сто ловушек в одном рассказе, LLM-судья с ключом ответов и баллы, которые считает код. Так устроен бенчмарк художественного перевода, который теперь встроен в опенсурсный конвейер BookTrans. В статье — зачем он понадобился, и как на нём выступили флагманы Anthropic, OpenAI и Google против китайских моделей. И ответ на главный вопрос: можно ли сэкономить, используя китайские модели, не потеряв в качестве. Читать далее