Причина, как мне казалось на старте, не в «недостатке таланта», а в архитектуре:Русский стих — силлабо-тоника. Отсюда рабочая гипотеза, с которой я начинал: основное время уйдёт не на выбор модели, а на механику стиха — ударения, метр, рифму. Train/eval-сплит — по стихотворениям, а не по парам (чтобы одно стихотворение не протекло в обе стороны): 11 942 / 1400. Но после «ковыг» и «гунтов» это выглядело прогрессом, и я прогнал A/B против базы своим оценщиком: v2 — 0.705, база — 0.618. Разделяйте задачи по тому, где они решаются, а не по тому, какой инструмент моднее.