Модель выбирает вероятное
Распознавание предсказывает наиболее вероятную последовательность слов — не только по звучанию, но и по тому, что обычно говорят.
Редкая фамилия по определению маловероятна. Похожее по звучанию обычное слово встречается в языке в тысячи раз чаще, и модель выбирает его.
Четыре трудные категории
- Имена и фамилии, особенно нерусские.
- Названия компаний и продуктов.
- Профессиональные термины и аббревиатуры.
- Числа в сложных сочетаниях: артикулы, номера договоров.
Что помогает до записи
Попросить собеседника в начале произнести по буквам фамилию и название компании. Тридцать секунд, которые снимают половину правок.
Проговаривать аббревиатуры полностью хотя бы один раз: дальше в тексте вы замените их сокращением сами.
Что помогает после
Вычитывать не подряд, а поиском: пройтись по тексту, ища места, где стоит явная бессмыслица. Обычно это и есть имена.
Заменять через «найти и заменить» — одна ошибка в фамилии повторяется по всему тексту одинаково.