Скажите свое мнение. В общем идея следующая:
1) есть строка, например Privet Zemlya
2) Затем ты указываешь в процентах от 0 до 100 степень коверкания, которая заключается в том, что с заданной вероятностью (от 0 до 100) символ будет заменен на его ближайший аналог (I на l (и на л) и так далее). То есть вы задаете число, которое покажет какой процент символов от исходной строки будет инвертирован.
Это должно хорошо работать особенно со стандартной базой анализ фамилии и какие-то свои варианты, "наслаивая" программную замену и существенно повышая уникальность в теории. Жду отзывы о идее. Конструктивно, с душой, по делу
Так же планируется, что один и тот же символ может быть заменен несколькими вариантами, что добавляет разнообразия.