Мне нужно проверить имена и фамилии людей со всего мира. Представьте себе огромный список из миллионов имен и фамилий, из которого мне нужно как можно лучше удалить любой мусор, который я нахожу. Как я могу сделать это с помощью регулярного выражения? Если бы это были только английские, я думаю, это было бы проще:
Код: Выделить всё
^[a-z -']+$
[*]другие символы пунктуации поскольку они могут использоваться в разных странах (не знаю, в каких, но, возможно, вы это делаете!)
[*]разные наборы букв Юникода (буква с ударением, греческий, японский, китайский и т. д.)
никакие цифры, символы, ненужные знаки препинания, руны и т. д.
[*]заголовки, средние инициалы, суффиксы не являются частью этих данных[*]имена уже разделены фамилиями.
[*]мы готовы заставить упростить очень редкие имена (существует человек с именем «@», но это не так) Нет смысла разрешать использование этого символа повсюду. Используйте прагматизм и здравый смысл.)
[*]обратите внимание, что во многих странах действуют законы об именах, поэтому существуют стандарты, которым необходимо следовать.
< /ul>
Существует ли стандартный способ проверки этих полей, который я мог бы реализовать, чтобы убедиться, что пользователи нашего веб-сайта имеют приятный опыт и действительно могут использовать свое имя при регистрации в списке?
Я бы искал что-то похожее на множество регулярных выражений «адреса электронной почты», которые вы можете найти в Google.
Подробнее здесь: https://stackoverflow.com/questions/888 ... d-surnames