Какие символы могут быть в фио
Перейти к содержимому

Какие символы могут быть в фио

Какие символы можно использовать в именах людей?

Есть стандартные символы A-Z, a-z, но также есть дефисы, длинные тире, кавычки и т. д.

Кроме того, есть все международные персонажи, такие как умляуты и т. д.

Итак, каков полный набор для системы на английском языке? А как насчет наборов для других языков? А как насчет UTF8, UTF16 и т. д.?

Дополнительный вопрос: сколько полей имени необходимо и какова их максимальная длина?

Обновлено: Определенно существует два разных типа символов, задействованных в именах людей: те, которые присутствуют как часть контекста, и те, которые присутствуют по структурным причинам. Я не хочу ограничивать или вмешиваться в контекстные символы, но мне нужно иметь дело со структурными.

Например, у меня было имя, которое было разделено длинным тире, но было трудно отличить его от символа минус. Чтобы упростить поиск в системе, я хочу взять все пять разных типов тире и сопоставить их с одним уникальным символом (минус), чтобы поисковику не нужно было точно знать, какой символ был введен изначально.

Проблема существует для тире, возможно, и для кавычек, но также и для скольких других символов?

Только что видел в нашей системе длинное тире в UTF8, которое должно было быть сопоставлено с минусом ASCII (иначе вы не сможете выполнять поиск по нему). Насколько велика моя проблема?

Мы не имеем права ограничивать ввод, поэтому, например, дефисы, дефисы и минусы должны быть последовательно отображены обратно в простой ASCII, чтобы все это работало должным образом.

Вы не можете сопоставить все имена с простым ASCII (хотя вы можете сопоставить тире и похожие символы). А как насчет китайских, витнамских и арабских имен?

Да, полагаю, мне следует различать «символы содержания» и «метасимволы». Я хочу отображать идентичные метасимволы как один символ, но не контентные.

Это легко может привести к столкновениям: Пауль Мюллер и его переименованный друг в США Пол Мюллер могут быть не слишком счастливы.

Мы привыкли называть это заблуждением О’Брайена.

См. Программисты верят неправду об именах. Вкратце: все персонажи действительны, поскольку имя может быть таким, каким они хотят его видеть.

Формы c голосовым вводом в React с помощью Speechly

Flatpickr: простой модуль календаря для вашего приложения на React

Что такое cURL в PHP? Встроенные функции и пример GET запроса

Ответы 10

UTF-8 должен быть достаточно хорош, что касается полей имени, вам понадобятся как минимум имя и фамилия.

Но у меня только одно имя. А что я? 🙂

Быть придирчивым; UTF-8 — это не набор символов, это кодировка символов.

Действительно, набор символов называется Юникод.

Есть хорошая статья от W3C под названием Личные имена по всему миру, которая довольно хорошо объясняет проблемы (и возможные решения) (изначально это была запись в блоге Ричарда Исиды, состоящая из двух частей: часть 1 и часть 2)

Лично я бы сказал: поддерживайте все печатаемые символы Unicode и на всякий случай укажите только одно поле «name», которое содержит полное отформатированное имя. Таким образом вы можете сохранить практически любую форму имени. Возможно, вам понадобится более структурированное хранилище, но тогда не ожидайте, что сможете хранить каждую комбинацию в структурированной форме, поскольку их просто слишком много.

Это имеет смысл, но я удивлен, я всегда думал, что полное имя и приветствие были более грубыми условностями, чем первое, среднее и последнее.

@ Пол: Возможно, это так, когда вы имеете дело только с одной культурой и языком. Но когда вы попадаете в разный порядок имен, разное количество имен и т. д., Человеку может быть трудно использовать все возможности, не говоря уже о программе, поэтому просто позвольте пользователю самому решать, как отобразить свое собственное имя.

Есть ли определение для печатаемых символов Юникода?

Если вы спросите меня, занесение в белый список символов, которые могут появиться в имени человека, — это неправильный путь. Конечно, [A-Za-z] — справедливая отправная точка, но, как вы сказали, у вас возникают проблемы с «европейскими» именами. Таким образом, вы сопоставляете все умляуты, циркумфлексы и тому подобное. А что насчет китайских имен? Японский? Индийский? Иврит? Вы вступаете в битву против ветряных турбин.

Если вы абсолютно необходимо проверяете действительность чьего-либо имени, я бы предложил сделать скромный черный список определенных символов. Фигурные скобки, математические символы, некоторые знаки препинания и тому подобное можно игнорировать. Но на вашем месте я был бы осторожен.

Возможно, лучше всего просто принять все, что входит. UTF-16 должен быть сегодняшним избыточным набором символов, которого хватит на несколько лет вперед.

Редактировать: Что касается вашего вопроса о длине имени и количестве имен. Если вы действительно хотите, чтобы люди писали свои настоящие и полные имена, я полагаю, что единственным надежным ответом на оба этих вопроса будет «бесконечно». Невозможно найти реальные примеры для людей, но, безусловно, есть аналогичные примеры для людей, как исконное название города Бангкок.

Я бы позволил все, кроме пробелов

Но на самом деле, почему? Что, если моя фамилия была «фон Реттиг»? Если я проиндексирую эту фамилию, она будет написана «Rettig, von». Никогда нельзя быть слишком уверенным .

Я не хочу ограничивать ввод, но в некоторых случаях я хочу отобразить несколько символов на один, например, я хочу сопоставить любые длинные тире в UTF8 с минусами в ASCII, чтобы упростить поиск.

тире к дефисам / минусам кажутся мне достаточно безобидными. Но думали ли вы также о отображении Ä в A? В скандинавских (то есть в Северной Европе) языках эти два символа очень разные. Фактически, A является последним символом в алфавите, Ä является вторым последним в финском (и некоторых других).

Я имею в виду: «А — это символ первый в алфавите . »

Просто чтобы быть умником: UTF-16 — это не набор символов, а кодировка символов набора Unicode. Вы действительно имели в виду Unicode. (UTF-16 не содержит больше символов, чем UTF-8.)

Любой символ, который может быть представлен любым числом, кратным восьми битам (больше нуля), является возможным символом для имени человека. Длины имен и кодировок произвольны, поэтому не следует учитывать верхнюю границу.

Просто убедитесь, что вы дезинфицируете входные данные своей базы данных, чтобы маленькие таблицы Bobby Drop не понимали вас.

Я бы запретил, по крайней мере, все непечатаемые символы Unicode (управляющие символы), поскольку они очень, очень, очень вряд ли будут содержаться в имени.

Да, но он не ограничивал свои входные данные Unicode, не так ли? Я пытаюсь продемонстрировать, что бесполезно пытаться угадать, что будет, а что не будет частью действительного имени. Вы либо накладываете произвольные ограничения на имя, а потом оскорбляете нескольких людей, либо не устанавливаете никаких ограничений и дезинфицируете.

Какие символы допускаются в ФИО.

Добрый день. Есть ли какие-либо ограничения на символы используемые в графах ФИО паспорта гражданина РФ/свидетельстве о рождении.

Ответы на вопрос:

Запрещается запись имени, которое состоит из цифр, буквенно-цифровых обозначений, числительных, символов и не являющихся буквами знаков, за исключением знака «дефис», или их любой комбинации либо содержит бранные слова, указания на ранги, должности, титулы.

Для более точного ответа уточните вопрос.

Похожие вопросы

Я гражданин РФ перевёз родителей (пенсионеров) из казахстана. У матери выяснилось что в паспорте дата рождения не совподает с свидетельством о рождении. Свидетельство ветхое дату не видно. Поставили дату регистрации свидетельства вместо дня рождения. Возможно ли переделать дату в свидетельстве о рождении? Так-как паспорт и другие документы переделать нет возможности.

При замене паспорта по возрасту в МФЦ обнаружили ошибку в старом паспорте. Несоответствие места рождения со свидетельством о рождении. Новый паспорт будет выдан по данным свидетельства о рождении. Нужно ли менять свидетельство о регистрации права собственности на квартиру?

В свидетельстве о рождении, отчество отличается на одну букву от паспорта. Свидетельство выдавалось в Грузии, а я гражданин РФ (паспорт гражданина РФ)

Какие документы надо заменить.

У моего мужа, согласно свидетельства о рождение ФИО-ТерЕхин Кирилл ГенадИевич.

В паспорте полученном в 83 г его ФИО-ТерЁхин Кирилл ГенадЬевич

Во всех последующих документах (воинский билет, трудовая книжка, пенсионное свидетельство, дипломы, права, СВИДЕТЕЛЬСТВО О БРАКЕ и в графе отец СВИДЕТЕЛЬСТВА О РОЖДЕНИЕ нашей дочери. ) ФИО согласно паспорту.

В 2003 при смене паспорта СССР на Российский, муж получил новый паспорт, который полностью соответствует его свидетельству о рождение. В настоящий момент мы хотим приватизировать квартиру, в которой прописан муж: ТерЕхин Кирилл ГенадИевич и дочь (16 лет) ТерЁхина Анастасия Кирилловна. Что посоветуете переоформить, чтобы на будущее у ребенка не возникло проблем? Можно ли внести изменение в её свидетельсво о рождение, чтобы она была ТерЁхина, а отец ТерЕхин и ГенадИевич, в графе мать, кстати, я-ТерЕхина. Простите за путаницу, но мне кажется этот вопрос серьёзным. Заранее спасибо.

Каковы все допустимые символы для имен людей?

Существуют стандартные символы A-Z, a-z, а также дефисы, тире, кавычки и т.д.

Кроме того, есть все международные символы, такие как умляуты и т.д.

Итак, каков полный набор для системы, основанной на английском языке? А как насчет наборов для других языков? Как насчет UTF8, UTF16 и т.д.?

Бонусный вопрос: Сколько полей имен необходимо, и какова их максимальная длина?

EDIT: В именах людей определенно есть два разных типа символов: те, которые являются частью контекста, и те, которые используются по структурным причинам. Я не хочу ограничивать или вмешиваться в контекстные символы, но мне нужно разобраться со структурными.

Например, мне пришло имя, разделенное тире, но его трудно отличить от знака минус. Чтобы облегчить поиск, я хочу взять все пять различных типов тире и сопоставить их с одним уникальным символом (минусом), чтобы поисковик не знал, какой символ был введен изначально.

Проблема существует для тире, возможно, и для кавычек, а также для многих других символов?

Your Common Sense

Есть хорошая статья W3C под названием Личные имена по всему миру, которая довольно хорошо объясняет проблемы (и возможные решения) (первоначально это была статья в блоге Ричарда Ишиды, состоящая из двух частей: часть 1 и часть 2).

Лично я бы сказал: поддерживайте все печатаемые Unicode-символы и, чтобы быть в безопасности, предоставьте только одно поле «имя», которое содержит полное, форматированное имя. Таким образом, вы сможете хранить практически все формы имен. Возможно, вам понадобится более структурированное хранение, но тогда не стоит ожидать, что вы сможете хранить все комбинации в структурированном виде, поскольку их просто слишком много.

Белый список символов, которые могут встречаться в имени человека, — это неправильный путь, если вы спросите меня. Конечно, [A-Za-Z] — справедливая отправная точка, но, как вы сказали, возникают проблемы с «европейскими» именами. То есть вы наносите на карту все умляуты, циркумфлексы и прочее. А как насчет китайских имен? Японские? Индийских? Еврейские? Вы вступаете в борьбу с ветряными турбинами.

Если вам абсолютно необходимо проверить достоверность чьего-то имени, я бы предложил составить скромный черный список определенных символов. Скобки, математические символы, некоторые знаки препинания и тому подобное можно игнорировать. Но я бы на вашем месте был осторожен.

Возможно, лучше просто принимать все, что приходит. UTF-16 должен быть сегодняшним избыточным набором символов, которого хватит на несколько лет вперед.

Редактирование: Что касается вашего вопроса о длине имени и количестве имен. Если вы действительно хотите, чтобы люди писали свои настоящие и полные имена, я думаю, единственным надежным ответом на оба этих вопроса будет «бесконечность». Не могу привести ни одного реального примера для людей, но наверняка есть аналогичные примеры для людей, как родное название города Бангкок.

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *