Аннотация

Исследователю, использующему персидские слова, парадигмы и связные цитаты в научном тексте, необходима самостоятельная система письма, которая последовательно обозначает гласные и согласные, сохраняет значимые противопоставления и позволяет распознавать морфологическое устройство форм. Такая система должна представлять персидский язык, а не только преобразовывать знаки персидско-арабского оригинала.

NPL26-A определяется здесь как первичная латинская орфография: она исходит из фонемной и морфологической структуры персидского, а не из процедуры преобразования персо-арабского написания.

В статье рассматриваются языковые требования к такой записи и сопоставляются решения, представленные в международных стандартах романизации, иранистической издательской практике и проектах первичной латинской орфографии. На этой основе формулируется НПЛ‑26 — научная персидская латиница, с международным идентификатором NPL26. Для современного литературного иранского персидского рекомендуется модель NPL26-A: шестигласная фонемно ориентированная запись с последовательным обозначением согласных, геминации, изафета и основных морфологических границ. Дополнительная модель NPL26-E сохраняет выбранные этимологические различия. Для исторического материала предусматривается расширенный фонологический профиль.

Предлагаемая спецификация преимущественно использует уже существующие научные обозначения. Самостоятельные нормативные решения принимаются там, где рассмотренные документы оставляют выбор открытым: прежде всего при записи зияния, распределении y, графическом членении и обозначении просодии.

Ключевые слова: персидский язык, научная орфография, латиница, фонемная запись, морфонология, зияние, изафет, романизация, стандартизация.


1. Постановка задачи

1.1. Какая запись нужна исследователю

Предмет настоящей статьи — система, в которой можно непосредственно писать по-персидски: приводить слова и предложения, сопоставлять формы, обсуждать словообразование и воспроизводить литературные цитаты. Читатель такой записи не должен предварительно восстанавливать персидско-арабское написание, чтобы определить, какие гласные присутствуют в слове или где находится изафет.

Это требует решения двух взаимосвязанных задач.

Первая — фонологическая полнота: различающиеся нормативные звуковые формы не должны становиться одинаковыми вследствие недостаточности алфавита. В частности, необходимо различать a и ā, s и š, одиночные и удвоенные согласные.

Вторая — морфологическая устойчивость: одна и та же основа или грамматическая форма не должна получать новое написание при каждом позиционном ослаблении, ассимиляции или индивидуальном изменении произношения.

Эти задачи не сводятся ни к инструкции «писать как слышится», ни к буквенной транслитерации. Орфография должна представлять нормализованную языковую форму, находящуюся между конкретным произнесением и абстрактной морфологической структурой.

Латиница здесь выбирается как распространённая среда научной коммуникации. Основанием выбора служат совместимость с иранистической практикой, возможность последовательной передачи противопоставлений и удобство работы с текстом, а не предполагаемое соответствие определённой языковой семьи определённому алфавиту.

1.2. Язык и его графическое представление

NPL26-A не является транслитерацией персо-арабского письма. Её исходный объект — нормативные языковые формы, их фонемный состав и морфологическое устройство; персо-арабское написание не требуется как обязательный промежуточный слой.

Термин «романизация» также требует уточнения. Он не равнозначен «транслитерации» и сам по себе не утверждает первичности или превосходства нелатинского письма: документ ООН, например, называет романизацией широкую транскрипционную систему. В настоящей статье этот термин не используется как название NPL26-A, потому что предметом является самостоятельная орфография, а не преобразование уже существующей графической записи в латиницу. (UNSD; UNSD)

Первичность в этом контексте означает непосредственную запись языка, а не историческое старшинство алфавита. Персо-арабское письмо глубоко укоренено в персидской культуре, но оно не является ни первой письменностью в истории иранских языков, ни единственной графикой новоперсидского: древнеперсидский использовал клинопись, среднеперсидский — в том числе пехлевийское письмо; новоперсидские тексты засвидетельствованы также еврейской, манихейской и сирийской графикой. Современная таджикская кириллица дополнительно показывает, что самостоятельная персидская письменность не обязана проходить через арабографический оригинал. (Iranica Online; Iranica Online)

Обычная персо-арабская орфография без огласовок фонемно недоспецифицирована: она не обозначает явно все фонемные различия. Гласные, передаваемые в NPL26-A буквами a, e, o, обычно не получают отдельного знака; например, написание گرد может соответствовать gard ‘пыль’, gerd ‘круглый’ и gord ‘герой’. Это не омонимия языка, а омография письма: различие существует в персидском, но не выражено данным написанием. Огласовки позволяют записывать обычно пропускаемые гласные, поэтому речь идёт не о принципиальной невозможности арабской графики, а о недостаточности обычного невокализованного письма для явного представления всех сегментных противопоставлений. (UNSD; LAITS Sites)

Неравномерная представленность фонем на письме не меняет их фонологического статуса. Отсутствие обязательного знака для /o/ не делает его «полуфонемой», а регулярное обозначение ā не делает эту фонему более полноценной. Выводить иерархию фонем из графической асимметрии значило бы принимать свойство исторической орфографии за свойство языка.

block-beta
    columns 3

    L["Персидский язык выбранной нормы<br/>Фонемная и морфологическая структура"]:3

    space:3

    N["NPL26-A<br/>gard · gerd · gord"]
    space
    A["Персо-арабская запись без огласовок<br/>گرد"]

    space:3

    space:2
    O["Не обозначено в данном написании:<br/>различие a / e / o"]

    L -- "Орфографическое кодирование" --> N
    L -- "Орфографическое кодирование" --> A

    A -- "× Транслитерация:<br/>не путь определения NPL26-A" --> N
    A --> O

    style N stroke-width:2px
    style A stroke-width:2px,stroke-dasharray:6 4
    style O stroke-dasharray:2 3

Язык и две его графические проекции. Различия, не выраженные в невокализованном написании, сохраняются в самом языке. NPL26-A представляет языковые формы непосредственно, а не воспроизводит неполноту другой орфографии.

1.3. Что означает «полнота»

Полнота не означает, что обычное написание обязано одновременно содержать узкую фонетическую транскрипцию, этимологию, синтаксическое дерево и сведения о рукописном оригинале.

Для научного употребления необходимы согласованные уровни:

Уровень Что он представляет
Основная орфография Нормативные слова, словоформы и связный текст
Морфологическая разметка Основы, аффиксы, клитики, алломорфы
Фонологическая и просодическая запись Сегментную структуру, слогоделение, акцентуацию
Фонетическая транскрипция Конкретное произнесение
Историко-филологическая запись Этимологические различия и особенности источника

Основная орфография должна допускать переход к этим уровням, но не подменять их. Например, наличие дефиса в нормативном написании не должно автоматически означать паузу, границу слога или окончательное решение вопроса о статусе морфемы.

1.4. Область применения

Основной профиль настоящей спецификации — современный литературный персидский Ирана с шестичленной системой гласных и объединённым увулярным рядом, то есть без обязательного противопоставления исторических q и ġ.

Это определённый фонологический профиль, а не утверждение об одинаковом произношении всех носителей. Для дари, таджикского и исторических стадий персидского нельзя автоматически применять тот же набор слияний. Например, в описании кабульского дари Baker фиксирует восемь гласных и различение /q/ и /ɣ/, отсутствующее в выбранном здесь основном иранском профиле. Раздельного подхода к современному иранскому, классическому, афганскому и таджикскому материалу требуют и рекомендации Iranian Studies. (Cambridge University Press)

Следовательно, самостоятельная латинская графика осуществима не как неопределённое «письмо всех персидских произношений сразу», а как общая система обозначений с явно названными языковыми профилями.


2. Какие особенности персидского языка должна учитывать система

2.1. Гласные: современная система и исторические соответствия

Для выбранного иранского профиля необходимо последовательно различать:

a, e, o, ā, i, u.

Обозначения a и ā сохраняют традиционную связь с противопоставлением краткого и долгого гласного. Однако в современном языке различие между соответствующими категориями нельзя исчерпать одной длительностью. Существенны также качество гласного и его фонологическое поведение. Toosarvandani рассматривает именно несводимость современной системы к простому противопоставлению трёх кратких и трёх долгих звуков одинакового качества. (UCSC People)

Для орфографии вывод однозначен:

a и ā — разные буквы для разных нормативных гласных категорий. Макрон не означает требования произносить любую ā ровно вдвое дольше любой a.

Аналогично, запись e вместо a не должна определяться отдельным слуховым впечатлением. Необходимо различать позиционную реализацию одной категории, устойчивый лексический вариант и действительное междиалектное соответствие. Последнее может потребовать другого профиля записи, а не произвольного чередования букв внутри одного текста.

Историческая перспектива требует дополнительных возможностей. Для ранненовоперсидского обычно различают краткие a, i, u и долгие ā, ī, ū, ē, ō. В современном иранском персидском исторические ē и ī, с одной стороны, ō и ū — с другой, совпали. Одновременно исторические краткие i, u получили современные соответствия e, o. (Iranica Online)

Поэтому нельзя использовать современную шестигласную запись как единственное представление исторического материала. Для исторического анализа должны быть доступны ī, ū, ē, ō, но их распределение устанавливается по историческим данным, а не восстанавливается механически из современного i или u.

Практический критерий здесь следующий: не смешивать различия выбранного языкового состояния, но и не приписывать ему различия другого состояния.

2.2. Согласные: фонемные противопоставления и исторические буквы

Наиболее очевидные требования связаны с обозначением согласных, для которых общеупотребительные значения базовых латинских букв недостаточны или неоднозначны:

/tʃ/, /dʒ/, /ʃ/, /ʒ/, /x/, увулярного согласного, /j/ и гортанной смычки.

Для всех этих случаев уже существуют научные решения. Иранская система, принятая ООН в 2012 году, использует, в частности, č, j, š, ž, x, q, y и специальный знак гортанного согласного. Здесь j обозначает аффрикату /dʒ/, а y — палатальный аппроксимант /j/. (UNSD)

Отдельная задача — установить, какие различия исходного письма не являются фонемными в выбранной разновидности персидского. Арабские межзубные и эмфатические согласные при освоении слов обычно совпали с персидскими /s/, /z/, /t/; исторические /ḥ/ и /h/ также не образуют соответствующего противопоставления в основном литературном иранском профиле. Gazsi рассматривает эти соответствия как результат фонологической интеграции заимствований. (Language Science Press)

Отсюда следуют два допустимых, но различных решения:

  • в фонемно ориентированной записи одинаковая современная фонема передаётся одинаково;
  • в этимологически расширенной записи исторические источники этой фонемы могут различаться.

Второе решение не делает всю систему автоматически транслитерацией. Но сами дополнительные различия следует называть этимологическими, а не дополнительными современными фонемами.

2.3. Фонотактика, слог и позиционные изменения

В традиционных описаниях персидского начало слога допускает не более одного согласного, а конец — до двух. Начальные группы согласных в освоенных заимствованиях могут устраняться посредством вставки гласного. Вместе с тем вопрос об обязательности начального гортанного согласного влияет на выбор формулы слога: CV(C)(C) или (C)V(C)(C). (ROA)

Для письма важны три разграничения.

Лексикализованная вставка гласного должна обозначаться. Если гласный входит в нормативную персидскую форму заимствования, его нельзя опустить ради сходства с языком-источником.

Предсказуемая реализация согласного не требует новой буквы. Изменение места артикуляции, степени придыхания или длительности само по себе не создаёт нового орфографического элемента.

Слоговая граница не тождественна морфологической. В записи mi-xānam дефис может обозначать приставочный блок, но из него нельзя выводить слогоделение всей формы.

Поэтому основная графика должна сохранять нормативные сегменты, а специальная запись слогоделения — использовать собственный знак, например точку: xā.ne. Дефис для этой цели не используется.

2.4. Геминация

Удвоенные согласные нельзя считать исключительно наследием арабской графики. Hansen и Myers экспериментально исследовали персидское противопоставление одиночных и долгих согласных; в числе исходных примеров приводится пара:

banā ‘постройка’ — bannā ‘строитель’.

Следовательно, отказ от обозначения геминации способен объединить действительно различные формы. (Cambridge University Press)

Установленное решение — удвоение соответствующей буквы: nn, ll, rr и т. д. Оно применимо также к другим согласным, если удвоение входит в принятую нормативную форму.

Однако персидская орфография не должна автоматически воспроизводить любое удвоение арабского этимона. Нормативный объект — персидское слово. При позиционном ослаблении геминаты может сохраняться морфологически постоянное написание, например xatt — xatti, но это уже явно оговорённая морфографическая конвенция, а не запись фактической длительности каждого произнесения.

2.5. Гортанная смычка и зияние — разные явления

Гортанный согласный нельзя смешивать ни с паузой, ни с любым переходом между гласными.

Обсуждение начальной гортанной смычки в персидском не завершилось единым анализом. Pirhayati сопоставляет несколько подходов к её фонемному или вставному статусу. Поэтому отсутствие начального знака в практической орфографии допустимо обосновывать предсказуемостью его употребления, но не следует выдавать за доказательство общепринятой фонологической теории. (JLW Razi University)

Для внутренней позиции ситуация иная: различие между отсутствием согласного и сохраняемым гортанным элементом может быть лексически существенным. Проект Dabire, например, использует противопоставление bad ‘плохой’ и baʾd ‘после’ как аргумент в пользу соответствующего различения. (IDA)

Отсюда выводится требование:

Не обозначать автоматически каждый гортанный приступ, но сохранять гортанный элемент нормативной словоформы независимо от его возможного ослабления в быстрой речи.

И обратно: нельзя механически ставить гортанный знак на месте каждой исторической арабской буквы, если соответствующий элемент не входит в принятую современную форму.

2.6. Y и зияние: почему общего запрета на iy недостаточно

Последовательность, приблизительно реализуемая как [ijV], допускает разные анализы. В ней может присутствовать лексическое /j/, морфологически обусловленный связующий элемент или только фонетический переход после /i/.

Эти случаи нельзя объединять по одному признаку «слышится глайд». Глайд может быть самостоятельным согласным; термин не означает автоматически нефонемность.

Исследование Ariyaee и Jurgec показывает, что на границе основы и суффикса в разговорном персидском встречаются сохранение зияния, удаление гласного и вставка согласного. Распределение зависит не только от соседних звуков. Авторы также отмечают трудность акустического разграничения некоторых вставных глайдов и непрерывных переходов между гласными. Это исследование морфологических границ, а не доказательство единственного анализа всех слов с iV. (Koorosh Ariyaee)

Предложения не писать предсказуемый переход после i существовали и в более ранних научно ориентированных разработках. Maleki в Dabire предлагает siâh, рассматривая соответствующий [j] как фонетический переход; одновременно другие случаи с y трактуются отдельно. Следовательно, сама идея не является ни новой, ни заведомо ненаучной. Вопрос заключается в её распределении и доказательности конкретного анализа. (IDA)

Для орфографии необходимо различать три правила.

Лексическое правило. Установленное /j/ основы обозначается буквой y. Ослабление его реализации не является основанием для изменения написания.

Морфологическое правило. Связующий элемент записывается в соответствии с конкретной конструкцией. Если y входит в нормативную форму изафетного соединения, его написание не зависит от того, считают ли этот элемент частью основы.

Фонетическое правило. Чисто артикуляционный переход не получает букву автоматически.

Отсюда следует важное ограничение: непринадлежность элемента корню ещё не означает, что он не должен обозначаться в словоформе. Орфография связного текста представляет словоформы и конструкции, а не только глубинные морфемы.

Практическое различие видно в сопоставлении:

xāne-ye — изафетная форма; xāne-am — ‘мой дом’; pā-yam — ‘моя нога’.

Распределение связующего y в местоименных формах после ā, u отличается от его распределения в изафете. Поэтому одинаковый графический рецепт для любых двух соседних гласных непригоден. (LAITS Sites)

Для лексических случаев, в которых анализ остаётся конкурирующим, научная орфография вправе установить устойчивую конвенцию. Ниже принимаются xiyābān, biyābān, siyāh. Это нормативный выбор консервативной записи, а не утверждение, что написание само доказывает единственно возможное фонемное представление /ijV/.

Наконец, формы mi-āyad и разговорное miyād нельзя сопоставлять простым перемещением одной буквы. В литературной форме y находится после ā в основе āy-. Соответственно, происхождение перехода после i в разговорной форме требует отдельного морфонологического анализа.

2.7. Просодия: ударение, акцентная структура и паузы

Персидская акцентуация связана с морфологией и синтаксисом. Для многих именных форм характерна выделенность последнего слога; присоединение клитики может не переносить её, тогда как словообразовательный или словоизменительный суффикс способен менять акцентную структуру. В глагольной системе важны приставочные показатели и различие между основой и личным окончанием. (LAITS Sites)

Теоретическая интерпретация этих явлений неодинакова. Наряду с описанием словесного ударения существуют анализы, связывающие выделенность с постлексическим распределением тона. Rahmani, Rietveld и Gussenhoven приводят экспериментальные аргументы против обязательной лексической спецификации ударения или тона в персидском. (PLOS)

Для орфографии это не препятствие, а основание разделить две задачи:

нормативную акцентуацию форм можно обозначать независимо от того, какая теория объясняет её распределение; интонацию конкретного высказывания необходимо записывать отдельно.

Обычная орфография не должна вводить подобие китайских тоновых букв без установленного лексического противопоставления. Но научная система обязана иметь средства для явного обозначения акцента, интонационной границы и паузы, когда они составляют предмет анализа.

2.8. Морфология: устойчивые основы, алломорфы и заимствованные модели

Требование сохранять корни не означает, что все формы лексемы необходимо свести к одной буквенной последовательности.

В персидском следует различать основы настоящего и прошедшего времени:

rav- / raft-, bin- / did-, xān- / xānd-.

Это реальные отношения между основами, а не орфографические искажения одного неизменного корня. Личные окончания и структура простых и составных глагольных форм должны записываться так, чтобы эти основы оставались распознаваемыми. (LAITS Sites)

Аналогично, отношения zende — zendegi, nevisande — nevisandegān требуют передачи нормативных форм, а не механического присоединения абстрактных суффиксов без учёта алломорфии.

Для множественного числа необходимо учитывать как суффиксальные образования, так и заимствованные модели. Perry показывает, что различие между «арабскими» и «персидскими» парадигмами не совпадает полностью с происхождением слова. Ломаное множественное число встречается и у неарабских основ, например bandar — banāder. Формы harfhā ‘высказывания, замечания’ и horuf ‘буквы’ демонстрируют также семантическую специализацию разных образований. (Academia)

Следовательно, этимологическая маркировка согласных не заменяет морфологического описания. Дополнительная буква для исторического арабского источника /z/ может быть полезна филологу, но сама по себе не сообщает, какое множественное число употребляется у конкретной лексемы.

2.9. Синтаксис и графические границы

Для связного персидского текста особенно существенно обязательное обозначение изафета. Оно должно зависеть от наличия конструкции, а не от того, выражен ли соответствующий показатель отдельным знаком в исходном письме.

Не менее важно сохранять различие между самостоятельным словом, присоединяемым элементом и компонентом составного сказуемого. Например:

ketāb-e man, ketāb-am, ketāb rā, kār kardan, kār mi-konam.

Система письма не должна сливать эти образования по одному принципу «всё произносится без паузы». В обычном нейтральном порядке персидский глагол тяготеет к концу предложения, но порядок компонентов и границы конструкций несут информацию, которую нельзя перестраивать при смене графики. (ROA)

Латинская запись сохраняет исходный порядок слов. Пунктуация обозначает структуру письменного высказывания; фонетические паузы при необходимости указываются дополнительной разметкой. Гортанный знак, дефис и знак паузы имеют разные функции.

2.10. Какие омонимы следует сохранять

Научная запись должна устранять искусственную омографию, вызванную потерей языковых различий. Она не обязана устранять реальную омонимию языка.

В современном иранском персидском ‘молоко’ и ‘лев’ совпадают как šir. В таджикском соответствующие слова различаются: шир и шер. Обратный случай представляют иранские pul ‘деньги’ и pol ‘мост’, которым в таджикском соответствует одинаковая форма пул. Эти различия рассматриваются в исследовании персидско-таджикской конверсии Merchant, Ramarao и Tang. (arXiv)

Из этого следует:

Современная иранская запись не должна искусственно превращать šir ‘лев’ в отдельную фонемную форму ради устранения омонимии. Но историческая запись обязана сохранить šēr / šīr, когда такое противопоставление соответствует описываемому состоянию языка.

Таджикская письменность подтверждает осуществимость полноценной алфавитной записи, но не предоставляет готовой таблицы автоматического преобразования всех иранских форм: фонологические слияния в двух разновидностях различны.


3. Требования к научной латинской орфографии

Из рассмотренных свойств выводятся десять требований.

Код Требование Проверяемое следствие
R1 Определённость языкового профиля Современные и исторические различия не смешиваются без обозначения
R2 Полное обозначение гласных a, e, o, ā, i, u различаются во всех позициях
R3 Однозначная передача согласных s/š, z/ž, k/x, аффрикаты и y не смешиваются
R4 Сохранение количества согласных и значимых гортанных элементов banā/bannā, bad/baʾd не объединяются
R5 Явная политика зияния Лексическое, морфологическое и фонетическое y не подчиняются одному поверхностному правилу
R6 Морфологическая устойчивость Основы и модели образования сохраняются при позиционных реализациях; реальные алломорфы признаются
R7 Полная запись грамматических связок Изафет и присоединяемые элементы не опускаются
R8 Согласованные границы Пробел, дефис, морфемная и слоговая границы разграничены
R9 Просодическая расширяемость Можно явно обозначить акцент, слогоделение и просодические границы
R10 Техническая воспроизводимость Заданы точные символы, нормализация текста и версия спецификации

R1–R9 описывают содержательные требования. R10 обеспечивает возможность выполнять их одинаково в разных публикациях и программных средах.


4. Что уже решено существующей практикой

4.1. Транслитерационные и библиографические стандарты

DMG представляет влиятельную традицию научной передачи арабской графики, закреплённую в меморандуме 1935 года. Её принципиальная ценность для настоящей задачи — разработанные средства различения исторических согласных и последовательность научной нотации. Однако задача передачи графических источников не равнозначна созданию первичной орфографии современного персидского. (Deutsche Morgenländische Gesellschaft)

ALA–LC также нельзя описывать как простую запись только видимых букв: её персидские правила предусматривают добавление кратких гласных, отсутствующих в оригинале. Следовательно, присутствие всех гласных ещё не определяет систему как фонемную. Библиографическая романизация может одновременно восстанавливать произношение и сохранять историко-графические различия. (Bibliothèque du Congrès)

ISO 233-3:2026, третья редакция, опубликованная в августе 2026 года, определяет свою задачу как транслитерацию персидско-арабских знаков для информационной и библиографической обработки. Это самостоятельная полезная функция, но её нельзя без дополнительных правил отождествлять с нормой первичного письма. В настоящем сопоставлении используется официально опубликованная область применения ISO; закрытые таблицы новой редакции не используются для посимвольных выводов. (ISO)

4.2. Международная романизация географических названий

BGN/PCGN 1958, в редакции, проверенной в 2019 году, прямо предусматривает обращение к справочным источникам для установления нормативных гласных и устранения диалектной или индивидуальной вариативности. Таким образом, даже практическая географическая романизация не сводится к записи случайно услышанного произнесения. (Gouvernement du Royaume-Uni)

UN 2012 — наиболее непосредственно подходящий источник сегментного набора. Официальное описание характеризует её как широкую транскрипцию и указывает на неполную обратимость относительно исходного письма. Система содержит полные гласные, č, š, ž, x, объединённое q, правила удвоения и изафета. (UNSD)

Важно не преуменьшать её полноту: она регулирует не только отдельные согласные. В исходном предложении присутствуют также правила соединительных форм -o/-yo, в том числе в числительных. Но это ещё не общая спецификация записи всей персидской морфологии и просодии. (UNSD)

4.3. Иранистическая издательская практика

Рекомендации Iranian Studies используют современные a, e, o, ā, i, u, но предпочитают диграфы ch, sh, zh, kh, gh. Они различают исторические gh/q, а в ряде случаев сохраняют конечное h, не обозначающее согласного современного произношения. Правила изафета сформулированы явно, тогда как часть дефисных написаний оставлена авторскому выбору. (Association for Iranian Studies)

Encyclopaedia Iranica использует развитую филологическую систему с č, š, ž, а также этимологическими согласными. Однако её конвенции не совпадают с чисто современной фонемной записью: например, сохраняется историческое конечное -a в соответствующих персидских словах вместо современного -e. (Iranica Online)

IJMES представляет другую устойчивую традицию. В ней для персидского прямо предписываются i, u, а не e, o; долгие обозначаются ā, ī, ū. Такая запись может последовательно различать категории, но требует иной интерпретации букв при чтении современного иранского материала. Она не «теряет» e/o обязательно, а кодирует соответствующие категории другими знаками. (Cambridge University Press)

Уже это сопоставление показывает, что единственного всемирного посимвольного стандарта научной персидской латиницы нет. Существует устойчивый круг совместимых решений, внутри которого различаются цели и степень этимологичности.

4.4. Первичная латинская запись

Dabire непосредственно рассматривает правила письма слов, сложных образований и грамматических конструкций, а не только таблицу соответствий. Его значение для настоящей задачи — постановка орфографических вопросов и признание морфологической устойчивости. Однако отдельные решения, включая c для /tʃ/ и некоторые правила гортанного согласного или зияния, не являются общепринятой иранистической нормой. (IDA)

Alefbā-ye 2om и связанные с ним материалы FIAS важны как практическое применение латиницы к обучению и связным текстам. На сайте FIAS представлен учебник Mā fārsi balad-im! Hamid Farroukh. Это свидетельство применимости соответствующего типа письма за пределами списков собственных имён, но не самостоятельное доказательство правильности каждого фонологического решения. (Persian Manual)

4.5. Сопоставление основных графических решений

Ниже приведены не все возможные романизации, а документированные решения, непосредственно существенные для выбора научной графики.

Значение UN 2012 Iranian Studies Encyclopaedia Iranica Dabire
/tʃ/ č ch č c
/dʒ/ j j ǰ j
/ʃ/ š sh š š
/ʒ/ ž zh ž ž
/x/ x kh x
Палатальный /j/ y y y y
Исторические q/ġ Объединённое q q/gh q/ḡ Объединённое q
Современные гласные a e o ā i u a e o ā i u Преимущественно тот же набор, с филологическими конвенциями a e o â i u

Таблица составлена по официальным документам и авторскому описанию Dabire. Она показывает пересечение традиций, а не статистически измеренную частотность их употребления. (UNSD)

Для š/ž выбор особенно хорошо обоснован. Они уже используются в международной и иранистической записи; переход к другим диакритическим обозначениям не добавляет различений. Более того, s̄/z̄ в прежней системе романизации Ирана имели другие, этимологические значения — не /ʃ/ и /ʒ/. Повторное назначение таких знаков создавало бы дополнительный конфликт чтения. (UNSD)

4.6. Какие требования покрываются не полностью

Требование Уже существующий механизм Что требуется закрепить дополнительно
R2: полные гласные UN 2012; современные иранистические схемы; вокализованная библиографическая романизация Выбрать современную или историческую интерпретацию
R3: специальные согласные č/š/ž/x/j/y и альтернативные диграфы Зафиксировать один набор без смешения
R4: геминация Удвоение буквы Отделить современную норму от механического копирования арабского удвоения
R4: гортанный согласный Апострофоподобные знаки; ʾ/ʿ Развести фонологическую и этимологическую функции
R5: зияние Лексические написания; правила отдельных аффиксов; предложения о предсказуемых глайдах Установить единый порядок применения правил
R6–R8: морфология и границы Грамматические описания; издательские дефисы; правила Dabire Выбрать воспроизводимую норму связного текста
R7: изафет UN 2012 и иранистические правила Сделать его обозначение обязательным во всех текстах
R9: просодия Фонологические исследования и транскрипция Определить основной и полностью акцентуированный режимы
R10: техническая форма Unicode Зафиксировать точные символы и нормализацию

Основной недостаток существующей практики — не отсутствие подходящего алфавита, а неполная согласованность орфографических правил поверх него.


5. Выбор модели

5.1. Критерии выбора

При равной способности передавать языковое различие предпочтение отдаётся решению, которое:

уже закреплено в научных или официальных документах; не создаёт неоднозначных буквосочетаний; требует меньше специальных исключений; допускает последовательную морфологическую разметку.

Например, sh вполне может служить однозначным обозначением /ʃ/ при наличии правил разграничения диграфа и последовательности /s+h/. Но š позволяет обойтись без дополнительного правила для этого случая. Это функциональный аргумент, а не утверждение о лингвистической неправильности диграфов.

Для j/y принимается распределение UN 2012, удобное для связного текста: j = /dʒ/, y = /j/. В фонетической транскрипции IPA остаются собственные значения знаков.

5.2. Две модели

Вводятся два идентификатора.

NPL26-A — основная фонемно ориентированная модель современного литературного иранского персидского.

NPL26-E — та же основа с дополнительным этимологическим различением выбранных согласных.

Название НПЛ‑26 и эти идентификаторы вводятся настоящей спецификацией; они не обозначают ранее утверждённый международный стандарт.

Параметр NPL26-A NPL26-E
Современные гласные a e o ā i u Те же
Исторические источники /s/ Не различаются Могут различаться как s, ṯ, ṣ
Исторические источники /z/ Не различаются z, ḏ, ż, ẓ
Исторические h/ḥ и t/ṭ h, t h/ḥ, t/ṭ
Исторические q/ġ q q/ḡ
Исторические источники гортанного Единое ʾ по современной норме Допускается различение ʾ/ʿ
Морфология, изафет, границы По правилам ниже Те же

Набор этимологических различий в модели E использует уже существующие иранистические знаки, а не новые произвольные символы. Их современные звуковые значения при этом не меняются: в таком профиле не предписывает произносить персидское слово с арабским [θ]. (Iranica Online)

Для основной исследовательской работы рекомендуется NPL26-A. Модель E целесообразна для задач, где исторический источник согласного регулярно участвует в аргументации. Дополнительная этимологическая информация не должна становиться обязательной нагрузкой всех цитат и парадигм.


6. Нормативная спецификация NPL26-A

Ниже слово «пишется» обозначает правило принимаемой системы, а не утверждение, что другие научные конвенции невозможны.

6.1. Алфавит

Гласные

Буква Основное значение в выбранном профиле
a Передний низкий гласный, ориентировочно /æ/
ā Низкий задний гласный, ориентировочно /ɒ/
e /e/
i /i/
o /o/
u /u/

Эти значения не являются узкой транскрипцией всех допустимых реализаций.

Согласные и вспомогательное w

Буквы Значения
b p t d k g Соответствующие смычные
č j /tʃ dʒ/
f v s z š ž x h Соответствующие щелевые; š = /ʃ/, ž = /ʒ/, x = /x/
q Объединённая увулярная фонема выбранного иранского профиля
m n l r Соответствующие сонорные
y Палатальный /j/ и закреплённые правилами связующие употребления
ʾ Сохраняемый нормативной формой гортанный согласный
w Неслоговой элемент в нормативных сочетаниях, прежде всего ow

Таким образом, основной набор совпадает по большей части с уже разработанным набором широкой иранской транскрипции. Это результат выбора по сформулированным критериям, а не требование следовать названию определённого проекта.

6.2. Гласные и нормативная форма слова

Все гласные обозначаются. Макрон в ā обязателен.

ā, i, u не заменяются буквенными удвоениями aa, ii, uu. Последовательность двух гласных букв обозначает последовательность гласных, а не условную долготу одного.

Сохраняются нормативные ey и ow. Их написание не меняется при отдельной монофтонгической реализации. Вопрос о том, анализируются ли они как дифтонги или как последовательности гласного и неслогового элемента, рассматривается отдельно.

Исторически непроизносимые буквы исходного письма в основной профиль не переносятся:

xāne, не xāneh; xāb, не xvāb; xāndan, не xvāndan.

Реальный /h/ сохраняется, например в rāh. Исторические формы с лабиализованным согласным или xw допустимы в исторической записи, но не вводятся в современное слово ради внешнего сходства с источником. Развитие исторического и его утрата в новоперсидском описаны Paul. (Iranica Online)

6.3. Y и последовательности гласных

Принимается следующий порядок правил.

А. Лексическая основа. Сохраняется установленное y. Для обсуждавшегося спорного класса нормативно закрепляются:

xiyābān, biyābān, siyāh.

Эти формы не сокращаются по общему правилу iy → i.

Б. Изафет. После конечного гласного пишется -ye, включая позицию после i:

xāne-ye, dānā-ye, dānešju-ye, irāni-ye.

В. Другие присоединяемые элементы. Применяется правило конкретной модели, а не правило изафета:

xāne-am, irāni-am, но pā-yam, mu-yam.

Г. Глагольная граница. В литературных формах сохраняются нормативная основа и продуктивный приставочный блок:

mi-āyad, nemi-āyad.

Присутствие i перед гласной не требует автоматически писать mi-yāyad. Разговорное miyād относится к другому регистровому профилю и не заменяет литературную форму без специального указания.

Д. Отсутствие согласного. Между двумя гласными не вставляется автоматически ни y, ни ʾ. При необходимости явно показать слогоделение оно выносится в фонологическую запись.

Таким образом, правило представляет собой не «писать или не писать любой глайд», а разграничение лексического написания и морфологических моделей соединения.

6.4. Гортанный согласный и геминация

Используется один знак ʾ.

Предсказуемый начальный приступ не обозначается: āb, emruz. Внутренний гортанный элемент нормативной формы сохраняется: baʾd, masʾul, moʾallem.

Знак не удаляется автоматически между гласными или перед согласным. Вместе с тем его наличие определяется принятой персидской формой, а не одним фактом присутствия ʿayn или hamza в этимоне.

Нормативная геминация передаётся удвоением:

banā — bannā, xatt — xatti.

Буква y подчиняется тому же принципу: yy допустимо, когда записывается действительное нормативное удвоение /j/, но не вводится автоматически по арабскому образцу.

6.5. Изафет, аффиксы и клитики

Для обычного текста выбирается умеренное морфографическое членение. Оно делает видимыми наиболее важные границы, не превращая каждое слово в полную морфемную формулу.

Элемент Правило Примеры
Изафет Через дефис ketāb-e, xāne-ye
Приставочный блок mi-/nemi- Через дефис mi-xānam, nemi-xānam
Продуктивные be-/na- Через дефис при прозрачном присоединении be-ravam, na-raftam
Личные окончания простой глагольной формы Слитно с основой raftam, mi-ravand
Присоединяемые местоименные элементы Через дефис ketāb-am, didam-aš
Краткая связка Через дефис xub-am, irāni-am
Перфектное присоединение Через дефис xānde-am
Показатель неопределённости Через дефис ketāb-i, xāne-i
Регулярные суффиксы множественного числа Слитно ketābhā, mardān
Словообразовательные суффиксы Слитно irāni, zendegi, bozorgtar
Самостоятельные предлоги и Отдельно be xāne, ketāb rā
Компоненты составного глагола Отдельно kār kardan, kār mi-konam

Эта таблица закрепляет редакционную конвенцию. Из фонологии не следует, что mi- может писаться только через дефис. Дефис выбран для устойчивости одной научной нормы; слитное написание в другой последовательно устроенной системе само по себе не было бы ошибкой.

При слиянии, затрагивающем форму приставки и основы, не следует создавать ложную прозрачность. Лексикализованные формы типа biyā, biyāyad записываются как нормативные целые; их морфонологическое устройство раскрывается в отдельном анализе.

Для соединительного элемента принимаются -o/-yo там, где выбирается соответствующая нормативная конструкция, например bist-o yek, si-yo yek. Самостоятельное va пишется отдельно. Наличие этих вариантов не разрешает свободно заменять один другим в цитате; сохраняется форма цитируемого регистра. Такое различение соединительных форм уже предусмотрено иранским предложением для ООН. (UNSD)

6.6. Морфологическая разметка

Обычное написание и аналитическая сегментация различаются:

Обычный текст Морфологическая строка
mi-xānam mi-xān-am
ketābhā ketāb-hā
ketāb-am ketāb=am, при анализе элемента как клитики

В аналитической строке используются принципы Лейпцигских правил: дефис для аффиксальной границы, знак равенства для клитической. Это не означает, что обычный орфографический дефис во всех случаях соответствует одному морфологическому статусу. (Institut Max Planck d’Anthropologie Évolutive)

При конкурирующих анализах синтаксической конструкции основная запись остаётся постоянной, а различие теорий показывается в аналитической строке.

6.7. Акцентуация и просодический режим

Вводятся два режима представления одной модели.

Обычный NPL26-A использует установленную морфологическую структуру для чтения регулярной акцентуации. Акут обязателен там, где требуется обозначить отклонение от принятой модели или где существенное противопоставление иначе не выражено.

NPL26-A/P — полностью акцентуированное представление для фонологического, учебного или просодического обсуждения. В нём акут ставится на гласном каждого акцентно самостоятельного элемента в принятом нейтральном чтении.

Например:

ketāb → ketā́b; ketāb-i → ketā́b-i; mi-xānam → mí-xānam; nemi-xānam → némi-xānam; raftam → ráftam; xānde-am → xāndé-am.

Акут обозначает выбранную нормативную акцентуацию, а не автоматически измеренный пик основного тона. Описание реального фокуса, деакцентуации и интонации выполняется в отдельной просодической строке. Морфологическая обусловленность персидской выделенности и её отличие от простой фиксированной позиции в графическом слове подробно рассматриваются в исследованиях Hosseini и Rahmani. (ROA)

Тем самым система не скрывает просодию, но и не заставляет обычную цитату изображать акустические свойства неизвестного конкретного произнесения.

6.8. Техническая форма

Для нормативного текста устанавливаются:

Unicode NFC; ā, č, š, ž без замены похожими символами; ʾ U+02BE для гортанного знака; одинаковая обработка регистра и диакритики во всём документе.

Unicode-нормализация объединяет канонически эквивалентные представления; она не означает удаления диакритики. Комбинируемые знаки сами по себе корректны, в том числе в ā́. Требование относится к воспроизводимости текста, а не к тому, чтобы каждая графема обязательно состояла из одного кодового пункта. (Unicode)

Для поиска можно создавать дополнительные ключи без части диакритики, но они не заменяют нормативное написание. В основном тексте š → s и ā → a являются потерей различий, а не стилистическим упрощением.


7. Исторический и этимологический материал

7.1. Когда нужна модель E

NPL26-E применяется, когда исторические источники согласных регулярно важны для исследования: например, при обсуждении арабских словообразовательных гнёзд, графических вариантов или истории заимствования.

Эта модель не переводит персидское слово обратно в арабское. Современные гласные и персидская морфология сохраняются; дополнительные знаки сообщают происхождение соответствующих согласных.

Если же предметом цитирования является сам арабский текст, используется система записи арабского с явным указанием смены языка. Персидское заимствование и арабский этимон не следует делать графически неразличимыми.

7.2. Исторические гласные и междиалектные соответствия

Для исторического анализа предусматривается набор:

a, i, u, ā, ī, ū, ē, ō,

с дополнительными согласными различиями, необходимыми конкретному источнику. Профиль обозначается указанием периода и традиции чтения. При необходимости сохраняются q/ḡ, w и историческая лабиализация.

Это не универсальная реконструкция произношения «всего классического персидского». Miller показывает, что хронология и география изменений не совпадают, а обозначение «классический персидский» само по себе не задаёт единого фонологического состояния. Его сопоставление исторических лексических классов даёт подходящий механизм для согласования разных профилей без смешения их гласных. (Academia)

Для древне- и среднеперсидского сохраняются специальные принятые в соответствующих областях системы. Современная орфография не должна заменять собой транслитерацию клинописного текста или различение транслитерации и транскрипции пехлеви; такое разграничение принято и в правилах Encyclopaedia Iranica. (Iranica Online)

Таким образом, межъязыковая и историческая совместимость достигается сопоставлением явно обозначенных форм, а не искусственным сближением современного написания с предполагаемым праязыковым корнем.


8. Практическая памятка NPL26-A

8.1. Контрольные написания

Что необходимо различать или сохранять Нормативная запись
Гласные a/ā bad — bād
Разные гласные одного согласного состава gard — gerd — gord
Одиночный и удвоенный согласный banā — bannā
Отсутствие и наличие гортанного элемента bad — baʾd
Современное конечное /e/ xāne, не xāneh
Лексическое и закреплённое нормативное y xiyābān, biyābān, siyāh
Изафет после согласного ketāb-e man
Изафет после гласного xāne-ye man, irāni-ye javān
Присоединение без автоматического y xāne-am, irāni-am
Связующее y в соответствующей модели pā-yam, mu-yam
Приставочный блок и основа mi-xānam, nemi-xānam, mi-āyad
Разные основы одной лексемы rav-/raft-, bin-/did-, xān-/xānd-
Продуктивное множественное число ketābhā, mardān
Лексически особая форма множественного числа harfhā — horuf
Составной глагол kār kardan, kār mi-konam
Показатель объекта ketāb rā

Таблица представляет применение выбранных правил. В частности, выбор xiyābān здесь является правилом NPL26-A, а не ссылкой на якобы единогласное решение всех фонологических школ.

8.2. Связный текст

Специально составленный пример:

Man in ketābhā rā dar xāne-ye dust-am xānde-am. Dust-am har ruz be ketābxāne mi-ravad. Mā emruz dar xiyābān qadam mi-zanim.

Я прочитал эти книги в доме моего друга. Мой друг каждый день ходит в библиотеку. Сегодня мы гуляем по улице.

В этом тексте представлены полные гласные, изафет, местоименное присоединение, перфектная форма, приставочный блок, составной глагол и самостоятельный показатель объекта. Для чтения не требуется восстанавливать исходную арабскую графику.

8.3. Формулировка для методологического раздела научной работы

Персидский материал передаётся в системе NPL26-A — нормализованной научной латинице современного литературного иранского персидского. Система обозначает все гласные, различает нормативные согласные и геминацию, последовательно передаёт изафет и использует установленные правила графического членения. Позиционные реализации не изменяют написание основ. Разговорные и исторические формы маркируются отдельно. Этимологические различия согласных при необходимости приводятся в модели NPL26-E; фонетическая транскрипция и морфологическая сегментация не смешиваются с основной орфографией.


Заключение

Для научной записи персидского языка не требуется изобретать новый алфавит. Большинство необходимых обозначений уже выработано. Система UN 2012 предоставляет практически весь подходящий сегментный набор; иранистическая практика — развитые филологические обозначения; грамматические и фонологические исследования — основания для записи морфологии, зияния и просодии.

Однако ни таблица географической романизации, ни библиографическая транслитерация сами по себе не задают полностью норму работы со связным персидским текстом. Необходимо дополнительно закрепить языковой профиль, распределение y, обращение с гортанным согласным, графические границы и режим просодической записи.

Для поставленной задачи принимается NPL26-A. Её близость к UN 2012 и к фонографическому направлению Alefbā-ye 2om следует из совпадения функциональных требований, а не из заранее выбранной принадлежности к одному проекту.

Содержательно система представляет собой самостоятельную фонемно ориентированную орфографию с ограниченными и явными морфографическими конвенциями. Она не требует знания арабского написания для каждого слова, но позволяет подключать этимологический слой там, где он действительно нужен исследованию.

Поэтому NPL26-A определяется не как транслитерация или романизация готового текста, а как прямое орфографическое представление выбранной нормы персидского языка.

Принцип её долговременной устойчивости состоит в следующем: изменение научного анализа не должно незаметно менять основной текст, а условное написание не должно выдаваться за доказательство фонологической теории. Нормативная форма, аналитическая интерпретация и документальный источник сохраняются как связанные, но различимые объекты.


Литература и нормативные документы

Лингвистические исследования

Ariyaee, K.; Jurgec, P. 2021. Variable Hiatus in Persian is Affected by Suffix Length. Proceedings of the Annual Meetings on Phonology, 9. DOI: 10.3765/amp.v9i0.4919. (Koorosh Ariyaee)

Baker, A. 2016. Dari (Afghan Persian). Journal of the International Phonetic Association, 46(2): 229–234. DOI: 10.1017/S0025100315000390. (Cambridge University Press)

Gazsi, D. 2020. Iranian Languages. В: Lucas, C.; Manfredi, S., ред. Arabic and Contact-Induced Change, 441–457. Berlin: Language Science Press. DOI: 10.5281/zenodo.3744539. (Language Science Press)

Hansen, B. B.; Myers, S. 2017. The Consonant Length Contrast in Persian: Production and Perception. Journal of the International Phonetic Association, 47(2): 183–205. DOI: 10.1017/S0025100316000244. (Cambridge University Press)

Hosseini, S. A. 2014. The Phonology and Phonetics of Prosodic Prominence in Persian. Докторская диссертация, University of Tokyo. (ROA)

Maleki, J. 2008. A Romanized Transcription for Persian. Авторская публикация проекта Dabire, INFOS 2008. (IDA)

Merchant, R.; Ramarao, A. K.; Tang, K. 2025. Connecting the Persian-speaking World through Transliteration. Препринт, arXiv:2502.20047. (arXiv)

Miller, C. Variation in Persian Vowel Systems. Orientalia Suecana, 61 (2012): 156–169. (Academia)

Paul, L. Persian Language i. Early New Persian. Encyclopaedia Iranica. (Iranica Online)

Perry, J. R. 2007. Persian Morphology. В: Kaye, A. S., ред. Morphologies of Asia and Africa, 975–1019. DOI: 10.1515/9781575065663-038. (Academia)

Pirhayati, A. 2024. Revisiting Word-initial Glottal Stops in Persian: Underlying or Epenthetic? DOI: 10.22126/jlw.2024.10677.1765. (JLW Razi University)

Rahmani, H.; Rietveld, T.; Gussenhoven, C. 2015. Stress “Deafness” Reveals Absence of Lexical Marking of Stress or Tone in the Adult Grammar. PLOS ONE, 10(12): e0143968. DOI: 10.1371/journal.pone.0143968. (PLOS)

Toosarvandani, M. D. 2004. Vowel Length in Modern Farsi. Journal of the Royal Asiatic Society, 14(3): 241–251. DOI: 10.1017/S1356186304004079. (UCSC People)

University of Texas at Austin, LAITS. Persian Online: Grammar & Resources. Использованы разделы об ударении, глагольных окончаниях и присоединяемых местоимениях. (LAITS Sites)

University of Texas at Austin, LAITS. Persian Online: The Writing System. (LAITS Sites)

Стандарты, издательские правила и технические конвенции

Islamic Republic of Iran. 2012. New Persian Romanization System. Документ ООН E/CONF.101/118/Rev.1. (UNSD)

UNGEGN Working Group on Romanization Systems. 2013. Persian. Report on the Current Status of United Nations Romanization Systems for Geographical Names, version 4.0. (UNSD)

UNGEGN. Romanization Systems. (UNSD)

BGN/PCGN. Romanization of Persian (Farsi). Система 1958 года, обновление 2019 года. (Gouvernement du Royaume-Uni)

Association for Iranian Studies. Iranian Studies: Transliteration. (Association for Iranian Studies)

Encyclopaedia Iranica. Style Guide, разделы о персидском и исторических иранских языках. (Iranica Online)

Encyclopaedia Iranica. Iran vi. Iranian Languages and Scripts (3) Writing Systems. (Iranica Online)

Encyclopaedia Iranica. Tajik ii. Tajiki Persian. (Iranica Online)

International Journal of Middle East Studies. Translation and Transliteration Guide; Transliteration Chart. (Cambridge University Press)

Library of Congress. 2011. Persian Romanization Table. (Bibliothèque du Congrès)

Deutsche Morgenländische Gesellschaft. Die Transliteration der arabischen Schrift; официальный раздел публикаций о системе 1935 года. (Deutsche Morgenländische Gesellschaft)

ISO. 2026. ISO 233-3:2026. Information and Documentation — Transliteration of Perso-Arabic Characters into Latin Characters — Part 3: Persian Language. (ISO)

FIAS, Committee on Language Planning. Persian Latin Standard: Persian Manual. Материалы, связанные с учебником Mā fārsi balad-im! Hamid Farroukh. (Persian Manual)

Unicode Consortium. Unicode Standard Annex #15: Unicode Normalization Forms. (Unicode)

Max Planck Institute for Evolutionary Anthropology. The Leipzig Glossing Rules. (Institut Max Planck d’Anthropologie Évolutive)

Источниковедческое примечание. Сопоставление охватывает основные непосредственно релевантные нормативные традиции и исследовательские работы, а не претендует на библиографическую полноту всех когда-либо опубликованных романизаций. Электронные документы проверены по состоянию на 7 сентября 2026 года. Полный словарь Alefbā-ye 2om не использовался как проверенный нормативный корпус. NPL26-A — определённая в настоящей статье спецификация письма, а не утверждение о проведённой пословной проверке всей персидской лексики.