Перейти к содержимому
⛪

Церковнославянский текст в гражданский шрифт

Заменяет ѡ, ѧ, ꙋ, ѯ, ѱ гражданскими буквами, раскрывает титла и числа, снимает надстрочные знаки; читает текст из шрифта Ирмологион (UCS)

Инструмент справился с вашей задачей?

Одно нажатие, без регистрации. По ответам мы решаем, какие инструменты дорабатывать первыми.

Ваш ответ здесь будет первым.

Этот инструмент ещё ждёт первого комментария

Нашли приём, остался вопрос или чего-то не хватило — напишите, пригодится следующим. Без почты и пароля · публикуем после проверки, обычно за 1–2 дня

Церковнославянский текст гражданским шрифтом онлайн

Инструмент переписывает церковнославянский текст, набранный в Юникоде, привычными буквами гражданского шрифта. Он заменяет ѡ, ѻ, ѧ, ꙋ, ѯ, ѱ и другие церковнославянские буквы, снимает придыхания и прочие надстрочные знаки, раскрывает сокращения под титлом и переводит буквенные числа в арабские цифры. Вставьте фрагмент Псалтири, молитвы, богослужебного текста или статью из электронного словаря. Результат появится сразу, а под ним — список правок по видам: сколько замен каждого вида и примеры «было → стало».

Меняется письмо, а не язык. Это не перевод на русский: слова, окончания и порядок слов остаются церковнославянскими. «Бл҃же́нъ мꙋ́жъ, и҆́же не и҆́де на совѣ́тъ нечести́выхъ» станет «Блаже́н муж, и́же не и́де на сове́т нечести́вых». Читать стало проще, но «иже» так и осталось «иже». Чтобы понять смысл, нужен русский перевод текста, а не смена шрифта.

Всё считается в вашем браузере: текст и файлы никуда не отправляются. Результат детерминирован: одинаковый текст с одинаковыми настройками всегда даёт одинаковый результат. При настройках по умолчанию повторный прогон уже переведённого текста ничего не меняет.

Обычный современный текст рядом остаётся нетронутым. Слово обрабатывается, если рядом с ним, не дальше восьми слов в той же строке, есть признаки старого письма: надстрочный знак, церковнославянская буква, знак тысяч ҂, глаголица или буквы ѣ, ѳ, ѵ. Одно слово с конечным ъ, одиночное ударение и буквы і, є сами по себе признаками не считаются: они бывают в названиях, в современных словарях и в украинском тексте. Поэтому в русской статье без церковнославянских слов «Коммерсантъ» и «группы A и B» останутся как были. Если же в тексте есть хотя бы одно слово с надстрочным знаком, кроме ударения, или с церковнославянской буквой, дореформенные буквы, конечный ъ и вария переводятся во всём тексте, а не только рядом с ним: в словаре Дьяченко толкование набрано дореформенной печатью, и «замечаетъ», «мненія» становятся «замечает», «мнения». Украинский абзац рядом с цитатой при этом остаётся как был.

Современные буквы или дореформенная гражданская печать

Результат бывает двух видов. «Современные буквы» (по умолчанию) — ѣ становится «е», і — «и», ѳ — «ф», конечный ъ снимается. После ж, ш, щ «ы» меняется на «и», после ж, ш, ч, щ «я» из юса меняется на «а»: «на́шѧ» → «на́ша», «дш҃ы̀» → «души́». «Дореформенная гражданская печать (ѣ, і, ъ)» оставляет ѣ, і, ѳ и твёрдый знак, как в книгах, напечатанных гражданским шрифтом до 1918 года: «Христо́съ воскре́се изъ ме́ртвыхъ».

В обоих режимах церковнославянская грамматика не меняется: окончания -аго, формы «ея» и «-ія» остаются. Так же устроены параллельные издания церковнославянских текстов гражданским шрифтом: «свята́го», «вся́каго», «ея́».

Десятеричное і в дореформенной печати по умолчанию стоит там же, где в церковнославянском тексте: «Філі́ппъ», «Іису́съ». Опция «„і“ по правилу Грота» в тонких настройках оставляет і только перед гласной и в слове «міръ»: «Фили́ппъ», но «Іису́съ». В современных буквах і становится «и», кроме двух случаев. Римская цифра, набранная кириллической І, становится латинской: «ХІХ вѣкъ» → «XIX век», «при Петрѣ І» → «при Петре I». А тонкая настройка «„мір“ (вселенная) — с і» сохраняет «мір», если в источнике он написан через і, тогда как «миръ» (покой), написанный через и, становится «мир».

Правила сверены со стихами Псалтири и Евангелий (Пс 1 и 50, Мф 6, Лк 1, Ин 1), для которых на azbyka.ru есть три параллельные версии: церковнославянская, дореформенная и современная. Слова сравнивались без учёта регистра и ударений. В современных буквах совпадают 98 % слов. В дореформенной печати совпадают 99 %, если не считать двух сознательных отличий: і там, где оно стояло в источнике, и «отъ» с твёрдым знаком. Остальные расхождения — разночтения издателя: например, у него «тма» там, где в церковнославянском тексте «тьма».

Как раскрываются титла: словарь из 317 сокращений

В церковнославянском письме частые и священные слова пишутся сокращённо. Над сокращением стоит титло (҃) или выносная буква под покрытием: «Бг҃ъ» — Бог, «Гдⷭ҇ь» — Господь, «чл҃вѣ́къ» — человек. По правилу такое сокращение не раскрыть, поэтому инструмент пользуется словарём из 317 правил. Основа словаря — открытый проект cslavonic (лицензия MIT); тот же список лежит в модуле Lingua::CU проекта Ponomar. Он дополнен примерами из Unicode Technical Note #41 и словаря Дьяченко, часть раскрытий исправлена по параллельному тексту Библии.

Правило раскрывает основу, а окончание идёт следом, поэтому одно правило работает во всех падежах: «гдⷭ҇ꙋ» → «Го́споду», «ст҃а́гѡ» → «свята́го», «Бцⷣ҇а» → «Богоро́дица». Если в исходном слове стоит ударение, оно сохраняется. Если ударения нет, ставится словарное: «бг҃а» → «Бо́га».

Словарь проверяется раньше чисел. Поэтому «сн҃а» раскрывается в «сы́на», а не в число 251 (200 + 50 + 1). Сокращение, которого в словаре нет, остаётся как есть, с титлом, и попадает в предупреждение «Сокращения под титлом, которых нет в словаре». Раскройте его вручную: показать спорное место честнее, чем угадать.

Опция «Заглавная буква в именах Бога и святых именах» (включена по умолчанию) пишет с заглавной священные имена, раскрытые из-под титла: Бог, Господь, Христос, Иисус, Спас, Богородица, Троица, Израиль, Иерусалим, Мария, Давид. «Господин» и «христианский» остаются со строчной. Слова «сын», «дух», «отче», «дева» не меняются: издатели пишут их с заглавной по смыслу, а по написанию смысл не определить. Регистр остальных имён, набранных строчными, инструмент не меняет, в том числе священных имён, написанных полностью, без титла: «і҆ерꙋсали́мъ» станет «иерусали́м», «наѳана́илъ» — «нафана́ил».

Числа под титлом — в арабские цифры

В церковнославянском тексте числа записывают буквами с титлом: а҃ = 1, і҃ = 10, р҃ = 100. Знак тысяч ҂ ставится перед буквой и относится только к ней: ҂а҃ = 1000, ҂к҃ = 20 000. В словарях вместо него встречается знак ⸒ — он читается так же. Числа от 11 до 19 пишутся с единицей впереди, как и произносятся («единонадесять»): а҃і = 11. Опция «Числа под титлом — арабскими цифрами» включена по умолчанию: «въ лѣ́то ҂зф҃ѕ» станет «в ле́то 7506».

Чтобы не принять слово за число, инструмент проверяет запись. В ней должны быть титло или знак тысяч, только буквы-цифры, никаких ударений и придыханий, только строчные буквы. Сотни, десятки и единицы идут по убыванию (кроме чисел 11–19), каждого разряда не больше одного. Поэтому «г҃а» (две единицы подряд) числом не считается, а «рк҃г» — это 123.

Тьма, легион и более крупные числа (от 10 000 и выше, записанные особыми знаками вокруг буквы) не переводятся, как и ҂҂ для миллионов: в разных источниках один и тот же знак означает разное. Такие места остаются как есть и попадают в предупреждение. Если большое число записано группами через пробел, группы переводятся по отдельности, и инструмент предложит склеить их вручную.

Буквы ѡ, ѧ, ꙋ, ѵ, ѿ, надстрочные знаки и ударения

Омега ѡ и широкое ѻ становятся «о», ѯ — «кс», ѱ — «пс», зело ѕ и земля ꙁ — «з», юс ѧ и ꙗ — «я», ук ꙋ и ѹ — «у», широкое є — «е». Регистр сохраняется: «Ѱалти́рь» → «Псалти́рь». Ижица ѵ читается «в» после а, е, є, если на ней нет ни ударения, ни придыхания, а в остальных случаях — «и»: «Ѱеѵдоапо́столъ» → «Псевдоапо́стол», «Гѵмнасїа́рхъ» → «Гимнасиа́рх».

ѿ — это «от». Твёрдый знак после него остаётся перед е, ю, я: «Ѿѧ́ти» → «Отъя́ти». Перед «и» в дореформенной печати пишется «ъи», а в современных буквах — «ы»: «ѿи́де» → «отъи́де» или «оты́де». Отдельное «ѿ» в дореформенной печати даёт «отъ», в современных буквах — «от». Ерок — надстрочный значок на месте пропущенного ъ — становится твёрдым знаком: «и҆з̾» → «изъ» или «из».

Диграф «оу» сворачивается в «у», когда он записан как ᲂу или когда начальное «оу» стоит с придыханием: «Оу҆бл҃жѝ» → «Ублажи́». Простое «оу» внутри слова не трогается, иначе испортились бы «соучастник» и «поужинать». Для цитат из древнерусских памятников есть опция «Древнерусское „оу“ → „у“»: «A своимъ тиоуномъ не велить соуда» → «А своим тиуном не велить суда». Она меняет и современные слова рядом с церковнославянским текстом, поэтому по умолчанию выключена.

Придыхание, кендема, покрытие и другие надстрочные знаки снимаются. Ударения по умолчанию остаются: вария и камора становятся обычным знаком ударения, а в современных буквах ударение снимается с односложных слов («смерть», «муж»). В режиме «Оставить» современные слова без признаков старого письма остаются как были, вместе со своими ударениями. Режим «Ударения: убрать» снимает знаки ударения над буквами во всём тексте, в том числе в современных строках рядом с церковнославянскими, а буквы й и ё при этом не превращаются в «и» и «е». Церковнославянский вопросительный знак выглядит как точка с запятой: внутри церковнославянского отрывка «;» становится «?», а в русских предложениях остаётся точкой с запятой.

Текст из шрифта Ирмологион (UCS): латиница и цифры вместо букв

Старые документы Word и RTF с церковнославянским текстом часто набраны шрифтами Irmologion ucs, Triodion ucs, Hirmos ucs. Эти шрифты работают в 8-битной кодировке UCS, построенной на Windows-1251: на месте обычного символа шрифт рисует церковнославянскую букву или надстрочный знак. Скопируйте такой текст без шрифта, и вместо «Бл҃же́нъ мꙋ́жъ, и҆́же не и҆́де на совѣ́тъ нечести́выхъ» получится «Бlжeнъ мyжъ, и4же не и4де на совётъ нечести1выхъ». Цифры здесь — надстрочные знаки, «l» — «л» под титлом, «y» — ук с ударением.

Длинный фрагмент инструмент узнаёт сам и предлагает кнопку «Перекодировать» (есть и кнопка «Это не UCS»). Молча он ничего не перекодирует: декодер испортил бы обычный русский текст, превратив цифры в знаки, а «э» в ять. Пока вы не выбрали, результат равен исходному тексту — без полупереведённой латиницы. Короткую строку из нескольких слов детектор может не узнать — тогда вставьте её и включите опцию «Текст из шрифта Ирмологион (UCS)» вручную. После перекодировки текст идёт по обычному пути, и получается «Блаже́н муж, и́же не и́де на сове́т нечести́вых».

Перекодируются только строки с признаками UCS. Русская строка рядом, например «Источник: издание 1900 г., с. 12–14», остаётся как была, а строки, где уже есть символы Юникода (ѣ, знаки ударения, титла), не перекодируются никогда. Если же признаков UCS нет ни в одной строке, опция перекодирует весь текст: так работает ручной режим для короткой строки. Обычный русский текст при этом портится: цифры становятся надстрочными знаками, а «Поэтому» превращается в «Поетому». Тогда над результатом появляется предупреждение с кнопкой «Выключить перекодировку», а новый текст, вставленный вместо прежнего целиком, и загруженный файл выключают опцию сами и снова проходят через детектор.

Таблица перекодировки на 129 символов взята из открытых конвертеров Lingua::CU и cslavonic. Детектор настроен осторожно: на формулах, единицах измерения, кодах и брендах он молчит, но на шахматной записи вроде «е4 Кf3» и нумерации вроде «а1, а2, в1» может ошибиться, поэтому решение остаётся за вами. Файлы в формате HIP (.hip, текст с апострофами вроде «ра'доватися» и знаками «w=») инструмент не читает.

Электронные словари, глаголица, греческие и латинские слова

Церковнославянские словари и библиотеки в интернете обычно хранят текст в настоящем Юникоде, а особые шрифты (например, Ponomar Unicode) только рисуют знаки. Скопируйте статью в обычный редактор, и надстрочные значки могут «съехать» или превратиться в квадратики. Кодировка при этом не сломана, просто в системе нет нужного шрифта. Инструмент переписывает такой текст обычными буквами, и он читается в любом шрифте. Древнерусские цитаты внутри статей тоже обрабатываются: «Ꙁабръꙁдити» → «Забръздити», ъ внутри слова сохраняется.

Глаголица (блок Юникода U+2C00–U+2C5F, 96 знаков) переводится буква в букву в церковнославянскую кириллицу, дальше текст идёт по обычному пути: «ⱄⰾⱁⰲⱁ» → «слово», «ⰳⰾⰰⰳⱁⰾⱏⰹ» → «глаголы». Часть соответствий условна (две глаголические «и», пе, йо, штапик, дервь), о них будет предупреждение. Опция «Глаголицу — в кириллицу» в тонких настройках включена по умолчанию. Глаголические числа не переводятся: числовые значения у глаголических букв другие.

Греческие и латинские слова остаются как были: βαμβάκηρος, lorica curta. Одиночная латинская буква, похожая на русскую, между кириллическими словами старого текста заменяется кириллической: «A своимъ тиоуномъ» → «А своим тиоуном». Если в тексте есть хотя бы одно слово с надстрочным знаком, кроме ударения, или с церковнославянской буквой, в строках русского толкования так же меняются строчная «a» вместо союза и X в «Р. X.»: «фараоном, a после» → «фараоном, а после». Другие одиночные латинские буквы там остаются: перечень «a) b) c)», «витамин C», «оси X и Y». Латинская X перед «века» или «в.» и рядом с другой римской цифрой («X и XI вв.») — римская цифра, она остаётся. Такие замены попадают в предупреждение. Буквы без русского соответствия, например дервь ꙉ и коппа ҁ, остаются на месте и тоже отмечаются, как и незнакомые знаки у букв — например «˜» в «˜Аже».

Церковнославянский в гражданский шрифт для многих файлов

На вкладке «Много файлов» можно выбрать файлы или целую папку либо перетащить их в окно. Все файлы обрабатываются с текущими настройками, результат скачивается ZIP-архивом со структурой папок. Один файл скачивается без архива. Перед обработкой виден предпросмотр правок в первом файле, а в отчёте — какие файлы переведены, какие остались без изменений и где произошла ошибка.

Кодировка каждого файла определяется автоматически: UTF-8 (с BOM и без), UTF-16 или Windows-1251. Файл сохраняется в той же кодировке. Знак ударения и буквы ѣ, ѳ в Windows-1251 не записываются, поэтому такой файл сохранится в UTF-8, и это будет отмечено в отчёте. Нужен результат в Windows-1251 — выберите современные буквы и «Ударения: убрать»: знаков ударения над буквами не останется нигде. Файл останется в Windows-1251, если в тексте нет греческих слов, нераскрытых сокращений, знаков тьмы и легиона и других символов вне этой кодировки.

Файл, похожий на текст из шрифта Ирмологион, при выключенной опции UCS копируется без изменений с пометкой, и предпросмотр первого файла предупреждает об этом заранее: включите опцию и запустите обработку снова. Двоичные файлы и файлы с битой кодировкой тоже кладутся в архив как есть, служебные вроде .DS_Store и Thumbs.db пропускаются. На вкладке «Текст» можно загрузить один текстовый файл (.txt, .md, .csv и другие) размером до 5 МБ и скачать результат в .txt в той же кодировке.

💡

Пример из жизни: статьи церковнославянского словаря для своей картотеки

Составитель словаря копирует статьи из электронной версии церковнославянского словаря. В обычном редакторе заголовки выглядят непривычно: «А҆́бїе» с надстрочными значками, «легеѡ́нъ» с омегой, числа вида «⸒а҃» и знаки тьмы и легиона.

1

Вставляет статью в поле «Церковнославянский текст».

2

Оставляет «Современные буквы» и ударения: в картотеке ударения нужны.

3

Смотрит правки: «А҆́бїе» стало «А́бие», «легеѡ́нъ» — «легео́н», «⸒а҃» и «҂а҃» — «1000».

4

Читает предупреждение: знаки тьмы и легиона оставлены как есть, значения этих чисел он вписывает вручную.

5

Копирует результат кнопкой «Копировать», а пачку сохранённых статей в .txt прогоняет на вкладке «Много файлов».

✅

Статьи читаются обычными буквами в любом шрифте, ударения на месте, а все спорные места собраны в одном списке.

🧠

Знаете ли вы?

📜

Гражданский шрифт ввёл Пётр I: первые книги им напечатаны в 1708 году, а в 1710 году царь утвердил новую азбуку. Церковные книги продолжили печатать прежним, церковнославянским шрифтом.

❓

Вопросительный знак в церковнославянском тексте выглядит как точка с запятой «;» — так же, как в греческом.

🔢

Числа от 11 до 19 записывают с единицей впереди — «а҃і» = 11, — потому что так они и звучат: «единонадесять», то есть «один на десяти».

💻

Правила набора церковнославянского текста в Юникоде описаны в Unicode Technical Note #41. Выносные буквы над строкой — это отдельные сочетаемые знаки, в основном из блока Cyrillic Extended-A (U+2DE0–U+2DFF).

Церковнославянские буквы в гражданском шрифте

БукваНазваниеСовременные буквыДореформенная печатьПример
ѡ, ѻомега, широкое оооѻ҆́ч҃е → о́тче, ка́кѡ → ка́ко
ѿотот; отъ перед е, ю, я; оты перед иот; отъ на конце слова и перед е, ю, я, иѾѧ́ти → Отъя́ти
ѯксиксксАлеѯа́ндръ → Алекса́ндр
ѱпсипспсѰалти́рь → Псалти́рь
ѕ, ꙁзело, земляззѕвѣзда̀ → звезда́
ѧ, ꙗюс малый, а йотированноея; после ж, ш, ч, щ — аяПѧтокни́жїе → Пятокни́жие, на́шѧ → на́ша
ꙋ, ᲂу, ѹукуусꙋ́щымъ → су́щим
єширокое е (есть)ееє҆гѡ̀ → его́
ѣятьеѣсовѣ́тъ → сове́т / совѣ́тъ
і, їи десятеричноеиіА҆́бїе → А́бие / А́біе
ѳфитафѳѲе́ѡдѡръ → Фе́одор / Ѳе́одоръ
ѵижицаи; в после а, еи; в после а, еѰеѵдоапо́столъ → Псевдоапо́стол
ъ на концеерснимаетсяостаётсяживо́тъ → живо́т / живо́тъ
ерок над буквойерокъ, на конце снимаетсяъи҆з̾ → из / изъ
ы после ж, ш, щерыиыдш҃ы̀ → души́ / душы́
ꙉ, ҁдервь, коппане заменяютсяне заменяютсяостаются, будет предупреждение

Церковнославянские числа: буквы-цифры под титлом

ЗаписьЧислоКак устроено
а҃ в҃ г҃ д҃ є҃ ѕ҃ з҃ и҃ ѳ҃1–9единицы
і҃ к҃ л҃ м҃ н҃ ѯ҃ ѻ҃ п҃ ч҃10–90десятки
р҃ с҃ т҃ у҃ ф҃ х҃ ѱ҃ ѿ҃ ц҃100–900сотни; 400 — у или ижица ѵ҃
а҃і11от 11 до 19 единица стоит перед і
к҃а21десяток, затем единица
рк҃г123сотня, десяток, единица — по убыванию
҂а҃, ⸒а҃1000знак тысяч перед буквой
҂к҃20 000знак тысяч действует на одну букву
҂аѿѯ҃18601000 + 800 + 60
҂зф҃ѕ75067000 + 500 + 6
а⃝, а҉, ҂҂ане переводятсятьма, легион, миллионы: знаки в источниках означают разное
⚠️

Меняется письмо, а не язык

Инструмент не переводит церковнославянский текст на русский: слова, окончания -аго и -ія, порядок слов остаются как в источнике. Он не расставит заглавные в местоимениях, как это делают издатели, и не угадает сокращение, которого нет в словаре: такое слово останется с титлом и попадёт в предупреждение. Тьма, легион и миллионы не переводятся в цифры. Перед публикацией сверьте результат с источником.

Как перевести церковнославянский текст в гражданский шрифт

1

Вставьте текст или загрузите файл

Вставьте фрагмент в поле или загрузите .txt до 5 МБ; кодировка, в том числе Windows-1251, определится сама.

2

Выберите вид результата

«Современные буквы» заменяют ѣ, і, ѳ и снимают конечный ъ; дореформенная печать их оставляет.

3

Настройте ударения, заглавные и числа

Ударения можно оставить или убрать, имена Бога писать с заглавной, числа под титлом — арабскими цифрами.

4

Перекодируйте текст из шрифта UCS

Латиница и цифры вместо букв («Бlжeнъ мyжъ, и4же») — нажмите «Перекодировать» или включите опцию UCS.

5

Проверьте правки и предупреждения

Правки собраны по видам с парами «было → стало»; нераскрытые сокращения и большие числа — в предупреждениях.

6

Скопируйте или скачайте результат

«Копировать» кладёт текст в буфер, «Скачать .txt» сохраняет файл; для папки — вкладка «Много файлов».

Примеры: было → стало

Пасхальный тропарь

«Хрⷭ҇то́съ воскре́се и҆з̾ ме́ртвыхъ, сме́ртїю сме́рть попра́въ» в современных буквах: «Христо́с воскре́се из ме́ртвых, сме́ртию смерть попра́в», в дореформенной печати: «Христо́съ воскре́се изъ ме́ртвыхъ, сме́ртію сме́рть попра́въ».

Первый псалом

«Бл҃же́нъ мꙋ́жъ, и҆́же не и҆́де на совѣ́тъ нечести́выхъ» становится «Блаже́н муж, и́же не и́де на сове́т нечести́вых». Слово «Бл҃же́нъ» раскрыто по словарю, ꙋ заменено на «у», придыхания сняты.

Сокращения под титлом

«Бг҃ъ, Гдⷭ҇ь, І҆и҃съ, Бцⷣ҇а, чл҃вѣ́къ, а҆́гг҃лъ» → «Бог, Госпо́дь, Иису́с, Богоро́дица, челове́к, а́нгел». В дореформенной печати: «Бо́гъ, Госпо́дь, Іису́съ, Богоро́дица, человѣ́къ, а́нгелъ».

Числа и год

«въ лѣ́то ҂зф҃ѕ» → «в ле́то 7506», «а҃і» → «11», «рк҃г» → «123», «҂аѿѯ҃» → «1860», «⸒а҃» → «1000». Знаки тьмы и легиона (а⃝, а҉) остаются как есть, о них будет предупреждение.

Текст из шрифта Ирмологион

«Бlжeнъ мyжъ, и4же не и4де на совётъ нечести1выхъ» после кнопки «Перекодировать» даёт «Блаже́н муж, и́же не и́де на сове́т нечести́вых».

Глаголица

«ⱄⰾⱁⰲⱁ ⰱⱑ ⰳⰾⰰⰳⱁⰾⱏⰹ» → «слово бе глаголы» в современных буквах и «слово бѣ глаголы» в дореформенной печати: глаголический ять ⱑ становится ѣ, пара ⱏ и ⰹ — буквой «ы».

Частые вопросы о церковнославянском тексте в гражданском шрифте

Это перевод с церковнославянского на русский?
Нет. Меняется только письмо: церковнославянские буквы заменяются гражданскими, надстрочные знаки снимаются, сокращения и числа раскрываются. Слова, окончания и порядок слов остаются церковнославянскими: «и́же не и́де» так и останется. Чтобы понять смысл, нужен русский перевод текста.
Чем «Современные буквы» отличаются от дореформенной печати?
Оба вида заменяют ѡ, ѧ, ꙋ, ѯ, ѱ, ижицу, снимают надстрочные знаки и раскрывают титла. «Современные буквы» дополнительно меняют ѣ на «е», і на «и», ѳ на «ф» и снимают конечный ъ. Дореформенная печать оставляет ѣ, і, ѳ и ъ: «Христо́съ воскре́се изъ ме́ртвыхъ».
Как раскрываются слова под титлом?
По словарю из 317 правил, основа которого — открытый проект cslavonic (лицензия MIT): «Бг҃ъ» → «Бог», «Гдⷭ҇ь» → «Госпо́дь». Окончание идёт за раскрытой основой, поэтому правило работает во всех падежах. Сокращение не из словаря остаётся с титлом и попадает в предупреждение.
Как перевести церковнославянские числа в арабские цифры?
Опция «Числа под титлом — арабскими цифрами» включена по умолчанию: «а҃» → 1, «а҃і» → 11, «рк҃г» → 123, «҂аѿѯ҃» → 1860. Знак тысяч ҂ (или ⸒) действует на одну следующую букву. Тьма, легион и миллионы не переводятся: в разных источниках эти знаки означают разное.
Почему вместо букв латиница и цифры, например «Бlжeнъ мyжъ, и4же»?
Текст набран старым шрифтом «Ирмологион ucs» (или Triodion, Hirmos) в кодировке UCS и скопирован без шрифта. Длинный такой текст инструмент узнаёт сам и предлагает «Перекодировать», для короткой строки включите опцию «Текст из шрифта Ирмологион (UCS)».
Почему текст из электронного словаря выглядит квадратиками или с «съехавшими» знаками?
Такой текст хранится в Юникоде, а надстрочные знаки рисует особый церковнославянский шрифт. В редакторе без этого шрифта знаки съезжают или становятся квадратиками, хотя кодировка в порядке. Перекодировать ничего не нужно: вставьте текст как есть, и инструмент перепишет его обычными буквами.
Сохранятся ли ударения?
По умолчанию да: вария и камора становятся обычным знаком ударения. В современных буквах ударение снимается с односложных слов («смерть», «муж»), в дореформенной печати остаётся везде. Режим «Ударения: убрать» снимает знаки ударения над буквами во всём тексте, включая современные строки рядом; буквы й и ё при этом не страдают.
Почему «Бог» и «Господь» с заглавной буквы, а «сын» и «дух» — нет?
Опция «Заглавная буква в именах Бога и святых именах» пишет с заглавной имена, раскрытые из-под титла: Бог, Господь, Христос, Иисус, Богородица, Троица, Израиль, Иерусалим и некоторые другие. «Сын», «дух», «отче» издатели пишут с заглавной по смыслу, а по написанию его не определить. Выключите опцию, если нужен регистр как в источнике.
Что делать с «оу» в древнерусских цитатах («тиоуномъ», «соуда»)?
Включите опцию «Древнерусское „оу“ → „у“»: получится «тиуном», «суда» (в дореформенной печати — «тиуномъ»). По умолчанию она выключена, потому что меняет и современные слова рядом с церковнославянским текстом: «соучастник» станет «сучастник». Диграф ᲂу и начальное «оу» с придыханием сворачиваются в «у» всегда.
Почему «ѿ» даёт то «от», то «отъ»?
Перед е, ю, я твёрдый знак остаётся всегда: «Ѿѧ́ти» → «Отъя́ти». Перед «и» дореформенная печать пишет «отъи́де», современные буквы — «оты́де». На конце слова дореформенная печать требует ъ («отъ»), в современных буквах получается «от». В остальных случаях ъ не нужен: «отве́ржи».
Как перевести год от сотворения мира в привычный?
Инструмент переводит только само число: «҂зф҃ѕ» → 7506. Пересчёт в год от Рождества Христова он не делает. Если год начинался 1 сентября, из года от сотворения мира обычно вычитают 5508, а для дат с сентября по декабрь — 5509.
Поддерживается ли глаголица и формат HIP?
Глаголица переводится буква в букву в кириллицу, а неуверенные соответствия отмечаются предупреждением. Глаголические числа не переводятся. Файлы HIP (.hip, текст вида «ра'доватися» с апострофами и знаками «=») инструмент не читает: их нужно сначала перевести в Юникод.
Можно ли обработать сразу много файлов и в какой кодировке они сохранятся?
Да, на вкладке «Много файлов». Выберите файлы или папку либо перетащите их в окно, результат скачается ZIP-архивом. Кодировка сохраняется (UTF-8, UTF-16, Windows-1251). Если ударение или ѣ нельзя записать в Windows-1251, файл сохранится в UTF-8, и это будет видно в отчёте.
Текст отправляется на сервер?
Нет. Преобразование выполняется в браузере, текст и файлы не покидают ваше устройство.

🔗 Другие инструменты для старых текстов

Орфография, ударения и обработка файлов:

Комментарии

Этот инструмент ещё ждёт первого комментария

Без почты и пароля · публикуем после проверки, обычно за 1–2 дня

  • Руслан АвдеевОт автора проекта
    Все инструменты на ToolFox бесплатны, и я их дорабатываю сам. Напишите, если инструмент считает неверно, чего-то не хватает или что-то стоит поправить, — по таким комментариям я и решаю, чем заняться дальше.

Комментарии — мнения посетителей, прошедшие проверку по правилам сайта.