Почему манускрипт Войнича не поддается расшифровке
Х@habr_comмедиа / агрегатор
3 недАвтор анализирует манускрипт Войнича с помощью Python, объясняя, почему статистические методы не помогают в его расшифровке.
Это наглядный пример того, как статистические данные могут вводить в заблуждение при поиске закономерностей в случайных наборах символов.
- Показывает ограничения статистического анализа в криптографии.
- Демонстрирует, как легко создать ложные корреляции в данных.
- Развенчивает популярные любительские теории о расшифровке манускрипта.
«Я попытался расшифровать манускрипт Войнича. Спойлер: не расшифровал — но выяснил, почему это не удалось и АНБ»
Манускрипт Войнича почти сто лет отбивает атаки криптографов, лингвистов и штатных сотрудников АНБ, которые ещё в 1970-х официально признали задачу нерешённой. Без их квалификации и ресурсов, зато с чистым Python и транскрипцией всего текста, автор за полдня решил честно посчитать статистику вместо гадания по картинкам с русалками.
Сначала всё сходилось на смысл. Кучность редких слов дала показатель 2.78, заметно выше английского эталона, будто слова кучкуются по темам, как в осмысленном тексте. Ровно на этом красивом числе обрывались все любительские разборы в интернете, и ровно здесь начинается самое интересное. Оставалось задать один вопрос, который меняет вывод на противоположный, и бессмысленная машина, собранная за тот же вечер, повторила почти весь эффект.
Узнаем, какой вопрос убивает ложный сигнал и почему статистика текста в принципе не вскроет манускрипт.

Кратко (AI)
Автор статьи предпринял попытку проанализировать манускрипт Войнича с помощью статистических методов на Python. Он пришел к выводу, что статистические показатели, которые часто принимают за признаки осмысленного текста, могут быть легко воспроизведены случайными алгоритмами, что объясняет неудачу профессиональных криптографов.
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖