Что такое мнемонический частотный анализ и почему мне нужно только 4 буквы исходных слов?

Что такое мнемонический частотный анализ и почему мне нужно только 4 буквы исходных слов?

Cryptosteel позволяет хранить только первые 4 буквы каждого слова моего мнемонического начального числа, в FAQ сказано, почему:

[. ] вам нужно только собрать первые 4 буквы каждого слова. Эти 4 буквы уникальны и достаточны для восстановления предложения и всего биткойн-кошелька. Мы провели частотный анализ и определили минимальный набор букв, который необходим для создания Cryptosteel.

Что такое мнемонический частотный анализ? Почему мне нужны только первые 4 буквы?

Я использую только мнемоническое семя в кошельке Greenbits для Android от GreenAddress. Однако он использует 24 или 27 словесных фаз, а не 12. Я пытался восстановить начальное число только из первых 4 букв, но кошелек жалуется, что некоторые из них не являются настоящими словами .

Я предполагаю, что GreenAddress использует что-то отличное от семян BIP39, и правило первых 4 букв не применяется ко всем семенам, это правильно?

Дэвид Мейстер

Здесь задают несколько вопросов.

Во-первых, немного справочной информации. BIP39 — это стандарт, включающий списки слов.

Что такое мнемонический частотный анализ?

Это причудливый способ сказать, что они вычислили минимальное количество букв, которое им нужно хранить, чтобы однозначно определить, какое слово из списка слов вы имели в виду .

Я проведу анализ крошечного списка слов (эти слова в BIP39) прямо здесь в качестве примера.

Представьте, что это мой список слов:

abandon , ability , crane , crash .

В нем всего 4 слова во всем списке, так что анализ довольно прост.

Теперь самыми длинными словами являются «отказаться» и «способность» по 7 штук в каждом.

Заметив это, я мог бы сказать, что пока я знаю до первых 7 букв любого слова в списке слов, я могу сказать вам, какое это слово находится в списке. Это не очень впечатляет, поскольку я возвращаю вам те же слова, что и вы мне.

В качестве альтернативы я мог бы начать с нижнего конца и увидеть, что, просто зная, является ли первая буква a или c , я уже могу сказать вам, в какой половине списка слов находится ваше слово.

2-е письмо не дает мне никакой дополнительной информации, так как это будет ab или cr - это единственные варианты.

3-я буква позволяет мне различать абандон и способность , но ничего не говорит мне о словах, начинающихся с cra .

Однако 4-я буква позволяет мне полностью и однозначно различать каждое слово в моем списке слов.

  • а = 2
  • с = 2
  • аб = 2
  • кр = 2
  • аба = 1
  • аби = 1
  • кра = 2
  • абан = 1
  • способность = 1
  • кран = 1
  • Крас = 1

Почему мне нужны только первые 4 буквы?

Потому что анализ, проведенный cryptosteel для полного списка слов BIP39 (а не только для моего игрушечного списка из 4 слов), также дал тот же результат — для извлечения любого уникального слова из списка требовалось не более 4 букв.

Я использую только мнемоническое семя в кошельке Greenbits для Android от GreenAddress. Однако он использует 24 или 27 словесных фаз, а не 12. Я пытался восстановить начальное число только из первых 4 букв, но кошелек жалуется, что некоторые из них не являются настоящими словами. Я предполагаю, что GreenAddress использует что-то отличное от семян BIP39, и правило первых 4 букв не применяется ко всем семенам, это правильно?

Верно то, что правило «первых 4 букв» не распространяется на все семена. Он специфичен для списка слов , используемого в BIP39, поэтому он будет применяться к семенам, использующим один и тот же список слов, и, вероятно, к семенам, использующим очень похожий список, но не к совершенно другим спискам. Кроме того, не все списки слов BIP39 составлены на английском языке, поэтому правило «первых 4 букв» может не применяться к другим языкам в BIP39 (может быть интересно изучить).

Не имея предварительных сведений о GreenAddress, вы не предоставили нам достаточно информации, чтобы узнать, что GreenAddress делает со своим начальным числом.

Мы не можем знать только по длине словосочетания (12, 24 или 27), реализует ли GreenAddress BIP39. В их FAQ упоминается BIP32 (HD-кошельки), но не BIP39 (конкретный список слов для seed), так что это тоже неубедительно.

Предполагая, что они поддерживают BIP39, сообщение об ошибке, которое вы видите, все еще разумно. Это просто означало бы, что программное обеспечение запрограммировано на прием только 100% совпадений со словом из списка слов, а не частичных совпадений, даже если это частичное совпадение будет уникальным.

Некоторые кошельки будут автоматически заполнять слово BIP39 при вводе, чтобы обойти эту проблему (или принять 4-буквенную версию слова), но вы всегда можете выполнить поиск вручную для любого кошелька, совместимого с BIP39, что не делает его легким. для тебя.

Например, если в вашей криптостали enve хранятся буквы, вы можете обратиться к списку слов, который я привел выше, чтобы найти слово envelope .

Карлос Кожушко

Чтобы добавить к предыдущему ответу, я проанализировал список слов BIP39, например, для испанского языка, и 4 букв недостаточно для однозначной идентификации каждого слова, есть разные слова, первые 4 буквы которых одинаковы.

📎📎📎📎📎📎📎📎📎📎