Статья

Кодирование текста: кодовые таблицы

5 сентября 2026~8 минут10–11 класс

Если «Кодирование текста: кодовые таблицы» вызывает ступор — это нормально: тема собрана из простых идей. Покажем их по порядку: теория, пример, разбор задания и типичные ошибки.

Зачем нужны кодовые таблицы

Текст на экране кажется обычным: буквы, пробелы, знаки препинания. Но компьютер видит не буквы, а числа. Если в задаче ЕГЭ или ОГЭ нужно определить код символа, легко запутаться в таблицах и системах счисления. Разберём тему по шагам: ты поймёшь, как символ превращается в число, чем отличаются ASCII и Unicode и как быстро решать типовые задания.

Кодирование текста — это представление символов с помощью числовых кодов. Для каждого символа в кодовой таблице закреплено своё значение. Например, латинская буква A в таблице ASCII имеет код 65, а пробел — код 32. Компьютер хранит эти числа в двоичном виде, потому что электронные устройства удобно описывать двумя состояниями: 0 и 1.

Важно различать три понятия. Символ — это знак, например буква «А». Код — число, назначенное этому символу. Кодировка — правило, по которому символы и их коды хранятся и передаются. Если открыть файл не в той кодировке, вместо текста могут появиться непонятные знаки.

Для закрепления базовых понятий можно перейти в бесплатную практику в личном кабинете и проверить себя на коротких заданиях.

ASCII: первая таблица символов

ASCII — одна из первых распространённых кодовых таблиц. В стандартном варианте используется 7 бит, поэтому всего можно закодировать 2⁷ = 128 различных значений: от 0 до 127. В таблицу вошли латинские буквы, цифры, знаки препинания и управляющие символы.

Коды латинских букв расположены последовательно. Это позволяет находить код без полного просмотра таблицы:

A → 65
B → 66
C → 67

Z → 90
a → 97
b → 98

z → 122

Между заглавной и строчной буквой одного вида есть разница: код строчной буквы на 32 больше. Например, код A равен 65, а код a равен 97. Цифры тоже идут подряд: 0 имеет код 48, 1 — 49, а 9 — 57. Это не означает, что символ «7» хранится как число 7: код символа «7» равен 55.

Русских букв в исходной ASCII нет. Для национальных алфавитов создавались расширенные таблицы, но они могли различаться, поэтому одинаковый файл на разных компьютерах отображался по-разному.

Совет репетитора

Сначала определи, что именно дано в условии: символ, его код или количество бит. Не смешивай код символа «5» с числом 5. Запиши рядом букву и число, а затем переводи только нужное значение в двоичную систему.

Unicode и кодирование русского текста

Чтобы представить алфавиты разных стран, появился стандарт Unicode. Он задаёт уникальные номера для букв, цифр, знаков и многих специальных символов. Например, русская заглавная буква А имеет код Unicode 1040, а строчная а — 1072. Эти значения можно записывать в десятичной или шестнадцатеричной системе.

Unicode и конкретный способ хранения — не одно и то же. Например, UTF-8, UTF-16 и UTF-32 кодируют символы Unicode по разным правилам. В школьных задачах чаще всего спрашивают не о внутреннем формате файла, а о количестве символов, битов или возможных кодов.

Если алфавит содержит N символов, для равномерного кодирования каждого символа нужно выбрать минимальное число бит i, для которого выполняется 2ⁱ ≥ N. Например, для 32 символов достаточно 5 бит, потому что 2⁵ = 32. Для 33 символов уже потребуется 6 бит.

\( N = 50 \)
\( 2^5 = 32 < 50 \)
\( 2^6 = 64 \ge 50 \)
Ответ: 6 бит на символ

В заданиях экзамена условие может отдельно сообщать, что используются только заглавные буквы, цифры и пробел. Тогда считай именно перечисленные символы, не добавляя знаки «на всякий случай».

Как решать задачи по кодовым таблицам

Удобный алгоритм состоит из четырёх шагов. Сначала выпиши множество допустимых символов или найди нужную строку таблицы. Затем посчитай количество символов N. После этого подбери минимальное i, чтобы 2ⁱ ≥ N. В конце умножь число бит на количество символов, если требуется определить объём сообщения.

Рассмотрим пример полностью. Сообщение состоит из 12 символов, а алфавит содержит 40 символов. Каждый знак кодируется одинаковым минимальным количеством бит. Сначала находим разрядность кода, затем общий объём:

\( N = 40 \)
\( 2^5 = 32 < 40 \)
\( 2^6 = 64 \ge 40 \)
На один символ нужно 6 бит
\( 12 \times 6 = 72 \)
Ответ: 72 бита

Если объём требуется указать в байтах, помни: 1 байт = 8 бит. Здесь 72 бита = 9 байт. Если число бит не делится на 8, в реальной памяти может понадобиться округление вверх до целого числа байтов, но в условии нужно следовать указанной модели.

Для дополнительной тренировки по системам счисления и кодированию используй личный кабинет с бесплатными заданиями: после каждого ответа полезно объяснять себе, почему выбран именно такой разряд.

Типичные ошибки и проверка ответа

Первая ошибка — брать не минимальное число бит. Если алфавит содержит 17 символов, 5 бит достаточно, потому что 2⁵ = 32. Использовать 8 бит можно технически, но это уже не минимальный равномерный код, если условие просит экономный вариант.

Вторая ошибка — считать символы в сообщении неверно. Пробел, точка, запятая и перенос строки могут быть отдельными символами. Перепроверь условие: иногда пробел включён в алфавит, а иногда сказано, что сообщение состоит только из букв.

Третья ошибка — путать количество символов с количеством кодов. Если код имеет i бит, возможны 2ⁱ комбинаций. Но часть комбинаций может оставаться неиспользованной. При N = 50 код из 6 бит даёт 64 варианта, и это нормально.

Ловушка

Не складывай коды отдельных букв, если спрашивают объём сообщения. Сначала определи, сколько бит занимает один символ, затем умножь на число символов. Само значение кода буквы обычно для этого не нужно.

Проверка простая: возведи 2 в найденную степень. Результат должен быть не меньше размера алфавита, а степень на единицу меньше — меньше него. Такое двойное сравнение помогает быстро заметить ошибку.

Что запомнить

Кодовая таблица сопоставляет символу числовой код. ASCII содержит базовые латинские символы и использует 7 бит в стандартном варианте. Unicode предназначен для символов разных письменностей, в том числе русского алфавита. Для алфавита из N символов минимальная длина равномерного кода определяется условием 2ⁱ ≥ N.

В задачах действуй последовательно: посчитай символы, найди минимальную степень двойки, умножь длину кода на количество знаков и при необходимости переведи биты в байты. Всегда учитывай пробелы и знаки препинания, если они входят в сообщение.

Следующий шаг — зарегистрируйся и реши 5 заданий бесплатно. Так ты проверишь не только запоминание формулы, но и умение читать условие, где часто скрыта главная сложность.

Если готовишься к экзамену, собери отдельную памятку по системам счисления и кодированию, а затем сравни свои решения с заданиями из разделов ОГЭ и ЕГЭ.

Что такое кодовая таблица?

Это набор соответствий между символами и их числовыми кодами. По такой таблице компьютер понимает, какой знак нужно показать или сохранить.

Чем ASCII отличается от Unicode?

ASCII содержит ограниченный набор базовых символов, прежде всего латинские буквы, цифры и знаки. Unicode охватывает алфавиты разных языков и множество специальных символов.

Как закрепить тему после разбора?

Реши несколько задач разных типов: на определение длины кода, объём сообщения и работу с таблицей символов. После каждого решения проговаривай, почему выполняется условие 2ⁱ ≥ N.

Нужно ли учитывать пробел в сообщении?

Да, если пробел входит в сообщение и условие не исключает его. Он считается отдельным символом и занимает столько же бит, сколько буква или знак при равномерном кодировании.

Закрепить тему на практике

Теория без практики забывается за неделю. В личном кабинете Просто Урок — задания именно по этой теме с проверкой каждого шага. Регистрация бесплатная.

Важно. Материалы сайта носят информационно-образовательный характер и не являются публичной офертой (ст. 437 ГК РФ), индивидуальной консультацией или руководством к действию. Мы аккуратно работаем с фактами, но не гарантируем полную точность и актуальность: структура и правила экзаменов могут меняться — сверяйтесь с официальными источниками (ФИПИ, действующие кодификаторы и нормативные акты РФ). Администрация сайта не несёт ответственности за возможные неточности и за решения, принятые на основе материалов. Заметили неточность — напишите нам, мы исправим.