Обработка текстовой информации — тренажёр для 7 класса
7 класс • Информатика
Тренажёр по теме «Обработка текстовой информации» для 7 класса на объяснять принципы кодирования символов в компьютере (ASCII, Unicode), различать форматирование символов (шрифт, размер, начертание) и форматирование абзацев, создавать и редактировать текстовые документы с соблюдением правил оформления. Задания соответствуют разделу «ФРП по информатике, 7 класс: Текстовые документы. Форматирование текста. Кодирование символов. Работа с текстовым редактором» федеральной рабочей программы. 15 заданий с автоматической проверкой ответов, подсказками и разбором решения. Заниматься можно бесплатно, без регистрации.
Задания в теме
Загружаем задание…
Справка
Проверено методистом
Михаил ИгнатьевУчитель высшей квалификационной категорииИсточник
[1] Примерная основная образовательная программа основного общего образования, раздел «ФРП по информатике, 7 класс: Текстовые документы. Форматирование текста. Кодирование символов. Работа с текстовым редактором», ФГОС ООО.
Что нужно уметь по этой теме
- объяснять принципы кодирования символов в компьютере (ASCII, Unicode)
- различать форматирование символов (шрифт, размер, начертание) и форматирование абзацев
- создавать и редактировать текстовые документы с соблюдением правил оформления
- вычислять объём текстового файла по числу символов и кодировке
- использовать функции поиска, замены и проверки орфографии в текстовом редакторе
Соответствие программе
Кодификатор ФИПИ: 9.1.4
ФРП: ФРП по информатике, 7 класс: Текстовые документы. Форматирование текста. Кодирование символов. Работа с текстовым редактором
Часы по ФРП на раздел: 8
Прогресс по этой теме: 0 верно, 0 неверно, 0 пропущено из 15 заданий.
Как разобраться в теме: полный разбор
Раздел 1 — Определение
Обработка текстовой информации — это совокупность операций ввода, редактирования, форматирования, хранения и поиска, выполняемых над символьными данными в текстовом редакторе. Единицей такой информации служит символ — буква, цифра, знак препинания, пробел или управляющий знак.
Компьютер не хранит буквы: он хранит числа. Каждому символу присвоен числовой код, а таблица соответствия «символ ↔ код» называется кодировкой. Поэтому один и тот же файл, открытый в разной кодировке, даёт либо осмысленный текст, либо «кракозябры».
Тема связывает три линии курса информатики 7 класса: измерение информации (объём файла считается по формуле), представление данных (двоичный код символа) и информационные технологии (работа в редакторе). Форматирование добавляет к тексту вид, но не меняет его смысл: набор символов остаётся тем же, меняется способ отображения.
Раздел 2 — Ключевые правила
Объём текстового файла равен произведению количества символов на количество байтов, отводимых кодировкой на один символ: I = K · i, где K — число символов, i — вес одного символа.
- Мощность алфавита и глубина кода связаны формулой N = 2ⁱ. Если кодировка использует i = 8 бит, то N = 2⁸ = 256 различных символов. Для 65 536 символов нужно i = 16 бит, так как 2¹⁶ = 65 536.
- ASCII отводит на символ 7 бит (128 кодов), а расширенные однобайтовые кодировки (Windows-1251, KOI-8) — 8 бит = 1 байт (256 кодов). Латиница, цифры и знаки препинания занимают первую половину таблицы, кириллица — вторую.
- Unicode — универсальная кодировка, охватывающая письменности всех языков. В UTF-32 символ занимает 4 байта, в UTF-16 — 2 байта, в UTF-8 латиница занимает 1 байт, а кириллица — 2 байта.
- Считаются все символы, включая пробелы и знаки препинания. В строке «Мир и труд» 10 символов: 8 букв и 2 пробела.
- Форматирование символов задаёт шрифт, кегль (размер), начертание (полужирный, курсив, подчёркнутый), цвет — и применяется к выделенному фрагменту любой длины, хоть к одной букве.
- Форматирование абзаца задаёт выравнивание, отступ первой строки, отступы слева/справа, междустрочный интервал — и применяется ко всему абзацу целиком, даже если курсор стоит внутри одного слова.
- Абзац завершается нажатием Enter, перенос строки внутри абзаца редактор выполняет автоматически. Лишний Enter в конце каждой строки разрушает вёрстку при изменении полей.
Раздел 3 — Разбор примеров
Пример 1. Объём текста в однобайтовой кодировке. Статья содержит 3 страницы по 40 строк, в каждой строке 60 символов; кодировка Windows-1251. K = 3 · 40 · 60 = 7200 символов; i = 1 байт; I = 7200 · 1 = 7200 байт = 7200 : 1024 ≈ 7,03 Кбайт. Вывод: при однобайтовой кодировке число символов численно равно числу байтов.
Пример 2. Тот же текст в Unicode (2 байта). I = 7200 · 2 = 14 400 байт ≈ 14,06 Кбайт. Объём вырос ровно вдвое, потому что вес символа увеличился с 1 до 2 байт, а количество символов не изменилось. Вывод: объём файла зависит не только от длины текста, но и от кодировки.
Пример 3. Обратная задача. Файл занимает 5 Кбайт, кодировка двухбайтовая. Сколько символов в тексте? 5 Кбайт = 5 · 1024 = 5120 байт; K = I : i = 5120 : 2 = 2560 символов. Вывод: из формулы I = K · i выражается любая из трёх величин.
Пример 4. Определение глубины кода. Алфавит некоторого языка содержит 400 знаков. Ищем наименьшее i, при котором 2ⁱ ≥ 400: 2⁸ = 256 < 400, 2⁹ = 512 ≥ 400, значит i = 9 бит. Вывод: разрядность кода округляется вверх до целого числа битов.
Пример 5. Различение двух видов форматирования. В абзаце выделено слово «алгоритм», задан курсив 14 пт, затем нажата кнопка «по ширине». Курсив и кегль применились только к выделенному слову — форматирование символов. Выравнивание по ширине применилось ко всему абзацу, хотя выделено одно слово, — форматирование абзаца. Вывод: область действия команды определяет её тип.
Пример 6. Поиск и замена. В тексте нужно заменить «диск» на «носитель». Простая замена превратит «дискета» в «носительета». Правильное решение: включить параметр «Только слово целиком», а при необходимости — «Учитывать регистр». Вывод: замена выполняется по строке символов, смысла слов редактор не понимает.
Раздел 4 — Таблица
| Кодировка | Битов на символ | Байтов на символ | Мощность алфавита |
|---|---|---|---|
| ASCII (базовая) | 7 | 1 (с ведущим нулём) | 128 |
| Windows-1251, KOI-8 | 8 | 1 | 256 |
| UTF-16 (Unicode) | 16 | 2 | 65 536 |
| UTF-32 (Unicode) | 32 | 4 | свыше 1 000 000 |
| Параметр | Уровень форматирования | Область действия | Пример значения |
|---|---|---|---|
| Шрифт (гарнитура) | символ | выделенный фрагмент | Times New Roman |
| Кегль (размер) | символ | выделенный фрагмент | 12 пт |
| Начертание | символ | выделенный фрагмент | полужирный, курсив |
| Выравнивание | абзац | весь абзац | по ширине |
| Отступ первой строки | абзац | весь абзац | 1,25 см |
| Междустрочный интервал | абзац | весь абзац | 1,5 |
Раздел 5 — Типичные ошибки
Смешение битов и байтов. Ученик умножает число символов на 8 и записывает ответ в байтах. Причина — потеря единицы измерения при подстановке в формулу. Неправильно: 100 символов · 8 = 800 байт. Правильно: 100 · 8 = 800 бит = 100 байт.
Пропуск пробелов при подсчёте символов. Пробел кажется «пустотой», но имеет собственный код (32 в ASCII) и занимает столько же места, сколько буква. Неправильно: в «Я иду домой» 9 символов. Правильно: 11 символов.
Деление на 1000 вместо 1024. Килобайт равен 2¹⁰ = 1024 байт, а не тысяче. Неправильно: 2048 байт = 2,048 Кбайт. Правильно: 2048 : 1024 = 2 Кбайт.
Создание отступа пробелами и центрирование пробелами. Отступ, набранный пятью пробелами, «поедет» при смене шрифта или полей. Неправильно: пять пробелов перед словом. Правильно: параметр абзаца «Отступ первой строки — 1,25 см» и кнопка «По центру».
Пробел перед знаком препинания. Наборное правило: точка, запятая, двоеточие ставятся вплотную к предыдущему слову, пробел — после знака. Неправильно: «текст , который». Правильно: «текст, который».
Раздел 6 — Пошаговый алгоритм
- Прочитайте условие и выпишите известные величины: количество символов K, вес символа i, объём I.
- Определите кодировку и переведите её в байты: однобайтовая — 1, UTF-16 — 2, UTF-32 — 4; если дано число битов, разделите на 8.
- Если число символов задано через страницы и строки, вычислите K = страницы · строки · символы в строке.
- Подставьте значения в формулу I = K · i и найдите неизвестную величину (K = I : i, i = I : K).
- Переведите результат в требуемые единицы: 1 Кбайт = 1024 байт, 1 Мбайт = 1024 Кбайт.
- Проверьте ответ прикидкой: при двухбайтовой кодировке байтов ровно вдвое больше, чем символов; объём в килобайтах меньше объёма в байтах.
Раздел 7 — Как запомнить
- Формула-ядро: I = K · i — «объём = количество × вес». Три величины, две операции: умножение и деление.
- Связка алфавита и кода: N = 2ⁱ — «сколько символов, столько степень двойки».
- Кодировки по возрастанию: ASCII → 1 байт, UTF-16 → 2 байта, UTF-32 → 4 байта. Ряд 1–2–4 удваивается.
- Различение форматирования: «ШРиН — символ» (Шрифт, Размер, Начертание), «ВОИ — абзац» (Выравнивание, Отступы, Интервал).
- Правило Enter: «Enter — конец мысли, а не конец строки».
- Правило пробела: «Пробел живёт после знака, а не перед ним».
Частые вопросы
Сколько бит использует кодировка ASCII для одного символа?
7 бит (стандартно расширяется до 8 бит = 1 байт).
Каков объём текста из 1024 символов в кодировке Windows-1251?
1024 × 1 байт = 1024 байт = 1 Кбайт.
Чем Unicode отличается от ASCII?
Unicode поддерживает символы всех языков мира (более 1 млн), а ASCII — только 128 символов латиницы и знаков.