Обработка текстовой информации — тренажёр для 7 класса

7 класс • Информатика

Тренажёр по теме «Обработка текстовой информации» для 7 класса на объяснять принципы кодирования символов в компьютере (ASCII, Unicode), различать форматирование символов (шрифт, размер, начертание) и форматирование абзацев, создавать и редактировать текстовые документы с соблюдением правил оформления. Задания соответствуют разделу «ФРП по информатике, 7 класс: Текстовые документы. Форматирование текста. Кодирование символов. Работа с текстовым редактором» федеральной рабочей программы. 15 заданий с автоматической проверкой ответов, подсказками и разбором решения. Заниматься можно бесплатно, без регистрации.

Задания в теме

верно неверно пропущено
Загрузка…

Загружаем задание…

Справка

Источник

[1] Примерная основная образовательная программа основного общего образования, раздел «ФРП по информатике, 7 класс: Текстовые документы. Форматирование текста. Кодирование символов. Работа с текстовым редактором», ФГОС ООО.

Что нужно уметь по этой теме

  • объяснять принципы кодирования символов в компьютере (ASCII, Unicode)
  • различать форматирование символов (шрифт, размер, начертание) и форматирование абзацев
  • создавать и редактировать текстовые документы с соблюдением правил оформления
  • вычислять объём текстового файла по числу символов и кодировке
  • использовать функции поиска, замены и проверки орфографии в текстовом редакторе

Соответствие программе

Кодификатор ФИПИ: 9.1.4

ФРП: ФРП по информатике, 7 класс: Текстовые документы. Форматирование текста. Кодирование символов. Работа с текстовым редактором

Часы по ФРП на раздел: 8

Прогресс по этой теме: 0 верно, 0 неверно, 0 пропущено из 15 заданий.

Как разобраться в теме: полный разбор

Раздел 1 — Определение

Обработка текстовой информации — это совокупность операций ввода, редактирования, форматирования, хранения и поиска, выполняемых над символьными данными в текстовом редакторе. Единицей такой информации служит символ — буква, цифра, знак препинания, пробел или управляющий знак.

Компьютер не хранит буквы: он хранит числа. Каждому символу присвоен числовой код, а таблица соответствия «символ ↔ код» называется кодировкой. Поэтому один и тот же файл, открытый в разной кодировке, даёт либо осмысленный текст, либо «кракозябры».

Тема связывает три линии курса информатики 7 класса: измерение информации (объём файла считается по формуле), представление данных (двоичный код символа) и информационные технологии (работа в редакторе). Форматирование добавляет к тексту вид, но не меняет его смысл: набор символов остаётся тем же, меняется способ отображения.

Раздел 2 — Ключевые правила

Объём текстового файла равен произведению количества символов на количество байтов, отводимых кодировкой на один символ: I = K · i, где K — число символов, i — вес одного символа.

  1. Мощность алфавита и глубина кода связаны формулой N = 2ⁱ. Если кодировка использует i = 8 бит, то N = 2⁸ = 256 различных символов. Для 65 536 символов нужно i = 16 бит, так как 2¹⁶ = 65 536.
  2. ASCII отводит на символ 7 бит (128 кодов), а расширенные однобайтовые кодировки (Windows-1251, KOI-8) — 8 бит = 1 байт (256 кодов). Латиница, цифры и знаки препинания занимают первую половину таблицы, кириллица — вторую.
  3. Unicode — универсальная кодировка, охватывающая письменности всех языков. В UTF-32 символ занимает 4 байта, в UTF-16 — 2 байта, в UTF-8 латиница занимает 1 байт, а кириллица — 2 байта.
  4. Считаются все символы, включая пробелы и знаки препинания. В строке «Мир и труд» 10 символов: 8 букв и 2 пробела.
  5. Форматирование символов задаёт шрифт, кегль (размер), начертание (полужирный, курсив, подчёркнутый), цвет — и применяется к выделенному фрагменту любой длины, хоть к одной букве.
  6. Форматирование абзаца задаёт выравнивание, отступ первой строки, отступы слева/справа, междустрочный интервал — и применяется ко всему абзацу целиком, даже если курсор стоит внутри одного слова.
  7. Абзац завершается нажатием Enter, перенос строки внутри абзаца редактор выполняет автоматически. Лишний Enter в конце каждой строки разрушает вёрстку при изменении полей.

Раздел 3 — Разбор примеров

Пример 1. Объём текста в однобайтовой кодировке. Статья содержит 3 страницы по 40 строк, в каждой строке 60 символов; кодировка Windows-1251. K = 3 · 40 · 60 = 7200 символов; i = 1 байт; I = 7200 · 1 = 7200 байт = 7200 : 1024 ≈ 7,03 Кбайт. Вывод: при однобайтовой кодировке число символов численно равно числу байтов.

Пример 2. Тот же текст в Unicode (2 байта). I = 7200 · 2 = 14 400 байт ≈ 14,06 Кбайт. Объём вырос ровно вдвое, потому что вес символа увеличился с 1 до 2 байт, а количество символов не изменилось. Вывод: объём файла зависит не только от длины текста, но и от кодировки.

Пример 3. Обратная задача. Файл занимает 5 Кбайт, кодировка двухбайтовая. Сколько символов в тексте? 5 Кбайт = 5 · 1024 = 5120 байт; K = I : i = 5120 : 2 = 2560 символов. Вывод: из формулы I = K · i выражается любая из трёх величин.

Пример 4. Определение глубины кода. Алфавит некоторого языка содержит 400 знаков. Ищем наименьшее i, при котором 2ⁱ ≥ 400: 2⁸ = 256 < 400, 2⁹ = 512 ≥ 400, значит i = 9 бит. Вывод: разрядность кода округляется вверх до целого числа битов.

Пример 5. Различение двух видов форматирования. В абзаце выделено слово «алгоритм», задан курсив 14 пт, затем нажата кнопка «по ширине». Курсив и кегль применились только к выделенному слову — форматирование символов. Выравнивание по ширине применилось ко всему абзацу, хотя выделено одно слово, — форматирование абзаца. Вывод: область действия команды определяет её тип.

Пример 6. Поиск и замена. В тексте нужно заменить «диск» на «носитель». Простая замена превратит «дискета» в «носительета». Правильное решение: включить параметр «Только слово целиком», а при необходимости — «Учитывать регистр». Вывод: замена выполняется по строке символов, смысла слов редактор не понимает.

Раздел 4 — Таблица

КодировкаБитов на символБайтов на символМощность алфавита
ASCII (базовая)71 (с ведущим нулём)128
Windows-1251, KOI-881256
UTF-16 (Unicode)16265 536
UTF-32 (Unicode)324свыше 1 000 000
ПараметрУровень форматированияОбласть действияПример значения
Шрифт (гарнитура)символвыделенный фрагментTimes New Roman
Кегль (размер)символвыделенный фрагмент12 пт
Начертаниесимволвыделенный фрагментполужирный, курсив
Выравниваниеабзацвесь абзацпо ширине
Отступ первой строкиабзацвесь абзац1,25 см
Междустрочный интервалабзацвесь абзац1,5

Раздел 5 — Типичные ошибки

Смешение битов и байтов. Ученик умножает число символов на 8 и записывает ответ в байтах. Причина — потеря единицы измерения при подстановке в формулу. Неправильно: 100 символов · 8 = 800 байт. Правильно: 100 · 8 = 800 бит = 100 байт.

Пропуск пробелов при подсчёте символов. Пробел кажется «пустотой», но имеет собственный код (32 в ASCII) и занимает столько же места, сколько буква. Неправильно: в «Я иду домой» 9 символов. Правильно: 11 символов.

Деление на 1000 вместо 1024. Килобайт равен 2¹⁰ = 1024 байт, а не тысяче. Неправильно: 2048 байт = 2,048 Кбайт. Правильно: 2048 : 1024 = 2 Кбайт.

Создание отступа пробелами и центрирование пробелами. Отступ, набранный пятью пробелами, «поедет» при смене шрифта или полей. Неправильно: пять пробелов перед словом. Правильно: параметр абзаца «Отступ первой строки — 1,25 см» и кнопка «По центру».

Пробел перед знаком препинания. Наборное правило: точка, запятая, двоеточие ставятся вплотную к предыдущему слову, пробел — после знака. Неправильно: «текст , который». Правильно: «текст, который».

Раздел 6 — Пошаговый алгоритм

  1. Прочитайте условие и выпишите известные величины: количество символов K, вес символа i, объём I.
  2. Определите кодировку и переведите её в байты: однобайтовая — 1, UTF-16 — 2, UTF-32 — 4; если дано число битов, разделите на 8.
  3. Если число символов задано через страницы и строки, вычислите K = страницы · строки · символы в строке.
  4. Подставьте значения в формулу I = K · i и найдите неизвестную величину (K = I : i, i = I : K).
  5. Переведите результат в требуемые единицы: 1 Кбайт = 1024 байт, 1 Мбайт = 1024 Кбайт.
  6. Проверьте ответ прикидкой: при двухбайтовой кодировке байтов ровно вдвое больше, чем символов; объём в килобайтах меньше объёма в байтах.

Раздел 7 — Как запомнить

  • Формула-ядро: I = K · i — «объём = количество × вес». Три величины, две операции: умножение и деление.
  • Связка алфавита и кода: N = 2ⁱ — «сколько символов, столько степень двойки».
  • Кодировки по возрастанию: ASCII → 1 байт, UTF-16 → 2 байта, UTF-32 → 4 байта. Ряд 1–2–4 удваивается.
  • Различение форматирования: «ШРиН — символ» (Шрифт, Размер, Начертание), «ВОИ — абзац» (Выравнивание, Отступы, Интервал).
  • Правило Enter: «Enter — конец мысли, а не конец строки».
  • Правило пробела: «Пробел живёт после знака, а не перед ним».

Частые вопросы

Сколько бит использует кодировка ASCII для одного символа?

7 бит (стандартно расширяется до 8 бит = 1 байт).

Каков объём текста из 1024 символов в кодировке Windows-1251?

1024 × 1 байт = 1024 байт = 1 Кбайт.

Чем Unicode отличается от ASCII?

Unicode поддерживает символы всех языков мира (более 1 млн), а ASCII — только 128 символов латиницы и знаков.