Метод len_utf8
Метод len_utf8 возвращает длину символа в байтах
при кодировании в UTF-8. Метод не принимает параметров
и возвращает значение типа usize. Поскольку
в UTF-8 символы могут занимать от 1 до 4 байтов,
результат всегда находится в диапазоне от 1 до 4.
Синтаксис
char.len_utf8()
Пример
Давайте узнаем, сколько байтов занимает латинская
буква 'a' в кодировке UTF-8:
fn main()
{
let res = 'a'.len_utf8();
println!("{}", res);
}
Результат выполнения кода:
1
Пример
Давайте узнаем, сколько байтов занимает кириллическая
буква 'я' в кодировке UTF-8:
fn main()
{
let res = 'я'.len_utf8();
println!("{}", res);
}
Результат выполнения кода:
2
Пример
Давайте узнаем, сколько байтов занимает эмодзи
'😀' в кодировке UTF-8:
fn main()
{
let res = '😀'.len_utf8();
println!("{}", res);
}
Результат выполнения кода:
4
Смотрите также
-
класс
char,
который представляет отдельный символ Unicode -
метод
is_ascii,
который проверяет, является ли символ ASCII -
метод
to_uppercase,
который преобразует символ в верхний регистр -
метод
escape_debug,
который возвращает экранированное представление символа