Строки в TensorFlow
В тензоре типа строки хранят текст в байтовом виде. Перед сравнением или поиском подстроки часто нужно, чтобы все буквы были одинакового регистра.
Функция lower из модуля
strings принимает
строковый тензор и возвращает
новый тензор с теми же
элементами в нижнем регистре.
Форма и число строк не меняются.
Создадим тензор из двух английских слов с заглавными буквами и выведем результат:
import tensorflow as tf
labels = tf.constant(["Hello", "World"])
print(tf.strings.lower(labels).numpy())
# выведет [b'hello' b'world']
Если во входе одна строка, а не набор, функция lower работает так же и возвращает один элемент:
import tensorflow as tf
line = tf.constant("MixEd Case")
print(tf.strings.lower(line).numpy()) # выведет b'mixed case'
Задайте тензор из строк
"Ab" и "Cd".
Получите их в нижнем регистре
и выведите содержимое.
Создайте одну строку
"TensorFlow" в тензоре.
Приведите её к нижнему регистру
и выведите значение.
Соберите тензор из трёх
меток "A", "bB"
и "cCc".
Выведите все элементы
после приведения к нижнему
регистру.