torch.nn.functional.embedding
-
torch.nn.functional.embedding(input, weight, padding_idx=None, max_norm=None, norm_type=2.0, scale_grad_by_freq=False, sparse=False)[source] -
Простая таблица поиска, которая ищет вложения в фиксированном словаре и размере.
Этот модуль часто используется для извлечения вложений слов с помощью индексов. Входом в модуль является список индексов и матрица вложений, а выходом являются соответствующие вложения слов.
См.
torch.nn.Embeddingдля получения дополнительной информации.Примечание
Обратите внимание, что аналитические градиенты этой функции относительно элементов в
weightв строке, указаннойpadding_idx, могут отличаться от численных.Примечание
Обратите внимание, что
:class:`torch.nn.Embeddingотличается от этой функции тем, что инициализирует строкуweightпо указанному индексуpadding_idxнулями при создании.- Параметры
-
- input (LongTensor) – Tensor, содержащий индексы в матрице вложений
- weight (Tensor) – Матрица вложений с числом строк, равным максимальному возможному индексу + 1, и числом столбцов, равным размеру вложения
-
padding_idx (int, optional) – Если указано, записи по
padding_idxне вносят вклад в градиент; следовательно, вектор вложения поpadding_idxне обновляется во время обучения, т. е. он остается фиксированным «заполнителем». -
max_norm (float, optional) – Если задано, каждый вектор вложения с нормой больше, чем
max_norm, перенормируется так, чтобы иметь нормуmax_norm. Примечание: это изменитweightна месте. -
norm_type (float, optional) – p в p-норме для вычисления опции
max_norm. По умолчанию2. -
scale_grad_by_freq (bool, optional) – Если задано, это приведет к масштабированию градиентов в зависимости от обратной частоты слов в мини-пакете. По умолчанию
False. -
sparse (bool, optional) – Если
True, градиент поweightбудет разреженным тензором. Дополнительные сведения о разреженных градиентах см. в Примечаниях кtorch.nn.Embedding.
- Тип возвращаемого значения
- Форма:
-
- Вход: LongTensor произвольной формы, содержащий индексы для извлечения
- Вес: Матрица вложений с плавающей точкой, форма
(V, embedding_dim), где V = максимальный индекс + 1, и embedding_dim = размер вложения - Вывод:
(*, embedding_dim), где*— форма входных данных
Примеры:
>>> # a batch of 2 samples of 4 indices each >>> input = torch.tensor([[1, 2, 4, 5], [4, 3, 2, 9]]) >>> # an embedding matrix containing 10 tensors of size 3 >>> embedding_matrix = torch.rand(10, 3) >>> F.embedding(input, embedding_matrix) tensor([[[ 0.8490, 0.9625, 0.6753], [ 0.9666, 0.7761, 0.6108], [ 0.6246, 0.9751, 0.3618], [ 0.4161, 0.2419, 0.7383]], [[ 0.6246, 0.9751, 0.3618], [ 0.0237, 0.7794, 0.0528], [ 0.9666, 0.7761, 0.6108], [ 0.3385, 0.8612, 0.1867]]]) >>> # example with padding_idx >>> weights = torch.rand(10, 3) >>> weights[0, :].zero_() >>> embedding_matrix = weights >>> input = torch.tensor([[0, 2, 0, 5]]) >>> F.embedding(input, embedding_matrix, padding_idx=0) tensor([[[ 0.0000, 0.0000, 0.0000], [ 0.5609, 0.5384, 0.8720], [ 0.0000, 0.0000, 0.0000], [ 0.6262, 0.2438, 0.7471]]])
© 2024, PyTorch Contributors
PyTorch has a BSD-style license, as found in the LICENSE file.
https://pytorch.org/docs/2.1/generated/torch.nn.functional.embedding.html