Skip to content

Commit 489f8f8

Browse files
committed
fix index collision of normal word and padding word
1 parent 52b50c4 commit 489f8f8

1 file changed

Lines changed: 3 additions & 3 deletions

File tree

seq2vec/seq2seq_auto_encoder.py

Lines changed: 3 additions & 3 deletions
Original file line numberDiff line numberDiff line change
@@ -41,7 +41,7 @@ def _create_single_layer_seq2seq_model(
4141
def _one_hot_encode_seq(seq, max_index):
4242
np_seq = []
4343
for idx in seq:
44-
arr = np.zeros(max_index)
44+
arr = np.zeros(max_index + 1)
4545
arr[idx] = 1
4646
np_seq.append(arr)
4747
return np_seq
@@ -77,15 +77,15 @@ def __init__(
7777

7878
model, encoder = _create_single_layer_seq2seq_model(
7979
max_length=self.max_length,
80-
max_index=self.max_index,
80+
max_index=self.max_index + 1,
8181
latent_size=self.latent_size,
8282
learning_rate=self.learning_rate,
8383
)
8484
self.model = model
8585
self.encoder = encoder
8686

8787
def _hash_seq(self, sequence):
88-
return [consistent_hash(word) % self.max_index for word in sequence]
88+
return [consistent_hash(word) % self.max_index + 1 for word in sequence]
8989

9090
def _generate_padding_array(self, seqs):
9191
hashed_seq = []

0 commit comments

Comments
 (0)