[object Object]

← back to Exo

fix embed_tokens for last layer in qwen models

9c1bea97e86c7a1eb277a2410ac9052cf998c7bb · 2025-01-28 23:09:45 +0000 · Alex Cheema

Files touched

Diff

commit 9c1bea97e86c7a1eb277a2410ac9052cf998c7bb
Author: Alex Cheema <alexcheema123@gmail.com>
Date:   Tue Jan 28 23:09:45 2025 +0000

    fix embed_tokens for last layer in qwen models
---
 exo/inference/mlx/models/qwen2.py | 2 +-
 1 file changed, 1 insertion(+), 1 deletion(-)

diff --git a/exo/inference/mlx/models/qwen2.py b/exo/inference/mlx/models/qwen2.py
index f2ffc7fb..492fbb27 100644
--- a/exo/inference/mlx/models/qwen2.py
+++ b/exo/inference/mlx/models/qwen2.py
@@ -31,7 +31,7 @@ class Qwen2Model(nn.Module):
     self.num_hidden_layers = args.num_hidden_layers
     assert self.vocab_size > 0
 
-    if self.args.shard.is_first_layer():
+    if self.args.shard.is_first_layer() or (self.args.shard.is_last_layer() and args.tie_word_embeddings):
       self.embed_tokens = nn.Embedding(args.vocab_size, args.hidden_size)
 
     self.layers = []

← af171f06 propagate prompts to other nodes so they can display them, c  ·  back to Exo  ·  Fix AMD device capabilities fields 9cf6818f →