File tree Expand file tree Collapse file tree
vllm/model_executor/models Expand file tree Collapse file tree Original file line number Diff line number Diff line change @@ -51,11 +51,8 @@ For example:
5151** 1. Attention:**
5252
5353``` python
54- -- 8 < -- " vllm/model_executor/layers/attention/mm_encoder_attention.py:mm_encoder_attn"
55-
5654-- 8 < -- " vllm/model_executor/layers/mla.py:multi_head_latent_attention"
5755
58- -- 8 < -- " vllm/model_executor/models/deepencoder.py:rel_pos_attention"
5956```
6057
6158** 2. Activation:**
@@ -170,6 +167,16 @@ For example:
170167-- 8 < -- " vllm/model_executor/layers/rotary_embedding/common.py:apply_rotary_emb"
171168```
172169
170+ ** 12. Encoder:**
171+
172+ ``` python
173+ -- 8 < -- " vllm/model_executor/models/deepencoder2.py:qwen2_decoder"
174+
175+ -- 8 < -- " vllm/model_executor/layers/attention/mm_encoder_attention.py:mm_encoder_attn"
176+
177+ -- 8 < -- " vllm/model_executor/models/deepencoder.py:rel_pos_attention"
178+ ```
179+
173180## Guidelines for Implementing a New CustomOp
174181
175182### Implement a New CustomOp in vLLM
Original file line number Diff line number Diff line change 1414import torch .nn as nn
1515import transformers
1616
17+ from vllm .model_executor .custom_op import PluggableLayer
1718
18- class CustomQwen2Decoder (nn .Module ):
19+
20+ # --8<-- [start:qwen2_decoder]
21+ @PluggableLayer .register ("qwen2_decoder" )
22+ class CustomQwen2Decoder (PluggableLayer ):
1923 """
2024 Qwen2 visual encoder
2125 non-causal attention + causal attention
2226 token_type_ids :0=non-causal, 1=causal
2327 """
2428
29+ # --8<-- [end:qwen2_decoder]
30+
2531 def __init__ (
2632 self ,
2733 decoder_layer : int = 24 ,
You can’t perform that action at this time.
0 commit comments