[Fix] Restore vLLM rollout topology - #2017
Conversation
76c4758 to
08424ca
Compare
|
@claude review |
08424ca to
bd3ae6a
Compare
|
Claude: Summary本 PR 恢复了 ProduceBatchResult impact: not affected Main Flowchart after this PRflowchart TD
A["RolloutController._initialize_worker_ports_and_build_rollout_topology"] --> B["vLLMWorker.build_rollout_topology<br/>(本次新增实现)"]
B --> C{"num_gpus_per_engine<br/>= ep > 1 ? ep : tp"}
C --> D["按 num_gpus_per_engine 切分<br/>engine_ranks / engine_bundle_idxs"]
D --> E["RolloutEngine + 单个 RolloutServerProcess<br/>weight_update_ranks = engine_ranks"]
E --> F["RolloutTopology.server_launch_specs()"]
F --> G["worker.init(launch_spec)"]
G --> H["VLLM_RAY_BUNDLE_INDICES<br/>+ tp = tensor_parallel_size // dp<br/>enable_expert_parallel = False"]
G --> I["VLLMIPCBackendAdapter<br/>rollout_tp = tensor_parallel_size"]
style B fill:#cfe8ff,stroke:#1a73e8
style C fill:#ffd6d6,stroke:#d93025
style H fill:#ffe8cc,stroke:#e8710a
style I fill:#ffe8cc,stroke:#e8710a
核心原理实现与单测核心行为是「把 但该实现目前没有任何单测覆盖: 抽象与信息隐藏评估
单测建议
其他 Issues
VerdictREQUEST_CHANGES |
bd3ae6a to
f611fb1
Compare
No description provided.