Conversation
AI Review审查尚未完整完成,无法给出整体结论;当前没有可发布的已确认问题,不代表代码没有问题。
|
AI CI 失败分析工作流:HCU PR CI 总结
与本次改动的关系无法确定:已定位的直接异常对本次改动的关联判断一致。 建议处理
|
There was a problem hiding this comment.
AI Review
🟢 未发现有明确证据的问题
在已提供并完成审查的 diff 范围内未形成可确认问题。
变更概览
本次变更主要包含:
- 新增 Omni HCU 调度器运行时补丁测试文件,覆盖 final-stage 元数据桥接保留、快路径与完整调度器生命周期输出/状态一致性、暂停与限流场景下快路径回退且不改状态、显式桥接选择器保留、异步桥接拒绝音频输出及 skipped_waiting 队列保持等行为。
- 新增差分测试文件,通过 AST 从已安装 vLLM 的 GPUModelRunner 提取 _calc_mrope_positions/_get_positions 加载为可调用函数,并提供 TokenMajorMropeBuffer 与 CpuGpuBuffer 两种测试缓冲区构造辅助。
- 本批新增 Omni 输入准备测试:在 TokenMajorMropeBuffer 与原 CpuGpuBuffer 两条路径下分别执行 _calc_mrope_positions 并断言结果一致,同时校验 token-major 布局(stride)、与 CPU 内存的共享,以及 _get_positions 的索引复制行为。
- 新增 Omni 输入准备运行时补丁的测试文件,覆盖独立环境变量开关的 opt-in 行为、不支持的模型配置在变更前被拒绝,以及 token-major 布局对 vllm 与 AOT 编译缓存哈希键的区分且不污染用户 additional_config。
文件审查摘要
| 文件 | 变更 | 审查结果 |
|---|---|---|
vllm_hcu/v1/core/sched/steady_decode_scheduler.py |
新增 · +266/-0 | — |
tests/runtime_patch/test_steady_decode_scheduler.py |
新增 · +258/-0 | — |
tests/runtime_patch/test_omni_hcu_scheduler.py |
新增 · +203/-0 | — |
tests/runtime_patch/test_omni_input_prepare.py |
新增 · +153/-0 | — |
vllm_hcu/v1/omni_input_prepare.py |
新增 · +89/-0 | — |
vllm_hcu/v1/core/sched/scheduler.py |
修改 · +50/-2 | — |
vllm_hcu/patch/platform/framework_opt/patch_scheduler.py |
修改 · +13/-2 | — |
vllm_hcu/platforms/envs.py |
修改 · +9/-0 | — |
审查信息
- 变更统计:8 个文件,+1041/-4。
- 覆盖情况:共 8 个文件,已完整审查 8 个。
- 候选问题:0 项;证据复核过滤:0 项;发布前敏感信息保护:0 项。
- 本服务只审查 GitHub 提供的 PR diff,未执行代码或重跑测试;结论仍需维护者核验。
Add an opt-in steady decode scheduling fast path and token-major M-RoPE buffers for Qwen3-Omni. Both switches default to off; Omni use requires the matching scheduler and input-preparation integration in vllm-omni.
Validated with Qwen3-Omni throughput benchmarks and a 3,000-sample ESD evaluation using the matching Omni integration.
git diff --checkpasses.