Skip to content

把multi_tensor_scale_tensor接入到TE-NPU - #112

Open
SummerMiku wants to merge 1 commit into
flagos-ai:mainfrom
SummerMiku:update-multi_tensor_scale_tensor
Open

把multi_tensor_scale_tensor接入到TE-NPU#112
SummerMiku wants to merge 1 commit into
flagos-ai:mainfrom
SummerMiku:update-multi_tensor_scale_tensor

Conversation

@SummerMiku

Copy link
Copy Markdown

问题

TE-FL 公共 ABI 定义了 multi_tensor_scale_tensor,而 TransformerEngineNPU 提供了相同的优化器实现。
然而,TE-FL NPU 后端没有适配器方法,也没有注册条目,因此 OpManager 无法为该操作选择 vendor.npu。

修改内容

  • 添加 NPUBackend.multi_tensor_scale_tensor() 方法。
  • 将调用转发至 TENPU 中同名的优化器。
  • 将此操作注册为 vendor.npu。
  • 增加针对缩放操作和非无穷标志传播的 NPU 功能测试。

范围

此补丁将现有的 TENPU 实现进行连接。内部 scale.item() 的转换保持不变。

@CLAassistant

CLAassistant commented Sep 2, 2026

Copy link
Copy Markdown

CLA assistant check
All committers have signed the CLA.

Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Projects

None yet

Development

Successfully merging this pull request may close these issues.

2 participants