Skip to content

[INTEL_HPU] enable tensor_wise_fp8 kernels - SDPA - #2181

Closed
yanfeich wants to merge 2 commits into
PaddlePaddle:developfrom
yanfeich:develop
Closed

[INTEL_HPU] enable tensor_wise_fp8 kernels - SDPA#2181
yanfeich wants to merge 2 commits into
PaddlePaddle:developfrom
yanfeich:develop

Conversation

@yanfeich

@yanfeich yanfeich commented Nov 18, 2025

Copy link
Copy Markdown
Collaborator

fused_sdpa_proj

  • combine bf16/fp8 as unique kernel
  • FSDPA out bf16/fp8 selectable

fused_block_attention

  • combine bf16/fp8 as unique kernel

fused_fp8_sdpa

  • add amax support

@paddle-bot

paddle-bot Bot commented Nov 18, 2025

Copy link
Copy Markdown

Thanks for your contribution!

@yanfeich
yanfeich force-pushed the develop branch 2 times, most recently from b3f3f7b to 1264a68 Compare November 18, 2025 05:18
@yanfeich yanfeich changed the title [INTEL_HPU] enable tensor_wise_fp8 kernels [INTEL_HPU] enable tensor_wise_fp8 kernels - SDPA Nov 18, 2025
@yanfeich yanfeich closed this Nov 18, 2025
@yanfeich yanfeich reopened this Nov 18, 2025
@yanfeich yanfeich closed this Nov 18, 2025
@yanfeich yanfeich reopened this Nov 18, 2025
@yanfeich yanfeich reopened this Nov 19, 2025
@yanfeich yanfeich closed this Nov 25, 2025
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Projects

None yet

Development

Successfully merging this pull request may close these issues.

2 participants