Skip to content

[Optimization] Put get_block_shape_and_split_kv_block in cuda graph for append attention backend - #4443

Merged
zhoutianzi666 merged 3 commits into
PaddlePaddle:developfrom
Sunny-bot1:append_graph
Oct 17, 2025
Merged

zhoutianzi666 merged 3 commits into
PaddlePaddle:developfrom
Sunny-bot1:append_graph

Conversation

@Sunny-bot1

Copy link
Copy Markdown
Collaborator

No description provided.

@paddle-bot

paddle-bot Bot commented Oct 16, 2025

Copy link
Copy Markdown

Thanks for your contribution!

@zhoutianzi666
zhoutianzi666 merged commit 930f7b7 into PaddlePaddle:develop Oct 17, 2025
24 of 27 checks passed
xiaoguoguo626807 pushed a commit to xiaoguoguo626807/FastDeploy that referenced this pull request May 7, 2026
…or append attention backend (PaddlePaddle#4443)

* get block in cuda graph

* fix sot
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

2 participants