Optimize Qwen3.8 inference on Apple silicon
This commit is contained in:
3334
metal/qwen38.metal
3334
metal/qwen38.metal
File diff suppressed because it is too large
Load Diff
Reference in New Issue
Block a user