Sign inSign up
L

lovedheart

Community User

Displaying 1 to 7 of 7 repositories

image

Qwen3.8-Flash-Next on sglang (#37500 merged, FP4/FP8 QSA indexer, SM120 b12x)

22d

4.5K

1

image

Qwen3.8-Flash-Next on sglang (#37500 merged, FP4/FP8 QSA indexer, SM120 b12x)

22d

311

image

One-command recipes for vLLM-Moet: auto-download + serve DeepSeek-V4-Flash, GLM-5.2, Kimi-K2.7-Code.

2m

1.6K

image

Frontier MoE on Blackwell: DeepSeek-V4-Flash, GLM-5.2, Kimi-K2.7 with 2-bit experts + FP4 recovery.

2m

1.7K

image

A vLLM extension for GPU + NUMA dual parallel inference

3m

224