Jon Doe
bullpoint
AI & ML interests
None yet
Organizations
None yet
Qwen3.6 397b
3
#75 opened 4 months ago
by
zenmagnets
Fast tokenizer token-ID parity with previous slow tokenizer?
3
#39 opened 3 months ago
by
bullpoint
vllm says it's not AWQ
4
#2 opened 7 months ago
by
jcowles
Works great! Thannk you!
3
#1 opened 7 months ago
by
Max-NexaEthos
Anyone try this on 4x RTX 6000 Pro yet?
52
#1 opened 6 months ago
by
zenmagnets
endless response
7
#4 opened 8 months ago
by
ramidahbash
GLM-4.6-FP8 - 55 tokens/sec on 4x RTX 6000 PRO
6
#2 opened 11 months ago
by
festr2
Speed measured on 2 x H200 / 4 x RTX 6000 Pro / 4 x A100
1
#3 opened 9 months ago
by
HristoTodorov
llm-compressor version
1
#1 opened 11 months ago
by
bullerwins
Suggested tokenizer changes by Unsloth.ai
🔥 13
7
#21 opened over 1 year ago
by
gugarosa