J
donaldJJ
AI & ML interests
None yet
Recent Activity
updated a dataset 11 days ago
donaldJJ/llm-vram-requirements updated a Space 11 days ago
donaldJJ/llm-vram-calculator new activity 12 days ago
Qwen/Qwen3.8-Flash-Next:Model cannot SPLIT TENSOR and will not work in consumer multi gpuOrganizations
None yet
Model cannot SPLIT TENSOR and will not work in consumer multi gpu
π 1
3
#62 opened 22 days ago
by
Dr-Ojinsky
Which GGUF quantization would you recommend for an RTX 5080 (16GB VRAM)?
2
#131 opened 23 days ago
by
pengwenzhi
Running IQ4_XS with MTP , crashing after a while.
β 1
2
#74 opened 17 days ago
by
Oxidez
ΠΠ²Π°Π½ΡΠΎΠ²Π°Π½ΠΈΠ΅ GGUF - Q8_0 ΠΈ Q4_K_M
π 1
1
#9 opened 18 days ago
by
itxw
Native quant?
π 1
3
#1 opened 19 days ago
by
singulariti
for 16gb vram context size <=114688 is fast. Pelican is gorgeous :)
ππ€― 4
8
#56 opened 17 days ago
by
KottCh
Memory performance
π 1
3
#67 opened 16 days ago
by
trombonator
Can we have a 8bit target ?
π 1
1
#12 opened 15 days ago
by
trigger2k25
Could we have a IQ3_S for coder?
ππ₯ 3
6
#3 opened 14 days ago
by
alexaione
MTP working?
4
#4 opened 14 days ago
by
netomx
Can you guys supply the Q5_K_M version?
β€οΈ 3
5
#4 opened 16 days ago
by
slyfox1186
Q4 for 64GB devices
π₯ 1
2
#1 opened 16 days ago
by
Vasili-Sk
VRAM requirements table / optional README badge
π 1
#2 opened 12 days ago
by
donaldJJ
VRAM requirements table / optional README badge
#4 opened 12 days ago
by
donaldJJ
VRAM requirements table / optional README badge
#13 opened 12 days ago
by
donaldJJ
Speed tests on a 3060 laptop with 48GB RAM
2
#31 opened 12 days ago
by
2vibeornot2vibe
Pretty good performance on a 2016 card
3
#5 opened 13 days ago
by
ygboucherk
fatal: run with vllm 0.3 0.30.0+cu129
1
#6 opened 15 days ago
by
rt5566
Which text encoder?
1
#2 opened 16 days ago
by
Deepfreeze
NVFP4 model ?
7
#29 opened 15 days ago
by
Vazox