newsReddit r/MachineLearningTrust 52 · CommunityPublished 1mo agoLive · 1mo ago
We'll benchmark an Open weights LLM on any GPU you choose — drop your model + hardware and we'll run it. [D]
We run HexGrid Cloud, a platform for deploying open-source models on GPUs, and we're heads-down optimizing our serving/deployment layer. To pressure-test it we're benchmarking real models under real concurrency — and instead of guessing, we'd rather run what you actually want to see. --- Models available for benchmarking : Nemotron-3 Super 120B-A12B (only NVFP4) Nemotron-3 Nano 30B A3B Qwen-3.6
Why these links exist
Every edge carries a method, confidence, and the source snippet that justified it — so bad links are debuggable.
- PossiblePossibly related (embedding) · 58%notwitcheer/llm-bench-rig →
- PossiblePossibly related (embedding) · 58%raketenkater/ggrun →
- PossiblePossibly related (embedding) · 56%jmaczan/tiny-vllm →
- PossiblePossibly related (embedding) · 54%FastFlowLM/FastFlowLM →
- PossiblePossibly related (embedding) · 54%WattGPU: Predicting Inference Power and Latency on Unseen GPUs and LLMs →
- PossiblePossibly related (embedding) · 49%Erwan923/gpu-infra-lab →
- PossiblePossibly related (embedding) · 60%openlake-project/openlake →
- PossiblePossibly related (embedding) · 50%xcena-dev/maru →
Covers
Covers (incoming)
repoErwan923/gpu-infra-labrepoopenlake-project/openlakerepoxcena-dev/marurepoalibaba/tair-kvcacherepoAMD-AGI/HyperloomrepoDaoyuanLi2816/mini-verlrepotonyd2wild/The-Sparky-Command-CenterrepoROCm/FastFlowLMrepodezoito/ollama-grid-searchrepoDaoyuanLi2816/llm-gpu-labrepoAMD-AGI/Magpierepohogeheer499-commits/strix-halo-guiderepogiannisanni/pulsarrepoPicovoice/llm-compression-benchmarkrepobeehive-lab/GPULlama3.javarepoovg-project/kvcached
Related across the graph
repoAMD-AGI/Magpiereporaketenkater/ggrunrepobeehive-lab/GPULlama3.javarepotonyd2wild/The-Sparky-Command-Centerrepogiannisanni/pulsarreponotwitcheer/llm-bench-rigrepoROCm/FastFlowLMrepoopenlake-project/openlakepaperWattGPU: Predicting Inference Power and Latency on Unseen GPUs and LLMsrepojmaczan/tiny-vllmrepoAMD-AGI/HyperloomrepoErwan923/gpu-infra-labrepoDaoyuanLi2816/llm-gpu-labrepohogeheer499-commits/strix-halo-guiderepoalibaba/tair-kvcacherepoDaoyuanLi2816/mini-verlrepodezoito/ollama-grid-searchrepoPicovoice/llm-compression-benchmarkrepoxcena-dev/marurepoFastFlowLM/FastFlowLMrepoovg-project/kvcached
