Popular repositories Loading
-
nemotron-encode
nemotron-encode PublicHigh-performance inference server for NVIDIA Nemotron VL embedding and reranking models, with comprehensive benchmarking tools.
Python 3
-
model-xl8r
model-xl8r PublicPure-Python model translator: HF safetensors ↔ GGUF ↔ ONNX ↔ OpenVINO ↔ CoreML ↔ MLX/AWQ/CompressedTensors. No llama.cpp/onnxruntime/openvino binaries required.
Python 1
-
-
wmd_mixedbread-ai_mxbai-rerank-xsmall-v1
wmd_mixedbread-ai_mxbai-rerank-xsmall-v1 PublicWebModelDelivery package for mixedbread-ai/mxbai-rerank-xsmall-v1
-
wmd_onnx-community_embeddinggemma-300m-ONNX
wmd_onnx-community_embeddinggemma-300m-ONNX PublicWebModelDelivery package for onnx-community/embeddinggemma-300m-ONNX
-
wmd_unsloth_gemma-3n-E2B-it-GGUF
wmd_unsloth_gemma-3n-E2B-it-GGUF PublicWebModelDelivery package for unsloth/gemma-3n-E2B-it-GGUF
Jupyter Notebook
If the problem persists, check the GitHub status page or contact support.