Model Hub
Browse PQC-verified AI models, datasets, and tools
M
mradermacher/SciRM-Ref-7B-i1-GGUF HF
Unverified
Text GenerationTransformersGGUFReward-ModelScientific-WritingEvaluation HIGH
7K 1
Updated 2026-04-22 M
mradermacher/Delphi-25B-SimpleRL-Math-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFMathReasoningGrpo HIGH
6K 0
Updated 2026-08-01 Y
yhyk1971/Tifa-Deepsex-14b-CoT-Q8 HF
Unverified
Reinforcement-LearningTransformersGGUFIncremental-PretrainingSftRoleplay HIGH
6K 1
Updated 2026-08-11 M
mradermacher/Aryabhata-2.0-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFReasoningStemMathematics HIGH
5K 1
Updated 2026-06-26 V
ValueFX9507/Tifa-Deepsex-14b-CoT-Q8 HF
Unverified
Reinforcement-LearningTransformersGGUFIncremental-PretrainingSftRoleplay HIGH
5K 189
Updated 2026-08-04 V
ValueFX9507/Tifa-Deepsex-14b-CoT-GGUF-Q4 HF
Unverified
Reinforcement-LearningTransformersGGUFIncremental-PretrainingSftRoleplay HIGH
5K 843
Updated 2026-07-27 M
mradermacher/Vero-Qwen35-9B-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFVeroVision-Language-ModelMultimodal HIGH
4K 1
Updated 2026-07-23 M
mradermacher/Vero-Qwen35-9B-Base-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFVeroVision-Language-ModelMultimodal HIGH
4K 0
Updated 2026-07-18 M
mradermacher/SpatialThinker-30B-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFSpatial-ReasoningMultimodalVision-Language HIGH
4K 0
Updated 2026-06-25 M
mradermacher/SpatialThinker-7B-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFSpatial-ReasoningMultimodalVision-Language HIGH
4K 1
Updated 2026-07-09 G
google/tabfm-1.0.0-jax HF
Unverified
Tabular-ClassificationTabfmTabularTabular-RegressionZero-ShotIn-Context-Learning HIGH
4K 9
Updated 2026-08-28 M
mradermacher/Atomight-V2.1-0.5B-Inference-i1-GGUF HF
Unverified
Text GenerationTransformersGGUFCausal-LmGrpoReasoning HIGH
4K 1
Updated 2026-06-28 P
PKU-Alignment/beaver-7b-v1.0-reward HF
Unverified
Reinforcement-LearningSafe-RlhfSafetensorsLLaMAReinforcement-Learning-From-Human-FeedbackBeaver HIGH
3K 17
Updated 2026-07-09 R
RLinf/RLinf-OpenVLAOFT-LIBERO-130-Base-Lora HF
Unverified
Reinforcement-LearningSafetensorsOpenvlaRLinfCustom_codeModel-Index HIGH
3K 0
Updated 2026-07-02 M
mradermacher/LongTraceRL-30B-i1-GGUF HF
Unverified
Reinforcement-LearningTransformersGGUFLong-ContextReasoningRubric-Reward HIGH
2K 0
Updated 2026-06-28 Showing 15 of 335 items (page 17 of 17)
Prev Next