AI Models

313 models · 67 new in 60d

Compare →
  • Qwen3.8 27B FP8NewOpen

    Qwen · self-host

    Best for: Trending on HuggingFace (345 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.8-27B-FP8")

    transformerssafetensorsqwen3_5image-text-to-textconversational

    API: huggingface.co/Qwen/Qwen3.8-27B-FP8

    Auto-discovered from HuggingFace trending. 345 likes, 0 downloads.

  • Qwen3.8 27BNewOpen

    Qwen · self-host

    Best for: Trending on HuggingFace (9246 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.8-27B")

    transformerssafetensorsqwen3_5image-text-to-textconversational

    API: huggingface.co/Qwen/Qwen3.8-27B

    Auto-discovered from HuggingFace trending. 9246 likes, 2 downloads.

  • DeepSeek V4 Pro 0813NewOpen

    deepseek-ai · self-host

    Best for: Trending on HuggingFace (446 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepseek-ai/DeepSeek-V4-Pro-0813")

    transformerssafetensorsdeepseek_v4text-generationconversational

    API: huggingface.co/deepseek-ai/DeepSeek-V4-Pro-0813

    Auto-discovered from HuggingFace trending. 446 likes, 245 downloads.

  • BigBang V1NewOpen

    endless-frontier · self-host

    Best for: Trending on HuggingFace (190 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("endless-frontier/BigBang-v1")

    transformerssafetensorsqwen3_5_moeimage-text-to-textconversational

    API: huggingface.co/endless-frontier/BigBang-v1

    Auto-discovered from HuggingFace trending. 190 likes, 3K downloads.

  • NVIDIA Nemotron 3.5 Lightning 30B A3B NVFP4NewOpen

    nvidia · self-host

    Best for: Trending on HuggingFace (260 likes this week)

    How: Available on Hugging Face. 120K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4")

    transformerssafetensorsnemotron_htext-generationnvidia

    API: huggingface.co/nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4

    Auto-discovered from HuggingFace trending. 260 likes, 120K downloads.

  • Qwen3.8 2.4T A95BNewOpen

    Qwen · self-host

    Best for: Trending on HuggingFace (930 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.8-2.4T-A95B")

    transformerssafetensorsqwen3_5_moe_texttext-generationconversational

    API: huggingface.co/Qwen/Qwen3.8-2.4T-A95B

    Auto-discovered from HuggingFace trending. 930 likes, 4K downloads.

  • Muse Glimmer 30B GGUFNewOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (270 likes this week)

    How: Available on Hugging Face. 228K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/Muse-Glimmer-30B-GGUF")

    ggufimage-text-to-textarxiv:2504.13181arxiv:2602.06036base_model:meta-models/Muse-Glimmer-30B

    API: huggingface.co/unsloth/Muse-Glimmer-30B-GGUF

    Auto-discovered from HuggingFace trending. 270 likes, 228K downloads.

  • Muse Glimmer 30BNewOpen

    meta-models · self-host

    Best for: Trending on HuggingFace (1523 likes this week)

    How: Available on Hugging Face. 165K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("meta-models/Muse-Glimmer-30B")

    transformerssafetensorsmuse_glimmerimage-text-to-textconversational

    API: huggingface.co/meta-models/Muse-Glimmer-30B

    Auto-discovered from HuggingFace trending. 1523 likes, 165K downloads.

  • PinkCherry_MiniMax H3NewOpen

    SexGod1979 · self-host

    Best for: Trending on HuggingFace (299 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("SexGod1979/PinkCherry_MiniMax-H3")

    transformersminimax-h3text-to-videolicense:apache-2.0endpoints_compatible

    API: huggingface.co/SexGod1979/PinkCherry_MiniMax-H3

    Auto-discovered from HuggingFace trending. 299 likes, 324 downloads.

  • LFM2.5 2.6B GGUFNewOpen

    LiquidAI · self-host

    Best for: Trending on HuggingFace (176 likes this week)

    How: Available on Hugging Face. 68K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("LiquidAI/LFM2.5-2.6B-GGUF")

    ggufliquidlfm2.5llama.cpptext-generation

    API: huggingface.co/LiquidAI/LFM2.5-2.6B-GGUF

    Auto-discovered from HuggingFace trending. 176 likes, 68K downloads.

  • Minimax H3 TurboNewOpen

    lightx2v · self-host

    Best for: Trending on HuggingFace (495 likes this week)

    How: Available on Hugging Face. 150K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("lightx2v/Minimax-h3-Turbo")

    diffuserst2vi2vr2vimage-to-video

    API: huggingface.co/lightx2v/Minimax-h3-Turbo

    Auto-discovered from HuggingFace trending. 495 likes, 150K downloads.

  • MiniMax H3 Turbo Lora ComfyUINewOpen

    drbaph · self-host

    Best for: Trending on HuggingFace (307 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("drbaph/MiniMax-H3-Turbo-Lora-ComfyUI")

    minimax-h3loraadaptercomfyuipruned-model

    API: huggingface.co/drbaph/MiniMax-H3-Turbo-Lora-ComfyUI

    Auto-discovered from HuggingFace trending. 307 likes, 0 downloads.

  • MiniMax H3 Turbo LoraNewOpen

    larryvrh · self-host

    Best for: Trending on HuggingFace (745 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("larryvrh/MiniMax-H3-Turbo-Lora")

    text-to-videotext-to-audioaudio-videoloraminimax-h3

    API: huggingface.co/larryvrh/MiniMax-H3-Turbo-Lora

    Auto-discovered from HuggingFace trending. 745 likes, 0 downloads.

  • Ling 3.0 FlashNewOpen

    inclusionAI · self-host

    Best for: Trending on HuggingFace (308 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("inclusionAI/Ling-3.0-flash")

    safetensorsbailing_hybridtext-generationconversationalcustom_code

    API: huggingface.co/inclusionAI/Ling-3.0-flash

    Auto-discovered from HuggingFace trending. 308 likes, 6K downloads.

  • Maple PreviewNewOpen

    deepgrove · self-host

    Best for: Trending on HuggingFace (337 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepgrove/maple-preview")

    transformerssafetensorstext-generationcausal-lmmixture-of-experts

    API: huggingface.co/deepgrove/maple-preview

    Auto-discovered from HuggingFace trending. 337 likes, 2K downloads.

  • Qwen3 VL 32B Ultra Heretic H3 ComfyUI INT8 ConvRotNewOpen

    ethanfel · self-host

    Best for: Trending on HuggingFace (466 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ethanfel/Qwen3-VL-32B-Ultra-Heretic-H3-ComfyUI-INT8-ConvRot")

    comfyuih3qwen3-vlqwen3-vl-32bheretic

    API: huggingface.co/ethanfel/Qwen3-VL-32B-Ultra-Heretic-H3-ComfyUI-INT8-ConvRot

    Auto-discovered from HuggingFace trending. 466 likes, 0 downloads.

  • LTX 2.5NewOpen

    Lightricks · self-host

    Best for: Trending on HuggingFace (869 likes this week)

    How: Available on Hugging Face. 208K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Lightricks/LTX-2.5")

    diffusion-single-fileimage-to-videotext-to-videovideo-to-videoimage-text-to-video

    API: huggingface.co/Lightricks/LTX-2.5

    Auto-discovered from HuggingFace trending. 869 likes, 208K downloads.

  • Qwen3.6 35B A3B Uncensored Genesis Hermes V7 GGUFNewOpen

    LuffyTheFox · self-host

    Best for: Trending on HuggingFace (390 likes this week)

    How: Available on Hugging Face. 309K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF")

    hermesggufuncensoredqwen3.6moe

    API: huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF

    Auto-discovered from HuggingFace trending. 390 likes, 309K downloads.

  • XYZ Aquila ProNewOpen

    XYZAILab · self-host

    Best for: Trending on HuggingFace (361 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("XYZAILab/XYZ-Aquila-pro")

    transformerssafetensorsqwen3_5_moeimage-text-to-textagentic-search

    API: huggingface.co/XYZAILab/XYZ-Aquila-pro

    Auto-discovered from HuggingFace trending. 361 likes, 1K downloads.

  • LFM2.5 2.6BNewOpen

    LiquidAI · self-host

    Best for: Trending on HuggingFace (619 likes this week)

    How: Available on Hugging Face. 124K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("LiquidAI/LFM2.5-2.6B")

    transformerssafetensorslfm2text-generationliquid

    API: huggingface.co/LiquidAI/LFM2.5-2.6B

    Auto-discovered from HuggingFace trending. 619 likes, 124K downloads.

  • Qwen3.6 35B A3B Escha W2NewOpen

    EschaLabs · self-host

    Best for: Trending on HuggingFace (210 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("EschaLabs/Qwen3.6-35B-A3B-Escha-W2")

    safetensorsqwen3_5_moemixture-of-expertsmoeqwen3

    API: huggingface.co/EschaLabs/Qwen3.6-35B-A3B-Escha-W2

    Auto-discovered from HuggingFace trending. 210 likes, 3K downloads.

  • KromaNewOpen

    lodestones · self-host

    Best for: Trending on HuggingFace (211 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("lodestones/Kroma")

    lorakrea2kreatext-to-imagecomfyui

    API: huggingface.co/lodestones/Kroma

    Auto-discovered from HuggingFace trending. 211 likes, 0 downloads.

  • XYZ Aquila MiniNewOpen

    XYZAILab · self-host

    Best for: Trending on HuggingFace (417 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("XYZAILab/XYZ-Aquila-mini")

    transformerssafetensorsqwen3_5_moeimage-text-to-textqwen3.6

    API: huggingface.co/XYZAILab/XYZ-Aquila-mini

    Auto-discovered from HuggingFace trending. 417 likes, 1K downloads.

  • DeepSeek V4 Flash 0731NewOpen

    deepseek-ai · self-host

    Best for: Trending on HuggingFace (3393 likes this week)

    How: Available on Hugging Face. 1606K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepseek-ai/DeepSeek-V4-Flash-0731")

    transformerssafetensorsdeepseek_v4text-generationconversational

    API: huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731

    Auto-discovered from HuggingFace trending. 3393 likes, 1.6M downloads.

  • VibeVoice ASR BitNetNewOpen

    microsoft · self-host

    Best for: Trending on HuggingFace (122 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("microsoft/VibeVoice-ASR-BitNet")

    ggmlsafetensorsggufvibevoiceASR

    API: huggingface.co/microsoft/VibeVoice-ASR-BitNet

    Auto-discovered from HuggingFace trending. 122 likes, 4K downloads.

  • Mage VLNewOpen

    microsoft · self-host

    Best for: Trending on HuggingFace (276 likes this week)

    How: Available on Hugging Face. 436K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("microsoft/Mage-VL")

    transformerssafetensorsmage_vlimage-text-to-textmultimodal

    API: huggingface.co/microsoft/Mage-VL

    Auto-discovered from HuggingFace trending. 276 likes, 436K downloads.

  • Audio8 TTS Preview 0.6bNewOpen

    Audio8 · self-host

    Best for: Trending on HuggingFace (276 likes this week)

    How: Available on Hugging Face. 11K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Audio8/Audio8-TTS-Preview-0.6b")

    transformerssafetensorsarkttsfeature-extractionaudio

    API: huggingface.co/Audio8/Audio8-TTS-Preview-0.6b

    Auto-discovered from HuggingFace trending. 276 likes, 11K downloads.

  • Inkling SmallNewOpen

    thinkingmachines · self-host

    Best for: Trending on HuggingFace (328 likes this week)

    How: Available on Hugging Face. 22K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("thinkingmachines/Inkling-Small")

    transformerssafetensorsinkling_mm_modelimage-text-to-textconversational

    API: huggingface.co/thinkingmachines/Inkling-Small

    Auto-discovered from HuggingFace trending. 328 likes, 22K downloads.

  • Qwen3.6 35B A3B Uncensored Genesis Hermes V6 GGUFNewOpen

    LuffyTheFox · self-host

    Best for: Trending on HuggingFace (369 likes this week)

    How: Available on Hugging Face. 309K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF")

    hermesggufuncensoredqwen3.6moe

    API: huggingface.co/LuffyTheFox/Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF

    Auto-discovered from HuggingFace trending. 369 likes, 309K downloads.

  • Solar Open2 250B Nota NVFP4NewOpen

    nota-ai · self-host

    Best for: Trending on HuggingFace (151 likes this week)

    How: Available on Hugging Face. 19K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nota-ai/Solar-Open2-250B-Nota-NVFP4")

    vllmsafetensorssolar_open2quantizationnvfp4

    API: huggingface.co/nota-ai/Solar-Open2-250B-Nota-NVFP4

    Auto-discovered from HuggingFace trending. 151 likes, 19K downloads.

  • Kimi K3 GGUFNewOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (308 likes this week)

    How: Available on Hugging Face. 170K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/Kimi-K3-GGUF")

    transformersggufunslothconversationalimage-text-to-text

    API: huggingface.co/unsloth/Kimi-K3-GGUF

    Auto-discovered from HuggingFace trending. 308 likes, 170K downloads.

  • GLM 5.2 Vision NVFP4NewOpen

    baseten · self-host

    Best for: Trending on HuggingFace (131 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("baseten/GLM-5.2-Vision-NVFP4")

    sglangsafetensorsglm5vmultimodalvision-language

    API: huggingface.co/baseten/GLM-5.2-Vision-NVFP4

    Auto-discovered from HuggingFace trending. 131 likes, 3K downloads.

  • Fara1.5 27BNewOpen

    microsoft · self-host

    Best for: Trending on HuggingFace (264 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("microsoft/Fara1.5-27B")

    transformerssafetensorsqwen3_5image-text-to-textcomputer-use

    API: huggingface.co/microsoft/Fara1.5-27B

    Auto-discovered from HuggingFace trending. 264 likes, 3K downloads.

  • Claude Opus 5New

    Anthropic · 1M tokens · →

    Best for: For complex agentic coding and enterprise work

    How: client.messages.create({model: "claude-opus-5", messages: [...]})

    Example: Use via the Anthropic SDK with model='claude-opus-5'.

    1M tokens contextadaptive thinking128k tokens max outputagentic coding

    API: api.anthropic.com — model: claude-opus-5 · AWS Bedrock · GCP Vertex AI

    Max output: 128k tokens. Adaptive thinking enabled by default.

  • KAT Coder V2.5 DevNewOpen

    Kwaipilot · self-host

    Best for: Trending on HuggingFace (522 likes this week)

    How: Available on Hugging Face. 17K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Kwaipilot/KAT-Coder-V2.5-Dev")

    transformerssafetensorsqwen3_5_moeimage-text-to-textcode

    API: huggingface.co/Kwaipilot/KAT-Coder-V2.5-Dev

    Auto-discovered from HuggingFace trending. 522 likes, 17K downloads.

  • Antares 1bNewOpen

    fdtn-ai · self-host

    Best for: Trending on HuggingFace (234 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("fdtn-ai/antares-1b")

    transformerssafetensorsgranitemoehybridtext-generationsecurity

    API: huggingface.co/fdtn-ai/antares-1b

    Auto-discovered from HuggingFace trending. 234 likes, 8K downloads.

  • Laguna S 2.1 NVFP4NewOpen

    poolside · self-host

    Best for: Trending on HuggingFace (150 likes this week)

    How: Available on Hugging Face. 158K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("poolside/Laguna-S-2.1-NVFP4")

    vllmsafetensorslagunalaguna-s-2.1text-generation

    API: huggingface.co/poolside/Laguna-S-2.1-NVFP4

    Auto-discovered from HuggingFace trending. 150 likes, 158K downloads.

  • Laguna S 2.1 GGUFNewOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (249 likes this week)

    How: Available on Hugging Face. 130K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/Laguna-S-2.1-GGUF")

    transformersgguflaguna-s-2.1unslothvllm

    API: huggingface.co/unsloth/Laguna-S-2.1-GGUF

    Auto-discovered from HuggingFace trending. 249 likes, 130K downloads.

  • Mage FlowNewOpen

    microsoft · self-host

    Best for: Trending on HuggingFace (422 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("microsoft/Mage-Flow")

    diffuserssafetensorstext-to-imageimage-generationimage-editing

    API: huggingface.co/microsoft/Mage-Flow

    Auto-discovered from HuggingFace trending. 422 likes, 2K downloads.

  • Solar Open2 250BNewOpen

    upstage · self-host

    Best for: Trending on HuggingFace (718 likes this week)

    How: Available on Hugging Face. 13K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("upstage/Solar-Open2-250B")

    transformerssafetensorssolar_open2text-generationupstage

    API: huggingface.co/upstage/Solar-Open2-250B

    Auto-discovered from HuggingFace trending. 718 likes, 13K downloads.

  • Nanbeige4.2 3BNewOpen

    Nanbeige · self-host

    Best for: Trending on HuggingFace (652 likes this week)

    How: Available on Hugging Face. 35K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Nanbeige/Nanbeige4.2-3B")

    transformerssafetensorsnanbeigetext-generationllm

    API: huggingface.co/Nanbeige/Nanbeige4.2-3B

    Auto-discovered from HuggingFace trending. 652 likes, 35K downloads.

  • Motif 3 BetaNewOpen

    Motif-Technologies · self-host

    Best for: Trending on HuggingFace (201 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Motif-Technologies/Motif-3-Beta")

    transformerssafetensorsMotiffeature-extractionmotif

    API: huggingface.co/Motif-Technologies/Motif-3-Beta

    Auto-discovered from HuggingFace trending. 201 likes, 3K downloads.

  • Laguna S 2.1NewOpen

    poolside · self-host

    Best for: Trending on HuggingFace (910 likes this week)

    How: Available on Hugging Face. 82K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("poolside/Laguna-S-2.1")

    transformerssafetensorslagunatext-generationlaguna-s-2.1

    API: huggingface.co/poolside/Laguna-S-2.1

    Auto-discovered from HuggingFace trending. 910 likes, 82K downloads.

  • Inkling GGUFNewOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (116 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/inkling-GGUF")

    ggufconversationalimage-text-to-textaudio-text-to-textmoe

    API: huggingface.co/unsloth/inkling-GGUF

    Auto-discovered from HuggingFace trending. 116 likes, 7K downloads.

  • Qwen3.6 27B Fable Fusion 711 Uncensored Heretic NM DAU NEO MAX MTP GGUFNewOpen

    DavidAU · self-host

    Best for: Trending on HuggingFace (2019 likes this week)

    How: Available on Hugging Face. 2892K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF")

    ggufunslothfine tunehereticuncensored

    API: huggingface.co/DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

    Auto-discovered from HuggingFace trending. 2019 likes, 2.9M downloads.

  • Ternary Bonsai 27B Mlx 2bitNewOpen

    prism-ml · self-host

    Best for: Trending on HuggingFace (131 likes this week)

    How: Available on Hugging Face. 18K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("prism-ml/Ternary-Bonsai-27B-mlx-2bit")

    mlxsafetensorsqwen3_5conversationalternary

    API: huggingface.co/prism-ml/Ternary-Bonsai-27B-mlx-2bit

    Auto-discovered from HuggingFace trending. 131 likes, 18K downloads.

  • MiniCPM5 1B Claude Opus Fable5 V2 Thinking GGUFNewOpen

    GnLOLot · self-host

    Best for: Trending on HuggingFace (147 likes this week)

    How: Available on Hugging Face. 52K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF")

    ggufllama.cppquantizedminicpm5thinking

    API: huggingface.co/GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF

    Auto-discovered from HuggingFace trending. 147 likes, 52K downloads.

  • Wan Dancer 14BNewOpen

    Wan-AI · self-host

    Best for: Trending on HuggingFace (145 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Wan-AI/Wan-Dancer-14B")

    diffuserssafetensorsi2vvideovideo genration

    API: huggingface.co/Wan-AI/Wan-Dancer-14B

    Auto-discovered from HuggingFace trending. 145 likes, 2K downloads.

  • Bonsai 27B Mlx 1bitNewOpen

    prism-ml · self-host

    Best for: Trending on HuggingFace (162 likes this week)

    How: Available on Hugging Face. 25K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("prism-ml/Bonsai-27B-mlx-1bit")

    mlxsafetensorsqwen3_5conversational1-bit

    API: huggingface.co/prism-ml/Bonsai-27B-mlx-1bit

    Auto-discovered from HuggingFace trending. 162 likes, 25K downloads.

  • OvisOCR2NewOpen

    ATH-MaaS · self-host

    Best for: Trending on HuggingFace (259 likes this week)

    How: Available on Hugging Face. 27K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ATH-MaaS/OvisOCR2")

    transformerssafetensorsqwen3_5image-text-to-textocr

    API: huggingface.co/ATH-MaaS/OvisOCR2

    Auto-discovered from HuggingFace trending. 259 likes, 27K downloads.

  • MiniCPM5 1B Claude Opus Fable5 ThinkingNewOpen

    GnLOLot · self-host

    Best for: Trending on HuggingFace (159 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking")

    transformerssafetensorsllamatext-generationminicpm

    API: huggingface.co/GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking

    Auto-discovered from HuggingFace trending. 159 likes, 5K downloads.

  • InklingNewOpen

    thinkingmachines · self-host

    Best for: Trending on HuggingFace (1654 likes this week)

    How: Available on Hugging Face. 46K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("thinkingmachines/Inkling")

    transformerssafetensorsinkling_mm_modelimage-text-to-textconversational

    API: huggingface.co/thinkingmachines/Inkling

    Auto-discovered from HuggingFace trending. 1654 likes, 46K downloads.

  • Qwythos 9B V2NewOpen

    empero-ai · self-host

    Best for: Trending on HuggingFace (138 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("empero-ai/Qwythos-9B-v2")

    transformerssafetensorsqwen3_5image-text-to-textqwythos

    API: huggingface.co/empero-ai/Qwythos-9B-v2

    Auto-discovered from HuggingFace trending. 138 likes, 8K downloads.

  • Bonsai 27B GgufNewOpen

    prism-ml · self-host

    Best for: Trending on HuggingFace (654 likes this week)

    How: Available on Hugging Face. 2187K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("prism-ml/Bonsai-27B-gguf")

    llama.cppggufconversational1-bitllama-cpp

    API: huggingface.co/prism-ml/Bonsai-27B-gguf

    Auto-discovered from HuggingFace trending. 654 likes, 2.2M downloads.

  • Ternary Bonsai 27B GgufNewOpen

    prism-ml · self-host

    Best for: Trending on HuggingFace (1101 likes this week)

    How: Available on Hugging Face. 665K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("prism-ml/Ternary-Bonsai-27B-gguf")

    llama.cppggufconversationalternary2-bit

    API: huggingface.co/prism-ml/Ternary-Bonsai-27B-gguf

    Auto-discovered from HuggingFace trending. 1101 likes, 665K downloads.

  • Tess 4 27BNewOpen

    migtissera · self-host

    Best for: Trending on HuggingFace (116 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("migtissera/Tess-4-27B")

    transformerssafetensorsqwen3_5image-text-to-texttess

    API: huggingface.co/migtissera/Tess-4-27B

    Auto-discovered from HuggingFace trending. 116 likes, 1K downloads.

  • Qwythos 9B V2 GGUFNewOpen

    empero-ai · self-host

    Best for: Trending on HuggingFace (184 likes this week)

    How: Available on Hugging Face. 106K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("empero-ai/Qwythos-9B-v2-GGUF")

    ggufllama.cppquantizedqwythosqwen3.5

    API: huggingface.co/empero-ai/Qwythos-9B-v2-GGUF

    Auto-discovered from HuggingFace trending. 184 likes, 106K downloads.

  • LTX Best Face IDNewOpen

    Alissonerdx · self-host

    Best for: Trending on HuggingFace (127 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Alissonerdx/LTX-Best-Face-ID")

    ltx-videoidentity-preservationipt2vreference-to-videolora

    API: huggingface.co/Alissonerdx/LTX-Best-Face-ID

    Auto-discovered from HuggingFace trending. 127 likes, 0 downloads.

  • Supra Router 51MNewOpen

    SupraLabs · self-host

    Best for: Trending on HuggingFace (102 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("SupraLabs/Supra-Router-51M")

    transformerssafetensorsllamatext-generationrouter

    API: huggingface.co/SupraLabs/Supra-Router-51M

    Auto-discovered from HuggingFace trending. 102 likes, 1K downloads.

  • Nemotron Labs Audex 30B A3BNewOpen

    nvidia · self-host

    Best for: Trending on HuggingFace (144 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/Nemotron-Labs-Audex-30B-A3B")

    transformerssafetensorsnemotron_labs_audexnvidianemotron-labs-audex

    API: huggingface.co/nvidia/Nemotron-Labs-Audex-30B-A3B

    Auto-discovered from HuggingFace trending. 144 likes, 1K downloads.

  • Inflect Nano V2Open

    owensong · self-host

    Best for: Trending on HuggingFace (119 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("owensong/Inflect-Nano-v2")

    text-to-speechspeech-synthesislocal-ttscpuedge-ai

    API: huggingface.co/owensong/Inflect-Nano-v2

    Auto-discovered from HuggingFace trending. 119 likes, 654 downloads.

  • Kimi K3Open

    moonshotai · self-host

    Best for: Trending on HuggingFace (10683 likes this week)

    How: Available on Hugging Face. 1975K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("moonshotai/Kimi-K3")

    transformerssafetensorskimi_k3feature-extractioncompressed-tensors

    API: huggingface.co/moonshotai/Kimi-K3

    Auto-discovered from HuggingFace trending. 10683 likes, 2.0M downloads.

  • Inflect Micro V2Open

    owensong · self-host

    Best for: Trending on HuggingFace (400 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("owensong/Inflect-Micro-v2")

    text-to-speechspeech-synthesislocal-ttscpuedge-ai

    API: huggingface.co/owensong/Inflect-Micro-v2

    Auto-discovered from HuggingFace trending. 400 likes, 2K downloads.

  • Claude Opus 4.7

    Anthropic · 1M tokens · $5/M → $25/M

    Best for: Most capable generally available model. Complex multi-step coding, long agentic workflows, 1M-token codebase reads.

    How: client.messages.create(model='claude-opus-4-7', ...). Adaptive thinking is on by default — no separate extended-thinking mode needed.

    Example: Use Claude Code CLI with --model claude-opus-4-7 to handle PR-sized refactors end-to-end in a single run.

    SWE-bench step-change over Opus 4.6Context 1M (~555k words)
    agentic codingnew tokenizeradaptive thinking1M context128k max output

    API: api.anthropic.com (model: claude-opus-4-7) · AWS Bedrock · GCP Vertex AI · Microsoft Foundry

    Step-change improvement in agentic coding vs Opus 4.6. New tokenizer means 1M tokens ≈ 555k words (vs 750k for Sonnet 4.6).

  • Gemma 4 31B DenseOpen

    Google · 256K tokens · self-host

    Best for: Self-hosted multimodal production, commercial use, multilingual apps

    How: Dense 31B — fits on a single A100 or 2x RTX 4090. Apache 2.0 = fully commercial. Supports images and video natively.

    Example: Deploy as a private multimodal assistant that reads screenshots, logs, and video clips.

    LMSYS Arena #3 textMMLU ~82%
    multimodalimages + video35+ languagesApache 2.0dense architecture
    Hardware to self-host
    VRAM: 20GB (quantized) / 62GB (FP16)
    GPU: 1× A100 80GB or 2× RTX 4090 24GB
    RAM: 32GB+ system RAM

    31B dense. Native multimodal (images + video) increases compute cost vs text-only.

    API: Ollama, vLLM, Hugging Face, Vertex AI. ollama run gemma4:31b

    Brand new (Apr 2026). Ranked #3 on LMSYS Arena text leaderboard at launch.

  • Gemma 4 27B MoEOpen

    Google · 128K tokens · self-host

    Best for: Faster self-hosted inference, cost-efficient multimodal

    How: MoE variant — faster inference than the 31B dense. Same multimodal capabilities.

    Example: Process image-based monitoring alerts faster than the dense variant at the same quality.

    LMSYS Arena #6 text
    MoE efficiencymultimodalimages + videoApache 2.0
    Hardware to self-host
    VRAM: 18GB (quantized) / 54GB (FP16)
    GPU: RTX 4090 24GB or 1× A100 40GB
    RAM: 32GB+ system RAM

    27B total MoE — faster inference than the 31B dense thanks to sparse activations.

    API: Ollama, vLLM, Hugging Face. ollama run gemma4:27b-moe

  • Gemma 4 E4BOpen

    Google · 128K tokens · self-host

    Best for: Edge, mobile, IoT, on-device AI with multimodal input

    How: 4B params — runs on any hardware. Supports images, video, AND native audio input.

    Example: Run on a Raspberry Pi to process security camera feeds with voice commands.

    tinyon-devicemultimodal + audioApache 2.0
    Hardware to self-host
    VRAM: 3GB (quantized) / 8GB (FP16)
    GPU: Any — CPU, phone, Jetson, Raspberry Pi 5, integrated GPU
    RAM: 4-8GB system RAM

    4B params. Edge-first design: runs on phones, SBCs, IoT devices.

    API: Ollama, Hugging Face. Runs on phones and Raspberry Pi.

  • DeepSeek V3.2Open

    DeepSeek · 164K tokens · self-host

    Best for: Long-context coding, upgraded V3 deployments

    How: Drop-in upgrade from V3. Uses Dynamic Sparse Attention for better long-context performance.

    Example: Feed your entire microservice codebase and get cross-service dependency analysis.

    HumanEval 94.0%
    codingmathsparse attention (DSA)MIT licenseimproved context
    Hardware to self-host
    VRAM: 350GB (quantized)
    GPU: 8× H100 80GB
    RAM: 512GB+ system RAM

    Same hardware footprint as V3 — 671B with sparse attention.

    API: api.deepseek.com OR self-host via vLLM. Same OpenAI-compatible API.

  • Mistral Large 3Open

    Mistral · 256K tokens · self-host

    Best for: European deployments, agent workflows, long-context multilingual apps

    How: Major upgrade from Large 2. MoE architecture with 41B active params. Same API, just change model ID.

    Example: Build a multi-tool agent that queries DBs, calls APIs, and generates reports in 30+ languages.

    MoE 41B active / 675B totalmultilingualfunction calling256K context
    Hardware to self-host
    VRAM: 350GB (quantized)
    GPU: 8× H100 80GB
    RAM: 512GB+ system RAM

    675B MoE (41B active). Datacenter class — most users go via api.mistral.ai.

    API: api.mistral.ai OR self-host via vLLM. OpenAI-compatible.

  • Ministral 3 (3B/8B/14B)Open

    Mistral · 128K tokens · self-host

    Best for: Edge deployment, on-device AI, lightweight vision tasks

    How: 3B fits on phones, 8B on laptops, 14B on dev GPUs. All have vision support.

    Example: Run 8B on a Jetson to classify manufacturing defects from camera feeds.

    edge-friendlyvisiondense3 sizes
    Hardware to self-host
    VRAM: 2GB (3B) / 6GB (8B) / 10GB (14B quantized)
    GPU: Phone/CPU (3B) · Laptop GPU (8B) · RTX 3060+ (14B)
    RAM: 8-16GB system RAM

    All three sizes are dense with vision. 3B runs on phones, 8B on laptops, 14B on dev GPUs.

    API: Ollama, vLLM, Hugging Face. Also on Mistral API.

  • Seedance 2.0 Pro

    ByteDance · N/A · credit-based → per-second

    Best for: Cost-sensitive Chinese-market video, fast iteration on social shorts, longer narrative clips.

    How: Two tiers — Seedance 2.0 Pro for quality and Seedance 2.0 Lite for fast/cheap drafts. Both expose text-to-video and image-to-video; v2 adds longer shot length and stronger prompt adherence over v1.

    Example: POST volcengineapi.com/seedance/v2/videos { prompt: 'a hummingbird in flight, slow motion', mode: 'pro' }

    high-fidelity 1080p (with 4K up-res)longer coherent shotsimproved motion physicsLite tier for cheap iteration

    API: Volcengine / ByteDance API

    Successor to Seedance 1.0 (2025-06). ByteDance's competitor to Sora / Veo / Kling. The Lite tier remains notably cheaper than competitors at comparable quality.

  • Sora 2

    OpenAI · N/A · see openai.com/pricing → per-second tiered

    Best for: Marketing reels, b-roll, storyboard previz, social-media shorts.

    How: Generate up to 60s clips from a text prompt or seed image. Audio and lip-sync included.

    Example: client.videos.generate(model='sora-2', prompt='aerial shot of a coastal city at sunrise, 1080p, 10s')

    high-fidelity 1080p videorealistic motion physicslong-shot consistencyaudio + dialogue generation

    API: api.openai.com — client.videos.generate(model='sora-2')

    Successor to Sora 1 — adds native audio and longer coherent shots.

  • Wan 2.2Open

    Alibaba · N/A · self-host

    Best for: Best-in-class open-source video. The 5B variant runs on a single 24GB consumer card.

    How: ComfyUI nodes ship official support. Or `python generate.py --task t2v-A14B --prompt '...'` from the WanX repo.

    Example: python generate.py --task t2v-A14B --prompt 'a corgi running on the beach at sunset' --resolution 720P

    MoE video architectureopen weightsT2V + I2V5B small variant for consumer GPUs720p output
    Hardware to self-host
    VRAM: 24GB (5B variant) / 80GB (A14B)
    GPU: RTX 4090 for 5B · H100 for A14B
    RAM: 32–64GB system RAM

    5B model fits a single 4090. A14B MoE delivers Sora-class quality but needs an H100 or 2× 4090 with offload.

    API: huggingface.co/Wan-AI/Wan2.2-T2V-A14B · Wan-AI/Wan2.2-T2V-5B

  • Kimi K2.5

    Moonshot AI · 256K tokens · $0.55/M → $2.19/M

    Best for: Budget alternative to flagship models, Chinese language tasks

    How: OpenAI SDK with base_url='https://api.moonshot.ai/v1'. WARNING: has implicit reasoning that eats max_tokens.

    Example: Use moonshot-v1-8k instead for structured JSON tasks — kimi-k2.5 wastes tokens on hidden thinking.

    reasoningmultimodalcheap

    API: api.moonshot.ai — OpenAI-compatible

    Watch:hidden thinking burns tokenstemperature locked to 1
  • Claude Opus 4.6

    Anthropic · 1M tokens · $15/M → $75/M

    Best for: Complex multi-step coding, large codebase refactors, long-document analysis

    How: Best via Claude Code CLI for coding tasks. For API: messages.create() with system prompt + tools.

    Example: claude-code: point it at a repo, describe the feature, it reads/edits/tests autonomously.

    SWE-bench 72.5%GPQA Diamond 74.9%HumanEval 95.4%
    reasoninglong contexttool useagentic workflowscode generation

    API: api.anthropic.com — SDK: pip install anthropic / npm i @anthropic-ai/sdk

  • Claude Sonnet 4.6

    Anthropic · 200K tokens · $3/M → $15/M

    Best for: Production API backends, real-time chat, moderate complexity coding

    How: Drop-in replacement for Opus when you need faster/cheaper. Same API, just change model ID.

    Example: Use as the default model in your API gateway — upgrade to Opus only for hard problems.

    SWE-bench 65.2%HumanEval 93.8%
    speedcost-efficiencycodingtool use

    API: api.anthropic.com — same SDK as Opus

  • Gemini 2.5 Flash

    Google · 1M tokens · $0.15/M → $0.60/M

    Best for: High-volume processing, real-time apps, budget-conscious pipelines

    How: Set thinking_budget to control reasoning cost. 0 = no thinking, 24576 = max.

    Example: Summarize 1000 GitHub issues per hour for a triage dashboard at ~$1.

    speedcostlong contextthinking budget control

    API: Same SDK as Gemini Pro. model='gemini-2.5-flash-preview-05-20'

  • Veo 3

    Google · N/A · Vertex AI pricing → per-second tiered

    Best for: Photoreal cinematic clips, ad creative, talking-head shorts with audio.

    How: Vertex AI: generate(model='veo-3.0-generate-preview', prompt='...'). Gemini API exposes the same model.

    Example: ai.models.generate_videos(model='veo-3.0-generate-preview', prompt='timelapse of a city under heavy rain')

    1080p / 4K up-ressynchronized audiostrong prompt adherence8s native, longer with stitching

    API: Vertex AI / Gemini API — model: veo-3.0-generate-preview

  • Claude Haiku 4.5

    Anthropic · 200K tokens · $0.80/M → $4/M

    Best for: Pipelines, batch processing, structured data extraction, routing

    How: Use for high-volume, low-complexity tasks: classification, extraction, summarization.

    Example: Process 10K support tickets per hour to classify priority and extract entities.

    HumanEval 88.5%
    speedcoststructured outputclassification

    API: api.anthropic.com — same SDK

  • GPT-4.1

    OpenAI · 1M tokens · $2/M → $8/M

    Best for: General-purpose API integration, multimodal apps, coding assistance

    How: client.chat.completions.create(model='gpt-4.1', messages=[...]). Supports vision, tools, JSON mode.

    Example: Build a PR review bot that reads diffs + screenshots and posts comments.

    SWE-bench 54.6%HumanEval 95.3%
    codinginstruction followinglong contextmultimodal

    API: api.openai.com — SDK: pip install openai / npm i openai

  • GPT-4.1 mini

    OpenAI · 1M tokens · $0.40/M → $1.60/M

    Best for: Embeddings preprocessing, log parsing, lightweight generation

    How: Same API as GPT-4.1. Best for high-volume, simple tasks where cost matters.

    Example: Parse 50K structured logs per hour and extract error patterns.

    SWE-bench 28.8%HumanEval 92.5%
    costspeedlong context

    API: api.openai.com — same SDK

  • GPT-4.1 nano

    OpenAI · 1M tokens · $0.10/M → $0.40/M

    Best for: Intent classification, entity extraction at massive scale

    How: Use for routing, tagging, simple extraction where quality bar is lower.

    Example: Route 1M incoming messages per day to the right service for $4 total.

    ultra-cheapfastclassification

    API: api.openai.com — same SDK

  • o3

    OpenAI · 200K tokens · $2/M → $8/M

    Best for: Hard math, science, multi-step planning, complex debugging

    How: Use reasoning_effort param: 'low'/'medium'/'high'. No system prompt — use developer message instead.

    Example: Debug a distributed system deadlock by feeding it the full trace + architecture.

    GPQA Diamond 79.7%AIME 2024 96.7%SWE-bench 69.1%
    reasoningmathscienceplanning

    API: api.openai.com — same SDK, just model='o3'

  • o4-mini

    OpenAI · 200K tokens · $1.10/M → $4.40/M

    Best for: Coding with reasoning, moderate-complexity math, budget reasoning

    How: Cheaper reasoning model. Use when o3 is overkill but you need chain-of-thought.

    Example: Generate a migration plan for a database schema change with safety checks.

    AIME 2024 93.4%SWE-bench 68.1%
    reasoningcodingcost-efficient reasoning

    API: api.openai.com — same SDK

  • Llama 4 MaverickOpen

    Meta · 1M tokens · self-host

    Best for: Self-hosted production deployments, privacy-sensitive workloads

    How: ollama run llama4-maverick OR deploy on vLLM with tensor parallelism. Also available hosted on Together/Groq.

    Example: Deploy on 2x A100 GPUs behind your API gateway for private code review.

    MMLU 88.4%HumanEval 84.8%
    multilingualmultimodalMoE architecture17B active / 400B total
    Hardware to self-host
    VRAM: 200GB (quantized)
    GPU: 2× H100 80GB or 4× A100 80GB
    RAM: 256GB system RAM

    400B total params (17B active). FP16 needs ~800GB, FP8 ~400GB, INT4 ~200GB.

    API: Self-host via vLLM, Ollama, or use via Together, Fireworks, Groq

  • Llama 4 ScoutOpen

    Meta · 10M tokens · self-host

    Best for: Processing entire codebases, very long documents, single-GPU deployments

    How: Fits on a single H100. Best open model for extreme context lengths.

    Example: Feed your entire monorepo into context and ask about cross-service dependencies.

    MMLU 86.2%
    longest context (10M)MoE 17B active / 109B totalfits single H100
    Hardware to self-host
    VRAM: 80GB
    GPU: 1× H100 80GB
    RAM: 128GB system RAM

    17B active params, fits in a single H100 at FP8.

    API: Same as Maverick — vLLM, Ollama, Together, Fireworks

  • Qwen 3 235BOpen

    Alibaba · 128K tokens · self-host

    Best for: Flexible thinking control, commercial self-hosting, multilingual

    How: Supports /think and /no_think tags to toggle reasoning on/off per request. Apache 2.0 = fully commercial.

    Example: Use /no_think for fast classification, /think for complex debugging — same model.

    AIME 2024 85.7%HumanEval 90.2%
    hybrid thinkingMoE 22B activeApache 2.0multilingual
    Hardware to self-host
    VRAM: 140GB (quantized)
    GPU: 4× A100 80GB or 2× H100
    RAM: 256GB+ system RAM

    235B total (22B active). MoE architecture — only 22B params active per forward pass.

    API: Self-host via vLLM/SGLang or use via Together, Fireworks. Also on Alibaba Cloud.

  • Qwen 3 30BOpen

    Alibaba · 128K tokens · self-host

    Best for: Local development, laptop-friendly reasoning, privacy

    How: Excellent for local dev. MoE means only 3B params active — fast on consumer hardware.

    Example: Run on your dev machine as a private coding assistant with reasoning.

    AIME 2024 66.7%
    MoE 3B active / 30B totalruns on consumer GPUhybrid thinking
    Hardware to self-host
    VRAM: 20GB (quantized) / 60GB (FP16)
    GPU: RTX 4090 24GB (quantized) or 1× A100
    RAM: 32GB+ system RAM

    30B total (3B active). The 3B active params make inference fast on consumer hardware.

    API: ollama run qwen3:30b — fits on RTX 4090 (24GB)

  • GPT-Image-1

    OpenAI · N/A · $5/M tokens → $40/M tokens

    Best for: UI mockups, marketing assets, diagrams with text

    How: Supports text overlays, inpainting, and style control. Best text rendering of any model.

    Example: Generate architecture diagrams with accurate labels from a text description.

    text renderinginstruction followingediting

    API: api.openai.com — client.images.generate(model='gpt-image-1')

  • Kling 2.1

    Kuaishou · N/A · credit-based → per-second

    Best for: Cost-sensitive video generation, dance / sports content.

    How: Cheaper alternative to Sora/Veo with strong human-motion fidelity.

    Example: POST klingai.com/v1/videos/text2video { prompt: '...', duration: 10 }

    realistic human motionlong shot generationcompetitive quality at lower price

    API: klingai.com — REST API

  • Gemini 2.5 Pro

    Google · 1M tokens · $1.25/M → $10/M

    Best for: Long-document analysis, multimodal tasks, apps needing search grounding

    How: client.models.generate_content(model='gemini-2.5-pro', contents=[...]). Supports grounding with Google Search.

    Example: Feed a 200-page architecture doc and ask it to find security issues.

    SWE-bench 63.8%GPQA Diamond 67.2%
    multimodallong contextsearch groundingcode generation

    API: generativelanguage.googleapis.com — SDK: pip install google-genai

  • Gemma 3 27BOpen

    Google · 128K tokens · self-host

    Best for: On-device/edge deployment, multimodal at small scale

    How: ollama run gemma3:27b. Fits on RTX 3090/4090. Good multimodal + tool use at small size.

    Example: Run on a dev server to process screenshots and generate bug reports.

    MMLU 75.6%HumanEval 78.0%
    compactmultimodalruns on single GPUfunction calling
    Hardware to self-host
    VRAM: 18GB (quantized) / 54GB (FP16)
    GPU: RTX 3090/4090 24GB or 1× A100 40GB
    RAM: 32GB+ system RAM

    27B dense. Fits on a single high-end consumer GPU with quantization.

    API: Ollama, vLLM, Hugging Face. Also on Vertex AI.

  • Runway Gen-4

    Runway · N/A · credit-based → per-second

    Best for: Short narrative content where the same character appears in multiple scenes.

    How: Pass a reference image and a prompt; returns a 5–10s clip with consistent characters across shots.

    Example: POST runwayml.com/v1/image_to_video { promptImage: ..., promptText: '...' }

    character & object consistency across shotsimage-to-videolip-synccreator workflow

    API: runwayml.com — REST API + web app

  • Grok 3

    xAI · 128K tokens · $3/M → $15/M

    Best for: Tasks needing real-time information, math-heavy problems

    How: OpenAI SDK with base_url override. Also supports live search via tools.

    Example: Monitor real-time tech news and generate summaries using live search.

    GPQA Diamond 68.2%AIME 2024 93.3%
    reasoningreal-time datamath

    API: api.x.ai — OpenAI-compatible SDK. Set base_url='https://api.x.ai/v1'

  • Grok 3 mini

    xAI · 128K tokens · $0.30/M → $0.50/M

    Best for: Budget reasoning tasks, math, lightweight chain-of-thought

    How: Excellent cost-to-reasoning ratio. Use reasoning_effort param.

    Example: Validate Terraform plans with reasoning about dependency chains for pennies.

    fast reasoningvery cheapmath

    API: api.x.ai — same as Grok 3

  • Nomic Embed Text v2-MoEOpen

    Nomic AI · 8K tokens · self-host

    Best for: Self-hosted RAG, privacy-first search, zero-cost embeddings

    How: Self-host for zero cost. Comparable quality to OpenAI embeddings.

    Example: Run alongside pgvector on the same server — full RAG pipeline with zero API costs.

    MoE embeddingmatryoshkaApache 2.0self-hostable
    Hardware to self-host
    VRAM: 2GB or CPU-only
    GPU: Any — runs on CPU at reasonable speed
    RAM: 4-8GB system RAM

    Tiny MoE embedding model. CPU inference is fast enough for most use cases.

    API: pip install nomic OR Ollama. Also hosted on Nomic Atlas.

  • Step-Video-T2VOpen

    StepFun · N/A · self-host

    Best for: Highest-quality open-source video model when you have the hardware to run it.

    How: Clone stepfun-ai/Step-Video-T2V repo, install requirements, run sample.py with your prompt.

    Example: python sample_video.py --prompt 'underwater coral reef, schools of fish' --num-frames 204 --resolution 544x992

    30B paramsMIT licensecompetitive with Sora-class qualitydeep compression video VAE
    Hardware to self-host
    VRAM: 80GB (FP16) / 40GB (FP8)
    GPU: H100 80GB · or 2× A100 40GB · or A100 40GB with FP8
    RAM: 128GB system RAM

    30B is genuinely heavy but the MIT license + quality tradeoff is uniquely permissive in the open-source video space.

    API: huggingface.co/stepfun-ai/stepvideo-t2v

  • DeepSeek R1Open

    DeepSeek · 128K tokens · self-host

    Best for: Budget reasoning, self-hosted chain-of-thought, research

    How: API is OpenAI-compatible. Self-host the 70B distill on 2x A100. MIT license = no restrictions.

    Example: Run the 14B distill locally for debugging complex distributed system issues.

    AIME 2024 79.8%SWE-bench 49.2%GPQA Diamond 71.5%
    reasoningmathcodingMIT licensedistillable
    Hardware to self-host
    VRAM: 10GB (14B distill) / 48GB (70B distill) / 1TB+ (full 671B)
    GPU: RTX 4090 (14B) · 2× A100 (70B) · 8× H100 (full)
    RAM: Full model needs 256GB+ system RAM

    Full 671B MoE is massive. Distilled versions (14B, 32B, 70B) are far more practical.

    API: api.deepseek.com ($0.55/M in, $2.19/M out) OR self-host via vLLM/Ollama

  • Codestral 25.01Open

    Mistral · 256K tokens · self-host

    Best for: Code completion, inline suggestions, editor integration

    How: Supports FIM for inline completion. Integrate with any editor via LSP or Continue.dev.

    Example: Deploy as your team's FIM-capable completion server behind an LSP proxy.

    HumanEval 91.0%
    code completionFIM (fill-in-middle)80+ languages
    Hardware to self-host
    VRAM: 16GB (quantized) / 45GB (FP16)
    GPU: RTX 4090 24GB or 1× A100 40GB
    RAM: 32GB+ system RAM

    22B dense. Fits on a single consumer GPU with quantization.

    API: codestral.mistral.ai — dedicated code endpoint

  • Llama 3.3 70BOpen

    Meta · 128K tokens · self-host

    Best for: Proven workhorse for self-hosted deployments, fine-tuning base

    How: ollama run llama3.3:70b. For production: vLLM on 2x A100 or 4x A10G.

    Example: Fine-tune on your internal docs for a private knowledge base chatbot.

    MMLU 86.0%HumanEval 88.4%
    mature ecosystemfine-tuning friendlywide hardware support
    Hardware to self-host
    VRAM: 40GB (4-bit) / 140GB (FP16)
    GPU: 2× A100 80GB or 4× A10G 24GB
    RAM: 64GB+ system RAM

    70B dense. Widely supported — runs on Ollama with quantization on 48GB VRAM.

    API: Ollama, vLLM, TGI, or hosted (Together $0.60/M, Groq, Fireworks)

  • DeepSeek V3Open

    DeepSeek · 128K tokens · self-host

    Best for: Cost-sensitive production APIs, coding tasks, math-heavy pipelines

    How: Cheapest top-tier API. OpenAI-compatible. Self-host needs 8x A100.

    Example: Replace GPT-4 in your CI pipeline for automated code review at 1/10th the cost.

    HumanEval 92.1%MMLU 88.5%
    codingmathMoE 37B active / 671B totalMIT license
    Hardware to self-host
    VRAM: 350GB (quantized) / 1.3TB (FP16)
    GPU: 8× H100 80GB or 8× A100 80GB
    RAM: 512GB+ system RAM

    671B total (37B active). Most users rent via API — self-hosting needs datacenter hardware.

    API: api.deepseek.com ($0.27/M in, $1.10/M out) OR self-host

  • Phi-4Open

    Microsoft · 16K tokens · self-host

    Best for: Edge deployment, STEM tasks, embedded AI in products

    How: ollama run phi4. MIT license — embed in commercial products freely.

    Example: Embed in a CI pipeline to validate config files and Terraform plans.

    GPQA Diamond 56.2%MATH 80.4%
    14B paramsSTEM reasoningMIT licenseruns on laptop
    Hardware to self-host
    VRAM: 9GB (quantized) / 28GB (FP16)
    GPU: Any 8GB+ GPU (RTX 3060, laptop 4050, etc.)
    RAM: 16GB system RAM

    14B dense. Runs locally on most developer laptops with quantization.

    API: Ollama, Hugging Face, Azure AI

  • Pika 2.2

    Pika Labs · N/A · credit-based → per-clip

    Best for: Social shorts, music videos, rapid creative iteration.

    How: Strong for short, stylized clips and quick iteration. Pikaframes lets you set start/end frames.

    Example: Use Pikaframes: upload start + end image, prompt the in-between motion.

    fast iterationpikaframes (keyframe interpolation)lipsync

    API: pika.art — web app + API

  • HunyuanVideoOpen

    Tencent · N/A · self-host

    Best for: Self-hosted video generation, research, building custom pipelines.

    How: Clone repo, install diffusers, run sample.py with your prompt. Or use ComfyUI workflows.

    Example: python sample_video.py --prompt 'a cat surfing at sunset' --video-length 129 --infer-steps 50

    fully open weights13B paramscompetitive qualityfine-tunable
    Hardware to self-host
    VRAM: 60GB
    GPU: H100 80GB or 2× RTX 4090 (with offload)
    RAM: 64GB system RAM

    Quantized to 8-bit fits on a single A100 40GB. Comfy workflows offload UNet to CPU at the cost of speed.

    API: huggingface.co/tencent/HunyuanVideo

  • Qwen 2.5 Coder 32BOpen

    Alibaba · 128K tokens · self-host

    Best for: Private code completion, self-hosted Copilot replacement

    How: ollama run qwen2.5-coder:32b. Plug into Continue.dev or Copilot alternatives.

    Example: Set up as your team's private code completion backend — zero data leaves your infra.

    HumanEval 92.7%LiveCodeBench 48.5%
    code completioncode generationApache 2.0
    Hardware to self-host
    VRAM: 20GB (quantized) / 64GB (FP16)
    GPU: RTX 4090 24GB or 1× A100 40GB
    RAM: 32GB+ system RAM

    32B dense. Fits on a single consumer GPU with 4-bit quantization.

    API: Ollama, vLLM, or hosted on Together/Fireworks

  • LTX-VideoOpen

    Lightricks · N/A · self-host

    Best for: When you need quick turnaround — prototypes, drafts, dataset generation. Speed-first open-source video.

    How: diffusers LTXPipeline. Generates a 5-second 768×512 clip in seconds on an H100; a few minutes on a 4090.

    Example: from diffusers import LTXPipeline; pipe = LTXPipeline.from_pretrained('Lightricks/LTX-Video'); pipe(prompt='falling autumn leaves').frames

    real-time generation on H1002B params (small footprint)fast iteration loop13B variant for higher quality
    Hardware to self-host
    VRAM: 12GB (2B) / 24GB (13B)
    GPU: RTX 3090 / 4090 for 2B · H100 for 13B
    RAM: 32GB system RAM

    Smallest/fastest of the open-source video models — great for iterating on prompts before committing GPU time to bigger models.

    API: huggingface.co/Lightricks/LTX-Video · Lightricks/LTX-Video-13B

  • Mochi 1Open

    Genmo · N/A · self-host

    Best for: Open-source video where commercial use matters — the Apache 2.0 license is unrestricted.

    How: Diffusers pipeline or the official genmoai/models repo. ComfyUI workflows are well-documented.

    Example: python -m mochi_preview.cli --prompt 'time lapse of a city street at golden hour' --num-frames 84

    Apache 2.0 (commercial-friendly)10B paramshigh motion fidelityactive community fine-tunes
    Hardware to self-host
    VRAM: 60GB (full precision) / 24GB with quantization
    GPU: H100 80GB · or RTX 4090 with FP8 quant + offload
    RAM: 64GB system RAM

    Memory-hungry at full precision but FP8 / GGUF quants from the community fit a single 4090.

    API: huggingface.co/genmo/mochi-1-preview

  • Flux.1 Pro

    Black Forest Labs · N/A · $0.05/image → N/A

    Best for: High-quality image generation, product photography

    How: API or self-host Flux.1 Schnell (open). Pro via API only.

    Example: Generate product mockups for landing pages programmatically.

    photorealismprompt adherencecommercial license

    API: api.bfl.ml OR via Replicate, fal.ai

  • CogVideoX-5BOpen

    THUDM / Zhipu AI · N/A · self-host

    Best for: Pioneer open-source T2V — solid baseline for self-hosted experimentation and fine-tuning.

    How: pip install diffusers; CogVideoXPipeline.from_pretrained('THUDM/CogVideoX-5b') and run with a text prompt.

    Example: from diffusers import CogVideoXPipeline; pipe = CogVideoXPipeline.from_pretrained('THUDM/CogVideoX-5b'); pipe(prompt='a panda playing piano').frames

    fully open weights5B paramsfits on a single 24GB carddiffusers integration
    Hardware to self-host
    VRAM: 18GB (with CPU offload) / 24GB native
    GPU: RTX 4090 24GB
    RAM: 32GB system RAM

    Quantized + offload tricks let it run on 12GB. Slower than newer entries but the most fine-tuned-on open video model.

    API: huggingface.co/THUDM/CogVideoX-5b

  • Moonshot v1 (8K/32K/128K)

    Moonshot AI · 8K / 32K / 128K tokens · $0.14/M → $0.28/M

    Best for: Batch processing, structured extraction, JSON pipelines

    How: Best for structured output tasks. Supports response_format: json_object. No reasoning overhead.

    Example: Process RSS feeds into structured summaries for pennies per 1000 articles.

    very cheapno hidden reasoningreliable JSON

    API: api.moonshot.ai — OpenAI-compatible. model='moonshot-v1-8k'

  • text-embedding-3-large

    OpenAI · 8K tokens · $0.13/M → N/A

    Best for: RAG pipelines, semantic search, document retrieval

    How: Set dimensions param to reduce size (e.g., 256 for fast search, 3072 for max quality).

    Example: Index your internal docs and build a search API with pgvector + this model.

    3072 dimensionsstrong retrievalmatryoshka support

    API: api.openai.com — client.embeddings.create(model='text-embedding-3-large')

  • NVIDIA NeMo AutomodelOpen

    NVIDIA · N/A · self-host

    Best for: Efficiently fine-tuning and generating video and image models

    How: Use NVIDIA NeMo Automodel in conjunction with 🤗 Diffusers for model fine-tuning and generation

    Example: Fine-tune a video model using NVIDIA NeMo Automodel and generate images with 🤗 Diffusers

    Fine-tuning video and image models at scaleIntegration with 🤗 Diffusers

    Auto-discovered from news articles.

  • AMD GAIA

    AMD · 128K tokens · api

    Best for: Email management and AI assistance

    How: Integrate GAIA with email clients for AI-powered email sorting and response generation

    Example: Use GAIA to automatically categorize incoming emails and suggest replies

    AI companion for emails

    Auto-discovered from news articles.

  • Lemonade 11.0

    AMD · N/A · api

    Best for: Local AI server applications

    How: Integrate Lemonade 11.0 with AMD hardware for on-premises AI workloads

    Example: Use Lemonade 11.0 to deploy AI models leveraging AMD's CPUs, GPUs, and NPUs

    Text-to-speechSupport for AMD Ryzen CPUsSupport for AMD Radeon GPUsSupport for AMD Ryzen AI NPU

    Auto-discovered from news articles.

  • Hy3 GGUFNewOpen

    AngelSlim · self-host

    Best for: Trending on HuggingFace (149 likes this week)

    How: Available on Hugging Face. 110K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("AngelSlim/Hy3-GGUF")

    gguftext-generationbase_model:tencent/Hy3base_model:quantized:tencent/Hy3license:apache-2.0

    API: huggingface.co/AngelSlim/Hy3-GGUF

    Auto-discovered from HuggingFace trending. 149 likes, 110K downloads.

  • Bonsai 27B

    Hacker News · api

    Best for: mobile AI applications

    How: deploy Bonsai 27B on a mobile device

    Example: use Bonsai 27B for on-device AI tasks

    runs on a phone

    Auto-discovered from news articles.

  • Nemotron Model

    NVIDIA · api

    Best for: reasoning tasks

    How: participate in the NVIDIA Nemotron Model Reasoning Challenge

    Example: explore techniques to improve reasoning accuracy

    improving reasoning accuracy

    Auto-discovered from news articles.

  • LLM

    NVIDIA · 128K tokens · api

    Best for: training large language models with reduced memory constraints

    How: employ Host Offloading technique during training

    Example: use NVIDIA's LLM training approach to mitigate GPU memory limits

    reduces high-bandwidth memory bottlenecksoptimized for JAX-based training

    Auto-discovered from news articles.

  • NVIDIA Nemotron Labs 3 Puzzle 75B A9B NVFP4Open

    nvidia · self-host

    Best for: Trending on HuggingFace (115 likes this week)

    How: Available on Hugging Face. 39K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4")

    transformerssafetensorsnemotron_h_puzzletext-generationnvidia

    API: huggingface.co/nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4

    Auto-discovered from HuggingFace trending. 115 likes, 39K downloads.

  • OpenFold3

    NVIDIA · 128K tokens · api

    Best for: drug discovery and protein research

    How: use NVIDIA BioNeMo Agent Toolkit to accelerate performance

    Example: predicting protein structures for drug discovery

    biomolecular structure predictionco-folding

    Auto-discovered from news articles.

  • NVIDIA BioNeMo Agent Toolkit

    NVIDIA · api

    Best for: Biomolecular structure prediction and co-folding

    How: Integrate the toolkit into existing workflows for biomolecular structure prediction

    Example: Use the toolkit to enhance OpenFold3 models for drug discovery

    Accelerating end-to-end co-folding performancePowering drug discovery and protein design

    Auto-discovered from news articles.

  • NVIDIA NeMo

    NVIDIA · 128K tokens · api

    Best for: Financial natural language processing tasks

    How: Fine-tune the model on financial news data

    Example: Analyze earnings reports and financial news

    Fine-tuning LLMs for financial NLPHandling limited and imbalanced data

    Auto-discovered from news articles.

  • GPT-5.6

    OpenAI · 128K tokens · api

    Best for: high-level language tasks requiring deep understanding and generation

    How: use the API by calling `openai.Completion.create(model="gpt-5.6", prompt="your prompt here")`

    Example: Generate a summary of a long document or create a detailed response to a complex question

    state-of-the-art natural language processingadvanced understanding and generation capabilities

    Auto-discovered from news articles.

  • MiniCPM5 1B Claude Opus Fable5 Thinking GGUFNewOpen

    GnLOLot · self-host

    Best for: Trending on HuggingFace (258 likes this week)

    How: Available on Hugging Face. 121K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF")

    ggufllama.cppquantizedminicpm5thinking

    API: huggingface.co/GnLOLot/MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF

    Auto-discovered from HuggingFace trending. 258 likes, 121K downloads.

  • ThinkingCap Qwen3.6 27BNewOpen

    bottlecapai · self-host

    Best for: Trending on HuggingFace (531 likes this week)

    How: Available on Hugging Face. 25K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("bottlecapai/ThinkingCap-Qwen3.6-27B")

    transformerssafetensorsqwen3_5image-text-to-textqwen3_6

    API: huggingface.co/bottlecapai/ThinkingCap-Qwen3.6-27B

    Auto-discovered from HuggingFace trending. 531 likes, 25K downloads.

  • LongCat 2.0NewOpen

    meituan-longcat · self-host

    Best for: Trending on HuggingFace (183 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("meituan-longcat/LongCat-2.0")

    LongCat-2.0safetensorstransformerstext-generationconversational

    API: huggingface.co/meituan-longcat/LongCat-2.0

    Auto-discovered from HuggingFace trending. 183 likes, 2K downloads.

  • Hy3NewOpen

    tencent · self-host

    Best for: Trending on HuggingFace (830 likes this week)

    How: Available on Hugging Face. 14K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("tencent/Hy3")

    transformerssafetensorshy_v3text-generationhunyuan

    API: huggingface.co/tencent/Hy3

    Auto-discovered from HuggingFace trending. 830 likes, 14K downloads.

  • D7VK 1.12Open

    Phoronix · 128K tokens · self-host

    Best for: Optimizing Direct3D 7 and older applications on Linux

    How: Use D7VK 1.12 as the latest version of the implementation for Direct3D 7 and older atop the Vulkan API

    Example: Apply D7VK 1.12 to enhance the performance of legacy Direct3D applications on Linux systems

    Performance gains for older Direct3D versions on LinuxImplementation for Direct3D 7 and older atop the Vulkan API

    Auto-discovered from news articles.

  • Fable TracesNewOpen

    AliesTaha · self-host

    Best for: Trending on HuggingFace (198 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("AliesTaha/fable-traces")

    transformerssafetensorsqwen3text-generationinstruct

    API: huggingface.co/AliesTaha/fable-traces

    Auto-discovered from HuggingFace trending. 198 likes, 5K downloads.

  • Claude Sonnet 5New

    Anthropic · 1M tokens · →

    Best for: The best combination of speed and intelligence

    How: client.messages.create({model: "claude-sonnet-5", messages: [...]})

    Example: Use via the Anthropic SDK with model='claude-sonnet-5'.

    1M tokens contextadaptive thinking128k tokens max outputfast

    API: api.anthropic.com — model: claude-sonnet-5 · AWS Bedrock · GCP Vertex AI

    Max output: 128k tokens. Adaptive thinking enabled by default.

  • Qwopus3.6 35B A3B Coder MTP GGUFOpen

    Jackrong · self-host

    Best for: Trending on HuggingFace (141 likes this week)

    How: Available on Hugging Face. 85K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jackrong/Qwopus3.6-35B-A3B-Coder-MTP-GGUF")

    transformersggufllama.cppimage-text-to-textvision

    API: huggingface.co/Jackrong/Qwopus3.6-35B-A3B-Coder-MTP-GGUF

    Auto-discovered from HuggingFace trending. 141 likes, 85K downloads.

  • DeepSeek V4 Flash DSparkOpen

    deepseek-ai · self-host

    Best for: Trending on HuggingFace (144 likes this week)

    How: Available on Hugging Face. 33K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepseek-ai/DeepSeek-V4-Flash-DSpark")

    transformerssafetensorsdeepseek_v4text-generationarxiv:2606.19348

    API: huggingface.co/deepseek-ai/DeepSeek-V4-Flash-DSpark

    Auto-discovered from HuggingFace trending. 144 likes, 33K downloads.

  • Huihui GLM 5.2 Abliterated GGUFOpen

    huihui-ai · self-host

    Best for: Trending on HuggingFace (180 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("huihui-ai/Huihui-GLM-5.2-abliterated-GGUF")

    transformersggufglm_moe_dsaunslothabliterated

    API: huggingface.co/huihui-ai/Huihui-GLM-5.2-abliterated-GGUF

    Auto-discovered from HuggingFace trending. 180 likes, 7K downloads.

  • LTX 2.3 3DREAL LoRAOpen

    fal · self-host

    Best for: Trending on HuggingFace (145 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("fal/LTX-2.3-3DREAL-LoRA")

    loraic-loraltxltx-videoltx-2.3

    API: huggingface.co/fal/LTX-2.3-3DREAL-LoRA

    Auto-discovered from HuggingFace trending. 145 likes, 0 downloads.

  • Agents A1Open

    InternScience · self-host

    Best for: Trending on HuggingFace (569 likes this week)

    How: Available on Hugging Face. 33K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("InternScience/Agents-A1")

    transformerssafetensorsqwen3_5_moeimage-text-to-textmoe

    API: huggingface.co/InternScience/Agents-A1

    Auto-discovered from HuggingFace trending. 569 likes, 33K downloads.

  • Qwen3.6 27B NVFP4Open

    nvidia · self-host

    Best for: Trending on HuggingFace (217 likes this week)

    How: Available on Hugging Face. 1713K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/Qwen3.6-27B-NVFP4")

    transformerssafetensorsqwen3_5image-text-to-textunsloth

    API: huggingface.co/nvidia/Qwen3.6-27B-NVFP4

    Auto-discovered from HuggingFace trending. 217 likes, 1.7M downloads.

  • Nano Banana 2 LiteOpen

    DeepMind · 128K tokens · self-host

    Best for: Generating high-quality images with reduced computational requirements

    How: Use the provided API to generate images based on text prompts

    Example: Generate an image of a cat by providing the text prompt 'cat'

    Efficient image generationScalabilityHigh-quality images

    Auto-discovered from news articles.

  • LFM2.5 230MOpen

    LiquidAI · self-host

    Best for: Trending on HuggingFace (182 likes this week)

    How: Available on Hugging Face. 22K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("LiquidAI/LFM2.5-230M")

    transformerssafetensorslfm2text-generationliquid

    API: huggingface.co/LiquidAI/LFM2.5-230M

    Auto-discovered from HuggingFace trending. 182 likes, 22K downloads.

  • Ornith 1.0 397BOpen

    deepreinforce-ai · self-host

    Best for: Trending on HuggingFace (199 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepreinforce-ai/Ornith-1.0-397B")

    transformerssafetensorsqwen3_5_moeimage-text-to-texttext-generation

    API: huggingface.co/deepreinforce-ai/Ornith-1.0-397B

    Auto-discovered from HuggingFace trending. 199 likes, 7K downloads.

  • GLM 5.2 NVFP4Open

    nvidia · self-host

    Best for: Trending on HuggingFace (210 likes this week)

    How: Available on Hugging Face. 160K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/GLM-5.2-NVFP4")

    Model Optimizersafetensorsglm_moe_dsanvidiaModelOpt

    API: huggingface.co/nvidia/GLM-5.2-NVFP4

    Auto-discovered from HuggingFace trending. 210 likes, 160K downloads.

  • DeepSeek V4 Pro DSparkOpen

    deepseek-ai · self-host

    Best for: Trending on HuggingFace (459 likes this week)

    How: Available on Hugging Face. 29K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepseek-ai/DeepSeek-V4-Pro-DSpark")

    transformerssafetensorsdeepseek_v4text-generationarxiv:2606.19348

    API: huggingface.co/deepseek-ai/DeepSeek-V4-Pro-DSpark

    Auto-discovered from HuggingFace trending. 459 likes, 29K downloads.

  • GPT‑5.6 Sol

    OpenAI · 128K tokens · api

    Best for: advanced natural language processing tasks

    How: access the GPT-5.6 Sol model through the OpenAI API

    Example: use GPT-5.6 Sol for generating human-like text and summarization

    next-generation modelimproved capabilities over previous versions

    Auto-discovered from news articles.

  • GPT-5.6 Sol

    OpenAI · 128K tokens · api

    Best for: advanced AI applications

    How: use GPT-5.6 Sol for cutting-edge AI tasks

    Example: deploy GPT-5.6 Sol for state-of-the-art AI applications

    next-generation model

    Auto-discovered from news articles.

  • Mythos AI

    Anthropic · 128K tokens · api

    Best for: trusted AI applications

    How: deploy Mythos AI within trusted US organizations

    Example: use Mythos AI for secure and trusted AI applications

    trusted by US organizations

    Auto-discovered from news articles.

  • Ornith 1.0 9BOpen

    deepreinforce-ai · self-host

    Best for: Trending on HuggingFace (385 likes this week)

    How: Available on Hugging Face. 76K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepreinforce-ai/Ornith-1.0-9B")

    transformerssafetensorsqwen3_5image-text-to-texttext-generation

    API: huggingface.co/deepreinforce-ai/Ornith-1.0-9B

    Auto-discovered from HuggingFace trending. 385 likes, 76K downloads.

  • Ornith 1.0 35BOpen

    deepreinforce-ai · self-host

    Best for: Trending on HuggingFace (343 likes this week)

    How: Available on Hugging Face. 225K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepreinforce-ai/Ornith-1.0-35B")

    transformerssafetensorsqwen3_5_moeimage-text-to-texttext-generation

    API: huggingface.co/deepreinforce-ai/Ornith-1.0-35B

    Auto-discovered from HuggingFace trending. 343 likes, 225K downloads.

  • Ornith 1.0 9B GGUFOpen

    deepreinforce-ai · self-host

    Best for: Trending on HuggingFace (455 likes this week)

    How: Available on Hugging Face. 455K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepreinforce-ai/Ornith-1.0-9B-GGUF")

    transformersgguftext-generationlicense:mitendpoints_compatible

    API: huggingface.co/deepreinforce-ai/Ornith-1.0-9B-GGUF

    Auto-discovered from HuggingFace trending. 455 likes, 455K downloads.

  • GitHub Copilot agentic harness

    GitHub · api

    Best for: delivering strong performance and efficiency in coding tasks

    How: use the GitHub Copilot agentic harness for coding assistance

    Example: use GitHub Copilot agentic harness to write code more efficiently

    strong results across multiple benchmarksleading token efficiencyflexibility to choose among more than 20 models

    Auto-discovered from news articles.

  • Huihui Gemma 4 12B Coder Fable5 Composer2.5 V1 AbliteratedOpen

    huihui-ai · self-host

    Best for: Trending on HuggingFace (127 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("huihui-ai/Huihui-gemma-4-12B-coder-fable5-composer2.5-v1-abliterated")

    transformerssafetensorsgemma4_unifiedimage-text-to-textabliterated

    API: huggingface.co/huihui-ai/Huihui-gemma-4-12B-coder-fable5-composer2.5-v1-abliterated

    Auto-discovered from HuggingFace trending. 127 likes, 5K downloads.

  • Ornith 1.0 35B GGUFOpen

    deepreinforce-ai · self-host

    Best for: Trending on HuggingFace (856 likes this week)

    How: Available on Hugging Face. 1347K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepreinforce-ai/Ornith-1.0-35B-GGUF")

    transformersgguftext-generationlicense:mitendpoints_compatible

    API: huggingface.co/deepreinforce-ai/Ornith-1.0-35B-GGUF

    Auto-discovered from HuggingFace trending. 856 likes, 1.3M downloads.

  • Qwen AgentWorld 35B A3BOpen

    Qwen · self-host

    Best for: Trending on HuggingFace (557 likes this week)

    How: Available on Hugging Face. 58K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen-AgentWorld-35B-A3B")

    transformerssafetensorsqwen3_5_moeimage-text-to-textqwen

    API: huggingface.co/Qwen/Qwen-AgentWorld-35B-A3B

    Auto-discovered from HuggingFace trending. 557 likes, 58K downloads.

  • Krea 2 RawOpen

    krea · self-host

    Best for: Trending on HuggingFace (258 likes this week)

    How: Available on Hugging Face. 32K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("krea/Krea-2-Raw")

    diffuserssafetensorstext-to-imageenlicense:other

    API: huggingface.co/krea/Krea-2-Raw

    Auto-discovered from HuggingFace trending. 258 likes, 32K downloads.

  • Krea 2 TurboOpen

    krea · self-host

    Best for: Trending on HuggingFace (545 likes this week)

    How: Available on Hugging Face. 124K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("krea/Krea-2-Turbo")

    diffuserssafetensorstext-to-imageenbase_model:krea/Krea-2-Raw

    API: huggingface.co/krea/Krea-2-Turbo

    Auto-discovered from HuggingFace trending. 545 likes, 124K downloads.

  • Ideogram_4_turbotime_loraOpen

    ostris · self-host

    Best for: Trending on HuggingFace (111 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ostris/ideogram_4_turbotime_lora")

    diffuserstext-to-imagelorabase_model:ideogram-ai/ideogram-4-fp8base_model:adapter:ideogram-ai/ideogram-4-fp8

    API: huggingface.co/ostris/ideogram_4_turbotime_lora

    Auto-discovered from HuggingFace trending. 111 likes, 4K downloads.

  • MoebiusOpen

    HUST VL · N/A · self-host

    Best for: image inpainting

    How: Use the provided API to generate inpainted images

    Example: Inpaint missing regions in images using Moebius

    0.2B parameters10B-level performance

    Auto-discovered from news articles.

  • GPT-5.5-Cyber

    OpenAI · 128K tokens · api

    Best for: securing organizations by finding, validating, and patching vulnerabilities at scale

    How: Integrate GPT-5.5-Cyber with Daybreak tools to enhance security measures

    Example: Use GPT-5.5-Cyber to scan codebases for potential vulnerabilities and suggest patches

    vulnerability findingvalidationpatching

    Auto-discovered from news articles.

  • Qwythos 9B Claude Mythos 5 1MOpen

    empero-ai · self-host

    Best for: Trending on HuggingFace (737 likes this week)

    How: Available on Hugging Face. 153K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("empero-ai/Qwythos-9B-Claude-Mythos-5-1M")

    transformerssafetensorsqwen3_5image-text-to-textqwen3.5

    API: huggingface.co/empero-ai/Qwythos-9B-Claude-Mythos-5-1M

    Auto-discovered from HuggingFace trending. 737 likes, 153K downloads.

  • Qwythos 9B Claude Mythos 5 1M GGUFOpen

    empero-ai · self-host

    Best for: Trending on HuggingFace (2466 likes this week)

    How: Available on Hugging Face. 1571K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("empero-ai/Qwythos-9B-Claude-Mythos-5-1M-GGUF")

    ggufllama.cppquantizedqwen3.5reasoning

    API: huggingface.co/empero-ai/Qwythos-9B-Claude-Mythos-5-1M-GGUF

    Auto-discovered from HuggingFace trending. 2466 likes, 1.6M downloads.

  • Unlimited OCROpen

    baidu · self-host

    Best for: Trending on HuggingFace (3971 likes this week)

    How: Available on Hugging Face. 2858K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("baidu/Unlimited-OCR")

    transformerssafetensorsunlimited-ocrfeature-extractionbaidu

    API: huggingface.co/baidu/Unlimited-OCR

    Auto-discovered from HuggingFace trending. 3971 likes, 2.9M downloads.

  • ApertusOpen

    Open Foundation · 128K tokens · self-host

    Best for: Suitable for users seeking an open and sovereign AI model.

    How: Integrate Apertus into your AI infrastructure to leverage its capabilities.

    Example: Use Apertus for natural language processing tasks requiring a high degree of sovereignty and transparency.

    Sovereign AIOpen Foundation Model

    Auto-discovered from news articles.

  • Qwen3.6 27B MTP Pi Tune GGUFOpen

    bytkim · self-host

    Best for: Trending on HuggingFace (114 likes this week)

    How: Available on Hugging Face. 66K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("bytkim/Qwen3.6-27B-MTP-pi-tune-GGUF")

    ggufllama.cppqwenqwen3_6mtp

    API: huggingface.co/bytkim/Qwen3.6-27B-MTP-pi-tune-GGUF

    Auto-discovered from HuggingFace trending. 114 likes, 66K downloads.

  • LiftOpen

    datalab-to · self-host

    Best for: Trending on HuggingFace (152 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("datalab-to/lift")

    transformerssafetensorsqwen3_5image-text-to-textpdf

    API: huggingface.co/datalab-to/lift

    Auto-discovered from HuggingFace trending. 152 likes, 5K downloads.

  • Gemma 4 12B Agentic Fable5 Composer2.5 V2 3.5x Tau2 GGUFOpen

    yuxinlu1 · self-host

    Best for: Trending on HuggingFace (1179 likes this week)

    How: Available on Hugging Face. 453K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("yuxinlu1/gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF")

    ggufgemma4codingagenticterminal

    API: huggingface.co/yuxinlu1/gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF

    Auto-discovered from HuggingFace trending. 1179 likes, 453K downloads.

  • GLM 5.2 FP8Open

    zai-org · self-host

    Best for: Trending on HuggingFace (135 likes this week)

    How: Available on Hugging Face. 335K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("zai-org/GLM-5.2-FP8")

    transformerssafetensorsglm_moe_dsatext-generationconversational

    API: huggingface.co/zai-org/GLM-5.2-FP8

    Auto-discovered from HuggingFace trending. 135 likes, 335K downloads.

  • Inflect Nano V1Open

    owensong · self-host

    Best for: Trending on HuggingFace (196 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("owensong/Inflect-Nano-v1")

    pytorchtext-to-speechttsspeech-synthesisultra-small

    API: huggingface.co/owensong/Inflect-Nano-v1

    Auto-discovered from HuggingFace trending. 196 likes, 0 downloads.

  • Qwable V1Open

    lordx64 · self-host

    Best for: Trending on HuggingFace (164 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("lordx64/Qwable-v1")

    transformerssafetensorsqwen3_5_moeimage-text-to-textqwen

    API: huggingface.co/lordx64/Qwable-v1

    Auto-discovered from HuggingFace trending. 164 likes, 4K downloads.

  • GLM 5.2 GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (487 likes this week)

    How: Available on Hugging Face. 180K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/GLM-5.2-GGUF")

    ggufglm_moe_dsaunslothtext-generationen

    API: huggingface.co/unsloth/GLM-5.2-GGUF

    Auto-discovered from HuggingFace trending. 487 likes, 180K downloads.

  • Lemonade AI serverOpen

    AMD · N/A · self-host

    Best for: cross-platform AI usage on Windows and Linux

    How: Integrate Lemonade AI server with MCP Server for enhanced capabilities

    Example: Use Lemonade AI server for private AI tasks on Windows and Linux systems

    100% free and private AI usageleverages AMD Ryzen AI NPUs, Radeon GPUs, and x86_64 CPUs

    Auto-discovered from news articles.

  • Lemonade AI ServerOpen

    AMD · 128K tokens · self-host

    Best for: cross-platform AI usage on Windows and Linux

    How: install Lemonade AI server on Windows or Linux and start leveraging AI capabilities

    Example: use Lemonade AI server for on-device AI processing tasks

    100% free and private AI usageleverages AMD Ryzen AI NPUs, Radeon GPUs, and x86_64 CPUs

    Auto-discovered from news articles.

  • Kimi K2.7 Code GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (141 likes this week)

    How: Available on Hugging Face. 34K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/Kimi-K2.7-Code-GGUF")

    transformersggufkimi_k25image-feature-extractioncompressed-tensors

    API: huggingface.co/unsloth/Kimi-K2.7-Code-GGUF

    Auto-discovered from HuggingFace trending. 141 likes, 34K downloads.

  • XR AI

    NVIDIA · 128K tokens · api

    Best for: Creating AI experiences for AR glasses and wearable devices

    How: Integrate live data with AI models

    Example: Building AI agents for AR glasses and XR devices

    AI experiencesAR glasseswearable devices

    Auto-discovered from news articles.

  • Transaction Foundation Model

    NVIDIA · 128K tokens · api

    Best for: Analyzing financial transaction data

    How: Use the Transaction Foundation Model to analyze transaction data

    Example: Understanding patterns of human behavior in financial transactions

    Analyzing transaction dataUnderstanding human behavior patterns

    Auto-discovered from news articles.

  • NVIDIA XR AI

    NVIDIA · 128K tokens · api

    Best for: Developers building for AR glasses and wearable devices

    How: Integrate NVIDIA XR AI with AR glasses and wearable devices

    Example: Creating AI experiences for AR glasses and wearable devices

    AI experiences for AR glasses and wearable devicesIntegrates live data

    Auto-discovered from news articles.

  • VibeThinker 3BOpen

    WeiboAI · self-host

    Best for: Trending on HuggingFace (744 likes this week)

    How: Available on Hugging Face. 59K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("WeiboAI/VibeThinker-3B")

    transformerssafetensorsqwen2text-generationmath

    API: huggingface.co/WeiboAI/VibeThinker-3B

    Auto-discovered from HuggingFace trending. 744 likes, 59K downloads.

  • GLM 5.2Open

    zai-org · self-host

    Best for: Trending on HuggingFace (4894 likes this week)

    How: Available on Hugging Face. 2430K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("zai-org/GLM-5.2")

    transformerssafetensorsglm_moe_dsatext-generationconversational

    API: huggingface.co/zai-org/GLM-5.2

    Auto-discovered from HuggingFace trending. 4894 likes, 2.4M downloads.

  • ESM2

    NVIDIA · 128K tokens · api

    Best for: computational biology tasks

    How: Fine-tune ESM2 using NVIDIA BioNeMo recipes

    Example: Fine-tuning ESM2 with LoRA for specific protein tasks

    protein language understandinggenomic sequences

    Auto-discovered from news articles.

  • NVIDIA BioNeMo

    NVIDIA · N/A · api

    Best for: Computational biology tasks

    How: Use NVIDIA BioNeMo recipes for fine-tuning

    Example: Fine-tuning ESM2 protein language models

    Fine-tuning biological foundation modelsPretrained on massive corpora of protein or genomic sequences

    Auto-discovered from news articles.

  • FastContext 1.0 4B SFTOpen

    microsoft · self-host

    Best for: Trending on HuggingFace (356 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("microsoft/FastContext-1.0-4B-SFT")

    transformerssafetensorsqwen3text-generationExplorer SubAgent

    API: huggingface.co/microsoft/FastContext-1.0-4B-SFT

    Auto-discovered from HuggingFace trending. 356 likes, 6K downloads.

  • MiMo V2.5 Pro FP4 DFlashOpen

    XiaomiMiMo · self-host

    Best for: Trending on HuggingFace (115 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("XiaomiMiMo/MiMo-V2.5-Pro-FP4-DFlash")

    transformerssafetensorsmimo_v2text-generationagent

    API: huggingface.co/XiaomiMiMo/MiMo-V2.5-Pro-FP4-DFlash

    Auto-discovered from HuggingFace trending. 115 likes, 4K downloads.

  • Gemma 4 12B Coder Fable5 Composer2.5 V1 GGUFOpen

    yuxinlu1 · self-host

    Best for: Trending on HuggingFace (2596 likes this week)

    How: Available on Hugging Face. 641K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1-GGUF")

    ggufgemma4codingcodereasoning

    API: huggingface.co/yuxinlu1/gemma-4-12B-coder-fable5-composer2.5-v1-GGUF

    Auto-discovered from HuggingFace trending. 2596 likes, 641K downloads.

  • Rio 3.5 Open 397BOpen

    prefeitura-rio · self-host

    Best for: Trending on HuggingFace (327 likes this week)

    How: Available on Hugging Face. 191K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("prefeitura-rio/Rio-3.5-Open-397B")

    transformerssafetensorsqwen3_5_moeimage-text-to-textconversational

    API: huggingface.co/prefeitura-rio/Rio-3.5-Open-397B

    Auto-discovered from HuggingFace trending. 327 likes, 191K downloads.

  • Ryzen AI Halo

    AMD · N/A · api

    Best for: petite PC development

    How: work with either Microsoft Windows or Linux

    Example: use in AI development platforms

    Linux-friendlypowered by AMD Ryzen AI Max+

    Auto-discovered from news articles.

  • Qwopus3.6 27B Coder MTP GGUFOpen

    Jackrong · self-host

    Best for: Trending on HuggingFace (270 likes this week)

    How: Available on Hugging Face. 169K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jackrong/Qwopus3.6-27B-Coder-MTP-GGUF")

    transformersggufllama.cppimage-text-to-textvision

    API: huggingface.co/Jackrong/Qwopus3.6-27B-Coder-MTP-GGUF

    Auto-discovered from HuggingFace trending. 270 likes, 169K downloads.

  • SCAIL 2Open

    zai-org · self-host

    Best for: Trending on HuggingFace (223 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("zai-org/SCAIL-2")

    diffuserscharacter-animationvideo-generationpose-drivendiffusion

    API: huggingface.co/zai-org/SCAIL-2

    Auto-discovered from HuggingFace trending. 223 likes, 0 downloads.

  • MiniMax M3Open

    MiniMaxAI · self-host

    Best for: Trending on HuggingFace (1241 likes this week)

    How: Available on Hugging Face. 154K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("MiniMaxAI/MiniMax-M3")

    transformerssafetensorsminimax_m3_vlimage-text-to-textmultimodal

    API: huggingface.co/MiniMaxAI/MiniMax-M3

    Auto-discovered from HuggingFace trending. 1241 likes, 154K downloads.

  • Kimi K2.7 CodeOpen

    moonshotai · self-host

    Best for: Trending on HuggingFace (1332 likes this week)

    How: Available on Hugging Face. 681K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("moonshotai/Kimi-K2.7-Code")

    transformerssafetensorskimi_k25feature-extractioncompressed-tensors

    API: huggingface.co/moonshotai/Kimi-K2.7-Code

    Auto-discovered from HuggingFace trending. 1332 likes, 681K downloads.

  • Claude Code

    Anthropic · 128K tokens · api

    Best for: use in infrastructure management tasks

    How: connect AI to your infrastructure through the Model Context Protocol (MCP)

    Example: AI assistants like GitHub Copilot, IBM Bob, Claude Code etc. to interact with Terraform through the Model Context Protocol (MCP)

    interacts with Terraformsupports infrastructure management

    Auto-discovered from news articles.

  • Gemma 4 26B A4B It Qat GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (144 likes this week)

    How: Available on Hugging Face. 129K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/gemma-4-26B-A4B-it-qat-GGUF")

    transformersggufgemma4image-text-to-textunsloth

    API: huggingface.co/unsloth/gemma-4-26B-A4B-it-qat-GGUF

    Auto-discovered from HuggingFace trending. 144 likes, 129K downloads.

  • Diffusiongemma 26B A4B It GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (309 likes this week)

    How: Available on Hugging Face. 164K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/diffusiongemma-26B-A4B-it-GGUF")

    ggufgemma4unslothgemmagoogle

    API: huggingface.co/unsloth/diffusiongemma-26B-A4B-it-GGUF

    Auto-discovered from HuggingFace trending. 309 likes, 164K downloads.

  • DiffusionGemma

    NVIDIA · 128K tokens · api

    Best for: real-time AI applications such as chat assistants, copilots, and agentic workflows

    How: Run DiffusionGemma on NVIDIA for high-throughput text generation

    Example: Developers can leverage DiffusionGemma for building real-time AI applications

    Developer-ReadyHigh-ThroughputText Generation

    Auto-discovered from news articles.

  • Nex N2 MiniOpen

    nex-agi · self-host

    Best for: Trending on HuggingFace (220 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nex-agi/Nex-N2-mini")

    transformerssafetensorsqwen3_5_moeimage-text-to-texttext-generation

    API: huggingface.co/nex-agi/Nex-N2-mini

    Auto-discovered from HuggingFace trending. 220 likes, 8K downloads.

  • Diffusiongemma 26B A4B ItOpen

    google · self-host

    Best for: Trending on HuggingFace (1051 likes this week)

    How: Available on Hugging Face. 874K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("google/diffusiongemma-26B-A4B-it")

    transformerssafetensorsdiffusion_gemmaimage-text-to-textconversational

    API: huggingface.co/google/diffusiongemma-26B-A4B-it

    Auto-discovered from HuggingFace trending. 1051 likes, 874K downloads.

  • Claude Mythos 5

    Anthropic · 1M tokens · →

    Best for: Available through Project Glasswing. Successor to Claude Mythos Preview.

    How: client.messages.create({model: "claude-mythos-5", messages: [...]})

    Example: Use via the Anthropic SDK with model='claude-mythos-5'.

    1M tokens contextadaptive thinking128k tokens max output

    API: api.anthropic.com — model: claude-mythos-5 · AWS Bedrock · GCP Vertex AI

    Max output: 128k tokens. Adaptive thinking enabled by default.

  • Claude Fable 5

    Anthropic · 1M tokens · →

    Best for: Next-generation intelligence for long-running agents

    How: client.messages.create({model: "claude-fable-5", messages: [...]})

    Example: Use via the Anthropic SDK with model='claude-fable-5'.

    1M tokens contextadaptive thinking128k tokens max outputagentic coding

    API: api.anthropic.com — model: claude-fable-5 · AWS Bedrock · GCP Vertex AI

    Max output: 128k tokens. Adaptive thinking enabled by default.

  • NVIDIA Nemotron Speech

    NVIDIA · api

    Best for: Training speech AI models for clinical applications

    How: Evaluate Clinical ASR Models Faster with Agent Skills and NVIDIA Nemotron Speech

    Example: Training a speech AI model to correctly recognize drug names like Acetaminophen, Amlodipine

    Recognizing or synthesizing clinical terminology

    Auto-discovered from news articles.

  • Gemma 4 12B OBLITERATEDOpen

    OBLITERATUS · self-host

    Best for: Trending on HuggingFace (336 likes this week)

    How: Available on Hugging Face. 76K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("OBLITERATUS/Gemma-4-12B-OBLITERATED")

    transformerssafetensorsggufgemma4_unifiedimage-text-to-text

    API: huggingface.co/OBLITERATUS/Gemma-4-12B-OBLITERATED

    Auto-discovered from HuggingFace trending. 336 likes, 76K downloads.

  • Nex N2 ProOpen

    nex-agi · self-host

    Best for: Trending on HuggingFace (336 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nex-agi/Nex-N2-Pro")

    transformerssafetensorsqwen3_5_moeimage-text-to-texttext-generation

    API: huggingface.co/nex-agi/Nex-N2-Pro

    Auto-discovered from HuggingFace trending. 336 likes, 8K downloads.

  • North Mini Code 1.0Open

    CohereLabs · self-host

    Best for: Trending on HuggingFace (475 likes this week)

    How: Available on Hugging Face. 20K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("CohereLabs/North-Mini-Code-1.0")

    transformerssafetensorscohere2_moetext-generationconversational

    API: huggingface.co/CohereLabs/North-Mini-Code-1.0

    Auto-discovered from HuggingFace trending. 475 likes, 20K downloads.

  • Google Gemini models

    Google · 128K tokens · api

    Best for: AI applications

    How: integrate with Apple's new AI architecture

    Example: use in AI-powered applications

    AI architectureinnovative

    Auto-discovered from news articles.

  • NVIDIA Nemotron 3 Ultra 550B A55B NVFP4Open

    nvidia · self-host

    Best for: Trending on HuggingFace (160 likes this week)

    How: Available on Hugging Face. 91K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4")

    transformerssafetensorsnemotron_htext-generationnvidia

    API: huggingface.co/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4

    Auto-discovered from HuggingFace trending. 160 likes, 91K downloads.

  • Nemotron 3 Ultra

    NVIDIA · api

    Best for: maintaining context and completing tasks across many turns

    How: deploy on Renesas RZ/V series for production

    Example: use in chatbots evolving into long-running agents

    faster reasoningmore efficientlong-running agents

    Auto-discovered from news articles.

  • Claude Opus 4.8

    Anthropic · 1M tokens · →

    Best for: For complex agentic coding and enterprise work

    How: client.messages.create({model: "claude-opus-4-8", messages: [...]})

    Example: Use via the Anthropic SDK with model='claude-opus-4-8'.

    1M tokens contextadaptive thinking128k tokens max outputagentic coding

    API: api.anthropic.com — model: claude-opus-4-8 · AWS Bedrock · GCP Vertex AI

    Max output: 128k tokens. Adaptive thinking enabled by default.

  • MisoTTSOpen

    MisoLabs · self-host

    Best for: Trending on HuggingFace (188 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("MisoLabs/MisoTTS")

    pytorchsafetensorstext-to-speechspeech-synthesisvoice

    API: huggingface.co/MisoLabs/MisoTTS

    Auto-discovered from HuggingFace trending. 188 likes, 0 downloads.

  • NVIDIA Nemotron 3 Ultra

    NVIDIA · api

    Best for: Maintaining context and efficiency across many turns

    How: Integrate with existing chatbot frameworks to enhance long-running agent capabilities

    Example: Use Nemotron 3 Ultra to power a chatbot that can reason and maintain context over multiple interactions

    Faster reasoningMore efficient for long-running agents

    Auto-discovered from news articles.

  • NVIDIA Nemotron 3 Ultra 550B A55B BF16Open

    nvidia · self-host

    Best for: Trending on HuggingFace (189 likes this week)

    How: Available on Hugging Face. 59K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16")

    transformerssafetensorsnemotron_htext-generationnvidia

    API: huggingface.co/nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16

    Auto-discovered from HuggingFace trending. 189 likes, 59K downloads.

  • Higgs Audio V3 Tts 4bOpen

    bosonai · self-host

    Best for: Trending on HuggingFace (489 likes this week)

    How: Available on Hugging Face. 57K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("bosonai/higgs-audio-v3-tts-4b")

    transformerssafetensorshiggs_multimodal_qwen3text-generationtext-to-speech

    API: huggingface.co/bosonai/higgs-audio-v3-tts-4b

    Auto-discovered from HuggingFace trending. 489 likes, 57K downloads.

  • Gemma 4 QAT

    Google · 128K tokens · api

    Best for: Mobile and laptop applications requiring efficient AI models

    How: Integrate Gemma 4 QAT models into your application for on-device AI processing

    Example: Use Gemma 4 QAT for image recognition on smartphones with low latency and power consumption

    Optimizing compression for mobile and laptop efficiency

    Auto-discovered from news articles.

  • Nemotron 3.5 Asr Streaming 0.6bOpen

    nvidia · self-host

    Best for: Trending on HuggingFace (712 likes this week)

    How: Available on Hugging Face. 56K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/nemotron-3.5-asr-streaming-0.6b")

    nemosafetensorsnemotron3_5_asrtransformersspeech-recognition

    API: huggingface.co/nvidia/nemotron-3.5-asr-streaming-0.6b

    Auto-discovered from HuggingFace trending. 712 likes, 56K downloads.

  • Ideogram 4 Nf4Open

    ideogram-ai · self-host

    Best for: Trending on HuggingFace (334 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ideogram-ai/ideogram-4-nf4")

    diffuserssafetensorstext-to-imageimage-generationdiffusion

    API: huggingface.co/ideogram-ai/ideogram-4-nf4

    Auto-discovered from HuggingFace trending. 334 likes, 3K downloads.

  • Ideogram 4 Fp8Open

    ideogram-ai · self-host

    Best for: Trending on HuggingFace (548 likes this week)

    How: Available on Hugging Face. 11K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ideogram-ai/ideogram-4-fp8")

    diffuserssafetensorstext-to-imageimage-generationdiffusion

    API: huggingface.co/ideogram-ai/ideogram-4-fp8

    Auto-discovered from HuggingFace trending. 548 likes, 11K downloads.

  • Gemma 4 12b It GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (599 likes this week)

    How: Available on Hugging Face. 926K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/gemma-4-12b-it-GGUF")

    ggufgemma4unslothgemmagoogle

    API: huggingface.co/unsloth/gemma-4-12b-it-GGUF

    Auto-discovered from HuggingFace trending. 599 likes, 926K downloads.

  • Mellum2 12B A2.5B ThinkingOpen

    JetBrains · self-host

    Best for: Trending on HuggingFace (274 likes this week)

    How: Available on Hugging Face. 18K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("JetBrains/Mellum2-12B-A2.5B-Thinking")

    transformerssafetensorsmellumtext-generationconversational

    API: huggingface.co/JetBrains/Mellum2-12B-A2.5B-Thinking

    Auto-discovered from HuggingFace trending. 274 likes, 18K downloads.

  • Bonsai Image Ternary 4B Gemlite 2bitOpen

    prism-ml · self-host

    Best for: Trending on HuggingFace (92 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("prism-ml/bonsai-image-ternary-4B-gemlite-2bit")

    diffuserssafetensorsternary1.58-bitgemlite

    API: huggingface.co/prism-ml/bonsai-image-ternary-4B-gemlite-2bit

    Auto-discovered from HuggingFace trending. 92 likes, 0 downloads.

  • Qwen3.6 35B A3B NVFP4Open

    nvidia · self-host

    Best for: Trending on HuggingFace (193 likes this week)

    How: Available on Hugging Face. 822K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/Qwen3.6-35B-A3B-NVFP4")

    Model Optimizersafetensorsqwen3_5_moenvidiaModelOpt

    API: huggingface.co/nvidia/Qwen3.6-35B-A3B-NVFP4

    Auto-discovered from HuggingFace trending. 193 likes, 822K downloads.

  • PaddleOCR VL 1.6Open

    PaddlePaddle · self-host

    Best for: Trending on HuggingFace (269 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("PaddlePaddle/PaddleOCR-VL-1.6")

    PaddleOCRsafetensorspaddleocr_vlERNIE4.5PaddlePaddle

    API: huggingface.co/PaddlePaddle/PaddleOCR-VL-1.6

    Auto-discovered from HuggingFace trending. 269 likes, 9K downloads.

  • Phi-4-mini

    Microsoft · api

    Best for: expanding on-device AI capabilities in Microsoft Edge

    How: use Prompt and Writing Assistance APIs in Microsoft Edge

    Example: integrated with Microsoft Edge for on-device AI tasks

    on-device AInew models and APIs for the web

    Auto-discovered from news articles.

  • Mellum2

    JetBrains · api

    Best for: Advanced AI tasks

    How: Integrate Mellum2 into your AI workflows

    Example: Use Mellum2 for complex problem-solving and decision-making

    12B Mixture-of-Experts Model

    Auto-discovered from news articles.

  • MOSS TTS V1.5Open

    OpenMOSS-Team · self-host

    Best for: Trending on HuggingFace (95 likes this week)

    How: Available on Hugging Face. 19K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("OpenMOSS-Team/MOSS-TTS-v1.5")

    safetensorsmoss_tts_delaytext-to-speechcustom_codezh

    API: huggingface.co/OpenMOSS-Team/MOSS-TTS-v1.5

    Auto-discovered from HuggingFace trending. 95 likes, 19K downloads.

  • NVIDIA Cosmos 3

    NVIDIA · N/A · api

    Best for: Developing Physical AI systems that need to understand and act within the real world

    How: Integrate NVIDIA Cosmos 3 into your Physical AI system to enable reasoning and action capabilities

    Example: Using NVIDIA Cosmos 3 to develop a robot that can understand and interact with its environment

    Physical AI reasoningAction modelsUnderstanding real world

    Auto-discovered from news articles.

  • LFM2.5 8B A1B GGUFOpen

    LiquidAI · self-host

    Best for: Trending on HuggingFace (177 likes this week)

    How: Available on Hugging Face. 87K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("LiquidAI/LFM2.5-8B-A1B-GGUF")

    ggufliquidlfm2edgellama.cpp

    API: huggingface.co/LiquidAI/LFM2.5-8B-A1B-GGUF

    Auto-discovered from HuggingFace trending. 177 likes, 87K downloads.

  • Gemini 3.5

    Google · 128K tokens · api

    Best for: General AI applications

    How: Integrate with Google I/O 2026

    Example: Watch 9 videos showing the capabilities of Gemini 3.5

    Advanced capabilitiesHigh performance

    Auto-discovered from news articles.

  • Gemini Omni

    Google · 128K tokens · api

    Best for: General AI applications

    How: Integrate with Google I/O 2026

    Example: Watch 9 videos showing the capabilities of Gemini Omni

    Advanced capabilitiesHigh performance

    Auto-discovered from news articles.

  • Qwen3.6 27B OBLITERATEDOpen

    OBLITERATUS · self-host

    Best for: Trending on HuggingFace (120 likes this week)

    How: Available on Hugging Face. 17K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("OBLITERATUS/Qwen3.6-27B-OBLITERATED")

    transformerssafetensorsggufqwen3_5_texttext-generation

    API: huggingface.co/OBLITERATUS/Qwen3.6-27B-OBLITERATED

    Auto-discovered from HuggingFace trending. 120 likes, 17K downloads.

  • Step 3.7 FlashOpen

    stepfun-ai · self-host

    Best for: Trending on HuggingFace (359 likes this week)

    How: Available on Hugging Face. 47K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("stepfun-ai/Step-3.7-Flash")

    transformerssafetensorsstep3p7text-generationvision-language

    API: huggingface.co/stepfun-ai/Step-3.7-Flash

    Auto-discovered from HuggingFace trending. 359 likes, 47K downloads.

  • LFM2.5 8B A1BOpen

    LiquidAI · self-host

    Best for: Trending on HuggingFace (551 likes this week)

    How: Available on Hugging Face. 135K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("LiquidAI/LFM2.5-8B-A1B")

    transformerssafetensorslfm2_moetext-generationliquid

    API: huggingface.co/LiquidAI/LFM2.5-8B-A1B

    Auto-discovered from HuggingFace trending. 551 likes, 135K downloads.

  • Lens TurboOpen

    microsoft · self-host

    Best for: Trending on HuggingFace (125 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("microsoft/Lens-Turbo")

    diffuserssafetensorstext-to-imageenarxiv:2605.21573

    API: huggingface.co/microsoft/Lens-Turbo

    Auto-discovered from HuggingFace trending. 125 likes, 1K downloads.

  • LensOpen

    microsoft · self-host

    Best for: Trending on HuggingFace (138 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("microsoft/Lens")

    diffuserssafetensorstext-to-imageenarxiv:2605.21573

    API: huggingface.co/microsoft/Lens

    Auto-discovered from HuggingFace trending. 138 likes, 1K downloads.

  • Qwopus3.6 27B V2 MTP GGUFOpen

    Jackrong · self-host

    Best for: Trending on HuggingFace (178 likes this week)

    How: Available on Hugging Face. 125K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jackrong/Qwopus3.6-27B-v2-MTP-GGUF")

    transformersggufllama.cppimage-text-to-textvision

    API: huggingface.co/Jackrong/Qwopus3.6-27B-v2-MTP-GGUF

    Auto-discovered from HuggingFace trending. 178 likes, 125K downloads.

  • SANA WM_bidirectionalOpen

    Efficient-Large-Model · self-host

    Best for: Trending on HuggingFace (86 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Efficient-Large-Model/SANA-WM_bidirectional")

    diffuserssafetensorstext-to-videoimage-to-videocamera-control

    API: huggingface.co/Efficient-Large-Model/SANA-WM_bidirectional

    Auto-discovered from HuggingFace trending. 86 likes, 0 downloads.

  • Command A Plus 05 2026 Bf16Open

    CohereLabs · self-host

    Best for: Trending on HuggingFace (126 likes this week)

    How: Available on Hugging Face. 14K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("CohereLabs/command-a-plus-05-2026-bf16")

    transformerssafetensorscohere2_visionimage-text-to-textconversational

    API: huggingface.co/CohereLabs/command-a-plus-05-2026-bf16

    Auto-discovered from HuggingFace trending. 126 likes, 14K downloads.

  • Intern S2 PreviewOpen

    internlm · self-host

    Best for: Trending on HuggingFace (86 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("internlm/Intern-S2-Preview")

    transformerssafetensorsintern_s2_previewimage-text-to-textconversational

    API: huggingface.co/internlm/Intern-S2-Preview

    Auto-discovered from HuggingFace trending. 86 likes, 2K downloads.

  • LocateAnything 3BOpen

    nvidia · self-host

    Best for: Trending on HuggingFace (2701 likes this week)

    How: Available on Hugging Face. 1456K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("nvidia/LocateAnything-3B")

    transformerssafetensorslocateanythingfeature-extractionnvidia

    API: huggingface.co/nvidia/LocateAnything-3B

    Auto-discovered from HuggingFace trending. 2701 likes, 1.5M downloads.

  • NVIDIA Blackwell

    NVIDIA · 128K tokens · api

    Best for: financial trading landscape

    How: Enables sophisticated analysis

    Example: revolutionizing financial trading landscape

    sophisticated analysisvast amounts of unstructured data

    Auto-discovered from news articles.

  • ChatGPT

    OpenAI · 128K tokens · api

    Best for: conversational AI and content generation in Portuguese

    How: Use ChatGPT API to integrate with applications

    Example: Generate news articles in Portuguese

    dialoguecontent creationinformation retrieval

    Auto-discovered from news articles.

  • MiniCPM5 1BOpen

    openbmb · self-host

    Best for: Trending on HuggingFace (776 likes this week)

    How: Available on Hugging Face. 101K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("openbmb/MiniCPM5-1B")

    transformerssafetensorsllamatext-generationminicpm

    API: huggingface.co/openbmb/MiniCPM5-1B

    Auto-discovered from HuggingFace trending. 776 likes, 101K downloads.

  • NVIDIA Cloud Partner (NCP) reference architecture

    NVIDIA · N/A · api

    Best for: governments, enterprises, and telcos

    How: N/A

    Example: N/A

    sovereign AI factoriesbased on NCP reference architecture

    Auto-discovered from news articles.

  • Qwopus3.6 27B V2 GGUFOpen

    Jackrong · self-host

    Best for: Trending on HuggingFace (183 likes this week)

    How: Available on Hugging Face. 29K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jackrong/Qwopus3.6-27B-v2-GGUF")

    transformersggufllama.cppimage-text-to-textvision

    API: huggingface.co/Jackrong/Qwopus3.6-27B-v2-GGUF

    Auto-discovered from HuggingFace trending. 183 likes, 29K downloads.

  • Command A Plus 05 2026 W4a4Open

    CohereLabs · self-host

    Best for: Trending on HuggingFace (213 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("CohereLabs/command-a-plus-05-2026-w4a4")

    transformerssafetensorscohere2_visionimage-text-to-textconversational

    API: huggingface.co/CohereLabs/command-a-plus-05-2026-w4a4

    Auto-discovered from HuggingFace trending. 213 likes, 8K downloads.

  • Gordon

    Docker · api

    Best for: container workflow management

    How: Integrate Gordon with Docker Desktop

    Example: Gordon proposes fixes and takes action across your entire Docker workflow

    understands environmentproposes fixestakes action across Docker workflow

    Auto-discovered from news articles.

  • Ring 2.6 1TOpen

    inclusionAI · self-host

    Best for: Trending on HuggingFace (89 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("inclusionAI/Ring-2.6-1T")

    transformerssafetensorsbailing_hybridtext-generationconversational

    API: huggingface.co/inclusionAI/Ring-2.6-1T

    Auto-discovered from HuggingFace trending. 89 likes, 3K downloads.

  • HRM Text 1BOpen

    sapientinc · self-host

    Best for: Trending on HuggingFace (751 likes this week)

    How: Available on Hugging Face. 135K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("sapientinc/HRM-Text-1B")

    transformerssafetensorshrm_texttext-generationhrm

    API: huggingface.co/sapientinc/HRM-Text-1B

    Auto-discovered from HuggingFace trending. 751 likes, 135K downloads.

  • Mythos

    Cloudflare · N/A · api

    Best for: analyzing live code across critical parts of infrastructure

    How: Point Mythos at live code to observe its strengths and weaknesses

    Example: Mythos was used to analyze live code across critical parts of Cloudflare's infrastructure

    security-focusedcode analysis

    Auto-discovered from news articles.

  • Qwopus3.5 9B Coder GGUFOpen

    Jackrong · self-host

    Best for: Trending on HuggingFace (181 likes this week)

    How: Available on Hugging Face. 39K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jackrong/Qwopus3.5-9B-Coder-GGUF")

    transformersgguftext-generation-inferenceunslothqwen3_5

    API: huggingface.co/Jackrong/Qwopus3.5-9B-Coder-GGUF

    Auto-discovered from HuggingFace trending. 181 likes, 39K downloads.

  • Qwen3.6 35B A3B MTP GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (393 likes this week)

    How: Available on Hugging Face. 628K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/Qwen3.6-35B-A3B-MTP-GGUF")

    transformersggufunslothqwenqwen3_5_moe

    API: huggingface.co/unsloth/Qwen3.6-35B-A3B-MTP-GGUF

    Auto-discovered from HuggingFace trending. 393 likes, 628K downloads.

  • Scenema AudioOpen

    ScenemaAI · self-host

    Best for: Trending on HuggingFace (101 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ScenemaAI/scenema-audio")

    scenema-audioaudio-generationdiffusiontext-to-audiovoice-cloning

    API: huggingface.co/ScenemaAI/scenema-audio

    Auto-discovered from HuggingFace trending. 101 likes, 237 downloads.

  • Deepseek V4 GgufOpen

    antirez · self-host

    Best for: Trending on HuggingFace (139 likes this week)

    How: Available on Hugging Face. 284K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("antirez/deepseek-v4-gguf")

    ggufquantizeddeepseekdeepseek-v4deepseek-v4-flash

    API: huggingface.co/antirez/deepseek-v4-gguf

    Auto-discovered from HuggingFace trending. 139 likes, 284K downloads.

  • DramaboxOpen

    ResembleAI · self-host

    Best for: Trending on HuggingFace (239 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ResembleAI/Dramabox")

    ltx-audio-ttsdramabox-ttsttsvoice-cloningaudio-generation

    API: huggingface.co/ResembleAI/Dramabox

    Auto-discovered from HuggingFace trending. 239 likes, 1K downloads.

  • LTX 2.3 WorkflowsOpen

    RuneXX · self-host

    Best for: Trending on HuggingFace (564 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("RuneXX/LTX-2.3-Workflows")

    ltxltx-2comfyuicomfygguf

    API: huggingface.co/RuneXX/LTX-2.3-Workflows

    Auto-discovered from HuggingFace trending. 564 likes, 0 downloads.

  • Fara 7BOpen

    microsoft · self-host

    Best for: Trending on HuggingFace (593 likes this week)

    How: Available on Hugging Face. 15K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("microsoft/Fara-7B")

    transformerssafetensorsqwen2_5_vlimage-text-to-textmultimodal

    API: huggingface.co/microsoft/Fara-7B

    Auto-discovered from HuggingFace trending. 593 likes, 15K downloads.

  • NVIDIA Vera Rubin Platform

    NVIDIA · 128K tokens · api

    Best for: Agentic inference workloads

    How: Integrate with NVIDIA's platform for inference

    Example: Use for non-deterministic trajectories in AI

    Solving Agentic AI’s Scale-Up ProblemRuntime dynamics of inference workloads

    Auto-discovered from news articles.

  • Qwen3.6 27B MTP GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (613 likes this week)

    How: Available on Hugging Face. 983K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/Qwen3.6-27B-MTP-GGUF")

    transformersggufunslothqwenqwen3_5

    API: huggingface.co/unsloth/Qwen3.6-27B-MTP-GGUF

    Auto-discovered from HuggingFace trending. 613 likes, 983K downloads.

  • NeedleOpen

    Cactus · self-host

    Best for: function-calling tasks

    How: run Needle on consumer devices

    Example: function-calling (tool use) model

    26M parameter modelruns at 6000 tok/s prefill1200 tok/s decode on consumer devices

    Auto-discovered from news articles.

  • Qwen3.6 27B MTP UD GGUFOpen

    havenoammo · self-host

    Best for: Trending on HuggingFace (87 likes this week)

    How: Available on Hugging Face. 43K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("havenoammo/Qwen3.6-27B-MTP-UD-GGUF")

    transformersggufunslothqwenqwen3_5

    API: huggingface.co/havenoammo/Qwen3.6-27B-MTP-UD-GGUF

    Auto-discovered from HuggingFace trending. 87 likes, 43K downloads.

  • Supertonic 3Open

    Supertone · self-host

    Best for: Trending on HuggingFace (771 likes this week)

    How: Available on Hugging Face. 58K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Supertone/supertonic-3")

    supertoniconnxtext-to-speechspeech-synthesistts

    API: huggingface.co/Supertone/supertonic-3

    Auto-discovered from HuggingFace trending. 771 likes, 58K downloads.

  • Qwopus3.6 35B A3B V1 GGUFOpen

    Jackrong · self-host

    Best for: Trending on HuggingFace (117 likes this week)

    How: Available on Hugging Face. 67K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jackrong/Qwopus3.6-35B-A3B-v1-GGUF")

    transformersgguftext-generation-inferenceunslothqwen3_6

    API: huggingface.co/Jackrong/Qwopus3.6-35B-A3B-v1-GGUF

    Auto-discovered from HuggingFace trending. 117 likes, 67K downloads.

  • Sulphur 2 BaseOpen

    SulphurAI · self-host

    Best for: Trending on HuggingFace (1537 likes this week)

    How: Available on Hugging Face. 1666K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("SulphurAI/Sulphur-2-base")

    diffusersgguftext-to-videobase_model:Lightricks/LTX-2.3base_model:quantized:Lightricks/LTX-2.3

    API: huggingface.co/SulphurAI/Sulphur-2-base

    Auto-discovered from HuggingFace trending. 1537 likes, 1.7M downloads.

  • MiniCPM V 4.6Open

    openbmb · self-host

    Best for: Trending on HuggingFace (1084 likes this week)

    How: Available on Hugging Face. 445K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("openbmb/MiniCPM-V-4.6")

    transformerssafetensorsminicpmv4_6image-text-to-textminicpm-v

    API: huggingface.co/openbmb/MiniCPM-V-4.6

    Auto-discovered from HuggingFace trending. 1084 likes, 445K downloads.

  • NVIDIA Nemotron 3 Nano Omni 30B A3B Reasoning GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (100 likes this week)

    How: Available on Hugging Face. 45K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/NVIDIA-Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF")

    ggufnvidiaunslothnemotron-3multimodal

    API: huggingface.co/unsloth/NVIDIA-Nemotron-3-Nano-Omni-30B-A3B-Reasoning-GGUF

    Auto-discovered from HuggingFace trending. 100 likes, 45K downloads.

  • Ling 2.6 1TOpen

    inclusionAI · self-host

    Best for: Trending on HuggingFace (111 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("inclusionAI/Ling-2.6-1T")

    transformerssafetensorsbailing_hybridtext-generationconversational

    API: huggingface.co/inclusionAI/Ling-2.6-1T

    Auto-discovered from HuggingFace trending. 111 likes, 642 downloads.

  • OmniVoiceOpen

    k2-fsa · self-host

    Best for: Trending on HuggingFace (872 likes this week)

    How: Available on Hugging Face. 2236K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("k2-fsa/OmniVoice")

    omnivoicesafetensorszero-shotmultilingualvoice-cloning

    API: huggingface.co/k2-fsa/OmniVoice

    Auto-discovered from HuggingFace trending. 872 likes, 2.2M downloads.

  • CyberSecQwen-4BOpen

    Hugging Face · 128K tokens · self-host

    Best for: defensive cyber tasks

    How: use the model for specialized cyber defense tasks

    Example: model can be used for detecting and preventing cyber threats

    defensive cyberspecializedlocally-runnable

    Auto-discovered from news articles.

  • Qwen3.6 27B Heretic Uncensored FINETUNE NEO CODE Di IMatrix MAX GGUFOpen

    DavidAU · self-host

    Best for: Trending on HuggingFace (105 likes this week)

    How: Available on Hugging Face. 144K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("DavidAU/Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF")

    transformersggufunslothhereticuncensored

    API: huggingface.co/DavidAU/Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF

    Auto-discovered from HuggingFace trending. 105 likes, 144K downloads.

  • LTX2.3 10ErosOpen

    TenStrip · self-host

    Best for: Trending on HuggingFace (281 likes this week)

    How: Available on Hugging Face. 136K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("TenStrip/LTX2.3-10Eros")

    diffusersimage-to-videoregion:us

    API: huggingface.co/TenStrip/LTX2.3-10Eros

    Auto-discovered from HuggingFace trending. 281 likes, 136K downloads.

  • Granite 4.1 30bOpen

    ibm-granite · self-host

    Best for: Trending on HuggingFace (100 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ibm-granite/granite-4.1-30b")

    transformerssafetensorsgranitetext-generationlanguage

    API: huggingface.co/ibm-granite/granite-4.1-30b

    Auto-discovered from HuggingFace trending. 100 likes, 6K downloads.

  • Granite 4.1 8bOpen

    ibm-granite · self-host

    Best for: Trending on HuggingFace (157 likes this week)

    How: Available on Hugging Face. 20K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("ibm-granite/granite-4.1-8b")

    transformerssafetensorsgranitetext-generationlanguage

    API: huggingface.co/ibm-granite/granite-4.1-8b

    Auto-discovered from HuggingFace trending. 157 likes, 20K downloads.

  • Z AnimeOpen

    SeeSee21 · self-host

    Best for: Trending on HuggingFace (418 likes this week)

    How: Available on Hugging Face. 16K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("SeeSee21/Z-Anime")

    diffuserssafetensorsggufz-animetext-to-image

    API: huggingface.co/SeeSee21/Z-Anime

    Auto-discovered from HuggingFace trending. 418 likes, 16K downloads.

  • Ling 2.6 FlashOpen

    inclusionAI · self-host

    Best for: Trending on HuggingFace (456 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("inclusionAI/Ling-2.6-flash")

    safetensorsbailing_hybridtext-generationconversationalcustom_code

    API: huggingface.co/inclusionAI/Ling-2.6-flash

    Auto-discovered from HuggingFace trending. 456 likes, 1K downloads.

  • GAIAOpen

    AMD · self-host

    Best for: local AI applications on Windows and Linux

    How: integrate with Lemonade SDK

    Example: use GAIA for local AI tasks on Windows and Linux systems

    easy to useleverages Lemonade SDK

    Auto-discovered from news articles.

  • NVIDIA DLSS 4.5

    NVIDIA · N/A · api

    Best for: AI-powered game development

    How: Integrate NVIDIA DLSS 4.5 with Unreal Engine 5

    Example: Game developers can enhance game performance and visuals

    Dynamic Multi Frame GenerationMulti Frame Generation 6Xsecond-generation RTX

    Auto-discovered from news articles.

  • Laguna XS.2Open

    poolside · self-host

    Best for: Trending on HuggingFace (228 likes this week)

    How: Available on Hugging Face. 14K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("poolside/Laguna-XS.2")

    transformerssafetensorslagunatext-generationlaguna-xs.2

    API: huggingface.co/poolside/Laguna-XS.2

    Auto-discovered from HuggingFace trending. 228 likes, 14K downloads.

  • Qwen3.6 27B DFlashOpen

    z-lab · self-host

    Best for: Trending on HuggingFace (262 likes this week)

    How: Available on Hugging Face. 29K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("z-lab/Qwen3.6-27B-DFlash")

    transformerssafetensorsqwen3feature-extractiondflash

    API: huggingface.co/z-lab/Qwen3.6-27B-DFlash

    Auto-discovered from HuggingFace trending. 262 likes, 29K downloads.

  • Qwen3.6 35B A3B DFlashOpen

    z-lab · self-host

    Best for: Trending on HuggingFace (165 likes this week)

    How: Available on Hugging Face. 27K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("z-lab/Qwen3.6-35B-A3B-DFlash")

    transformerssafetensorsqwen3feature-extractiondflash

    API: huggingface.co/z-lab/Qwen3.6-35B-A3B-DFlash

    Auto-discovered from HuggingFace trending. 165 likes, 27K downloads.

  • Qwen3.6 27B FP8Open

    Qwen · self-host

    Best for: Trending on HuggingFace (160 likes this week)

    How: Available on Hugging Face. 745K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.6-27B-FP8")

    transformerssafetensorsqwen3_5image-text-to-textconversational

    API: huggingface.co/Qwen/Qwen3.6-27B-FP8

    Auto-discovered from HuggingFace trending. 160 likes, 745K downloads.

  • Seedance 1.0 Pro

    ByteDance · N/A · credit-based → per-second

    Best for: Cost-sensitive Chinese-market video, fast iteration on social shorts.

    How: Two tiers: Seedance 1.0 Pro for top quality and Seedance 1.0 Lite for fast/cheap drafts. Both expose text-to-video and image-to-video.

    Example: POST volcengineapi.com/seedance/v1/videos { prompt: 'a hummingbird in flight, slow motion', mode: 'pro' }

    fast generation1080p outputstrong prompt adherenceLite variant for cheap iteration

    API: Volcengine / ByteDance API

    ByteDance's competitor to Sora / Veo / Kling. Lite tier is notably cheaper than competitors at similar quality.

  • NVIDIA Nemotron 3 Nano Omni

    NVIDIA · api

    Best for: multimodal agent reasoning in a single efficient open model

    How: Run NVIDIA Nemotron 3 Nano Omni locally in a single command

    Example: reasoning across screens, documents, audio, video, and text within a single perception-to-action loop

    understand and reason across video, audio, images, and language

    Auto-discovered from news articles.

  • MiMo V2.5 ProOpen

    XiaomiMiMo · self-host

    Best for: Trending on HuggingFace (506 likes this week)

    How: Available on Hugging Face. 40K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("XiaomiMiMo/MiMo-V2.5-Pro")

    safetensorsmimo_v2text-generationagentlong-context

    API: huggingface.co/XiaomiMiMo/MiMo-V2.5-Pro

    Auto-discovered from HuggingFace trending. 506 likes, 40K downloads.

  • DeepSeek-V4-Flash

    DeepSeek · api

    Best for: enabling highly efficient operations

    How: Build with DeepSeek V4 Using NVIDIA Blackwell and GPU-Accelerated Endpoints

    Example: DeepSeek just launched its fourth generation of flagship models

    highly efficient

    Auto-discovered from news articles.

  • DeepSeek-V4-Pro

    DeepSeek · api

    Best for: enabling highly efficient operations

    How: Build with DeepSeek V4 Using NVIDIA Blackwell and GPU-Accelerated Endpoints

    Example: DeepSeek just launched its fourth generation of flagship models

    highly efficient

    Auto-discovered from news articles.

  • Qwen3.6 27B Uncensored HauhauCS AggressiveOpen

    HauhauCS · self-host

    Best for: Trending on HuggingFace (265 likes this week)

    How: Available on Hugging Face. 303K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive")

    ggufuncensoredqwen3.6visionmultimodal

    API: huggingface.co/HauhauCS/Qwen3.6-27B-Uncensored-HauhauCS-Aggressive

    Auto-discovered from HuggingFace trending. 265 likes, 303K downloads.

  • Hy3 PreviewOpen

    tencent · self-host

    Best for: Trending on HuggingFace (189 likes this week)

    How: Available on Hugging Face. 14K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("tencent/Hy3-preview")

    transformerssafetensorshy_v3text-generationconversational

    API: huggingface.co/tencent/Hy3-preview

    Auto-discovered from HuggingFace trending. 189 likes, 14K downloads.

  • Google TPU 8th Generation

    Google · N/A · api

    Best for: powering AI applications

    How: Deploy Google's 8th generation TPUs for your AI workloads

    Example: Use the new TPUs for training and inference in AI applications

    specialized chipsfuture of AI

    Auto-discovered from news articles.

  • Google TPUv8

    Google · N/A · api

    Best for: AI acceleration

    How: deploy Google TPUv8 in your cloud environment

    Example: use Google TPUv8 for AI model training and inference

    specialized chipspower the future of AI

    Auto-discovered from news articles.

  • Google's 8th generation TPU

    Google AI · N/A · api

    Best for: AI acceleration

    How: Deploy Google's 8th generation TPU for AI workloads.

    Example: Use the TPU for training and inference of AI models.

    specialized chipspower the future of AI

    Auto-discovered from news articles.

  • GPT-5.5

    OpenAI · 128K tokens · api

    Best for: coding, research, and data analysis

    How: Integrate GPT-5.5 into your tools for advanced tasks.

    Example: Use GPT-5.5 for coding assistance or data analysis.

    fastermore capablecomplex tasks

    Auto-discovered from news articles.

  • DeepSeek V4 FlashOpen

    deepseek-ai · self-host

    Best for: Trending on HuggingFace (1948 likes this week)

    How: Available on Hugging Face. 2814K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepseek-ai/DeepSeek-V4-Flash")

    transformerssafetensorsdeepseek_v4text-generationconversational

    API: huggingface.co/deepseek-ai/DeepSeek-V4-Flash

    Auto-discovered from HuggingFace trending. 1948 likes, 2.8M downloads.

  • DeepSeek V4 ProOpen

    deepseek-ai · self-host

    Best for: Trending on HuggingFace (4999 likes this week)

    How: Available on Hugging Face. 2612K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("deepseek-ai/DeepSeek-V4-Pro")

    transformerssafetensorsdeepseek_v4text-generationconversational

    API: huggingface.co/deepseek-ai/DeepSeek-V4-Pro

    Auto-discovered from HuggingFace trending. 4999 likes, 2.6M downloads.

  • Google's eighth generation TPU

    Google · N/A · api

    Best for: AI applications requiring high-performance computing

    How: deploy on Google Cloud to leverage the new TPU capabilities

    Example: use for training and inference of large AI models

    powering the future of AItwo specialized chips

    Auto-discovered from news articles.

  • OpenAI Privacy Filter

    OpenAI · api

    Best for: text privacy and compliance

    How: Integrate into text processing workflows

    Example: Automatically redact sensitive information from documents

    detecting and redacting PIIstate-of-the-art accuracy

    Auto-discovered from news articles.

  • Google's TPU (eighth generation)

    Google · api

    Best for: AI acceleration

    How: Deploy in Google Cloud for AI tasks

    Example: Use for training and inference in AI applications

    specialized chipspower the future of AI

    Auto-discovered from news articles.

  • Qwen3.6 35B A3B Claude 4.6 Opus Reasoning Distilled GGUFOpen

    hesamation · self-host

    Best for: Trending on HuggingFace (200 likes this week)

    How: Available on Hugging Face. 129K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("hesamation/Qwen3.6-35B-A3B-Claude-4.6-Opus-Reasoning-Distilled-GGUF")

    ggufllama.cppqwenqwen3.6qwen3_5_moe

    API: huggingface.co/hesamation/Qwen3.6-35B-A3B-Claude-4.6-Opus-Reasoning-Distilled-GGUF

    Auto-discovered from HuggingFace trending. 200 likes, 129K downloads.

  • Qwen3.6 27B GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (633 likes this week)

    How: Available on Hugging Face. 1355K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/Qwen3.6-27B-GGUF")

    transformersggufunslothqwenqwen3_5

    API: huggingface.co/unsloth/Qwen3.6-27B-GGUF

    Auto-discovered from HuggingFace trending. 633 likes, 1.4M downloads.

  • Qwen3.6 27BOpen

    Qwen · self-host

    Best for: Trending on HuggingFace (1554 likes this week)

    How: Available on Hugging Face. 5064K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.6-27B")

    transformerssafetensorsqwen3_5image-text-to-textconversational

    API: huggingface.co/Qwen/Qwen3.6-27B

    Auto-discovered from HuggingFace trending. 1554 likes, 5.1M downloads.

  • Codex

    OpenAI · 128K tokens · api

    Best for: enterprises to deploy and scale Codex

    How: partner with Accenture, PwC, Infosys, and others

    Example: help enterprises deploy and scale Codex across the software development lifecycle

    deploy and scale across the software development lifecycle

    Auto-discovered from news articles.

  • Qwopus GLM 18B Merged GGUFOpen

    Jackrong · self-host

    Best for: Trending on HuggingFace (201 likes this week)

    How: Available on Hugging Face. 70K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jackrong/Qwopus-GLM-18B-Merged-GGUF")

    ggufmergefrankenmergeqwen3.5reasoning

    API: huggingface.co/Jackrong/Qwopus-GLM-18B-Merged-GGUF

    Auto-discovered from HuggingFace trending. 201 likes, 70K downloads.

  • Kimi K2.6Open

    moonshotai · self-host

    Best for: Trending on HuggingFace (1197 likes this week)

    How: Available on Hugging Face. 825K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("moonshotai/Kimi-K2.6")

    transformerssafetensorskimi_k25feature-extractioncompressed-tensors

    API: huggingface.co/moonshotai/Kimi-K2.6

    Auto-discovered from HuggingFace trending. 1197 likes, 825K downloads.

  • Qwen3.6 35B A3B FP8Open

    Qwen · self-host

    Best for: Trending on HuggingFace (158 likes this week)

    How: Available on Hugging Face. 490K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.6-35B-A3B-FP8")

    transformerssafetensorsqwen3_5_moeimage-text-to-textconversational

    API: huggingface.co/Qwen/Qwen3.6-35B-A3B-FP8

    Auto-discovered from HuggingFace trending. 158 likes, 490K downloads.

  • Qwen3.6 35B A3B Uncensored HauhauCS AggressiveOpen

    HauhauCS · self-host

    Best for: Trending on HuggingFace (3175 likes this week)

    How: Available on Hugging Face. 1856K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive")

    ggufuncensoredqwen3.6moevision

    API: huggingface.co/HauhauCS/Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive

    Auto-discovered from HuggingFace trending. 3175 likes, 1.9M downloads.

  • GPT-Rosalind

    OpenAI · N/A · api

    Best for: life sciences research

    How: N/A

    Example: N/A

    accelerate drug discoverygenomics analysisprotein reasoningscientific research workflows

    Auto-discovered from news articles.

  • ERNIE Image Turbo GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (180 likes this week)

    How: Available on Hugging Face. 30K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/ERNIE-Image-Turbo-GGUF")

    ggmlgguftext-to-imageunslothbase_model:baidu/ERNIE-Image-Turbo

    API: huggingface.co/unsloth/ERNIE-Image-Turbo-GGUF

    Auto-discovered from HuggingFace trending. 180 likes, 30K downloads.

  • Gemma 4 31B It NVFP4 TurboOpen

    LilaRest · self-host

    Best for: Trending on HuggingFace (247 likes this week)

    How: Available on Hugging Face. 105K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("LilaRest/gemma-4-31B-it-NVFP4-turbo")

    transformerssafetensorsgemma4text-generationgemma-4-31b-it

    API: huggingface.co/LilaRest/gemma-4-31B-it-NVFP4-turbo

    Auto-discovered from HuggingFace trending. 247 likes, 105K downloads.

  • Supergemma4 26b Uncensored Mlx 4bit V2Open

    Jiunsong · self-host

    Best for: Trending on HuggingFace (172 likes this week)

    How: Available on Hugging Face. 14K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2")

    mlxsafetensorsgemma4uncensoredapple-silicon

    API: huggingface.co/Jiunsong/supergemma4-26b-uncensored-mlx-4bit-v2

    Auto-discovered from HuggingFace trending. 172 likes, 14K downloads.

  • Gemma 4 E4B It OBLITERATEDOpen

    OBLITERATUS · self-host

    Best for: Trending on HuggingFace (526 likes this week)

    How: Available on Hugging Face. 128K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("OBLITERATUS/gemma-4-E4B-it-OBLITERATED")

    safetensorsggufgemma4abliterateduncensored

    API: huggingface.co/OBLITERATUS/gemma-4-E4B-it-OBLITERATED

    Auto-discovered from HuggingFace trending. 526 likes, 128K downloads.

  • Gemma 4 31B JANG_4M CRACKOpen

    dealignai · self-host

    Best for: Trending on HuggingFace (1487 likes this week)

    How: Available on Hugging Face. 170K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("dealignai/Gemma-4-31B-JANG_4M-CRACK")

    mlxsafetensorsgemma4abliterateduncensored

    API: huggingface.co/dealignai/Gemma-4-31B-JANG_4M-CRACK

    Auto-discovered from HuggingFace trending. 1487 likes, 170K downloads.

  • ERNIE Image TurboOpen

    baidu · self-host

    Best for: Trending on HuggingFace (344 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("baidu/ERNIE-Image-Turbo")

    diffuserssafetensorstext-to-image8Blicense:apache-2.0

    API: huggingface.co/baidu/ERNIE-Image-Turbo

    Auto-discovered from HuggingFace trending. 344 likes, 6K downloads.

  • Qwen3.6 35B A3B GGUFOpen

    unsloth · self-host

    Best for: Trending on HuggingFace (966 likes this week)

    How: Available on Hugging Face. 2500K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("unsloth/Qwen3.6-35B-A3B-GGUF")

    transformersggufunslothqwenqwen3_5_moe

    API: huggingface.co/unsloth/Qwen3.6-35B-A3B-GGUF

    Auto-discovered from HuggingFace trending. 966 likes, 2.5M downloads.

  • Supergemma4 26b Uncensored Gguf V2Open

    Jiunsong · self-host

    Best for: Trending on HuggingFace (627 likes this week)

    How: Available on Hugging Face. 267K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Jiunsong/supergemma4-26b-uncensored-gguf-v2")

    ggufgemma4uncensoredfastllama.cpp

    API: huggingface.co/Jiunsong/supergemma4-26b-uncensored-gguf-v2

    Auto-discovered from HuggingFace trending. 627 likes, 267K downloads.

  • GLM 5.1Open

    zai-org · self-host

    Best for: Trending on HuggingFace (1472 likes this week)

    How: Available on Hugging Face. 171K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("zai-org/GLM-5.1")

    transformerssafetensorsglm_moe_dsatext-generationconversational

    API: huggingface.co/zai-org/GLM-5.1

    Auto-discovered from HuggingFace trending. 1472 likes, 171K downloads.

  • ERNIE ImageOpen

    baidu · self-host

    Best for: Trending on HuggingFace (550 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("baidu/ERNIE-Image")

    diffuserssafetensorstext-to-image8Blicense:apache-2.0

    API: huggingface.co/baidu/ERNIE-Image

    Auto-discovered from HuggingFace trending. 550 likes, 7K downloads.

  • HY Embodied 0.5Open

    tencent · self-host

    Best for: Trending on HuggingFace (897 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("tencent/HY-Embodied-0.5")

    transformerssafetensorshunyuan_vl_motimage-text-to-texthunyuan

    API: huggingface.co/tencent/HY-Embodied-0.5

    Auto-discovered from HuggingFace trending. 897 likes, 2K downloads.

  • Qwen3.6 35B A3BOpen

    Qwen · self-host

    Best for: Trending on HuggingFace (1803 likes this week)

    How: Available on Hugging Face. 5477K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("Qwen/Qwen3.6-35B-A3B")

    transformerssafetensorsqwen3_5_moeimage-text-to-textconversational

    API: huggingface.co/Qwen/Qwen3.6-35B-A3B

    Auto-discovered from HuggingFace trending. 1803 likes, 5.5M downloads.

  • MiniMax M2.7Open

    MiniMaxAI · self-host

    Best for: Trending on HuggingFace (1052 likes this week)

    How: Available on Hugging Face. 469K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("MiniMaxAI/MiniMax-M2.7")

    transformerssafetensorsminimax_m2text-generationconversational

    API: huggingface.co/MiniMaxAI/MiniMax-M2.7

    Auto-discovered from HuggingFace trending. 1052 likes, 469K downloads.

  • Nucleus ImageOpen

    NucleusAI · self-host

    Best for: Trending on HuggingFace (213 likes this week)

    How: Available on Hugging Face.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("NucleusAI/Nucleus-Image")

    diffuserssafetensorsmoesparse-moediffusion

    API: huggingface.co/NucleusAI/Nucleus-Image

    Auto-discovered from HuggingFace trending. 213 likes, 2K downloads.

  • Gemma 4 31B ItOpen

    google · self-host

    Best for: Trending on HuggingFace (2640 likes this week)

    How: Available on Hugging Face. 9794K downloads.

    Example: from transformers import AutoModelForCausalLM; model = AutoModelForCausalLM.from_pretrained("google/gemma-4-31B-it")

    transformerssafetensorsgemma4image-text-to-textconversational

    API: huggingface.co/google/gemma-4-31B-it

    Auto-discovered from HuggingFace trending. 2640 likes, 9.8M downloads.