Model Watch
New AI model releases across providers. Subscribe via RSS or Atom.
- xiaomi/mimo-v2.6-flashopenroutermodels.dev/opencode-gomodels.dev/kilomodels.dev/openroutermodels.dev/xiaomi-token-plan-cnmodels.dev/xiaomi-token-plan-amsmodels.dev/xiaomimodels.dev/vercelmodels.dev/xiaomi-token-plan-sgpmodels.dev/opencodemodels.dev/empiriolabsXiaomi: MiMo-V2.6-Flash · xiaomi · Released 1h ago · Seen 10h ago
MiMo-V2.6-Flash is an open-source foundation model developed by Xiaomi. Built on a Mixture-of-Experts architecture with 309B total parameters and 15B activated per token, it employs a hybrid attention mechanism for...
- xiaomi/mimo-v2.6-proopenroutermodels.dev/opencode-gomodels.dev/kilomodels.dev/openroutermodels.dev/xiaomi-token-plan-cnmodels.dev/xiaomi-token-plan-amsmodels.dev/xiaomimodels.dev/vercelmodels.dev/xiaomi-token-plan-sgpmodels.dev/empiriolabsXiaomi: MiMo-V2.6-Pro · xiaomi · Released 2026-09-22 · Seen 10h ago
MiMo-V2.6-Pro is the flagship foundation model developed by Xiaomi. Built at a scale of over 1T parameters, it is designed to push the ceiling of capability for the most demanding...
- xiaomi/mimo-v2.6-pro-ultraspeedopenroutermodels.dev/openroutermodels.dev/kilomodels.dev/xiaomimodels.dev/vercelmodels.dev/empiriolabsXiaomi: MiMo-V2.6-Pro-UltraSpeed · xiaomi · Released 10h ago · Seen 10h ago
MiMo-V2.6-Pro-UltraSpeed is the fast speed edition of Xiaomi's flagship foundation model, MiMo-V2.6-Pro. Built from the same 1T MiMo-V2.6-Pro checkpoint, it matches the original model in quality while delivering roughly 10x...
- x-ai/grok-4.7openroutermodels.dev/vercelmodels.dev/kilomodels.dev/openroutermodels.dev/xaimodels.dev/opencode-gomodels.dev/venicemodels.dev/llmgateway-providersmodels.dev/llmgatewaymodels.dev/merge-gatewaymodels.dev/github-copilotmodels.dev/nano-gptSpaceXAI: Grok 4.7 · x-ai · Released 14h ago · Seen 13h ago
Grok 4.7 is SpaceXAI's flagship model for coding, agentic tasks, and knowledge work, succeeding Grok 4.6. It is particularly strong at long-running software engineering tasks, verifying its own work, and...
- viv-fastmodels.dev/vivgridViv Fast · vivgrid · Released 2026-09-21 · Seen 13h ago
- alibaba/qwen3.8-27b-hemmingwaymodels.dev/nano-gptQwen 3.8 27B Hemingway · nano-gpt · Released 2026-09-21 · Seen 16h ago
- google/diffusiongemmamodels.dev/nano-gptDiffusionGemma · nano-gpt · Released 2026-09-19 · Seen 2d ago
- zhipu/glm-5.3-flash-cybersecuritymodels.dev/nano-gptGLM 5.3 Flash Cybersecurity · nano-gpt · Released 2026-09-19 · Seen 2d ago
- alibaba/qwen3.8-27b-cybersecuritymodels.dev/nano-gptQwen 3.8 27B Cybersecurity · nano-gpt · Released 2026-09-19 · Seen 2d ago
- google/gemma-4-26b-a4b-it-cybersecuritymodels.dev/nano-gptGemma 4 26B A4B Cybersecurity · nano-gpt · Released 2026-09-19 · Seen 2d ago
- PrismML: Ternary Bonsai 2 27B · prism-ml · Released 3d ago · Seen 3d ago
Bonsai 2 27B is a 27B-parameter reasoning model from PrismML derived from Qwen3.8-27B. It supports coding, mathematics, tool calling, and image understanding with a 262K-token context window. Ternary compression shrinks...
- zhipu/glm-5.3-flashxmodels.dev/vercelopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/zhipuaimodels.dev/zaimodels.dev/zenmuxGLM 5.3 FlashX · vercel · Released 2026-09-18 · Seen 3d ago
- slowburn/gemma4-31b-splituntiedmodels.dev/nano-gptGemma 4 31B Split-Untied · nano-gpt · Released 2026-09-17 · Seen 4d ago
- alibaba/qwen3.8-omni-flashmodels.dev/nano-gptmodels.dev/vercelmodels.dev/crossmodelmodels.dev/aihubmixmodels.dev/empiriolabsQwen3.8 Omni Flash · nano-gpt · Released 2026-09-17 · Seen 4d ago
- unbiased/paretoopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/opencode-gomodels.dev/opencodemodels.dev/cloudflare-ai-gatewaymodels.dev/nano-gptUnion Alpha · stealth · Released 5d ago · Seen 5d ago
Union Alpha is a multimodal model built for research, coding, and agentic workflows, while delivering frontier-level performance across a broad range of general-purpose tasks. Union Alpha is a stealth model....
- stepfun/step-5-previewmodels.dev/vercelmodels.dev/nano-gptmodels.dev/empiriolabsmodels.dev/stepfun-step-planmodels.dev/stepfun-aiStep 5 Preview · vercel · Released 2026-09-16 · Seen 1d ago
- quiverai/arrow-2-telosmodels.dev/vercelArrow 2 Telos · vercel · Released 2026-09-16 · Seen 2d ago
- quiverai/arrow-2models.dev/vercelArrow 2 · vercel · Released 2026-09-16 · Seen 2d ago
- jev-1.13models.dev/opencodeJev 1.13 · opencode · Released 2026-09-15 · Seen 2d ago
- typesafe/jevmodels.dev/vercelopenroutermodels.dev/nano-gptmodels.dev/cloudflare-ai-gatewaymodels.dev/opencodemodels.dev/vivgridJev · vercel · Released 2026-09-15 · Seen 4d ago
This model always redirects to the latest model in the Jev family.
- google/gemini-3.8-live-extendedmodels.dev/vercelGemini 3.8 Live Extended Thinking · vercel · Released 2026-09-15 · Seen 6d ago
- google/gemini-3.8-livemodels.dev/vercelGemini 3.8 Live · vercel · Released 2026-09-15 · Seen 6d ago
- Davd-b01/qwen-3.8-next-40b-exp-v6rank-K128-bf16 · Davd-b01 · Released 8d ago · Seen 8d ago
- Atria Dawn Preview (Atria) · llmgateway-providers · Released 2026-09-12 · Seen 7d ago
- kimi-for-coding · kimi-code-plan-global · Released 2026-09-11 · Seen 3d ago
- deepseek/deepseek-v4.1-flash-fast-fp4models.dev/coralbricksDeepSeek V4.1 Flash FP4 · coralbricks · Released 2026-09-10 · Seen 1h ago
- deepseek/deepseek-v4.1-flash-flexmodels.dev/neuralwattDeepSeek V4.1 Flash Flex · neuralwatt · Released 2026-09-10 · Seen 13h ago
- openai/gpt-live-1models.dev/vercelGPT-Live 1 · vercel · Released 2026-09-10 · Seen 6d ago
- DeepSeek V4 Flash · agentrouter · Released 2026-09-10 · Seen 9d ago
- lightonai/lightonocr-2-1bmodels.dev/nano-gptLightOnOCR 2 · nano-gpt · Released 2026-09-10 · Seen 10d ago
- meta/llama-3.1-405b-instructmodels.dev/nano-gptLlama 3.1 405B · nano-gpt · Released 2026-09-10 · Seen 10d ago
- sakana/fugu-maxopenroutermodels.dev/nano-gptmodels.dev/llmgateway-providersmodels.dev/llmgatewaymodels.dev/vercelmodels.dev/kilomodels.dev/openrouterSakana: Fugu Max · sakana · Released 2026-09-10 · Seen 10d ago
Fugu Max is the cost-performance model in Sakana AI's Fugu family. Rather than a single monolithic model, Fugu is a learned multi-agent orchestration system: a language model trained to route...
- Sakana: Fugu Ultra v2 · sakana · Released 2026-09-10 · Seen 10d ago
Fugu Ultra v2 is the higher-performance model in Sakana AI's Fugu family. Rather than a single monolithic model, Fugu is a learned multi-agent orchestration system: a language model trained to...
- deepseek/deepseek-v4p1-flashmodels.dev/fireworks-aiDeepSeek V4.1 Flash · fireworks-ai · Released 2026-09-10 · Seen 11d ago
- deepseek/deepseek-flashmodels.dev/opencode-gomodels.dev/deepseekmodels.dev/302aimodels.dev/vancineopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/fireworks-aiDeepSeek V4.1 Flash · opencode-go · Released 2026-09-10 · Seen 12d ago
This model always redirects to the latest model in the DeepSeek Flash family.
- alibaba/qwen-3-8-flashmodels.dev/veniceQwen 3.8 Flash · venice · Released 2026-09-10 · Seen 12d ago
- deepseek/deepseek-v4-flash-vision-expopenroutermodels.dev/opencodemodels.dev/crofmodels.dev/aihubmixmodels.dev/siliconflowDeepSeek: DeepSeek V4 Flash Vision Exp · deepseek · Released 2026-09-10 · Seen 17d ago
DeepSeek V4 Flash Vision Exp is an experimental vision-enabled version of [DeepSeek V4 Flash 0731](https://openrouter.ai/deepseek/deepseek-v4-flash-0731) from DeepSeek, adding image understanding while matching the base model on text capabilities including agents,...
- k2-horizon-7bmodels.dev/nano-gptK2-Horizon-7B · nano-gpt · Released 2026-09-09 · Seen 12d ago
- agnes-3.0-flashmodels.dev/nano-gptAgnes 3.0 Flash · nano-gpt · Released 2026-09-09 · Seen 12d ago
- google/gemma-4-12b-it-station-keepermodels.dev/nano-gptGemma 4 12B StationKeeper · nano-gpt · Released 2026-09-09 · Seen 12d ago
- google/gemma-4-12b-it-semancermodels.dev/nano-gptGemma 4 12B Semancer · nano-gpt · Released 2026-09-09 · Seen 12d ago
- alibaba/qwen3.8-27b-queenmodels.dev/nano-gptQwen 3.8 27B Queen · nano-gpt · Released 2026-09-09 · Seen 12d ago
- inception/mercury-2.5openroutermodels.dev/vercelmodels.dev/kilomodels.dev/openroutermodels.dev/inceptionmodels.dev/veniceInception: Mercury 2.5 · inception · Released 13d ago · Seen 13d ago
Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...
- Nex AGI: Nex-N2.5-Mini (free) · nex-agi · Released 13d ago · Seen 13d ago
Nex-N2.5 is an agentic model built to turn goals into working, verified outcomes. Its core strength is agentic coding within a visual feedback loop: it can explore codebases, implement multi-file...
- Nex AGI: Nex-N2.5-Pro (free) · nex-agi · Released 13d ago · Seen 13d ago
Nex-N2.5 is an agentic model built to turn goals into working, verified outcomes. Its core strength is agentic coding within a visual feedback loop: it can explore codebases, implement multi-file...
- inclusionai/ling-3.0-flash-vlmodels.dev/nano-gptopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/vercelLing 3.0 Flash VL · nano-gpt · Released 2026-09-08 · Seen 12d ago
- GPT Image 2.5 Flare · vercel · Released 2026-09-08 · Seen 13d ago
- GPT Image 2.5 Sunburst · vercel · Released 2026-09-08 · Seen 13d ago
- deepseek/deepseek-v4.1-flash-betamodels.dev/vercelDeepSeek V4.1 Flash Beta · vercel · Released 2026-09-08 · Seen 13d ago
- deepseek/deepseek-v4.1-flashmodels.dev/nano-gptopenroutermodels.dev/crossmodelmodels.dev/kilomodels.dev/openroutermodels.dev/llmgateway-providersmodels.dev/llmgatewaymodels.dev/requestymodels.dev/huggingfacemodels.dev/vercelmodels.dev/deepinframodels.dev/merge-gatewaymodels.dev/ofoxmodels.dev/edenaimodels.dev/opencode-gomodels.dev/hypermodels.dev/greenptmodels.dev/ollama-cloudmodels.dev/basetenmodels.dev/cline-passmodels.dev/aihubmixmodels.dev/togetheraimodels.dev/amdmodels.dev/alibaba-token-plan-cnmodels.dev/meliousmodels.dev/cortecsmodels.dev/digitaloceanmodels.dev/alibaba-token-planmodels.dev/tensorxmodels.dev/vancinemodels.dev/syntheticmodels.dev/scnet-token-planmodels.dev/alibaba-cnmodels.dev/opencodemodels.dev/nebiusmodels.dev/vivgridmodels.dev/neuralwattmodels.dev/venicemodels.dev/empiriolabsmodels.dev/tinfoilmodels.dev/wandbDeepSeek V4.1 Flash · nano-gpt · Released 2026-09-08 · Seen 13d ago
- deepseek/deepseek-v4-flash-vision-exp-uncensoredmodels.dev/nano-gptDeepSeek V4 Flash Vision Exp Uncensored · nano-gpt · Released 2026-09-07 · Seen 14d ago
- amd/minicpm5-2bmodels.dev/amdMiniCPM5-2B · amd · Released 2026-09-06 · Seen 7d ago
- thedrummer/artemis-v1.1models.dev/nano-gptTheDrummer/Artemis v1.1 · nano-gpt · Released 2026-09-06 · Seen 15d ago
- openai/gpt-6-astra-proopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/nano-gptmodels.dev/veniceOpenAI: GPT-6 Astra Pro · openai · Released 2026-09-05 · Seen 17d ago
GPT-6 Astra Pro is the same underlying model as [GPT-6 Astra](https://openrouter.ai/openai/gpt-6-astra), served with `reasoning.mode` set to `pro` for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode
- openai/gpt-6-astraopenroutermodels.dev/llmgateway-providersmodels.dev/llmgatewaymodels.dev/openroutermodels.dev/nano-gptmodels.dev/vercelmodels.dev/kilomodels.dev/merge-gatewaymodels.dev/github-copilotmodels.dev/openaimodels.dev/opencodemodels.dev/crossmodelmodels.dev/edenaimodels.dev/azuremodels.dev/ofoxmodels.dev/neonmodels.dev/vivgridmodels.dev/302aimodels.dev/requestymodels.dev/amazon-bedrockmodels.dev/cloudflare-ai-gatewaymodels.dev/aihubmixmodels.dev/opperopencodemodels.dev/infermodels.dev/venicemodels.dev/digitaloceanOpenAI: GPT-6 Astra · openai · Released 17d ago · Seen 17d ago
GPT-6 Astra is OpenAI's flagship model for demanding end-to-end work. It is suited for advanced analysis, software engineering, deep research, scientific work, and document creation, with particular strengths in long-horizon...
- inclusionAI: Ling 3.0 Flash Sante (free) · inclusionai · Released 17d ago · Seen 17d ago
Ling 3.0 Flash Sante is a health and medicine-focused mixture-of-experts model from InclusionAI, built on Ling 3.0 Flash with 5.1B active parameters out of 124B total. It is designed for...
- gitlab/duo-chat-gpt-6-astramodels.dev/gitlabAgentic Chat (GPT-6 Astra) · gitlab · Released 2026-09-04 · Seen 14d ago
- openai/gpt-6-astra-fastmodels.dev/vercelGPT-6 Astra (Fast) · vercel · Released 2026-09-04 · Seen 17d ago
- omen-alphamodels.dev/opencode-goOmen Alpha · opencode-go · Released 2026-09-04 · Seen 17d ago
- meta/muse-spark-1.3-contributoropenroutermodels.dev/nano-gptmodels.dev/llmgateway-providersmodels.dev/bothubMeta: Muse Spark 1.3 Contributor · meta · Released 19d ago · Seen 17d ago
Muse Spark 1.3 Contributor is the cost-efficient contributor tier of Meta’s multimodal reasoning model for experimentation, learning, and early-stage agentic, multi-agent, and coding workflows. It is designed to track information...
- meta/muse-spark-1.3openroutermodels.dev/nano-gptmodels.dev/llmgateway-providersmodels.dev/vercelmodels.dev/opencodemodels.dev/aihubmixmodels.dev/opperMeta: Muse Spark 1.3 · meta · Released 19d ago · Seen 17d ago
Muse Spark 1.3 is a multimodal reasoning model from Meta for long-running agentic, multi-agent, and coding workflows. It is designed to keep track of information across extended tasks, work through...
- anthropic/claude-fable-5.1openroutermodels.dev/neonmodels.dev/vivgridmodels.dev/302aimodels.dev/llmgateway-providersmodels.dev/aihubmixmodels.dev/oppermodels.dev/tempropencodeAnthropic: Claude Fable 5.1 · anthropic · Released 20d ago · Seen 17d ago
Claude Fable 5.1 improves on Claude Fable 5 across the board, with the biggest gains in agentic coding, long-running agentic workflows, and knowledge work: long code refactors, front-end and visual...
- inception/mercury-2.5-previewopenrouterInception: Mercury 2.5 Preview · inception · Released 21d ago · Seen 17d ago
Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...
- tencent/hy4-previewopenroutermodels.dev/llmgatewaymodels.dev/llmgateway-providersmodels.dev/aihubmixmodels.dev/huggingfaceTencent: Hy4 preview · tencent · Released 25d ago · Seen 17d ago
Tencent: Hy4 preview is a mixture-of-experts model from Tencent, with 49B active parameters out of 770B total. It is designed for coding agents, complex tool-use workflows, and productivity tasks that...
- inclusionai/ling-3.0-flash-finopenrouterLing 3.0 Flash Fin · inclusionai · Released 25d ago · Seen 17d ago
Ling 3.0 Flash Fin is a finance-focused mixture-of-experts model from InclusionAI, built on Ling 3.0 Flash with 5.1B active parameters out of 124B total. It is designed for real-world investment...
- alibaba/qwen3.8-flash-nextmodels.dev/tensorxQwen3.8 Flash Next · tensorx · Released 2026-08-27 · Seen 2d ago
- alibaba/qwen3.8-flashopenroutermodels.dev/302aimodels.dev/ofoxmodels.dev/deepinframodels.dev/nano-gptmodels.dev/aihubmixmodels.dev/opencodeQwen: Qwen3.8 Flash · qwen · Released 26d ago · Seen 17d ago
Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.
- zhipu/glm-5.3-flashopenroutermodels.dev/llmgateway-providersmodels.dev/wandbmodels.dev/cline-passmodels.dev/opencodemodels.dev/302aimodels.dev/greenptmodels.dev/bothubmodels.dev/volcengine-coding-planmodels.dev/nvidiamodels.dev/friendlimodels.dev/meliousmodels.dev/privatemode-aimodels.dev/iteracomputemodels.dev/tensorxmodels.dev/zenmuxmodels.dev/neuralwattmodels.dev/siliconflowmodels.dev/oppermodels.dev/neonmodels.dev/orcarouterZ.ai: GLM 5.3 Flash · z-ai · Released 26d ago · Seen 17d ago
GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...
- zhipu/glm-5.3-flash-flexmodels.dev/neuralwattGLM-5.3 Flash Flex · neuralwatt · Released 2026-08-26 · Seen 13h ago
- zhipu/ox-alphamodels.dev/aihubmixOx Alpha · aihubmix · Released 2026-08-26 · Seen 3d ago
- GLM 5.3 Flash · umans-ai-coding-plan · Released 2026-08-26 · Seen 5d ago
- zhipu/glm-5.3-flash:fastmodels.dev/incoGLM-5.3-Flash · inco · Released 2026-08-26 · Seen 5d ago
- zhipu/glm-5-3-flash-260828models.dev/volcengineGLM-5.3-Flash · volcengine · Released 2026-08-26 · Seen 5d ago
- zhipu/glm-5.3-flash-fp4models.dev/coralbricksGLM 5.3 Flash FP4 · coralbricks · Released 2026-08-26 · Seen 7d ago
- ibm-granite/granite-4.2-8bopenrouterIBM: Granite 4.2 8B · ibm-granite · Released 2026-08-24 · Seen 17d ago
Granite 4.2 8B is a dense reasoning model from IBM. It is suited for mathematics, code generation, multilingual dialogue, and agentic workflows that need multi-step reasoning. It supports full, low-effort,...
- tencent/hy-mt2-1.8bopenrouterTencent: Hy-MT2-1.8B · tencent · Released 2026-08-20 · Seen 17d ago
Hy-MT2-1.8B is a compact 1.8B-parameter translation model from Tencent. It supports 33 language pairs and five Chinese dialect and minority-language pairs, with workflows for structured, delimiter-based, contextual, glossary-based, and style-guided...
- tencent/hy-mt2-30b-a3bopenrouterTencent: Hy-MT2-30B-A3B · tencent · Released 2026-08-20 · Seen 17d ago
Hy-MT2-30B-A3B is Tencent's flagship translation model in the Hy-MT2 family. It supports 33 language pairs and five Chinese dialect and minority-language pairs, with workflows for structured, delimiter-based, contextual, glossary-based, and...
- inklingmodels.dev/hyperInkling · hyper · Released 2026-08-15 · Seen 16d ago
- alibaba/qwen3.8-27bmodels.dev/llmgateway-providersmodels.dev/ovhcloudmodels.dev/ofoxmodels.dev/amdmodels.dev/nano-gptmodels.dev/iteracomputeopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/tensorxmodels.dev/opperQwen3.8-27B · ovhcloud · Released 2026-08-14 · Seen 17d ago
- zhipu/glm-5.3-flexmodels.dev/neuralwattGLM 5.3 Flex · neuralwatt · Released 2026-08-14 · Seen 13h ago
- nvidia/qwen3.8-27b-nvfp4models.dev/llmtechQwen3.8 27B · llmtech · Released 2026-08-14 · Seen 13h ago
- alibaba/qwen-3.8-27b-flexmodels.dev/neuralwattQwen3.8 27B Flex · neuralwatt · Released 2026-08-14 · Seen 13h ago
- zhipu/glm-5-3models.dev/mistralGLM-5.3 · mistral · Released 2026-08-14 · Seen 4d ago
- GLM-5.3 Fast · inco · Released 2026-08-14 · Seen 6d ago
- zhipu/glm5.3-754bmodels.dev/aki-ioGLM-5.3 · aki-io · Released 2026-08-14 · Seen 7d ago
- zhipu/glm5.3models.dev/nanGLM-5.3 · nan · Released 2026-08-14 · Seen 10d ago
- zhipu/glm-5.3-fastmodels.dev/fireworks-aiGLM 5.3 Fast · fireworks-ai · Released 2026-08-14 · Seen 14d ago
- alibaba/qwen-3.8-27bmodels.dev/cerebrasQwen3.8 27B · cerebras · Released 2026-08-14 · Seen 15d ago
- zhipu/glm-5.3models.dev/opencodemodels.dev/privatemode-aiopenroutermodels.dev/302aimodels.dev/greenptmodels.dev/cloudflare-workers-aimodels.dev/bothubmodels.dev/llmgateway-providersmodels.dev/agentroutermodels.dev/meliousmodels.dev/alibaba-cnmodels.dev/nvidiamodels.dev/iteracomputemodels.dev/incomodels.dev/alibaba-token-planmodels.dev/alibaba-token-plan-cnmodels.dev/nebiusmodels.dev/tensorxmodels.dev/zenmuxmodels.dev/siliconflowmodels.dev/oppermodels.dev/tinfoilGLM-5.3 · opencode · Released 2026-08-14 · Seen 17d ago
- Gemini 3.7 Flash · 302ai · Released 2026-08-13 · Seen 13d ago
- mixedbread/toast-1models.dev/vercelToast 1 · vercel · Released 2026-08-13 · Seen 2d ago
- google/gemini-3.8-flashopenroutermodels.dev/nano-gptmodels.dev/llmgateway-providersmodels.dev/google-vertexmodels.dev/requestymodels.dev/crossmodelmodels.dev/googlemodels.dev/vercelmodels.dev/vivgridmodels.dev/302aimodels.dev/cortecsmodels.dev/ofoxmodels.dev/aihubmixmodels.dev/oppermodels.dev/tempropencodeGoogle: Gemini 3.8 Flash · google · Released 2026-08-13 · Seen 17d ago
Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.
- alibaba/qwen3.8-2.4t-a95bmodels.dev/fireworks-aimodels.dev/iteracomputemodels.dev/tensorxmodels.dev/siliconflowmodels.dev/opperQwen3.8 2.4T A95B · iteracompute · Released 2026-08-12 · Seen 17d ago
- deepseek/deepseek-v4-pro-0813models.dev/vivgridmodels.dev/edenaimodels.dev/bothubmodels.dev/meliousmodels.dev/iteracomputemodels.dev/nebiusmodels.dev/tensorxmodels.dev/siliconflowDeepSeek V4 Pro 0813 · vivgrid · Released 2026-08-12 · Seen 14d ago
- x-ai/grok-4-6models.dev/neonmodels.dev/amazon-bedrockmodels.dev/302aimodels.dev/google-vertexmodels.dev/zenmuxmodels.dev/oppermodels.dev/ociGrok 4.6 · neon · Released 2026-08-12 · Seen 15d ago
- deepseek/deepseek-v4-pro:0813models.dev/ollama-cloudDeepSeek V4 Pro 0813 · ollama-cloud · Released 2026-08-12 · Seen 9d ago
- deepseek/deepseek-v4-promodels.dev/sensenovamodels.dev/llmgateway-providersmodels.dev/meliousmodels.dev/fireworks-aimodels.dev/opperopenroutermodels.dev/kilomodels.dev/openrouterDeepSeek V4 Pro · sensenova · Released 2026-08-12 · Seen 15d ago
This model always redirects to the latest model in the DeepSeek Pro family.
- nvidia/nemotron-3.5-lightningmodels.dev/nano-gptNvidia Nemotron 3.5 Lightning TEE · nano-gpt · Released 2026-08-11 · Seen 10d ago
- x-ai/grok-imagine-image-2.0models.dev/zenmuxGrok Imagine Image 2.0 · zenmux · Released 2026-08-07 · Seen 2d ago
- Muse Spark 1.2 · aihubmix · Released 2026-08-05 · Seen 13h ago
- meta/muse-spark-1.2-contributoropenrouterMeta: Muse Spark 1.2 Contributor · meta · Released 2026-08-05 · Seen 17d ago
Muse Spark 1.2 contributor tier is a reasoning model from Meta designed for developers who want to start building at an even lower cost. It’s meaningfully cheaper than Muse Spark...
- x-ai/grok-voice-stt-1.0models.dev/zenmuxGrok Voice STT 1.0 · zenmux · Released 2026-08-04 · Seen 2d ago
- Qwen3.8 Max · 302ai · Released 2026-08-03 · Seen 13d ago
- alibaba/qwen3.8-max-0902models.dev/nano-gptmodels.dev/vercelopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/edenaimodels.dev/ofoxQwen3.8 Max 0902 · nano-gpt · Released 2026-08-03 · Seen 17d ago
- flexai/deepseek-v4-flash-0731models.dev/edenaimodels.dev/bothubmodels.dev/meliousmodels.dev/iteracomputeopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/siliconflowDeepSeek V4 Flash 0731 (FlexAI) · edenai · Released 2026-07-31 · Seen 14d ago
- deepseek/deepseek-v4-flash-0731-fastmodels.dev/aihubmixDeepSeek V4 Flash 0731 Fast · aihubmix · Released 2026-07-31 · Seen 13h ago
- deepseek/deepseek-v4-flash-speedmodels.dev/neuralwattDeepSeek V4 Flash (Speed) · neuralwatt · Released 2026-07-31 · Seen 13h ago
- inclusionai/inkling-smallmodels.dev/pioneerInkling Small · pioneer · Released 2026-07-30 · Seen 10d ago
- ornith-ai/ornith-1.5-35b-a3bmodels.dev/iteracomputeOrnith 1.5 35B A3B · iteracompute · Released 2026-07-29 · Seen 5d ago
- Claude Opus 5 · 302ai · Released 2026-07-24 · Seen 13d ago
- anthropic/claude-opus-5-fastmodels.dev/pioneerClaude Opus 5 · pioneer · Released 2026-07-23 · Seen 10d ago
- Gemini 3.6 Flash · 302ai · Released 2026-07-21 · Seen 13d ago
- google/gemini-3.5-flash-litemodels.dev/302aimodels.dev/sap-ai-coremodels.dev/aihubmixmodels.dev/oppermodels.dev/tempropencodeGemini 3.5 Flash Lite · 302ai · Released 2026-07-21 · Seen 13d ago
- moonshot/kimi-k2.7-code-nitromodels.dev/fireworks-aiKimi Latest · fireworks-ai · Released 2026-07-16 · Seen 6d ago
- runware/kimi-k3models.dev/llmgateway-providersmodels.dev/sensenovamodels.dev/302aimodels.dev/volcengine-coding-planmodels.dev/meliousmodels.dev/wallabymodels.dev/alibaba-cnmodels.dev/alibabamodels.dev/iteracomputemodels.dev/ainetcafemodels.dev/siliconflowmodels.dev/opperKimi K3 (Runware) · llmgateway-providers · Released 2026-07-16 · Seen 16d ago
- Kimi K3-256K · kimi-code-plan-global · Released 2026-07-16 · Seen 3d ago
- Kimi K3 · kimi-code-plan-global · Released 2026-07-16 · Seen 3d ago
- Kimi K3 · inco · Released 2026-07-16 · Seen 6d ago
- moonshot/kimi-k3-fastmodels.dev/pioneerKimi K3 · pioneer · Released 2026-07-16 · Seen 10d ago
- alibaba/qwen3.7-flashmodels.dev/nano-gptQwen3.7 Flash Thinking · nano-gpt · Released 2026-07-15 · Seen 7d ago
- databricks/databricks-inklingmodels.dev/edenaiInkling · edenai · Released 2026-07-15 · Seen 16d ago
- openai/gpt-5.6-luna-promodels.dev/302aigpt-5.6-luna-pro · 302ai · Released 2026-07-09 · Seen 13d ago
- openai/gpt-5.6-lunamodels.dev/302aimodels.dev/bothubmodels.dev/oppermodels.dev/amazon-bedrockopenroutermodels.dev/nano-gptmodels.dev/kilomodels.dev/openrouterGPT-5.6 Luna · 302ai · Released 2026-07-09 · Seen 13d ago
This model always redirects to the latest model in the OpenAI GPT Luna family.
- openai/gpt-5.6-terramodels.dev/302aimodels.dev/oppermodels.dev/amazon-bedrockopenroutermodels.dev/nano-gptmodels.dev/kilomodels.dev/openrouterGPT-5.6 Terra · 302ai · Released 2026-07-09 · Seen 13d ago
This model always redirects to the latest model in the OpenAI GPT Terra family.
- openai/gpt-5.6-sol-promodels.dev/302aigpt-5.6-sol-pro · 302ai · Released 2026-07-09 · Seen 13d ago
- openai/gpt-5.6-solmodels.dev/302aimodels.dev/oppermodels.dev/amazon-bedrockmodels.dev/inferopenroutermodels.dev/nano-gptmodels.dev/kilomodels.dev/openrouterGPT-5.6 Sol · 302ai · Released 2026-07-09 · Seen 13d ago
This model always redirects to the latest model in the OpenAI GPT Sol family.
- Grok 4.5 · 302ai · Released 2026-07-08 · Seen 13d ago
- Hy3 (Tencent Cloud) · llmgateway-providers · Released 2026-07-06 · Seen 9d ago
- poolside/laguna-xs-2.1models.dev/nano-gptLaguna XS 2.1 · nano-gpt · Released 2026-07-02 · Seen 14d ago
- google/gemini-3.1-flash-lite-imagemodels.dev/aihubmixNano Banana 2 Lite · aihubmix · Released 2026-06-30 · Seen 13h ago
- LongCat-2.0 · siliconflow · Released 2026-06-30 · Seen 13h ago
- Claude Sonnet 5 · 302ai · Released 2026-06-29 · Seen 13d ago
- bytedance/seed-2.1-turbomodels.dev/vercelSeed 2.1 Turbo · vercel · Released 2026-06-23 · Seen 7d ago
- Fugu Ultra v2.0 (Sakana AI) · llmgateway-providers · Released 2026-06-15 · Seen 10d ago
- zhipu/glm-5.2-maasmodels.dev/google-vertexGLM-5.2 · google-vertex · Released 2026-06-13 · Seen 5d ago
- zhipu/glm-5.2-fastmodels.dev/pioneerGLM-5.2 · pioneer · Released 2026-06-13 · Seen 11d ago
- zhipu/glm-5.2openroutermodels.dev/302aimodels.dev/llmgateway-providersmodels.dev/meliousmodels.dev/kilomodels.dev/openroutermodels.dev/opperZ.ai: GLM 5.2 (batch) · z-ai · Released 2026-06-13 · Seen 13d ago
GLM 5.2 is a large-scale reasoning model from Z.ai. It supports text input and output with a 1M-token context window, and is suited for long-horizon agent workflows, project-level software engineering,...
- moonshot/kimi-k2.7-codemodels.dev/302aimodels.dev/llmgateway-providersmodels.dev/meliousmodels.dev/siliconflowKimi K2.7 Code · 302ai · Released 2026-06-12 · Seen 13d ago
- Kimi For Coding HighSpeed · kimi-code-plan-global · Released 2026-06-12 · Seen 3d ago
- moonshot/kimi-k2.7-code-highspeedmodels.dev/llmgateway-providersKimi K2.7 Code Highspeed (Tencent Cloud) · llmgateway-providers · Released 2026-06-12 · Seen 9d ago
- Claude Fable 5 · vivgrid · Released 2026-06-07 · Seen 14d ago
- nvidia/nemotron-3.5-content-safetymodels.dev/nano-gptNemotron 3.5 Content Safety · nano-gpt · Released 2026-06-04 · Seen 2d ago
- nex-agi/nex-n2-promodels.dev/siliconflowNex-N2-Pro · siliconflow · Released 2026-06-02 · Seen 13h ago
- Qwen3.7 Plus · 302ai · Released 2026-06-02 · Seen 13d ago
- minimax/minimax-m3:fastmodels.dev/incoMiniMax M3 Fast · inco · Released 2026-06-01 · Seen 5d ago
- minimax/minimax-m3models.dev/302aimodels.dev/llmgateway-providersmodels.dev/iteracomputemodels.dev/incomodels.dev/aihubmixmodels.dev/siliconflowmodels.dev/oppermodels.dev/fireworks-aiMiniMax-M3 · 302ai · Released 2026-06-01 · Seen 13d ago
- google/gemma-4-12b-itmodels.dev/siliconflowGemma 4 12B IT · siliconflow · Released 2026-05-31 · Seen 13h ago
- stepfun/step-3.7-flashmodels.dev/aihubmixStep 3.7 Flash · aihubmix · Released 2026-05-29 · Seen 13h ago
- google/gemini-3.1-flash-imagemodels.dev/aihubmixNano Banana 2 · aihubmix · Released 2026-05-28 · Seen 13h ago
- Claude Opus 4.8 · 302ai · Released 2026-05-28 · Seen 13d ago
- Qwen3.7 Max · 302ai · Released 2026-05-21 · Seen 13d ago
- Hy-MT2 Plus · llmgateway · Released 2026-05-21 · Seen 9d ago
- Gemini 3.5 Flash · 302ai · Released 2026-05-19 · Seen 13d ago
- Gemini 3.1 Flash Lite · 302ai · Released 2026-05-07 · Seen 13d ago
- x-ai/grok-voice-tts-1.0models.dev/zenmuxGrok Voice TTS 1.0 · zenmux · Released 2026-05-03 · Seen 2d ago
- deepseek/deepseek-v4.1-flash:fastmodels.dev/incoDeepSeek V4.1 Flash · inco · Released 2026-05-03 · Seen 5d ago
- mistralai/mistral-medium-3.5models.dev/nano-gptMistral Medium 3.5 Thinking · nano-gpt · Released 2026-04-29 · Seen 7d ago
- Qwen3.6 Flash · 302ai · Released 2026-04-27 · Seen 13d ago
- openai/gpt-5.5-promodels.dev/opperGPT-5.5 Pro · opper · Released 2026-04-23 · Seen 13h ago
- DeepSeek V4 Flash 0423 · merge-gateway · Released 2026-04-23 · Seen 11d ago
- GPT-5.5 · 302ai · Released 2026-04-23 · Seen 13d ago
- openai/gpt-5.6-terra-promodels.dev/302aigpt-5.6-terra-pro · 302ai · Released 2026-04-23 · Seen 13d ago
- xiaomi/mimo-v2.5-promodels.dev/llmgateway-providersMiMo V2.5 Pro (Tencent Cloud) · llmgateway-providers · Released 2026-04-22 · Seen 9d ago
- google/gemini-embedding-2models.dev/temprGemini Embedding 2 · tempr · Released 2026-04-22 · Seen 1h ago
- Qwen3.6 27B · ofox · Released 2026-04-22 · Seen 11d ago
- Kimi K2.6 · 302ai · Released 2026-04-21 · Seen 13d ago
- Qwen3.6 Max Preview · ofox · Released 2026-04-20 · Seen 11d ago
- alibaba/qwen3.6-35b-flexmodels.dev/neuralwattQwen3.6 35B Flex · neuralwatt · Released 2026-04-17 · Seen 13h ago
- Qwen3.6 35B-A3B · 302ai · Released 2026-04-17 · Seen 13d ago
- Grok 4.3 · 302ai · Released 2026-04-17 · Seen 13d ago
- x-ai/grok-build-0.1models.dev/opperGrok Build 0.1 · opper · Released 2026-04-16 · Seen 13h ago
- inference-net/schematron-v2-smallopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/nano-gptmodels.dev/vercelInference.net: Schematron V2 Small · inference-net · Released 2026-04-16 · Seen 10d ago
Schematron V2 Small is a 3B-parameter HTML-to-JSON extraction model from Inference.net. It prioritizes extraction quality for complex schemas and long pages. Extraction instructions must be supplied through a JSON schema...
- inference-net/schematron-v2-turboopenroutermodels.dev/kilomodels.dev/openroutermodels.dev/nano-gptmodels.dev/vercelInference.net: Schematron V2 Turbo · inference-net · Released 2026-04-16 · Seen 10d ago
Schematron V2 Turbo is a 3B-parameter HTML-to-JSON extraction model from Inference.net. It prioritizes throughput for high-volume extraction workloads. Extraction instructions must be supplied through a JSON schema in response_format rather...
- anthropic/claude-opus-4-7models.dev/302aimodels.dev/amazon-bedrockmodels.dev/oppermodels.dev/tempropencodeclaude-opus-4-7-thinking · 302ai · Released 2026-04-14 · Seen 13d ago
- meta/muse-spark-1.1models.dev/aihubmixMuse Spark 1.1 · aihubmix · Released 2026-04-08 · Seen 13h ago
- x-ai/grok-imagine-image-qualitymodels.dev/xaiGrok Imagine Image Quality · xai · Released 2026-04-03 · Seen 13h ago
- Gemma 4 31B IT (Consensus Protocol) · llmgateway-providers · Released 2026-04-02 · Seen 11d ago
- Qwen3.6 Plus · 302ai · Released 2026-04-02 · Seen 13d ago
- google/gemma-4-26b-a4b-itmodels.dev/temprGemma 4 26B A4B IT · tempr · Released 2026-04-02 · Seen 1h ago
- google/gemma-4-e2bmodels.dev/amazon-bedrockGemma 4 E2B IT · amazon-bedrock · Released 2026-04-02 · Seen 10d ago
- google/gemma-4-31bmodels.dev/amazon-bedrockGemma 4 31B IT · amazon-bedrock · Released 2026-04-02 · Seen 10d ago
- google/gemma-4-26b-a4bmodels.dev/amazon-bedrockGemma 4 26B A4B IT · amazon-bedrock · Released 2026-04-02 · Seen 10d ago
- GLM-5V-Turbo · llmgateway · Released 2026-04-01 · Seen 9d ago
- alibaba/qwen3.5-omni-plusmodels.dev/nano-gptQwen3.5 Omni Plus · nano-gpt · Released 2026-03-30 · Seen 7d ago
- alibaba/qwen3.5-omni-flashmodels.dev/nano-gptQwen3.5 Omni Flash · nano-gpt · Released 2026-03-30 · Seen 7d ago
- GLM-5.1 (Tencent Cloud) · llmgateway-providers · Released 2026-03-27 · Seen 9d ago
- MiniMax M2.7 (Tencent Cloud) · llmgateway-providers · Released 2026-03-18 · Seen 9d ago
- minimax/minimax-m2p7models.dev/fireworks-aiMiniMax-M2.7 · fireworks-ai · Released 2026-03-18 · Seen 6d ago
- openai/gpt-5.4-minimodels.dev/opperGPT-5.4 mini · opper · Released 2026-03-17 · Seen 13h ago
- openai/gpt-5.4-nanomodels.dev/opperGPT-5.4 nano · opper · Released 2026-03-17 · Seen 13h ago
- Mistral: Mistral Small 4 (batch) · mistralai · Released 2026-03-16 · Seen 12d ago
Mistral Small 4 is the next major release in the Mistral Small family, unifying the capabilities of several flagship Mistral models into a single system. It combines strong reasoning from...
- GLM-5-Turbo · llmgateway · Released 2026-03-16 · Seen 9d ago
- nvidia/nemotron-3-super-120b-a12bmodels.dev/crusoeNemotron 3 Super 120B A12B · crusoe · Released 2026-03-11 · Seen 17d ago
- Grok 4.20 (Reasoning) · google-vertex · Released 2026-03-09 · Seen 11d ago
- Grok 4.20 (Non-Reasoning) · google-vertex · Released 2026-03-09 · Seen 11d ago
- openai/gpt-5.4-promodels.dev/opperGPT-5.4 Pro · opper · Released 2026-03-05 · Seen 13h ago
- openai/gpt-5.4models.dev/opperGPT-5.4 · opper · Released 2026-03-05 · Seen 13h ago
- google/gemini-3.1-flash-lite-previewmodels.dev/302aiGemini 3.1 Flash Lite Preview · 302ai · Released 2026-03-03 · Seen 13d ago
- GPT-5.3 Chat (latest) · 302ai · Released 2026-03-03 · Seen 13d ago
- Qwen3.5 Flash · ofox · Released 2026-02-23 · Seen 11d ago