Provider Model InputCostPerMillion OutputCostPerMillion Notes UpdatedAt
cerebras llama3.1-8b 0.1 0.1 Cerebras llama3.1-8b 2026-08-18 12:11:53 Edit Delete
groq meta-llama/llama-4-scout-17b-16e-instruct 0.11 0.34 Groq Llama-4-Scout 2026-08-18 12:11:53 Edit Delete
groq Qwen/Qwen3-8B 0.05 0.05 Groq Qwen3-8B router 2026-08-18 12:11:53 Edit Delete
groq openai/gpt-oss-120b 2.0 2.0 Groq gpt-oss-120b 2026-08-18 12:11:53 Edit Delete
groq openai/gpt-oss-20b 0.6 0.6 Groq gpt-oss-20b 2026-08-18 12:11:53 Edit Delete
llamacpp phi-4-mini 0.0 0.0 LlamaCpp local sin costo 2026-08-18 12:11:53 Edit Delete
nvidia nvidia/nemotron-mini-4b-instruct 0.0 0.0 NVIDIA NIM Free Endpoint 2026-08-18 12:11:53 Edit Delete
ollama qwen2.5:7b 0.0 0.0 Ollama local sin costo 2026-08-18 12:11:53 Edit Delete
ollama qwen2.5:3b 0.0 0.0 Ollama local sin costo 2026-08-18 12:11:53 Edit Delete
ollama llama3.2:1b 0.0 0.0 Ollama local sin costo 2026-08-18 12:11:53 Edit Delete
siliconflow deepseek-ai/DeepSeek-V4-Flash 0.1 0.1 SiliconFlow DeepSeek-V4-Flash 2026-08-18 12:11:53 Edit Delete
siliconflow meta-llama/llama-4-scout-17b-16e-instruct 0.11 0.34 SiliconFlow Llama-4-Scout 2026-08-18 12:11:53 Edit Delete
siliconflow Qwen/Qwen2.5-72B-Instruct 0.59 0.59 SiliconFlow Qwen2.5-72B 2026-08-18 12:11:53 Edit Delete
siliconflow Qwen/Qwen3-8B 0.06 0.06 SiliconFlow Qwen3-8B 2026-08-18 12:11:53 Edit Delete
siliconflow Qwen/Qwen3-VL-30B-A3B-Instruct 0.2 0.2 SiliconFlow Qwen3-VL-30B 2026-08-18 12:11:53 Edit Delete