Où s'inscrire, et ce que Nokido sait interroger par clé
Hub unifié vers ~300 modèles (Llama, Gemma, Mistral, GLM5, Claude, GPT, etc.). Une seule clé, modèles `:free` gratuits, paid quand besoin.
Inference API + Spaces. Accès des milliers modèles open. Rate-limit free tier.
Inférence ultra-rapide (LPU). Llama 3.3 70B, Mixtral, Gemma. ~1000 req/jour free.
Gemini 2.5 Flash / Pro. 1M context window. Free tier 15 req/min, 1500/jour. OAuth via gcloud / Vertex AI dispo (entreprise).
Command R+ / R, RAG-optimisé. Clé Trial gratuite sans CB, rate-limitée.
Llama 3.3 70B / 405B sur Reconfigurable Dataflow Units. Free tier.
Inférence ultra-rapide WSE wafer scale. Llama 3.3 70B. Free beta.
Build avec NIM hostés. Llama, Mistral, Code Llama. 1000 req/mois free pour build.
GPT-4o, Claude, Llama, Mistral, Codestral hostés gratuits avec abo Copilot. OAuth GitHub natif via gh CLI.
Claude Sonnet/Opus 4.7. Subscription Pro/Max OU API pay-per-token. OAuth via Claude Code utilise les quotas de la subscription (séparé API depuis 15 juin 2026).
GPT-5.x, DALL-E. Pas de free tier auto, prépayer ~$5 min. OAuth ChatGPT pour Codex / interface web (Plus/Pro).
Cette table est le reflet du catalogue tools/forge_provider_catalogue.py —
la source unique de ce que Nokido sait interroger par clé. Les sections ci-dessus
mettent en avant quelques fournisseurs ; ici ils sont tous listés, y compris ceux
qu'aucune carte ne montrait (mesure du 2026-09-18 : 9 manquaient).
La variable et l'URL /models sont reprises telles quelles du catalogue ;
le lien d'inscription est dérivé du domaine de cet endpoint, il n'est pas inventé.
Aucune clé n'est affichée nulle part.
| fournisseur | variable de clé | endpoint /models | inscription |
|---|---|---|---|
| groq | GROQ_API_KEY | api.groq.com | console.groq.com |
| xai | XAI_API_KEY | api.x.ai | console.x.ai |
| sambanova | SAMBANOVA_API_KEY | api.sambanova.ai | cloud.sambanova.ai |
| openrouter | OPENROUTER_API_KEY | openrouter.ai | openrouter.ai/keys |
| mistral | MISTRAL_API_KEY | api.mistral.ai | console.mistral.ai |
| cerebras | CEREBRAS_API_KEY | api.cerebras.ai | cloud.cerebras.ai |
| deepseek | DEEPSEEK_API_KEY | api.deepseek.com | platform.deepseek.com |
| together | TOGETHER_API_KEY | api.together.xyz | api.together.xyz |
| deepinfra | DEEPINFRA | api.deepinfra.com | deepinfra.com |
| siliconflow | SILICONFLOW | api.siliconflow.cn | siliconflow.cn |
| nvidia | NVIDIA_API_KEY | integrate.api.nvidia.com | build.nvidia.com |
| nvidia_nim | NVIDIA_NIM_API_KEY | integrate.api.nvidia.com | build.nvidia.com |
| zai | ZAI_API_KEY | api.z.ai | z.ai |
| mammouth | MAMMOUTH_API_TOKEN | api.mammouth.ai | mammouth.ai |
| hf | HF_TOKEN | router.huggingface.co | huggingface.co |
| cohere | COHERE_API_KEY | api.cohere.ai | dashboard.cohere.com |
| voyage | VOYAGE_API_KEY | api.voyageai.com | voyageai.com |
| jina | JINA_API_KEY | api.jina.ai | jina.ai |
| lmstudio | LMSTUDIO_TOKEN | 127.0.0.1:1234 | local — aucune inscription |
| llamacpp | FORGE_LLAMA_KEY | 127.0.0.1:8080 | local — aucune inscription |
| ollama | — | 127.0.0.1:11434 | local — aucune inscription |
| litellm | LITELLM_API_KEY | 127.0.0.1:4000 | local — aucune inscription |
Volontairement hors de cette table, et le catalogue dit pourquoi : Tavily
(moteur de recherche, pas de /models), Smithery (registre MCP), Kaggle
(jeux de données), Codeberg (forge git), Freebox (domotique), Cloudflare Workers AI
(URL dépendante du compte), Perceval et Quandela (calcul quantique), et GitHub Models
— backend retiré le 2026-08-18 (410 Gone). Une absence nommée n'est pas un oubli.
Run LLMs localement. Llama, Qwen, DeepSeek, Mistral. Choisir quantization selon RAM/VRAM.
GUI pour LLMs locaux, OpenAI-compat API server. Modèles GGUF Hugging Face.
Backend C++ haute perf, support GGUF, CPU/Vulkan/CUDA/Metal/DirectML. Base d'Ollama/LM Studio.