Retour à l'espace développeurTarifs officiels Tarifs officiels
Cohere Modèles
Explorez les 2 modèles de Cohere avec des prix détaillés, avantages et inconvénients, et recommandations pour développeurs.
2
Modèles
$1.00
Entrée la moins chère
256K
Contexte max
2
Niveaux de qualité
Recommandations rapides
Meilleur rapport qualité-prix: Command A ($1.00/1M)
Meilleure qualité: Command A
Command A
FlagshipUtilisation d'outils, RAG, agents
Quand l'utiliser: Meilleur modèle Cohere pour l'utilisation d'outils en entreprise, le RAG et les charges de travail d'agents multilingues.
Points clés de la mise à niveau
- ◆111B paramètres — le modèle le plus grand et le plus performant de Cohere
- ◆Contexte 256K — 2x celui de Command R+ (128K) pour des documents plus longs
- ◆Débit 150 % supérieur à Command R+ — service de production plus rapide
- ◆23 langues prises en charge — la couverture multilingue la plus large chez Cohere
- ◆Ajustement fin + appel de fonctions — conçu pour les agents d'entreprise
Prix d'entrée
$1.00
per 1M tokens
Prix de sortie
$2.00
per 1M tokens
Entrée en cache
—
per 1M tokens
Entrée batch
—
per 1M tokens
Fenêtre de contexte: 256K
Sortie max: 8,000 tokens
Date de coupure des connaissances: 2025-03
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit
Avantages
- 111B paramètres, contexte 256K
- Débit 150 % supérieur à Command R+
- 23 langues prises en charge
Inconvénients
- Pas de support visuel
- Contexte plus petit que les concurrents
- Peu de benchmarks disponibles
Performance
Vitesse de sortie~60 tok/s
Limite de débit3,000 RPM
Multimodal
Entrée imageSortie imageEntrée audioSortie audio
Benchmarks
MMLU
82.0%
HumanEval
79.0%
Command R+
Mid-tierRAG, recherche d'entreprise
Quand l'utiliser: Spécialisé pour le RAG et la recherche d'entreprise — à utiliser lorsque la qualité de récupération est prioritaire.
Points clés de la mise à niveau
- ◆Conçu spécifiquement pour les pipelines RAG — génération fondée avec citations
- ◆Optimisation de la recherche d'entreprise — précision de récupération de premier ordre
- ◆Ajustement fin disponible — personnalisez pour des bases de connaissances spécifiques au domaine
- ◆La sortie max de 4K est limitante — passez à Command A pour 8K de sortie
- ◆Cher à 2,50 $/10 $ — Command A offre plus à 1 $/2 $
Prix d'entrée
$2.50
per 1M tokens
Prix de sortie
$10.00
per 1M tokens
Entrée en cache
—
per 1M tokens
Entrée batch
—
per 1M tokens
Fenêtre de contexte: 128K
Sortie max: 4,000 tokens
Date de coupure des connaissances: 2024-08
VisionAppel de fonctionAjustement finMode JSONNiveau gratuit
Avantages
- Conçu spécifiquement pour les pipelines RAG
- Optimisation de la recherche d'entreprise
- Ajustement fin disponible
Inconvénients
- Seulement 4K de sortie max
- Pas de vision
- Cher pour le milieu de gamme
Performance
Vitesse de sortie~50 tok/s
Limite de débit2,000 RPM
Multimodal
Entrée imageSortie imageEntrée audioSortie audio
Benchmarks
MMLU
78.0%
HumanEval
73.0%
Comparaison côte à côte
| Modèle | Niveau | Entrée | Sortie | Contexte |
|---|---|---|---|---|
| Command A | Flagship | $1.00 | $2.00 | 256K |
| Command R+ | Mid-tier | $2.50 | $10.00 | 128K |