Robocikowo>ROBOCIKOWO
Command R+

Command R+

Command R+ (104B) · Rodzina: Command
LLM Cohere (104B, kontekst 128K) do zastosowań enterprise: generowanie z wyszukiwaniem (RAG) z cytowaniami i wieloetapowe użycie narzędzi; otwarte wagi (CC-BY-NC 4.0).
✓ Aktywny✓ Publiczny dostęp⚖ Open weightsLLMModel używający narzędzi📁 Command
Okno kontekstowe
128K
tokenów
Parametry
104B
parametrów
Data premiery
4 kwietnia 2024
Dostęp:DownloadAPIHostedWdrożenie:💻 Lokalnie☁ Cloud

Przegląd

Command R+ to duży model językowy opracowany przez Cohere (i Cohere Labs), zoptymalizowany pod kątem zastosowań enterprise — w szczególności generowania wspomaganego wyszukiwaniem (RAG) oraz wieloetapowego użycia narzędzi. Ma 104 miliardy parametrów i obsługuje okno kontekstowe o długości 128K tokenów.

Model wyróżnia się ugruntowanym generowaniem (grounded generation) z cytowaniami wskazującymi źródła informacji, jedno- i wieloetapowym wywoływaniem funkcji (function calling / tool use) do interakcji z zewnętrznymi API i bazami danych oraz zdolnościami agentowymi łączącymi wiele narzędzi w sekwencje kroków.

Command R+ jest wielojęzyczny — oceniany w 10 językach (angielski, francuski, hiszpański, włoski, niemiecki, portugalski brazylijski, japoński, koreański, arabski i chiński uproszczony) i wstępnie trenowany na 13 dodatkowych. To dobrze pozycjonuje go do zastosowań biznesowych, m.in. RAG, wyszukiwania korporacyjnego i automatyzacji zadań.

Model udostępniono z otwartymi wagami do celów badawczych na licencji CC-BY-NC 4.0 (z zasadami dopuszczalnego użytku Cohere Labs); wagi dostępne są na Hugging Face. Komercyjnie Command R+ jest oferowany przez API Cohere oraz platformy chmurowe (m.in. Microsoft Azure, Amazon Bedrock, Oracle).

Klasyfikacja
LLMModel używający narzędzi
Rodzina: Command
Dostęp i wdrożenie
PobieranieAPIHostowane
LokalnieChmura
Wagi: Open weights
Kluczowe parametry
📏 Kontekst: 128K
🧩 Parametry: 104B
Narzędzia · ✓ Fine-tuning
📥 Wejście: tekst

Specyfikacja techniczna

Okno kontekstowe
128K
tokenów
Parametry
104B
parametrów
Licencja
CC-BY-NC 4.0 (wagi badawcze); komercyjnie przez API Cohere
Wymagania sprzętowe
Model z otwartymi wagami (CC-BY-NC 4.0) do celów badawczych na Hugging Face; 104 mld parametrów wymaga wielu GPU o dużej pamięci VRAM do lokalnej inferencji (wersje skwantyzowane zmniejszają wymagania). Komercyjnie dostępny przez API Cohere oraz chmury (Azure, Amazon Bedrock, Oracle).
Funkcje:Używanie narzędziFine-tuning
Modalności
⬇ Wejście (Input)
text
⬆ Wyjście (Output)
textcode

Możliwości i zastosowania

Natywne możliwości modelu
Modelowanie języka
Zdolność przewidywania kolejnych tokenów i generowania spójnego tekstu w języku naturalnym na podstawie poprzedzającego kontekstu.
Kategoria: language
Rozumowanie
Zdolność modelu do logicznego wnioskowania i rozwiązywania złożonych problemów.
Kategoria: reasoning
Rozumowanie wieloetapowe
Prowadzenie wieloetapowego toku rozumowania w długich, złożonych zadaniach.
Kategoria: reasoning
Generowanie wspomagane wyszukiwaniem (RAG)
Zdolność modelu do generowania odpowiedzi w oparciu o pobrane dokumenty/dane, z ugruntowaniem treści i wskazaniem źródeł (cytowań).
Kategoria: language
Użycie narzędzi
Zdolność modelu do wywoływania zewnętrznych funkcji, API i narzędzi w trakcie rozmowy: kalkulator, wyszukiwarka, edytor kodu, baza danych. Model decyduje kiedy i jak użyć narzędzia oraz interpretuje jego wynik.
Kategoria: planning
Wywoływanie funkcji
Natywne wsparcie dla ustrukturyzowanego wykorzystania narzędzi, umożliwiające przepływy pracy oparte na agentach.
Kategoria: planning
Zdolności agentowe
Zdolność modelu do autonomicznego planowania i wykonywania wieloetapowych zadań poprzez sekwencyjne użycie narzędzi, utrzymywanie kontekstu i adaptację do wyników pośrednich.
Kategoria: planning
Programowanie
Generowanie, analizowanie i modyfikowanie kodu w wielu językach programowania. Obejmuje pisanie funkcji, debugowanie, refaktoryzację, code review, tworzenie testów. Mierzone benchmarkami takimi jak HumanEval, SWE-bench.
Kategoria: coding
Wielojęzyczność
Kompetencje w wielu językach naturalnych (od kilku do stu+): rozumienie, generowanie, tłumaczenie, code-switching w obrębie jednej rozmowy. Modele frontier obsługują szeroki wachlarz języków ze zbliżoną jakością.
Kategoria: language
Długi kontekst
Obsługa dużych okien kontekstowych — dziesiątek do setek tysięcy (lub milionów) tokenów wejścia. Umożliwia analizę całych baz kodu, długich dokumentów, wielu równolegle rozmów bez utraty wcześniejszych informacji. GPT-5.1 wspiera 400 000 tokenów.
Kategoria: language
Przestrzeganie instrukcji
Precyzyjne wypełnianie wskazówek zawartych w prompcie: format odpowiedzi, długość, styl, ograniczenia (np. 'odpowiedz w sześciu słowach'). GPT-5.1 znacząco poprawił tę zdolność względem GPT-5.
Kategoria: language
Wyjście strukturyzowane
Generowanie danych w ustrukturyzowanych formatach, np. JSON.
Kategoria: structured_generation

Architektura techniczna

Rdzeń architektury (Core Architecture)
Techniki trenowania (Training Techniques)