Poznaj Eleven v4Poznaj Eleven v4, nasz najbardziej emocjonalny model. 3× więcej kredytów w planie Creator+ do 12 października

Przejdź do treści

Przedstawiamy ElevenLabs CLI v1

Opublikowano
Ostatnia aktualizacja

PosłuchajPosłuchaj tego artykułu

Dziś przedstawiamy v1 ElevenLabs CLI, która przenosi API ElevenLabs prosto do twojego terminala.

Agenci kodujący już działają w terminalu, gdzie uruchamiają polecenia, odczytują wyniki, a nawet zamawiają lunch. ElevenLabs CLI zaprojektowaliśmy z myślą przede wszystkim o agentach: oferuje dobrze udokumentowane polecenia i ustrukturyzowane wyniki JSON, które łatwo analizować i łączyć. Ma też tryb --dry-run — pozwala podejrzeć każdą operację, zanim zmieni coś w twoim obszarze roboczym.

CLI wprowadza też agents-as-code do ElevenAgents. Pobierz wszystkich agentów z obszaru roboczego do lokalnych plików konfiguracji, edytuj je jak każdą inną część kodu, podejrzyj dokładny diff i wdrażaj na produkcję ręcznie lub przez agenta kodującego.

Instalacja na macOS

brew install elevenlabs/tap/elevenlabs

Windows

scoop bucket add elevenlabs https://github.com/elevenlabs/scoop-bucket
scoop install elevenlabs

cURL

curl --proto '=https' --tlsv1.2 -LsSf https://github.com/elevenlabs/cli/releases/latest/download/elevenlabs-cli-installer.sh | sh

Cała platforma w jednym interfejsie

Każdy endpoint API ElevenLabs opublikowany w naszej specyfikacji OpenAPI jest dostępny jako podpolecenie:

# list every agent in your workspace as structured JSON 
elevenlabs agents list --format json

# compose a song from a prompt
elevenlabs music compose --prompt "lo-fi track for a rainy afternoon" --output track.mp3

# speak a sentence and save the audio
elevenlabs text-to-speech convert --voice-id gPPH6SLdL8XSX6GNJ40G --text "Hello from the CLI" --output hello.mp3

Agenci jako kod

Agents-as-code traktuje konfigurację agentów tak jak kod aplikacji. Pracujesz na plikach na dysku, a CLI synchronizuje je z twoim obszarem roboczym. Cały workflow mieści się w trzech poleceniach.

elevenlabs agents pull              # every agent in your workspace becomes a local config file
# edit a config: change the greeting, swap the voice, update the prompt
elevenlabs agents push --dry-run    # preview exactly what would change, without changing anything
elevenlabs agents push              # apply

Ten sam workflow działa też na produkcji. Gałęzie oddzielają środowisko deweloperskie od produkcyjnego — gałąź deweloperska może używać testowego numeru telefonu i tańszego LLM, a produkcja prawdziwego numeru i modelu frontier. W nowych projektach elevenlabs agents init tworzy całą strukturę wraz z szablonami startowymi dla popularnych konfiguracji, takich jak obsługa klienta.

Przy kilku agentach dashboard wystarczy. Jednak gdy zarządzasz flotą agentów w setkach organizacji klientów lub masowo przenosisz agentów z innej platformy, tylko pliki i kontrola wersji dają workflow, który się skaluje.

Stworzone dla agentów kodujących i deweloperów

Agent korzystający z CLI napotyka błędy inaczej niż człowiek. Nie odpowie na interaktywny prompt, stale ponawia próby i uczy się z tego, co podaje mu komunikat o błędzie. CLI zaprojektowaliśmy z myślą o tej rzeczywistości.

--help jest dla ludzi, --schema — dla agentów. Każde polecenie API wyświetla kontrakt czytelny dla maszyn: typowane dane wejściowe, ich lokalizację, wymagane pola i dokładny format odpowiedzi. Dzięki temu agent może utworzyć prawidłowe wywołanie bez zgadywania.

$ elevenlabs text-to-speech convert --schema
{
  "operation": "text-to-speech.convert",
  "description": "Create speech",
  "binaryResponse": true,
  "input": {
    "properties": {
      "text": { "location": "body", "type": "string" },
      "voice_id": { "location": "path", "type": "string" },
      ...
    },
    "required": ["text", "voice_id"]
  }
}

Błędy również dają agentowi punkt zaczepienia. Dla agentów zwracamy błędy jako JSON, który mogą analizować. Gdy przez TTY wykryjemy użytkownika, zamiast tego wyświetlamy zwykły komunikat o błędzie. Oba zawierają instrukcje, jak go naprawić.

Dla nieprawidłowego polecenia:

$ elevenlabs text-to-speech convert --text "Hello from the CLI"

Agenci otrzymają taki komunikat o błędzie:

$ elevenlabs text-to-speech convert --text "Hello from the CLI"
{
  "error": {
    "code": 400,
    "message": "Required parameter 'voice_id' is missing. Provide it via --voice-id or --params",
    "reason": "validationError"
  }
}

Użytkownicy zobaczą za to bardziej czytelny błąd ze wskazówką, jak rozwiązać problem:

error[validation]:
 Required parameter 'voice_id' is missing. Provide it via --voice-id or --params
 Try `elevenlabs text-to-speech convert --help`

Skills są gotowe do użycia

--help i --schema to wbudowana dokumentacja CLI. Skills idą dalej — uczą twojego agenta kodującego całych workflow, na przykład tworzenia agenta, generowania mowy czy transkrypcji rozmowy.

Zainstaluj je w swoim projekcie:

elevenlabs generate-skills

Agenci już działają w terminalu. Teraz działa tam też całe ElevenLabs. Zainstaluj CLI, przekaż agentowi skills i zobacz, co stworzy. Zacznij od dokumentacji.

Podobne artykuły

Twórz z najwyższej jakości audio AI