Dźwięki wywołań narzędzi

Dodaj dźwięk tła podczas działania narzędzia, by poprawić doświadczenie użytkownika.

Omówienie

Dźwięki wywołań narzędzi zapewniają dźwięk tła podczas działania narzędzia, tworząc bardziej naturalne i angażujące doświadczenie rozmowy. Gdy agent uruchamia narzędzie — na przykład pobiera dane z API lub przetwarza żądanie — dźwięki te wypełniają chwile ciszy i informują użytkowników, że agent aktywnie pracuje.

ElevenLabs Agents obsługuje wiele wbudowanych dźwięków tła, które możesz skonfigurować zarówno na poziomie narzędzia, jak i integracji. Dzięki temu masz precyzyjną kontrolę nad tym, kiedy i jak dźwięki są odtwarzane podczas rozmów.

Dźwięki wywołań narzędzi są odtwarzane tylko podczas działania narzędzia. Aby ustawić ciągły dźwięk w tle, zobacz Środowisko audio.

Przypadki użycia

Dźwięki wywołań narzędzi sprawdzają się szczególnie dobrze, gdy:

  • Wywołania API wymagają czasu: Odtwarzaj muzykę tła lub dźwięki pisania podczas pobierania danych z zewnętrznych usług
  • Długie operacje: Zapewnij informację dźwiękową podczas zapytań do bazy danych, złożonych obliczeń lub integracji z usługami zewnętrznymi
  • Naturalny przebieg rozmowy: Wypełniaj przerwy w rozmowie, by uniknąć niezręcznej ciszy
  • Oczekiwania użytkowników: Daj użytkownikom znać, że agent przetwarza ich żądanie, a nie ma problemów technicznych

Dźwięki wywołań narzędzi są opcjonalne. Jeśli wolisz ciche działanie narzędzi, po prostu pozostaw ustawienie dźwięku wywołania narzędzia jako „None”.

Dostępne dźwięki

ElevenLabs oferuje następujące opcje dźwięków tła:

Typ dźwiękuOpisNajlepsze zastosowanie
NoneBrak dźwięku podczas działania narzędziaSzybkie operacje, ciche workflow
TypingEfekt dźwiękowy pisania na klawiaturzeWyszukiwanie, przetwarzanie tekstu
Elevator Music 1-4Lekka muzyka w tle (energiczna)Dłuższe oczekiwanie, zastosowania ogólne

Możesz odsłuchać każdy dźwięk w panelu, klikając przycisk odtwarzania obok listy rozwijanej podczas konfiguracji dźwięków wywołań narzędzi.

Konfiguracja

Dźwięki wywołań narzędzi możesz skonfigurować w dwóch miejscach, przy czym konfiguracja na poziomie narzędzia ma pierwszeństwo:

Konfiguracja na poziomie narzędzia

Skonfiguruj dźwięki dla poszczególnych narzędzi w ustawieniach narzędzi agenta.

1

Przejdź do konfiguracji narzędzia

W sekcji Agent w ustawieniach agenta wybierz narzędzie, które chcesz skonfigurować, lub utwórz nowe.

2

Skonfiguruj dźwięk wywołania narzędzia

Przewiń do sekcji Tool Call Sound na dole konfiguracji narzędzia.

lista rozwijana dźwięku wywołania narzędzia

Wybierz dźwięk z listy rozwijanej:

  • None: Dźwięk nie będzie odtwarzany
  • Typing: Efekt pisania na klawiaturze
  • Elevator Music 1-4: Różne opcje muzyki tła
3

Skonfiguruj zachowanie dźwięku

Jeśli wybierzesz dźwięk (inny niż „None”), zobaczysz dodatkową opcję Sound Behavior:

lista rozwijana zachowania dźwięku

Wybierz, kiedy dźwięk ma być odtwarzany:

  • With pre-speech: Dźwięk jest odtwarzany tylko wtedy, gdy agent mówi przed uruchomieniem narzędzia
  • Always play: Dźwięk jest odtwarzany przy każdym uruchomieniu narzędzia, niezależnie od tego, czy agent najpierw coś powie
4

Zapisz konfigurację

Kliknij Save, aby zastosować ustawienia dźwięku wywołania narzędzia.

Konfiguracja na poziomie integracji

W przypadku narzędzi utworzonych przez integracje (serwery MCP, integracje API itd.) możesz ustawić domyślne dźwięki wywołań narzędzi na poziomie integracji:

1

Przejdź do ustawień integracji

Przejdź do Agent Settings > Integrations i wybierz integrację.

2

Skonfiguruj domyślny dźwięk

W podsumowaniu integracji znajdź ustawienia Tool Call Sound.

lista rozwijana integracji dźwięku wywołania narzędzia

Wybierz domyślny dźwięk, który będzie stosowany do wszystkich narzędzi z tej integracji, chyba że zostanie zastąpiony na poziomie narzędzia.

3

Zastąp na poziomie narzędzia (opcjonalnie)

Możesz zastąpić domyślne ustawienie na poziomie integracji dla konkretnych narzędzi, konfigurując dźwięki wywołań w ustawieniach danego narzędzia.

Opcje zachowania dźwięku

Ustawienie zachowania dźwięku określa, kiedy dźwięki wywołań narzędzi są odtwarzane podczas rozmowy:

With Pre-Speech (Auto)

Domyślne zachowanie. Dźwięk jest odtwarzany tylko wtedy, gdy agent mówi przed użyciem narzędzia.

Przykładowy scenariusz:

User: "What's the weather in Tokyo?"
Agent: "Let me check that for you..." [typing sound plays while fetching weather data]
Agent: "It's currently 72 degrees and sunny in Tokyo."

Kiedy używać:

  • Gdy chcesz, aby dźwięki były odtwarzane dopiero po potwierdzeniu żądania przez agenta
  • Aby rozmowa przebiegała bardziej naturalnie, gdy cisza po wypowiedzi użytkownika byłaby niezręczna
  • Gdy uruchomienie narzędzia następuje bezpośrednio po wypowiedzi agenta

Always Play

Dźwięk jest odtwarzany przy każdym uruchomieniu narzędzia, niezależnie od tego, czy agent wcześniej coś powie.

Przykładowy scenariusz:

User: "Check my order status"
[typing sound plays immediately while fetching order data]
Agent: "Your order #12345 shipped yesterday and will arrive tomorrow."

Kiedy używać:

  • W przypadku operacji, które zawsze zajmują zauważalną ilość czasu
  • Gdy chcesz zapewnić spójną informację dźwiękową przy każdym wywołaniu narzędzia
  • W przypadku operacji w tle, które mogą nie wymagać potwierdzenia przez agenta

Jeśli wybierzesz „Always play”, dźwięk będzie odtwarzany nawet wtedy, gdy agent nie mówi przed użyciem narzędzia. Może to spowodować odtworzenie dźwięku zaraz po tym, jak użytkownik skończy mówić, co w niektórych kontekstach rozmowy może wydawać się nagłe.

Dobre praktyki

Dopasuj dźwięki do czasu działania narzędzia

W przypadku szybkich operacji (< 1 sekunda) rozważ użycie „None” lub dźwięku pisania. W przypadku dłuższych operacji (> 3 sekundy) muzyka wind zapewnia lepsze doświadczenie użytkownika.

Używaj „With pre-speech” przy potwierdzonych działaniach

Gdy agent wyraźnie potwierdza żądanie przed jego wykonaniem, użyj zachowania „With pre-speech”, aby rozmowa przebiegała naturalnie:

System prompt
When users request information, first acknowledge their request before using tools.
For example: "Let me check that for you..." then call the appropriate tool.

Konfiguruj na poziomie integracji dla spójności

Jeśli masz wiele narzędzi z tej samej integracji, skonfiguruj dźwięki wywołań narzędzi na poziomie integracji, aby zapewnić spójną informację dźwiękową we wszystkich powiązanych narzędziach.

Testuj przy realistycznych opóźnieniach

Testuj dźwięki wywołań narzędzi przy realistycznych opóźnieniach API, aby upewnić się, że informacja dźwiękowa spełnia oczekiwania użytkowników. Weź pod uwagę:

  • Opóźnienie sieci do API
  • Czas przetwarzania API
  • Rozmieszczenie geograficzne użytkowników

Zachowaj równowagę z obsługą przerwań

Jeśli agent obsługuje przerwania przez użytkownika, dźwięki wywołań narzędzi zostaną automatycznie zatrzymane, gdy użytkownik przerwie. Upewnij się, że przebieg rozmowy dobrze to obsługuje.

Przykładowe konfiguracje

Agent wyszukiwania

Przypadek użycia: Agent przeszukujący bazę wiedzy lub bazę danych

Konfiguracja:

  • Dźwięk wywołania narzędzia: Typing
  • Zachowanie dźwięku: With pre-speech
  • Prompt systemowy zawiera: „Gdy użytkownicy zadają pytania, powiedz „Pozwól, że tego poszukam” przed wywołaniem narzędzia wyszukiwania.”

Agent obsługi klienta

Przypadek użycia: Agent sprawdzający status zamówień, stan magazynowy lub dane klientów

Konfiguracja:

  • Dźwięk wywołania narzędzia: Elevator Music 3
  • Zachowanie dźwięku: Always play
  • Uzasadnienie: Operacje mogą trwać 2–5 sekund, a muzyka w tle zapewnia lepsze doświadczenie niż cisza

Wieloetapowy workflow

Przypadek użycia: Agent wykonujący kilka kolejnych wywołań narzędzi

Konfiguracja:

  • Pierwsze narzędzie: Typing z With pre-speech
  • Kolejne narzędzia: Elevator Music 1 z Always play
  • Prompt systemowy określa: „Najpierw potwierdź żądanie, a potem uruchamiaj narzędzia kolejno.”

Rozwiązywanie problemów

Dźwięk się nie odtwarza

Możliwe przyczyny:

  1. Brak wypowiedzi przed użyciem narzędzia: Jeśli używasz zachowania „With pre-speech”, agent musi powiedzieć coś przed uruchomieniem narzędzia. Zaktualizuj prompt systemowy, aby zawierał potwierdzenie.
  2. Szybkie wykonanie: Jeśli narzędzie kończy działanie w mniej niż około 500 ms, dźwięk może nie mieć czasu, by zostać zauważalnie odtworzony.

Powiązane materiały