Obiekty audio

*Ta zawartość została przetłumaczona przy użyciu narzędzi AI (w wersji beta) i może zawierać błędy. Aby wyświetlić tę stronę w języku angielskim, kliknij tutaj.

Modułowe obiekty audio w Robloxie pozwalają na dynamiczną kontrolę nad dźwiękiem i czatem głosowym w twoich doświadczeniach. Prawie każdy obiekt audio odpowiada rzeczywistemu urządzeniu audio, a wszystkie one współdziałają, aby rejestrować i odtwarzać dźwięk jak ich fizyczne odpowiedniki.

Na przykład, każdy obiekt audio konceptualnie należy do następujących kategorii:

  • Obiekty, które produkują strumienie audio, takie jak odtwarzacze audio.
  • Obiekty, które konsumują strumienie audio, takie jak emitery audio.
  • Obiekty, które modyfikują strumienie audio, takie jak efekty audio.
  • Obiekty, które przenoszą strumienie audio z jednego obiektu audio do drugiego, takie jak przewody.

Czytając ten przewodnik i ucząc się, jak wszystkie te obiekty audio współpracują, aby emitować dźwięk, dowiesz się, jak dokładnie rejestrować i przesyłać muzykę, efekty dźwiękowe oraz ludzki głos z doświadczenia do gracza i odwrotnie.

Odtwarzanie audio

Aby odtwarzać audio w swoim doświadczeniu, ważne jest, aby zrozumieć rolę każdego dostępnego obiektu audio:

  • AudioPlayer ładuje i odtwarza plik audio za pomocą określonego identyfikatora zasobu audio.
  • AudioEmitter to wirtualny głośnik, który emituje dźwięk w środowisku 3D.
  • AudioListener to wirtualny mikrofon, który rejestruje dźwięk z środowiska 3D.
  • AudioDeviceOutput to fizyczne urządzenie sprzętowe w rzeczywistym świecie, takie jak głośnik lub słuchawki.
  • AudioDeviceInput to fizyczny mikrofon w rzeczywistym świecie.
  • Obiekt AudioTextToSpeech konwertuje tekst na audio za pomocą sztucznego głosu ludzkiego.
  • Obiekt AudioSpeechToText konwertuje mówione audio na tekst.
  • Wire przenosi strumienie audio z jednego obiektu audio do drugiego.

Jak połączysz te obiekty audio, zależy od tego, czy chcesz emitować dźwięk bezpośrednio do głośnika lub słuchawek gracza, czy z obiektów w przestrzeni 3D. Następne sekcje szczegółowo opisują oba scenariusze.

Audio 2D

Audio 2D to dźwięk niedyrektywny, który odtwarzany jest z żadnej konkretnej lokalizacji, pozostając na tym samym poziomie głośności niezależnie od pozycji lub orientacji gracza w przestrzeni 3D. Ten typ audio wymaga trzech obiektów audio:

  • Odtwarzacza audio do produkcji strumienia audio.
  • Fizycznego urządzenia sprzętowego do odtwarzania strumienia audio w rzeczywistym świecie.
  • Przewodu do przenoszenia strumienia audio z odtwarzacza audio do urządzenia wyjściowego.

Aby pokazać, jak skonfigurować te obiekty audio w Studio dla audio 2D, poniższy diagram porównuje każdy obiekt z ich rzeczywistym odpowiednikiem urządzenia audio. Podsumowując:

  • AudioPlayer ładuje i odtwarza twój zasób audio z określonymi ustawieniami.
  • AudioDeviceOutput pozwala graczowi słyszeć dźwięk przez ich głośnik lub słuchawki.
  • Wire łączy się z odtwarzaczem audio za pomocą właściwości SourceInstance, a z fizycznym urządzeniem sprzętowym za pomocą właściwości TargetInstance. Działa wtedy jako mostek, aby przenieść strumień audio z odtwarzacza audio do urządzenia wyjściowego gracza.

Aby odtwarzać dźwięk niedyrektywny:

  1. W oknie Explorer przejdź do SoundService i wstaw następujące:
    1. Obiekt AudioPlayer, aby utworzyć źródło audio.
    2. Obiekt AudioDeviceOutput, aby utworzyć głośnik, który odtwarza dźwięk w całym doświadczeniu.
    3. Obiekt Wire, aby połączyć strumień z odtwarzacza audio do głośnika.
  2. W oknie Properties obiektu AudioPlayer:
    1. Ustaw AssetID na ważny identyfikator zasobu audio. Jeśli nie masz własnego niestandardowego audio, możesz znaleźć darmowe zasoby audio w Creator Store.
    2. Włącz Looping, jeśli chcesz, aby twoje audio powtarzało się w nieskończoność.
    3. Ustaw Volume na jednostkę amplitudy, którą chcesz odtwarzać w swoim audio.
  3. W oknie Properties obiektu Wire:
    1. Ustaw SourceInstance na AudioPlayer, aby określić, że chcesz odtwarzać audio w tym konkretnym odtwarzaczu audio.
    2. Ustaw TargetInstance na AudioDeviceOutput, aby określić, że chcesz odtwarzać audio z tego konkretnego głośnika.

Stąd możesz uruchomić swoje audio niedyrektywne za pomocą skryptów, aby odtwarzać je, gdy gracze dołączają do doświadczenia lub w wyniku zdarzenia w grze lub interakcji z interfejsem użytkownika. Aby uzyskać odniesienia do przykładów kodu dla tych przypadków użycia, zobacz samouczek Dodaj audio 2D.

Audio 3D

Audio 3D to dźwięk kierunkowy, który odtwarzany jest z konkretnej lokalizacji w przestrzeni 3D, zwiększając lub zmniejszając głośność w zależności od pozycji i orientacji gracza względem dźwięku. Ten typ audio wymaga sześciu obiektów audio:

  • Odtwarzacza audio do produkcji strumienia audio.
  • Emitera audio do emitowania strumienia audio w środowisku.
  • Słuchacza do rejestrowania strumienia audio z otoczenia.
  • Fizycznego urządzenia sprzętowego do odtwarzania strumienia audio w rzeczywistym świecie.
  • Dwóch przewodów: jeden do przenoszenia strumienia audio z odtwarzacza audio do emitera, a drugi do przenoszenia go z słuchacza do urządzenia wyjściowego.

Aby pokazać, jak skonfigurować te obiekty audio w Studio dla audio 3D, poniższy diagram porównuje każdy obiekt z ich rzeczywistym odpowiednikiem urządzenia audio. Podsumowując:

  • AudioPlayer ładuje i odtwarza twój zasób audio z określonymi ustawieniami.
  • Pozycja rodzica AudioEmitter w przestrzeni 3D określa, skąd dźwięk emituje w środowisku.
  • AudioListener rejestruje dźwięk z emitera z lokalnej kamery lub z Humanoid.RootPart postaci gracza, w zależności od tego, gdzie ustawisz domyślną pozycję słuchacza.
  • AudioDeviceOutput pozwala graczowi słyszeć dźwięk przez ich głośnik lub słuchawki.
  • Pierwszy Wire łączy się z odtwarzaczem audio za pomocą właściwości SourceInstance, a z emiterem za pomocą właściwości TargetInstance. Działa wtedy jako mostek, aby przenieść strumień audio z odtwarzacza audio do emitera.
  • Drugi Wire łączy się z słuchaczem za pomocą właściwości SourceInstance, a z fizycznym urządzeniem sprzętowym za pomocą właściwości TargetInstance. Działa wtedy jako mostek, aby przenieść strumień audio z słuchacza do urządzenia wyjściowego gracza.

Aby odtwarzać audio pozycyjne:

  1. Wybierz, gdzie chcesz utworzyć AudioListener, gdy gracze wchodzą do doświadczenia.

    1. W oknie Explorer wybierz SoundService.
    2. W oknie Properties ustaw ListenerLocation na jedną z następujących opcji:
      • Default - Tworzy i przypisuje słuchacza do Workspace.CurrentCamera w doświadczeniach, które włączają czat głosowy.
      • None - Nie tworzy słuchacza. Ta opcja jest przydatna, jeśli chcesz utworzyć słuchacza za pomocą skryptu.
      • Character - Tworzy i przypisuje słuchacza do postaci lokalnego gracza.
      • Camera - Tworzy i przypisuje słuchacza do Workspace.CurrentCamera.
  2. W oknie Explorer przejdź do obiektu 3D, z którego chcesz emitować dźwięk i wstaw następujące:

    1. Obiekt AudioPlayer, aby utworzyć źródło audio.
    2. Obiekt AudioEmitter, aby emitować strumień pozycyjny z obiektu 3D.
    3. Obiekt Wire, aby połączyć strumień z generatora mowy audio do emitera audio.
  3. W oknie Properties obiektu AudioPlayer:

    1. Ustaw AssetID na ważny identyfikator zasobu audio. Jeśli nie masz własnego niestandardowego audio, możesz znaleźć darmowe zasoby audio w Creator Store.
    2. Włącz Looping, jeśli chcesz, aby twoje audio powtarzało się w nieskończoność.
    3. Ustaw Volume na jednostkę amplitudy, którą chcesz odtwarzać w swoim audio.
  4. W oknie Properties obiektu AudioEmitter, ustaw DistanceAttenuation na krzywą głośności w zależności od odległości, która określa, jak głośno słuchacz słyszy emiter w zależności od odległości między nimi.

    Na przykład, poniższa krzywa zmniejsza głośność audio o połowę, gdy słuchacz znajduje się 50 studów od emitera, a następnie gwałtownie zmniejsza głośność do zera, gdy słuchacz znajduje się 70 studów od emitera.

  5. W oknie Properties obiektu Wire:

    1. Ustaw SourceInstance na AudioPlayer, aby określić, że chcesz odtwarzać audio w tym konkretnym odtwarzaczu audio.
    2. Ustaw TargetInstance na AudioEmitter, aby określić, że chcesz odtwarzać audio z tego konkretnego emitera audio.

Stąd możesz uruchomić swoje audio kierunkowe za pomocą skryptów, aby odtwarzać je, gdy gracze dołączają do doświadczenia lub w wyniku zdarzenia w grze lub interakcji z interfejsem użytkownika. Aby uzyskać odniesienia do przykładów kodu dla tych przypadków użycia, zobacz samouczek Dodaj audio 3D.

Tekst na mowę

Tekst na mowę (TTS) to forma technologii wspomagającej, która konwertuje ciągi tekstowe na dźwięki mowy za pomocą sztucznego głosu. Ten typ audio wymaga pięciu obiektów audio:

  • Generatora mowy audio do ładowania i konwertowania tekstu na audio.
  • Emitera audio do emitowania strumienia audio w środowisku.
  • Słuchacza do rejestrowania strumienia audio z otoczenia.
  • Fizycznego urządzenia sprzętowego, takiego jak mikrofon, do rejestrowania wejścia audio.
  • Dla audio 2D - Przewodu do przenoszenia strumienia audio z generatora mowy audio do urządzenia wyjściowego.
  • Dla audio 3D - Dwóch przewodów: jeden do przenoszenia strumienia audio z generatora mowy audio do emitera, a drugi do przenoszenia go z słuchacza do urządzenia wyjściowego.

Jak skonfigurujesz te obiekty, zależy od tego, czy chcesz stworzyć audio TTS 2D czy 3D. Aby uzyskać więcej szczegółów na temat każdego procesu, kliknij między następującymi zakładkami.

Aby pokazać, jak skonfigurować te obiekty audio w Studio dla audio TTS 2D, poniższy diagram porównuje każdy obiekt z ich rzeczywistym odpowiednikiem urządzenia audio. Podsumowując:

  • Obiekt AudioTextToSpeech ładuje i konwertuje ciągi tekstowe na dźwięki mowy.
  • AudioDeviceOutput pozwala graczowi słyszeć dźwięk przez ich głośnik lub słuchawki.
  • Wire łączy się z generatorem mowy audio za pomocą właściwości SourceInstance, a z fizycznym urządzeniem sprzętowym za pomocą właściwości TargetInstance. Działa wtedy jako mostek, aby przenieść strumień audio z generatora mowy audio do urządzenia wyjściowego gracza.

Aby odtwarzać audio tekst na mowę 2D:

  1. W oknie Explorer przejdź do SoundService i wstaw następujące:
    1. Obiekt AudioTextToSpeech, aby utworzyć generator mowy audio.
    2. Obiekt AudioDeviceOutput, aby utworzyć głośnik, który odtwarza dźwięk w całym doświadczeniu.
    3. Obiekt Wire, aby połączyć strumień z generatora mowy audio do głośnika.
  2. W oknie Properties obiektu AudioTextToSpeech:
    1. Ustaw Text na cokolwiek, co chcesz, aby głos powiedział. Istnieje limit 300 znaków na żądanie.
    2. Ustaw VoiceId na numer sztucznego głosu, którego chcesz użyć. Aby uzyskać pełną listę dostępnych głosów, zobacz listę sztucznych głosów.
    3. Ustaw Volume na jednostkę amplitudy, którą chcesz odtwarzać w swoim audio.
  3. W oknie Properties obiektu Wire:
    1. Ustaw SourceInstance na AudioTextToSpeech, aby określić, że chcesz odtwarzać audio w tym konkretnym generatorze mowy audio.
    2. Ustaw TargetInstance na AudioDeviceOutput, aby określić, że chcesz odtwarzać audio z tego konkretnego głośnika.

Stąd możesz uruchomić swoje audio TTS za pomocą skryptów. Aby uzyskać odniesienia do przykładów kodu dla audio TTS, w tym jak skonfigurować TTS kontekstowe, które dostosowuje się w odniesieniu do gracza, stanu ich środowiska lub statusu gry, zobacz samouczek Dodaj tekst na mowę.

Lista sztucznych głosów

VoiceIDOpis głosuPrzykład audio
1Brytyjski mężczyzna
2Brytyjska kobieta
3Amerykański mężczyzna #1
4Amerykańska kobieta #1
5Amerykański mężczyzna #2
6Amerykańska kobieta #2
7Australijski mężczyzna
8Australijska kobieta
9Retro głos #1
10Retro głos #2
11Głos narratora
101Hiszpański mężczyzna
102Hiszpańska kobieta
201Niemiecki mężczyzna
202Niemiecka kobieta
301Włoski mężczyzna
302Włoska kobieta
401Francuski mężczyzna
402Francuska kobieta
501Chiński mężczyzna
502Chińska kobieta
601Hinduski mężczyzna
602Hinduska kobieta
701Japoński mężczyzna
702Japońska kobieta
801Arabski mężczyzna
802Arabska kobieta
901Koreański mężczyzna
902Koreańska kobieta
1001Portugalski mężczyzna
1002Portugalska kobieta

Mowa na tekst

Mowa na tekst (STT) to forma technologii, która automatycznie generuje ciągi tekstowe z dźwięków mowy. Ten typ audio wymaga trzech obiektów audio:

  • Generatora tekstu do ładowania i konwertowania audio na tekst.
  • Fizycznego urządzenia sprzętowego, takiego jak mikrofon, do rejestrowania wejścia audio.
  • Przewodu do przenoszenia strumienia audio z urządzenia wejściowego do generatora tekstu.

Wszystkie te obiekty audio współpracują, aby generować tekst STT w odpowiedzi na działania gracza. Na przykład, jeśli gracz nosi słuchawki podczas grania w doświadczenie na swoim laptopie:

  • AudioDeviceInput rejestruje mowę gracza, jako mówioną do ich mikrofonu i jako strumień audio.
  • Wire przenosi strumień audio z AudioDeviceInput do AudioSpeechToText.
  • AudioSpeechToText konwertuje mowę gracza na tekst.
  • Doświadczenie odczytuje ten tekst i wykonuje akcję, taką jak wyświetlenie mówionego tekstu na ekranie lub otwarcie drzwi na polecenie gracza.

Aby wdrożyć mowę na tekst w swoim doświadczeniu:

  1. Włącz użycie najnowszego API dla głosu.
    1. W oknie Explorer wybierz VoiceChatService.
    2. W oknie Properties ustaw UseAudioApi na Enabled.
  2. W oknie Explorer przejdź do SoundService i wstaw następujące:
    1. Obiekt AudioDeviceInput, aby rejestrować mowę.
    2. Obiekt AudioSpeechToText, aby konwertować mowę na tekst.
    3. Obiekt Wire, aby przenosić strumień z urządzenia wejściowego audio do instancji STT.
  3. W oknie Properties obiektu AudioSpeechToText ustaw stan Enabled na włączony.
  4. W oknie Properties obiektu Wire:
    1. Ustaw SourceInstance na nowy AudioDeviceInput, aby określić, że chcesz, aby przewód przenosił audio z tej konkretnej instancji audio.
    2. Ustaw TargetInstance na nowy AudioSpeechToText, aby określić, że chcesz, aby przewód przenosił audio do tej konkretnej instancji audio.
  5. Ustaw właściwość Player urządzenia wejściowego audio na lokalnego gracza w czasie wykonywania za pomocą audioDeviceInput.Player = game.Players.LocalPlayer. To mówi Robloxowi, z mikrofonu którego użytkownika ma rejestrować audio.

Po skonfigurowaniu STT w swoim doświadczeniu możesz uruchomić go za pomocą skryptów. Aby uzyskać odniesienia do przykładów kodu, zobacz samouczek Dodaj mowę na tekst.

Obsługiwane języki

Nie jest wymagana żadna konfiguracja, aby włączyć obsługiwane języki. Roblox automatycznie wykrywa mówiony język z audio i transkrybuje go.

STT obsługuje następujące języki:

  • Arabski
  • Chiński (uproszczony)
  • Chiński (tradycyjny)
  • Angielski
  • Francuski
  • Niemiecki
  • Indonezyjski
  • Włoski
  • Japoński
  • Koreański
  • Polski
  • Portugalski
  • Hiszpański
  • Rosyjski
  • Turecki
  • Tajski
  • Wietnamski

Filtruj podobne słowa

Gdy wdrażasz STT w swoim doświadczeniu, możesz chcieć poprawić dokładność dopasowania, filtrując słowa, które brzmią podobnie do słów, które naprawdę chcesz, aby gracz powiedział. Aby to zrobić, możesz porównać słowa rozpoznane przez AudioSpeechToText z znanymi listami słów:

  1. Oczyść i podziel wyjście Text z AudioSpeechToText, aby stworzyć tabelę małych liter, które można analizować i porównywać.
    1. Usuń znaki interpunkcyjne.
    2. Przekształć cały ciąg na małe litery.
    3. Podziel ciąg według białych znaków, aby uzyskać tabelę słów.
  2. Wygeneruj tabele kandydatów, aby przygotować swoje ciągi do porównania.
    1. Oczyść i podziel każdy ciąg odniesienia.
    2. Przechowuj te przetworzone słowa w osobnej tabeli.
  3. Porównaj i dopasuj słowa w obu tabelach, aby rozpoznać wejścia mowy, które są bliskie twoim docelowym frazom, nawet jeśli zawierają małe wariacje.
    • Dla prostych sprawdzeń, sprawdź, czy ciągi są dokładnie takie same.
    • Dla bardziej elastycznego dopasowania możesz napisać niestandardową logikę, aby zaakceptować substytucje (jak "colour" zamiast "color") lub dopasować podzbiór słów i obliczyć wynik podobieństwa.

Dostosowywanie audio

Efekty audio pozwalają na nieniszczące modyfikowanie lub wzmacnianie strumieni audio przed dotarciem do uszu gracza. Możesz zastosować te efekty, aby uczynić swoje audio bardziej immersyjnym w doświadczeniach, na przykład używając obiektu AudioEqualizer, aby deszcz brzmiał stłumiony, obiektu AudioCompressor, aby kontrolować maksymalną głośność dźwięku, lub AudioReverb, aby dodać bardziej realistyczne odbicia dźwięku w pomieszczeniach.

Aby uzyskać instrukcje dotyczące konfigurowania efektów audio, a także porównania przed i po dostosowaniu audio, zobacz Efekty audio.

Uruchamianie audio

Możesz uruchomić audio kontekstowo z poziomu skryptu, wywołując Play() na obiekcie AudioPlayer, który jest poprawnie podłączony. Na przykład, jeśli przypiszesz skrypt do odtwarzacza audio, możesz uruchomić zasób audio w coś takiego:

local audio = script.Parent
local something = ...
something.SomeEvent:Connect(function()
audio:Play()
end)

Aby uzyskać bardziej złożone przykłady kodu do uruchamiania audio, takie jak dla informacji zwrotnej w grze, interakcji z interfejsem użytkownika i pętli tła, zobacz samouczki Dodaj audio 2D, Dodaj audio 3D i Dodaj tekst na mowę.

©2026 Roblox Corporation. Nazwa Roblox, logo Roblox oraz hasło „Powering Imagination” należą do naszych zarejestrowanych i niezarejestrowanych znaków towarowych na terenie Stanów Zjednoczonych oraz w innych krajach.