Objetos de audio

*Este contenido se traduce usando la IA (Beta) y puede contener errores. Para ver esta página en inglés, haz clic en aquí.

Los objetos de audio modulares de Roblox te permiten tener un control dinámico sobre el sonido y el chat de voz en tus experiencias. Casi cada objeto de audio corresponde a un dispositivo de audio del mundo real, y todos funcionan juntos para capturar y reproducir audio como sus contrapartes físicas.

Por ejemplo, cada objeto de audio conceptualmente cae en las siguientes categorías:

  • Objetos que producen flujos de audio, como los reproductores de audio.
  • Objetos que consumen flujos de audio, como los emisores de audio.
  • Objetos que modifican flujos de audio, como los efectos de audio.
  • Objetos que transportan flujos de audio de un objeto de audio a otro, como los cables.

A medida que leas esta guía y aprendas cómo todos estos objetos de audio trabajan juntos para emitir sonido, aprenderás cómo capturar y alimentar con precisión música, efectos de sonido y la voz humana desde la experiencia hacia el jugador y viceversa.

Reproducir audio

Para reproducir audio dentro de tu experiencia, es importante entender el papel de cada objeto de audio disponible:

  • Un AudioPlayer carga y reproduce el archivo de audio utilizando un ID de activo de audio establecido.
  • Un AudioEmitter es un altavoz virtual que emite audio en el entorno 3D.
  • Un AudioListener es un micrófono virtual que recoge audio del entorno 3D.
  • Un AudioDeviceOutput es un dispositivo de hardware físico en el mundo real, como un altavoz o auriculares.
  • Un AudioDeviceInput es un micrófono físico en el mundo real.
  • El objeto AudioTextToSpeech convierte texto en audio utilizando una voz humana artificial.
  • El objeto AudioSpeechToText convierte audio hablado en texto.
  • Un Wire transporta flujos de audio de un objeto de audio a otro.

Cómo emparejas estos objetos de audio depende de si deseas emitir audio directamente al altavoz o auriculares del jugador o desde objetos en el espacio 3D. Las siguientes secciones detallan ambos escenarios.

Audio 2D

El audio 2D es sonido no direccional que se reproduce desde ninguna ubicación en particular, manteniéndose al mismo volumen independientemente de la posición o la orientación del jugador en el espacio 3D. Este tipo de audio requiere tres objetos de audio:

  • Un reproductor de audio para producir un flujo de audio.
  • Un dispositivo de hardware físico para reproducir el flujo de audio en el mundo real.
  • Un cable para transportar el flujo de audio desde el reproductor de audio hasta el dispositivo de salida.

Para demostrar cómo configurar estos objetos de audio en Studio para audio 2D, el siguiente diagrama compara cada objeto con su contraparte de dispositivo de audio del mundo real. En resumen:

  • El AudioPlayer carga y reproduce tu activo de audio con configuraciones especificadas.
  • El AudioDeviceOutput permite al jugador escuchar el audio a través de su altavoz o auriculares.
  • El Wire se conecta al reproductor de audio con su propiedad SourceInstance, y al dispositivo de hardware físico con su propiedad TargetInstance. Luego actúa como un puente para transportar el flujo de audio desde el reproductor de audio hasta el dispositivo de salida del jugador.

Para reproducir audio no direccional:

  1. En la ventana de Explorer, ve a SoundService e inserta lo siguiente:
    1. Un objeto AudioPlayer para crear una fuente de audio.
    2. Un objeto AudioDeviceOutput para crear un altavoz que reproduzca a lo largo de la experiencia.
    3. Un objeto Wire para conectar el flujo desde el reproductor de audio hasta el altavoz.
  2. En la ventana de Properties del objeto AudioPlayer:
    1. Establece AssetID a un ID de activo de audio válido. Si no tienes tu propio audio personalizado, puedes encontrar activos de audio de uso gratuito en la Creator Store.
    2. Habilita Looping si deseas que tu audio se repita continuamente.
    3. Establece Volume a la unidad de amplitud que deseas para reproducir tu audio.
  3. En la ventana de Properties del objeto Wire:
    1. Establece SourceInstance al AudioPlayer para especificar que deseas reproducir el audio dentro de este reproductor de audio específico.
    2. Establece TargetInstance al AudioDeviceOutput para especificar que deseas reproducir el audio desde este altavoz específico.

A partir de aquí, puedes activar tu audio no direccional con scripts para reproducirlo cuando los jugadores se unan a la experiencia o como resultado de un evento de juego o interacción de la interfaz de usuario. Para referencias de ejemplos de código para estos casos de uso, consulta el tutorial Agregar audio 2D.

Audio 3D

El audio 3D es sonido direccional que se reproduce desde una ubicación particular en el espacio 3D, aumentando o disminuyendo en volumen dependiendo de la posición y orientación del jugador con respecto al sonido. Este tipo de audio requiere seis objetos de audio:

  • Un reproductor de audio para producir un flujo de audio.
  • Un emisor de audio para emitir el flujo de audio dentro del entorno.
  • Un oyente para recoger el flujo de audio del entorno.
  • Un dispositivo de hardware físico para reproducir el flujo de audio en el mundo real.
  • Dos cables: uno para transportar el flujo de audio desde el reproductor de audio hasta el emisor, y otro para transportarlo desde el oyente hasta el dispositivo de salida.

Para demostrar cómo configurar estos objetos de audio en Studio para audio 3D, el siguiente diagrama compara cada objeto con su contraparte de dispositivo de audio del mundo real. En resumen:

  • El AudioPlayer carga y reproduce tu activo de audio con configuraciones especificadas.
  • La posición del padre del AudioEmitter en el espacio 3D determina dónde se emite ese audio dentro del entorno.
  • El AudioListener recoge audio del emisor desde la cámara local o dentro de la Humanoid.RootPart del personaje del jugador, dependiendo de dónde establezcas la posición predeterminada del oyente.
  • El AudioDeviceOutput permite al jugador escuchar el audio a través de su altavoz o auriculares.
  • El primer Wire se conecta al reproductor de audio con su propiedad SourceInstance, y al emisor con su propiedad TargetInstance. Luego actúa como un puente para transportar el flujo de audio desde el reproductor de audio hasta el emisor.
  • El segundo Wire se conecta al oyente con su propiedad SourceInstance, y al dispositivo de hardware físico con su propiedad TargetInstance. Luego actúa como un puente para transportar el flujo de audio desde el oyente hasta el dispositivo de salida del jugador.

Para reproducir audio posicional:

  1. Elige dónde deseas crear un AudioListener cuando los jugadores aparezcan en la experiencia.

    1. En la ventana de Explorer, selecciona SoundService.
    2. En la ventana de Properties, establece ListenerLocation a uno de los siguientes:
      • Default - Crea y asigna el oyente a Workspace.CurrentCamera en experiencias que habilitan el chat de voz.
      • None - No crea un oyente. Esta opción es útil si deseas crear un oyente a través de un script.
      • Character - Crea y asigna un oyente al personaje del jugador local.
      • Camera - Crea y asigna el oyente a Workspace.CurrentCamera.
  2. En la ventana de Explorer, ve al objeto 3D desde el cual deseas emitir audio e inserta lo siguiente:

    1. Un objeto AudioPlayer para crear una fuente de audio.
    2. Un objeto AudioEmitter para emitir un flujo posicional desde el objeto 3D.
    3. Un objeto Wire para conectar el flujo desde el generador de audio hasta el emisor de audio.
  3. En la ventana de Properties del objeto AudioPlayer:

    1. Establece AssetID a un ID de activo de audio válido. Si no tienes tu propio audio personalizado, puedes encontrar activos de audio de uso gratuito en la Creator Store.
    2. Habilita Looping si deseas que tu audio se repita continuamente.
    3. Establece Volume a la unidad de amplitud que deseas para reproducir tu audio.
  4. En la ventana de Properties del objeto AudioEmitter, establece DistanceAttenuation a una curva de volumen sobre distancia que determina cuán fuerte escucha el oyente al emisor según la distancia entre ellos.

    Por ejemplo, la siguiente curva disminuye el volumen del audio a la mitad cuando el oyente está a 50 studs del emisor, luego disminuye bruscamente el volumen a cero cuando el oyente está a 70 studs de distancia.

  5. En la ventana de Properties del objeto Wire:

    1. Establece SourceInstance al AudioPlayer para especificar que deseas reproducir el audio dentro de este reproductor de audio específico.
    2. Establece TargetInstance al AudioEmitter para especificar que deseas reproducir el audio desde este emisor de audio específico.

A partir de aquí, puedes activar tu audio direccional con scripts para reproducirlo cuando los jugadores se unan a la experiencia o como resultado de un evento de juego o interacción de la interfaz de usuario. Para referencias de ejemplos de código para estos casos de uso, consulta el tutorial Agregar audio 3D.

Texto a voz

Texto a voz (TTS) es una forma de tecnología asistencial que convierte cadenas de texto en sonidos de voz utilizando una voz artificial. Este tipo de audio requiere cinco objetos de audio:

  • Un generador de voz de audio para cargar y convertir texto en audio.
  • Un emisor de audio para emitir el flujo de audio dentro del entorno.
  • Un oyente para recoger el flujo de audio del entorno.
  • Un dispositivo de hardware físico para reproducir el flujo de audio en el mundo real.
  • Para audio 2D - Un cable para transportar el flujo de audio desde el generador de voz de audio hasta el dispositivo de salida.
  • Para audio 3D - Dos cables: uno para transportar el flujo de audio desde el generador de voz de audio hasta el emisor, y otro para transportarlo desde el oyente hasta el dispositivo de salida.

Cómo configuras estos objetos depende de si deseas crear audio TTS 2D o audio TTS 3D. Para más detalles sobre cualquiera de los procesos, haz clic entre las siguientes pestañas.

Para demostrar cómo configurar estos objetos de audio en Studio para audio TTS 2D, el siguiente diagrama compara cada objeto con su contraparte de dispositivo de audio del mundo real. En resumen:

  • El objeto AudioTextToSpeech carga y convierte cadenas de texto en sonidos de voz.
  • El AudioDeviceOutput permite al jugador escuchar el audio a través de su altavoz o auriculares.
  • El Wire se conecta al generador de voz de audio con su propiedad SourceInstance, y al dispositivo de hardware físico con su propiedad TargetInstance. Luego actúa como un puente para transportar el flujo de audio desde el generador de voz de audio hasta el dispositivo de salida del jugador.

Para reproducir audio de texto a voz 2D:

  1. En la ventana de Explorer, ve a SoundService e inserta lo siguiente:
    1. Un objeto AudioTextToSpeech para crear un generador de voz de audio.
    2. Un objeto AudioDeviceOutput para crear un altavoz que reproduzca a lo largo de la experiencia.
    3. Un objeto Wire para conectar el flujo desde el generador de voz de audio hasta el altavoz.
  2. En la ventana de Properties del objeto AudioTextToSpeech:
    1. Establece Text a cualquier cosa que desees que la voz diga. Hay un límite de 300 caracteres por solicitud.
    2. Establece VoiceId al número de la voz artificial que deseas usar. Para una lista completa de voces disponibles, consulta la lista de voces artificiales.
    3. Establece Volume a la unidad de amplitud que deseas para reproducir tu audio.
  3. En la ventana de Properties del objeto Wire:
    1. Establece SourceInstance al AudioTextToSpeech para especificar que deseas reproducir el audio dentro de este generador de voz de audio específico.
    2. Establece TargetInstance al AudioDeviceOutput para especificar que deseas reproducir el audio desde este altavoz específico.

A partir de aquí, puedes activar tu audio TTS con scripts. Para referencias de ejemplos de código para audio TTS, incluyendo cómo configurar TTS consciente del contexto que se adapta en relación con el jugador, el estado de su entorno o el estado del juego, consulta el tutorial Agregar texto a voz.

Lista de voces artificiales

VoiceIDDescripción de la vozEjemplo de audio
1Masculino británico
2Femenino británico
3Masculino de Estados Unidos #1
4Femenino de Estados Unidos #1
5Masculino de Estados Unidos #2
6Femenino de Estados Unidos #2
7Masculino australiano
8Femenino australiano
9Voz retro #1
10Voz retro #2
11Voz de narrador
101Masculino español
102Femenino español
201Masculino alemán
202Femenino alemán
301Masculino italiano
302Femenino italiana
401Masculino francés
402Femenino francés
501Masculino chino (mandarín)
502Femenino chino (mandarín)
601Masculino hindi
602Femenino hindi
701Masculino japonés
702Femenino japonés
801Masculino árabe
802Femenino árabe
901Masculino coreano
902Femenino coreano
1001Masculino portugués
1002Femenino portugués

Voz a texto

Voz a texto (STT) es una forma de tecnología que genera automáticamente cadenas de texto a partir de sonidos de voz. Este tipo de audio requiere tres objetos de audio:

  • Un generador de texto para cargar y convertir audio en texto.
  • Un dispositivo de hardware físico como un micrófono para capturar la entrada de audio.
  • Un cable para transportar el flujo de audio desde el dispositivo de entrada hasta el generador de texto.

Todos estos objetos de audio trabajan juntos para generar texto STT en respuesta a las acciones del jugador. Por ejemplo, si el jugador está usando un auricular mientras juega una experiencia con su computadora portátil:

  • El AudioDeviceInput captura el habla del jugador, como se habla en su micrófono y como un flujo de audio.
  • Un Wire transporta el flujo de audio desde el AudioDeviceInput hasta el AudioSpeechToText.
  • El AudioSpeechToText convierte el habla del jugador en texto.
  • La experiencia lee este texto y realiza una acción, como mostrar el texto hablado en la pantalla o abrir una puerta a pedido del jugador.

Para implementar voz a texto en tu experiencia:

  1. Habilita el uso de la última API para voz.
    1. En la ventana de Explorer, selecciona el VoiceChatService.
    2. En la ventana de Properties, establece UseAudioApi a Enabled.
  2. En la ventana de Explorer, ve a SoundService e inserta lo siguiente:
    1. Un AudioDeviceInput para capturar el habla.
    2. Un AudioSpeechToText para convertir el habla en texto.
    3. Un Wire para transportar el flujo desde el dispositivo de entrada de audio hasta la instancia STT.
  3. En la ventana de Properties del objeto AudioSpeechToText, establece el estado Enabled en activado.
  4. En la ventana de Properties del objeto Wire:
    1. Establece SourceInstance a tu nuevo AudioDeviceInput para especificar que deseas que el cable transporte audio desde esta instancia de audio específica.
    2. Establece TargetInstance a tu nuevo AudioSpeechToText para especificar que deseas que el cable transporte audio hacia esta instancia de audio específica.
  5. Establece la propiedad Player del dispositivo de entrada de audio al jugador local en tiempo de ejecución con audioDeviceInput.Player = game.Players.LocalPlayer. Esto le dice a Roblox de qué usuario capturar audio desde el micrófono.

Después de configurar STT en tu experiencia, puedes activarlo con scripts. Para referencias de ejemplos de código, consulta el tutorial Agregar voz a texto.

Idiomas soportados

No se requiere configuración para habilitar idiomas soportados. Roblox detecta automáticamente el idioma hablado a partir del audio y lo transcribe.

STT soporta los siguientes idiomas:

  • Árabe
  • Chino (simplificado)
  • Chino (tradicional)
  • Inglés
  • Francés
  • Alemán
  • Indonesio
  • Italiano
  • Japonés
  • Coreano
  • Polaco
  • Portugués
  • Español
  • Ruso
  • Turco
  • Tailandés
  • Vietnamita

Filtrar palabras similares

Cuando implementas STT en tu experiencia, es posible que desees mejorar la precisión de coincidencia filtrando palabras que suenan similares a las palabras que realmente deseas que el jugador diga. Para hacer esto, puedes comparar las palabras reconocidas por AudioSpeechToText con listas de palabras conocidas:

  1. Sanea y tokeniza la salida Text de AudioSpeechToText para crear una tabla de cadenas en minúsculas que se puedan analizar y comparar.
    1. Elimina caracteres de puntuación.
    2. Convierte toda la cadena a minúsculas.
    3. Divide la cadena por espacios en blanco para producir una tabla de palabras.
  2. Genera tablas de candidatos para preparar tus cadenas para la comparación.
    1. Sanea y tokeniza cada cadena de referencia.
    2. Almacena estas palabras procesadas en una tabla separada.
  3. Compara y empareja las palabras en ambas tablas para reconocer las entradas de voz que están cerca de tus frases objetivo, incluso si incluyen pequeñas variaciones.
    • Para verificaciones simples, verifica si las cadenas son exactamente las mismas.
    • Para coincidencias más flexibles, puedes escribir lógica personalizada para aceptar sustituciones (como "colour" en lugar de "color") o emparejar un subconjunto de palabras y calcular un puntaje de similitud.

Personalizar audio

Los efectos de audio te permiten modificar o mejorar de manera no destructiva los flujos de audio antes de que lleguen a los oídos de un jugador. Puedes aplicar estos efectos para hacer que tu audio sea más inmersivo dentro de las experiencias, como usar un objeto AudioEqualizer para hacer que la lluvia suene apagada, un objeto AudioCompressor para controlar el volumen máximo de un sonido, o AudioReverb para agregar reflexiones de sonido más realistas en espacios interiores.

Para instrucciones sobre cómo configurar efectos de audio, así como comparaciones lado a lado de antes y después de personalizar tu audio, consulta Efectos de audio.

Activar audio

Puedes activar audio contextual desde un script llamando a Play() en un objeto AudioPlayer que esté correctamente cableado. Por ejemplo, si asignas un script a un reproductor de audio, puedes activar el activo de audio a través de algo como esto:

local audio = script.Parent
local something = ...
something.SomeEvent:Connect(function()
audio:Play()
end)

Para ejemplos de código más complejos para activar audio, como para retroalimentación de juego, interacciones de la interfaz de usuario y ruido de fondo en bucle, consulta los tutoriales Agregar audio 2D, Agregar audio 3D y Agregar texto a voz.

©2026 Roblox Corporation. Roblox, el logotipo de Roblox y "Powering Imagination" son algunas de nuestras marcas registradas y no registradas en los Estados Unidos y otros países.