---
title: "Funciones de VoxisLive — Traducción de voz sin drivers"
description: "Descubre todas las funciones: captura WASAPI sin drivers, 79 idiomas, modo de reunión bidireccional, transcripción bilingüe y subtítulos en pantalla."
url: https://voxislive.com/es/features
language: "es"
source_html: https://voxislive.com/es/features
site: "Voxis — real-time voice translation"
og_image: https://voxislive.com/assets/og.png
generated_by: voxislive-markdown-pipeline
---

[Inicio](https://voxislive.com/es/) · / · Funciones

FUNCIONES

# Todo lo que hace VoxisLive, en detalle.

VoxisLive es una app de Windows y Linux que convierte cualquier audio del sistema en una voz natural en tu idioma, unos pocos segundos por detrás del orador. Aquí tienes explicada cada función principal.

## Captura del audio del sistema sin drivers

VoxisLive lee la mezcla de audio de tu Windows directamente mediante **process-loopback WASAPI**, la misma API de sesión de audio de Windows de bajo nivel que usan los grabadores de pantalla para capturar lo que está sonando. No hay VB-CABLE, ni dispositivo de sonido virtual, ni nada que enrutar. Instala la app y escucha lo que tú escuchas, de inmediato, en Windows 10 y 11.

La captura también **excluye la propia salida de VoxisLive**, así que la app nunca traduce su propia voz, ni siquiera en una conversación bidireccional.

## 79 idiomas, intercambiables a mitad de sesión

Elige qué escuchas y qué hablas entre 79 idiomas, e intercambia el par en un clic sin detener la sesión. La detección automática del idioma de origen se encarga del audio multilingüe.

## Modo de reunión bidireccional

El modo de reunión ejecuta dos sesiones en vivo a la vez: la otra parte se traduce a tu idioma por tus altavoces, y tu propia voz se traduce al suyo y se inyecta a través de un **micrófono virtual**. Funciona junto a Teams, Zoom, Meet, Webex y Discord, y ningún bot aparece jamás en la lista de participantes.

![El modo de reunión de VoxisLive traduciendo en ambos sentidos con el tema claro](https://voxislive.com/assets/shot-app-light.png?v=1081)

## Un intérprete simultáneo nativo, no un pipeline

La voz va a un modelo multimodal en tiempo real que reconoce, traduce y vuelve a pronunciar en una sola pasada de baja latencia, igual que trabaja un intérprete humano en cabina. Empieza a traducir mientras el orador todavía está hablando y se mantiene aproximadamente **unos pocos segundos por detrás**.

## Atenuación psicoacústica

Mientras habla la voz traducida, el audio original baja automáticamente — igual que en la interpretación simultánea profesional — y se restaura cuando termina la frase. Siempre sabes quién está hablando.

## Transcripción bilingüe en vivo y exportación

Cada sesión genera una transcripción con búsqueda: la frase original queda justo encima de su traducción. Se guarda sola al pulsar **Detener**, y la exportas como **TXT, SRT o VTT** desde **Historial de traducciones**.

## Subtítulos en pantalla, si los quieres

Una superposición de subtítulos opcional, siempre visible, flota sobre cualquier app o juego con una sola línea: la traducción, con etiquetas S1/S2 cuando cambia el hablante. La vista bilingüe — la frase de origen justo encima de su traducción — vive en el **Flujo de traducción** de la propia app. La voz hablada es el producto; los subtítulos están ahí cuando necesitas un registro.

![VoxisLive traduciendo un video con una transcripción bilingüe en vivo](https://voxislive.com/assets/shot-app-dark-es.png?v=1081)

## Privado por diseño

VoxisLive nunca se une a tu llamada como participante y no es un bot de navegador. La detección de actividad de voz, el etiquetado de cambio de hablante y la voz local del plan gratuito se ejecutan en tu propia CPU. **En los planes de pago, el audio capturado se transmite de forma continua al modelo de traducción mientras la sesión está activa**; en el plan gratuito el flujo está filtrado, de modo que solo se envía la voz detectada. No se conserva ningún audio tras la sesión. El pipeline completo de captura a reproducción se publica como un extracto de código disponible en GitHub, para que puedas verificar exactamente qué sale de tu equipo.

## Disponible como código fuente

El pipeline de audio del motor de escritorio se publica en [GitHub](https://github.com/VoxisLive/voxislive) como un extracto de código disponible — audita exactamente cómo funcionan la captura, la traducción y la reproducción. Consigue la app completa desde la Microsoft Store con minutos prepagados y cero configuración.

¿Lo estás comparando con otras herramientas? Mantenemos una comparativa actualizada de los [traductores de voz en tiempo real para Windows](https://voxislive.com/es/best-real-time-voice-translation-apps), incluyendo en qué casos otro es mejor opción.

FAQ

## Preguntas frecuentes

### ¿VoxisLive necesita un cable de audio virtual?

No para capturar. VoxisLive usa process-loopback WASAPI sin drivers, integrado en Windows 10 y 11: no hay VB-CABLE, driver de audio virtual ni utilidad de enrutamiento que instalar para capturar el audio de tu PC, y tu configuración de audio queda intacta. La excepción es el modo Reunión bidireccional: en Windows envía tu voz traducida a través de un cable de audio virtual como VB-CABLE y no se inicia sin uno; en Linux, la app crea su propio micrófono virtual.

### ¿La traducción es hablada o son subtítulos?

Es hablada. VoxisLive ofrece traducción de voz a voz en tiempo real con una voz natural. También hay disponibles una transcripción bilingüe en vivo y una superposición de subtítulos opcional en pantalla, exportables como TXT, SRT o VTT.

### ¿Cuánto va por detrás del orador la traducción?

Unos pocos segundos, según la longitud de la frase y la latencia de red. El modelo empieza a traducir mientras el orador todavía está hablando, en lugar de esperar a que termine la frase.

### ¿Con qué apps funciona?

Cualquier cosa que reproduzca audio en Windows: navegadores, reproductores de escritorio, juegos y apps de videollamadas como Teams, Zoom, Meet, Webex o Discord. La captura ocurre en la capa de audio del sistema operativo, así que la app de origen es irrelevante.

## Sigue leyendo

[Cómo funciona · El pipeline completo: captura por loopback WASAPI, detección de voz en el dispositivo, un modelo de IA de…](https://voxislive.com/es/how-it-works) · [Casos de uso · Un solo pipeline sin drivers para cualquier fuente: traduce audio de juegos, llamadas de Zoom/Teams/Meet, video de…](https://voxislive.com/es/use-cases) · [Idiomas · VoxisLive traduce 79 idiomas en tiempo real. Los planes de pago hablan los 79; el plan gratuito habla 35 y muestra…](https://voxislive.com/es/languages)
[Traducción de voz a voz](https://voxislive.com/es/speech-to-speech-translation) · [Registro de cambios · Todas las versiones de Voxis, una por una: qué se corrigió y qué se añadió, en lenguaje claro.](https://voxislive.com/es/changelog)

Pruébalo gratis · 10 minutos gratis cada día

## Escucha todos los idiomas, en tiempo real.

Funciona en Windows 10 y 11 y en Linux: captura sin drivers, sin rituales de configuración y sin bots en tu llamada.

[Consíguelo en Microsoft Store](https://apps.microsoft.com/store/detail/9P5Z0KVS58RS?cid=DevShareMCLPCB)
[Linux · Snap Store](https://snapcraft.io/voxis)
[Ver en GitHub](https://github.com/VoxisLive/voxislive)


## Structured data (JSON-LD)

```json
{
  "@context": "https://schema.org",
  "@graph": [
    {
      "@type": "BreadcrumbList",
      "itemListElement": [
        {
          "@type": "ListItem",
          "position": 1,
          "name": "Inicio",
          "item": "https://voxislive.com/es/"
        },
        {
          "@type": "ListItem",
          "position": 2,
          "name": "Funciones",
          "item": "https://voxislive.com/es/features"
        }
      ]
    },
    {
      "@type": "WebPage",
      "name": "Funciones de VoxisLive — Traducción de voz sin drivers",
      "url": "https://voxislive.com/es/features",
      "description": "Descubre todas las funciones: captura WASAPI sin drivers, 79 idiomas, modo de reunión bidireccional, transcripción bilingüe y subtítulos en pantalla.",
      "inLanguage": "es",
      "dateModified": "2026-07-13",
      "isPartOf": {
        "@type": "WebSite",
        "name": "VoxisLive",
        "url": "https://voxislive.com/"
      }
    },
    {
      "@type": "FAQPage",
      "mainEntity": [
        {
          "@type": "Question",
          "name": "¿VoxisLive necesita un cable de audio virtual?",
          "acceptedAnswer": {
            "@type": "Answer",
            "text": "No para capturar. VoxisLive usa process-loopback WASAPI sin drivers, integrado en Windows 10 y 11: no hay VB-CABLE, driver de audio virtual ni utilidad de enrutamiento que instalar para capturar el audio de tu PC, y tu configuración de audio queda intacta. La excepción es el modo Reunión bidireccional: en Windows envía tu voz traducida a través de un cable de audio virtual como VB-CABLE y no se inicia sin uno; en Linux, la app crea su propio micrófono virtual."
          }
        },
        {
          "@type": "Question",
          "name": "¿La traducción es hablada o son subtítulos?",
          "acceptedAnswer": {
            "@type": "Answer",
            "text": "Es hablada. VoxisLive ofrece traducción de voz a voz en tiempo real con una voz natural. También hay disponibles una transcripción bilingüe en vivo y una superposición de subtítulos opcional en pantalla, exportables como TXT, SRT o VTT."
          }
        },
        {
          "@type": "Question",
          "name": "¿Cuánto va por detrás del orador la traducción?",
          "acceptedAnswer": {
            "@type": "Answer",
            "text": "Unos pocos segundos, según la longitud de la frase y la latencia de red. El modelo empieza a traducir mientras el orador todavía está hablando, en lugar de esperar a que termine la frase."
          }
        },
        {
          "@type": "Question",
          "name": "¿Con qué apps funciona?",
          "acceptedAnswer": {
            "@type": "Answer",
            "text": "Cualquier cosa que reproduzca audio en Windows: navegadores, reproductores de escritorio, juegos y apps de videollamadas como Teams, Zoom, Meet, Webex o Discord. La captura ocurre en la capa de audio del sistema operativo, así que la app de origen es irrelevante."
          }
        }
      ]
    }
  ]
}
```
