Qué hace cada herramienta de transcripción con tu audio
Comparativa de nueve transcriptores online: dónde se procesa el archivo, qué guardan y cuánto tiempo, si exigen registro, qué incluye el plan gratis y cuánto cuestan. Con la fuente de cada dato y los huecos marcados.
Transcribo 26 min de lectura
Cuando buscas un transcriptor online, todas las webs te prometen lo mismo: rápido, preciso, gratis. Ninguna te dice en la portada lo único que de verdad cambia entre unas y otras: qué le pasa a tu archivo después de que pulses «subir».
Y no es una pregunta menor. Esa grabación puede ser una reunión con datos de clientes, una entrevista con una fuente, una consulta médica o la nota de voz de tu pareja. En el momento en que sale de tu ordenador, deja de ser tuya y pasa a estar sujeta a la política de retención de un tercero, a sus subencargados y a la legislación del país donde estén sus servidores.
Esta comparativa responde a esa pregunta, herramienta por herramienta, con la fuente delante.
Datos comprobados el 17 de agosto de 2026 en las webs oficiales de cada herramienta. Donde una empresa no publica un dato, la celda lo dice en lugar de inventárselo. Al final tienes la metodología y todas las fuentes.
La tabla
| Herramienta | Dónde se procesa el audio | Qué guarda y cuánto tiempo | ¿Exige registro? | Plan gratuito | Precio de entrada |
|---|---|---|---|---|---|
| Transcribo | En tu navegador, con Whisper. El archivo no se sube | Nada. No hay servidor donde guardarlo | No | Sin límite de minutos ni de archivos | 0 € |
| audiototext.com | Nube. Servidores en EE. UU. Operado por Textintel FZE (Dubái) | «Se borran automáticamente al completar la transcripción». Sin plazo numérico. Entrenamiento de IA: no especificado | No para transcribir. Sí (suscripción activa) para descargar el texto | Hasta 3 GB por archivo. Límite diario no publicado. Su app promociona «romper la barrera de 30 minutos» | No publicado: su página de precios devuelve error 404 |
| Descript | Nube. Servidores en EE. UU. Almacena en Amazon S3 o Google Cloud y usa a Rev como subencargado de la transcripción automática | Los proyectos borrados se eliminan «en un plazo de 30 días». Las huellas de voz, hasta 3 años tras el último acceso. Compartir tu contenido para mejorar el servicio viene desactivado por defecto | Sí | 60 minutos al mes. Exportación de vídeo a 720p; la exportación sin marca de agua figura como función de pago | 24 $/mes con pago mensual; 16 $/mes con pago anual |
| Monica | Nube. Servidores en EE. UU. Comparte tu contenido con proveedores de IA de terceros que, según sus propios términos, pueden no estar obligados a mantener la confidencialidad | No fija plazo. Sus términos se reservan una licencia perpetua e irrevocable para usar tu contenido de forma agregada y mejorar el servicio | Sí. Sale un muro de registro antes incluso de dejarte elegir el archivo | 30 minutos de regalo, una sola vez, para usuarios nuevos. Máximo 50 MB por archivo | Pro: 9,9 $/mes con pago mensual; 99 $/año con pago anual |
| Notta | Nube. AWS, centro de datos en Tokio. Tiene un «modo privacidad» local, solo en la app de escritorio y de plan Pro en adelante | Retención permanente por defecto. Papelera: 30 días. El borrado automático es solo para Enterprise. Entrenamiento de IA: no especificado | Sí en la web. La app móvil tiene modo invitado | 120 min/mes, máximo 3 minutos por conversación, 50 subidas/mes | 11,69 €/mes con pago mensual; 7 €/mes con pago anual (83,99 €/año) |
| Otter.ai | Nube. AWS, región oeste de EE. UU. | Mientras sea necesario, sin plazo. Papelera: 30 días. Entrena su IA con grabaciones desidentificadas y con transcripciones; no documentan forma de negarse | Sí, con verificación de email obligatoria | 300 min/mes, máximo 30 min por conversación, 3 importaciones de archivo de por vida, historial de 25 conversaciones | 16,99 $/usuario/mes con pago mensual; 8,33 $ con pago anual |
| Rev | Nube, exclusivamente en EE. UU. Si contratas transcripción humana, transcriptores acceden a tus archivos | Sin plazo publicado. Entrena sus modelos de reconocimiento de voz con contenido de clientes (dice que no para IA generativa). Negarse solo en Enterprise y Unlimited | Sí | 45 min/mes de transcripción con IA, solo en inglés | 29,99 $/asiento/mes con pago mensual; 25,49 $ con pago anual. Sin suscripción: 0,25 $/min con IA, 1,99 $/min con humano |
| Transkriptor | Nube. Dice alojar todo en la UE. Subencargados: AWS, Google Cloud, Stripe. Su contrato se rige por la ley de Dubái. Operado por Textintel FZE | Ventana de borrado que eliges tú, de 1 minuto a 1 año. Declara que no entrena IA con tu contenido | Sí | 30 min/día y 1 transcripción/día. Su página de precios menciona además una opción «Free – 90 Minutes» | 9,99 $/mes (Lite) con pago mensual; Pro 19,99 $/mes o 8,33 $/mes con pago anual |
| Vidnoz | No especificado: su política no menciona dónde están los servidores. Como referencia, sus condiciones se rigen por la ley de Hong Kong, que es la ley aplicable, no la ubicación de los datos | No fija plazo por defecto. Solo dice que borrarán los datos «en 72 horas previa solicitud», y la herramienta habla de borrado «tras cierto tiempo», sin cifra. Entrenamiento de IA: no especificado | Para subir, no. Para descargar la transcripción, sí | Máximo 200 MB y 30 minutos por archivo, y un límite diario de usos cuya cifra no publican | El plan que cubre audio a texto (Vidnoz Voice Basic): 8,99 $/mes con pago mensual; 6,74 $/mes con pago anual |
Ficha por herramienta
Aquí va el detalle, con la frase textual de cada empresa. Está en inglés porque así es como lo publican ellas.
Notta
Notta aloja su software en Amazon Web Services y su centro de datos está en Tokio: «Notta use Amazon Web Services (AWS) as our data center. (…) Your data is stored in a data center located in Tokyo». Tiene un modo local, pero con dos condiciones importantes: solo en la aplicación de escritorio y solo de plan Pro en adelante.
El dato que más sorprende está en su centro de ayuda: la retención es permanente. Su tabla lo dice con esas palabras, «Data retention: Permanent retention», y añade que «if you cancel your subscription and revert to a free user, your existing transcription data will not be changed or deleted». El borrado automático programado figura como función «available for Enterprise plan users only». Lo que va a la papelera sí se elimina: «Items in Trash will be permanently deleted after 30 days».
Su política de privacidad no fija ningún plazo de conservación y no dice nada sobre si usan tu audio para entrenar modelos. Conviene no ir más allá de eso: no hemos encontrado ninguna afirmación de que Notta entrene con tus grabaciones, ni tampoco un compromiso de que no lo haga, salvo que la ausencia de entrenamiento aparece listada como característica del plan Enterprise («No data training»).
El plan gratuito tiene un límite que lo hace poco útil para lo que suele hacer falta: 120 minutos al mes, pero con un máximo de 3 minutos por conversación.
Otter.ai
Otter es explícito sobre dónde vive tu audio: «Otter uses AWS services for its data storage in the AWS region West, United States». Su política de privacidad lo repite: «Cloud service providers who we rely on for compute and data storage, including Amazon Web Services, based in the United States».
Y es de las pocas que dice con todas las letras qué hace con tus grabaciones. Entre los usos declarados de tus datos está: «Improve and monitor the Services, including training our proprietary AI technology on de-identified audio recordings and on transcriptions (which may contain Personal Information)». También menciona a «data labeling service providers who provide annotation services and use the data we share to create training and evaluation data».
Hay que reconocerle la transparencia: lo dice. Lo que no encontramos en su política es una forma de negarse. Los derechos de exclusión que documenta se refieren a la «venta» de datos y a la publicidad segmentada, no al entrenamiento.
Sobre plazos, la fórmula es la habitual: «Otter.ai stores all Personal Information for as long as necessary to fulfill the purposes set out in this Policy». Sin número. Lo que borras va a la papelera y desaparece a los 30 días.
El plan gratuito engaña un poco si solo miras el titular de 300 minutos: los archivos que subes desde tu ordenador están limitados a 3 importaciones de por vida.
Rev
Rev es la más estricta con la localización: «Rev enforces data sovereignty policies to ensure that all customer data is processed and stored within the United States». Si eso te sirve o te estorba depende de dónde estés tú.
Es también la única de la lista donde personas pueden escuchar tu grabación, porque vende transcripción humana: «If you request human transcription services, Rev’s professional transcribers (“Revvers”) will be able to access your files as they work with them».
El asunto del entrenamiento merece leerse entero, porque Rev dice cosas distintas en páginas distintas. Sus términos: «your Customer Content will be analyzed by our ASR models and other Rev artificial intelligence models and may be used for continuous training of those models. (…) Customer Content will not be used for any generative AI model training». Su centro de ayuda, en un sitio: «Do you use my audio and transcription files to train your service? Yes», y describe su corpus como «real voices that are submitted for transcription». En esa misma página, unos párrafos antes: «Does Rev use customer data to train AI models or large language models (LLMs)? No». La lectura que concilia ambas es la de los términos: sí para reconocimiento de voz, no para IA generativa. Negarse es posible, pero solo en los planes Enterprise y Unlimited.
Retención: «We will retain personal data for the period necessary to fulfill the purposes outlined in this Privacy Policy». Sin número, otra vez.
Su plan gratuito son 45 minutos al mes y solo en inglés, lo que lo deja fuera de juego para el mercado hispanohablante.
Descript
Descript lo dice en una frase: «Descript is based in the United States and we process and store information in the U.S.». Y avisa de lo que eso implica: «we and our service providers may transfer your information to, or store or access it in, jurisdictions that may not provide equivalent levels of data protection as your home jurisdiction». Su página de seguridad concreta dónde acaba el archivo: «Descript stores your audio, video, and transcription data on either Amazon S3 or Google Cloud».
Y hay un detalle que casi nadie tiene en cuenta al comparar estas herramientas: Descript no transcribe todo por su cuenta, sino que usa a otra empresa de esta misma lista como subencargada. Lo dice sin rodeos: «Rev only accesses or uses your data to complete the automatic transcription. Shortly after completing the service, your data is deleted from its servers». Es decir, elegir Descript implica también aceptar a Rev en la cadena.
Es la que mejor resuelve el asunto del entrenamiento, y con diferencia, porque la casilla viene apagada de fábrica: «If you choose to share your transcription information with Descript, we use it to help improve the quality of our service. This option is disabled by default and can only be enabled by you. You can change this setting from your Descript account at any time». En su política de privacidad figura además el interruptor concreto: «You can opt out of having your Projects used to improve the Descript Service by disabling the Share Data with Descript setting».
Sobre plazos también es de las pocas que da cifras. Para los proyectos: «When you delete a project from Descript, we delete it permanently from our servers within 30 days». Y para las huellas de voz: «We will retain those voiceprints until the purpose of collection has been satisfied or for up to three years after you last accessed your account».
Su plan gratuito es de 60 minutos al mes, con la exportación de vídeo limitada a 720p; exportar sin marca de agua aparece en su tabla como función de los planes de pago.
Transkriptor
Transkriptor es la que hace la promesa geográfica más fuerte de la lista: «All production servers, backups, and processing environments are hosted exclusively within the European Union. No personal data is accessed, copied, or stored in any non-EU jurisdiction». Sus subencargados declarados son AWS, Google Cloud y Stripe.
Con un matiz que conviene conocer: el contrato de encargado de tratamiento que publican en su propia web se rige por otra jurisdicción, «This Agreement is governed by the laws of Dubai, United Arab Emirates», y lista un conjunto de subencargados más amplio que el de su página de seguridad.
En retención es la más generosa de todo el grupo, y con diferencia: «Set your own automatic deletion window — from as short as 1 minute to up to 1 year». Y sobre entrenamiento es tajante: «We do not use your content to train, develop, or improve any AI or machine learning models — not for our benefit, and not for any third party». Aunque en su página de precios «your data will not be used for training purposes» aparece listado como característica del plan Pro, lo que encaja regular con un «nunca» que debería aplicar a todo el mundo.
Su plan gratuito son 30 minutos al día y una transcripción diaria, según su propia sección de preguntas frecuentes. En la página de precios, sin embargo, aparece mencionada una opción «Free – 90 Minutes». Son cifras distintas en la misma web y no hemos podido determinar cuál está vigente.
audiototext.com
Esta es la que más se anuncia como «100 % gratis» y «sin registro requerido» en el mercado español, así que merece un repaso detallado.
Lo del registro es cierto para transcribir: «You can start transcribing immediately without any registration, email, or account creation». Pero los propios textos de su aplicación dicen que descargar el resultado no lo es: «Downloading transcriptions requires an active subscription. Please upgrade to continue». Hay además un límite diario, cuyo número no publican, y un aviso de producto que invita a «romper la barrera de 30 minutos» pasando a la versión de pago. No tienen página de precios: la URL habitual devuelve un error 404.
Sobre dónde acaba tu archivo: «your information may be transferred to, stored, and processed in the United States where our servers are located». Y sobre cuánto lo guardan: «Audio files are automatically deleted from our servers after transcription is complete». Es una afirmación tranquilizadora, pero sin plazo numérico no es verificable ni exigible. De entrenamiento de IA, su política no dice nada.
Un detalle que no habíamos anticipado: el sitio lo opera Textintel FZE, con domicilio en Dubái, que es la misma empresa que está detrás de Transkriptor. Dos productos del mismo dueño con declaraciones opuestas sobre dónde se procesan los datos: la UE en uno, Estados Unidos en el otro.
Monica
Monica ofrece «30 minutes of free audio to text transcription» a los usuarios nuevos, con un tope de «Max file size: 50M» por archivo. Ojo con la letra pequeña de ese regalo: son 30 minutos una sola vez, no una cuota mensual. Su propia página lo aclara: «offering 30 minutes of free trial time. After the trial, you can choose a paid plan to continue using it».
Lo de «sin registro» aquí no aplica: al pulsar «Choose local file» aparece un formulario de alta antes de que puedas siquiera elegir el archivo. Sus condiciones lo confirman: «To access our Services, you must complete account registration».
Su página de la herramienta dice que usa «advanced encryption technology to ensure your audio files and transcriptions are fully protected», pero no especifica dónde se procesan los archivos ni cuánto tiempo los conservan. Para lo primero hay que ir a la política de privacidad general: «such information may be transferred, stored or processed in the United States where our servers or central databases are located».
Donde Monica se separa del resto es en sus términos, y no para bien. Dos cláusulas que conviene leer despacio. La primera concede una licencia que no caduca: «a perpetual and irrevocable license to use Your Content in an aggregated manner to improve the Services». La segunda advierte de que tu contenido sale hacia terceros: «Company may share your Inputs with the AI Services for this purpose and such AI Services may not be required to maintain the confidentiality of any of Your Content».
No hay plazo de retención publicado ni forma documentada de negarse a nada de lo anterior. El operador es Butterfly Effect Pte. Ltd.
Vidnoz
La página de su herramienta publica los límites con claridad: «Maximum file size: 200 MB» y «Maximum duration: 30 minutes». Hay además un límite de usos diarios, pero la cifra no la publican: el mensaje de error deja el número en blanco para que lo rellene el servidor.
Y hace una afirmación fuerte sobre privacidad: «All files you upload to the audio to text AI are completely private and secure. We don’t share or store your information once the transcription is complete». El problema es doble. Primero, que unas líneas más abajo, en sus propias preguntas frecuentes, la promesa cambia: los archivos se borran «after a certain period of time», que no es lo mismo que no almacenarlos. Segundo, que su política de privacidad no respalda ninguna de las dos versiones con un plazo: no fija cuánto conservan por defecto los archivos subidos, y lo único concreto que dice sobre borrado es que los datos «se eliminarán en un plazo de 72 horas previa solicitud». Una cosa es «no lo guardamos» en la portada y otra distinta un compromiso de borrado en el documento que sí es vinculante.
Tampoco especifica dónde están sus servidores ni si el contenido se usa para entrenar modelos. Sus condiciones se rigen por la ley de Hong Kong.
Sobre el registro, el matiz importa: puedes subir el archivo sin cuenta, pero el botón de descarga comprueba tu sesión y te manda a iniciarla si no la tienes. Sus términos lo resumen así: «Services are available to you upon registration».
Y una advertencia para no comparar mal: la tarifa que suele encontrarse al buscar «precios de Vidnoz» es la de su producto de vídeo con avatares, que no cubre esta herramienta. El plan que sí incluye audio a texto es Vidnoz Voice, cuyo escalón de entrada es «$8.99/mo — billed monthly» (6,74 $/mes con pago anual).
Lo que casi nunca dice la letra pequeña
Después de leer nueve políticas seguidas, hay cinco patrones que se repiten y que conviene saber detectar.
«Durante el tiempo necesario» no es un plazo. Es la fórmula que usan Otter, Rev, Monica y Vidnoz para la retención. Es válida jurídicamente y no dice absolutamente nada: significa que el plazo lo decide la empresa y puede cambiarlo cuando quiera. Solo tres de esta lista dan una cifra útil: Transkriptor (ventana de borrado que eliges tú, de 1 minuto a 1 año), Descript (30 días para borrar un proyecto) y Transcribo (no aplica, porque no hay servidor). Y en el extremo contrario está Notta, que sí es concreta, aunque no en el sentido que esperarías: «Permanent retention».
«No vendemos tus datos» no significa «no los usamos». Son cosas distintas. Otter no vende tus grabaciones, y aun así las usa para entrenar su tecnología. Rev tampoco las vende, y entrena con ellas sus modelos de reconocimiento de voz. Monica presume de que «we don’t sell any information to third parties» y a la vez se reserva en sus términos una licencia «perpetual and irrevocable» sobre tu contenido. Vender y usar son dos casillas separadas, y la portada solo suele hablar de la primera.
La empresa de la portada no siempre es la que trata tus datos. Transkriptor y audiototext.com pertenecen a la misma sociedad, Textintel FZE, con domicilio en Dubái, y hacen declaraciones opuestas: una dice alojar todo en la Unión Europea, la otra declara servidores en Estados Unidos. Descript, por su parte, subcontrata la transcripción automática a Rev, que es otra de las herramientas de esta comparativa. Y Monica avisa de que manda tu contenido a proveedores de IA de terceros que «may not be required to maintain the confidentiality of any of Your Content». Nada de esto es ilegal, pero significa que la lista de empresas que tocan tu grabación es más larga que la que pone en la pestaña del navegador.
«Gratis» y «sin registro» a veces se refieren a la mitad del recorrido. En audiototext.com puedes transcribir sin cuenta, pero descargar el texto requiere una suscripción activa. En Vidnoz puedes subir el archivo sin identificarte, y el botón de descarga te manda a iniciar sesión. El momento de la verdad no es cuando sube el archivo: es cuando quieres llevarte el resultado.
Los planes gratuitos están calibrados para que no te sirvan. No es una acusación, es su modelo de negocio, pero conviene mirar el límite que de verdad muerde en lugar del titular. Notta anuncia 120 minutos al mes y luego corta cada conversación a los 3 minutos. Otter anuncia 300 minutos y te deja subir 3 archivos en toda la vida de la cuenta. Rev da 45 minutos solo en inglés. Monica regala 30 minutos una única vez. En todos los casos, el titular y el límite operativo son números distintos.
Y un apunte sobre el idioma, porque en España importa: el plan gratuito de Rev es solo en inglés. Es la clase de detalle que no aparece en las comparativas escritas fuera del mercado hispanohablante.
La voz no es «solo un archivo»: es un dato personal
Conviene tenerlo claro antes de subir nada. La Agencia Española de Protección de Datos lo ha dicho de forma explícita en un informe de su Gabinete Jurídico:
En consecuencia, la imagen así como la voz de una persona es un dato personal, al igual que lo será cualquier información que permita determinar, directa o indirectamente, su identidad.
Es decir: cuando subes una reunión a una web de transcripción, no estás subiendo «un MP3». Estás tratando datos personales de todas las personas que hablan en esa grabación, y casi ninguna de ellas te ha dado permiso para enviarlas a un servidor de terceros.
Eso tiene tres consecuencias prácticas para cualquiera que trabaje en España:
- Necesitas una base jurídica para ese tratamiento, y el «es que era más cómodo» no es una de ellas.
- Si el proveedor procesa fuera del Espacio Económico Europeo, entra en juego el capítulo V del RGPD (transferencias internacionales) y te toca a ti, como responsable, documentar esa transferencia.
- Si el proveedor usa tus grabaciones para entrenar sus modelos, ese es un tratamiento adicional que también hay que poder justificar.
Nada de esto convierte a las herramientas de nube en ilegales: la mayoría ofrece contratos de encargado de tratamiento y opciones empresariales precisamente para cubrir esto. Lo que sí hace es que la casilla «dónde se procesa el audio» pase de ser un detalle técnico a ser la primera pregunta que deberías hacerte.
Cómo comprobarlo tú mismo en 30 segundos
No hace falta que te fíes de esta tabla ni de la portada de nadie. Cualquier navegador de escritorio trae la herramienta para verificarlo:
- Abre la web de transcripción que quieras auditar.
- Pulsa F12 (o clic derecho → «Inspeccionar») y ve a la pestaña Red / Network.
- Marca la casilla de filtro Fetch/XHR y, si tu navegador lo permite, ordena por tamaño.
- Sube un archivo de audio que pese lo suficiente como para notarse: 10 o 20 MB va bien.
- Mira la columna de tamaño de las peticiones salientes.
Si ves una petición de subida cuyo tamaño se parece al de tu archivo, tu audio ha viajado. Si no la ves, no ha viajado. Es una prueba binaria y la puedes repetir en cualquier herramienta de esta lista, incluida la nuestra.
Un aviso para que la prueba sea justa: descargar no es subir. Casi todas las webs descargan cosas (interfaz, fuentes, y en el caso de las que transcriben en local, el modelo de reconocimiento de voz, que pesa cientos de megas). Lo que hay que mirar es el tráfico de salida, el cuerpo de las peticiones POST.
Qué hace Transcribo con tu audio
Somos parte interesada, así que aquí van los detalles concretos para que puedas comprobarlo en lugar de creernos.
Dónde se procesa. El reconocimiento de voz se ejecuta dentro de tu navegador con Whisper, el modelo de reconocimiento de voz de OpenAI, ejecutado en local mediante WebGPU (y WASM como alternativa cuando no hay WebGPU). No hay servidor de transcripción en medio: el archivo se lee desde el disco a la memoria de la pestaña y se procesa ahí.
Qué sale por la red. Una sola cosa: el modelo. La primera vez que entras se descarga el modelo Whisper (unos 510 MB en la versión que usamos en escritorio con WebGPU; una versión pequeña de unas decenas de MB en iPhone y en navegadores sin WebGPU). Se guarda en el almacenamiento del navegador, así que a partir de la segunda visita arranca al instante y funciona incluso sin conexión. Ese tráfico es de entrada. Tu audio, que es tráfico de salida, no aparece por ningún lado.
Qué guardamos. Nada del audio ni de la transcripción. No hay base de datos de archivos porque no hay archivos que guardar. Cuando cierras la pestaña, la transcripción desaparece si no la has descargado.
Registro. No hay. Ni email, ni cuenta, ni tarjeta.
Límites. No hay contador de minutos ni de archivos.
Precio. 0 €.
La excepción honesta: YouTube. Nuestra función de transcribir vídeos de YouTube funciona distinto y es justo decirlo. Ahí no procesamos audio: aprovechamos la pista de subtítulos que YouTube ya tiene para ese vídeo. Eso significa que la URL del vídeo sí pasa por nuestro servidor, que es quien pide los subtítulos a YouTube y te devuelve el texto. No sube ningún archivo tuyo, porque no hay archivo tuyo, pero la URL que pegas no es local. Si el vídeo no tiene subtítulos, la alternativa es descargar el audio y subirlo como archivo, y entonces vuelve a procesarse en tu navegador.
Qué medimos. Usamos analítica agregada y sin cookies para saber cuánta gente entra y si la transcripción falla. No registramos el contenido de los archivos ni las transcripciones.
Puedes verificar todo lo anterior con la prueba de la pestaña Red que hay más arriba. Es literalmente el argumento: no te pedimos que confíes en una política de privacidad, te pedimos que mires el tráfico.
Metodología
Cómo se ha hecho esta comparativa, para que puedas repetirla o rebatirla:
- Fecha de comprobación: 17 de agosto de 2026. Los precios y los planes gratuitos de este sector cambian con frecuencia. Si estás leyendo esto mucho después, comprueba los enlaces.
- Fuente prioritaria: la web oficial de cada herramienta. Política de privacidad, términos de servicio, página de precios y centro de ayuda. No se han usado reseñas de terceros, listas de blogs ni comparativas de la competencia como fuente de datos.
- Los precios son los de la tarifa pública anunciada. Cuando una herramienta muestra un precio distinto según se pague por meses o por año, se indica cuál es cuál, porque la diferencia suele ser grande. Se han recogido los precios de lista, no las promociones temporales: varias de estas webs tenían descuentos activos el día de la consulta y esos descuentos caducan.
- Algunos precios se muestran en dólares y otros en euros. No es un descuido: las tarifas se consultaron desde España, y unas webs localizan el precio y otras no. Otter factura en dólares y lo dice expresamente; Notta muestra euros a un visitante español. Se ha recogido lo que ve cada uno.
- Las políticas de privacidad se han leído enteras, no solo el resumen. En varios casos, la afirmación de la portada y la del documento legal no coinciden, y cuando eso pasa el artículo cita las dos.
- «No especificado» significa exactamente eso. Cuando un dato no aparece en la documentación pública de la herramienta, la celda lo dice en lugar de rellenarse con una suposición. Preferimos una tabla con huecos honestos a una tabla completa e inventada.
- Ninguna de estas herramientas ha patrocinado este artículo ni ha sido consultada antes de publicarlo. Transcribo es nuestro producto, y por eso su fila está descrita con más detalle y con instrucciones para verificarla, no con más adjetivos.
- Correcciones. Si representas a alguna de estas herramientas y un dato es incorrecto o se ha quedado antiguo, escríbenos a [email protected] con el enlace a la página oficial que lo desmienta y lo corregimos indicando la fecha del cambio.
En resumen
Si transcribes la lista de la compra, cualquiera de estas herramientas te sirve y probablemente la nube te dé mejor experiencia: diarización, editores colaborativos, resúmenes automáticos. Hay cosas que un modelo corriendo en tu portátil no hace.
Si transcribes reuniones con datos de clientes, entrevistas confidenciales, historiales médicos o cualquier grabación que no querrías ver filtrada, la pregunta relevante no es cuál acierta más palabras: es cuál no necesita que tu archivo salga de tu ordenador.
¿Quieres probar la segunda opción? El transcriptor online de Transcribo está en la portada, sin registro y sin límite. Y con las DevTools abiertas, si quieres comprobarlo mientras lo usas.
Fuentes
Todas consultadas el 17 de agosto de 2026.
Notta: precios · seguridad · política de privacidad · seguridad y privacidad de datos (centro de ayuda) · qué pasa con tus datos al expirar la suscripción · modo privacidad
Otter.ai: precios · política de privacidad · políticas de seguridad y privacidad de datos · borrar una conversación
Rev: precios · política de privacidad · términos de servicio · privacidad y seguridad (centro de ayuda) · exclusión del entrenamiento de IA
Descript: precios · política de privacidad · seguridad · términos
Transkriptor: precios · seguridad · información legal y contrato de tratamiento
audiototext.com: portada en español · política de privacidad · términos de servicio
Monica: herramienta de audio a texto · política de privacidad · términos · precios
Vidnoz: herramienta de audio a texto · política de privacidad y términos · precios de Vidnoz Voice
Transcribo: cómo funciona · política de privacidad · precios
Normativa: Agencia Española de Protección de Datos, Gabinete Jurídico, informe sobre grabación de imágenes y voz y proporcionalidad (PDF).