Recursos · Integración Make

Integración Google Cloud Speech MakeAutomatiza Google Cloud Speech con Make.

¿Cuánto tiempo pierdes transcribiendo grabaciones a mano? La integración Google Cloud Speech Make trae 3 módulos: 2 acciones y 1 búsqueda. Aquí ves cómo vincular tu proyecto de Google Cloud y montar tu primer flujo de transcripción, paso a paso.

Reseñas verificadas en Trustpilot · Agencia de IA, automatización y growth

Lo que puedes automatizar

¿Qué te aporta la integración Google Cloud Speech Make?

Con ella, un escenario de Make, es decir, la automatización que construyes encadenando piezas, manda audio al reconocimiento de voz de Google y recibe la transcripción. Cada pieza es un módulo, y aquí tienes 3: dos para lanzar un reconocimiento y uno para consultar un trabajo largo.

Tener por escrito las notas de voz del equipo comercial. Tus vendedores dejan audios cortos tras cada visita. Start Synchronous Speech Recognition devuelve el texto en el mismo paso, una vez procesado todo el audio.

Transcribir clases o formaciones completas. Una academia online graba sesiones largas. Start Asynchronous Speech Recognition lanza el trabajo en segundo plano y Get the State of Asynchronous Speech Recognition recoge el resultado cuando Google lo tiene listo.

Llevar el texto a tus herramientas. La transcripción viaja como bundle, un elemento que pasa de un módulo al siguiente, hacia la app que elijas; por ejemplo, una base como la de la Integración Airtable Make.

Lo que no encontrarás: la app no tiene disparador, así que otra app o una programación debe arrancar el escenario, y tampoco hay módulo Make an API Call. Si dudas entre plataformas, lee n8n vs Make; para dominar el editor, echa un vistazo al Curso de Make.

Conexión

¿Cómo conectas Google Cloud Speech con Make?

  1. 01

    Prepara tu proyecto de Google Cloud

    Necesitas una cuenta de Google Cloud con la facturación habilitada y la API Cloud Speech-to-Text activada. En la consola, abre APIs and Services, luego Credentials, y crea un OAuth client ID.

  2. 02

    Indica la dirección de retorno de Make

    Cuando Google pida la URI de redirección, pega https://www.integromat.com/oauth/cb/google-cloud-speech, pulsa Create y copia el Client ID y el Client secret que aparecen en pantalla.

  3. 03

    Crea la conexión en Make

    Añade un módulo de Google Cloud Speech a tu escenario y pulsa Create a connection. El campo Connection name es opcional. Pega tus credenciales: esa conexión, tu cuenta de Google vinculada a Make, vale para los 3 módulos.

Primer escenario

Tu primer escenario con Google Cloud Speech

ObjetivoCuando llega una grabación nueva a otra app, Make la envía a Google Cloud Speech y recoge el texto.

  1. 01

    Crea el escenario

    En la página Scenarios, crea un escenario nuevo y pulsa el + para poner el primer módulo. Elige la app donde caen tus audios: como Google Cloud Speech no tiene disparador, esa app abre el flujo.

  2. 02

    Lanza la transcripción

    Pulsa el + de la derecha, busca Google Cloud Speech y elige Start Asynchronous Speech Recognition. Si es tu primer módulo de la app, pulsa Create a connection y asigna el audio que trae el módulo anterior.

  3. 03

    Consulta el trabajo

    Añade después Get the State of Asynchronous Speech Recognition y asígnale lo que devolvió el módulo anterior. Este módulo lee el estado del trabajo y te entrega el texto cuando Google lo termina.

  4. 04

    Prueba con Run once

    Pulsa Run once para ejecutar el escenario una sola vez. Abre la burbuja sobre cada módulo para leer los bundles recibidos y el estado que devuelve Google.

  5. 05

    Programa y activa

    El reloj del primer módulo fija la programación, cada 15 minutos por defecto. Luego activa el escenario. Cada ejecución de un módulo sobre un bundle cuenta como una operación en tu plan de Make.

Módulos

Qué hace cada módulo de Google Cloud Speech

Google Cloud Speech te da 3 módulos. Para cada uno: qué hace por ti, cuándo elegirlo y a qué prestar atención.

Google Cloud Speech1

Get the State of Asynchronous Speech Recognition

Acción

En MakeGets the latest state of a long-running operation. Clients can use this method to poll the operation result at intervals as recommended by the API service.

Con él sabes si una transcripción larga ya terminó y obtienes su texto cuando está lista. Solo tiene sentido después de haber lanzado un trabajo asíncrono.

Cuándo usarlo
tras enviar a Google la grabación de una junta directiva o de una entrevista de prensa, para llevar el acta a tu gestor documental.
Ojo
el trabajo puede seguir en curso cuando el módulo lo consulta; revisa el estado devuelto antes de usar el texto en los pasos siguientes.
Google Cloud Speech2

Start Asynchronous Speech Recognition

Acción

En MakePerforms asynchronous speech recognition: receive results via the google.longrunning.

Mandas la transcripción a segundo plano y el escenario sigue adelante sin esperar el texto. Google procesa el audio mientras tanto, algo ideal para archivos demasiado largos para tratarlos de una vez.

Cuándo usarlo
una clase grabada, un seminario web o una llamada larga con un proveedor que quieres tener por escrito.
Ojo
este módulo no devuelve la transcripción en sí; colócale detrás Get the State of Asynchronous Speech Recognition para recogerla.
Google Cloud Speech3

Start Synchronous Speech Recognition

Búsqueda

En MakePerforms synchronous speech recognition: receive results after all audio has been sent and processed.

Recibes el texto en el mismo paso: Make envía el audio, Google lo procesa entero y la transcripción sale del módulo. Es el camino más directo para fragmentos cortos.

Cuándo usarlo
la nota de voz de un vendedor al salir de una visita, que quieres convertir al momento en una ficha de tu CRM.
Ojo
Make lo trata como una búsqueda, así que puede devolver cero, uno o varios bundles; prevé cada caso en los módulos siguientes.
¿Necesitas ayuda?

¿Necesitas ayuda para automatizar Google Cloud Speech con Make?

Una persona lee cada mensaje.

FAQ

Preguntas frecuentes sobre Google Cloud Speech en Make

01¿La integración Google Cloud Speech Make es gratis?
En Make, sí: Google Cloud Speech es una app estándar, disponible desde el plan Free. Ese plan incluye 2 escenarios activos, un intervalo mínimo de 15 minutos entre ejecuciones programadas, 5 minutos de ejecución como máximo, archivos de hasta 5 MB y 512 MB de transferencia. Los planes de pago bajan el intervalo a 1 minuto y suben la ejecución a 40 minutos. Google cobra su servicio aparte: tu cuenta de Google Cloud necesita la facturación habilitada, y sus precios figuran en la página de precios de Google Cloud Speech.
02¿Qué se necesita para conectar Google Cloud Speech con Make?
Una cuenta de Google Cloud con la facturación habilitada y la API Cloud Speech-to-Text activada. En la consola de Google Cloud creas un OAuth client ID desde APIs and Services y luego Credentials, con la URI de redirección de Make que aparece más arriba. Google te muestra entonces un Client ID y un Client secret. En Make añades un módulo de Google Cloud Speech, pulsas Create a connection y pegas esas credenciales. La misma conexión sirve para los 3 módulos.
03¿El escenario de Google Cloud Speech se dispara en tiempo real?
No. La app no tiene ningún módulo disparador, ni programado ni instantáneo, así que no puede arrancar un escenario por sí sola. El flujo empieza en otra app, la que recibe tus grabaciones por ejemplo, o se ejecuta según la programación del primer módulo. Un escenario nuevo revisa cada 15 minutos por defecto, y los planes de pago permiten bajar a 1 minuto. Los módulos de Google Cloud Speech van después de ese primer paso.
04¿Qué hacer si falta un módulo de Google Cloud Speech en Make?
Depende de lo que necesites. La app tiene solo 3 módulos y, a diferencia de muchas otras, no incluye Make an API Call, así que no llegas a otras funciones de la API de Google desde esta integración. Para lo que quede fuera del reconocimiento síncrono, el asíncrono y la consulta de estado, busca otra app en Make que lo cubra o pide al equipo de la agencia Make que estudie un desarrollo a medida. Ten en cuenta además que la documentación de Make para esta app está marcada como generada por IA: confirma los detalles con Google.
05¿Make o n8n para Google Cloud Speech?
Depende de tus criterios, no hay un ganador fijo. En Make tienes 3 módulos listos para esta app, un editor visual, un plan Free para arrancar y una conexión basada en tus propias credenciales OAuth de Google. n8n suele ofrecer un nodo para la misma app, así que compara lo que cubre cada herramienta en tu caso concreto. Fíjate en los módulos que necesitas, en cómo trabaja tu equipo y en el resto de apps que usas, y prueba el flujo en la herramienta que mejor encaje.