Recursos · Integración Make

Integración Google Cloud Vision MakeAutomatiza Google Cloud Vision con Make.

¿Cuántas imágenes y escaneos revisa tu equipo a mano cada vez que llegan? La integración Google Cloud Vision Make trae 9 módulos, 4 acciones y 5 búsquedas, para sacar texto, etiquetas o alertas de cualquier imagen. Aquí ves cómo conectar tu cuenta y montar tu primer escenario.

Reseñas verificadas en Trustpilot · Agencia de IA, automatización y growth

Lo que puedes automatizar

¿Qué puedes hacer con la integración Google Cloud Vision Make?

La integración Google Cloud Vision Make deja que un escenario, la automatización que armas en Make, mande una imagen o un archivo escaneado al servicio de visión de Google. A cambio recibes texto, etiquetas, rostros, colores o un aviso sobre el contenido, listos para el siguiente paso y sin escribir código.

Imágenes de usuarios filtradas antes de publicarse. Detect Potentially Unsafe or Undesirable Content within an Image revisa cada foto que suben tus clientes, y solo las dudosas pasan por una persona.

Albaranes y contratos escaneados convertidos en texto. Con Run Text Detection (OCR) within a File and Iterate the Result Array, Make lee un PDF o un TIFF página por página y el equipo de administración recibe el contenido, no un adjunto que hay que abrir.

Un catálogo de fotos que se ordena solo. El localizador de objetos encuentra cada artículo de una foto, y Compute Image Dominant Colors and Iterate the Result Array saca sus colores principales, ideal para fichas de producto.

Lo que no hace: la app no tiene disparador, así que otra app o una programación debe arrancar el escenario, y no hay módulo Make an API Call para ir más allá de los 9 módulos. El mismo servicio suele tener un nodo en n8n; la comparativa n8n vs Make te ayuda a decidir y el Curso de Make te guía en tus primeros escenarios.

Conexión

¿Cómo conectas Google Cloud Vision con Make?

  1. 01

    Habilita la API en Google

    Necesitas una cuenta de Google Cloud Vision AI con la facturación activada. En Google Cloud Platform, crea o elige un proyecto, abre APIs & Services > Library, busca Cloud Vision API y haz clic en Enable. Si ves Manage, ya estaba habilitada.

  2. 02

    Crea tu clave API

    En la misma consola, entra en APIs & Services > Credentials, haz clic en + Create Credentials > API key y copia el valor que aparece. Guárdalo bien, porque Make te lo pide en el paso siguiente.

  3. 03

    Conecta la cuenta en Make

    Añade cualquier módulo de Google Cloud Vision a tu escenario y pulsa Create a connection. La conexión es tu cuenta enlazada una sola vez con Make y que usan todos los módulos de la app. Pega la clave en API Key, pulsa Sign in with Google y confirma el acceso.

Primer escenario

Tu primer escenario: sacar el texto de una imagen

ObjetivoCuando llega una imagen a la app donde recibes tus documentos, Make extrae su texto con Google Cloud Vision y revisa si su contenido es apropiado.

  1. 01

    Crea el escenario

    Desde la página Scenarios, crea un escenario nuevo y haz clic en el + para poner el primer módulo. Como Google Cloud Vision no tiene disparador, elige el de la app donde te llegan las imágenes.

  2. 02

    Añade el OCR

    Pulsa el + a la derecha de ese primer módulo, busca Google Cloud Vision y elige Run Text Detection (OCR) within an Image. Haz clic en Create a connection y enlaza la cuenta con tu clave API.

  3. 03

    Asigna la imagen

    Rellena los campos del módulo con la imagen que entrega el primer módulo. Un bundle es cada elemento que pasa de un módulo a otro, aquí una imagen. Si es un documento, marca la opción pensada para texto denso.

  4. 04

    Suma la revisión

    Pulsa otra vez el + y añade Detect Potentially Unsafe or Undesirable Content within an Image sobre la misma imagen. Así tienes el texto y un aviso si algo no debería circular.

  5. 05

    Prueba con Run once

    Haz clic en Run once para ejecutar el escenario una vez y abre cada módulo para ver los bundles que recibió. Cada ejecución de un módulo cuenta como una operación, la unidad que Make descuenta de tu plan.

  6. 06

    Programa y activa

    Fija la programación en el primer módulo, cada 15 minutos por defecto, y activa el escenario. Desde ahí, cada imagen nueva se lee y se revisa sin que tengas que hacer nada.

Módulos

Qué hacen los módulos de Google Cloud Vision

Google Cloud Vision te da 9 módulos en 2 grupos. Para cada uno: qué hace por ti, cuándo elegirlo y a qué prestar atención.

Images

8 módulos

Run Localizer for Object Detection within an Image and Iterate the Result Array

Google Cloud Vision1

Run Handwriting Detection within an Image

Acción

En MakeRuns detection to extract handwriting from an image.

Con este módulo la letra escrita a mano en una foto pasa a ser texto, y te ahorras copiar partes de trabajo, encuestas en papel o apuntes de una reunión.

Cuándo usarlo
tus repartidores fotografían hojas de entrega firmadas y rellenadas a mano, y alguien tiene que pasarlas a una hoja de cálculo.
Ojo
si el texto está impreso, usa el módulo de OCR normal; este apunta a la escritura manual.
Google Cloud Vision2

Run Label Detection within an Image

Acción

En MakeDetects and extracts information about entities within an image, across a broad group of categories.

Sabes qué aparece en una imagen, dentro de un abanico amplio de categorías, y el escenario puede archivarla o enviarla según su tema y no según el nombre del archivo.

Cuándo usarlo
una inmobiliaria recibe fotos de pisos y quiere separar cocinas, baños y fachadas sin mirarlas una a una.
Ojo
para leer palabras o analizar rostros, los módulos de OCR y de rostros están hechos para eso.
Google Cloud Vision3

Run Text Detection (OCR) within an Image

Acción

En MakeRuns text detection / optical character recognition (OCR) to extract text from an image. If the image is a document, check the flag to optimize the detection for dense text and documents.

El texto impreso de una foto o una captura sale como texto plano, listo para tu CRM, una hoja de cálculo o un correo. OCR significa reconocimiento óptico de caracteres.

Cuándo usarlo
te llegan tickets, tarjetas de visita o etiquetas en foto y su contenido tiene que poder buscarse.
Ojo
si la imagen es un documento, marca la opción de texto denso para que la detección se ajuste a páginas llenas de letra.
Google Cloud Vision4

Run Landmark Detection within an Image and Iterate the Results

Búsqueda

En MakeDetection identifies landmarks in an image. One landmark in the image produces one record in the result array.

Los lugares conocidos que salen en una foto quedan identificados, algo útil para poner pie de foto a imágenes de viajes o de turismo sin adivinar dónde se tomaron.

Cuándo usarlo
una oficina de turismo recopila fotos de visitantes y quiere indicar el monumento de cada una.
Ojo
es un módulo de búsqueda: cada lugar encontrado es un bundle, y si no reconoce ninguno no sale nada y lo que sigue no se ejecuta.
Google Cloud Vision5

Run Face Detection within an Image and Iterate the Result Array

Búsqueda

En MakeDetects and extracts multiple faces within an image along with the associated key facial attributes such as emotional state or wearing headwear. One face in the image produces one record in the result array.

Cada rostro de una imagen te llega con sus atributos principales, como la emoción o si lleva algo en la cabeza, para contar personas o marcar fotos que conviene revisar.

Cuándo usarlo
tras un evento, quieres separar las fotos con público de las que salen vacías.
Ojo
un rostro equivale a un bundle, así que una foto de grupo multiplica las operaciones de los módulos que vienen detrás.
Google Cloud Vision6

Compute Image Dominant Colors and Iterate the Result Array

Búsqueda

En MakeComputes and iterates an array of dominant colors wirthin an image.

Descubres los colores que mandan en una imagen, práctico para etiquetar material gráfico por tono o comprobar que una foto encaja con tu identidad visual antes de publicarla.

Cuándo usarlo
una tienda online quiere rellenar el atributo de color de cada ficha a partir de la foto del producto.
Ojo
los colores salen en varios bundles; pon un agregador detrás si prefieres una sola línea por imagen.
Google Cloud Vision7

Detect Potentially Unsafe or Undesirable Content within an Image

Acción

En MakeDetects potentially unsafe or undesirable content within an image.

Cada imagen pasa un control antes de verse, y el escenario puede apartar las que parecen inapropiadas mientras deja pasar el resto sin frenar a nadie.

Cuándo usarlo
tu comunidad sube fotos a un foro o a una sección de opiniones y el moderador solo debe revisar las dudosas.
Ojo
usa el resultado para mandar imágenes a revisión, no como una decisión final sin una persona detrás.
Google Cloud Vision8

Run Text Detection (OCR) within a File and Iterate the Result Array

Búsqueda

En MakeRuns text detection / optical character recognition (OCR) to extract text from a PDF/TIFF file. One page in the file produces one record in the result array.

Un PDF o un TIFF completo se lee página por página, de modo que un contrato escaneado o un lote de albaranes se convierte en texto que el escenario puede buscar y reenviar.

Cuándo usarlo
tus proveedores mandan PDF escaneados y administración necesita el contenido, no una imagen.
Ojo
cada página genera su propio bundle; un agregador de texto detrás vuelve a juntar el documento entero.

Otros módulos

1 módulo
Google Cloud Vision9

Run Localizer for Object Detection within an Image and Iterate the Result Array

Búsqueda

En MakeObject localization identifies multiple objects in an image and provides info for each object in the image. One object in the image produces one record in the result array.

Los objetos de una misma imagen se localizan y se describen uno a uno: la foto de una estantería o de una sala se convierte en la lista de lo que contiene.

Cuándo usarlo
un equipo de inventario o un perito de seguros fotografía un local y quiere registrar cada objeto por separado.
Ojo
a diferencia de la detección de etiquetas, que describe la imagen entera, este módulo devuelve un bundle por objeto y lo siguiente se ejecuta para cada uno.
¿Necesitas ayuda?

¿Necesitas ayuda para automatizar Google Cloud Vision con Make?

Una persona lee cada mensaje.

FAQ

Google Cloud Vision y Make: preguntas frecuentes

01¿La integración Google Cloud Vision Make es gratis?
Sí en lo que toca a Make: Google Cloud Vision es una app estándar, disponible desde el plan Free. Ese plan permite 2 escenarios activos, un intervalo mínimo de 15 minutos entre ejecuciones programadas, 5 minutos de ejecución como máximo, archivos de hasta 5 MB y 512 MB de transferencia. Los planes de pago bajan a 1 minuto y cuentan el uso en créditos. Por parte de Google, tu cuenta de Cloud Vision AI debe tener la facturación activada; esta página no entra en los precios de Google.
02¿Qué hace falta para conectar Google Cloud Vision con Make?
Una cuenta de Google Cloud Vision AI con la facturación activada, un proyecto de Google Cloud con Cloud Vision API habilitada y una clave API creada desde APIs & Services, Credentials en ese mismo proyecto. En Make, pulsa Create a connection en cualquier módulo de la app, pega la clave en el campo API Key, haz clic en Sign in with Google y confirma el acceso. Después, la conexión sirve para todos los módulos.
03¿Un escenario de Google Cloud Vision puede arrancar solo?
No desde Google Cloud Vision, porque la app no tiene ningún módulo disparador. Lo arrancas de otra forma: con el disparador de la app donde llegan tus imágenes o archivos, puesto en primer lugar, o con la programación del primer módulo, que en un escenario nuevo viene fijada cada 15 minutos. Los módulos de Google Cloud Vision van después y trabajan con la imagen que les pasa el módulo anterior.
04¿Qué hacer si falta un módulo de Google Cloud Vision?
Depende de lo que necesites, y la app no tiene módulo Make an API Call para lanzar una petición a medida. Primero repasa los 9 módulos: texto impreso, escritura a mano, archivos, etiquetas, lugares, rostros, colores, objetos y contenido inapropiado cubren casi todos los casos. Si ninguno encaja, busca otra app de Make que ofrezca la función que quieres, o pide al equipo que te ayude a diseñar el escenario.
05¿Make o n8n para Google Cloud Vision?
Depende de la herramienta que ya usa tu equipo. Make te da los 9 módulos de esta página, un editor visual y un plan Free para probar sin compromiso. n8n suele tener un nodo para el mismo servicio, así que conviene mirar qué ofrece para tu caso antes de decidir. La comparativa n8n vs Make del sitio explica las diferencias entre ambas plataformas, sin declarar un ganador, para que elijas según tu propio contexto.