Le das un video, una nota de voz o una idea. Cuatro motores se reparten el trabajo: uno mira, otro escucha, otro arma el reel vertical y otro compone las piezas de marca. Cada uno declara qué hizo y qué no.
Corta la película en escenas reales, describe cada tramo, reconoce quién aparece y te dice en qué minuto pasa lo que buscás.
La atmósfera la genera el motor. El titular y el logo se componen con tu tipografía: a un modelo nunca se le pide texto, hace atmósferas muy bien y tipografía muy mal. La portada sale de un cuadro que está de verdad en el reel.
No son cuatro herramientas sueltas: cada uno le pasa al siguiente lo que hizo. Por eso el subtítulo cae donde termina la frase y la portada muestra un cuadro que está de verdad en el video.
Mira el material entero, lo corta en escenas reales, describe cada tramo y reconoce quién aparece en qué minuto.
Le pasa a VETA: dónde cambia el plano y dónde está la personaTranscribe con cada palabra en su segundo exacto. No una frase por minuto: palabra por palabra.
Le pasa a VETA: dónde termina cada fraseCon el mapa de VISION y las palabras de SONAR arma el reel vertical: elige el tramo, sigue a la persona, quema los subtítulos. Es el único dueño del render.
Le pasa a PRISMA: un cuadro real del reel terminadoCompone las piezas que acompañan: la portada de grilla, el carrusel y las placas de marca, con tu tipografía y tu logo.
Devuelve: los archivos listos para subirDónde cambia el plano, qué pasa en cada tramo y un resumen que declara cuánto del video miró de verdad.
Reconocimiento facial contra tu propia galería, con la línea de tiempo de cada persona.
Texto completo y cada palabra con su segundo. Sirve para subtitular, para buscar y para cortar exacto.
Le pasás la lista de nombres y marcas antes de empezar. Es lo que más se equivoca un modelo de voz.
Vertical, con la cámara siguiendo a quien habla, los subtítulos quemados y el texto lejos de lo que tapa la interfaz de la app.
Pedís seis reels de una charla y salen seis, uno por idea. Dónde cortar lo decide el motor, que sí vio el material.
El titular y el logo se componen con tu tipografía. La imagen la genera el motor; el texto no, porque un modelo lo escribe mal.
Con un cuadro del propio reel, no con una imagen inventada que promete otra cosa que la que el video muestra.
Una clave, un POST y un identificador. Consultás cuando quieras: los trabajos no se pierden.
Cuántos cuadros miró, qué décimos del video cubrió y qué quedó afuera. Si no lo vio, lo dice.
El cupo descuenta minutos procesados. Un trabajo que falla no te consume nada.
El panel dice si el motor está encendido y cuántos trabajos tenés adelante. Un «procesando» sin nadie del otro lado sería una mentira cómoda.
# Un video para transcribir… curl -X POST https://signal.growxagency.info/v1/jobs \ -H "Authorization: Bearer gxv_tu_clave" \ -H "Content-Type: application/json" \ -d '{"tipo":"transcribir","fuente":"https://…/charla.mp4"}' # …o una pieza de marca, que no necesita ningún video: curl -X POST https://signal.growxagency.info/v1/jobs \ -H "Authorization: Bearer gxv_tu_clave" \ -H "Content-Type: application/json" \ -d '{"tipo":"pieza","opciones":{"marca":"growx","titulo":"Publicar no es tener presencia."}}' # Te devuelve un id, y cuando está listo: curl https://signal.growxagency.info/v1/jobs/<id> \ -H "Authorization: Bearer gxv_tu_clave"
Los trabajos se procesan en una GPU propia, de a uno por vez. En horas cargadas se hace cola: el trabajo espera, no falla. Preferimos decirlo antes que prometer un tiempo que no controlamos.
Es lo que cuesta de verdad: tiempo de GPU. Contar trabajos premiaría al que manda dos horas y castigaría al que manda una nota de voz. Los cuatro motores están en todos los planes; lo que cambia es cuánto material entra.