Blog Logo

Cómo uso OpenClaw de verdad: mi automatización para crear vídeos más rápido

OpenClaw es una herramienta que todo el mundo está utilizando. Está hasta en la sopa, la tenemos en todos los sitios. Pero lanzo una pregunta: ¿realmente es útil? Porque una cosa es ver demos bonitas en Twitter y otra muy distinta es que te sirva para algo en tu día a día.

Pues hoy te voy a enseñar cómo yo lo utilizo de verdad y para qué me sirve a mí. Te voy a mostrar una automatización que estoy usando en mi canal para llevar un proceso completo de creación de vídeos. Aunque esto lo puedes adaptar a tu negocio o a tu caso de uso como te dé la gana. También te voy a enseñar cómo hacer para poder hablarle por mensaje de voz y que te entienda, sin tener que pagar ninguna API, totalmente gratis. Al fin y al cabo, te voy a enseñar cómo lo uso para mi trabajo y cómo puedes optimizarlo para el tuyo.


Dónde ejecutar OpenClaw

Como ya sabéis, OpenClaw se puede ejecutar en cualquier máquina. Pero a mí, como me gusta tenerlo activo todo el rato, porque es mi asistente 24 horas del día, necesito tenerlo en un servidor. Y esta vez para hostearlo he escogido HostGator.

HostGator es una plataforma de hosting bastante top que nos permite muchos tipos de hosting, pero a nosotros nos interesa el VPS. Desde su página web puedes ver las diferentes opciones que tienen. Aquí sinceramente podéis elegir el servidor que queráis. Yo he elegido el que menos potencia tiene, porque cuesta menos y porque para lo que voy a hacer me sobra. Pero vosotros podéis elegir la potencia que necesitéis. Tienen planes a diferentes precios y sobre todo si sois de Latinoamérica, os interesa porque el mayor soporte lo tienen allí.

Yo ya tengo mi máquina con OpenClaw preinstalado, que los propios amigos de HostGator me lo dejaron preparado. Si os dais cuenta, te ponen toda la información relevante: la IP y el puerto por el que acceder vía terminal. También te deja ejecutar una terminal en el navegador y te pone la contraseña root, que obviamente la tenéis que cambiar. En mi caso me dio dos gigas de RAM y 50 gigas de almacenamiento, y me sobra.

Si estáis interesados y necesitáis hostear vuestro propio OpenClaw u otro tipo de aplicaciones (ya tenemos un montón de tutoriales en el canal donde enseño a hostear muchas otras cosas), entonces HostGator es vuestra solución. Echadle un vistazo al enlace que os dejo ahí donde podréis ver todo lo que ofrece y qué precios tiene.


Configuración inicial y seguridad

Una vez conectado al servidor por SSH, como ya tengo OpenClaw instalado, toca configurarlo. No voy a ahondar mucho en esto porque ya tenemos muchos vídeos sobre cómo instalarlo y configurarlo, pero simplemente os diré que de modelo he utilizado Qwen 2.5. Este modelo tan famoso que se está volviendo muy viral últimamente, aunque no me gusta esa palabra.

Aparte he establecido un montón de políticas de seguridad que ya comenté en un vídeo anterior. Y yo sinceramente, como no me acordaba, las he mirado en mi blog, he copiado y pegado lo que había que hacer y ya está. No me ha costado mucho más.

Aquí recordaros que entre otras cosas restringimos los puertos a los que nos podemos conectar. Si estáis usando HostGator, fijaos que el puerto SSH que os dan puede no ser el 22 estándar. En mi caso me dieron el 22022, así que cuidado, no restrijáis el puerto equivocado o os cargáis la máquina y tendréis que formatearla.

Luego otra cosa que hago es usar Tailscale para poder conectarnos de forma segura sin tener que exponer nuestro servicio. Esto también importantísimo. Y bueno, un par de configuraciones más de las que ya hablé en otros posts.


Hablarle por audio gratis con Groq

Vamos al jugo. Primero vamos a ver cómo he configurado el tema de que yo le mande un audio y me lo transcriba y me entienda, porque esto por defecto no lo hace. OpenClaw te sugiere usar la API de Whisper de OpenAI, pero eso vale dinero. Tienes que cargar créditos, los créditos caducan… es un jaleo que no necesitamos para simplemente poder mandar un mensaje de voz.

¿Cómo lo vamos a hacer? Pues por si no lo sabíais, hay proveedores que te ofrecen acceso a APIs de inteligencia artificial gratis. ¿Por qué gratis? Bueno, para que uses sus servicios, porque te ofrecen un tier gratuito bastante generoso. Para este caso vamos a usar uno de esos servicios que se llama Groq. Y no, no estoy hablando de la inteligencia artificial de Elon Musk. No, Grok con K… su primo tonto.

Con Groq tenemos un tier gratuito muy generoso de Whisper que vamos a poder utilizar sin poner tarjeta de crédito ni nada. Vamos a la página web, nos registramos y podemos generar una API key y utilizarla.


Las Skills: la clave de todo

¿Y cómo vamos a hacer que OpenClaw nos entienda cuando le mandamos un audio? Pues muy sencillo, y en esto se va a basar todo el post. Para hacer que OpenClaw aprenda algo, simplemente hay que decírselo. Pero a veces diciéndoselo la IA puede alucinar y no hacer bien las cosas, tener que hacer demasiados reintentos o directamente no poder hacerlo bien.

Entonces, para ir a tiro hecho vamos a utilizar las skills. Las skills básicamente son ficheros markdown de texto donde documentan el proceso de cómo hacer ciertas cosas. De este modo, la inteligencia artificial ya no se va a inventar nada porque tiene una referencia de cómo hacerlo. Es básicamente como si accediese a la documentación, pero es una documentación más estructurada, más colapsada, resumida, para que lo entienda rápidamente y sepa utilizarlo sin muchos otros líos.

Yo me he puesto a buscar skills en skills.sh, que es una web donde recopilan skills de código abierto. Ojo, cuidado porque aquí podemos encontrarnos de todo y podemos encontrar skills maliciosas que intenten robarnos nuestras APIs. Así que mucho cuidado por favor. Aunque hayamos configurado el bot con una capa de seguridad, siempre puede haber algo que se lo salte. Revisad siempre bien las skills que utilicéis.

Dicho esto, yo encontré una skill de Groq. Lo que le he dicho a OpenClaw es básicamente: “apréndete esta skill de Groq y a partir de ahora cuando te hable por audio me lo vas a transcribir y lo vas a entender”. Ya está, no le he dicho nada más.

Y en efecto, se lo digo y me dice que guarde la API key en el fichero de variables de entorno. Gracias a nuestra configuración de seguridad, me enseña cómo hacerlo de forma segura, yo abro el fichero, guardo la API key, recargo el fichero y con esto ya accede directamente a Groq. Sinceramente prefiero hacerlo así porque tampoco se envía nada por el chat ni a ningún sitio esa API key.

Y como veis, después de un rato (no es que sea lo más rápido del mundo Qwen 2.5, pero ahí lo tenemos), ya funciona. Le mando un audio y me entiende. Me devuelve lo que le he dicho en el audio, lo que quiere decir que me ha entendido perfectamente.


Añadir un modelo para programar

Después de configurar el audio, lo que hago es añadirle un modelo más, porque quiero un modelo para cuando tenga que programar y hacer cosas más pesadas. Y esta vez he decidido que sea Codex. Para añadirlo me voy a la terminal y pongo el comando openclaw models login, le indico el de OpenAI Codex, y con esto ya me da un enlace para hacer OAuth con mi suscripción de GPT y tener acceso a Codex.

Visto esta parte, ya tenemos acceso a un modelo extra aparte de Qwen 2.5, que es potente para programar, y tenemos la capacidad de hablarle por audio. Perfecto. Ahora ya con estas comodidades, vamos a ver cuál sería esta automatización que quiero montar.


La automatización completa: de mis guardados de Twitter a un guion en Notion

Y es que mencioné algo parecido en un vídeo anterior, solo que ahora es más sofisticado y más enfocado a mi negocio. Os explico.

Yo tengo muchos guardados en Twitter. Me gustaría poder recopilarlos y analizarlos porque tengo muchas cosas guardadas y creo que muchas son útiles para subir vídeos al canal. Entonces me he querido montar una automatización que yo pueda accionar cuando me apetezca, y esto lo que hace son varias cosas.

Primero obtiene un perfil de mí, de cómo soy, cuáles son mis gustos. Esto es gracias a todos los vídeos que he ido subiendo durante todo este tiempo. Como los tengo almacenados en Notion con títulos de guion, pues ya sabe los vídeos que he hecho. En base a eso se va a mis guardados de Twitter, que también reflejan mis gustos. Pero claro, ahí hay un montón de cosas guardadas y tiene que elegir cuál sugerirme.

Para elegir qué sugerirme como próximo vídeo, se basa en una cosa: sabe buscar tendencias. Le digo “de las cosas que te he pasado, mira a ver qué es lo más candente, lo más hablado en Reddit, en Twitter”. Incluso creo que también tiene un poco de acceso a Google Trends. Y con esto, sabiendo las tendencias de cada tema, ya puede deliberar en base a los trends y a lo que me gusta a mí cuáles pueden ser las siguientes ideas para próximos vídeos.

Y no se queda ahí solamente, porque me sugiere tres ideas (o las que queramos decirle, yo he puesto tres). Y aparte de justificarme por qué cada una es buena, cuando yo quiero desarrollar una idea en concreto, se lo digo. “Vamos a desarrollar esta”. Y se pone a buscar información porque puede buscar en Google también. Lo importante es que me genera un guion en Notion, y ojito, en base a lo que ha aprendido de mí. Porque como tiene todos mis guiones, sabe cómo hablo y con esto me genera una base de guion que obviamente tengo que revisar y cambiar cosas. A veces lo hace muy corto. No escribo mis guiones con inteligencia artificial, pero sí que me da una idea de cómo puedo hablar y afrontar este contenido. Son más unos pasos de storytelling que un propio guion, pero la clave está ahí.

Ya tengo un proceso completo de validación de idea de vídeo hasta la creación de su guion. Y todo esto en un momento y de forma muy sencilla. Así que voy a enseñaros cómo lo he montado para que cojáis ideas para vuestras propias automatizaciones.


Paso 1: Conectar la API de Twitter

Lo primero y más importante: la API de Twitter. Creo que antes estaba capada o era de pago, pero recientemente han actualizado todo el tema y ahora es muy accesible. Yo de momento no he tenido que pagar nada.

Para usarla, vamos a ir a la consola de desarrolladores de Twitter. Tienen ahí una consola de administración y aquí vamos a crear y gestionar las API keys. Tenéis que crear todas, exactamente todas. No os preocupéis si os perdéis un poco, copiad todas las APIs que os genere.

Y lo que vamos a usar también es, a ver quién lo sabe… exactamente, una skill. En este caso encontré una skill de Twitter que me ha gustado. Hay muchísimas, pero bueno, yo os dejo las que he utilizado por si os sirve de algo.

Esto es más de lo mismo: le paso la URL de la skill, le digo que se la aprenda, y luego le paso los tokens. Ahí he tenido que preguntarle porque no sabía cuál era cada token (es que hay como cuatro o cinco), pero me los ha explicado, los he puesto en el fichero de variables de entorno, los ha cogido, y después de un ratillo, ya tiene acceso a Twitter. Ya puede verme los guardados. Fenomenal.


He encontrado una skill de tendencias que no necesita ninguna API y te busca en Reddit, Twitter, en todo. No sé muy bien cómo funciona sin API, pero la verdad es que funciona y es una maravilla. Así que esta es facilita: le dices a OpenClaw que la instale y se la aprenda, y ya está.


Paso 3: Conectar Notion

La siguiente es la de Notion, para que tenga acceso a todos mis guiones y también me pueda crear uno nuevo. Esta también es muy fácil. Encontré una skill en concreto, se la aprende, y necesita la API key de la API de Notion.

Vamos a ir a la zona de desarrolladores de Notion. Aquí vamos a crear una integración. Hay dos tipos de integraciones, nosotros podemos crear la sencillita, no hace falta crear una aplicación entera. Al crearla nos aparece la API key. Como siempre: copiamos, pegamos donde nos diga OpenClaw (que ya sabe que no se le pasan esas APIs por el chat y que tienen que ir directamente al sistema), y ya tiene acceso a Notion.


El prompt que lo orquesta todo

Una cosa menos. ¿Qué nos queda? Bueno, realmente ya no nos quedan skills por configurar. Nos queda pasarle el prompt gordo para que haga todo este ciclo que os he explicado.

Y yo, esto que os he explicado, me fui hasta ChatGPT (sí, aún lo tengo y a veces lo uso, fijaos) y se lo expliqué todo. Le di detalles, en qué parte de Notion tengo los guiones, le expliqué todo un poco como he podido, y le dije que me generase un prompt bueno para OpenClaw. Para que haga exactamente eso que os he contado.

Y me ha generado un texto que ojito, no podéis pasar tanto texto por el chat de Telegram porque no lo permite. Así que lo he puesto en un txt y le he dicho a OpenClaw que se lea ese txt. Ya está, un archivo de texto normal y corriente. Se lo ha leído y en principio se lo ha aprendido.


Probando la automatización

Así que voy a probarla. Le digo que la accione. En efecto, se pone a buscar, me busca en mis guardados, contrasta con la API de tendencias que hemos mencionado antes, y ya cuando lo tiene todo, me sugiere.

Y como veis ahí me ha sugerido tres cosas. La que me interesa, y que probablemente sea un vídeo pronto (espero, si tengo tiempo), es la del servidor de Hytale. Y es que sí lo tengo pendiente, tengo que hacer un vídeo de cómo montar un servidor de Hytale. Ya lo sé, y me lo ha recordado esto. Próximamente será de las cosas que voy a hacer, dadme tiempo.

Pues perfecto, esto encaja perfectamente en lo que quería y ya lo tengo. Así que le digo que me escriba el guion en Notion. Y bueno, aquí tengo que decir que me esperaba algo más completo. Como ya os he dicho, parece más una guía de storytelling del vídeo que otra cosa. Imagino que para estas cosas ahora le podría decir que utilice Codex, que tiene más ventana de contexto, y aunque está hecho para programar, podría sugerirle que lo utilizase para escribir este guion.

Y bueno, si quisiese gastar dinero de verdad (porque todo esto me está saliendo relativamente gratis o barato), le podría pedir a Opus 4.6 que lo hiciese, que es un modelo bastante más potente. Pero no tengo la suscripción de Claude y no lo he visto necesario.


Esto no acaba aquí

Y con esto tendríamos el ciclo completo. Pero no solo se queda aquí, sino que puedo ahondar más. Le puedo dar permisos en GitHub y enseñarle cómo funciona mi blog. Y en base a lo que ya tenga escrito, una vez corrija todo el guion y grabe (porque me gusta primero grabar), le diría que me generase el post del blog. Así es, el blog lo hago después de grabar.

No lo tengo implementado todavía, pero se me ocurre que cogiendo el guion y el transcript del vídeo que genere, le puedo decir que me escriba el blog. Pero que lo haga automáticamente, que tenga permisos en GitHub y me haga una pull request con los cambios. Porque si mi blog está en GitHub, ¿dónde iba a estar si no? Es otra cosa que seguramente acabe implementando.


Para terminar

Bueno, no quiero enrollarme más. Coged todas las ideas que queráis para vuestros negocios. Dejadme en los comentarios a ver qué automatizaciones estáis haciendo vosotros, me interesa saber porque quizás aprendo algo que yo no sé. Incluso si creéis que esto se puede mejorar o se puede hacer de diferente manera y mejor, dejádmelo, quiero saberlo, quiero escucharos.

Si queréis un vídeo en concreto de otra automatización, también lo mismo, dejádmelo que yo os voy a leer.

Y si necesitáis un VPS para montar todo esto, ya sabéis, echadle un vistazo a HostGator que tienen planes muy bien de precio y os va a sobrar de potencia para correr OpenClaw y lo que le queráis meter.

Por mi parte agradeceros si habéis llegado hasta aquí porque habéis aguantado toda esta turra. Y eso es todo amigos, muchas gracias y nos vemos en el próximo.


¿Qué te ha parecido?

Déjame tu opinión, pregunta o sugerencia. Los comentarios se sincronizan con GitHub Discussions .

Volver al blog