Blog Logo

MiniMax Code y el salto de usar un agente a montar un equipo

Hay una forma de usar IA que mucha gente todavia no ha terminado de pillar. Primero estuvo la fase de usarla como un chat glorificado: preguntas, emails, dudas sueltas y poco mas. Luego llego la fase de meterla dentro del editor y dejar que toque archivos, que ya es bastante mas util. Pero entre eso y montar un flujo serio hay otro salto, y justo de eso va este video: de dejar de tratar a la IA como un unico empleado para todo y empezar a tratarla como si fuese un equipo con roles separados. Si te pica la curiosidad por la herramienta, tienes el plan de MiniMax aqui.

La idea parece obvia cuando la oyes en voz alta. En una empresa no dejas que la misma persona haga el trabajo, se autocorrija, se ponga la nota y encima te diga que todo esta perfecto. Con los agentes hacemos eso constantemente. Le pides a Claude Code, Cursor o Codex que construyan algo y luego le pides al mismo sistema que lo revise. Y claro, sorpresa ninguna: casi siempre te dira que esta bastante bien.


El problema de fondo no es solo el modelo

Lo interesante del planteamiento de Edu no es vender humo con que ahora ha salido otro modelo milagroso. La tesis del video es bastante mas sensata: cuando una tarea se alarga, el contexto se llena de barro, el agente empieza a perder el hilo y la calidad cae. Eso pasa en codigo, pero tambien en cualquier tarea compleja donde mezclas analisis, ejecucion, revision y correcciones dentro de la misma sesion.

Por eso insiste tanto en separar papeles. Uno ejecuta, otro revisa sin haber visto el proceso y, si algo falla, se devuelve. Esa parte de revision adversarial es la gracia real de MiniMax Code, que en el video aparece como una app de escritorio para Mac y Windows donde montas varios agentes trabajando a la vez y donde, ademas, todo se queda corriendo en tu propio ordenador.

Ese detalle local no es precisamente menor. Si trabajas con repos privados, documentos internos o cualquier historia que no te apetezca mandar a servidores ajenos, que el contexto, los archivos y la memoria se queden en tu maquina cambia bastante la pelicula.

Tambien se comenta el modelo que hay por debajo, MiniMax M3, y aqui el mensaje importante no es solo el benchmark. Se destaca que compite en la liga alta, que tiene hasta un millon de tokens de contexto y que es multimodal de verdad. Y esto ultimo en el video no se queda en la teoria, porque la primera demo va exactamente por ahi.


Lo que se ve en la demo de verdad

Aqui hay una diferencia importante entre el guion y lo que realmente se enseña en pantalla. En la grabacion no se hace solo una auditoria abstracta de repositorios. Primero hay una demo bastante mas visual: Edu le pasa capturas de una tienda online a MiniMax Code y le pide que le monte una ficha parecida. No le da un briefing eterno ni una especificacion obsesiva. Le da imagenes, deja trabajar al sistema y lo que sale es una replica bastante convincente, con galeria, productos, carrito y una UI que se parece mucho a la referencia. No todo estaba perfecto, y de hecho el propio video ensena algun fallo y algun elemento inventado por el agente, pero precisamente por eso la demo resulta mas creible.

Luego llega la parte que, para mi, tiene mas chicha: abre su propio blog y le pide una mejora bastante concreta. Hasta ese momento, publicar un post nuevo implicaba crear el fichero MDX a mano dentro del repo. La tarea que le pasa al sistema es montar una interfaz de administracion para crear posts, subir imagenes al CDN y programar la publicacion. Y aqui es donde se ve mejor la idea del equipo de agentes.

MiniMax Code arranca con varios roles ya preparados. Aparece un coder, un verifier y un agente generalista. En mitad de la demo, Edu crea ademas un planner en lenguaje natural, sin rituales raros ni configuraciones de ingenieria espacial. Ese planner se pone a trabajar en paralelo con el coder, mientras el verificador queda listo para meter el dedo en la llaga cuando haga falta. El resultado final no es una promesa vaga: acaba apareciendo un panel de administracion real en la ruta /admin, con los posts existentes, campos editables, soporte para varios idiomas, programacion de fecha de publicacion y hasta busqueda por contenido.

Y esto es importante contarlo asi porque es lo que realmente cambia el tono del video. No te esta ensenando solo un concepto bonito de “agentes especializados”. Te esta ensenando que, con una instruccion bien tirada, el sistema le monto una pieza util para su flujo editorial de verdad.


Donde si se nota la diferencia frente a Claude Code o Codex

La comparativa que plantea el video tiene bastante sentido. En herramientas como Claude Code o Codex, una tarea grande suele avanzar paso a paso, dentro del mismo hilo y con el mismo agente cargando con todo el contexto. Si se equivoca, o lo pillas tu o se cuela. Aqui la apuesta es otra: que varios agentes curren en paralelo y que el que verifica no venga contaminado por haber participado en la implementacion.

Ademas, en la demo se ensenan dos detalles que no son tan vistosos como una UI nueva, pero que para uso diario pesan bastante. El primero es la memoria local por proyecto. Edu remarca que el sistema guarda contexto de como esta organizado el repo, de como trabaja el usuario y de que se ha hecho antes, todo en archivos editables en local. El segundo es el tema operativo: puedes programar tareas para que corran a una hora concreta y hasta lanzarlas desde Telegram conectado a tu PC. De hecho, en el video monta el bot en directo, pregunta desde el movil y luego restringe el acceso para que no quede abierto a cualquiera. Ese matiz de seguridad tambien merecia quedarse en el articulo porque no es adorno, es sentido comun.

Con todo eso, la sensacion que deja la demo no es tanto “este modelo escribe mejor codigo” como “este harness esta mejor pensado para trabajo largo”. Y honestamente, creo que esa es la lectura correcta.


El patrocinio encaja, pero lo que importa es otra cosa

Si, el video esta patrocinado por MiniMax y se nota porque se habla de planes, descuento y descarga. Pero para ser justos, el patrocinio encaja con lo que se esta demostrando. No meten una mencion que no pinta nada a mitad de una reflexion tecnica. La herramienta es el propio tema del video.

Sobre el precio, lo que se comenta es un sistema de suscripcion por tokens compartidos entre codigo, imagen, voz y otros formatos, en vez de separar cada cosa en cajones distintos.

Ahora bien, lo mas valioso del video no me parece el descuento ni siquiera la app en si. Lo valioso es la idea de fondo: si vas a trabajar de forma agentica en serio, deja de pensar en un agente unico para todo. Separa roles, reduce autocontaminacion, deja espacio para que alguien revise y no conviertas cada flujo en una conversacion infinita donde el mismo sistema produce, se justifica y se absuelve.

MiniMax Code lo empaqueta bien y la demo deja claro por que ese enfoque puede ser mas fiable. Luego ya cada uno decidira si le compensa esta herramienta, otra o montarselo por su cuenta. Pero el cambio mental importante no va de marca. Va de entender que, en cuanto el trabajo se complica, un equipo suele ganar a un llanero solitario.

Si llevabas tiempo usando agentes como si fueran un chat con esteroides, este video tiene una cosa buena: te obliga a replantearte el flujo. Y eso, para que enganarnos, vale mas que muchas demos perfectas donde todo sale bien a la primera. Y si ademas quieres echarle un ojo a MiniMax, lo tienes aqui.


¿Qué te ha parecido?

Déjame tu opinión, pregunta o sugerencia. Los comentarios se sincronizan con GitHub Discussions .

Volver al blog