Volver al inicio

GLM 5.3 y Freebuff: un agente de IA totalmente gratuito en tu escritorio

Fatih Bellisoy combina el GLM 5.3 de Z.ai con el agente de escritorio Freebuff para crear apps 3D a partir de un solo prompt, abrir sesiones por hora con 25 tokens diarios y lanzar una herramienta de chat con IA sobre canvas en unos 15 minutos.

Importado a Nodesdaily: (UTC+03:00)
Ver en YouTube — kuSM8kw0LHU
Opciones de lectura

La voz del dispositivo no está disponible en este navegador.

Lupa de conceptos

Elige un término técnico de esta vista para leer su definición general, un ejemplo didáctico y su uso en el artículo.

No se encontró ningún término de nuestro glosario en esta vista. El glosario aún no cubre todos los términos.

En este video, Fatih Bellisoy recorre un agente de IA que presenta como utilizable sin ninguna suscripción ni clave API, construido en torno al GLM 5.3 de Z.ai. El modelo se presenta como un sistema de uso de computadora para tareas de escritorio, planificación a largo plazo y diseño de flujos de trabajo complejos. La posibilidad de experimentar sin presión de costos es la razón por la que ahora lo usa en sus propios proyectos.

GLM 5.3 mantiene la misma base que GLM 5.2; cada mejora proviene de escalar el post-entrenamiento. El equipo combinó IndexShare para la eficiencia en contexto largo, SAO para RL en horizontes largos y slime para entrenamiento asíncrono a gran escala, y luego amplió el conjunto de entornos de tareas recopilados durante meses. La variante Flash parte de una base recién entrenada: 320 mil millones de parámetros totales con solo 18 mil millones activos, un híbrido de atención dispersa y lineal más Hyper-Conexiones con restricción de variedad que reduce el cómputo de atención en 3x y el caché KV en 4,4x con contexto de 1M; en Z.ai Code Bench, Flash salta de 46,2 en 5.2 a 63,4, acercándose a Claude Opus 4.8.

La primera demo es deliberadamente tosca: un único prompt corto para una suite de hotel 2+1 en 3D por la que puedes caminar. El resultado no es perfecto, pero un espacio navegable a partir de una frase valida la idea de incorporar la retroalimentación visual al bucle de codificación.

El segundo proyecto es un centro de control personal, aún inacabado, que orquesta varios agentes y muestra datos de trabajo en vivo — métricas sociales, conteos de vistas y últimos videos en un solo lugar. Está incompleto pero se ha impulsado con GLM 5.3 sin costo adicional. El panel muestra que el agente puede leer el contexto del escritorio más allá de solo escribir código.

La tercera demo es un juego de ajedrez en 3D, también a partir de un solo prompt. El juego avanza con fluidez, los turnos se alternan y las animaciones funcionan sin fallas. El modelo del caballo es débil en estética, pero lanzar un juego interactivo con reglas correctas a partir de un comando breve demuestra que el modelo puede manejar el front-end y la lógica del juego juntos.

También puedes probar el modelo en la web. La superficie de chat de Z.ai ofrece GLM 5.3 y una opción Flash más rápida con plantillas para diapositivas y apps web. En escritorio, la vía normal es el acceso API con facturación por uso: Z.ai lista GLM 5.3 a $1,40 por millón de tokens de entrada y $4,40 por millón de tokens de salida, con entrada en caché a $0,26, mientras que la variante Flash baja a $0,15 de entrada y $0,50 de salida y $0,03 en caché. Flash alcanza 57 en el Artificial Analysis Intelligence Index a $0,045 por tarea, ofreciendo inteligencia similar a aproximadamente una décima parte del precio. Freebuff afirma anular esa factura con soporte publicitario.

Después de descargar Freebuff, eliges una carpeta vacía; el agente obtiene acceso de lectura y escritura a ese espacio de trabajo. En el selector de modelos, GLM 5.3 Flash aparece como recomendado. El servicio otorga 25 tokens por día, y 5 tokens compran una sesión de una hora en GLM 5.3. También se listan alternativas — Mimo 2.5 a 10 tokens por hora, DeepSeek V4 Flash a 25 — y también puedes conectar Claude Code o Codex con tu propia clave. La sesión no comienza al abrir la app sino con tu primer mensaje, iniciando una cuenta regresiva de una hora.

Para la construcción final se activa el modo de planificación para crear una interfaz de chat sobre un canvas donde las respuestas pueden fijarse como notas. El agente hace preguntas de alcance, redacta un plan detallado y espera la aprobación antes de escribir código. Tras la revisión, la app permite seleccionar una respuesta y añadirla al canvas, algo que el anfitrión encuentra útil para el aprendizaje de idiomas. Incluyendo la configuración y pequeñas correcciones, la construcción tomó unos 15 minutos.

Visualization: nodesdaily AI

Comentario de la IA

""Lo que más me impactó no fue el precio sino la sensación de libertad — la sesión por hora comienza con el primer mensaje, no al abrir la app, y el plan requiere tu aprobación antes de ejecutar cualquier código.""

Evaluación de la IA

La réplica más fuerte a este video, a mi juicio, es que una escena 3D llamativa de un solo prompt no es código de producción. Sin medidas de cobertura de pruebas, mantenibilidad o costo total en el tiempo, lo gratuito puede verse mejor de lo que es. La propia tabla de Z.ai muestra GLM 5.3 con 88,2 en Terminal Bench 2.1, pero en benchmarks de explotación de etapas posteriores sigue detrás de GPT-5.6 Sol y Mythos 5; escalar el post-entrenamiento no eleva cada peldaño por igual.

Los límites que el video no menciona importan en la práctica. Z.ai retrasó los pesos abiertos unas dos semanas porque la capacidad cibernética creció más rápido de lo esperado — ExploitBench más que se duplicó, de 24,4 a 54,4, y ExploitGym saltó de 29 a 105 tareas en dos horas, forzando un endurecimiento adicional. En Freebuff, 25 tokens al día significan unas cinco horas, el modo completo está disponible en más de 25 países y en otros lugares se recurre a un modo limitado tras VPNs, y aunque los anuncios de texto financian el nivel gratuito, la transparencia sobre el manejo de datos y el enrutamiento del tráfico sigue siendo escasa.

En cuanto a incentivos y verificabilidad, mantengo separados dos números. Mantener el precio API de GLM 5.3 fijo en $1,40 de entrada / $4,40 de salida suena estable, pero la factura real se mueve con la ventana de contexto, el caché y si te enrutan a Flash a $0,15 / $0,50 y $0,03 en caché — etiquetas distintas para productos distintos. El enrutamiento financiado por publicidad de Freebuff no ha sido auditado de forma independiente; para un agente de escritorio con acceso a carpetas, los rastros de red y la política de selección de modelos merecen una verificación de segunda fuente antes de concederle un repositorio sensible.

En mi propio uso, ubico este stack como ideal para estudiantes, desarrolladores en solitario y equipos con presupuesto ajustado que quieran prototipos rápidos, experimentos 3D o un tablero de aprendizaje de idiomas mediante GLM 5.3 Flash en Freebuff; lanzar un chat fijado en canvas en unos 15 minutos es una ganancia real de velocidad. Para trabajo empresarial que requiera cumplimiento, pistas de auditoría o privacidad estricta en contextos largos, esperar a que los pesos estén abiertos y el modelo publicitario sea más claro es la opción más prudente.

Fuentes

8 enlaces; 1 de ellos también citados por 1 otra noticia. Stories sharing a link do not confirm each other; a source's origin is not inferred from how often it is cited.

glm 5.3 · freebuff · z.ai · agente de ia · agente de escritorio · ia gratuita · agente de codificación

Seguir el tema

Antes de esta noticia

Un breve orden de lectura de noticias anteriores vinculadas a este evento por un editor.

Evidencia y fuentes

Revisa los pasajes permitidos, sus versiones y su origen.

KAYNAKLARLA OKU

Bu haberi açalım.

Hesap kontrol ediliyor…

GLM 5.3 y Freebuff: un agente de IA totalmente gratuito en…