🏭 Factory: la "fábrica de software" que quiere que dejes de escribir código línea a línea
Hay algo que me llamó la atención cuando empecé a probar Factory: no intenta competir con Cursor ni con Copilot en el terreno del autocompletado. Su apuesta es otra. Quiere que dejes de pensar en "escribir código" y empieces a pensar en "delegar trabajo de ingeniería". Después de un par de semanas usándolo, entiendo por qué han levantado 500 millones de dólares de valoración con una herramienta que, en esencia, hace lo que Claude Code promete pero desde una óptica distinta: la de una fábrica, no la de un asistente.

🔍 ¿Qué es exactamente Factory?
Factory es una plataforma de agentes de código autónomos fundada en 2023 por Matan Grinberg y Eno Reyes, con sede en San Francisco. La empresa nació después de que Grinberg, estudiante de doctorado en física teórica en UC Berkeley, enviara un correo en frío a Sequoia Capital y acabara dejando el doctorado para construir algo distinto en el espacio de la IA para programación.
El producto que importa hoy es Droid, un agente autónomo que opera en IDE, CLI, CI/CD y hasta Slack y Teams. No es un autocompletado. Es un contratista al que le describes una tarea, la planifica, edita archivos en todo el repositorio, ejecuta tests, y abre una pull request para que la revises.
¿Qué problema resuelve? La brecha entre "asistencia" y "ejecución". Las herramientas de autocompletado te ayudan a escribir más rápido, pero tú sigues conduciendo. Droid conduce solo y te pasa el volante cuando termina. El caso de uso ideal: tareas acotadas, verificables, con un "hecho" concreto. Actualizar dependencias, añadir un campo a través de todo el stack, escribir los tests que nunca escribiste, traducir un stack trace a un fix con test de regresión.
La empresa ha crecido a un ritmo notable. En abril de 2026 valía 1.500 millones. En julio, 4.000. En septiembre, 5.000 millones tras una ronda de 200 millones. Clientes: Nvidia, Adobe, Morgan Stanley, Royal Bank of Canada, Palo Alto Networks, EY.
🧩 Funciones principales
- Spec Mode (planificación previa): antes de tocar una línea, el agente genera una especificación revisable de lo que va a hacer. Tú la apruebas, la corriges, o la rechazas. Es la diferencia entre "confía en mí" y "esto es lo que voy a hacer, ¿te parece bien?".
- Missions (tareas largas y autónomas): más allá de una edición supervisada, puedes lanzar trabajos multi-paso que consumen tiempo y tokens, con el agente iterando sobre sus propios fallos hasta completar el objetivo o agotar la cuota.
- Soporte multi-modelo real (BYOK): no estás casado con un proveedor. Funciona con Claude, GPT, Gemini, DeepSeek, y cualquier API compatible. El agente enruta automáticamente cada subtarea al modelo más eficiente. Si Claude cae, redirige a GPT o Gemini sin que tú hagas nada.
- Droid Computers: entornos virtuales gestionados donde los agentes ejecutan tareas remotas. Guardan librerías, configuraciones y assets, eliminando la necesidad de reinstalar todo en cada sesión.
- Integración nativa con el flujo de trabajo: acepta tareas desde GitHub Issues, Linear, Slack, Sentry, y Notion. No tienes que copiar y pegar contexto.
- Niveles de autonomía configurables: desde revisión obligatoria de cada cambio (Spec Mode) hasta ejecución completamente autónoma con allow/deny lists configurables. Incluye Droid Shield, que protege variables de entorno y secretos.
- droid exec (modo headless): ejecución no interactiva para pipelines de CI/CD. Puedes lanzar tareas desde GitHub Actions o GitLab CI como si fuera un ingeniero junior automatizado.
- AutoWiki y documentación automática: genera documentación que explica el código y la refresca tras cada actualización. Un agente puede monitorear el código y generar sugerencias de troubleshooting.
✨ Lo que lo diferencia de otros
He usado Claude Code, Codex y Cline. Factory tiene tres diferencias que importan:
- Arquitectura multi-modelo como seguro contra caídas: el fundador lo dijo claramente: "Mientras Claude estaba caído, estábamos en llamadas con clientes. Es el mejor marketing, porque podemos decirles que Factory enruta dinámicamente a ChatGPT o Gemini". Ninguna otra herramienta de esta categoría ofrece esa resiliencia de forma nativa.
- Preparado para empresa desde el día uno: SOC 2, SSO SAML/SCIM, RBAC, retención cero, cifrado gestionado por el cliente, deployment on-prem y air-gapped. Factory persigue FedRAMP para clientes gubernamentales. Cosas que Cursor o Cline añadieron después, Factory las tenía desde el principio.
- Visión de "fábrica de software", no de asistente: Factory no quiere ser una herramienta que te ayude a programar. Quiere ser el sistema operativo de un equipo de ingeniería. Missions, Droid Computers, Automations y Analytics apuntan a coordinar todo el ciclo de vida del software, no solo la escritura de código.
- La promesa "one prompt to PR" cumplida (casi): acepta tareas desde Linear, GitHub, Slack o Sentry, y abre una pull request revisable. Es el flujo de trabajo más cercano a "delegar de verdad" que he probado.
🎯 ¿Para qué se usa en la práctica?
Factory brilla en trabajo acotado y verificable. No es una herramienta de exploración ni de escritura creativa. Es un ejecutor.
- Mantenimiento de dependencias: actualizar librerías y refactorizar los cambios de ruptura a través de todo el codebase. Uno de los casos de uso más citados y donde la autonomía tiene más sentido.
- Añadir campos a través del stack: migración, modelo, API, tipos, tests. Una tarea mecánica que consume horas y que un Droid completa sin que tengas que coordinar los cambios manualmente.
- Escribir tests ausentes: para módulos legacy sin cobertura. El agente lee el código, entiende el comportamiento, y genera los tests que faltan. Aburrido y valioso, exactamente el perfil de tarea ideal.
- Corrección de bugs con trazabilidad: le das un informe de bug con stack trace, y el agente produce un fix más un test de regresión que valida la corrección.
- Revisión de código automatizada: el agente revisa PRs, escanea seguridad, y genera descripciones de cambios. Factory 2.0 extiende esto a code review, análisis de seguridad, QA e incident response.
- CI/CD como ingeniero junior: integrado en pipelines para tareas repetitivas que nadie quiere hacer manualmente.
🚀 Cómo empezar
El setup es más directo que otras herramientas de su categoría, pero hay decisiones que tomar.
- Instala el CLI:
npm install -g @factory-ai/droid@latesto vía Homebrew. Requiere Node.js. - Crea una cuenta de Factory: el plan Pro ($20/mes) es el punto de entrada. No hay free tier permanente, lo que es una fricción real si quieres probar antes de pagar.
- Configura el proyecto: crea un archivo
AGENTS.mden la raíz del repositorio con comandos de build, test, y convenciones de código. Droid lo lee automáticamente. - Instala el plugin de IDE (opcional): VS Code o JetBrains. El plugin da a Droid contexto en tiempo real: archivos abiertos, errores, selecciones.
- Elige modelo y autonomía: selecciona el modelo (interno o BYOK) y el nivel de autonomía. Para empezar, Spec Mode es lo sensato.
- Lanza una tarea acotada: empieza con algo simple y verificable. "Añade un test para la función X" o "actualiza la dependencia Y y arregla lo que rompa".
💡 Trucos que marcan la diferencia
- Trata al Droid como un contratista en su primera semana: no como a un senior. Sabe el lenguaje y las herramientas, pero no sabe qué partes de tu código son críticas. Acota las tareas y el output mejora drásticamente. Pídele cosas vagas y rellenará los huecos con suposiciones.
- Crea un archivo AGENTS.md detallado: documenta comandos de build, test, lint, y convenciones de código. Droid lo lee automáticamente, así no tienes que repetir las mismas instrucciones en cada sesión.
- Usa un archivo de memorias personales: crea
~/.factory/memories.mdcon tus preferencias (arrow functions, indentación, frameworks de test). Droid lo consulta y las aplica. - Revisa las PRs autónomas con más sospecha que las humanas: un diff de agente está optimizado para parecer correcto y pasar los tests que ve. Es exactamente el perfil de cambio que esconde bugs en los huecos que tus tests no cubren.
- Usa Droid Core para tareas rutinarias: el pool de modelos open-weight gratuito tiene límites separados. Los modelos Core a menudo dan resultados comparables y estiran tu plan.
- Activa Extra Usage antes de lanzar Missions: las Missions no funcionan sin Extra Usage habilitado, aunque tengas cuota disponible. Es una trampa común.
🖥️ Dónde funciona
- CLI (terminal): la superficie principal y más potente. Es donde mejor funciona el flujo "one prompt to PR".
- VS Code y JetBrains: extensiones nativas que llevan el agente al editor sin cambiar tu entorno.
- Factory App (Desktop): interfaz gráfica para gestionar sesiones, usage y readiness dashboards.
- Slack y Teams: puedes asignar tareas directamente desde donde tu equipo ya conversa.
- CI/CD: modo
droid execpara pipelines de GitHub Actions, GitLab CI o Jenkins. - Windows/Mac/Linux: disponible en las tres plataformas principales.
- iOS/Android: no hay app móvil nativa. Es una herramienta de escritorio y terminal.
💰 Cuánto cuesta
Factory no tiene free tier real, y los saltos de precio son agresivos.
- Pro ($20/mes): Factory App, Droid CLI, Droid SDK, agentes en background (cloud y locales), y dashboards de billing y usage. Rate limits en ventanas de 5 horas, 7 días y 30 días. Es el punto de entrada real.
- Plus ($100/mes): aproximadamente 5x los límites de Pro, más Droid Computers gestionados para ejecuciones remotas.
- Max ($200/mes): aproximadamente 10x los límites de Pro, más acceso temprano a modelos frontier nuevos.
- Teams ($60/mes base + $40/asiento/mes): hasta 10 asientos, 10 horas/mes de Droid Computer compartido, facturación centralizada.
- Business y Enterprise: precio personalizado. SSO SAML/SCIM, retención cero, audit logging, deployment on-prem, FedRAMP para gobierno. Enterprise añade dedicated compute y customer-managed encryption keys.
Advertencia: los saltos entre Pro ($20), Plus ($100) y Max ($200) son 5x y 10x. Si tu flujo de trabajo se vuelve intensivo, el coste escala rápido. Y hay reportes de usuarios que han tenido problemas para cancelar suscripciones y se han encontrado con cargos no deseados.
👥 ¿Para quién es?
- Equipos con tickets limpios y tests sólidos: si tu equipo ya escribe tickets con contexto claro, mantiene cobertura de tests, y revisa cada cambio, Factory se integra sin fricción. Amplifica la disciplina que ya existe.
- Empresas que necesitan controles de seguridad: SOC 2, SSO, RBAC, retención cero, cifrado BYOK, deployment on-prem y air-gapped. Factory persigue FedRAMP. Cosas que otras herramientas añaden tarde, Factory las tenía desde el principio.
- Desarrolladores que quieren delegar, no asistir: si buscas un agente que haga el trabajo y te entregue un PR, Factory está diseñado para eso. Si prefieres el bucle interactivo de "sugerir y aceptar", Cursor o Copilot son más cómodos.
- Equipos pequeños que quieren amplificar capacidad: un Droid como "ingeniero junior" para tareas acotadas puede liberar a tus seniors para trabajo de diseño.
No es para: equipos con tickets de una línea y cobertura de tests pobre. El agente amplificará el desorden, no lo resolverá. Tampoco para usuarios individuales que buscan la opción más barata: Cline con modelos baratos o Copilot a $10 ofrecen más por menos si tu uso es esporádico.
🌍 Adopción global
Factory alcanzó una valoración de 5.000 millones de dólares en septiembre de 2026, tras una ronda de 200 millones liderada por Blackstone, con participación de Sequoia, Khosla Ventures e Insight Partners. La empresa acumula más de 400 millones en financiación.
La empresa reporta cientos de miles de desarrolladores usando la plataforma, con clientes enterprise de primer nivel: Nvidia, Adobe, Morgan Stanley, Royal Bank of Canada, Palo Alto Networks, EY, T-Mobile, Blackstone.
La adopción está concentrada en Estados Unidos y Europa, con presencia creciente en equipos enterprise que necesitan los controles de seguridad que Factory ofrece. El perfil de usuario es desarrollador profesional en equipos medianos o grandes, no hobbyistas. La empresa planea crecer a 300 empleados para finales de 2026.
⚖️ Lo bueno y lo no tan bueno
Lo que funciona bien:
- Resiliencia multi-modelo: el enrutamiento automático entre Claude, GPT, Gemini y DeepSeek significa que una caída de un proveedor no detiene tu trabajo. Es un seguro real, no marketing.
- Preparación enterprise real: SOC 2, SSO, RBAC, retención cero, cifrado BYOK, on-prem y air-gapped. Si tu empresa tiene requisitos de cumplimiento, Factory los cubre sin parches.
- Flujo "one prompt to PR": acepta tareas desde Linear, GitHub, Slack o Sentry, planifica, ejecuta y entrega una pull request revisable. Es el flujo más cercano a delegación real que he probado.
- Clientes enterprise validados: Nvidia, Adobe, Morgan Stanley, Palo Alto Networks. Si funciona para ellos, funciona para la mayoría.
Lo que no me convence:
- Sin free tier permanente: el plan Pro de $20/mes requiere pago antes de evaluar. Cursor, Cline y Claude Code ofrecen tier gratuito para probar. Esto crea fricción innecesaria.
- Saltos de precio agresivos: Plus ($100) y Max ($200) son 5x y 10x el precio de Pro. Si tu uso escala, el coste lo hace con saltos discretos, no gradualmente.
- Reportes de problemas de cancelación: hay usuarios que reportan dificultades para cancelar suscripciones y cargos no deseados. La gestión de billing parece ser un punto débil.
- Amplifica el desorden: en repositorios con convenciones implícitas, tickets vagos o tests débiles, el agente se pierde o produce cambios que parecen correctos pero no lo son. No es una herramienta para arreglar equipos desorganizados.
🆚 Comparativa con alternativas
| Factory | Claude Code | Cursor | |
|---|---|---|---|
| Enfoque | Fábrica de software: delegación multi-agente | Terminal interactiva con agente | Editor con IA integrada |
| Precio | $20-200/mes | $17-200/mes | $20-60/mes |
| Free tier | No | Limitado | Sí (Hobby) |
| Multi-modelo | Sí (enrutamiento automático) | Solo Anthropic | Sí (Anthropic, OpenAI, Gemini) |
| Enterprise | SOC 2, SSO, RBAC, on-prem, FedRAMP | SSO en planes altos | SSO en Business |
| Mejor para | Equipos con tests sólidos, delegación a escala | Trabajo interactivo en terminal | Desarrollo diario en editor |
Resumen: Factory es el más "fábrica de software" de los tres. Claude Code es más interactivo y está más maduro en el bucle de conversación. Cursor es el más cómodo para trabajo diario en editor. Si tu equipo tiene disciplina de tickets y tests, Factory puede ser el más productivo. Si no, amplificará los problemas existentes.
✅ Veredicto: ¿merece la pena?
Sí, para un perfil muy concreto. Factory no es para todo el mundo, y el precio y la falta de free tier real lo dejan claro.
Lo recomiendo si: tu equipo ya escribe tickets limpios y mantiene tests. Si necesitas controles de seguridad enterprise (SOC 2, SSO, RBAC, on-prem) que otras herramientas no ofrecen desde el principio. Si quieres delegar tareas completas y revisar PRs, no escribir código línea a línea. Si valoras la resiliencia multi-modelo como seguro contra caídas de proveedor. Si trabajas en un equipo mediano o grande donde la especialización y la coordinación aportan valor.
No lo recomiendo si: tus tickets son notas de una línea o tu cobertura de tests es pobre. Factory amplificará el desorden en lugar de resolverlo. Si quieres probar antes de pagar: no hay free tier real, y $20/mes duele si no estás seguro. Si tu uso es esporádico o personal: Cline con modelos baratos o Copilot a $10 te dan más por menos. Si te preocupa la gestión de billing: hay reportes de problemas con cancelaciones y cargos no deseados.
Factory es una herramienta para equipos que ya hacen las cosas bien. Si ese es tu caso, la productividad que desbloquea es real. Si no, el agente te va a mostrar exactamente dónde están tus problemas, y no de una forma amable.

Comentarios