Claude Code cobra por el uso real de la API de Anthropic, y el plan gratuito de Claude.ai te da un cupo chico de mensajes por día. Si viste el tip de FreeLLMAPI y querés el paso a paso real para dejar de pagarle a la API oficial, es esto: instalar FreeLLMAPI en tu máquina y apuntar Claude Code ahí con una sola variable de entorno.
Qué es FreeLLMAPI y por qué sirve para esto
FreeLLMAPI es un proyecto open source que agrega el free tier de unos 34 proveedores de modelos de lenguaje (Google, Groq, Mistral, entre otros) detrás de un único endpoint local. Ese endpoint imita tanto la API de OpenAI como la Messages API de Anthropic, así que Claude Code lo puede usar como si fuera la API oficial, sin que nadie tenga que tocar el código de Claude Code. Corre en tu propia máquina (o en un servidor tuyo), no en la nube de un tercero: vos cargás tus propias API keys gratuitas de cada proveedor y el sistema las guarda cifradas en local, según el repositorio del proyecto.
La diferencia con la vía más conocida de "Claude Code gratis" (usar Ollama con un modelo corriendo en tu computadora) es que ahí necesitás una placa de video con memoria suficiente para el modelo. Con FreeLLMAPI los modelos corren en la nube de cada proveedor: tu máquina sólo enruta el tráfico.

¿Quieres que tus devs entreguen 3x más con Claude Code?
Sin reescribir el repo. Sin formaciones largas. Sin tocar tu stack.
Agendar llamadaCómo instalar FreeLLMAPI
La instalación más rápida es con un script:
curl -fsSL https://freellmapi.co/install.sh | bash
También hay opciones con Docker, Docker Compose, en local con Node, o como app de escritorio para Mac y Windows. Una vez instalado, el paso siguiente es cargar tus API keys gratuitas de los proveedores que quieras usar (por ejemplo, la key gratuita de Google AI Studio o de Groq). Sin al menos una key cargada, el router no tiene a dónde mandar las requests.
Cómo conectar Claude Code a FreeLLMAPI
Con FreeLLMAPI corriendo y con al menos una key cargada, quedan dos pasos del lado de Claude Code:
- Instalar Claude Code de forma global, si todavía no lo tenés:
npm install -g @anthropic-ai/claude-code
- Setear la variable de entorno que le dice a Claude Code a qué servidor mandar las requests, en vez de a la API paga de Anthropic:
export ANTHROPIC_BASE_URL=http://localhost:3001/v1
claude
Desde ese momento, cada mensaje que le mandes a Claude Code sale hacia tu FreeLLMAPI local, que a su vez lo reparte entre los proveedores gratuitos que tengas cargados. La interfaz, los permisos y los plugins de Claude Code siguen siendo los mismos: lo único que cambió es el backend que responde. Si además querés bajar el consumo de tokens por sesión (algo que ayuda incluso con backends gratis, porque cada proveedor tiene su propio límite), la guía para ahorrar tokens con un archivo CLAUDE.md suma en el mismo sentido.
FreeLLMAPI vs Claude.ai gratis vs Ollama local
Las tres vías conocidas para no pagar la API de Anthropic con Claude Code parten de necesidades distintas:
| Vía | Qué necesitás | Límite principal |
|---|---|---|
| Plan gratuito de Claude.ai | Sólo una cuenta | Cupo chico de mensajes por día |
| Ollama local | GPU propia con memoria suficiente | El modelo corre en tu hardware |
| FreeLLMAPI | API keys gratuitas de terceros | Rate limit de cada proveedor |
Ninguna es "mejor" en todos los casos. Si tenés una GPU potente sin usar, Ollama te da control total, como explica la guía de Claude Code gratis con Ollama. Si no tenés GPU pero sí paciencia para sumar un par de API keys gratuitas, FreeLLMAPI te da acceso a modelos más grandes sin depender de tu hardware. Y si lo que buscás es comparar directamente las distintas formas de usar Claude en general, sumá la nota sobre 3 formas de usar Claude y cuál vale la pena.
Límites reales de este método
Vale ser honesto con lo que este método no resuelve. Cada proveedor gratuito tiene su propio rate limit, así que en sesiones largas el router puede rotar de modelo en medio de una tarea, y la calidad de respuesta va a depender del modelo que esté detrás en ese momento (no siempre va a ser tan bueno como el modelo pago de Anthropic). Tampoco es una vía pensada para equipos: FreeLLMAPI está armado para uso individual y local, no como servicio compartido para varias personas a la vez. Y como con cualquier free tier de terceros, las condiciones de cada proveedor pueden cambiar sin aviso.
Para uso personal, para probar Claude Code sin comprometerte a pagar, o para tareas donde no necesitás el modelo más potente del mercado, es una vía real. Si en algún momento tu volumen de trabajo justifica pagar la API oficial o un plan de Claude.ai, siempre podés volver a sacar la variable ANTHROPIC_BASE_URL y Claude Code vuelve a hablar directo con Anthropic.
Seguir leyendo
Si querés seguir bajando el costo de usar Claude Code o comparar otras vías, estas notas suman:
Instalás Claude Code y Remotion, le escribís qué querés y te devuelve el reel editado: silencios cortados, tu LUT, subtítulos, animaciones y sonido. Con los pedidos para copiar.

¿Quieres que tus devs entreguen 3x más con Claude Code?
Sin reescribir el repo. Sin formaciones largas. Sin tocar tu stack.
Agendar llamadaPreguntas frecuentes sobre Claude Code gratis con FreeLLMAPI
Es un proyecto open source que junta el free tier de unos 34 proveedores de modelos de lenguaje (Google, Groq, Mistral y otros) detrás de un único endpoint que corre en tu propia máquina. Ese endpoint habla el mismo idioma que la API de OpenAI y también el de la Messages API de Anthropic, así que cualquier herramienta pensada para Claude, incluido Claude Code, puede apuntarle sin que la tengas que modificar. No es un servicio en la nube de un tercero cobrándote: lo instalás vos, con tus propias credenciales gratuitas, según el repositorio oficial en GitHub.
Primero instalás FreeLLMAPI en tu máquina (script de instalación o Docker) y cargás ahí tus API keys gratuitas de los proveedores soportados. Después instalás Claude Code de forma global con npm install -g @anthropic-ai/claude-code, si todavía no lo tenés. El paso clave es setear la variable de entorno ANTHROPIC_BASE_URL apuntando a la dirección local donde quedó corriendo FreeLLMAPI, antes de abrir una sesión con el comando claude. Desde ese momento, cada request de Claude Code sale hacia tu FreeLLMAPI en vez de ir a la API paga de Anthropic. Podés confirmar que el consumo real bajó revisando la lista completa de comandos y trucos de límite de uso.
FreeLLMAPI está pensado para correr en modo local, de un solo usuario: según su propia documentación, las keys que cargás quedan cifradas en tu máquina y no se mandan a ningún servidor externo del proyecto. El riesgo real no es de FreeLLMAPI en sí, sino de cada proveedor individual: cada free tier tiene su propio límite de uso y sus propias condiciones, así que conviene leerlas antes de sumar una key. Si un proveedor corta el acceso gratuito, simplemente dejás de usarlo desde ahí y seguís con los demás que tengas cargados en el mismo router, siguiendo los mismos pasos de la sección cómo conectar Claude Code a FreeLLMAPI de esta guía.
No, son dos cosas distintas y se complementan. El plan gratuito de Claude.ai te da un cupo chico de mensajes por día en la web o en la app, algo que ya cubrieron guías como la comparativa de vías gratuitas para usar Claude Code. FreeLLMAPI, en cambio, no te da acceso a los modelos de Anthropic gratis: te deja correr Claude Code contra otros modelos (de Google, Groq, Mistral, etc.) usando la interfaz y los permisos de Claude Code, pero sin pagar la API oficial de Anthropic. Es una alternativa para cuando el cupo gratuito de Claude.ai no te alcanza y no querés pagar por token.
Cada proveedor que soporta FreeLLMAPI tiene su propio tope de uso gratuito por día o por minuto, y el router va rotando entre los que tengas disponibles cuando uno se corta por rate limit. Si se te terminan todos al mismo tiempo, tenés tres caminos: esperar a que se reinicien al otro día, sumar la key gratuita de otro proveedor soportado, o bajar el consumo real de tokens por sesión con hábitos como los que explica la guía para ahorrar tokens en Claude Code. Ese último punto importa incluso usando backends gratis: menos tokens por tarea significa menos probabilidad de pegar contra el límite de cualquier proveedor.
Fuentes e inspiración
Mira los posts originales donde desarrollamos estas ideas en redes.
Llévate el próximo en tu correo
NewsletterUn mail al mes con el próximo recurso.







