Back to flin
flin

AI Gateway: 8 proveedores, una API

Cómo el AI Gateway de FLIN proporciona una interfaz unificada para OpenAI, Anthropic, DeepInfra, Google, Mistral, Cohere, Groq y modelos locales -- cambie de proveedor modificando una línea de configuración.

Juste A. Gnimavo (Thales) & Claude | March 26, 2026 3 min flin
EN/ FR/ ES
flinrust

El panorama de la IA en 2026 está fragmentado. OpenAI tiene GPT-4o. Anthropic tiene Claude. Google tiene Gemini. Mistral tiene sus modelos de pesos abiertos. Cohere se especializa en embeddings. Groq ofrece inferencia a una velocidad extraordinaria. DeepInfra aloja docenas de modelos de código abierto. Cada proveedor tiene su propio formato de API, su propio esquema de autenticación, su propio modelo de precios y su propio SDK.

Una aplicación FLIN que usa IA no debería estar atada a un solo proveedor. Si OpenAI sube los precios, debería poder cambiar a DeepInfra. Si Anthropic agrega una función que necesita, debería poder probarla sin reescribir su código. Si quiere ejecutar localmente por privacidad, debería poder usar un modelo local.

El AI Gateway de FLIN proporciona una interfaz unificada para ocho proveedores. Su código FLIN llama a ai_complete(), ai_embed() y ai_chat(). El gateway enruta la solicitud al proveedor configurado, traduce el formato de API y retorna una respuesta normalizada. Cambiar de proveedor es una línea en flin.config.

La API unificada

Tres funciones cubren las operaciones de IA más comunes:

flin// Completación de texto
response = ai_complete("Summarize this article: " + article.content, {
    max_tokens: 200,
    temperature: 0.3
})

// Completación de chat
response = ai_chat([
    { role: "system", content: "You are a helpful assistant." },
    { role: "user", content: user_message }
])

// Embeddings
vector = ai_embed("comfortable office chair for long work sessions")

Estas funciones funcionan independientemente de qué proveedor esté configurado. La API es la misma ya sea que esté usando GPT-4o, Claude, Gemini o un modelo local Llama.

Los ocho proveedores soportados

ProveedorModelosMejor para
OpenAIGPT-4o, GPT-4o MiniPropósito general, visión
AnthropicClaude 3 Opus, Sonnet, HaikuContexto largo, razonamiento
GoogleGemini Pro, Gemini FlashMultimodal, velocidad
MistralMistral Large, Medium, SmallResidencia de datos europea
CohereCommand R+, Embed v3Embeddings, RAG
GroqLlama 3, MixtralLatencia ultra-baja
DeepInfra50+ modelos abiertosOptimización de costos
LocalOllama, llama.cppPrivacidad, offline

Implementación del gateway

El gateway traduce entre el formato unificado de FLIN y la API específica de cada proveedor:

rustpub trait AiProvider: Send + Sync {
    async fn complete(&self, prompt: &str, opts: &CompletionOptions) -> Result<String, AiError>;
    async fn chat(&self, messages: &[Message], opts: &ChatOptions) -> Result<String, AiError>;
    async fn embed(&self, text: &str) -> Result<Vec<f32>, AiError>;
}

Esta separación de responsabilidades es especialmente importante para el motor de intenciones y la búsqueda semántica, que son funciones centrales del lenguaje. No deberían dejar de funcionar porque se cambió de OpenAI a Anthropic.


Esta es la Parte 118 de la serie "Cómo construimos FLIN", que documenta cómo un CEO en Abidjan y un CTO de IA diseñaron y construyeron un lenguaje de programación desde cero.

Navegación de la serie: - [117] Búsqueda semántica y almacenamiento vectorial - [118] AI Gateway: 8 proveedores, una API (estás aquí) - [119] Integración de FastEmbed para embeddings - [120] RAG: recuperación, reranking y atribución de fuentes

Share this article:

Responses

Write a response
0/2000
Loading responses...

Related Articles

Thales & Claude zerosuite

Funciona, y no está terminado

El director recorrió él mismo todos los canales de senndo — cinco canales, de uno en uno y en campaña, la importación, las estadísticas, un reembolso, la API — y todo respondió. El archivo de seguimiento seguía diciendo que no, y la única línea que bloqueaba no era código: era un documento que había dejado de ser cierto en silencio. Cuatro afirmaciones ciertas al escribirse y falsas al leerse, y las guardas legibles por una máquina que ahora atrapan cada una de esas formas.

12 min Sep 14, 2026
senndocpaaslaunch-readinessdocumentation +8
Thales & Claude zerosuite

El navegador en manos de Claude: manejar el propio Chrome del CEO

Claude-in-Chrome permite que una sesión de Claude Code maneje el navegador real del director — mismo perfil, mismas sesiones abiertas. Qué hace la herramienta en realidad, por qué es mejor que pedirle a una persona que haga clic y lo cuente, y dónde el humano sigue ganando. Anclado en el día en que Claude recorrió un alta de cliente completa en la consola de producción de senndo, con mensajes facturados incluidos.

9 min Aug 18, 2026
claude-in-chromebrowser-automationclaude-codeclaude-fable-5 +9
Thales & Claude deblo

El segfault que no era nuestro: cómo lanzamos el tracking del día de lanzamiento de Déblo en la noche del despliegue — analítica condicionada por entorno, atribución nativa de las tiendas, tres bugs que el compilador no podía ver y un build sin memoria que diagnosticamos en lugar de revertir

El 1 de julio de 2026 — el día del lanzamiento — el riesgo nunca fue el texto. Era que las campañas de pago salieran a ciegas. Este es el build-log de cómo desplegamos la analítica y la atribución de instalaciones de Déblo como código en la noche del lanzamiento: etiquetas GA4, Meta y LinkedIn condicionadas por entorno que se despliegan sin riesgo antes de que existan las cuentas publicitarias; atribución enrutada por los canales nativos de las tiendas en lugar del pixel web; una auditoría adversarial que atrapó tres bugs que tanto el typechecker como el build dieron por buenos; y un despliegue en Easypanel que hizo segfault en el primer build — que demostramos que no era nuestro código antes de tocar una sola línea.

18 min Jul 1, 2026
deblolaunch-dayclaude-opus-4.8claude-code +26