Ir al contenido
Mercury .

Mercury Flux es la capa de optimización de costos en AI de Mercury Technology Solutions: un enrutador multimodelo que envía cada tarea al nivel más económico capaz (local, económico, medio, premium), verifica la calidad con pruebas deterministas y aprende de los resultados. Es la actualización rentable de Mercury Core y puede ejecutarse como un Booster Pack sobre Core o como un servicio independiente.

Orquestación multimodelo, optimización de costos LLM, enrutamiento de agentes, puertas de calidad, registros de tokens, inferencia autoalojada

Mercury Technology Solutions, Mercury Flux, Mercury Core, Herdr Core, OpenClaw, Flux Cloud, Flux Intel

Capa de costos para Mercury Core · compatible como servicio independiente

Gasto en AI que fluye hacia el modelo correcto.

Mercury Flux es la actualización rentable de Mercury Core. Enruta cada tarea de AI al modelo más económico capaz de ejecutarla con calidad — premium, económico o tus propias GPU — y demuestra su eficacia con pruebas reales antes de cualquier lanzamiento. Ejecútalo en Core o como un servicio independiente.

Actualización rentable de CoreServicio independienteControl de calidad integrado

Reducción de costos típica del 60–75 % · cero bloqueo de proveedor · núcleo de código abierto

ENCAMINADOR FLUX — EN VIVO
TAREAS0 inFLUXclasificación · enrutamientolocal · autoalojado$0económico · clase Haiku$medio · clase DeepSeek$$premium · clase Opus$$$
Tareas enrutadas
0
Porcentaje premium
0%
Ahorro en esta ejecución
$0.00
línea base todo premium $0.00enrutado por FLUX $0.00
Definición

Qué es Mercury Flux

Mercury Flux es la capa de optimización de costos de IA de Mercury Technology Solutions. Es la actualización rentable para Mercury Core: un enrutador multimodelo que envía cada tarea al nivel más económico capaz (local, económico, intermedio, premium), verifica la calidad con pruebas deterministas y registra cada token. Instálelo como Booster Pack en Mercury Core o ejecútelo como servicio independiente sin necesidad de licencia del Core.

Puntos clave

Lo que la alta dirección debe tener presente

  • Flux es la actualización rentable para Mercury Core: misma familia, camino más económico.
  • También funciona de forma independiente. No se requiere licencia del Core para enrutar, registrar o verificar.
  • El ahorro típico es del 60–75 % frente a una línea base totalmente premium en trabajos de dificultad mixta.
  • La calidad está garantizada mediante pruebas reales. Los modelos económicos no pueden deteriorar en silencio los resultados.
  • Herdr Core es de código abierto. Flux Cloud y Flux Intel son capas comerciales opcionales.
01 / El problema

Estás pagando de más por inteligencia que no utilizas.

$$$ → $

Precios premium para tareas básicas

Renombrar claves de configuración no requiere un modelo de $15/M-token. El 70 % de tu carga de trabajo tampoco, pero por eso es lo que estás pagando.

1 proveedor

Dependencia de un único proveedor

Cada cambio implica reescrituras, nuevas pruebas y renegociaciones. Por eso nunca te mueves... y el equipo de precios de tu proveedor lo sabe.

???

Una factura en caja negra

El gasto en IA se refleja en la tarjeta de crédito sin desglose por funcionalidad, proyecto o cliente. Suerte defendiéndolo en la revisión presupuestaria.

02 / Cómo funciona

Una única capa entre tu organización y cada modelo.

Flux se posiciona por encima de los proveedores. Intercambia cualquier modelo editando una única línea de configuración... adopta el modelo más rentable del próximo trimestre esta misma tarde, no en el siguiente sprint.

1

Triaje

Un clasificador ligero evalúa el nivel de dificultad de cada tarea... de trivial a experto... por fracciones de centavo.

2

Enrutamiento

Las tareas se dirigen a la capa más rentable y viable: local → económico → medio → premium. La ejecución especulativa prioriza siempre las opciones de menor costo.

3

Validación

Las pruebas deterministas se ejecutan en un sandbox antes de que cualquier modelo procese la solicitud. Las aprobaciones inestables reciben una segunda opinión.

4

Aprendizaje

Los resultados retroalimentan el sistema de enrutamiento. El motor se vuelve más preciso y rentable cada semana que está en operación.

router.config.yamltoda tu integración
# Four lines of config. No rewrites.
stages:
  executor:
    tier: mid              # Flux speculatively tries cheaper first
    fallback_tier: premium
budget:
  projects:
    client_a: 500000    # hard cap, enforced before every call

Compatible con los proveedores que ya pagas... Claude, GPT, DeepSeek, Qwen o tus propias GPUs de vLLM/Ollama.

03 / Los números

Medido en tu carga de trabajo real, no en nuestra presentación.

60–75%
reducción típica de costos frente a una línea base 100% premium
$0
costo marginal en la capa local autoalojada
<1 day
para adoptar un modelo recién lanzado
100%
de tokens contabilizados por proyecto, totalmente auditable

Los ahorros dependen de la mezcla de carga de trabajo... el dashboard de Flux muestra exactamente el tuyo, basado en tus propias ejecuciones. Las cifras se comparan con una línea base 100% premium en trabajos de dificultad mixta.

04 / Por qué los equipos eligen Flux

Un activo que genera valor compuesto, no un gasto que solo aumenta.

Conoce tu base de código

El router de aprendizaje monitorea qué capa funciona mejor para cada tipo de tarea en tus repositorios y se ajusta automáticamente. Tu inteligencia de enrutamiento nunca abandona tu infraestructura.

La calidad está garantizada, no es una esperanza

Las suites de pruebas reales validan cada cambio; las aprobaciones con baja confianza activan una segunda opinión automática. Los modelos económicos no pueden degradar silenciosamente el resultado.

Siempre operativo

Cortacircuitos por proveedor con conmutación automática hacia el siguiente nivel. La caída de un proveedor no afecta su operación.

Diseñado para agencias

Presupuestos estrictos por proyecto impiden que el Cliente A consuma los tokens del Cliente B. Cada dólar está asignado y cada ejecución queda registrada en la contabilidad.

Compatible con autoalojamiento

Enruta el trabajo rutinario a tus propias GPU con costo marginal cero. Alquila lo impredecible y adquiere lo predecible.

Listo para el CFO

Gasto por proyecto, etapa y función — con el ahorro frente a la línea base en un solo panel de control. La IA pasa de ser un gasto opaco a un portafolio gestionado.

05 / Open Core

Abierto en el núcleo. Tuyo en los bordes.

El motor de enrutamiento es de código abierto: audítalo, realiza un fork, autoaloja la solución y nunca nos pagues un centavo. Las capas comerciales añaden inteligencia alojada.

Código abierto

Herdr Core

Gratis · para siempre

  • Motor de enrutamiento completo + escalera de 4 niveles
  • Enrutador de aprendizaje + seguimiento de resultados
  • Libro contable local y panel de costos
  • Cortacircuitos y conmutación por error
Nube

Flux Cloud

Por proyecto · se paga solo con un día de suscripción premium ahorrado

  • Todo lo incluido en Herdr Core
  • Paneles de control alojados y sistema de alertas
  • Presupuestos y roles del equipo
  • Alertas de costos por Slack / webhook
Empresa

Flux Intel

Personalizado

  • Todo lo incluido en Flux Cloud
  • Puntos de referencia de enrutamiento entre flotas a partir de datos anónimos con consentimiento
  • SSO, exportación de auditoría, SLA
  • Instalación del Booster Pack en Mercury Core
Preguntas frecuentes

Preguntas frecuentes

Mercury Flux es una capa de optimización de costos con IA. Enruta cada tarea al modelo más económico que pueda ejecutarla con eficacia, verifica la calidad mediante pruebas reales y registra cada token. Es la actualización rentable de Mercury Core y también puede ejecutarse como un servicio independiente.
A su disposición

Deje de pagar tarifas de nivel senior por trabajo de nivel junior.

cinco minutos para su primera ejecución enrutada · núcleo con licencia MIT