Qué es Mercury Flux
Mercury Flux es la capa de optimización de costos de IA de Mercury Technology Solutions. Es la actualización rentable para Mercury Core: un enrutador multimodelo que envía cada tarea al nivel más económico capaz (local, económico, intermedio, premium), verifica la calidad con pruebas deterministas y registra cada token. Instálelo como Booster Pack en Mercury Core o ejecútelo como servicio independiente sin necesidad de licencia del Core.
Lo que la alta dirección debe tener presente
- Flux es la actualización rentable para Mercury Core: misma familia, camino más económico.
- También funciona de forma independiente. No se requiere licencia del Core para enrutar, registrar o verificar.
- El ahorro típico es del 60–75 % frente a una línea base totalmente premium en trabajos de dificultad mixta.
- La calidad está garantizada mediante pruebas reales. Los modelos económicos no pueden deteriorar en silencio los resultados.
- Herdr Core es de código abierto. Flux Cloud y Flux Intel son capas comerciales opcionales.
Una vía más rentable hacia Core — o un servicio independiente.
Mercury Flux es la actualización rentable de Mercury Core. En Core se integra como un Booster Pack: misma arquitectura de memoria, mismo centro de mando, gasto enrutado. Fuera de Core funciona como un servicio de orquestación independiente — instalable vía pip, optimizado para autoalojamiento y sin requerir licencia de Core.
- 1En Core: enrutamiento, libro mayor y controles de calidad comparten memoria OpenClaw con tus agentes.
- 2Independiente: un único archivo de configuración te conecta a cada modelo que ya pagas.
- 3Mismo motor en ambos casos. Herdr Core es de código abierto; las capas comerciales son opcionales.
Estás pagando de más por inteligencia que no utilizas.
Precios premium para tareas básicas
Renombrar claves de configuración no requiere un modelo de $15/M-token. El 70 % de tu carga de trabajo tampoco, pero por eso es lo que estás pagando.
Dependencia de un único proveedor
Cada cambio implica reescrituras, nuevas pruebas y renegociaciones. Por eso nunca te mueves... y el equipo de precios de tu proveedor lo sabe.
Una factura en caja negra
El gasto en IA se refleja en la tarjeta de crédito sin desglose por funcionalidad, proyecto o cliente. Suerte defendiéndolo en la revisión presupuestaria.
Una única capa entre tu organización y cada modelo.
Flux se posiciona por encima de los proveedores. Intercambia cualquier modelo editando una única línea de configuración... adopta el modelo más rentable del próximo trimestre esta misma tarde, no en el siguiente sprint.
Triaje
Un clasificador ligero evalúa el nivel de dificultad de cada tarea... de trivial a experto... por fracciones de centavo.
Enrutamiento
Las tareas se dirigen a la capa más rentable y viable: local → económico → medio → premium. La ejecución especulativa prioriza siempre las opciones de menor costo.
Validación
Las pruebas deterministas se ejecutan en un sandbox antes de que cualquier modelo procese la solicitud. Las aprobaciones inestables reciben una segunda opinión.
Aprendizaje
Los resultados retroalimentan el sistema de enrutamiento. El motor se vuelve más preciso y rentable cada semana que está en operación.
# Four lines of config. No rewrites. stages: executor: tier: mid # Flux speculatively tries cheaper first fallback_tier: premium budget: projects: client_a: 500000 # hard cap, enforced before every call
Compatible con los proveedores que ya pagas... Claude, GPT, DeepSeek, Qwen o tus propias GPUs de vLLM/Ollama.
Medido en tu carga de trabajo real, no en nuestra presentación.
Los ahorros dependen de la mezcla de carga de trabajo... el dashboard de Flux muestra exactamente el tuyo, basado en tus propias ejecuciones. Las cifras se comparan con una línea base 100% premium en trabajos de dificultad mixta.
Un activo que genera valor compuesto, no un gasto que solo aumenta.
Conoce tu base de código
El router de aprendizaje monitorea qué capa funciona mejor para cada tipo de tarea en tus repositorios y se ajusta automáticamente. Tu inteligencia de enrutamiento nunca abandona tu infraestructura.
La calidad está garantizada, no es una esperanza
Las suites de pruebas reales validan cada cambio; las aprobaciones con baja confianza activan una segunda opinión automática. Los modelos económicos no pueden degradar silenciosamente el resultado.
Siempre operativo
Cortacircuitos por proveedor con conmutación automática hacia el siguiente nivel. La caída de un proveedor no afecta su operación.
Diseñado para agencias
Presupuestos estrictos por proyecto impiden que el Cliente A consuma los tokens del Cliente B. Cada dólar está asignado y cada ejecución queda registrada en la contabilidad.
Compatible con autoalojamiento
Enruta el trabajo rutinario a tus propias GPU con costo marginal cero. Alquila lo impredecible y adquiere lo predecible.
Listo para el CFO
Gasto por proyecto, etapa y función — con el ahorro frente a la línea base en un solo panel de control. La IA pasa de ser un gasto opaco a un portafolio gestionado.
Abierto en el núcleo. Tuyo en los bordes.
El motor de enrutamiento es de código abierto: audítalo, realiza un fork, autoaloja la solución y nunca nos pagues un centavo. Las capas comerciales añaden inteligencia alojada.
Herdr Core
Gratis · para siempre
- →Motor de enrutamiento completo + escalera de 4 niveles
- →Enrutador de aprendizaje + seguimiento de resultados
- →Libro contable local y panel de costos
- →Cortacircuitos y conmutación por error
Flux Cloud
Por proyecto · se paga solo con un día de suscripción premium ahorrado
- →Todo lo incluido en Herdr Core
- →Paneles de control alojados y sistema de alertas
- →Presupuestos y roles del equipo
- →Alertas de costos por Slack / webhook
Flux Intel
Personalizado
- →Todo lo incluido en Flux Cloud
- →Puntos de referencia de enrutamiento entre flotas a partir de datos anónimos con consentimiento
- →SSO, exportación de auditoría, SLA
- →Instalación del Booster Pack en Mercury Core
Preguntas frecuentes
Deje de pagar tarifas de nivel senior por trabajo de nivel junior.
cinco minutos para su primera ejecución enrutada · núcleo con licencia MIT