Lewati ke konten
Mercury .

Mercury Flux adalah lapisan optimisasi biaya AI dari Mercury Technology Solutions: sebuah perute multi-model yang mengarahkan setiap tugas ke tier termurah yang mampu (lokal, murah, menengah, premium), memverifikasi kualitas dengan uji deterministik, dan belajar dari hasil. Ini merupakan pembaruan hemat biaya untuk Mercury Core dan dapat berjalan sebagai Booster Pack di atas Core atau sebagai layanan mandiri.

Orkestrasi multi-model, optimisasi biaya LLM, perutean agen, gerbang kualitas, buku besar token, inferensi self-hosted

Mercury Technology Solutions, Mercury Flux, Mercury Core, Herdr Core, OpenClaw, Flux Cloud, Flux Intel

Lapisan biaya untuk Mercury Core · mampu berjalan mandiri

Pengeluaran AI yang mengalir ke model yang tepat.

Mercury Flux adalah pembaruan hemat biaya untuk Mercury Core. Ia mengarahkan setiap tugas AI ke model termurah yang mampu menjalankannya dengan baik — premium, murah, atau GPU milik Anda sendiri — dan membuktikan kualitas melalui uji nyata sebelum dirilis. Jalankan di atas Core, atau sebagai layanan mandiri.

Pembaruan Core hemat biayaLayanan mandiriTerjamin kualitasnya

Pengurangan biaya tipikal 60–75% · nol vendor lock-in · inti open-source

FLUX ROUTER — LIVE
TUGAS0 inFLUXpenyortiran · pengalihanlokal · self-hosted$0ekonomis · kelas Haiku$menengah · kelas DeepSeek$$premium · kelas Opus$$$
Tugas dirutekan
0
Porsi premium
0%
Penghematan pada eksekusi ini
$0.00
baseline semua premium $0.00dirutekan oleh Flux $0.00
Definisi

Apa itu Mercury Flux

Mercury Flux adalah lapisan optimasi biaya AI dari Mercury Technology Solutions. Ini merupakan pembaruan hemat biaya untuk Mercury Core: router multi-model yang mengarahkan setiap tugas ke tier termurah yang mampu (lokal, murah, menengah, premium), memverifikasi kualitas melalui uji deterministik, dan mencatat setiap token. Instal sebagai Paket Penguat di Mercury Core, atau jalankan sebagai layanan mandiri tanpa memerlukan lisensi Core.

Poin kunci

Yang perlu diingat para eksekutif

  • Flux adalah pembaruan hemat biaya untuk Mercury Core — keluarga yang sama, jalur lebih terjangkau.
  • Ia juga dapat dijalankan secara mandiri. Tidak diperlukan lisensi Core untuk merutekan, mencatat, atau memverifikasi.
  • Penghematan tipikal mencapai 60–75% dibandingkan basis premium penuh pada pekerjaan dengan tingkat kesulitan campuran.
  • Kualitas dijaga melalui uji nyata. Model murah tidak dapat menurunkan kualitas output secara diam-diam.
  • Herdr Core bersifat open source. Flux Cloud dan Flux Intel merupakan lapisan komersial opsional.
01 / Masalahnya

Anda membayar lebih untuk kecerdasan yang tidak terpakai.

$$$ → $

Harga premium untuk pekerjaan tingkat dasar

Mengganti kunci konfigurasi tidak memerlukan model seharga $15/juta token. Begitu pula 70% beban kerja Anda — namun itulah yang sebenarnya Anda bayar.

1 vendor

Terkunci pada satu penyedia

Setiap pergantian menuntut penulisan ulang, pengujian ulang, dan negosiasi ulang. Akibatnya, Anda tidak pernah berganti — dan tim pricing penyedia Anda sangat menyadari hal itu.

???

Tagihan tanpa transparansi

Pengeluaran AI langsung dibebankan ke kartu kredit tanpa rincian per fitur, proyek, atau klien. Sulit untuk mempertahankannya saat tinjauan anggaran.

02 / Cara Kerja

Satu lapisan penghubung antara Anda dan setiap model.

Flux beroperasi di lapisan atas para penyedia. Tukar model apa pun hanya dengan mengubah satu baris konfigurasi — terapkan model yang lebih efisien untuk kuartal depan pada sore ini, tanpa menunggu sprint berikutnya.

1

Triage

Klasifier ringan menilai tingkat kesulitan setiap tugas — dari sederhana hingga kompleks — dengan biaya hanya sepersekian sen.

2

Pengalihan

Tugas dialirkan ke tier termurah yang memenuhi syarat: lokal → ekonomis → menengah → premium. Eksekusi spekulatif mengutamakan opsi yang lebih terjangkau terlebih dahulu.

3

Verifikasi

Uji deterministik dijalankan di sandbox sebelum ada model yang melakukan peninjauan akhir. Hasil yang kurang meyakinkan akan otomatis mendapatkan validasi tambahan.

4

Pembelajaran

Hasil akhir secara otomatis mengoptimalkan pengalihan rute berikutnya. Mesin menjadi semakin presisi — dan efisien biaya — seiring setiap minggu operasionalnya.

router.config.yamlseluruh integrasi Anda
# Four lines of config. No rewrites.
stages:
  executor:
    tier: mid              # Flux speculatively tries cheaper first
    fallback_tier: premium
budget:
  projects:
    client_a: 500000    # hard cap, enforced before every call

Bekerja dengan penyedia yang sudah Anda bayar — Claude, GPT, DeepSeek, Qwen, atau GPU vLLM/Ollama milik Anda sendiri.

03 / Data & Metrik

Dihitung berdasarkan beban kerja riil Anda, bukan sekadar angka di presentasi.

60–75%
Penghematan biaya rata-rata dibandingkan baseline premium penuh
$0
Biaya marjinal untuk tier lokal yang di-host sendiri
<1 hari
Waktu untuk mengadopsi model peluncuran terbaru
100%
Jumlah token yang tercatat secara transparan per proyek dan siap diaudit

Besaran penghematan bergantung pada komposisi beban kerja Anda — dasbor Flux menampilkan angka riil berdasarkan eksekusi Anda sendiri. Perbandingan dilakukan terhadap baseline premium penuh untuk tugas dengan tingkat kesulitan campuran.

04 / Mengapa Tim Memilih Flux

Aset yang terus berkembang, bukan tagihan yang membengkak.

Memahami basis kode Anda

Router pembelajaran memantau tier mana yang paling efektif untuk setiap jenis tugas dalam repositori Anda, lalu menyesuaikan secara otomatis. Intelejensi pengalihan Anda tetap sepenuhnya berada di dalam infrastruktur Anda.

Kualitas terjamin secara sistematis, bukan sekadar harapan

Suite pengujian riil mengawal setiap perubahan; persetujuan dengan skor kepercayaan rendah memicu tinjauan otomatis. Model ekonomis tidak dapat menurunkan kualitas output secara tersembunyi.

Selalu Tersedia

Circuit breaker per penyedia dengan failover otomatis ke tingkat prioritas lebih tinggi. Gangguan pada satu penyedia tidak memengaruhi operasional Anda.

Dibangun untuk Agensi

Anggaran ketat per proyek memastikan Klien A tidak pernah menguras token Klien B. Setiap dolar teratribusi, setiap eksekusi tercatat rapi.

Ramah Self-Host

Arahkan pekerjaan rutin ke GPU milik Anda dengan nol biaya marginal. Sewa beban puncak, miliki kapasitas yang dapat diprediksi.

Siap untuk CFO

Pantau pengeluaran per proyek, per tahap, dan per fitur — lengkap dengan analisis penghematan versus baseline dalam satu dasbor. AI beralih dari pengeluaran kotak hitam menjadi portofolio yang terkelola.

05 / Open core

Terbuka pada intinya. Milik Anda di lapisannya.

Mesin perutean bersifat open source — Anda dapat melakukan audit, membuat fork, atau self-host tanpa pernah membayar kami sepeser pun. Lapisan komersial menambahkan kecerdasan terkelola secara terpusat.

Open source

Herdr Core

Gratis · selamanya

  • Mesin perutean lengkap + struktur 4 tingkat
  • Router pembelajaran + pelacakan hasil
  • Buku besar lokal dan dasbor biaya
  • Circuit breaker dan failover
Cloud

Flux Cloud

Per proyek · terbayar sendiri dalam satu hari premium yang dihemat

  • Semua fitur di Herdr Core
  • Dasbor terhosting dan sistem peringatan
  • Anggaran tim dan peran
  • Peringatan biaya Slack / webhook
Enterprise

Flux Intel

Kustom

  • Semua fitur di Flux Cloud
  • Benchmarks perutean lintas armada dari data teranonimasi dengan persetujuan pengguna
  • SSO, ekspor audit, SLA
  • Instalasi Booster Pack pada Mercury Core
FAQ

Pertanyaan yang sering diajukan

Mercury Flux adalah lapisan optimasi biaya AI. Lapisan ini merutekan setiap tugas ke model termurah yang mampu menjalankannya dengan optimal, memverifikasi kualitas melalui pengujian nyata, dan mencatat setiap token secara transparan. Ini merupakan pembaruan hemat biaya untuk Mercury Core dan juga dapat dioperasikan sebagai layanan mandiri.
Siap kapanpun Anda siap

Berhenti membayar harga senior untuk pekerjaan junior.

5 menit untuk eksekusi pertama Anda · inti berlisensi MIT