od Synenergy

Consilium Router

Wielomodelowy panel AI do ważnych pytań. Pluralna odpowiedź z dowodami.

Do otwartych ocen — kilka modeli odpowiadających niezależnie. Do stosu plików — odpowiedzi z cytatami i widocznym kosztem. Jedno wejście — API lub MCP — i agregator dostawców.

Dostępne przez katalogi:

  • OpenRouter
  • Hugging Face
  • OpenAI
  • Anthropic
  • DeepSeek
  • Qwen
  • xAI

Ślepe plamy — i kontekst, który się nie mieści.

Jeden model to jedna perspektywa i jeden zestaw halucynacji. A gdy prawdziwa robota to stos specyfikacji, logów i notatek, wepchnięcie wszystkiego w jeden frontier-czat marnuje pieniądze i gubi wątek. Wybierz tryb Consilium pod swoje zadanie.

Do czego służy

Twoje dokumenty — duży kontekst, kontrolowany koszt.

Ty (albo asystent) zbierasz pliki — specyfikacje, notatki, logi, skany, zrzuty z bazy, zapisane strony. Consilium przechodzi ten zestaw zamiast wklejać wszystko do jednego drogiego modelu: odpowiada cytatami z tych plików, sprawdza, że cytaty tam naprawdę są, i pokazuje koszt. Tańsze modele pomocnicze mogą najpierw posprzątać materiał. Internetu za ciebie nie przeszukuje.

Druga opinia — pluralizm modeli.

Kilka modeli AI — różne rodziny, różne ślepe plamy — odpowiada na to samo otwarte pytanie. Ten pluralizm jest celem: widać, gdzie się zgadzają, a gdzie zderzają. Więcej modeli nie oznacza więcej prawdy — ważne fakty sprawdzaj sam.

Audyty i recenzje.

Architektura, bezpieczeństwo, umowa, strategia — wystawiasz to przed panel, a każdy model szuka słabych punktów niezależnie. Co pominie jeden, znajdzie drugi.

Jedno API i agregator dostawców.

Consilium sam łączy się z OpenRouter i Hugging Face: jeden base_url, jeden rachunek, modele z obu katalogów w rolach solo i w panelach. Własny klucz dostawcy — opcjonalnie.

Weryfikacja kodu.

Code review przed merge, polowanie na błędy, ocena ryzykownych zmian. Niezależne werdykty bez myślenia stadnego: żaden model nie widzi, co powiedziały inne.

Trudne decyzje.

Model biznesowy, finanse, inwestycje, wybór strategii albo stosu — gdy błąd jest drogi, zwołaj radę zamiast ufać jednej opinii.

Tryby

01

Twoje dokumenty (Gather & Judge).

Gdy odpowiedź ma pochodzić z twoich plików — a zestaw jest za duży na jeden prompt. Consilium przechodzi kontekst krokami: prawdziwe cytaty z plików, sprawdzenie, że tam są, i jasny koszt. Tańsze modele pomocnicze sprzątają materiał, żeby główny asystent nie palił drogich tokenów na rutynę. To nie panel wielu opinii. Zweryfikowany cytat znaczy „jest w twoich plikach” — nie „prawda całego świata”.

Najlepsze do: dużych zestawów plików, sprzeczności, „co te pliki naprawdę mówią — z cytatami?”

02

Compare — Porównanie.

Kilka modeli odpowiada na ten sam prompt niezależnie, obok siebie.

Najlepsze do: szybkiego sprawdzenia — czy modele się zgadzają, czy któryś halucynuje?

03

Deliberate — Narada.

Panel odpowiada, sędzia składa najmocniejsze części w jedną końcową odpowiedź.

Najlepsze do: codziennej pracy — jedna wiarygodna odpowiedź zamiast kilku surowych.

04

Vote — Głosowanie.

Podajesz kandydata — każdy model zwraca niezależny werdykt.

Najlepsze do: walidacji gotowej decyzji, tekstu albo kodu przed wydaniem.

05

Brainstorm — Burza mózgów.

Modele generują pomysły w ciemno; najmocniejsze są rekombinowane. Twierdzenia traktuj jako niezweryfikowane, dopóki nie sprawdzisz ich sam.

Najlepsze do: szukania nowych pomysłów, gdy potrzebujesz wachlarza opcji, nie jednej opinii.

06

Extended — Zachód kontra Wschód.

Czołowe modele zachodniej i wschodniej szkoły na jednym panelu, przez dwa niezależne kanały.

Najlepsze do: decyzji, w których wspólne ślepe plamy są niebezpieczne.

07

Council — Konsylium.

Ustrukturyzowana sesja panelu dla najtrudniejszych decyzji.

Najlepsze do: architektury, strategii, nazewnictwa — decyzji, które drogo odwracać.

08

Route Lab.

Sprawdź, które modele i trasy pasują do klasy zadań, zanim na sztywno wsadzisz domyślną do agenta. Darmowi pomocnicy odkrywają i proponują; płatne eksperymenty odpalają prawdziwe trasy i je rankują. To nie codzienny czat.

Najlepsze do: wyboru domyślnej dla agentów albo recepty panelu.

Dlaczego Consilium

Pluralizm modeli.

Nie jedna szkoła myślenia — celowo mieszany panel, żeby wspólne ślepe plamy trudniej było ukryć.

Kontekst bez zrzutu.

Duże zestawy plików idą krokami — z cytatami i ich weryfikacją — zamiast wklejać wszystko do jednego frontier-czatu.

Koszt, który widać.

Uruchomienia na dokumentach pokazują rachunek. Tani pomocnicy sprzątają materiał; drogie modele zostają do osądu, nie do harówki.

Działa z twoimi narzędziami.

Podłącza się jak zwykły model OpenAI: dwa wiersze w ustawieniach — i twój klient czatu, IDE albo skrypt konsultuje panel.

Zbudowane dla agentów.

Podłącz raz: „Twoje dokumenty” dla dużego kontekstu z widocznym kosztem albo panel dla pluralnej drugiej opinii.

Elastyczny start.

Demo od razu, bez kluczy. Potem własny klucz dostawcy — albo wszystko przez nas.

Tryb poufności.

Na planach komercyjnych: bez przechowywania promptów, bez uczenia na twoich danych.

Pada głośno, nie po cichu.

Awaria jednego modelu jest widoczna od razu — a reszta panelu i tak oddaje wynik.

Jak to działa

  1. Wysyłasz jedno żądanieswój prompt i jak szeroki panel chcesz.
  2. Panel pracujeniezależne odpowiedzi, krzyżowe sprawdzenie, scalenie.
  3. Dostajesz werdyktjedną odpowiedź, w której rozbieżności są pokazane, nie ukryte.

Consilium jako dostawca dla agentów

Wskaż Cursor, Claude, Codex, Hermes albo OpenClaw na Consilium — „Twoje dokumenty”, gdy stos nie mieści się w jednym prompcie (cytaty + kontrola kosztu), panel dla pluralnej drugiej opinii albo jeden model do codziennej pracy. Szerzej nie zawsze znaczy dokładniej.

Role subagentów na różnych LLM.

Architekt, sceptyk, implementator — różne modele przez jedną bramę albo wspólny compare, gdy brief jest jeden.

Solo do rutyny, panel do osądu.

Zwykłe poprawki zostają na jednym modelu. Panel albo deliberate — tylko przy otwartych decyzjach: projekt, nazewnictwo, kompromisy.

Vote przed merge.

Gotowy kandydat + rubryka → niezależne accept / reject / abstain. Sygnał bramki — nie scalony esej, nie zamiennik testów.

Rozbieżność → eskalacja.

Gdy panel przeczy sam sobie przy drogiej decyzji, poszerz panel, zagłosuj konkretnego kandydata albo zapytaj człowieka — nie udawaj konsensusu.

Drop-in druga opinia.

Ustaw base_url na Consilium /v1 i/albo podepnij MCP. Reszty stosu agenta nie ruszaj.

Twoje dokumenty.

Gdy stos nie mieści się w jednym prompcie: Consilium odpowiada cytatami z tych plików, pokazuje koszt i może użyć tańszych pomocników do przygotowania — żeby model główny nie był śmieciarką na kontekst. Panel zostaw do otwartego osądu.

Route Lab przed hard-code.

Zbadaj, która trasa albo solo-domyślna pasuje do klasy zadań, zanim wsadzisz konfigurację agenta. Najpierw darmowi pomocnicy; płatne eksperymenty tylko z jawnym approve — nie na każdy czat użytkownika.

Route Lab

Zbadaj, które modele i trasy pasują do klasy zadań — zanim na sztywno wsadzisz domyślną. Za darmo: discover, propose, stub-benchmark. Płatne: route_lab_run_experiment (approve spend). Nie zastępuje compare, deliberate, vote ani „Twoich dokumentów”.

Modele dla agentów

Gdy ustawiasz base_url na Consilium /v1, zacznij od tych ról solo — nie od „jednego najlepszego modelu”. Vendorowe twierdzenia o agentach (w tym Meta o Llama tool use) to hipotezy, dopóki nie opublikujemy własnych ocen harness. Panel osobno: panel=diversified* przez MCP.

RolaOpenRouterHugging Face
Controller
openai/gpt-6.1-sol$2 / $10
deepseek-ai/DeepSeek-V4-Pro-0813$1.32 / $3.96
Planner
anthropic/claude-opus-5.5$4 / $20
Qwen/Qwen3.8-2.4T-A95B$2 / $6
Implementer
anthropic/claude-sonnet-5.5$2 / $10
deepseek-ai/DeepSeek-V4-Pro-0813$1.32 / $3.96
Skeptic
x-ai/grok-4.7$2 / $6
zai-org/GLM-5.3$1.4 / $4.4
Cheap worker
openai/gpt-oss-120b$0.037 / $0.17
zai-org/GLM-5.3-Flash$0.15 / $0.5
Fast / light
openai/gpt-6-luna$0.1 / $0.5
xiaomi/mimo-v2.6-flash$0.14 / $0.28
XiaomiMiMo/MiMo-V2.6-Flash-RL$0.14 / $0.28

Najlepsze wybory na 5 października 2026 · ceny z publicznych katalogów dostawców, za 1 mln tokenów wejście/wyjście · wybór ma charakter orientacyjny

Subagenci: architekt → Claude Opus 5.5 · implementator → Claude Sonnet 5.5 · sceptyk → Grok 4.7 · orkiestrator → GPT-6.1 Sol.

Połączenie / weryfikacja

Masz już Consilium service Bearer od operatora? Pobierz skrypt dymny i uruchom lokalnie — sprawdza /health, /v1/models i krótki czat bez streamu. Tokenów nie tworzy i nigdy ich nie drukuje.

curl -fsSL https://consilium.synenergy.ai/connect.sh -o consilium-auth.sh chmod +x consilium-auth.sh CONSILIUM_TOKEN=… ./consilium-auth.sh

Lepiej download-then-run. Opcjonalnie pipe: curl -fsSL …/connect.sh | bash -s -- "$CONSILIUM_TOKEN".

Hermes / OpenAI drop-in: base_url=https://consilium.synenergy.ai/v1. Domyślny agent solo: model=meta-llama/llama-4-maverick (zob. modele dla agentów).

  • OpenRouterOpenRouter
  • Hugging FaceHugging Face

Dostawcy za Consilium: zapytania idą przez czołowe katalogi.

Dla asystentów. Panel = druga opinia na pytanie. Twoje dokumenty = odpowiedzi z cytatami z plików, które podasz (to samo połączenie; po aktualizacji podepnij MCP raz, żeby pojawiły się nowe narzędzia). Route Lab = dobór domyślnej trasy dla klasy zadań przed hard-code — nie do jednorazowych pytań użytkownika. Zwykły czat na jeden model sam z siebie nie uruchamia „Twoich dokumentów” ani Lab.

Przestań stawiać wszystko na jeden model.

Wczesny dostęp jest ograniczony — dołącz do listy oczekujących, a wyślemy klucz API, gdy zwolni się miejsce.