Agora · AI Audit

Jeden reliability report pre tvoj AI systém.

Opíš svoj AI/agentový systém a dostaneš jeden prioritizovaný PASS / WARN / FAIL report — reward-hacking, kolaps modelu, stádovanie agentov, falošné A/B nárasty, hnitie RAG, skreslené kauzálne tvrdenia — každé s opravou. Každá kontrola je odmeraná, nie predpokladaná. Spusti to zadarmo nižšie, v prehliadači.

Spusti to teraz

Vyplň tie časti systému, ktoré máš (predvyplnené zlyhávajúcim príkladom). Beží celé v prehliadači — nič sa nikam neposiela.

Odpovedz na tie, ktoré vieš — ostatné preskoč. Predvolené hodnoty sú zámerne pokazený príklad, aby si videl plný report.

1 · Pomohla zmena naozaj?

Tvoj A/B test — konverzie z používateľov, na variant.

2 · Trénuje model na vlastnom výstupe?

Riziko kolapsu z umelých / samo-generovaných dát.

3 · Kopírujú sa agenti navzájom?

Stádovanie multi-agentov / ensemble (preskoč ak 1 agent).

4 · Dá sa tvoja KPI / odmena ľahko gameovať?

Reward-hacking / Goodhart — keď sa miera stane cieľom.

5 · Kontroluješ správne veci?

Kauzálne/atribúcia — jedna premenná, na ktorú "kontroluješ". Nesprávny druh vnáša skreslenie.

Čo kontroluje

Každá je dokázaný, odmeraný nástroj — a všetky spúšťame na sebe, verejne. Pozri náš seba-audit →

nullcheck

Je nárast reálny, či šum?

selfref

Kolabuje model sám na seba?

herdcheck

Budú agenti stádovať?

goodhart

Je metrika gameovaná?

idcheck

Je kauzálne číslo identifikované?

ragfresh

Hnije tvoj RAG sklad?

inspeximus

Zdravie pamäte agentov.

quitkit

Kedy vzdať slabnúce úsilie.

Cena

Open core

zadarmo, navždy
  • Všetkých 8 kontrol + audit, jeden pip install
  • CLI a MCP server (do CI)
  • Spustenie v prehliadači, ako vyššie
GitHub ↗

Hostované

čoskoro
  • Audit API + dashboard, história v čase
  • Napojenie na CI/CD a agent runtime
  • Kontinuálny monitoring a alerty
Daj vedieť