WhoAI · AI authenticity lab
Verify what your AI API actually runs
Behavior-first forensics untuk endpoint OpenAI-compatible. Metadata yang cocok bukan bukti — perilaku adalah bukti. Semua pekerjaan diproses lokal di VPS 1 melalui antrean prioritas.
Recent tests
Audit terakhir dari sesi ini — klik untuk melihat laporan.
Model health overview
Agregasi authenticity, latency, dan reliability per model.
Capability overview
Hasil terakhir tool calling, web search, dan vision.
Capability lab
Pilih kemampuan untuk diuji pada model terpilih — ground truth dinamis dibuat server-side per test.
Latency snapshot
Durasi audit terakhir per tes (detik).
Forensic audit
Deep Forensics
Probe rahasia dinamis: identitas, token fingerprint, behavioral challenges, routing, dan (bila reference aktif) perbandingan perilaku.
Provider endpoint
Kredensial disimpan hanya di sessionStorage browser — tidak pernah dikirim ke server selain header permintaan.
Model & test depth
Hubungkan provider untuk menampilkan model.
Model terpilih
Belum adaConsole log
Model catalog
Models
Status per model dari endpoint yang terhubung: latency, authenticity confidence, capability, dan reliability — dengan history sparkline.
Model bars
Klik model untuk memilihnya di audit. Bar terisi dari hasil tes yang tersimpan.
Connectivity
Ping Test
Ukur responsivitas endpoint dengan 5 handshake GET ke /v1/models — tanpa membakar token model.
Target
Endpoint + API key dipakai langsung dari browser header.
Capability lab
Vision Lab
PNG + secret code dibuat ulang setiap test. Jawaban tidak pernah ditempel ke text prompt — hanya ada di dalam piksel gambar.
Dynamic vision challenge
Opsi upload gambar untuk manual review (maks 3 MiB).
auto-generate bila kosong
Belum diuji
Jalankan tes vision untuk mendapatkan evidence card.
Capability lab
Tool Calling
5 tools mirip dengan selection otomatis, nested JSON arguments, required fields, enum, array, dan parallel round-trip.
Tool selection & schema lab
Skor berdasarkan selection correctness, argument accuracy, dan round-trip success.
Belum diuji
Jalankan tes tool calling untuk mendapatkan evidence card.
Capability lab
Web Search
Dynamic web canary: halaman sementara di whoai.my.id/canary/<random> berisi secret acak yang harus diambil model.
Web canary
Diukur: tool invocation, citation quality, dan secret accuracy.
Belum diuji
Jalankan tes web search untuk mendapatkan evidence card.
Capability lab
Long Context
Staged testing 16K → 64K → 128K → 256K dengan canary acak. Mendeteksi truncation, fake context window, dan hidden proxy limits.
Staged retrieval challenge
Perbandingan staged membutuhkan reference endpoint tepercaya (pola seller vs reference pada stage yang sama).
Reference mode belum aktif
Konfigurasi reference endpoint dulu di Settings agar long-context staging bisa berjalan.
butuh reference
Evidence archive
Reports
Laporan audit tersimpan lokal di browser (localStorage) — lengkap dengan evidence, findings, dan reference analysis. Ekspor kapan saja.
0 reports
Preferences
Settings
Tampilan, reference mode, dan manajemen data lokal.
Appearance
Tema terang (default) atau gelap — tersimpan di localStorage.
light
Reference mode
Bandingkan perilaku seller terhadap endpoint tepercaya — 80% bobot score pada behavioral overlap. Metadata tidak bisa menyelamatkan mismatch perilaku.
System
Status node dan antrean pemrosesan lokal.
Data
History audit & ping disimpan lokal di browser.