WhoAI/Dashboard
VPS 1
A
WhoAI · AI authenticity lab

Verify what your AI API actually runs

Behavior-first forensics untuk endpoint OpenAI-compatible. Metadata yang cocok bukan bukti — perilaku adalah bukti. Semua pekerjaan diproses lokal di VPS 1 melalui antrean prioritas.

Recent tests

Audit terakhir dari sesi ini — klik untuk melihat laporan.

Model health overview

Agregasi authenticity, latency, dan reliability per model.

Capability overview

Hasil terakhir tool calling, web search, dan vision.

Capability lab

Pilih kemampuan untuk diuji pada model terpilih — ground truth dinamis dibuat server-side per test.

Latency snapshot

Durasi audit terakhir per tes (detik).
Forensic audit

Deep Forensics

Probe rahasia dinamis: identitas, token fingerprint, behavioral challenges, routing, dan (bila reference aktif) perbandingan perilaku.

Provider endpoint

Kredensial disimpan hanya di sessionStorage browser — tidak pernah dikirim ke server selain header permintaan.
Not connected

Model & test depth

Hubungkan provider untuk menampilkan model.
0 model
Model terpilih
Belum ada
Console log
Model catalog

Models

Status per model dari endpoint yang terhubung: latency, authenticity confidence, capability, dan reliability — dengan history sparkline.

Model bars

Klik model untuk memilihnya di audit. Bar terisi dari hasil tes yang tersimpan.
0 model
Connectivity

Ping Test

Ukur responsivitas endpoint dengan 5 handshake GET ke /v1/models — tanpa membakar token model.

Target

Endpoint + API key dipakai langsung dari browser header.
Capability lab

Vision Lab

PNG + secret code dibuat ulang setiap test. Jawaban tidak pernah ditempel ke text prompt — hanya ada di dalam piksel gambar.

Dynamic vision challenge

Opsi upload gambar untuk manual review (maks 3 MiB).
auto-generate bila kosong
Belum diuji

Jalankan tes vision untuk mendapatkan evidence card.

Capability lab

Tool Calling

5 tools mirip dengan selection otomatis, nested JSON arguments, required fields, enum, array, dan parallel round-trip.

Tool selection & schema lab

Skor berdasarkan selection correctness, argument accuracy, dan round-trip success.
Belum diuji

Jalankan tes tool calling untuk mendapatkan evidence card.

Capability lab

Web Search

Dynamic web canary: halaman sementara di whoai.my.id/canary/<random> berisi secret acak yang harus diambil model.

Web canary

Diukur: tool invocation, citation quality, dan secret accuracy.
Belum diuji

Jalankan tes web search untuk mendapatkan evidence card.

Capability lab

Long Context

Staged testing 16K → 64K → 128K → 256K dengan canary acak. Mendeteksi truncation, fake context window, dan hidden proxy limits.

Staged retrieval challenge

Perbandingan staged membutuhkan reference endpoint tepercaya (pola seller vs reference pada stage yang sama).
Reference mode belum aktif

Konfigurasi reference endpoint dulu di Settings agar long-context staging bisa berjalan.

butuh reference
Evidence archive

Reports

Laporan audit tersimpan lokal di browser (localStorage) — lengkap dengan evidence, findings, dan reference analysis. Ekspor kapan saja.
0 reports
Preferences

Settings

Tampilan, reference mode, dan manajemen data lokal.

Appearance

Tema terang (default) atau gelap — tersimpan di localStorage.
light

Reference mode

Bandingkan perilaku seller terhadap endpoint tepercaya — 80% bobot score pada behavioral overlap. Metadata tidak bisa menyelamatkan mismatch perilaku.

System

Status node dan antrean pemrosesan lokal.

Data

History audit & ping disimpan lokal di browser.