Eval & LLMOps

Evaluation harness, tracing, observability, guardrail, dan manajemen prompt.

Tool di kategori ini

Eval & LLMOps ★ 34.7k

Open Code Review

Review kode hibrida: aturan deterministik dulu, LLM belakangan — satu-satunya urutan yang lolos review keamanan enterprise.

Tim yang butuh AI code review lolos review keamanan, bukan sekadar terlihat keren di demo Baca selengkapnya →

Guardrails AI

Memvalidasi output model terhadap schema alih-alih berharap — dan bertanya ulang saat validasi gagal.

Output terstruktur yang harus ter-parse andal, serta pemeriksaan PII atau kebijakan sebelum konten sampai ke pengguna Baca selengkapnya →

OpenLLMetry

Trace LLM sebagai span OpenTelemetry standar — sehingga mendarat di stack observability yang sudah Anda bayar.

Organisasi dengan stack OpenTelemetry yang sudah ada dan tak ingin silo observability kedua Baca selengkapnya →
Eval & LLMOps ★ 15.0k

Langfuse

Tracing, eval, dan manajemen prompt yang bisa di-self-host — lapisan observability yang sering lupa dibangun tim.

Tracing, versioning prompt, dan eval produksi Baca selengkapnya →
Eval & LLMOps ★ 11.0k

Ragas

Suite metrik untuk RAG: faithfulness, context precision, recall — angka yang Anda butuhkan sebelum review go-live.

Regression testing RAG dan metrik go-live Baca selengkapnya →

Catatan di kategori ini