

Alpy Evaluation
#1 in Observability & EvalsCrowdworks · 2× · zuletzt 18. Aug. 2026
Alpy Evaluation ist ein Modul der Agentic-AI-Plattform "Alpy" des koreanischen AI-Tech-Unternehmens Crowdworks, das am 11. Februar 2025 vorgestellt wurde. Die Lösung bewertet quantitativ und qualitativ die Zuverlässigkeit und Sicherheit von KI-Diensten (LLM, RAG, AI-Agenten) und unterteilt sich in eine Safety Evaluation (Verhinderung unerwünschter/schädlicher Antworten) und eine Performance Evaluation (Prüfung, ob Antworten wie beabsichtigt ausfallen). Die Safety-Evaluation-Komponente kombiniert menschliche Red-Team-Bewertungen mit modellbasierter automatisierter Bewertung, u.a. über die Partnerlösung "AIM Supervisor" von AIM Intelligence. Konkrete Preisangaben, Deployment-Optionen, Protokoll-Kompatibilität oder Durchsatz-/Latenzwerte sind auf der offiziellen Doku-/Produktseite nicht öffen
Features
| Deployment (Self-host/Cloud) | Als Solution/Service über Crowdworks bereitgestellt (End-to-End Enterprise AI Solution), keine öffentliche Angabe zu Self-Hosting |
| Plattform | Modul der Agentic-AI-Suite "Alpy" (neben Knowledge Compiler, RAG, LLM Engine, Agent Studio, Admin) |
| Release-Datum | 11. Februar 2025 (Launch der Alpy-Plattform inkl. Alpy Evaluation) |
| Unterstützte Modelle/Provider | Modellunabhängig einsetzbar; Alpy LLM Engine unterstützt u.a. GPT-4o, Llama, HyperCLOVA X, DeepSeek R1 (in Vorbereitung) |