KI-Modelltraining
-
Giskard Giskard
Automatisierte Red-Team-Tests, Qualitätsbewertung und Überwachungsplattform auf Unternehmensebene für LLM-Anwendung RAG und AI Agent
-
Google AI Studio AI Studio
Offizielles Google-Portal für Gemini-Experimente und Prototypenentwicklung
-
HoneyHive HoneyHive
Beobachtungs-, Bewertungs-, Überwachungs- und kontinuierliche Verbesserungsplattform für KI-Agenten auf Produktionsebene
-
Arize Phoenix Phoenix
Open-Source-KI/LLM-Plattform für beobachtbare Nachverfolgung, Bewertung und Experimente
-
CMMLU CMMLU
Umfassender Benchmark für die Evaluierung großer chinesischer Modelle, der Multi-Domain-Wissen abdeckt und das Wissen und die Argumentation des Modells im chinesischen Kontext misst
-
Google Colab Colab
Google führt ein kostenloses Online-Jupyter-Notebook mit integrierter GPU-Beschleunigung ein
-
DeepEval Confident AI
Open-Source-Evaluierungsframework für die LLM-Anwendung RAG und Agent, das den Pytest-Stil verwendet, um die Evaluierung in den F&E-Prozess zu integrieren
-
DreamGen NVIDIA
NVIDIA Robot Learning-Forschungsprojekt unter Verwendung von Videoweltmodellen zur Generierung synthetischer Trainingsdaten
-
FlagEval FlagEval
Die vom Zhiyuan Research Institute ins Leben gerufene große Modellbewertungsplattform bietet mehrdimensionale Modellfähigkeitsbewertungen und -rankings.








