説明
Revalvoは、大規模言語モデル(LLM)を評価するために設計されたローカルファーストのワークベンチで、複数のモデルで同時にプロンプトを実行できます。ユーザーがプロンプトを作成、実行、バージョン管理、評価できる包括的な環境を提供し、プロダクションに到達する前に評価を行います。従来のチャットUIとは異なり、Revalvoはプロンプト、モデル、変数に対する完全な制御を提供し、スコア、差分、バージョン履歴を通じて透明性と追跡可能性を確保します。
このプラットフォームは典型的なSaaSではなく、アカウントの作成は不要で、すべてのデータはユーザーのブラウザに保存され、プライバシーとセキュリティが確保されます。ユーザーはキー、OAuth、またはローカルランタイムを使用してプロバイダーに接続し、各プロバイダーのために別々のワークスペースを作成できます。プレイグラウンド機能により、ユーザーは一度プロンプトを書いてどこでも実行でき、モデルは同じプロンプトに対して並行して応答し、レイテンシ、トークン、応答ごとのコストなどのメトリクスを提供します。
Revalvoのバージョン管理システムは、プロンプトをコードのように扱い、不変のスナップショット、Gitスタイルのバージョン履歴、任意の以前のバージョンにロールバックする機能を提供します。ユーザーはバージョンをAPIスニペットやエージェントプロンプトとしてエクスポートし、新しい評価のためにワークスペース間でプロンプトを複製できます。
このプラットフォームは、データセットを使用した大規模テストをサポートし、構造、AI判断、パフォーマンス、安全性のための40のバッチ実行可能なスコアラーを提供します。バッチ実行から生成されるレポートには、合格率、レイテンシ、モデルごとのコストが含まれ、出荷の準備状況の詳細なレシートを提供します。
Revalvoは効率性を最適化しており、思慮深いデフォルト設定と最小限のセットアップ時間を提供します。チャットプレイグラウンドのスピードと完全評価プラットフォームの厳密さをバランスさせており、初めてのユーザーにも経験豊富なプロンプトエンジニアにも適しています。
Revalvoの主要機能
ローカルファーストのLLM評価
リアルタイムスコアリングとバージョン管理
アカウント不要
スコアと差分の完全な透明性
キー、OAuth、またはローカルランタイムを介して接続
並行モデル応答評価
Gitスタイルのバージョン履歴
40のスコアラーによるバッチテスト
Revalvoの使い方は?
設定: キーまたはOAuthを使用してプロバイダーに接続
使用: 複数のモデルでプロンプトを並行して実行
最適化: Gitスタイルの履歴でプロンプトを保存およびバージョン管理
テスト: データセットとスコアラーを使用してバッチテストを実行
Revalvoの使用例
- プロンプト評価
- バージョン管理
- バッチテスト
- モデル比較
- データプライバシー





