Use Cases
Track Agent Edits, Measured Outcomes, And Evaluation Costs
1 project
Track Prompt/llm/retrieval Changes Across Experiments
1 project
Tracking Query Rewriting And Retrieval Training Methods
1 project
Train And Evaluate Labeled Linear Probes On Held-out Data
1 project
Train And Evaluate RL Robot-learning Policies
1 project
Training And Evaluating Image-text Models
1 project
Training And Evaluating Multimodal Gui Agents
1 project
Trust-verified Retrieval With Strong/weak/rebuilt/stale Verdicts
1 project
Update Retrieval Indexes As Data Changes
1 project
Use Microsoft Foundry Tools For Models, Knowledge And Evaluation
1 project
Vector Rag Retrieval Over Project Knowledge
1 project
Version-aware Retrieval Of Superseded Vs Current Health Guidance
1 project
Visualize Question And Snippet Embeddings With Umap To Inspect Retrieval Cluster
1 project
Wrap Any Python Callable As An Eval Target
1 project
Write Tests And Evals For Prompts
1 project