Platform Cookbooks
Feature-focused recipes for the Future AGI platform: tracing and debugging, evaluation workflows, datasets, and prompt optimization.
Reach for these when you need one capability working, whatever you are building.
Tracing & Debugging
Manual Tracing
Add custom spans to any application
Distributed Tracing
Connect spans across services with OpenTelemetry
Inline Evals in Tracing
Score every response as it is generated
Portkey Integration
End-to-end observability through a Portkey gateway
Debug Traces from IDE
Query traces in natural language over MCP
Falcon AI Trace Debugging
Context-aware trace debugging with Falcon AI
Falcon AI End-to-End Workflow
Trace, debug, evaluate, and fix in one conversation
Evaluation Workflows
Custom Eval Metrics
Write your own evaluation criteria
Async & Batch Evaluations
Evaluate at scale without blocking
Eval Correction Loop
Teach your evaluator what good means for your domain
Eval Metrics for Optimization
Choose the metrics that drive optimization
Comparing Prompts and Models
Compare prompts and models on one dataset
Datasets
Synthetic Data Generation
Create test datasets from a column schema
Dynamic Dataset Columns
Enrich rows with AI-generated data
Hugging Face Dataset Import
Import datasets from Hugging Face
Dataset Annotation
Human-in-the-loop annotation workflows
Golden Datasets from Traces
Curate regression datasets from production traces
Prompts & Optimization
Prompt Versioning
Create, label, and serve prompt versions
Prompt Optimization
Improve a prompt automatically
Basic Prompt Optimization
First steps with the agent-opt library
End-to-End Prompt Optimization
Optimize with evaluation in the loop
GEPA Optimization
Evolutionary prompt optimization with GEPA
Dataset Optimization
Improve prompts directly in your dataset
Custom Datasets for Optimization
Bring your own data to agent-opt
Comparing Prompt Optimizers
ProTeGi, GEPA, and PromptWizard head to head
Comparing Optimizers
Bayesian search, GEPA, and meta-prompt compared
Semantic Caching
Cut LLM costs with semantic caching in Agent Command Center
Questions & Discussion