Skip to main content
When building AI applications that need domain-specific knowledge or consistent formatting, generic models often fall short. Fine-tuning lets you train models on your curated datasets from Helicone, creating specialized AI that understands your unique requirements and consistently delivers the exact outputs your application needs.

Why use Fine-tuning

  • Create domain experts: Train models on your specific data to excel at specialized tasks like legal analysis or medical coding
  • Ensure consistent outputs: Get reliable formatting and structure that matches your exact specifications every time
  • Reduce costs and latency: Smaller fine-tuned models often outperform larger generic models at specific tasks
Dataset curation interface showing request filtering and evaluation for fine-tuning

Helicone's dataset curation interface for preparing fine-tuning data

Quick Start

1

Curate your dataset

Filter and select high-quality request-response pairs from your Helicone logs:
Use Helicone’s powerful filtering to find the best training data:
  • Score thresholds for quality control
  • User feedback filters
  • Token count ranges
  • Custom property combinations
2

Export for fine-tuning

Export your curated dataset in the format your fine-tuning platform requires:
3

Create fine-tuning job

Use your exported dataset with your chosen platform:

Configuration Options

Basic Settings

Core options for dataset curation and export:

Advanced Settings

Detailed Explanations

Control how your dataset is divided for training and validation:
Larger validation sets help detect overfitting but reduce training data.
Remove duplicate or near-duplicate examples to improve training:

Use Cases

Fine-tune a model on your best support conversations for consistent, brand-aligned responses:

Understanding Fine-tuning

When to Use Fine-tuning vs RAG

Fine-tuning and RAG (Retrieval Augmented Generation) solve different problems: What Fine-tuning is best for:
  • Teaching consistent behavior and output formats
  • Improving performance on specific tasks
  • Reducing latency and costs with smaller models
  • Encoding domain knowledge into the model
What RAG is best for:
  • Working with frequently changing information
  • Handling large knowledge bases
  • Maintaining source attribution
  • Quick updates without retraining

Dataset Quality Guidelines

The quality of your fine-tuning dataset determines model performance: Key principles:
  • Diversity: Include varied examples covering edge cases
  • Consistency: Ensure similar inputs have similar outputs
  • Quality: Only include high-quality, verified examples
  • Quantity: Start with 50-100 examples minimum
Quality indicators in Helicone:

Fine-tuning Workflow Best Practices

Data preparation checklist:
  • Review examples for quality and consistency
  • Remove PII and sensitive information
  • Balance dataset across different use cases
  • Validate format matches platform requirements
Monitoring fine-tuned models:

Datasets

Create and manage training datasets from your Helicone requests

Scores

Score requests to identify high-quality training examples

Request Filtering

Advanced filtering to find the perfect training examples

Custom Properties

Tag requests for easier dataset curation