HomeModelsPricingDocsBlogCommunityLoginSign up
Models
Pricing
Sign upLog in

Laurence/
oasst2-self-rewarding

Generate
DataBranchesEvaluationsFine-tune
Copyright © 2026 Oxen Labs, Inc., All Rights Reserved
CareersTrust CenterPrivacy PolicyTerms and Conditions
oasst2-self-rewarding
public
format_oasst_dataset.ipynb
47.6 kB
Added code to create IFT and EFT datasets from raw oasst2 dataset
text
2 yrs ago
oasst2_evaluation_fine_tuning.jsonl
3.3 mb
Uncompressed main files
tabular
3 yrs ago
oasst2_instruction_fine_tuning.jsonl
8.1 mb
Uncompressed main files
tabular
3 yrs ago
README.md
205 B
Added data
text
3 yrs ago
oasst2_nested_conversations.jsonl.gz
121.2 mb
Added data
binary
3 yrs ago
Last commit cannot be located
About

A replication of the IFT and EFT datasets created from the OpenAssistant dataset in the paper Self-Rewarding Language Models. https://arxiv.org/abs/2401.10020

5 commits
1 contributor
5 downloads
132.6 mb
1 star
Project contents
text 80.0%
binary 20.0%
132.6 mb
14
Contributors
@Laurence
oasst2-self-rewarding/
1 branch