Transformers
Safetensors
English
deberta-v2
reward_model
reward-model
RLHF
evaluation
llm
instruction
reranking
Instructions to use mightbe/Better-PairRM with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use mightbe/Better-PairRM with Transformers:
# Load model directly from transformers import AutoTokenizer, DebertaV2PairRM tokenizer = AutoTokenizer.from_pretrained("mightbe/Better-PairRM") model = DebertaV2PairRM.from_pretrained("mightbe/Better-PairRM", device_map="auto") - Notebooks
- Google Colab
- Kaggle
File size: 129 Bytes
e50d81e | 1 2 3 4 | version https://git-lfs.github.com/spec/v1
oid sha256:a076d677e06637d318f97a7dad62d7d53a64a87014538e9d7a2afc0efac6d170
size 4664
|