We introduce Starling-LM-7B-beta, an open large language model (LLM) trained by Reinforcement Learning from AI Feedback (RLAIF). Starling-LM-7B-beta is trained from
Openchat-3.5-0106
with our new reward model
Nexusflow/Starling-RM-34B
and policy optimization method
Fine-Tuning Language Models from Human Preferences (PPO)
.
Harnessing the power of the ranking dataset,
berkeley-nest/Nectar
, the upgraded reward model,
Starling-RM-34B
, and the new reward training and policy tuning pipeline, Starling-LM-7B-beta scores an improved 8.12 in MT Bench with GPT-4 as a judge.
Citation
@misc{starling2023,
title = {Starling-7B: Improving LLM Helpfulness & Harmlessness with RLAIF},
url = {},
author = {Zhu, Banghua and Frick, Evan and Wu, Tianhao and Zhu, Hanlin and Ganesan, Karthik and Chiang, Wei-Lin and Zhang, Jian and Jiao, Jiantao},
month = {November},
year = {2023}
}
Runs of QuantFactory Starling-LM-7B-beta-GGUF on huggingface.co
977
Total runs
-22
24-hour runs
33
3-day runs
164
7-day runs
529
30-day runs
More Information About Starling-LM-7B-beta-GGUF huggingface.co Model
Starling-LM-7B-beta-GGUF huggingface.co is an AI model on huggingface.co that provides Starling-LM-7B-beta-GGUF's model effect (), which can be used instantly with this QuantFactory Starling-LM-7B-beta-GGUF model. huggingface.co supports a free trial of the Starling-LM-7B-beta-GGUF model, and also provides paid use of the Starling-LM-7B-beta-GGUF. Support call Starling-LM-7B-beta-GGUF model through api, including Node.js, Python, http.
Starling-LM-7B-beta-GGUF huggingface.co is an online trial and call api platform, which integrates Starling-LM-7B-beta-GGUF's modeling effects, including api services, and provides a free online trial of Starling-LM-7B-beta-GGUF, you can try Starling-LM-7B-beta-GGUF online for free by clicking the link below.
QuantFactory Starling-LM-7B-beta-GGUF online free url in huggingface.co:
Starling-LM-7B-beta-GGUF is an open source model from GitHub that offers a free installation service, and any user can find Starling-LM-7B-beta-GGUF on GitHub to install. At the same time, huggingface.co provides the effect of Starling-LM-7B-beta-GGUF install, users can directly use Starling-LM-7B-beta-GGUF installed effect in huggingface.co for debugging and trial. It also supports api for free installation.
Starling-LM-7B-beta-GGUF install url in huggingface.co: