QuantFactory / Starling-LM-7B-beta-GGUF

huggingface.co
Total runs: 977
24-hour runs: -22
7-day runs: 164
30-day runs: 529
Model's Last Updated: March 28 2024
text-generation

Introduction of Starling-LM-7B-beta-GGUF

Model Details of Starling-LM-7B-beta-GGUF

Starling-LM-7B-beta-GGUF

Description

This repo contains GGUF format model files for Starling-LM-7B-beta

Model Summary

  • Developed by: The Nexusflow Team ( Banghua Zhu * , Evan Frick * , Tianhao Wu * , Hanlin Zhu, Karthik Ganesan, Wei-Lin Chiang, Jian Zhang, and Jiantao Jiao).
  • Model type: Language Model finetuned with RLHF / RLAIF
  • License: Apache-2.0 license under the condition that the model is not used to compete with OpenAI
  • Finetuned from model: Openchat-3.5-0106 (based on Mistral-7B-v0.1 )

We introduce Starling-LM-7B-beta, an open large language model (LLM) trained by Reinforcement Learning from AI Feedback (RLAIF). Starling-LM-7B-beta is trained from Openchat-3.5-0106 with our new reward model Nexusflow/Starling-RM-34B and policy optimization method Fine-Tuning Language Models from Human Preferences (PPO) . Harnessing the power of the ranking dataset, berkeley-nest/Nectar , the upgraded reward model, Starling-RM-34B , and the new reward training and policy tuning pipeline, Starling-LM-7B-beta scores an improved 8.12 in MT Bench with GPT-4 as a judge.

Citation
@misc{starling2023,
    title = {Starling-7B: Improving LLM Helpfulness & Harmlessness with RLAIF},
    url = {},
    author = {Zhu, Banghua and Frick, Evan and Wu, Tianhao and Zhu, Hanlin and Ganesan, Karthik and Chiang, Wei-Lin and Zhang, Jian and Jiao, Jiantao},
    month = {November},
    year = {2023}
}

Runs of QuantFactory Starling-LM-7B-beta-GGUF on huggingface.co

977
Total runs
-22
24-hour runs
33
3-day runs
164
7-day runs
529
30-day runs

More Information About Starling-LM-7B-beta-GGUF huggingface.co Model

More Starling-LM-7B-beta-GGUF license Visit here:

https://choosealicense.com/licenses/apache-2.0

Starling-LM-7B-beta-GGUF huggingface.co

Starling-LM-7B-beta-GGUF huggingface.co is an AI model on huggingface.co that provides Starling-LM-7B-beta-GGUF's model effect (), which can be used instantly with this QuantFactory Starling-LM-7B-beta-GGUF model. huggingface.co supports a free trial of the Starling-LM-7B-beta-GGUF model, and also provides paid use of the Starling-LM-7B-beta-GGUF. Support call Starling-LM-7B-beta-GGUF model through api, including Node.js, Python, http.

Starling-LM-7B-beta-GGUF huggingface.co Url

https://huggingface.co/QuantFactory/Starling-LM-7B-beta-GGUF

QuantFactory Starling-LM-7B-beta-GGUF online free

Starling-LM-7B-beta-GGUF huggingface.co is an online trial and call api platform, which integrates Starling-LM-7B-beta-GGUF's modeling effects, including api services, and provides a free online trial of Starling-LM-7B-beta-GGUF, you can try Starling-LM-7B-beta-GGUF online for free by clicking the link below.

QuantFactory Starling-LM-7B-beta-GGUF online free url in huggingface.co:

https://huggingface.co/QuantFactory/Starling-LM-7B-beta-GGUF

Starling-LM-7B-beta-GGUF install

Starling-LM-7B-beta-GGUF is an open source model from GitHub that offers a free installation service, and any user can find Starling-LM-7B-beta-GGUF on GitHub to install. At the same time, huggingface.co provides the effect of Starling-LM-7B-beta-GGUF install, users can directly use Starling-LM-7B-beta-GGUF installed effect in huggingface.co for debugging and trial. It also supports api for free installation.

Starling-LM-7B-beta-GGUF install url in huggingface.co:

https://huggingface.co/QuantFactory/Starling-LM-7B-beta-GGUF

Url of Starling-LM-7B-beta-GGUF

Starling-LM-7B-beta-GGUF huggingface.co Url

Provider of Starling-LM-7B-beta-GGUF huggingface.co

QuantFactory
ORGANIZATIONS

Other API from QuantFactory