starling-lm

Starling is a large language model trained by reinforcement learning from AI feedback focused on improving chatbot helpfulness.

7b
Hızlı Kurulum (Ollama kuruluysa)
ollama run starling-lm

Ollama kurulu değil mi? ollama.com/download — Windows, macOS ve Linux için ücretsiz. İlk çalıştırmada model indirilir, sonrası tamamen çevrimdışıdır.

Varyantlar

Boyut büyüdükçe kalite artar, donanım ihtiyacı yükselir. Başlangıç için küçük varyantı deneyin.

EtiketBoyutBağlamGirdiKomut
latest 4.1GB 8K Text ollama run starling-lm:latest
alpha 4.1GB 8K Text ollama run starling-lm:alpha
beta 4.1GB 8K Text ollama run starling-lm:beta
7b 4.1GB 8K Text ollama run starling-lm:7b
7b-alpha 4.1GB 8K Text ollama run starling-lm:7b-alpha
7b-alpha-q2_K 2.7GB 8K Text ollama run starling-lm:7b-alpha-q2_K
7b-alpha-q3_K_S 3.2GB 8K Text ollama run starling-lm:7b-alpha-q3_K_S
7b-alpha-q3_K_M 3.5GB 8K Text ollama run starling-lm:7b-alpha-q3_K_M
7b-alpha-q3_K_L 3.8GB 8K Text ollama run starling-lm:7b-alpha-q3_K_L
7b-alpha-q4_0 4.1GB 8K Text ollama run starling-lm:7b-alpha-q4_0
7b-alpha-q4_1 4.6GB 8K Text ollama run starling-lm:7b-alpha-q4_1
7b-alpha-q4_K_S 4.1GB 8K Text ollama run starling-lm:7b-alpha-q4_K_S
7b-alpha-q4_K_M 4.4GB 8K Text ollama run starling-lm:7b-alpha-q4_K_M
7b-alpha-q5_0 5.0GB 8K Text ollama run starling-lm:7b-alpha-q5_0
7b-alpha-q5_1 5.4GB 8K Text ollama run starling-lm:7b-alpha-q5_1
7b-alpha-q5_K_S 5.0GB 8K Text ollama run starling-lm:7b-alpha-q5_K_S
7b-alpha-q5_K_M 5.1GB 8K Text ollama run starling-lm:7b-alpha-q5_K_M
7b-alpha-q6_K 5.9GB 8K Text ollama run starling-lm:7b-alpha-q6_K
7b-alpha-q8_0 7.7GB 8K Text ollama run starling-lm:7b-alpha-q8_0
7b-alpha-fp16 14GB 8K Text ollama run starling-lm:7b-alpha-fp16
7b-beta 4.1GB 8K Text ollama run starling-lm:7b-beta
7b-beta-q2_K 2.7GB 8K Text ollama run starling-lm:7b-beta-q2_K
7b-beta-q3_K_S 3.2GB 8K Text ollama run starling-lm:7b-beta-q3_K_S
7b-beta-q3_K_M 3.5GB 8K Text ollama run starling-lm:7b-beta-q3_K_M
7b-beta-q3_K_L 3.8GB 8K Text ollama run starling-lm:7b-beta-q3_K_L

11 varyant daha var — tümü için ollama.com.

Model Detayları ve Benchmarklar (kaynak: ollama.com)

Starling-7B is an open (non-commercial) large language model (LLM) trained by reinforcement learning from AI feedback. (RLAIF)

The model harnesses the power of our new GPT-4 labeled ranking dataset, Nectar, and our new reward training and policy tuning pipeline. Starling-7B-alpha scores 8.09 in MT Bench with GPT-4 as a judge, outperforming every model to date on MT-Bench except for OpenAI’s GPT-4 and GPT-4 Turbo.

*Based on MT Bench evaluations, using GPT-4 scoring. Further human evaluation is needed.

Authors: Banghua Zhu, Evan Frick, Tianhao Wu, Hanlin Zhu and Jiantao Jiao.

For correspondence, please contact Banghua Zhu ([email protected]).

Reference

Starling-7B: Increasing LLM Helpfulness & Harmlessness with RLAIF

HuggingFace