llama3-gradient

This model extends LLama-3 8B's context length from 8k to over 1m tokens.

8b 70b
Hızlı Kurulum (Ollama kuruluysa)
ollama run llama3-gradient

Ollama kurulu değil mi? ollama.com/download — Windows, macOS ve Linux için ücretsiz. İlk çalıştırmada model indirilir, sonrası tamamen çevrimdışıdır.

Varyantlar

Boyut büyüdükçe kalite artar, donanım ihtiyacı yükselir. Başlangıç için küçük varyantı deneyin.

EtiketBoyutBağlamGirdiKomut
latest 4.7GB 1M Text ollama run llama3-gradient:latest
instruct 4.7GB 1M Text ollama run llama3-gradient:instruct
1048k 4.7GB 1M Text ollama run llama3-gradient:1048k
8b 4.7GB 1M Text ollama run llama3-gradient:8b
70b 40GB 1M Text ollama run llama3-gradient:70b
8b-instruct-1048k-q2_K 3.2GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q2_K
8b-instruct-1048k-q3_K_S 3.7GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q3_K_S
8b-instruct-1048k-q3_K_M 4.0GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q3_K_M
8b-instruct-1048k-q3_K_L 4.3GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q3_K_L
8b-instruct-1048k-q4_0 4.7GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q4_0
8b-instruct-1048k-q4_1 5.1GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q4_1
8b-instruct-1048k-q4_K_S 4.7GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q4_K_S
8b-instruct-1048k-q4_K_M 4.9GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q4_K_M
8b-instruct-1048k-q5_0 5.6GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q5_0
8b-instruct-1048k-q5_1 6.1GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q5_1
8b-instruct-1048k-q5_K_S 5.6GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q5_K_S
8b-instruct-1048k-q5_K_M 5.7GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q5_K_M
8b-instruct-1048k-q6_K 6.6GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q6_K
8b-instruct-1048k-q8_0 8.5GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-q8_0
8b-instruct-1048k-fp16 16GB 1M Text ollama run llama3-gradient:8b-instruct-1048k-fp16
70b-instruct-1048k-q2_K 26GB 1M Text ollama run llama3-gradient:70b-instruct-1048k-q2_K
70b-instruct-1048k-q3_K_S 31GB 1M Text ollama run llama3-gradient:70b-instruct-1048k-q3_K_S
70b-instruct-1048k-q3_K_M 34GB 1M Text ollama run llama3-gradient:70b-instruct-1048k-q3_K_M
70b-instruct-1048k-q3_K_L 37GB 1M Text ollama run llama3-gradient:70b-instruct-1048k-q3_K_L
70b-instruct-1048k-q4_0 40GB 1M Text ollama run llama3-gradient:70b-instruct-1048k-q4_0

10 varyant daha var — tümü için ollama.com.

Model Detayları ve Benchmarklar (kaynak: ollama.com)

This model extends LLama-3 8B’s context length from 8k to > 1040K, developed by Gradient, sponsored by compute from Crusoe Energy. It demonstrates that SOTA LLMs can learn to operate on long context with minimal training by appropriately adjusting RoPE theta. We trained on 830M tokens for this stage, and 1.4B tokens total for all stages, which is < 0.01% of Llama-3’s original pre-training data.

Large Context Window

Note: using a 256k context window requires at least 64GB of memory. Using a 1M+ context window requires significantly more (100GB+).

To extend the context window (to 256k for example) use:

API

curl http://localhost:11434/api/generate -d '{
  "model": "llama3-gradient",
  "prompt": "Why is the sky blue?",
  "options": {
    "num_ctx": 256000
  }
}'

CLI

ollama run llama3-gradient
>>> /set parameter num_ctx 256000

References

Website

Hugging Face