Stack Exchange
entities · 1 notes linked
Related: Hugging Face · Llama · Reinforcement Learning · Large Language Models · RLHF
Notes
- Hugging Face Introduces StackLLaMA: A 7B Parameter Language Model Based on LLaMA and Trained on Data from Stack Exchange Using RLHF — Hugging Face RLHF fine-tuning of LLaMA 7B on Stack Exchange Q&A data