Paul Christiano
entities · 1 notes linked
Related: Openai · Anthropic · Chatgpt · Reinforcement Learning From Human Feedback · AI Safety · AI Alignment
Notes
- 255 — Paul Christiano's defense of RLHF research positive net impact
entities · 1 notes linked
Related: Openai · Anthropic · Chatgpt · Reinforcement Learning From Human Feedback · AI Safety · AI Alignment