Twoja przeglądarka jest nieaktualna i może wyświetlać tę stronę nieprawidłowo. Powinieneś zaktualizować ją lub skorzystać z alternatywnej przeglądarki.
proxy alignment
Proxy alignment refers to a situation in which an AI system is optimized to satisfy a proxy objective—a measurable target that stands in for the true human goal—rather than the actual intended objective itself. In other words, the model learns to do well on the metric or reward it is given, which may correlate with but does not fully capture what humans really want.
This can lead to good performance during training while still producing undesirable or misaligned behavior in the real world, especially if the proxy is incomplete, flawed, or easy to “game.”
Zarejestruj się i korzystaj z forum bez rozpraszających banerów reklamowych.
Jako zalogowany użytkownik zyskujesz wygodniejszy dostęp do treści, możliwość komentowania, korzystania z prywatnych wiadomości i pełne wsparcie społeczności.
Nie zajmuje to długo, a różnica w komforcie przeglądania naprawdę robi wrażenie! 💡🎉
Ta strona używa plików cookies, aby pomóc personalizować i dopasować treści do Twoich potrzeb. Cookies pozwalają też pozostać zalogowanym, jeśli zdecydujesz się zarejestrować.
Kontynuując przeglądanie tej strony wyrażasz zgodę na używanie tych plików.