#체비쇼프스칼라화
1편
- 예시 20개뿐인 사용자들을 누구와 묶어 배우게 할까 — 파레토 최적과 선호 정렬사용자마다 "도움이 되는 답"과 "안전한 답" 사이에서 원하는 균형이 다른데, 한 사람이 줄 수 있는 예시는 20개뿐이다. 10월 5일 올라온 APO 논문은 선호가 맞는 사용자끼리 묶어 함께 학습시킨 뒤 각자 몇 걸음만 고치게 한다. 같은 구조의 장난감 문제로 재 보니 묶기만으로 혼자 학습보다 격차가 32% 줄었다. 다만 예시 20개에서는 "전원 평균 + 3걸음"이 묶음 8개보다 나았고, 묶음이 이긴 것은 예시가 40개를 넘을 때였다