또 다른 연구자, OpenAI가 대화로 학습한 뒤 돌파구를 이뤘다고 주장했다며 비판

4 hours ago 6

Hacker News 의견들 다른 논의도 있음: https://news.ycombinator.com/item?id=49638353. 원문은 다음 세 게시물임. https://mathstodon.xyz/@andreasthom/117240535270608201 https://mathstodon.xyz/@andreasthom/117240536885387540 https://mathstodon.xyz/@andreasthom/117240537520615623 이번 글은 Bluesky에서 누군가 Twitter 게시물을 링크 없이 캡처한 것이고, 그 Twitter 게시물도 페디버스 원문을 링크 없이 캡처한 것임. 출처 없이 스크린샷만 돌려 나르는 일이 점점 황당해짐. 요즘은 영상도 꽤 정교하게 위조할 수 있는데, 스크린샷 위조는 일곱 살도 할 만한 수준임. 학습에 사용하도록 설정한 대화에 식별용 문구나 카나리아 문구를 넣고, 나중에 모델이 그것을 아는지 시험해 본 사람이 있는지 궁금함. 작은 실험용 모델에서라도 어떤 식으로 작동하는지, 선도 AI 연구소의 제품을 대상으로 의도적으로 검증하는 사람이 있는지 알고 싶음. 직관적으로는 대화 기록 하나가 모델에 큰 흔적을 남기기 어려워 보이지만, 실제 작동 방식이 궁금함. “Improve the model for everyone” 설정을 끄면 자기 데이터가 학습에 쓰이지 않는다고 정말 믿는 건가? 어떻게 그렇게 쉽게 신뢰하게 되는지 궁금함. 문구 자체부터 죄책감을 유도함. 대화에서 좋아요·싫어요 버튼을 누르는 것만으로도 대화 전체가 학습에 사용될 수 있음. 공식 문서에는 개인정보 포털이나 데이터 제어 설정에서 학습을 거부하면 새 대화는 학습에 쓰지 않는다고 되어 있음. 연결된 청소년 계정은 부모나 보호자가 이를 관리할 수 있음. 하지만 학습을 거부했더라도 응답에 피드백을 남기면, 그 피드백과 연결된 대화 전체가 학습에 사용될 수 있다고 명시함. 문서: https://help.openai.com/en/articles/5722486-how-your-data-is.... 보관본: https://web.archive.org/web/20260910151242/https://help.open.... 법과 규제로 안전한 환경을 마련하는 대신, 모든 사람에게 모든 분야의 전문가가 되라고 요구하고 있음. 나도 굳이 전문가가 되고 싶지 않은 분야에서는 실수하므로, 이를 개인 탓으로 돌리고 싶지 않음...

Read Entire Article