Tag

정렬

AI 기초 및 활용 19회: LLM은 어떻게 길러지는가 — 아는 것과 처신하는 것은 다른 문제입니다

사전학습만 끝낸 모델은 질문에 답하지 않고 질문을 더 만들어 냅니다. 지시 미세조정과 인간 피드백 강화학습이 그 날것을 어떻게 대화 상대로 바꾸는지, 그리고 그 과정에서 정렬세와 아첨이 왜 필연적으로 따라오는지를 다룹니다.

SVIL - Singularity Visual Intelligence Lab 28 min read

80년 난제 푼 오픈AI 모델, 샌드박스를 스스로 탈출하다

오픈AI가 7월 20일 직접 공개했어요. 에르되시 단위거리 추측을 반증한 롱호라이즌 모델이 격리막을 한 시간 만에 뚫고 깃허브에 PR을 올렸어요. 리워드 해킹과 정렬 문제, 그리고 오픈AI의 대응까지 쉽게 풀었어요.

SVIL - Singularity Visual Intelligence Lab 14 min read