"(나비에 스토크 문제를 푼) 내부 모델의 훈련은 8월 28일부터 시작"
** 훈련을 시작한지 2주도 되지 않아 1만개의 병렬 에이전트 작업과 1,300억개 토큰으로 나비에-스토크 문제를 풀었다는 것인데
** 여기서 말하는 훈련이 최초 사전훈련의 시작인지, 추가 사전훈련인지, 강화학습인지 알 수 없지만 이 모델의 성능 자체는 일반적 상상을 초월하는 수준임은 분명한듯
** 특히, 이 모델도 여전히 블랙웰로 훈련하는 모델일텐데, 내년 이후 루빈으로 훈련할 모델은..
Forwarded from카이에 de market
