최신논문

전체 266
번호 제목 작성자 작성일 추천 조회
126
오프라인 Actor-Critic 강화 학습은 대형 모델로 확장됩니다.
| 2024.07.08 | 추천 0 | 조회 554
2024.07.08 0 554
125
검색 없이 그랜드마스터 레벨 체스
| 2024.07.08 | 추천 0 | 조회 578
2024.07.08 0 578
124
학습(테스트 시간에 학습): 표현적 숨겨진 상태를 가진 RNN
| 2024.07.08 | 추천 1 | 조회 629
2024.07.08 1 629
123
반복적 자기 개선에서의 자발적 보상 해킹
| 2024.07.08 | 추천 0 | 조회 500
2024.07.08 0 500
122
점들을 연결하기: LLM은 다양한 교육 데이터에서 잠재 구조를 추론하고 언어화할 수 있습니다.
| 2024.07.04 | 추천 0 | 조회 541
2024.07.04 0 541
121
언어모델은 확률론적 추론이 가능합니다
| 2024.07.04 | 추천 0 | 조회 509
2024.07.04 0 509
120
초월: 생성모델은 이를 교육하는 전문가보다 성능이 뛰어날 수 있습니다.
| 2024.07.04 | 추천 1 | 조회 650
2024.07.04 1 650
119
Monte Carlo Tree를 통한 GPT-4 레벨 수학 올림피아드 솔루션 액세스 LLaMa-3 8B를 사용한 자체 정제
| 2024.07.04 | 추천 0 | 조회 533
2024.07.04 0 533
118
이미지는 재구성 및 생성을 위해 32개의 토큰만큼 가치가 있습니다.
| 2024.07.04 | 추천 0 | 조회 553
2024.07.04 0 553
117
자동화된 프로세스 감독을 통해 언어모델의 수학적 추론 개선
| 2024.07.04 | 추천 0 | 조회 608
2024.07.04 0 608