최신논문

전체 258
번호 제목 작성자 작성일 추천 조회
98
언어모델은 비밀리에 Q-함수입니다
| 2024.07.04 | 추천 0 | 조회 408
2024.07.04 0 408
97
자가 플레이 적대 언어 게임은 LLM 추론을 향상시킵니다.
| 2024.07.04 | 추천 0 | 조회 625
2024.07.04 0 625
96
여러 시뮬레이션된 세계에서 Instructable 에이전트 확장
| 2024.07.04 | 추천 0 | 조회 527
2024.07.04 0 527
95
압축은 지능을 선형적으로 나타냅니다.
| 2024.07.04 | 추천 0 | 조회 527
2024.07.04 0 527
94
Generalist Vision Transformer를 향하여
| 2024.07.04 | 추천 0 | 조회 465
2024.07.04 0 465
93
Quiet-STaR: 언어 모델은 말하기 전에 스스로 생각하는 법을 배울 수 있습니다.
| 2024.07.04 | 추천 0 | 조회 629
2024.07.04 0 629
92
1비트 LLM 시대: 모든 대규모 언어 모델은 1.58비트입니다.
| 2024.07.04 | 추천 0 | 조회 406
2024.07.04 0 406
91
언어모델을 넘어: 바이트 모델은 디지털 세계 시뮬레이터입니다.
| 2024.07.04 | 추천 0 | 조회 371
2024.07.04 0 371
90
그리핀: 효율적인 언어 모델을 위한 지역적 주의와 게이트 선형 재귀를 혼합
| 2024.07.04 | 추천 0 | 조회 408
2024.07.04 0 408
89
트랜스포머가 경사 하강을 통해 인과 구조를 학습하는 방법
| 2024.07.04 | 추천 0 | 조회 396
2024.07.04 0 396