▲LLaMA - Meta가 공개한 65b 파라미터 LLM (ai.facebook.com)7P by xguru 2023-02-28 | ★ favorite | 댓글과 토론 7B, 13B, 33B, 65B 의 4가지 사이즈로 공개 훨씬 작은 규모지만, 데이터 학습 강화 및 파인 튜닝하여 더 큰 규모의 모델과 비교가능한 효율적인 모델 33B/65B는 1조 4천억개의 토큰으로 훈련됨(7B는 1조) "13B 모델이 175B인 GPT-3보다 뛰어나고, 65B는 훨씬 더 큰 Chinchilla70B 및 PaLM-540B 와 경쟁 가능" 인공지능 연구등 비상업적 용도로만 활용 가능(신청하여 승인 필요) 함께 보면 좋은 글 β LLaMA 모델의 간략한 역사 LIMA - 65B LLaMA 모델과 1000개의 프롬프트만으로 GPT-4에 근접하는 성능을 내기 Meta, Llama 3.1 공개 로컬 LLM 생태계에는 Ollama가 필요하지 않다 XGen-7B - 1.5T 토큰에 대해 최대 8K 시퀀스 길이로 훈련한 7B LLM 댓글과 토론 인증 이메일 클릭후 다시 체크박스를 눌러주세요