- needle-in-a-needlestack는 GPT-4o, Llama, Jamba, Sonnet, Gemini 관련 실험 글과 코드를 한곳에 모은 공개 페이지임
- 프로젝트의 코드 저장소가 함께 제공되어 Needle in a Needlestack 실험 자료를 직접 확인할 수 있음
- 모델별 글은 긴 컨텍스트 처리와 확장성 차이를 중심으로 Llama 3.1 8B, Jamba 1.5 등의 결과를 비교함
- GPT-4o-mini는 GPT-4 Turbo와 비슷하면서 가격이 98.5% 낮은 사례로, Sonnet 3.5는 NIAN에서 Sonnet 3.0보다 나은 사례로 소개됨
- 페이지 자체가 오픈소스라 GitHub의 “Improve this page” 링크로 문서 수정에 참여할 수 있음
Needle in a Needlestack 관련 링크
- Needle in a Needlestack Code: Needle in a Needlestack 코드 저장소
- GPT-4o’s Memory Breakthrough!: GPT-4o의 메모리 혁신을 다루는 글
- GPT4o-mini comparable to GPT-4 Turbo, for 98.5% lower price: GPT-4o-mini가 GPT-4 Turbo와 비슷하면서 가격은 98.5% 낮다는 글
모델별 비교 글
- Llama 3.1 8B: Excels in 8K Contexts, Challenged by Expansion: Llama 3.1 8B가 8K 컨텍스트에서는 강하지만 확장에는 어려움이 있다는 내용
- Jamba 1.5: New model with new architecture crushes Needle-in-a-Needlestack: Jamba 1.5가 새 아키텍처로 Needle-in-a-Needlestack을 크게 앞선다는 내용
- Sonnet 3.5 Does Much Better at NIAN Than 3.0: Sonnet 3.5가 NIAN에서 Sonnet 3.0보다 훨씬 낫다는 내용
- Gemini 1.5 Flash Outperforms Much More Expensive Models: Gemini 1.5 Flash가 훨씬 비싼 모델보다 앞선다는 내용
오픈소스 문서
- 이 사이트는 오픈소스임
- Improve this page 링크를 통해 GitHub에서 페이지를 수정할 수 있음