- Windows에서도 Ollama를 네이티브 환경으로 실행할 수 있어, 로컬 대형 언어 모델을 가져오고 실행·생성하는 흐름이 쉬워짐
- Windows용 Ollama는 내장 GPU 가속, 전체 모델 라이브러리 접근, OpenAI 호환 Ollama API를 함께 제공함
- 모델 실행에는 NVIDIA GPU와 AVX, AVX2 같은 최신 CPU 명령어 세트를 활용하며, 별도 설정이나 가상화가 필요 없음
- 전체 모델 라이브러리와 비전 모델을 Windows에서 사용할 수 있고, LLaVA 1.6은 이미지를
ollama run에 드래그 앤 드롭해 메시지에 추가할 수 있음
- 백그라운드에서 실행되는 Ollama API 덕분에 기존 OpenAI용 도구를 로컬 모델과 연결해 쓸 수 있음
Windows 프리뷰 제공
- Ollama가 Windows 프리뷰로 제공되어 Windows에서 대형 언어 모델을 가져오고, 실행하고, 생성할 수 있음
- Windows용 Ollama는 주요 기능을 한 번에 포함함
하드웨어 가속과 실행 방식
- 모델 실행 시 NVIDIA GPU를 사용해 가속함
- 사용 가능한 경우 AVX, AVX2 같은 최신 CPU 명령어 세트도 활용함
- 별도 설정이나 가상화 없이 Windows 환경에서 바로 사용할 수 있음
전체 모델 라이브러리와 비전 모델
- Windows에서도 전체 Ollama 모델 라이브러리를 실행할 수 있음
- 비전 모델도 포함됨
- LLaVA 1.6 같은 비전 모델 실행 중 이미지를
ollama run에 드래그 앤 드롭하면 메시지에 추가할 수 있음
백그라운드에서 동작하는 Ollama API
- Ollama API는 백그라운드에서 자동 실행되며
http://localhost:11434에서 제공됨
- 도구와 애플리케이션은 추가 설정 없이 이 API에 연결할 수 있음
- PowerShell에서 Ollama API를 호출하는 예시는 다음과 같음
(Invoke-WebRequest -method POST -Body '{"model":"llama2", "prompt":"Why is the sky blue?", "stream": false}' -uri http://localhost:11434/api/generate ).Content | ConvertFrom-json
- Windows용 Ollama도 다른 플랫폼과 같은 OpenAI 호환성을 지원함
- 기존 OpenAI용 도구를 Ollama를 통한 로컬 모델과 함께 사용할 수 있음
설치와 피드백
- Windows Preview를 시작하려면 OllamaSetup.exe를 다운로드함
- 설치 파일
OllamaSetup.exe를 더블 클릭해 설치함
- 설치 후 터미널을 열고 다음 명령으로 모델을 실행함
ollama run llama2