Strata v0.1.34 릴리스: Windows 환경 AMD GPU 가속 및 내장 MCP 서버 지원

오픈소스 로컬 LLM 추론 엔진 Strata가 v0.1.34 업데이트를 통해 Windows 운영체제에서의 AMD GPU 하드웨어 가속과 AI 코딩 에이전트 연동을 위한 내장 Model Context Protocol(MCP) 서버를 공식 지원합니다.

tau · 2026년 10월 3일

#Strata #AMD #Windows #MCP #로컬LLM #AI도구

Strata v0.1.34 릴리스: Windows 환경 AMD GPU 가속 및 내장 MCP 서버 지원

개발자 니코 바이트(Niko Veit, @coldniko)가 오픈소스 로컬 대형 언어 모델(LLM) 추론 엔진 Strata의 v0.1.34 버전을 공개했습니다. 이번 릴리스의 핵심은 윈도우(Windows) 운영체제 환경에서의 AMD GPU 하드웨어 가속 지원과 외부 AI 에이전트 도구 생태계와 직결할 수 있는 내장 모델 컨텍스트 프로토콜(Model Context Protocol, MCP) 서버의 도입입니다.

Windows 환경에서 AMD GPU 가속과 MCP 서버를 지원하는 Strata 로컬 LLM 추론 엔진

이미지 출처: Niko Veit (@coldniko) / Niko1221 Strata

Windows 기반 AMD GPU 가속 공식 지원과 하드웨어 확장

기존 엔비디아(NVIDIA) CUDA 중심의 로컬 LLM 추론 환경에서 벗어나, 윈도우 환경의 AMD GPU 사용자들도 Strata를 통해 하드웨어 가속 추론을 실행할 수 있게 되었습니다.

  • Radeon Pro 구동 사례 보고: 한 커뮤니티 사용자가 AMD Radeon Pro W7900 환경에서 IQ2 양자화 모델과 256K 컨텍스트로 구동한 사례를 보고했습니다. 개발자는 W7800을 48GB RAM 시스템에서 구동 중인 사용자가 있다고 답했습니다. 이는 개별 사용자 보고이며 대표 성능 측정이 아닙니다.
  • 초기 지원 및 엣지케이스 수정: 현재 Windows AMD 지원은 초기 단계로, 개발자는 릴리스 안내에서 이슈 수정 작업을 병행하고 있다고 밝혔습니다.

내장 MCP 서버를 통한 AI 에이전트 생태계 직결

v0.1.34 버전에는 Model Context Protocol(MCP) 서버 기능이 포함되었습니다.

  • 에이전트 직접 호출: 별도의 외부 브릿지나 복잡한 미들웨어 설정 없이, 외부 AI 에이전트가 Strata 엔진을 로컬 도구 및 추론 엔드포인트로 직접 호출할 수 있도록 설계되었습니다.
  • 로컬 자원 기반 워크플로우 통합: 로컬 PC의 하드웨어 리소스를 에이전트 파이프라인의 백엔드로 직결하는 구성을 목표로 합니다.

향후 로드맵과 주의점

Strata 프로젝트는 이번 릴리스 이후에도 지속적인 최적화 및 호환성 확장을 이어가고 있습니다.

  • KV 캐시 최적화 작업 중: FreeTokens에 구현된 KV 캐시 최적화 기법의 도입을 요청받자 개발자는 작업 중이라고 답했습니다.
  • 혼합 장치 및 구형 아키텍처 지원 요청: 엔비디아 CUDA와 AMD HIP 장치를 나누어 쓰는 혼합 구성이나 구형 GPU 아키텍처(Pascal, gfx1031 등)에 대한 지원은 커뮤니티에서 요청·질문된 사항이며, 확보된 증거에는 개발자의 확정 답변이 없습니다.

출처