AWS, Qwen 기반 오픈소스 경량 에이전트 모델 Strands 공개
AWS가 에이전트 개발 속도를 높이기 위한 경량 의사결정 모델을 오픈소스로 공개했어요.
AWS의 실험적 에이전트 개발 프로젝트 Strands Labs가 Alibaba Qwen 기반을 파인튜닝한 무료 오픈소스 모델 Strands Decider 2B를 공개했어요. 이는 AI 에이전트를 더 저렴하고 빠르게 만들기 위한 경쟁에 대응하기 위한 조치예요. AWS는 텍스트 생성을 배제해 지연시간을 줄이고 에이전트 개발을 가속하기 위해 이 모델을 선보였어요. Qwen3.5-2B 기반에 맞춤형 포인터 헤드를 적용해 구축되었으며 Hugging Face와 GitHub를 통해 오픈소스로 배포되었어요.
텍스트 생성을 과감히 덜어내고 의사결정 속도와 비용 절감에 집중한 에이전트 모델의 기술적 세부 사항이 함께 공개된 점을 볼 만해요.
초경량 파라미터와 포인터 헤드 구조로 지연시간을 단축하려는 시도로 정리돼요.
오픈소스로 풀린 경량 에이전트 모델이 실제 개발 생태계에서 얼마나 빠르게 활용될지 주목할 만해요.