CNET Korea뉴스엔터프라이즈

AWS, 한 줄 코드로 시작하는 오픈소스 AI 에이전트 ‘스트랜즈 하네스’ 공개

AWS 자체 테스트서 6개 벤치마크 평균 토큰 비용 28% 절감

(씨넷코리아=윤현종 기자) 아마존웹서비스(AWS)가 23일 로컬 PC에서 실행하거나 다양한 클라우드 환경에 배포할 수 있는 오픈소스 AI 에이전트 ‘스트랜즈 하네스(Strands harness)’를 공개했다.     

스트랜즈 하네스는 AI 에이전트를 실행하는 데 필요한 구성 요소를 하나의 실행 환경으로 묶은 범용 에이전트다. 아파치 2.0 라이선스로 제공되며 개발자는 원하는 AI 모델을 지정하고 파이썬이나 타입스크립트 코드 한 줄로 에이전트를 구동할 수 있다.     

특정 코딩 작업에 한정하지 않고 다양한 업무를 처리하는 범용 에이전트로 설계했다. 기존 AI 에이전트를 직접 구축할 때 필요한 도구 연결과 컨텍스트 관리, 장기 기억, 작업 분배 등의 기능을 기본 제공하는 게 특징이다.     

AWS 자체 테스트에서는 동일한 클로드 또는 GPT 모델을 사용할 경우 스트랜즈 하네스가 6개 벤치마크 전반에서 토큰 비용을 평균 28% 줄인 것으로 나타났다. 정확도는 클로드 코드와 코덱스 등 기존 도구와 동등하거나 높은 수준을 유지했다고 AWS는 설명했다.     

‘페이블 5(Fable 5)’ 모델을 사용한 테스트에서는 클로드 코드보다 비용이 77% 낮았으며 ‘터미널 벤치 2.1(Terminal Bench 2.1)’ 점수는 더 높게 나타났다. 테스트는 아마존 EC2 기반 분산 환경에서 하버(Harbor)를 이용해 진행됐으며 세부 결과는 향후 논문으로 공개할 예정이다.     

토큰 비용 절감에는 컨텍스트 관리 기능이 활용됐다. 도구 실행 결과가 약 1천500토큰을 넘으면 내용을 자동으로 요약·축약하고, 컨텍스트 사용량이 85%를 넘으면 기존 대화 내용을 자동으로 압축한다.     

컨텍스트 용량을 초과하는 상황에서는 실행 도중 자동 복구하는 기능도 제공한다. 반복적으로 사용하는 요청은 프롬프트 캐싱을 통해 저장하고 재사용해 처리 시간과 비용을 줄인다.     

지원 모델은 아마존 베드록을 비롯해 앤트로픽과 오픈AI, 구글의 최신 모델을 포함한다. 로컬 환경에서 실행하는 올라마(Ollama) 모델도 연동할 수 있다.     

기본 에이전트에는 셸 명령 실행과 파일 읽기·쓰기·편집, 웹 검색 등의 도구가 포함된다. 대규모 실행 결과는 파일로 옮겨 컨텍스트 사용량을 줄이며 여러 작업 세션에 걸쳐 장기 기억도 유지한다.     

세션 ID를 이용하면 이전 대화를 이어갈 수 있으며, 복잡한 작업은 내장된 보조 에이전트에 위임한다. 여러 단계로 구성된 작업은 체크리스트 형태로 관리한다.     

배포 환경은 리눅스 컨테이너를 지원하는 플랫폼이라면 제한 없이 구성할 수 있다. 모달과 클라우드플레어 컨테이너스, 애저 컨테이너 앱스, 구글 클라우드 런, 아마존 ECS, 아마존 베드록 에이전트코어 등을 지원한다.     

자연어를 이용해 에이전트를 빠르게 만드는 ‘스트랜즈 CLI(Strands CLI)’도 함께 제공한다. 이용자가 모델 공급자와 지시문, 필요한 도구를 지정하면 에이전트를 시제품 형태로 구성할 수 있다.     

스트랜즈 하네스는 파이썬이나 타입스크립트의 경우 간단한 명령어를 입력해 설치 가능하다. 자세한 내용은 AWS 홈페이지에서 확인할 수 있다.

윤현종 기자mandu@cnet.co.kr

국내외 최신 IT 소식, 쉽고 재미있게 풀어내겠습니다. :)