AI 에이전트 '블랙박스' 걷어낸다…알리바바 클라우드, 코드 안 고치고 실행 과정 추적

김동현 기자 · 입력 2026.10.07 19:36
모델 호출부터 도구 사용까지 자동으로 계측…16개 개발 프레임워크·코딩 에이전트까지 지원
기사 대표 이미지
User:CatOnMars

AI 에이전트가 사람 대신 코드를 짜서 실행하고, 브라우저를 조작하고, 여러 도구를 스스로 불러 쓰는 단계로 발전하면서 새로운 고민거리가 생겼다. 에이전트가 안전하게 움직이는지 확인하는 것을 넘어, 지금 내부에서 정확히 무엇을 하고 있는지를 들여다보는 '관측성(observability)'이 과제로 떠오른 것이다. 관측성이란 시스템 밖에서 로그·지표 등을 통해 내부 동작 상태를 파악할 수 있게 하는 능력을 뜻한다. 지금까지 AI 에이전트는 겉으로 결과만 드러날 뿐, 그 과정은 개발자조차 알기 어려운 '블랙박스'에 가까웠다.

알리바바 클라우드(Alibaba Cloud)는 애플리케이션 코드를 고치거나 컨테이너 이미지를 다시 만들지 않고도 시스템의 동작을 추적할 수 있는 '오픈텔레메트리 eBPF 계측(OpenTelemetry eBPF Instrumentation, OBI)' 기술을 공식 문서로 제공하고 있다. eBPF는 리눅스 운영체제 커널 안에서 별도 프로그램을 안전하게 실행해 시스템 동작을 감시하는 기술이다. 알리바바 클라우드는 컨테이너 서비스 쿠버네티스(ACK) 환경에 OBI를 데몬셋 형태로 배포하면 코드 수정이나 사이드카 프로그램 주입 없이도 지표와 실행 흐름 데이터를 자동으로 모을 수 있다고 설명한다.

알리바바 클라우드는 이와 별도로 AI 에이전트 전용 관측 체계도 운영하고 있다. 회사 공식 블로그에 따르면 'AgentLoop'라는 관측 플랫폼과 'LoongSuite Pilot'이라는 수집기가 에이전트의 동작을 담당한다. 'loongsuite-instrument'라는 명령 하나만 실행하면 각 개발 프레임워크에 후크(hook)나 몽키패치 방식의 탐지 코드가 자동으로 심어져, 개발자가 직접 코드를 고치지 않아도 계측이 이뤄진다. 이 방식은 랭체인(LangChain)·랭그래프(LangGraph)·에이전트스코프(AgentScope)·디파이(Dify) 등 16개 개발 프레임워크와 클로드 코드(Claude Code), 코덱스(Codex), 커서(Cursor), 코더(Qoder) 등 코딩 에이전트까지 폭넓게 지원한다.

이와 함께 알리바바 클라우드는 에이전트가 실제로 실행되는 '샌드박스(Sandbox)' 환경의 성능도 공개했다. 공식 문서를 보면 에이전트 샌드박스는 분당 최대 1만5000개까지 확장해 만들어낼 수 있고, 잠시 쉬고 있던 샌드박스도 1~10초 안에 이전 메모리 상태로 되살아난다. 실행에 필요한 이미지를 미리 저장해두는 이미지 캐시 가속 기능은 일반적인 상황에서 이미지를 불러오는 시간을 90% 넘게 줄여준다고 밝혔다.

다만 OBI 자체는 일반 애플리케이션의 관측성을 설명하는 기술이며, AI 에이전트의 모델 호출·도구 사용·외부 서비스 접속까지 구체적으로 추적한다고 알리바바 클라우드가 명시한 자료는 확인되지 않았다. AI 에이전트의 실행 과정을 들여다보는 기술은 범용 계측인 OBI와 에이전트 전용 계측인 AgentLoop·LoongSuite Pilot이라는 두 갈래로 이뤄져 있는 것으로 풀이된다.

자료: 알리바바 클라우드

저작권자 © 한국R&D신문 — 무단 전재 및 재배포 금지
김동현 기자 dh.kim@k-rnd.net
전자·AI·소프트웨어 — 전자회로·통신·임베디드, 생성형 AI·머신러닝·데이터
댓글 0 최신순 추천순

첫 댓글을 남겨보세요.

0 / 400 · 회원 로그인 시 닉네임으로 작성 · 비회원 수정은 작성 후 1분 이내