본문 바로가기
IT/소프트웨어

🔁 AI 에이전트, 이제 죽지 않는다 — Vercel Workflows가 바꾸는 개발 패러다임

by DrKo83 2026. 6. 13.
300x250
반응형

"로컬에선 됐는데 프로덕션에서 왜 터지죠?" 개발자들이 가장 많이 하는 질문

개발하다 보면 꼭 이런 순간이 찾아오더라고요.

로컬 환경에서는 완벽하게 돌아가던 AI 에이전트가, 실제 서버에 올라가는 순간 중간에 멈추고 다시 처음부터 실행해야 하는 상황. 특히 여러 API를 연속 호출하거나 검색, 요약, 응답처럼 멀티 스텝 작업에서는 중간에 하나만 실패해도 전체가 날아가버립니다.

이건 코드 실력의 문제가 아니에요. 기존 인프라 구조 자체의 한계였거든요.

AI 에이전트 프로덕션 배포, 왜 이렇게 어려웠을까?

장시간 실행되는 백엔드 작업을 서비스에 올리려면 예전엔 정말 손이 많이 갔어요.

큐(Queue) 시스템 별도 설치, 워커(Worker) 프로세스 관리, DB에 상태 저장용 테이블 설계, 실패 시 재시도 로직 직접 구현, 거기다 모니터링까지. 쿠버네티스 위에 Temporal이나 Celery 같은 오케스트레이션 서비스를 따로 띄우는 경우도 많았죠.

결국 개발자들은 실제 비즈니스 로직을 짜는 시간보다 인프라 관리에 훨씬 더 많은 시간을 써야 했어요. 5~10명 규모의 스타트업에서는 이게 정말 치명적이었습니다.

Vercel Workflows 정식 출시, 핵심은 단 두 줄

2026년 4월, Vercel이 이 문제를 정면 돌파하는 솔루션을 정식 출시했습니다. 이름은 Vercel Workflows. 2025년 10월 베타로 시작해 약 6개월 만에 GA(일반 공개)로 전환됐어요.

핵심 아이디어는 정말 단순합니다. 타입스크립트 함수 파일에 "use workflow" 디렉티브를 붙이면, 그 함수 전체가 내구성 있는 워크플로우로 바뀌어요. 각 단계에는 "use step"을 붙이면 끝입니다.

이 두 줄만으로 자동 재시도, 단계별 상태 저장, 실행 관찰, 장애 복구가 전부 따라옵니다. 별도의 큐 설정도, 워커 관리도, 상태 테이블도 필요 없어요.

로컬에서 쓰는 코드와 프로덕션 코드가 완전히 동일하다는 게 가장 큰 차이입니다.

내부 구조를 알면 왜 강한지 이해됩니다

Vercel Workflows의 작동 원리는 세 가지 컴포넌트로 이루어져 있어요.

첫 번째는 이벤트 로그(Event Log)입니다. 모든 단계의 입력, 출력, 에러, 슬립 상태를 전부 기록합니다. 실행 상태의 유일한 진실 공급원 역할을 하죠.

두 번째는 Fluid Compute 위에서 실행되는 함수들이에요. 각 단계가 별도 함수 호출로 나뉘어 실행되며, 워크플로우 라이브러리가 큐 처리, 상태 로딩, 암호화, 실행, 다음 단계 전달까지 전부 알아서 해줍니다.

세 번째는 Vercel Queues입니다. 각 함수가 다음 단계를 자동으로 큐에 넣어주는 방식이에요. 덕분에 코드가 실제로 실행될 때만 비용이 발생하고, 슬립(대기) 상태에서는 컴퓨팅 비용이 0원입니다.

AI 에이전트에 특히 강력한 이유, 내구성 스트림

Vercel Workflows가 AI 에이전트 개발에 특화된 핵심 기능이 있어요. 바로 내구성 있는 스트림(Durable Streams)입니다.

사용자가 브라우저를 닫아도 에이전트는 계속 실행됩니다. 나중에 다시 접속하면 끊긴 지점부터 그대로 이어받아요. 항공권 예약 에이전트가 검색 중에 노트북 전원이 나가도, 다시 열면 결과가 준비되어 있는 식이죠. Redis나 pub/sub 구성 없이도 가능합니다.

보안도 기본값으로 포함되어 있어요. 모든 단계의 입출력과 스트림 청크가 외부로 나가기 전에 자동으로 암호화됩니다. 추가 설정이 전혀 필요 없고요. 단계별 페이로드 50MB, 전체 실행 당 최대 2GB를 지원해서 이미지나 영상을 다루는 멀티모달 에이전트도 충분히 처리할 수 있습니다.

6명 팀이 300만 고객을 서비스하는 실제 사례

실제 고객 사례가 이 기술의 진짜 위력을 보여줍니다.

Durable이라는 서비스는 300만 중소기업을 위해 AI 에이전트로 웹사이트를 자동 생성하는데요, 30초 안에 완성된 사이트를 만들기 위해 수십 개의 병렬 AI 단계를 동시에 처리합니다. 이걸 단 6명의 개발팀이 Workflows로 전환하면서 자체 인프라를 완전히 걷어냈어요.

Flora는 50개 이상의 이미지 생성 모델을 오케스트레이션하는 크리에이티브 AI 서비스입니다. 별도 큐도, 상태 머신도, 서비스도 없이 전체 미디어 생성 파이프라인을 운영하고 있어요.

Flora의 AI 책임자가 남긴 말이 이 기술의 본질을 잘 표현합니다. "인프라 논쟁을 멈추고 제품 논쟁을 시작하게 됐다"고 했거든요.

이미 검증된 숫자들, 베타 이후 6개월의 기록

2025년 10월 베타 출시 이후의 수치도 인상적입니다.

1,500개 이상의 고객사가 사용 중이고, 1억 건 이상의 실행과 5억 건 이상의 단계를 처리했어요. 주간 npm 다운로드는 20만 건을 넘어섰습니다. 스타트업부터 대형 서비스까지, 실제 프로덕션에서 검증된 숫자들이라는 점에서 의미가 다릅니다.

Workflows 5와 Python SDK, 앞으로 어떻게 바뀌나

다음 버전인 Workflows 5에는 새로운 기능들이 추가될 예정이에요.

여러 실행 간 작업을 조율하는 락(Lock) 프리미티브, 글로벌 배포 인프라, 이벤트 히스토리가 늘어날수록 재실행 오버헤드를 줄이는 스냅샷 기반 런타임이 포함됩니다.

무엇보다 주목할 건 Python SDK가 베타로 출시됐다는 점이에요. 기존 타입스크립트 중심이었던 생태계가 파이썬 AI, ML 커뮤니티로 확장되는 겁니다. 데이터 엔지니어링, LLM 파이프라인, ETL 작업까지 동일한 프로그래밍 모델로 통합할 수 있게 되는 거죠.

규제 산업의 한국 B2B SaaS 개발팀에게 특히 중요한 이유

국내 B2B SaaS 스타트업 입장에서 Vercel Workflows가 특히 주목되는 건, 감사 추적(Audit Trail) 때문이에요.

보험, 의료, 금융 같은 규제 산업에서 AI를 도입할 때 가장 큰 장벽 중 하나가 바로 실행 투명성과 이력 관리입니다. 어떤 단계에서 어떤 입력이 들어가고 어떤 결과가 나왔는지 기록이 남아야 하거든요.

Vercel Workflows는 모든 단계가 이벤트 로그에 기록되고, CLI로 언제든 검사 가능하며, 암호화와 감사 추적이 기본 내장입니다. 규제 산업의 컴플라이언스 요구사항을 인프라 수준에서 자연스럽게 충족하는 구조인 셈이에요. 규제 환경이 복잡할수록 이런 기본값 설계가 더 큰 경쟁력이 됩니다.

마무리

Vercel Workflows가 보여주는 방향은 분명합니다.

인프라의 복잡성은 프레임워크가 흡수하고, 개발자는 비즈니스 로직에만 집중한다. 프로토타입과 프로덕션의 간격을 코드 두 줄로 좁힌다는 게 그냥 마케팅 문구가 아니라는 걸, 1억 건의 실행 기록이 증명하고 있어요.

AI 에이전트를 실제 서비스에 올리려는 팀이라면, 큐 설정하고 워커 관리하는 시간에 Vercel Workflows를 먼저 살펴보세요. 인프라 논쟁이 사라지는 순간, 비로소 진짜 제품 이야기를 시작할 수 있으니까요.

300x250
반응형