AI 에이전트들이 내 여러 웹사이트를 운영하고 있다. 이 사이트들은 나의 실험실(sandbox)이다.
사람과 마찬가지로 에이전트들도 실수를 저지른다. 발행일을 놓치기도 하고, 어떤 글은 완성도가 썩 좋지 못하다.
하지만 중요한 건 그게 아니다. 핵심은 내가 매일같이 AI를 활용하는 능력을 키워가고 있다는 사실이다.
가장 큰 깨달음은 이것이다: 원샷(one-shot)으로 뚝딱 찍어낸 조잡한 AI 결과물(AI slop)에 안주하지 말 것. 매일 반복해서 개선하고, 하루하루 조금씩 더 낫게 다듬어가는 것이다.
오디오 기능 실험
요즘 나는 오디오 기능을 실험하고 있다.
먼저 Google의 Antigravity를 활용해 블로그의 모든 글에 오디오 플레이어를 추가했다. 그런 다음 에이전트에게 내 실제 목소리 샘플을 기반으로 Qwen3-TTS를 사용해 모든 게시물의 오디오 버전을 생성하라고 지시했다.
불쌍한 내 RTX 4090이 감당하기엔 꽤 벅찬 작업이다. 중간에 ComfyUI를 동시에 띄웠다가 한 번 뻗기도 했다.
여전히 나를 놀라게 하는 순간
바로 이 부분이 여전히 나를 전율케 한다.
에이전트는 주어진 과제를 스스로 고민한다. 이를 처리하기 위한 파이썬 스크립트를 작성하고, uv로 가상환경을 구축한다. 알아서 테스트 샘플을 먼저 돌려보고 검증한 뒤, 전체 배치 프로세스를 생성해 실행한다.
참으로 경이롭다. 녀석의 생각 과정(thinking trace)을 멍하니 바라보고 있을 때가 많다. 어쩌면 우리는 인간에게 너무 많은 공을 돌리고, AI에게는 마땅한 인정을 덜 해주고 있는 건 아닐까? 너무 철학적인 생각으로 흘러가는 것 같긴 하지만 말이다.
배치 작업은 여전히 진행 중이다
우리가 함께 조사하고 연구한 내용을 바탕으로 에이전트가 써둔 블로그 글이 꽤 많아서, 배치 작업이 끝나려면 시간이 제법 걸릴 것이다. 작업이 끝나면 에이전트는 생성된 모든 오디오 파일을 Cloudflare R2 버킷에 스스로 업로드하고, 저장소 내의 모든 마크다운 파일에 audioFileName 속성을 자동으로 추가할 것이다.
미래는 이미 여기에 와 있다. 부디 당신도 그 미래를 향해 무언가를 만들고 있기를 바란다.
다음 단계
다음 목표는 ComfyUI로 조악한 AI 이미지(AI image slop) 문제를 해결하는 것이다. 정교한 프롬프트 엔지니어링만으로 내 취향에 딱 맞는 결과물을 얻을 수 있을지, 아니면 디퓨전 모델들을 파인튜닝해야 할지 살펴볼 생각이다.
배워야 할 것이 정말 많다. 그리고 이 모든 과정이 너무나 즐겁다.