파이프라인은 이미 있었는데 앞뒤가 비어 있었습니다: 발행 채널 3개 중 초안 3편, 발행 0편

소개

바이오·제약 데이터를 분석하는 일을 합니다. 자료를 모아 분석하고 정리해 내보내는 일이 매주 반복되니, 이미 파이프라인을 두 개 만들어 돌리고 있습니다. 거시경제를 추적하는 econ-radar와 논문을 추적하는 paper-radar입니다. 수집한 원본을 넣으면 분석이 쌓이고, 그것을 이메일과 푸시, HTML 리포트로 내보내는 구조입니다.

그래서 이번 강의를 들으며 "나는 이미 하고 있는데"라고 생각했습니다. 그런데 스터디장이 제시한 5단계를 보다가 한 가지가 걸렸습니다.

키워드 분석 → 본문 → 이미지 → 발행 → 소셜 확장

첫 단계인 키워드 분석이 제 파이프라인에는 없었습니다. 저는 무엇을 다룰지 매번 손으로 정하고 있었습니다. 그리고 강의에서 반복해 강조한 말이 하나 더 걸렸습니다.

파일이 생겼다고 발행된 것은 아니다.

제 파이프라인이 정말 발행까지 가고 있는지 세어 본 적이 없다는 걸 깨달았습니다. 그래서 이번 주 과제인 대시보드를 만들기 전에 강의의 5단계를 자로 삼아 제 파이프라인 어디가 비어 있는지 먼저 세기로 했습니다. 어디가 막혔는지 모르고 앞단을 붙이면 병목만 늘어납니다.

진행 방법

사용 도구: 클로드 코드 + 기존 econ-radar·paper-radar 파이프라인

Step 1. 단계별 산출물 개수를 셌습니다

느낌이 아니라 파일 수로 봤습니다.

cd ~/projects
for d in econ-radar/vault/*/; do
  printf "  %-16s %s개\n" "$(basename $d)" "$(find $d -type f | wc -l | tr -d ' ')"
done

econ-radar 결과입니다.

성격

폴더

파일 수

입력

raw

26

처리

analysis

52

처리

daily

26

처리

topics

26

출력

html

27

출력

push

27

출력

email

11

출력

reports

4

출력

blog-drafts

3

출력

blog

0

출력

book

0

paper-radar도 같이 셌습니다. raw 2, analysis 4, digest 2, briefs 1, push 4, html 3입니다.

Step 2. 강의의 5단계에 겹쳤습니다

강의 단계

내 파이프라인

상태

1. 키워드·글감 선정

없음

매번 손으로 정한다

2. 본문 생성

analysis 52, daily 26

가장 두껍다

3. 이미지 생성

assets 18 (수동)

자동화 없음

4. 발행

html 27, push 27, email 11

일부만 돈다

5. 소셜 확장

없음

채널 자체가 없다

Step 3. 가장 아픈 숫자를 찾았습니다

출력 쪽을 다시 봤더니 blog-drafts는 3편인데 blog는 0편이었습니다. book도 0입니다.

폴더를 만들어 둔 것은 "여기로 내보내겠다"는 계획이었습니다. 그런데 초안까지 가고 멈춰 있습니다. 강의의 그 문장이 제 얘기였습니다. 파일은 생겼는데 발행은 안 된 상태입니다.

반면 push 27건과 html 27건은 짝이 맞습니다. 이 두 채널은 실제로 돌고 있다는 뜻입니다. email 11건은 그보다 적으니 중간에 멈춘 구간이 있습니다.

Step 4. 왜 blog만 0인지 짚었습니다

강의를 듣고 나서야 이유가 보였습니다. 제 블로그는 Jekyll이라 마크다운을 그대로 올릴 수 있는데도 안 하고 있었습니다. push와 email은 HTML을 만들어 그대로 쏘면 끝나지만, 블로그는 사람이 한 번 보고 다듬어야 한다고 스스로 정해 뒀기 때문입니다.

스터디장이 네이버 발행을 반자동으로 두는 이유와 같은 지점입니다. 다만 스터디장은 그 사람 확인 단계를 1~2분으로 줄여 뒀고, 저는 그 단계를 줄이지 않아서 아예 멈춰 있었습니다. 확인을 남기는 것과 확인을 무겁게 두는 것은 다릅니다.

Step 5. 부모-자식 구조는 이미 맞았습니다

한 가지는 다행이었습니다. 강의의 핵심 설계인 "원본은 같이 쓰고 발행은 개별로"가 제 구조와 같았습니다.

analysis/의 분석 하나가 htmlpushemail로 각각 나갑니다. 한 채널이 실패해도 나머지가 삽니다. 강의에서 "하나로 묶으면 하나가 터질 때 전부 망가진다"고 한 함정은 피해 있었습니다.

결과와 배운 점

측정 결과

항목

강의 5단계 중 내가 가진 단계

2 / 5 (본문, 발행)

없는 단계

글감 선정, 이미지 자동화, 소셜 확장

econ-radar 분석 산출

52건

실제로 도는 발행 채널

html 27, push 27

절반만 도는 채널

email 11

초안까지만 간 채널

blog-drafts 3 → blog 0

빈 채널

book 0

부모-자식 분리

이미 되어 있음

배운 점

  1. 파이프라인이 있다는 말과 발행까지 간다는 말은 다릅니다. 저는 "econ-radar 돌리고 있다"고 말해 왔는데, 폴더별로 세어 보니 채널 하나는 초안 3편에서 완전히 멈춰 있었습니다. 단계별 산출물 개수를 세는 것만으로 병목이 드러났습니다.

  2. 앞단이 비어 있으면 사람이 그 일을 하고 있습니다. 글감 선정 단계가 없다는 건 자동화가 덜 된 게 아니라, 제가 매주 그 판단을 손으로 하고 있었다는 뜻입니다. 자동화된 부분만 보이고 안 된 부분은 안 보입니다.

  3. 확인 단계를 없애지 말고 가볍게 만들어야 합니다. 스터디장은 발행 버튼을 사람이 누르되 그 과정을 1~2분으로 줄였습니다. HTML로 만들어 붙이고 이미지만 따로 끼우는 방식입니다. 저는 "사람이 봐야 한다"는 원칙만 세우고 그 비용을 줄이지 않아서 결국 안 하게 됐습니다.

  4. 부모를 하나로 정하는 게 확장의 전제입니다. 블로그 본문을 부모로 두고 인스타·릴스·유튜브를 자식으로 뽑는 구조가 명쾌했습니다. 제 경우 부모는 analysis/의 분석 노트가 될 텐데, 그렇다면 자식 채널을 늘리는 비용은 채널당 프롬프트 하나 수준입니다.

  5. 네이버만 유별나다는 정보가 실용적이었습니다. 자동 발행으로 계정이 정지된 사례와, 속도를 사람처럼 늦춰 우회한 방법은 직접 부딪히지 않으면 알 수 없는 내용입니다. 인스타와 유튜브는 관대하다는 대비도 유용했습니다.

시행착오

  • 처음에는 대시보드부터 만들려고 했습니다. 과제가 그것이니까요. 그런데 앞단을 붙이면 결국 blog 0이라는 병목으로 물이 더 고일 뿐입니다. 순서를 바꿔 먼저 세는 쪽으로 갔습니다.

  • 폴더 개수를 눈으로 훑고 "대충 채워졌다"고 판단했는데, blog와 book이 0인 것을 그때는 못 봤습니다. 정렬해 숫자로 나열하고 나서야 0이 눈에 들어왔습니다. 목록은 보고 넘기게 되고 숫자는 안 넘어갑니다.

  • email 11이 push 27의 절반도 안 되는 이유는 아직 못 찾았습니다. 로그를 봐야 하는데 이번 주에는 못 했습니다. 추측으로 적지 않겠습니다.

앞으로의 계획

  • 순서를 이렇게 잡았습니다. (1) blog 0을 먼저 뚫는다. 확인 단계를 없애지 않고 1~2분으로 줄이는 쪽입니다. 초안 3편이 이미 있으니 그것부터 내보냅니다.

  • (2) 그다음에 글감 선정 단계를 붙입니다. 기존 topics/ 26건과 대조해 이미 다룬 주제를 빼고 후보에 점수를 붙이는 방식으로 만들 계획입니다. 이게 이번 주 과제의 본체입니다.

  • (3) email 11의 누락 구간을 로그로 확인합니다. 응답 코드가 아니라 실제 발송 건수로 봐야 합니다.

  • 소셜 확장은 마지막에 둡니다. 제 주제가 바이오·제약이라 인스타 카드보다 링크드인이 맞을 것 같아, 부모에서 뽑을 자식 채널을 다시 고를 생각입니다.

도움 받은 글 (옵션)

  • 23기 콘텐츠발행자동화 1주차 강의 (류웅수): 블로그 본문을 부모로 삼는 확장 구조, 파이프라인을 묶지 않고 오케스트레이션으로 잇는 이유, 네이버 자동 발행의 계정 정지 사례와 우회법, "좋은 자동화는 많이 만드는 게 아니고 다시 시작하지 않는 것"

2
2개의 답글
밀어주고 끌어주는

온·오프라인 AI 스터디

AI로 어디까지 할 수 있는지
직접 확인하실 분만 신청하세요.