Hero photograph for: GPT-5 Is Not Your Competitor. Your Workflow Is.

GPT-5는 당신의 경쟁자가 아니에요. 워크플로우가 경쟁자예요

새 모델이 나올 때마다 무너지는 AI 제품은, 사실 모델 때문에 무너진 적이 없어요. 워크플로우가 없어서 무너진 거예요.

· 7분 읽기

GPT-5는 당신의 경쟁자가 아니에요. 워크플로우가 경쟁자예요

모두가 잘못된 질문을 하고 있어요

inline 1

GPT-5가 나올 때마다 제 메일함에는 같은 질문이 쌓여요. “형, 이제 우리 AI 제품 죽는 거 아니에요?”

솔직히 말할게요. 모델 때문에 죽지는 않아요. 거의 항상 워크플로우 때문에 죽어요.

저는 건설 도메인에서 두 개 AI 제품을 운영하고 있어요. Pante와 BuildChain. 지금까지 세 번의 모델 세대를 겪었어요. 단 한 번도 새 모델이 우리를 죽인 적이 없어요. 우리를 위협한 건, 경쟁사의 워크플로우가 우리 것보다 빠르고 매끈해 보일 때였죠.

모델은 강이에요. 워크플로우는 배예요. 강이 빨라졌다고 빠지는 사람은 없어요. 배가 없는 사람이 빠지는 거예요.

모델은 API예요. 워크플로우가 제품이에요

inline 2

GPT-5가 나오면 한국 빌더들이 가장 먼저 묻는 게 이거예요. “GPT-5가 구조도면을 GPT-4보다 잘 읽나요?”

질문이 비껴가 있어요. 모델이 곧 제품이라는 전제가 깔려 있거든요. 모델은 제품이 아니에요. 모델은 API예요.

제품은 그 위에 올라갑니다. 도면 수집·적재 파이프라인, 도메인 규칙, 검토(리뷰) 루프, 담당자 서명 단계, 고객사 법무팀이 실제로 요구하는 감사 로그 — 이게 제품이에요.

a16z가 정리한 표현을 빌리면 모델 도메인전문가 도메인이 있어요. “이메일 써줘” 같은 모델 도메인은 OpenAI 같은 파운데이션 랩이 기본값으로 이기는 영역이에요. 반면 “이 보험 청구를 약관과 12년치 판례에 대조해서 검토해줘” 같은 전문 영역은 버티컬 빌더가 가져가는 판이고요. 워크플로우가 해자거든요.

건설은 전형적인 전문가 도메인이에요. 구조 검토는 “이 PDF 요약해줘”가 아니에요. 도면을 파싱하고, 시방서와 대조하고, 한국 건축법에 맞는지 확인하고, 책임 기술자가 놓치면 소송으로 번질 소지가 큰 세 가지를 표시하고, 화요일 협의회에서 PM(프로젝트 매니저)이 바로 들고 갈 수 있는 형태로 출력하는 일이에요.

GPT-5는 이걸 못 해요. 워크플로우가 하는 거예요. GPT-5는 그 안의 한 재료일 뿐이에요.

제가 매번 돌리는 테스트

inline 3

새 기능을 출시할 때마다 저는 이 질문을 던져요.

내일 OpenAI가 이 기능이 감싸고 있는 한 가지 작업을 10배 잘하는 모델을 내놓으면, 제 제품이 죽나요?

죽으면 — 저는 모델 도메인에서 일하고 있어요. 래퍼인 거죠. 시간을 빌려 사는 중이에요.

죽지 않으면 — 가치는 다른 데 살아 있다는 뜻이에요. 제가 모은 데이터, 제가 인코딩한 규칙, 제가 만든 검토 루프, 고객사 BIM 스택과의 연동. 이런 축 위에서는 모델이 10배 좋아지면 제 제품도 10배 좋아져요. 모델은 위협이 아니라 지렛대예요.

그래서 한국 빌더분들께 계속 말해요. 모델 벤치마크만 들여다보지 마세요. 워크플로우를 벤치마크하세요. 처음부터 끝까지 검토하는 데 시간이 얼마나 걸리나요? 인계가 몇 번 오가나요? 사람이 맥락을 몇 번 다시 설명해야 하나요? 다음 10년의 가치는 거기서 쌓여요.

실제 건설 워크플로우는 이렇게 생겼어요

BuildChain의 구조도면 검토는 프롬프트 한 줄로 끝나지 않아요. 흐름은 이렇습니다.

  1. 수집·정규화 — 도면 PDF를 가져와 레이어를 추출하고, 구조 요소를 분리해 표준 스키마로 정규화합니다.
  2. 맥락 불러오기 — 매칭되는 시방서, 프로젝트 적용 법규, 이전 리비전의 수정 표식을 불러옵니다.
  3. 모델 호출 — 네, 여기서 LLM이 일해요. 하지만 비중은 큽지 않아요. 전체 시간의 15% 정도.
  4. 도메인 규칙 검사 — 모델이 잘 못 하는 결정론적 검사를 돌립니다. 법정 이격거리, 철근 피복두께처럼 모델이 자주 헷갈리는 규정들.
  5. 불일치 검토 루프 — 모델이 잡은 플래그와 규칙 엔진이 잡은 플래그의 불일치를 띄웁니다. 엔지니어의 주의가 거기로 가야 하니까요.
  6. 감사 로그 — 고객사 품질보증팀이 분쟁 시 방어할 수 있도록 전 과정을 기록합니다.

GPT-5가 영향을 주는 건 3번뿐이에요. 1, 2, 4, 5, 6에 제품의 본체가 있어요. 내일 GPT-5로 통째로 바꿔도 워크플로우는 안 바뀌어요. 3번 단계가 조금 더 좋아질 뿐이죠.

이건 범용 AI 강의나 글로는 배우기 어려운 영역이에요. 유튜브 튜토리얼은 모델을 챗봇으로 감싸는 법을 알려줘요. 그 챗봇이 건설사 법무팀의 계약 검토를 어떻게 통과하는지는 아무도 얘기해 주지 않죠.

토스랑 당근이 이미 보여준 거예요

한국 빌더들이 자주 잊는 사실이 있어요. 한국에서 가장 강한 AI 제품들은 이미 워크플로우 게임을 하고 있다는 거예요.

토스의 사기 탐지를 보세요. GPT가 더 똑똑해진다고 토스 사기 탐지가 죽나요? 안 죽어요. 수년치의 거래 패턴 데이터, 한국 금융 규제에 맞춘 규칙, 실시간 차단 워크플로우, 금융감독원 보고용 감사 로그가 촘촘히 엮여 있어요. 모델은 그중 하나의 재료예요.

당근의 커뮤니티 모더레이션도 마찬가지예요. 한국어 비속어, 지역 거래 사기 패턴, 동네별 맥락 — 이 데이터를 제대로 가진 곳은 당근뿐이에요. 파운데이션 모델이 아무리 좋아져도 이 워크플로우는 못 만들어요. 데이터가 없거든요.

당신이 만들어야 할 것도 이 결입니다. 한국 건설, 한국 의료, 한국 제조, 한국 법무 — 어느 버티컬이든 똑같아요.

이번 주에 돌릴 세 가지 테스트

만들고 있는 게 있다면, 출시 전에 매번 이 세 가지를 돌려보세요.

  1. 모델 교체 테스트. GPT를 Claude로, Claude를 Gemini로 바꿔도 제품이 출시되나요? 출시되면 워크플로우가 내 거예요. 안 되면 한 랩의 인질이에요.
  2. 데이터 선순환(플라이휠) 테스트. 모든 고객 상호작용이 다음 상호작용을 더 좋게 만드나요? 그것도 파운데이션 모델이 쉽게 따라 하기 어려운 방식으로? 아니라면 해자가 없는 거예요.
  3. 인계 테스트. AI가 일을 끝내면 그 출력이 어디로 가나요? 바로 사용자에게 가면 챗봇이에요. 서명, 감사, 연동이 있는 규제 워크플로우로 흘러가면 제품이에요.

세 가지 모두 탈락하면 모델 도메인에서 일하고 있는 거예요. 전환하세요.

세 가지 모두 통과하면 다음 GPT 릴리스는 위협이 아니에요. 순풍이에요.

이번 주에 할 것

제품을 다시 만들라는 게 아니에요. 시선을 옮기라는 거예요.

  • 워크플로우를 처음부터 끝까지 매핑하세요. 단계마다 시간을 재세요. 모델 호출이 아닌 단계를 찾으세요. 거기에 방어력이 살아요. 거기에 투자하세요.
  • 모델이 자주 틀리는 도메인 규칙 하나를 고르세요. 결정론적으로 인코딩하세요. 출시하세요. 해자의 벽돌 한 장이에요.
  • 고객이 떼어내기 어려운 연동 하나를 찾으세요. 그들의 BIM, 그들의 PM 도구, 그들의 ERP. 연결기를 만드세요. 모델은 이런 연동기를 만들지 못합니다. 워크플로우가 만듭니다.
  • 30일간 모델 릴리스 노트는 잠시 덮어두세요. 대신 워크플로우 사례를 읽으세요. 보험 도메인의 FurtherAI, 법무의 Harvey, 의료의 Abridge — 프롬프트가 아니라 흐름을 훔치세요.

제가 거는 베팅

저는 워크플로우 레이어에 회사를 걸고 있어요. 파운데이션 모델을 의심해서가 아니에요. 저도 매일 써요. 그리고 매번 더 좋아지고 있어요.

워크플로우 레이어에 거는 이유는, 거기가 도메인을 아는 사람에게 가치가 쌓이는 자리이기 때문이에요.

모델은 강이에요. 더 빨라질 거예요. 더 깊어질 거예요. 분기마다 지형을 바꿀 거예요.

워크플로우는 배예요. 잘 만들면, 빨라진 강이 당신을 더 빠르게 밀어줘요. 안 만들면, 강가에 서서 지나가는 배들을 보며 GPT-5가 왜 위협처럼 느껴졌는지 궁금해할 거예요.

처음부터 위협이 아니었어요. 없는 워크플로우가 위협이었어요.

배를 만드세요.