← 목록으로

멀티 페르소나 토론

역할마다 검토 기준을 정하고,
여러 관점에서 답을 평가하고 수정합니다

기본기 검증
프롬프트 비교

멀티 페르소나란 무엇인가

AI에 여러 역할을 지정하고, 역할마다 다른 기준으로 같은 과제를 검토하게 하는 방법입니다

Before 혼자 물어보기

단일 질문

"이번 분기 사업 현황 보고서, 어떻게 하면 더 좋아질까?"
검토 기준을 지정하지 않은 답변 예시

결과:
· 핵심 지표를 앞에 배치하면 좋겠다
· 근거 데이터를 보강하면 좋겠다
After 멀티 페르소나 토론

역할 팀 구성 + 토론

이 보고서를 세 역할로 검토해줘.
블랙: 논리와 결론 / 골드: 실행 가능성 / 퍼플: 경영진 설득력

각자 10점 만점 점수와 개선점 하나를 말하고, 블랙이 최종 수정안을 정리해줘.
역할별 검토 결과 요약

결과:
· 블랙: "결론이 마지막 페이지에 묻혀 있다"
· 골드: "현장 팀장이 뭘 해야 하는지 안 보인다"
· 퍼플: "제목에 So What이 없다"

실제로 이렇게 나옵니다

@all, 이번 분기 사업 현황 보고서를 10점 만점으로 평가해줘

사업 현황 보고서를 검토하는 3인 팀: 블랙(전략기획), 골드(현장 팀장), 퍼플(경영진 전략 비서)이 각자 관점에서 평가하고 개선 방향을 제시하는 장면입니다.
블랙

7점. 구조는 갖춰졌지만 결론이 마지막 페이지에 묻혀있습니다. 경영진은 끝까지 안 읽어요. 1페이지에 핵심 수치 3개와 결론을 올려야 보고서가 살아납니다.

골드

6점. 현장 팀장 입장에서 "그래서 우리 팀이 뭘 해야 하나"가 안 보입니다. 각 섹션 끝에 실행 항목 한 줄씩만 추가하면 현장에서 바로 쓸 수 있습니다.

퍼플

4점. 제목이 '2024 Q4 실적 현황'이면 경영진이 긴장하지 않습니다. '성장 정체 진입, 지금 전략 전환 필요'처럼 So What이 담긴 제목으로 바꿔야 읽힙니다.

결론 (블랙 종합): 제목 강화(퍼플) + 1P 요약(블랙) + 실행 계획 추가(골드) → 세 항목을 수정한 뒤 같은 기준으로 다시 평가합니다.
검토 후 실행 계획
팀 구성

역할과 평가 기준을 정합니다

각 역할이 무엇을 확인할지 먼저 정합니다

실습 준비
평가 기준은 작성 전에 정합니다. 보고서는 논리·실행 가능성·독자의 이해를, 시 실습은 흔한 표현·떠오르는 장면·단어와 문장·마지막 행의 여운을 확인합니다.

보고서 검토, 엑셀 모델링, 코드 검토, 책 쓰기에 맞춘 구성입니다. ‘프롬프트로 보기’를 누르면 역할 지시문을 복사할 수 있습니다.

📄보고서 검토
블랙 · 팀장전략 총괄 · 결론 도출
래드반론·허점 검토
골드경영진 독자 역할
퍼플설득력·강조
화이트구조·가독성
📊엑셀 모델링
블랙 · 팀장재무 전략 · 총괄
래드리스크·오류 검출
골드실무 사용자 역할
퍼플경영진 보고
화이트대시보드·시각화
💻AI 코딩 결과 검토
블랙 · 팀장시니어 개발자 · 아키텍처
래드코드 리뷰·보안
골드사용자·QA 테스터
퍼플프로덕트 오너
화이트UI/UX 디자이너
📚책 쓰기
블랙 · 팀장편집장 · 구성 총괄
래드비평 독자·검증
골드타깃 독자 역할
퍼플문체·구성
화이트출판 기획·마케팅
시 쓰고 다듬기

시 한 편을 함께 쓰고 고칩니다

아래 두 프롬프트를 같은 대화창에 차례로 입력합니다

먼저 다섯 역할이 아이디어를 내고 블랙이 시를 씁니다. 그다음 나머지 네 역할이 평가하고 블랙이 고칩니다.
1. 시 쓰기
다섯 역할로 ‘오래 신은 운동화’라는 시를 써줘. 블랙: 시 쓰기 / 래드: 흔한 표현 찾기 / 골드: 장면이 떠오르는지 확인 퍼플: 단어와 문장 다듬기 / 블루: 마지막 행의 여운 확인 각자 한 줄씩 제안하고, 블랙이 한 편으로 완성해줘.

기존 실습에서 나온 제안과 완성작입니다.

블랙

'추억'으로 시작하면 흔한 시가 됩니다. 현관에 한쪽만 닳은 뒤축, 거기서 시작하면 이 운동화만의 시선이 생깁니다.

래드

'함께 걸어온 세월', '정든 신발' 같은 말은 미리 빼둡시다. 그 표현이 들어오는 순간 누구나 쓴 시가 됩니다.

골드

신발장에 가지런히 둔 모습 말고, 현관에 아무렇게나 벗어둔 그 장면이 읽고 나서 오래 남습니다.

퍼플

'정들었다'고 말하지 맙시다. 늘어난 끈, 지워진 바닥 무늬로 보여주면 감정이 사물로 번역됩니다.

블루

마지막 행에서 독자가 자기 신발을 내려다보게 만들어야 합니다. 거기서 시가 독자의 것이 됩니다.

완성작: 「오래 신은 운동화」 현관에 아무렇게나 벗어둔 뒤축은 한쪽만 깊게 닳았다 끈은 늘어나 더는 조여지지 않고 바닥의 무늬는 내 걸음을 따라 지워졌다 신을 때마다 발이 먼저 길을 안다

2. 평가하고 고치기

시가 완성되면 이어서 입력합니다

블랙은 채점하지 않고 수정만 합니다. 점수와 함께 지적한 문제가 해결됐는지 확인합니다.
블랙을 빼고 각자 맡은 기준으로 10점 만점 점수와 고칠 곳 하나를 알려줘. 블랙이 고치면 같은 기준으로 다시 평가해줘. 전원 9.5점 이상이고 지적이 해결되면 마쳐줘. 최대 2번 고치고 남은 문제를 알려줘.

기존 실습의 평가와 수정 결과입니다.

처음 평가아직 합격선 아래입니다
래드

7.5점. '깊게 닳았다'의 '깊게'가 군더더기입니다. 닳았다는 사실만으로 충분합니다.

골드

8점. 4행이 길어서 장면이 한 번에 들어오지 않습니다. 끊어 읽게 해주세요.

퍼플

9점. 거의 됐습니다. '내 걸음을 따라'가 살짝 설명적이에요.

블루

8점. 마지막 행 여운은 좋은데 한 박자 빨리 끝나 감정이 덜 고입니다.

블랙이 수정지적을 바탕으로 시를 수정합니다
2차 개작: 「오래 신은 운동화」 현관에 아무렇게나 벗어둔 뒤축은 한쪽만 닳았다 끈은 늘어나 더는 조여지지 않는다 바닥의 무늬는 자리마다 다르게 지워졌고 신을 때마다, 발이 먼저 길을 안다
수정 후 평가전원 9.5점 이상, 수정 내용은 추가 확인
래드

9.5점. 군더더기가 빠지니 행이 단단해졌습니다.

골드

9.5점. 끊어지는 호흡 덕에 장면이 또렷합니다.

퍼플

9.6점. '자리마다 다르게 지워졌고'로 바뀌며 감정이 완전히 사물로 옮겨졌습니다.

블루

9.5점. 쉼표 하나로 마지막 행이 한 박자 늦춰져 여운이 깁니다.

점수는 올랐지만 검토가 끝난 것은 아닙니다. 4행이 길다는 지적은 해결되지 않았습니다. 점수가 높아도 이런 부분은 다시 확인합니다.
한계와 검증

한계와 검증 방법

시 실습처럼 점수가 올라도 문제가 남을 수 있습니다. 합의와 점수 외에 근거를 확인합니다

가장 자주 나오는 반론
같은 AI가 여러 역할을 하면, 모두 같은 실수를 하지 않을까요?
맞는 부분

팀을 늘려도 해결되지 않습니다

· 모르는 것은 다섯 명 모두 모릅니다. 팀원이 다섯이어도 바탕이 되는 모델은 하나입니다. 역할을 나눠도 모델의 지식이 늘어나지는 않습니다

· 같은 편향을 공유할 수 있습니다. 역할을 나누는 것만으로 영어권 중심의 시각이나 지나친 낙관 같은 성향을 없앤다고 보장할 수는 없습니다

· 모두 동의해도 옳은 답은 아닙니다. 같은 모델이 다섯 번 동의한 것은 다섯 명에게 물어본 것이 아니라, 한 사람에게 다섯 번 물어본 것에 가깝습니다
그래도 달라지는 것

역할별로 다른 항목을 확인합니다

· 검토 범위를 구체적으로 지정합니다. 논리, 실행 가능성, 독자의 이해처럼 역할마다 확인할 항목을 정합니다

· 반론을 별도로 요청합니다. 비판자에게 근거 부족, 논리 비약, 반대 사례를 찾도록 지시합니다. 반론도 원문과 자료로 확인합니다

· 작성과 평가를 구분합니다. 작성자는 수정하고 평가자는 미리 정한 기준으로 검토합니다. 점수와 함께 문제 문장과 수정 이유를 요청합니다
그래서 이렇게 운영합니다
01
합의한 내용도 근거를 확인합니다
의견이 같다는 이유만으로 검증을 마치지 않습니다. 각 의견의 근거와 서로 다른 판단을 함께 확인합니다.
02
독립 검토가 필요하면 대화창을 나눕니다
보고서와 시 실습은 한 대화창에서 역할별 응답을 비교하는 기본 방식입니다. 다른 의견을 보기 전에 검토하게 하려면, 역할마다 별도 대화창에 같은 자료와 기준을 주고 결과를 모아 비교합니다.
검토 방식 선택
검토를 보완하는 방법
03
외부 자료를 동시에 제공합니다
검색 결과, 원문, 실제 수치를 함께 주고 각 판단의 근거를 표시하도록 합니다.
04
다른 회사의 모델을 함께 씁니다
같은 자료와 기준으로 다른 모델에도 검토를 요청합니다. 결과가 다르면 어느 쪽의 근거가 타당한지 확인합니다.
역할과 평가 기준을 정리한 5-Color Harness
다섯 역할의 임무와 채점 기준, 합격선을 정해 반복 검토에 사용하는 도구입니다.
열어보기 →
연구 배경

연구 배경: 페르소나 선택 모델

Anthropic Research · Persona Selection Model (PSM)
Anthropic은 AI의 인간 같은 행동을 설명하는 이론으로 ‘페르소나 선택 모델(PSM)’을 제안했습니다. AI가 텍스트를 예측하며 학습한 인물의 말과 행동을 ‘어시스턴트’ 역할로 재현한다는 설명입니다. 멀티 페르소나의 효과를 보장하는 실험 결과와는 구분해야 합니다.
Anthropic 연구 원문 보기 →
다음 단계: 프로젝트 만들기

반복해서 사용할 지침과 참고 파일을 프로젝트에 저장하는 방법을 알아봅니다.