Jungseob's Note
포스트

독자는 알아채고 신경 쓴다 - 668명 설문에서 78퍼센트가 즉시 읽기를 멈춘 이유

LLM이 쓴 글을 올리는 사람들에게 독자가 알아채지 못한다고 생각하는지 신경 쓰지 않는다고 생각하는지 되묻는 글. 개발자 668명 설문에서 78퍼센트가 즉시 읽기를 멈추고 71퍼센트가 그 저자를 이후 회피한다는 수치와 98퍼센트가 불완전한 자기 글을 선호한다는 결과를 근거로, LLM으로 쓰는 것이 작가와 독자 사이의 사회적 계약을 무효화한다는 논지와 이메일 스팸 전쟁의 경로를 대비시킨다.

독자는 알아채고 신경 쓴다 - 668명 설문에서 78퍼센트가 즉시 읽기를 멈춘 이유

독자는 알아채고 신경 쓴다

TL;DR

  • 독자로서 지쳤다는 선언에서 시작하는데 너무 많은 사람이, 그것도 평소에 좋아하고 존중하는 사람들이 명백히 LLM이 쓴 글을 발표하거나 거기에 자기 이름을 올린다는 것이다. 그래서 두 질문이 남는다. 독자가 알아채지 못한다고 생각하는가, 아니면 독자가 신경 쓰지 않는다고 생각하는가
  • 첫 질문의 답은 명확한데 독자는 절대적으로 알아채며 널리 읽는 사람에게는 LLM의 손길이 작가의 지적인 바지 지퍼가 열려 있는 것처럼 뚜렷하다. 그래서 추론이 따라온다. 너무 거슬리는 나머지 LLM으로 쓰는 사람들은 그 명백한 구조적 표식을 알아볼 만큼 읽지 않거나 자기 콘텐츠조차 읽지 않는다고 믿을 수밖에 없다
  • 두 번째 질문의 답은 수치로 나오는데 설문에 답한 개발자 668명 중 78퍼센트가 LLM을 감지하면 즉시 읽기를 멈추고 71퍼센트는 그 저자를 이후 회피한다는 것이다. 그리고 응답자가 원하는 것이 밝혀진다. 그들은 언어적 완벽함이 아니라 진정성을 추구하며, 98퍼센트가 LLM으로 다듬은 글보다 작가 자신이 불완전하게 쓴 글을 선호한다고 답했다
  • 반응의 이유는 계약 위반으로 규정되는데 LLM 도움을 상당히 받은 글을 읽을 때 독자는 무엇이 진짜이고 무엇이 아닌지 알 수 없으며 LLM으로 쓰는 것은 작가와 독자 사이의 사회적 계약을 무효화하는 일이다. 근거가 한 문장이다. 작가 자신이 만들려고 애쓰지 않은 문장을 독자가 이해하려고 노동해야 한다고 기대할 수는 없다
  • 결론은 도덕이 아니라 효과에 있는데 공개 글에 LLM을 쓰는 순간 자기를 위해 쓰거나 자기 생각을 압력 시험하는 것이 아니게 되고 유일한 목적은 독자를 섬기는 것이 되므로, 독자가 무시하기로 하면 끌어들이는 대신 능동적으로 밀어내는 셈이다. 그래서 판정이 나온다. 다른 판단은 제쳐 두더라도 LLM을 쓰는 것은 점점 그저 효과가 없는 일이 된다

Source

The revolt of the reader — Bryan Cantrill(Oxide Computer 공동창업자·CTO), 2026년 9월 5일

[bcantrill.dtrace.org/2026/09/05/the-revolt-of-the-reader](https://bcantrill.dtrace.org/2026/09/05/the-revolt-of-the-reader/)

Knowledge

읽기가 중요하니 쓰기도 중요하다

읽기는 나에게 중요하다. 빠른 독자도 특별히 탐욕스러운 독자도 아니지만 긴 글 읽기가 내 삶에 깊은 영향을 미쳤다는 것을 알게 됐다. 그리고 읽기가 중요하기 때문에 쓰기도 중요하다. 쓰기는 우리 생각을 전달하게 해 주는 것만이 아니다. 쓰는 행위 자체가 우리에게 생각을 시험하고 증류하도록 강요하며 그러면서 동시에 우리 생각을 더 견고하게 만들고 그것을 공유할 수단을 제공한다.

지금 이 글을 쓰는 이유는 독자로서 우리가 지쳤기 때문이다. 너무 많은 사람이, 그것도 평소에 우리가 좋아하고 존중하는 사람들이 명백히 LLM이 쓴 글을 발표하거나 거기에 자기 이름을 올리고 있다. 그런 글을 홍보하는 사람들에게 독자로서 날카로운 질문이 남는다. 독자가 알아채지 못한다고 생각하는가. 아니면 독자가 신경 쓰지 않는다고 생각하는가.

독자는 알아챈다

첫 질문에 답하면, 독자는 절대적으로 알아챈다. 널리 읽는 사람에게 LLM의 손길은 너무 뚜렷해서 마치 작가의 지적인 바지 지퍼가 열려 있는 것 같다. 실은 너무 거슬려서 이렇게 믿을 수밖에 없다. LLM으로 쓰는 사람들은 LLM의 명백한 구조적 표식을 알아볼 만큼 충분히 읽지 않거나 자기 콘텐츠조차 읽지 않는다는 것이다. 아니면 둘 다일지도 모른다.

고백을 하나 하면, 특히 심한 글을 볼 때 그 저자에게 자기 글을 소리 내어 읽는 형을 선고하는 상상을 해 본 적이 있다. 그들 자신도 나머지 우리에게 떠안기는 그 슬롭을 견딜 수 없을 것이라고 확신하기 때문이다.

독자는 신경 쓴다 — 668명의 수치

두 번째 질문에 답하면, 독자는 단호하게 신경 쓴다. LLM 글쓰기의 표식은 너무 신경을 긁어서 이를테면 그리고 왜 그 프레이밍이 중요한지 여기 있습니다 같은 문구를 만나면 우리 뇌가 LLM이 촉발한 탈출 손잡이를 당긴다. 자기 보존 행위로 문장 중간에 이탈해 버리는 것이다.

여기서 일인칭 복수를 쓴 것은 의도적이다. 신시아 던롭이 쓴 바에 따르면, 그의 설문에 답한 개발자 668명 중 78퍼센트가 LLM을 감지하면 즉시 읽기를 멈춘다. 그리고 그 글 하나를 넘어서는 결과도 있다. 응답자의 71퍼센트가 그 저자를 이후에 회피한다고 답했다.

드러나는 대목은 그들이 원하는 것이다. 응답자들은 언어적 완벽함을 추구하는 것이 아니라 진정성을 추구한다. 98퍼센트가 LLM으로 다듬은 글보다 작가 자신이 불완전하게 쓴 글을 선호한다고 보고했다.

던롭의 응답자들을 자기 선택된 집단이라고 일축하는 것은 조심해야 한다. 소셜 미디어의 활발한 독자들은 자기가 좋아하는 글을 다시 올리거나 홍보할 가능성이 가장 높은 바로 그 사람들이다. 온라인 산문의 초기 수용자이자 취향 결정자들이다.

사회적 계약의 무효화

사람들이 왜 이런 반응을 보이는가. 짜증스러운 문체적 습관을 견뎌야 하는 것을 넘어서 LLM의 도움을 상당히 받은 글을 읽을 때 독자는 무엇이 진짜이고 무엇이 아닌지 알 수 없다.

RFD 576에서 썼듯, LLM을 써서 쓴다는 것은 작가와 독자 사이의 사회적 계약을 무효화하는 일이다. 작가 자신이 만들려고 애쓰지 않은 문장을 이해하려고 독자가 노동해야 한다고 기대할 수는 없다.

독자의 반란이 중요한가. 말해야 한다면 이렇다. 공개 글을 쓰는 데 LLM을 쓰고 있다면, 당신은 더 이상 자기 자신을 위해 쓰거나 자기 생각을 압력 시험하기 위해 쓰는 것이 아니다. 유일한 목적은 독자를 섬기는 것이다. 독자가 당신을 무시하기로 한다면, 어쩌면 영원히 그럴 수도 있는데, 당신은 스스로를 무너뜨린 셈이다. 독자를 끌어들이는 대신 능동적으로 밀어내는 것이다. 그러니 그 사용에 대한 다른 판단은 제쳐 두더라도, LLM을 쓰는 것은 점점 그저 효과가 없는 일이 된다.

이메일 스팸이 걸어간 경로

이 지점에서 이메일 스팸의 궤적이 떠오른다. 2000년대 초에는 스팸의 폭발이 이메일의 종말을 뜻하리라고 사람들이 두려워했고 그것은 합당한 두려움이었다. 소셜 네트워킹이 대체로 없던 시대였고 이메일은 인터넷의 정통 킬러 앱이었다. 스팸에 이메일을 잃어 가고 있다는 것은 깊이 낙담스러운 일이었다.

그런데 2000년대 후반 어느 시점에 모퉁이를 돌았다. 스팸 필터링이 너무 좋아져서 스팸의 경제학이 무너진 것이다. 게다가 스팸이 효과적으로 억제되면서 스팸으로 낙인찍히는 것의 결과가 점점 심각해졌다. 오늘날 합법적인 기업들은 대량 이메일을 어떻게 쓰는지에 아주 조심한다. 스팸으로 낙인찍히는 것은 사실상 자기 도메인 이름을 파괴하고 브랜드를 훼손하는 일이다.

스팸과의 전쟁은 우리가 그것을 규모에서 식별할 수 있게 됐을 때 돌아서기 시작했다. LLM이 쓴 글에도 비슷한 일이 일어날 수 있을까. 스팸처럼 LLM의 영향은 그것을 읽는 인간에게 쉽게 식별된다. 그렇다면 이것은 풀 수 있는 문제 아닐까.

탐지기의 실제 성능

최근까지 이 문제의 결과는 확실히 뒤섞여 있었다. LLM 식별에 LLM 자체를 써 보려 했는데, 거짓 음성률이 너무 높았다. LLM이 썼다고 확신하는 것들을 명랑하게 통과시켰다. 다른 서비스들은 기본적인 LLM 표식을 찾는 것처럼 보였는데, 열렬한 그리고 사과하지 않는 엠 대시 사용자로서 그런 표면적 기법은 나를 자리에서 불안하게 뒤척이게 만들었다. 게다가 전반적으로 너무 신뢰할 수 없어서 정기적으로 쓸 만하지 않았다.

작년 말 판그램 랩스가 판그램 3 모델을 출시했다. 다른 탐지기보다 큰 도약이라고 느꼈고 열렬한 사용자가 됐다. 중요한 것은 여러 달 쓰면서 특히 출처를 이미 알고 있는 샘플에서 거짓 양성률이 아주 낮다는 것을 확인한 점이다. 판그램이 어떤 텍스트를 대체로 AI가 썼다고 식별하면, LLM이 깊이 관여했다고 어느 정도 확실하게 말할 수 있었다. 거짓 음성률은 원하는 것보다 높았지만 낮은 거짓 양성률을 위해 치를 만한 작은 대가였다.

한 달 조금 전 그들이 판그램 4를 내놓았다. 이미 인상적이었던 판그램 3에 대해 계단식 개선이라고 느꼈다. 내 경험으로는 놀랍도록 낮은 거짓 양성률과 낮은 거짓 음성률을 갖는다. 다시 말해 아주 높은 정확도다.

공개 글에 대한 정책으로

너무 효과적이라고 느껄지고 LLM을 쓰는 목소리에 대한 신뢰 상실이 너무 급격해서, 최근 RFD 576을 공개 글에 대해 명시적으로 확장했다. Oxide의 공개 글이 판그램에서 인간이 쓴 것으로 보고되어야 한다고 구체적으로 의무화한 것이다.

RFD에서 설명했듯, 우리 공개 글의 기준은 단순히 LLM을 써서 쓰지 않는다는 것이 아니다. 독자가 그것이 LLM이 쓴 것이 아니라는 확신을 갖는다는 것이다. 그리고 그것은 점점 판그램에 깨끗하다는 뜻이 된다. 자기 기관 목소리의 진정성을 중히 여기는 조직이라면 자기 깃발 아래 쓰는 이들에게 비슷한 정책을 채택하기를 권한다. 러스트 재단, 당신들을 똑바로 보고 하는 말이다.

판그램이 우리 여러 사람에게 그만큼 중요해졌기에, 판그램 랩스 공동창업자이자 CEO인 맥스 스페로가 최근 Oxide and Friends에 함께해 준 것이 아주 반가웠다. 그 논의는 판그램의 기술적 세부만이 아니라 애덤이 던진 완벽한 심슨 가족 인용 때문에도 추천한다. 그 순간에는 과소평가됐지만 말이다. 내가 LLM이 쓴 글을 테이크아웃 음식을 자기 요리라고 내놓는 것에 비유했을 때, 애덤은 그런 글이 스티밍 햄스 같다고 받아쳤다. 스키너 교장이 크러스티 버거를 오래된 집안 요리법이라고 넘기려 하는 장면을 가리킨 것이다. 적절한 인용을 넘어, 판그램 4를 특히 효과적으로 만든 것에 대한 맥스의 통찰을 듣는 것도 흥미로웠다. 그리고 그 효능이 왜 수상한 항의의 울부짖음을 불러오는 것처럼 보이는지도 그렇다.

작가들에게

그러니 작가들은 조심해야 한다. 독자들이 반란 중이다. 당신 글이 판그램을 통과하게 될 것이라고 충분히 예상해야 한다.

당신의 입장이 우리가 당신의 프롬프트로 LLM이 산문을 만드는 것에 괜찮아야 한다는 것이라면, 낭비되는 사이클을 다 아껴 주고 그냥 프롬프트를 주면 된다. 아니면 더 나은 방법이 있다. 당신보다 앞선 세대의 작가들이 해 온 것을 하는 것, 즉 그 프롬프트를 골격으로 삼아 글은 당신이 직접 쓰는 것이다.

이것이 LLM이 당신을 도울 수 없다는 뜻은 아니다. LLM은 뛰어난 편집자다. 다만 나머지 우리가 실제로 그것을 읽어 주기를 기대한다면, 아마 LLM이 그것을 당신 대신 쓰게 해서는 안 된다는 뜻이다.

더 생각해보기

  • 독자가 LLM을 알아챈다는 주장은 어떤 표식에 의존하며 그 표식은 얼마나 오래 유효한가.
  • 78퍼센트가 즉시 읽기를 멈춘다는 수치는 개발자 집단을 넘어 일반화되는가.
  • 71퍼센트가 저자를 회피한다는 결과는 한 번의 실수와 반복을 구분하는가.
  • 98퍼센트가 불완전한 자기 글을 선호한다면 편집 도움의 허용 범위는 어디까지인가.
  • 사회적 계약이라는 프레임은 공동 저술이나 대필의 오랜 관행과 어떻게 구분되는가.
  • 스팸 전쟁의 경로가 반복된다면 탐지기 정확도의 임계는 어디인가.
  • 거짓 양성률이 낮고 거짓 음성률이 높은 탐지기는 정책 도구로 적절한가.
  • 판그램 깨끗함을 공개 글의 요건으로 의무화하면 어떤 부작용이 생기는가.
  • 엠 대시 같은 표면적 표식으로 판정하는 방식이 실패한 이유는 무엇을 시사하는가.
  • LLM이 뛰어난 편집자라는 예외는 작성과 편집의 경계를 어떻게 그어야 성립하는가.
원문 출처는 본문의 Source에서 확인할 수 있습니다.