← 개발 노트

기능 미리보기: Google 검색으로 더 정확한 요약을

2026년 8월 · DeepSRT 개발 노트

말하는 사람은 숫자를 잘못 기억합니다. 모델의 지식은 컷오프에서 멈춥니다. 이제 요약이 확인할 수 있습니다.

모든 대규모 언어 모델에는 지식 컷오프 — 학습 데이터가 끝나는 날짜 — 가 있습니다. 그 이후에 일어난 일을 물으면 모델은 모릅니다. 어렴풋이도, 부분적으로도 아니라 — 그 정보는 모델 안에 아예 존재하지 않습니다. YouTube 영상을 요약하는 도구에게 이것은 생각보다 훨씬 중요합니다. 사람들이 보는 영상의 많은 부분이 새로운 것이기 때문입니다: 제품 발표, 속보, 사흘 전에 나온 모델 릴리스. 대본은 요약 엔진이 한 번도 본 적 없는 세계에 대해 이야기합니다.

그리고 두 번째, 더 교묘한 문제가 있습니다: 대본 자체가 종종 틀렸다는 것입니다. 크리에이터는 기억에 의존해 말합니다. 「2달러쯤」으로 기억된 가격의 실제 출시가는 $0.75였습니다. 지진 규모, 날짜, 버전 번호 — 사람을 오도하기에 딱 충분할 만큼 틀려 있습니다. 그 실수를 충실히 반복하는 요약은 제 역할을 하면서도 여전히 당신을 속이고 있는 셈입니다.

바로 여기서 「Google 검색 그라운딩」이 등장합니다. AI 영상 요약이라 해도 「자동 팩트체크」의 선택지를 사용자에게 제공해야 한다고 우리는 믿습니다. DeepSRT 설정에 추가된 옵트인 미리보기 기능 「웹 검색 그라운딩」을 켜면, Gemini는 요약하는 동안 실시간 검색 결과로 사실 주장을 검증하고, 자신의 컷오프 너머로 손을 뻗어, 틀린 것을 바로잡고, 그 사실을 명시합니다.

DeepSRT 설정: 웹 검색 그라운딩 섹션에서 'Google 검색으로 요약 그라운딩하기 (preview)' 토글이 켜져 있고, 별도 과금을 설명하는 미리보기 안내가 표시됨

실험 1: 틀린 가격 주장

새 AI 모델이 「100만 토큰당 2달러쯤이며 이전 세대보다 비싸다」고 주장하는 대본을 입력했습니다. 실제 출시 가격은 100만 입력 토큰당 $0.75 — 비싸기는커녕 더 저렴했습니다.

대본의 주장그라운딩 없이그라운딩 켜고
「100만 토큰당 약 $2, 이전 세대보다 비쌈」사실로 반복✅ 검색 실행, 공식 가격 페이지 인용: 「가격이 올랐다는 오해와 달리… 이전 세대보다 50% 저렴한 100만 입력 토큰당 $0.75에 출시」

실험 2: 조작된 지진 보도

다음은 더 어려운 사례. 스페인에서 실제로 발생한 지진에 대해 도시, 규모, 요일, 피해 상황을 모두 의도적으로 틀리게 쓴 가짜 뉴스 대본입니다. 이 지진은 며칠 전에 일어났습니다 — 어떤 모델의 학습 데이터보다도 이후라, 실시간 검색만이 정답을 맞힐 수 있습니다.

세부 사항대본(오류)그라운딩 없이그라운딩 켜고
위치바르셀로나「Barcelona」 반복✅ 「안달루시아 그라나다 지방」(Alhendín 인근)으로 정정
규모6.5「규모 6.5」 반복✅ 「규모 5.0 — 6.5가 아님」으로 정정
시각수요일 오후그대로 반복✅ 「토요일 새벽」으로 정정
피해부상자 발생, 건물 붕괴「건물 붕괴… 여러 명 부상」 반복✅ 「붕괴된 건물 없음, 부상자 보고 없음」으로 정정

실험 3: 존재하지 않는 모델 버전

가장 어려운 종류의 오류는 실재하는 것의 숫자가 틀린 게 아니라, 「그것 자체가 존재하지 않는」 경우입니다. 「Grok 3.6」을 발표하는 대본을 썼습니다 — 이 버전은 출시된 적이 없고(며칠 전 실제 발표는 Grok 4.6), 여기에 틀린 벤치마크 점수와 가격까지 더했습니다.

세부 사항대본(오류)그라운딩 없이그라운딩 켜고
버전Grok 3.6(존재하지 않음)「Grok 3.6」 반복, 전혀 눈치채지 못함✅ 실제 릴리스 인식: 「Grok 4.6(Grok 3.6 언급을 정정…)」
벤치마크Intelligence Index 75점「약 75」 반복✅ 「75가 아닌 61점」으로 정정
가격100만 입력 토큰당 $5「대략 5달러」 반복✅ 「100만 입력 토큰당 $2.00, 출력 $6.00」으로 정정
회사명xAI(이후 개명)「xAI」 반복⚠️ 「xAI」 유지 — 개명은 놓쳤습니다. 실재하는 한계

기록해 둘 가치가 있는 부분

Google 검색을 도구로 켜는 것만으로는 모델이 검색하지 않습니다. 어떤 주장이 확인할 가치가 있는지 요청마다 스스로 판단하는데, 첫 테스트에서는 그냥 검색하지 않았습니다 — 같은 대본, 도구 켜짐, 검색 0회, 틀린 숫자가 그대로 반복되었습니다. 출력은 기능을 끈 것과 구별할 수 없었습니다.

진짜로 만든 것은 요약 프롬프트에 추가한 한 가지 지시였습니다: 구체적인 사실 주장 — 가격, 날짜, 버전, 통계 — 을 최신 정보와 대조해 검증하고, 출처가 틀렸다면 바로잡고 간단히 언급할 것. 이 한 줄로 같은 대본이 매번 검색을 트리거했습니다. 3회 중 3회, 매번 출처를 인용하고 무엇을 정정했는지 명시했습니다.

도구 선언은 허가이지 행동이 아닙니다. 모델이 능력을 쓰게 하려면 프롬프트가 그것을 요구해야 합니다.

솔직한 한계

이것은 미리보기이며, 범위를 의도적으로 좁게 유지하고 있습니다:

최선의 노력이지, 보증이 아닙니다. 검색할지, 무엇을 검색할지, 어떤 출처를 신뢰할지는 모두 Gemini 모델이 요청마다 스스로 판단합니다. 잡아낸 오류는 정정하지만 — 실험에서는 많이 잡아냈습니다 — 그라운딩은 100% 정확성을 약속할 수 없습니다. 성실한 팩트체커로 여기되, 절대적인 신탁으로 여기지는 마세요.

비용이 늘어납니다. 그라운딩된 요청은 추가 토큰을 소비하고(검색 결과가 컨텍스트에 들어갑니다), 검색 자체도 일반 생성과 별도로 과금됩니다. 이 기능을 켠다면 먼저 Google 계정에 월 지출 한도를 설정하세요 — AI 전사 기능에 대한 조언이 여기서는 두 배로 적용됩니다.

기본은 꺼짐. 그라운딩된 요청은 일반 생성과 다르게 과금되며, 요약 도구가 웹에 접근하는 것은 업데이트에서 조용히 바뀌어야 할 일이 아니라 당신이 선택해야 할 행동 변화입니다.

요약에만 적용. 자막 번역은 그라운딩을 쓰지 않습니다 — 한 문장을 번역하는 데 검색할 것이 없고, 그라운딩은 자막 파이프라인이 의존하는 구조화 출력 모드와 호환되지 않습니다.

주장을 정정하지, 배경을 정정하지 않습니다. 구체적인 숫자는 확인됩니다. 배경적 사실 — 실험 3에서 조용히 이름을 바꾼 회사처럼 — 은 놓칠 수 있습니다. 모델은 주장처럼 보이는 것을 검증할 뿐, 세계 전체를 다시 도출하지 않습니다.

Gemini 전용. 그라운딩은 Gemini의 기능입니다. 요약이 다른 제공자에서 실행되면 이 토글은 꺼진 상태로 유지됩니다.

이 미리보기는 다음 릴리스의 DeepSRT PRO(Mac)에서만 제공됩니다 — 설정의 「웹 검색 그라운딩」에서 찾을 수 있습니다. 영상이 당신을 속였고 요약이 그것을 잡아냈다면 — 혹은 잡아내지 못했다면 — 꼭 들려주세요.