DevCode : IT 개발 기술 아카이브

    LangChain 1

    RAG 성능 고도화 — 청킹 전략 깊게 파기

    RAG 성능 고도화 — 청킹 전략 깊게 파기이 글은 RAG 기반 시스템을 실제로 구축하면서 마주쳤던 청킹 전략의 선택 문제를 정리한 내용이다. 책과 Gemini의 도움을 빌려 궁금증을 해소해가며 쌓은 기록이다. 청킹이 왜 필요한가?RAG 시스템을 처음 설계할 때 가장 단순한 접근은 "그냥 문서를 통째로 LLM에 넣어서 처리하면 되지 않나?"라는 생각이 든다. 하지만 실제로 해보면 두 가지 벽에 부딪힌다.첫째는 토큰 한계다. LLM은 한 번에 처리할 수 있는 텍스트 양이 정해져 있어서, 문서가 길면 아예 입력 자체가 불가능하다. 둘째는 정확도 문제다. 설령 들어간다 해도, 방대한 문서 속에서 관련 없는 내용까지 한꺼번에 읽어야 하는 LLM은 핵심을 놓치거나 엉뚱한 부분에 집중하기 쉽다.그래서 문서를 적절한..

    AI Engineering/RAG 2026.06.21
    이전
    1
    다음
    더보기
    프로필사진

    DevCode : IT 개발 기술 아카이브

    DevCode : IT 개발 기술 아카이브

    07-25 09:33

    방문자수Total

    • Today :
    • Yesterday :
    • 분류 전체보기 (117)
      • AI Engineering (6)
        • 기본지식 (1)
        • RAG (5)
        • 파인튜닝 (0)
        • 프롬프팅 (0)
        • vision (0)
        • On-device AI (0)
      • Mobile Dev (68)
        • 안드로이드 자바 코틀린 (37)
        • 애플 iOS 스위프트 Xcode (11)
        • 플러터 Flutter (6)
        • 개발후기 (7)
        • 코드와트 코딩강의 (6)
      • IT 테크 기술 지식 공유 (42)
        • 전자 테크 기기 꿀팁 리뷰 사용기 (6)
        • 컴퓨터 일반 맥OS 윈도우 (22)
        • AI 정보 공유 (4)
        • 제품리뷰 (0)

    Copyright © codewatt on devcode

    티스토리툴바