설정
지식 베이스 설정 탭에서 문서의 처리 및 청크 방식을 구성할 수 있습니다. 이 설정은 콘텐츠의 청크, 임베딩, 에이전트에 의한 검색 방식에 영향을 줍니다.
청킹 전략
문서를 처리하기 위해 청크로 분할하는 방법을 선택합니다.
| 전략 | 설명 |
|---|---|
| 문장 청킹 | 자연어 경계를 위해 문장 토크나이저를 사용합니다. 문장 컨텍스트를 보존하는 것이 중요한 범용 콘텐츠에 적합합니다. |
| 시맨틱 청킹 | 의미에 따라 청크 경계를 자동으로 결정합니다. 시맨틱 컨텍스트가 문장 구조보다 중요한 복잡하거나 기술적인 문서에 적합합니다. |
청크 구성
문장 기반 청킹에 대한 청크 크기와 겹침을 구성합니다. 이 섹션은 문장 청킹이 선택된 경우에 적용됩니다.
| 설정 | 기본값 | 권장 사항 | 설명 |
|---|---|---|---|
| 청크 크기 | 64 | 64–512 토큰 | 각 청크의 최대 크기. 더 큰 청크는 더 많은 컨텍스트를 보존하지만 검색 정확도를 떨어뜨릴 수 있습니다. 더 작은 청크는 더 정확하지만 컨텍스트를 잃을 수 있습니다. |
| 청크 겹침 | 6 | 청크 크기의 10–20% | 인접 청크 간의 겹치는 토큰 수. 청크 경계 전반에 걸쳐 컨텍스트를 유지하는 데 도움이 됩니다. 0 이상이어야 하며 청크 크기보다 작아야 합니다. |
청크 향상 설정
더 나은 콘텐츠 처리를 위한 청크 풍부화 및 LLM 모델 선택을 구성합니다.
| 설정 | 설명 |
|---|---|
| 청크 풍부화 | 활성화하면 더 나은 검색 정확도를 위해 AI를 사용하여 청크에 추가 컨텍스트를 추가합니다. |
| LLM 모델 | 청크 풍부화에 사용할 LLM 모델을 선택합니다. 청크 풍부화가 활성화된 경우 필수입니다. |
참고
슈퍼 관리자에서 청크 풍부화 모델이 구성되지 않은 경우 기본 모델이 자동으로 사용됩니다.
팁
청크 풍부화는 검색 품질을 개선하지만 처리 시간과 계산 비용을 증가시킵니다. 단순 청킹으로는 충분하지 않은 복잡한 콘텐츠의 경우 활성화하세요.
위험 영역
경고
이 섹션의 작업은 되돌릴 수 없습니다. 주의하여 진행하세요.
모든 지식 베이스 삭제 — 지식 베이스에서 모든 문서, 청크 및 임베딩을 영구적으로 제거합니다. 이 작업은 되돌릴 수 없습니다.
설정 저장 및 적용
| 작업 | 설명 |
|---|---|
| 설정 저장 | 구성을 저장합니다. 앞으로 추가되거나 동기화되는 새 문서에만 적용됩니다. |
| 초기화 | 양식을 마지막으로 저장된 구성으로 초기화합니다. |
| 모든 문서에 적용 | 현재 설정을 사용하여 지식 베이스의 모든 기존 문서를 다시 인덱싱합니다. 이전에 업로드된 콘텐츠에 변경 사항을 적용하려면 저장 후 사용하세요. |
경고
지식 베이스의 문서 수에 따라 모든 문서에 설정을 적용하는 데 상당한 시간이 걸릴 수 있습니다. 이 프로세스는 시작 후 취소할 수 없습니다.
모범 사례
청킹 전략
- 대부분의 사용 사례에서는 문장 청킹으로 시작하세요.
- 문장 경계가 의미 있는 콘텐츠 분할과 일치하지 않는 복잡하거나 기술적인 문서의 경우 시맨틱 청킹으로 전환하세요.
청크 크기
- 기본값 (64)을 기준으로 시작하세요.
- 청크당 더 많은 컨텍스트가 필요한 콘텐츠의 경우 크기를 늘리세요.
- 정확하고 표적화된 검색이 컨텍스트보다 중요한 경우 크기를 줄이세요.
청크 겹침
- 청크 크기의 10–20%로 겹침을 유지하세요.
- 중요한 정보가 청크 경계에 걸쳐 있을 수 있는 경우 겹침을 늘리세요.
청크 풍부화
- 검색 품질을 개선해야 하는 복잡한 콘텐츠의 경우 활성화하세요.
- 최상의 결과를 위해 강력한 추론 기능이 있는 모델을 선택하세요.
- 활성화 후 처리 시간을 모니터링하세요 — 풍부화는 계산 비용을 추가합니다.