[G1-Sync] Manual knowledge update
This commit is contained in:
@@ -1,8 +1,8 @@
|
||||
---
|
||||
id: P-REINFORCE-AUTO-LSHH-001
|
||||
id: [[P-Reinforce]]-AUTO-LSHH-001
|
||||
category: "10_Wiki/💡 Topics/AI"
|
||||
confidence_score: 0.96
|
||||
tags: [auto-reinforced, lsh, hashing, vector-search, algorithms, big-data, similarity-search]
|
||||
tags: [auto-reinforced, lsh, hashing, vector-[[Search]], algorithms, [[Big-Data]], similarity-search]
|
||||
last_reinforced: 2026-04-20
|
||||
---
|
||||
|
||||
@@ -19,11 +19,11 @@ last_reinforced: 2026-04-20
|
||||
* 거리가 가까운 데이터들은 해시값이 같을 확률이 매우 높게 설계됨.
|
||||
* 전체 데이터를 다 비교하는 대신, 같은 바구니에 담긴 데이터들만 상세히 비교함 (연산량 폭감).
|
||||
2. **왜 중요한가?**:
|
||||
* 유튜브의 저작권 도용 영상 찾기, 구글의 중복 문서 필터링, 대규모 벡터 DB의 핵심 엔진임. (Efficiency와 연결)
|
||||
* 유튜브의 저작권 도용 영상 찾기, 구글의 중복 문서 필터링, 대규모 벡터 DB의 핵심 엔진임. ([[Efficiency]]와 연결)
|
||||
|
||||
## ⚠️ 모순 및 업데이트 (Contradictions & RL Update)
|
||||
- **과거 데이터와의 충돌**: 과거에는 정확도가 떨어진다는 정책적 우려가 있었으나, 현대 정책은 '근사 유사도 검색(ANN)' 정책이 빅데이터 환경에서 '정확도 100% 탐색 정책'보다 수천 배 빠르고 실용적임을 입증함(RL Update).
|
||||
- **정책 변화(RL Update)**: 최근 RAG(검색 증강 생성) 시스템에서 수백만 개의 문서 중 질문과 가장 닮은 문서를 0.1초 만에 찾아내는 'Faiss' 같은 라이브러리의 밑바닥 핵심 원리 정책으로 작동함. (Large Language Models (LLM)와 연결)
|
||||
- **정책 변화(RL Update)**: 최근 RAG(검색 증강 생성) 시스템에서 수백만 개의 문서 중 질문과 가장 닮은 문서를 0.1초 만에 찾아내는 'Faiss' 같은 라이브러리의 밑바닥 핵심 원리 정책으로 작동함. ([[Large Language Models (LLM)]]와 연결)
|
||||
|
||||
## 🔗 지식 연결 (Graph)
|
||||
- [[Efficiency]], [[Large Language Models (LLM)]], [[Analysis]], [[Information-Entropy]], [[Search-Optimization]]
|
||||
|
||||
Reference in New Issue
Block a user