forked from juanjuandog/FinSight-AI
-
Notifications
You must be signed in to change notification settings - Fork 0
Expand file tree
/
Copy pathHybridRetrievalGateway.java
More file actions
65 lines (56 loc) · 2.47 KB
/
Copy pathHybridRetrievalGateway.java
File metadata and controls
65 lines (56 loc) · 2.47 KB
1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
31
32
33
34
35
36
37
38
39
40
41
42
43
44
45
46
47
48
49
50
51
52
53
54
55
56
57
58
59
60
61
62
63
64
65
package com.finsight.rag;
import com.finsight.domain.model.DocumentChunk;
import com.finsight.domain.repository.DocumentChunkRepository;
import org.springframework.stereotype.Component;
import java.util.ArrayList;
import java.util.Comparator;
import java.util.LinkedHashMap;
import java.util.List;
import java.util.Map;
@Component
public class HybridRetrievalGateway {
private static final double RRF_K = 60.0;
private final DocumentChunkRepository chunkRepository;
private final EmbeddingService embeddingService;
public HybridRetrievalGateway(DocumentChunkRepository chunkRepository, EmbeddingService embeddingService) {
this.chunkRepository = chunkRepository;
this.embeddingService = embeddingService;
}
public List<RetrievalHit> search(String companySymbol, String question, int limit) {
Map<String, FusionCandidate> candidates = new LinkedHashMap<>();
List<DocumentChunk> keywordChunks = chunkRepository.keywordSearch(companySymbol, question, limit);
for (int i = 0; i < keywordChunks.size(); i++) {
addRank(candidates, keywordChunks.get(i), "keyword", i + 1);
}
List<Double> queryEmbedding = embeddingService.embed(question);
List<DocumentChunk> vectorChunks = chunkRepository.vectorSearch(companySymbol, queryEmbedding, limit);
for (int i = 0; i < vectorChunks.size(); i++) {
addRank(candidates, vectorChunks.get(i), "vector", i + 1);
}
return candidates.values().stream()
.map(candidate -> new RetrievalHit(
candidate.chunk(),
candidate.ranks().values().stream()
.mapToDouble(rank -> 1.0 / (RRF_K + rank))
.sum(),
String.join("+", candidate.ranks().keySet()),
Map.copyOf(candidate.ranks())
))
.sorted(Comparator.comparingDouble(RetrievalHit::score).reversed())
.limit(limit)
.toList();
}
private void addRank(
Map<String, FusionCandidate> candidates,
DocumentChunk chunk,
String channel,
int rank
) {
candidates.computeIfAbsent(
chunk.id(),
ignored -> new FusionCandidate(chunk, new LinkedHashMap<>())
).ranks().put(channel, rank);
}
private record FusionCandidate(DocumentChunk chunk, Map<String, Integer> ranks) {
}
}