Redis®*: Node.jsによるRAGパイプライン
このドキュメントはベクトル検索とRAGガイドの一部です。完全なガイドはこちらからご覧いただけます:Redisによるセマンティック検索、レコメンデーション、リトリーバル拡張生成(RAG)。
👋 Stackhero ドキュメントへようこそ!
Stackhero では、すぐに使える Redis cloud ソリューションをご提供しています。主な特長は以下の通りです:
Redis CommanderWeb UI を標準搭載。- メッセージサイズ・転送量が無制限。
- ワンクリックで簡単にアップデート可能。
- プライベートかつ専用インフラによる最適なパフォーマンスと強固なセキュリティ。
時間を節約し、運用をシンプルに:Stackhero の Redis cloud hosting ソリューションは、わずか5分でお試しいただけます!
import { createClient, SCHEMA_FIELD_TYPE, SCHEMA_VECTOR_FIELD_ALGORITHM } from 'redis';
const client = createClient({ url: process.env.STACKHERO_REDIS_URL_TLS });
await client.connect();
const DIMENSIONS = 1536;
const toBytes = embedding => Buffer.from(new Float32Array(embedding).buffer);
// 1. 起動時に一度だけインデックスを作成
try {
await client.ft.create(
'chunksIndex',
{
content: SCHEMA_FIELD_TYPE.TEXT,
documentId: SCHEMA_FIELD_TYPE.TAG,
embedding: {
type: SCHEMA_FIELD_TYPE.VECTOR,
ALGORITHM: SCHEMA_VECTOR_FIELD_ALGORITHM.HNSW,
TYPE: 'FLOAT32',
DIM: DIMENSIONS,
DISTANCE_METRIC: 'COSINE'
}
},
{ ON: 'HASH', PREFIX: 'chunk:' }
);
}
catch (error) {
if (!error.message.includes('Index already exists')) {
throw error;
}
}
// 2. チャンクをインデックス化(embeddingはモデルプロバイダーから取得)
async function indexChunk({ id, documentId, content, embedding }) {
await client.hSet(`chunk:${id}`, {
content,
documentId,
embedding: toBytes(embedding)
});
}
// 3. 質問に最も近いチャンクを、特定ドキュメントに限定して取得
async function retrieve({ questionEmbedding, documentId, count = 5 }) {
const results = await client.ft.search(
'chunksIndex',
`(@documentId:{${documentId}})=>[KNN ${count} @embedding $queryVector AS score]`,
{
PARAMS: { queryVector: toBytes(questionEmbedding) },
SORTBY: 'score',
RETURN: [ 'content', 'score' ],
DIALECT: 2
}
);
return results.documents.map(({ value }) => value.content);
}
// 4. モデルへのコンテキストとして渡す
const context = await retrieve({ questionEmbedding, documentId: 'doc42' });
const prompt = `Answer using only this context:\n\n${context.join('\n\n')}\n\nQuestion: ${question}`;