Du är här:
Utökad indexering av innehållsbitar
När du skapar ett vektor- eller hybrid sökindex från ostrukturerade data i Data 360 kan du berika de delar av innehållet som skapas genom att extrahera metadata från innehållet. Extraherade metadata inkluderar nyckelord, enheter, ämnesöversikter, frågor som besvaras av innehållet och innehållssammanfattningar.
Bitars berikning förbättrar hämtningens precision avsevärt, särskilt i de fall där du inte kan använda förinställda fält (till exempel i en UDMO-sökväg) och i agentåtgärder för frågor och svar. Bitar av berikat innehåll är ett alternativ till intensiv innehållsvalering eftersom LLM-skapat innehåll hjälper till att förbättra identifieringen av rätt delar.
För att använda delar av förbättrat innehåll, skapa först ett sökindex och aktivera delar av förbättrat innehåll. I AI-modeller, skapa en ny egen hämtning. När du ombes ange sökindexet, välj ett sökindex som skapades med alternativet berika delar.
För att få det mesta värdet från ett förbättrat index, få åtkomst till det genom en retriever. För att använda metadatabitarna tillämpar en retriever extra logik, som omrangordning och syftesanpassning. Att anropa indexet direkt genom sök-API:n förbigår hämtaren och resulterar i hämtningsbeteende som ligger närmare standardvektor- eller hybridsökning. Även om införandet av en retriever ibland lägger till latens möjliggör det högre precision för hämtning genom att förbättra hur sökfrågor mappar till relevant, svarsklart innehåll.
Att använda denna funktion i Data Cloud använder Flexkrediter. Mer information finns i Faktureringsöverväganden för förbättrat index. Kontakta din kontoansvariga för mer information.
Innehåll i berikade bitar
När du aktiverar förbättrat innehåll i ett vektor- eller hybrid sökindex skapar Data 360 tre delar: en del som innehåller den ursprungliga texten, en del som innehåller metadatatext och en del som innehåller frågor som delen kan besvara. Hämtar åtkomst till dessa delar för att använda i RAG- och AI-agentflöden.
| Typ av bit | Metadatatyper | Beskrivning |
|---|---|---|
| METADATA | Nyckelord | Extraherar nyckelord som unikt identifierar innehållet. |
| Enheter | Identifierar och listar ordagrant något av följande:
|
|
| Ämnen | Extraherar huvudämnen som diskuteras i delen. Inkluderar viktiga enheter och nyckelord i ämnesnamnen. |
|
| Rubrik | Genererar en koncis och informativ titel som sammanfattar innehållet. |
|
| Sammanfattning | Ger en sammanfattning av innehållet och lyfter fram viktiga ämnen och enheter. Om möjligt, sträva efter att omfatta minst 100 ord och högst 250 ord. | |
| FRÅGA | Frågor | Om tillämpligt, sammanställer en omfattande uppsättning detaljerade frågor som innehållet i textdelen kan besvara. |
Databearbetning för utökad indexering
Utökade index stöds i alla regioner där Data 360 är tillgängligt. Data för förbättrade index bearbetas genom hanterade tjänster i Amazon Bedrock i dessa regioner.
- us-west-2: USA Väst (Oregon)
- us-east-1: Östra USA (Virginia)
- eu-central-1: Europa (Frankfurt)
- eu-central-2 Europe (Zurich)
- eu-west-3: Europa (Paris)
Aktivera Amazon-berggrundsmodeller (Amazon och Antropiska) i Einstein Inställningar för att använda utökad indexering. Mer information finns i Dokumentation för Amazon Bedrock.
- Förstå utökade indexkostnader
Utökad indexering utökar delar med genererad intelligens, som enheter, sammanfattningar, ämnen och besvarade frågor, för att förbättra syftesdriven hämtning. Även om denna process ökar upptäckbarheten och jordningen för AI-assistenter ökar den indexeringskostnaderna eftersom varje del producerar ytterligare inbäddningar och metadatabitar. - Hämtningssvar med utökat sökindex
Utökad indexering förbättrar hämtningssvar genom att matcha en fråga till ett avsnitt med det bästa möjliga svaret i din Knowledge. Hybridsökning i Data 360 kombinerar styrkan hos sematiskt medveten vektorsökning med precisionen och hastigheten hos nyckelordssökning, men utökad indexering stänger luckan ytterligare genom att hitta de delar som är närmast användarens fråga.
