M문서
MDocument 클래스는 RAG 응용 프로그램용 문서를 처리합니다. 주요 방법은 다음과 같습니다.chunk()그리고.extractMetadata().
건설자건설자에 대한 직접 링크
docs:
Array<{ text: string, metadata?: Record<string, any> }>
텍스트 콘텐츠와 선택적 메타데이터가 포함된 문서 청크 배열입니다.
type:
'text' | 'html' | 'markdown' | 'json' | 'latex'
문서 콘텐츠의 유형입니다.
정적 방법정적 방법에 대한 직접 링크
fromText()fromtext에 대한 직접 링크
일반 텍스트 콘텐츠로 문서를 만듭니다.
static fromText(text: string, metadata?: Record<string, any>): MDocument
fromHTML()fromhtml에 대한 직접 링크
HTML 콘텐츠에서 문서를 만듭니다.
static fromHTML(html: string, metadata?: Record<string, any>): MDocument
fromMarkdown()frommarkdown에 대한 직접 링크
Markdown 콘텐츠에서 문서를 만듭니다.
static fromMarkdown(markdown: string, metadata?: Record<string, any>): MDocument
fromJSON()fromjson에 대한 직접 링크
JSON 콘텐츠에서 문서를 만듭니다.
static fromJSON(json: string, metadata?: Record<string, any>): MDocument
인스턴스 메소드인스턴스 메소드에 대한 직접 링크
chunk()chunk에 대한 직접 링크
문서를 청크로 분할하고 선택적으로 메타데이터를 추출합니다.
async chunk(params?: ChunkParams): Promise<Chunk[]>
자세한 옵션은 chunk() 레퍼런스를 참조하세요.
getDocs()getdocs에 대한 직접 링크
처리된 문서 청크의 배열을 반환합니다.
getDocs(): Chunk[]
getText()gettext에 대한 직접 링크
청크에서 텍스트 문자열의 배열을 반환합니다.
getText(): string[]
getMetadata()getmetadata에 대한 직접 링크
청크에서 메타데이터 개체의 배열을 반환합니다.
getMetadata(): Record<string, any>[]
extractMetadata()extractmetadata에 대한 직접 링크
지정된 추출기를 사용하여 메타데이터를 추출합니다. 자세한 내용은 ExtractParams 레퍼런스를 참조하세요.
async extractMetadata(params: ExtractParams): Promise<MDocument>
예예에 대한 직접 링크
import { MDocument } from '@mastra/rag'
// Create document from text
const doc = MDocument.fromText('Your content here')
// Split into chunks with metadata extraction
const chunks = await doc.chunk({
strategy: 'markdown',
headers: [
['#', 'title'],
['##', 'section'],
],
extract: {
summary: true, // Extract summaries with default settings
keywords: true, // Extract keywords with default settings
},
})
// Get processed chunks
const docs = doc.getDocs()
const texts = doc.getText()
const metadata = doc.getMetadata()