본문으로 건너뛰기

M문서

MDocument 클래스는 RAG 응용 프로그램용 문서를 처리합니다. 주요 방법은 다음과 같습니다.chunk()그리고.extractMetadata().

건설자
건설자에 대한 직접 링크

docs:

Array<{ text: string, metadata?: Record<string, any> }>
텍스트 콘텐츠와 선택적 메타데이터가 포함된 문서 청크 배열입니다.

type:

'text' | 'html' | 'markdown' | 'json' | 'latex'
문서 콘텐츠의 유형입니다.

정적 방법
정적 방법에 대한 직접 링크

fromText()
fromtext에 대한 직접 링크

일반 텍스트 콘텐츠로 문서를 만듭니다.

static fromText(text: string, metadata?: Record<string, any>): MDocument

fromHTML()
fromhtml에 대한 직접 링크

HTML 콘텐츠에서 문서를 만듭니다.

static fromHTML(html: string, metadata?: Record<string, any>): MDocument

fromMarkdown()
frommarkdown에 대한 직접 링크

Markdown 콘텐츠에서 문서를 만듭니다.

static fromMarkdown(markdown: string, metadata?: Record<string, any>): MDocument

fromJSON()
fromjson에 대한 직접 링크

JSON 콘텐츠에서 문서를 만듭니다.

static fromJSON(json: string, metadata?: Record<string, any>): MDocument

인스턴스 메소드
인스턴스 메소드에 대한 직접 링크

chunk()
chunk에 대한 직접 링크

문서를 청크로 분할하고 선택적으로 메타데이터를 추출합니다.

async chunk(params?: ChunkParams): Promise<Chunk[]>

자세한 옵션은 chunk() 레퍼런스를 참조하세요.

getDocs()
getdocs에 대한 직접 링크

처리된 문서 청크의 배열을 반환합니다.

getDocs(): Chunk[]

getText()
gettext에 대한 직접 링크

청크에서 텍스트 문자열의 배열을 반환합니다.

getText(): string[]

getMetadata()
getmetadata에 대한 직접 링크

청크에서 메타데이터 개체의 배열을 반환합니다.

getMetadata(): Record<string, any>[]

extractMetadata()
extractmetadata에 대한 직접 링크

지정된 추출기를 사용하여 메타데이터를 추출합니다. 자세한 내용은 ExtractParams 레퍼런스를 참조하세요.

async extractMetadata(params: ExtractParams): Promise<MDocument>

예에 대한 직접 링크

import { MDocument } from '@mastra/rag'

// Create document from text
const doc = MDocument.fromText('Your content here')

// Split into chunks with metadata extraction
const chunks = await doc.chunk({
strategy: 'markdown',
headers: [
['#', 'title'],
['##', 'section'],
],
extract: {
summary: true, // Extract summaries with default settings
keywords: true, // Extract keywords with default settings
},
})

// Get processed chunks
const docs = doc.getDocs()
const texts = doc.getText()
const metadata = doc.getMetadata()