> Discover all available pages from the documentation index: https://mastra.zisheng.pro/ja/llms.txt # MDocument MDocument クラスは、RAG アプリケーション向けにドキュメントを処理します。主なメソッドは `.chunk()` と `.extractMetadata()` です。 ## コンストラクター **docs** (`Array<{ text: string, metadata?: Record }>`): テキスト内容と任意のメタデータを含むドキュメントチャンクの配列 **type** (`'text' | 'html' | 'markdown' | 'json' | 'latex'`): ドキュメント内容の種類 ## 静的メソッド ### `fromText()` プレーンテキストの内容からドキュメントを作成します。 ```typescript static fromText(text: string, metadata?: Record): MDocument ``` ### `fromHTML()` HTML の内容からドキュメントを作成します。 ```typescript static fromHTML(html: string, metadata?: Record): MDocument ``` ### `fromMarkdown()` Markdown の内容からドキュメントを作成します。 ```typescript static fromMarkdown(markdown: string, metadata?: Record): MDocument ``` ### `fromJSON()` JSON の内容からドキュメントを作成します。 ```typescript static fromJSON(json: string, metadata?: Record): MDocument ``` ## インスタンスメソッド ### `chunk()` ドキュメントをチャンクに分割し、必要に応じてメタデータを抽出します。 ```typescript async chunk(params?: ChunkParams): Promise ``` オプションの詳細は、[chunk() リファレンス](https://mastra.zisheng.pro/ja/reference/rag/chunk)を参照してください。 ### `getDocs()` 処理済みドキュメントチャンクの配列を返します。 ```typescript getDocs(): Chunk[] ``` ### `getText()` チャンクから取得したテキスト文字列の配列を返します。 ```typescript getText(): string[] ``` ### `getMetadata()` チャンクから取得したメタデータオブジェクトの配列を返します。 ```typescript getMetadata(): Record[] ``` ### `extractMetadata()` 指定した extractor を使用してメタデータを抽出します。詳細は、[ExtractParams リファレンス](https://mastra.zisheng.pro/ja/reference/rag/extract-params)を参照してください。 ```typescript async extractMetadata(params: ExtractParams): Promise ``` ## 使用例 ```typescript import { MDocument } from '@mastra/rag' // Create document from text const doc = MDocument.fromText('Your content here') // Split into chunks with metadata extraction const chunks = await doc.chunk({ strategy: 'markdown', headers: [ ['#', 'title'], ['##', 'section'], ], extract: { summary: true, // Extract summaries with default settings keywords: true, // Extract keywords with default settings }, }) // Get processed chunks const docs = doc.getDocs() const texts = doc.getText() const metadata = doc.getMetadata() ```