LlamaIndex JSONReader
JSONReader, düğümler arasındaki ilişkileri çıkarmaya yönelik özellikler sunarken JSON belgelerini ayrıştırmanıza olanak tanır.
Geçişin derinliğini kontrol etmek, uzun JSON parçalarını daraltmak ve JSON yapısını temizlemek için seçenekler sunar.
Öncelikle paketi pip aracılığıyla kuralım:
pip install lama-index-readers-json
Aşağıda nasıl kullanılacağını gösteren bir kod parçası bulunmaktadır:
from llama_index.readers.json import JSONReader
# Initialize JSONReader
reader = JSONReader(
# The number of levels to go back in the JSON tree. Set to 0 to traverse all levels. Default is None.
levels_back="<Levels Back>",
# The maximum number of characters a JSON fragment would be collapsed in the output. Default is None.
collapse_length="<Collapse Length>",
# If True, ensures that the output is ASCII-encoded. Default is False.
ensure_ascii="<Ensure ASCII>",
# If True, indicates that the file is in JSONL (JSON Lines) format. Default is False.
is_jsonl="<Is JSONL>",
# If True, removes lines containing only formatting from the output. Default is True.
clean_json="<Clean JSON>",
)
# Load data from JSON file
documents = reader.load_data(input_file="<Input File>", extra_info={})
Şu anda JSON'dan metin verilerinin çıkarılmasına izin verirken geri kalanını meta veri olarak ele alacak bir seçenek üzerinde çalışıyorum. Tamamlandığında GitHub'da yayınlayacağım.
Referanslar: