Arango 数据库
简单ArangoDB读取器 #
基类:EventBaseReader
简单的 ArangoDB 读取器。 将每个 ArangoDB 文档拼接成 LlamaIndex 使用的 Document 对象。
参数:
| 名称 | 类型 | 描述 | 默认 |
|---|---|---|---|
host
|
Optional[Union[str, List[str]]]
|
(Union[str, List[str]]) 用于连接数据库的URL或URL列表 |
None
|
client
|
Optional[Any]
|
(任意)ArangoDB 客户端 |
None
|
workflows/handler.py 中的源代码llama_index/readers/arango_db/base.py
9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 | |
lazy_load #
lazy_load(username: str, password: str, db_name: str, collection_name: str, field_names: List[str] = ['text'], separator: str = ' ', query_dict: Optional[Dict] = {}, max_docs: int = None, metadata_names: Optional[List[str]] = None) -> Iterator[文档]
从 ArangoDB 懒加载数据。
参数:
| 名称 | 类型 | 描述 | 默认 |
|---|---|---|---|
username
|
str
|
用于凭据。 |
required |
password
|
str
|
用于凭据。 |
required |
db_name
|
str
|
数据库的名称。 |
required |
collection_name
|
str
|
集合的名称。 |
required |
field_names
|
List[str]
|
要连接的字段名称。 默认为 ["text"] |
['text']
|
separator
|
str
|
字段之间使用的分隔符。 默认为" " |
' '
|
query_dict
|
Optional[Dict]
|
用于筛选文档的查询。了解更多 |
{}
|
at [docs](https
|
//docs.python-arango.com/en/main/specs.html#arango.collection.StandardCollection.find) 默认为空字典 |
required | |
max_docs
|
int
|
最大加载文档数量。 默认为 None(无限制) |
None
|
metadata_names
|
Optional[List[str]]
|
要添加到文档元数据属性中的字段名称。默认为 None |
None
|
返回: List[Document]: 文档列表。
workflows/handler.py 中的源代码llama_index/readers/arango_db/base.py
41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 | |
load_data #
load_data(username: str, password: str, db_name: str, collection_name: str, field_names: List[str] = ['text'], separator: str = ' ', query_dict: Optional[Dict] = {}, max_docs: int = None, metadata_names: Optional[List[str]] = None) -> List[文档]
从 ArangoDB 加载数据。
参数:
| 名称 | 类型 | 描述 | 默认 |
|---|---|---|---|
username
|
str
|
用于凭据。 |
required |
password
|
str
|
用于凭据。 |
required |
db_name
|
str
|
数据库的名称。 |
required |
collection_name
|
str
|
集合的名称。 |
required |
field_names
|
List[str]
|
要连接的字段名称。 默认为 ["text"] |
['text']
|
separator
|
str
|
字段之间使用的分隔符。 默认为"" |
' '
|
query_dict
|
Optional[Dict]
|
用于筛选文档的查询。了解更多 |
{}
|
at [docs](https
|
//docs.python-arango.com/en/main/specs.html#arango.collection.StandardCollection.find) 默认为空字典 |
required | |
max_docs
|
int
|
最大加载文档数量。 默认为 0(无限制) |
None
|
metadata_names
|
Optional[List[str]]
|
要添加到文档元数据属性中的字段名称。默认为 None |
None
|
返回: List[Document]: 文档列表。
workflows/handler.py 中的源代码llama_index/readers/arango_db/base.py
100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 | |
选项: 成员:- SimpleArangoDBReader