Mongodb
SimpleMongo阅读器 #
基类:EventBaseReader
简易Mongo读取器。
将每个Mongo文档连接成LlamaIndex所使用的Document。
参数:
| 名称 | 类型 | 描述 | 默认 |
|---|---|---|---|
host
|
str
|
Mongo 主机。 |
None
|
port
|
int
|
Mongo端口。 |
None
|
workflows/handler.py 中的源代码llama_index/readers/mongodb/base.py
11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 128 129 130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 161 162 163 164 165 166 167 168 169 170 171 172 173 174 175 176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191 192 | |
lazy_load_data #
lazy_load_data(db_name: str, collection_name: str, field_names: List[str] = ['text'], separator: str = '', query_dict: Optional[Dict] = None, max_docs: int = 0, metadata_names: Optional[List[str]] = None, field_extractors: Optional[Dict[str, Callable[..., str]]] = None) -> Iterable[文档]
从MongoDB懒加载数据。
参数:
| 名称 | 类型 | 描述 | 默认 |
|---|---|---|---|
db_name
|
str
|
数据库的名称。 |
required |
collection_name
|
str
|
集合的名称。 |
required |
field_names
|
List[str]
|
要连接的字段名称。 默认为 ["text"] |
['text']
|
separator
|
str
|
字段之间使用的分隔符。 默认为"" |
''
|
query_dict
|
Optional[Dict]
|
用于筛选文档的查询。了解更多请访问文档 默认为空字典 |
None
|
max_docs
|
int
|
最大加载文档数量。 默认为 0(无限制) |
0
|
metadata_names
|
Optional[List[str]]
|
要添加到文档元数据属性中的字段名称。默认为 None |
None
|
field_extractors
|
Optional[Dict[str, Callable[..., str]]]
|
一个字典,用于从文档中提取字段时使用的函数集合。 默认为 None |
None
|
返回结果:
| 名称 | 类型 | 描述 |
|---|---|---|
Document |
Iterable[文档]
|
一个包含拼接文本和元数据的文档对象。 |
引发:
| 类型 | 描述 |
|---|---|
ValueError
|
如果在文档中未找到某个字段。 |
workflows/handler.py 中的源代码llama_index/readers/mongodb/base.py
58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 105 106 107 108 109 110 111 112 113 114 115 116 117 118 119 120 121 122 123 124 125 126 127 128 | |
alazy_load_data
async
#
alazy_load_data(db_name: str, collection_name: str, field_names: List[str] = ['text'], separator: str = '', query_dict: Optional[Dict] = None, max_docs: int = 0, metadata_names: Optional[List[str]] = None, field_extractors: Optional[Dict[str, Callable[..., str]]] = None)
从MongoDB集合中异步懒加载数据。
参数:
| 名称 | 类型 | 描述 | 默认 |
|---|---|---|---|
db_name
|
str
|
要连接的数据库名称。 |
required |
collection_name
|
str
|
要查询的集合名称。 |
required |
field_names
|
List[str]
|
要拼接成文档文本的字段。默认为 ["text"]。 |
['text']
|
separator
|
str
|
用于连接字段之间的分隔符。默认为 ""。 |
''
|
query_dict
|
Optional[Dict]
|
用于筛选文档的字典。默认为 None。 |
None
|
max_docs
|
int
|
要加载的最大文档数量。默认为 0(无限制)。 |
0
|
metadata_names
|
Optional[List[str]]
|
要包含在文档元数据中的字段。默认为 None。 |
None
|
field_extractors
|
Optional[Dict[str, Callable[..., str]]]
|
一个包含字段特定提取器函数的字典。默认为 None。 |
None
|
返回结果:
| 名称 | 类型 | 描述 |
|---|---|---|
Document |
一个异步生成器,用于生成包含拼接文本和可选元数据的文档对象。 |
引发:
| 类型 | 描述 |
|---|---|
ValueError
|
如果 async_client 未初始化,或者文档中未找到指定字段。 |
workflows/handler.py 中的源代码llama_index/readers/mongodb/base.py
130 131 132 133 134 135 136 137 138 139 140 141 142 143 144 145 146 147 148 149 150 151 152 153 154 155 156 157 158 159 160 161 162 163 164 165 166 167 168 169 170 171 172 173 174 175 176 177 178 179 180 181 182 183 184 185 186 187 188 189 190 191 192 | |
选项: 成员:- SimpleMongoReader