主要特性
- 支持100万以内的数据量
- 随时对数据进行插入、删除、搜索、更新等操作
句向量模型【支持15种语言】
句向量是指将语句映射至固定维度的实数向量。将不定长的句子用定长的向量表示,为NLP下游任务提供服务。
支持 15 种语言:
Arabic, Chinese, Dutch, English, French, German, Italian, Korean, Polish, Portuguese, Russian, Spanish, Turkish.
- 句向量

句向量应用:
- 语义搜索,通过句向量相似性,检索语料库中与query最匹配的文本
- 文本聚类,文本转为定长向量,通过聚类模型可无监督聚集相似文本
- 文本分类,表示成句向量,直接用简单分类器即训练文本分类器
使用说明
-
输入地址: http://localhost:8090
-
上传CSV数据文件
1). 点击上传按钮上传CSV文件.
测试数据
2). 点击特征提取按钮.
等待CSV文件解析,特征提取,特征存入向量引擎。通过console可以看到进度信息。

- 文本搜索
输入文字,点击查询,可以看到返回的清单,根据相似度排序。

4s. 帮助信息
- swagger接口文档:
http://localhost:8089/swagger-ui.html
