工具自动化网站到 RAG 知识库的转换,减少向量化和检索管道的开发成本。
抓取、分块并向量化任意网站,让你可以将其中的内容用于 LLM。
curl --request POST \
--url https://api.embedding.io/v0/query \
--header 'Authorization: Bearer V09XIFlPVSdSRSBBIEhBQ0tFUg==' \
--json '{
"collection": "col_lPMjKLBRLZ4qVe",
"query": "Why should I avoid sunflower oil?"
}'
使用我们的 API 或 Web 界面创建一个 Collection,用来存放你想使用的页面或网站。
curl --request POST \
--url https://api.embedding.io/v0/collections \
--header 'Authorization: Bearer V09XIFlPVSdSRSBBIEhBQ0tFUg==' \
--json '{
"name": "Health Gurus"
}'
将网页添加到你的 Collection 中。其余工作交给我们,包括后续更新。
curl --request POST \
--url https://api.embedding.io/v0/collections/col_lPMjKLBRLZ4qVe/websites \
--header 'Authorization: Bearer V09XIFlPVSdSRSBBIEhBQ0tFUg==' \
--json '{
"domains": [
"https://peterattiamd.com/",
"https://www.foundmyfitness.com/"
]
}'
Collection 准备就绪后,就可以通过我们的 API 进行查询。我们会持续为你更新其中的数据。
curl --request POST \
--url https://api.embedding.io/v0/query \
--header 'Authorization: Bearer V09XIFlPVSdSRSBBIEhBQ0tFUg==' \
--json '{
"collection": "col_lPMjKLBRLZ4qVe",
"query": "Why should I avoid sunflower oil?"
}'
WordPress 文档
Laravel 11.x 文档
Embedding.io 文档
Patrick McKenzie(patio11)
免费开始使用。
每月最多处理 500 个页面
与你的 Collection 对话
与你的 Collection 对话
与你的 Collection 对话
包含 Startup 方案的全部功能,此外还有:
不限数量的 Collection
Credit 是用于衡量和追踪服务使用量的单位。每向 Collection 添加一个页面,就会消耗一个 Credit。此外,页面每更新一次,也会消耗一个 Credit。
你可以嵌入互联网上任何公开可用的内容,包括网站、博客、文档等。
不需要,你的网站不必提供 sitemap。我们的系统可以抓取任何可公开访问的网页并提取其中的内容。
我们的爬虫会提取页面的主要内容,排除导航、广告及其他无关内容。我们结合机器学习与启发式方法,判断页面中的哪些部分属于主要内容。
内容更新频率取决于你订阅的方案。Free 方案每月更新内容,Hobby 方案每周更新,Startup 方案每天更新。你也可以手动触发更新。
可以,你可以通过我们的 API 创建、管理和查询 Collection。我们提供了详细的 API 文档,帮助你快速上手。
如果超出 Credit 限额,你需要升级到更高级别的方案,才能继续向 Collection 添加页面。你也可以联系我们获取定制解决方案。
可以。Enterprise 方案支持根据你的具体需求定制爬虫。联系我们了解更多详情。
可以,你可以随时取消订阅。你的账户会保持有效,直至当前计费周期结束。
不到 5 分钟,即可将你的内容接入 LLM。