开源 Advent 项目精选
Open Source Advent 活动精选的 15 个优秀项目汇总。为开发者了解和学习高质量开源工具提供参考。
Open Source Advent 活动精选的 15 个优秀项目汇总。为开发者了解和学习高质量开源工具提供参考。
我们在本月初启动了 Open Source Advent 来庆祝 25 个不同的开源项目。分享这些项目一直很有趣,我想我可以再分享一下前 15 个项目!看看这个仓库,尝试教程,让我们知道你的构建成果!
自然地,所有为这些开源项目工作的人都会很高兴能为他们的项目得到 GitHub star 而得到一点圣诞节的爱 🎄💕。
Milvus 是一个开源向量数据库,为向量相似度搜索和 AI 应用提供动力,致力于让向量搜索对每个组织都可及。Milvus 可以存储、索引和管理由深度神经网络和其他机器学习(ML)模型生成的 10 亿+ 个嵌入向量。这是我们在 Zilliz 所有人都在从事的项目,所以当然它在列表上。😇
FiftyOne 是用于构建高质量数据集和计算机视觉模型的开源工具包。使用 FiftyOne,你可以可视化、整理、管理和质量保证数据,以及自动化使企业机器学习成为可能的工作流程。他们在最后一次 Unstructured Meetup 上发言,你可以查看此处的记录(29:10 - 演讲者 Jacob Marks,使用 Voxel51 进行计算机视觉数据的向量搜索)
Quivr 是你的个人生产力助手,用来与你的转储文件(PDF、CSV)和应用程序聊天,使用 GPT 3.5 / 4 turbo、Private、Anthropic、VertexAI、LLMs,你可以与用户共享!OpenAI GPTs 的替代品。
Haystack 是一个端到端的 NLP 框架,使你能够构建由 LLMs、Transformer 模型、向量搜索等提供动力的应用程序。无论你想执行问题回答、答案生成、语义文档搜索,还是构建能够进行复杂决策和查询解决的工具,你都可以使用 Haystack 的最先进 NLP 模型来构建端到端的 NLP 应用程序以解决你的用例。我们有一个关于 Haystack 中检索增强的一些示例的视频。
Proton 是一个流分析数据库,基于 ClickHouse,用 C++ 编写。快速。强大。易用。
Ydata-profiling 是一个 Python 包,用于在一行代码中生成自动化数据质量分析报告。Ydata-synthetic 是一个使用最先进生成模型生成合成表格和时间序列数据的包。
Apache Flink 是用于对无界和有界数据流上的有状态计算的领先框架和分布式处理引擎。
LangChain RB 是一个原创的、受 Langchain 启发的 Ruby 框架。目标是抽象化复杂性和困难概念,使构建 AI/ML 增强型应用对传统 Ruby 软件工程师来说是可接近的。如果你是 Ruby 粉丝,我们有一个视频向你展示如何使用 Ruby 端到端构建 GenAI 应用程序。
Flyte 是一个开源编排器,便于构建生产级数据和 ML 管道。它为可扩展性和可重现性而构建,利用 Kubernetes 作为其底层平台。使用 Flyte,用户团队可以使用 Python SDK 构造管道,并将其无缝部署在云和本地环境中,从而实现分布式处理和高效的资源利用。
DVC 是一个命令行工具,可帮助你开发可重现的机器学习项目。
Phoenix 是 Arize AI 的开源可观测性库,设计用于在笔记本中对你的 LLM、CV 和 NLP 模型进行实验、微调和故障排除。
具有深度仪表和综合评估的 LLM 和多模态应用的可观测性。
OpenLLM 是一个开源平台,旨在促进在实际应用中大语言模型(LLMs)的部署和操作。使用 OpenLLM,你可以对任何开源 LLM 运行推理,将其部署在云或本地环境中,并构建强大的 AI 应用程序。
一个灵活的数据标注工具,适用于所有数据类型。为计算机视觉、自然语言处理、语音、声音和视频模型准备训练数据。
LlamaIndex 是一个数据框架,用于 LLM 基础应用来摄取、结构化和访问私有或特定领域的数据。
一些评论只对已登录的访问者可见。登录以查看所有评论。
如需进一步行动,你可以考虑屏蔽此人和/或报告滥用。