Navi2AI

      AI 大模型基建

      共 97 篇网址
      Navi2AI.com关于【AI 大模型基建】的分类定义与收录描述:模型从「训练好」到「能用起来」的整条技术栈,服务开发者与企业。涵盖模型获取(MaaS&API、开源权重)、能力改造(微调)、高效运行(推理与本地部署)、多模型调度(API 网关),以及让回答更准的 RAG 与向量数据库。这一层决定 AI 应用的成本、性能与合规边界。
      AI 大模型基建AI 文案与写作AI 图像与设计AI 视频与创作AI 音频与制作AI 代码与开发AI 效率与办公AI 通用智能体
      模型服务 MaaS&API开源模型推理与本地部署API 网关与聚合检索增强 RAG向量数据库训练与微调
      排序
      发布更新浏览点赞
      DeepSeek

      DeepSeek

      深度求索出品,推理与代码见长、API 极便宜的开源对话AI。
      540
      对话助手与 AI 搜索开源模型# DeepSeek# 深度求索
      Kimi

      Kimi

      月之暗面出品,国内长上下文见长的对话AI。
      660
      对话助手与 AI 搜索开源模型# Kimi# Moonshot# 月之暗面
      TokenHub

      TokenHub

      腾讯云大模型统一 API 入口,Hy3 Preview 旗舰 192K 上下文、三档推理,输入 ¥1/输出 ¥4 每百万 token(缓存命中 ¥0.25),首次开通送 100 万 Token + 100 万 Embedding,Hunyuan-Lite 永久免费,国内直连。
      360
      模型服务 MaaS&API# Hunyuan# TokenHub
      AnythingLLM​

      AnythingLLM​

      全栈私有AI应用,文档聊天+智能体+多用户。
      230
      多模型聊天前端检索增强 RAG# AnythingLLM​
      PocketPal AI

      PocketPal AI

      手机端本地LLM客户端,100%设备端推理,MIT许可。
      340
      推理与本地部署# PocketPal AI
      TextGen

      TextGen

      多后端本地LLM Web UI平台,支持LoRA训练,AGPL-3.0。
      210
      推理与本地部署# Text Generation WebUI# TextGen
      GPT4All

      GPT4All

      桌面级本地LLM聊天客户端,一键安装100%离线,MIT许可。
      180
      推理与本地部署# GPT4All
      Jan

      Jan

      开源桌面ChatGPT替代客户端,100%离线运行,Apache 2.0。
      180
      推理与本地部署# Jan
      LM Studio

      LM Studio

      桌面GUI本地模型客户端,个人与工作免费,全平台。
      210
      推理与本地部署# LM Studio
      Vespa

      Vespa

      Apache-2.0 许可的大规模 AI 检索平台,搜索+向量+张量+排序+ML 推理一体化分布式引擎,十亿级毫秒响应。
      90
      向量数据库# Vespa
      Pinecone

      Pinecone

      全托管 Serverless 向量数据库 SaaS,对象存储架构支撑十亿级向量毫秒检索,99.95% SLA,稠密+稀疏+全文混合检索。
      100
      向量数据库# Pinecone
      Weaviate

      Weaviate

      BSD-3-Clause 许可的开源 AI-native 向量数据库,Go 编写,BM25+向量原生混合检索,模块化向量化器,十亿级毫秒检索。
      80
      向量数据库# Weaviate
      Qdrant

      Qdrant

      Apache-2.0 许可的 Rust 编写 AI 原生向量数据库,HNSW 遍历期过滤、量化降内存 64 倍、原生混合检索。
      120
      向量数据库# Qdrant
      Milvus

      Milvus

      Apache-2.0 许可的企业级云原生向量数据库,万亿级向量毫秒检索,K8s 原生存算分离,LF AI 毕业项目。
      90
      向量数据库# Milvus
      UltraRAG​

      UltraRAG​

      Apache-2.0 许可的基于 MCP 架构的低代码 RAG 开发框架,YAML 编排复杂流程,可视化 IDE 白盒推理,清华 OpenBMB 出品。
      140
      检索增强 RAG# UltraRAG​
      Quivr

      Quivr

      Apache-2.0 许可的开源"第二大脑"式 RAG 平台,Brain 抽象统一封装摄入-检索-生成,任意 LLM+任意向量库。
      120
      检索增强 RAG# Quivr
      R2R

      R2R

      MIT 许可的生产级 RAG 引擎,RESTful API 统一封装多模态摄入、混合搜索、知识图谱与 Agentic Deep Research。
      130
      检索增强 RAG# R2R
      PaperQA2

      PaperQA2

      面向科研文献的高精度 RAG 库,回答带页级引用,Agentic 工作流,Future House 出品,Apache-2.0。
      110
      检索增强 RAG# PaperQA2
      加载更多
      Navi2AI
      Navi2AI 是一个专注 AI 工具的一站式导航站。汇集对话、绘画、编程、办公等热门 AI 产品,分类清晰、直达可用,帮你快速找到趁手的 AI 利器。

      友链申请 免责声明 广告合作 关于我们

      扫码加QQ群Navi2AI
      扫码加QQ群
      扫码加微信Navi2AI
      扫码加微信
      Copyright © 2026 Navi2AI 京ICP备2024080263号-3  京公网安备11010502061824号 
      网址
      网址文章软件书籍