Navi2AI

      AI 大模型基建

      共 97 篇网址
      Navi2AI.com关于【AI 大模型基建】的分类定义与收录描述:模型从「训练好」到「能用起来」的整条技术栈,服务开发者与企业。涵盖模型获取(MaaS&API、开源权重)、能力改造(微调)、高效运行(推理与本地部署)、多模型调度(API 网关),以及让回答更准的 RAG 与向量数据库。这一层决定 AI 应用的成本、性能与合规边界。
      AI 大模型基建AI 文案与写作AI 图像与设计AI 视频与创作AI 音频与制作AI 代码与开发AI 效率与办公AI 通用智能体
      模型服务 MaaS&API开源模型推理与本地部署API 网关与聚合检索增强 RAG向量数据库训练与微调
      排序
      发布更新浏览点赞
      OmniRoute

      OmniRoute

      免费 MIT 自托管 AI 网关,单端点聚合 340 提供商/1200+ 模型,智能回退+Token 压缩,本地优先零遥测。
      190
      API 网关与聚合# OmniRoute
      华为云盘古

      华为云盘古

      华为云推出的企业级模型即服务平台(MaaS)
      280
      模型服务 MaaS&API# 华为云盘古
      AIProxy

      AIProxy

      labring主导,以OpenAI/Claude/Gemini协议为入口的高性能AI网关,多租户隔离+智能路由,MIT许可。
      140
      API 网关与聚合# AIProxy
      硅基流动

      硅基流动

      国内开源模型 API 覆盖最全的一站式 MaaS 平台,DeepSeek-V4-Flash 输入 ¥1/输出 ¥2 每百万 token,9B 及以下模型永久免费,新用户送 14 元额度(约 2000 万 Tokens),国内直连。
      380
      API 网关与聚合模型服务 MaaS&API# siliconflow# 硅基流动
      OpenRouter

      OpenRouter

      一个 API Key 调用 400+ 模型 / 60+ 提供商,透传上游价格不加价,海外开发者的"模型超市",国内需VPN(国区受限)。
      190
      API 网关与聚合# OpenRouter
      n1n

      n1n

      企业级 LLM API 聚合网关,一个 Key 调 GPT-5/Claude 4.5/Gemini 3 Pro 等 500+ 模型,CN2 全球直连无需 VPN,98ms 延迟,1 元=1 美元充值。
      210
      API 网关与聚合# n1n
      Higress

      Higress

      阿里开源AI原生云原生网关,CNCF沙箱项目,基于Envoy,统一治理LLM API与MCP Server,Apache-2.0许可。
      170
      API 网关与聚合# Higress
      Kong AI Gateway

      Kong AI Gateway

      Kong Inc.主导,构建在Kong Gateway之上的AI网关,统一治理LLM/MCP/A2A流量,Apache-2.0许可。
      140
      API 网关与聚合# Kong AI Gateway
      Portkey Gateway

      Portkey Gateway

      Portkey-AI主导,TypeScript轻量AI网关,200+模型统一API,集成Guardrails,MIT许可。
      160
      API 网关与聚合# Portkey Gateway
      One API

      One API

      JustSong主导,以OpenAI格式统一30+大模型提供商,单可执行文件+Docker一键部署,MIT许可。
      140
      API 网关与聚合# One API
      LiteLLM

      LiteLLM

      BerriAI主导,以OpenAI格式统一调用100+ LLM提供商,MIT许可,AI网关事实标准。
      120
      API 网关与聚合# LiteLLM
      CTranslate2

      CTranslate2

      OpenNMT团队开源,Transformer模型高效C++推理引擎,自定义运行时+faster-whisper底层。
      130
      推理与本地部署# CTranslate2
      ExLlamaV3

      ExLlamaV3

      turboderp主导,消费级NVIDIA GPU本地LLM推理库,EXL3量化格式发源地,MIT许可。
      150
      推理与本地部署# ExLlamaV3
      MLX

      MLX

      Apple机器学习研究团队出品,Apple Silicon统一内存原生的数组框架与LLM推理引擎。
      140
      推理与本地部署# MLX# MLX LM
      Sonar

      Sonar

      PygmalionAI主导的vLLM分支推理引擎,量化格式覆盖最广,AGPL-3.0许可。
      160
      推理与本地部署# Sonar
      DeepSpeed-MII

      DeepSpeed-MII

      微软DeepSpeed团队开源,Blocked KV Cache+Dynamic SplitFuse高吞吐推理库。
      150
      推理与本地部署# DeepSpeed-MII
      Ollama

      Ollama

      本地LLM推理服务框架,一键拉取模型,MIT许可,全平台。
      440
      推理与本地部署# Ollama
      TensorRT-LLM

      TensorRT-LLM

      NVIDIA官方开源,编译优化大模型推理,NVIDIA GPU上极限吞吐引擎。
      140
      推理与本地部署# TensorRT-LLM
      加载更多
      Navi2AI
      Navi2AI 是一个专注 AI 工具的一站式导航站。汇集对话、绘画、编程、办公等热门 AI 产品,分类清晰、直达可用,帮你快速找到趁手的 AI 利器。

      友链申请 免责声明 广告合作 关于我们

      扫码加QQ群Navi2AI
      扫码加QQ群
      扫码加微信Navi2AI
      扫码加微信
      Copyright © 2026 Navi2AI 京ICP备2024080263号-3  京公网安备11010502061824号 
      网址
      网址文章软件书籍