~/home / tags / 大模型

# 大模型

60 个相关产品 · 中文解读 · 按热度排序
截至 2026-09-10,KanonAgent 库内有 60 个带「大模型」标签的 AI agent 与工具,本页按真实热度排序。标签由中文拆解自动归纳,不是人工打的;数据可经公开 API 复核。
DeepSeek-Reasonix
一个专为终端设计的DeepSeek原生AI编程代理,具备前缀缓存稳定性,可长期运行,帮助开发者自动完成代码任务。
router
AI 模型路由系统,能以 <50ms 延迟将提示词自动分发到最合适的模型,降低大模型调用成本 40%-70%,适用于多模型混合部署场景。
Qwen 3.8 Max now ranked as best overall model ahead of Opus 5 by Artificial Analysis agentic index
通义千问3.8 Max在AI代理能力评测中超越Opus 5,成为综合表现最佳模型,适合需要自主执行复杂任务的开发者与企业用户
Sonnet 4.6
Claude Sonnet 4.6版本,全面提升编码、多任务处理、长文本推理与Agent规划能力,支持100万token上下文窗口,显著增强复杂知识工作支持能力
Claude Opus 5
Claude Opus 5 是 Claude 系列中面向长周期 AI Agent 的升级版,显著提升编码与专业任务处理能力。
DeepSeek-V4-Flash-0731
高性能AI代理模型,以极低成本实现前沿智能推理,适合需要高性价比的AI任务。
Deepseek Harness is Up!
Deepseek Harness 是一个用于高效部署和管理 DeepSeek 大模型推理的工具套件,帮助开发者快速构建、测试和优化大模型应用,解决模型部署复杂、调用效率低的痛点,主
Aymo AI
一个安全的 AI 模型协作平台,集成 GPT、Claude、Gemini 等 45+ 大模型,支持团队对比输出、上传文件聊天,适合企业级 AI 工作流。
Inkling
由Thinking Machines推出的开源大模型,具备1M上下文、多模态理解与可控推理能力,支持微调与本地部署,面向AI研究与开发场景
Grok 4.5
SpaceX AI 推出的新型大模型,专为编程、自主任务执行和知识工作优化,支持复杂多步任务处理。
I shrank DeepSeek V4 Flash to 57GB and it wrote a compiler on my Mac
将 DeepSeek V4 Flash 模型压缩至 57GB 并在 Mac 上成功运行,用其自主编写编译器,展示大模型在本地轻量化部署与自主编程能力。
Gemini Omni 1.1 Flash
Gemini Omni 1.1 Flash 是 Google AI Studio 中的视频生成工具,支持对AI视频进行精细控制,如场景扩展、关键帧过渡和快速渲染。
Qwen3.8-Max
Qwen3.8-Max 是通义千问最新发布的超大规模模型,具备自主编程能力,可从空文件夹开始,无需人工干预完成长达十天的自演化开发,直接交付生产级代码。
CacheCatch
CacheCatch 可审计 LLM 提示词缓存效率,识别缓存失效点并优化提示结构,帮助开发者降低大模型调用成本,特别适配 LangSmith、Langfuse 等主流AI开发平台
Running over 80M tokens in one agent session with no compaction
单个 AI 代理会话中处理超 8000 万 token 且无需压缩,突破传统上下文长度限制,为长程推理与复杂任务提供可能,面向 AI 研发与高级应用开发者。
FlexInference LLM Router
基于LLM的推理路由系统,智能分配大模型请求到最优推理服务,提升推理效率与成本控制,适合AI应用开发者
FLUX 3
黑森林实验室推出的下一代多模态 AI 模型,支持图像、视频和音频的跨模态理解与生成,推动 AI 向视觉智能迈进。
DreamX-World, Alibaba's new realtime world model
DreamX-World 是阿里巴巴推出的实时世界模型,能动态模拟物理世界变化,用于虚拟环境构建与 AI 交互,面向 AI 研究、游戏与元宇宙场景。
euromodels
统一接入多个国产大模型(GLM/DeepSeek/Kimi)的兼容API,支持一键切换模型、流式输出和按需计费,降低AI应用集成门槛
GLM-5.2 is now available via Canopy Wave
通过 Canopy Wave 平台提供 GLM-5.2 大模型的访问服务,降低企业使用国产大模型的技术门槛,面向需要本地化AI能力的To B客户
DeepSeek V4 Flash 0731 with MoonViT Vision (NVFP4)
DeepSeek V4 Flash 0731 with MoonViT Vision 是一个融合了视觉理解能力的多模态大模型版本,支持图像与文本联合推理,适用于需要视觉输入的 AI
anolisa
阿里自研的 AI Agent 操作系统,支持运行时、安全、可观测性及无 Token 响应压缩,降低大模型使用成本。
openroutiq
一个自学习AI路由系统,能根据请求自动选择最优的模型、提供商和推理层级,比现有方案更高效准确,降低大模型调用成本。
uncensored-llm
首个提交的无审查大语言模型项目,旨在提供未经过滤的开源 LLM,可能用于研究或特定场景。
ZCode
ZCode 是专为 GLM-5.2 大模型打造的官方开发工具套件,帮助开发者快速集成、调试和部署基于 GLM-5.2 的应用,解决大模型本地化开发与工程化落地的复杂性问题,主要面向
Token Harbor
统一接入前沿AI模型的API网关,通过兼容OpenAI接口的方式,实现模型自动路由与透明调用,降低使用多模型的复杂度。
Grok 4.6
Grok 4.6 是 xAI 推出的最新版本大模型,具备更强的推理与多模态能力,面向开发者与企业用户开放使用
Ox Alpha
一款神秘的推理模型,支持100万token上下文,无需登录即可使用,具备编码、推理、写作与图像理解能力。
Claude Opus 4.6
Claude Opus 4.6 是 Anthropic 推出的最新一代 AI 模型,专为复杂代理任务优化,具备更强的推理、规划与多步骤执行能力。
stanfordnlp/dspy
一种新型语言模型编程框架,强调通过代码逻辑而非提示词来构建AI应用,提升可复用性与可控性
modelcontextprotocol/servers
模型上下文协议服务器实现,用于标准化AI模型交互中的上下文管理,提升多模型协作与系统集成能力
Neuratly
具备近乎零幻觉的AI系统,拥有类人记忆能力,适合高可靠性场景
Running over 80M tokens in one agent session with no compaction
一个能在单个代理会话中处理超过 8000 万 token 而无需压缩的 AI 系统,突破了上下文长度限制,适用于长文本理解与复杂推理任务。
londai
londai 是一个统一 API 接口,可接入多个主流大模型,简化 AI 应用开发中的模型调用复杂度。
OpenSenseNova/SenseNova-U1
SenseNova-U1:源自第一性原理的统一AI范式框架,支持多模态与通用智能构建,面向AI研究者与系统开发者。
langchain-ai/open_deep_research
LangChain团队开源的深度研究项目,聚焦大模型在复杂研究任务中的应用,适合AI研究人员和高级开发者,亮点是前沿探索与开放协作
MindCache – An open-source agentic memory system for LLMs
MindCache 是一个开源的 LLM 代理记忆系统,让大语言模型能长期存储、检索和利用上下文,提升 AI 代理的连贯性与智能水平。
Cactus Hybrid: We taught Gemma 4 to know when it's wrong
Cactus Hybrid 让 Gemma 4 模型学会识别自身错误,通过自我反思机制提升 AI 输出的可靠性,适用于高精度任务场景。
Nexus API
提供DeepSeek V4模型的API服务,具备Stripe支付、M4级推理速度与固定定价,适合开发者快速集成大模型能力
We built something different.
We built something different 是一个针对大语言模型幻觉问题的探索性项目,通过创新机制检测并减少 LLM 输出中的虚假信息。
Run GLM-4.5-Air(110B)on a 16GBRAM consumer machine
该项目展示了如何在仅 16GB 内存的消费级机器上运行 1100 亿参数的大模型 GLM-4.5-Air,通过量化与优化技术实现本地大模型推理,适合个人开发者和研究者在低配设备上体
Deep Skill Finder – Find agent skills using real execution benchmarks
Deep Skill Finder 是一个基于真实执行基准测试的智能工具,帮助开发者和 AI 研究者评估与选择大模型代理(Agent)的技能,提升 AI 应用的可靠性与性能。
theopenco/llmgateway
LLM 网关服务,统一管理多个大模型提供商的 API 调用,支持路由、限流、分析与降级,帮助开发者轻松构建多模型混合应用。
DeepSeek-V4-Flash-0731
DeepSeek-V4-Flash-0731 是一款高性能、低成本的前沿智能体API,支持复杂任务推理与响应,价格极具竞争力
Bright AI
在仅 4GB GPU 显存下运行 DeepSeek 16B 大模型,实现本地化大模型推理,适合资源有限的开发者与研究者
DeepSeek V4 Flash 0731 with MoonViT Vision (NVFP4)
DeepSeek V4 Flash 0731 搭载 MoonViT 视觉模型,是高性能多模态大模型,支持文本与图像联合推理,适用于需要视觉理解能力的 AI 应用开发。
The Claude Code Toolkit
专为 Claude 大模型设计的开发辅助工具包,帮助开发者更高效地构建软件,减少与 Claude 的交互摩擦。
minimax-h3.com
minimax-h3.com 是 MiniMax 推出的 AI 模型展示平台,提供多模态大模型能力演示,适合开发者和研究人员体验前沿 AI 技术。
Claude SuperPower
Claude SuperPower 是为 Anthropic Claude 模型打造的 MCP 服务器与技能目录,让开发者能快速集成和调用 Claude 的高级能力。
An n8n-like orchestration toolkit for DeepSeek harnesses
一个类n8n的工作流编排工具,专为DeepSeek大模型设计,帮助开发者轻松构建和管理AI工作流,适合AI应用开发者
Artificial Analysis' Qwen3.8-27B benchmarks put it neck and neck with DeepSeek V4 and GPT-5.6 Luna Max
Qwen3.8-27B 是由 Artificial Analysis 测试的开源大模型,性能接近 DeepSeek V4 和 GPT-5.6 Luna Max,适合本地部署与研究者
DFlash 2 available for Qwen 3.8 27B and Muse Glimmer
DFlash 2 是针对 Qwen 3.8 27B 和 Muse Glimmer 模型的本地量化推理工具,支持在消费级硬件上高效运行大模型,适合本地 AI 爱好者与开发者。
How To Strengthen Your AI Memory
该工具通过增强提示工程与记忆缓存机制,显著提升 ChatGPT、Claude、Gemini 等大模型的上下文记忆能力,让 AI 更懂长期对话与任务延续。
Rebiha
无需搭建基础设施,通过预置数据集即可微调大语言模型,降低 LLM 使用门槛
Use GLM-5.3 in Cursor today via tokengo API
通过 tokengo API 在 Cursor 中使用 GLM-5.3 模型,让开发者能快速接入中文大模型进行代码生成与辅助编程。
Hy4 preview
腾讯开源的770B参数大模型,专为长周期任务设计,适合需要复杂推理与上下文理解的AI开发者与研究者,支持长文本生成与多步骤任务处理。
IFM/K2-Horizon-MoVA-36B-A4B-GGUF · Hugging Face
K2-Horizon-MoVA-36B-A4B-GGUF 是一个开源的超大语言模型,支持本地部署,适用于高精度推理与私有化AI应用。
推出 K2 Horizon:前沿性能,彻底开放
K2 Horizon 是一个高性能、完全开源的AI模型系列,强调前沿性能与开放生态,支持本地部署与社区共建。
I made DeepSeek a stock prophet in the chat
利用 DeepSeek 大模型构建股票预测聊天助手,将 AI 与金融分析结合,供投资者和量化爱好者使用
GPT-5.5 by OpenAI
GPT-5.5 是 OpenAI 推出的最新大模型 API,专为开发者和企业设计,具备更强的推理与交互能力,支持更自然的对话与复杂任务处理。
其他标签

常见问题

「大模型」这个标签是怎么归的?

标签来自每个产品的中文拆解(解决什么场景、面向谁),由模型从产品自述里归纳,不是人工逐条打的,也不接受付费打标。

这里的排序依据是什么?

按库内真实热度:投票数 / MRR / 增速,取产品实际有的那个。不是编辑推荐,也不卖位置。

数据多久更新?

追踪持续进行(分钟级),本页于 2026-09-10 生成。全部数字可经公开只读 API 复核:https://kanonagent.com/data