# 模型
23 个相关产品 · 中文解读 · 按热度排序
截至 2026-09-12,KanonAgent 库内有 23 个带「模型」标签的 AI agent 与工具,本页按真实热度排序。标签由中文拆解自动归纳,不是人工打的;数据可经公开 API 复核。
DFlash 2 available for Qwen 3.8 27B and Muse Glimmer
为 Qwen 3.8 27B 和 Muse Glimmer 模型优化的 DFlash 2 推理加速工具,显著提升生成速度与内存效率,适合本地部署用户。
Interactive, animated architecture of any HuggingFace models
交互式、动画化的 HuggingFace 模型架构可视化工具,可动态展示任意模型的结构与数据流,帮助开发者理解复杂模型。
Coarena - A community-driven arena to benchmark models for computer-use
一个由社区驱动的模型评测平台,专门用于测试 AI 模型在计算机操作任务中的表现,推动模型在真实使用场景下的能力验证
A SLM Optimized for Tool Calling
专为工具调用优化的小型语言模型(SLM),提升AI在复杂任务中的执行效率和准确性。
QuantumNous/new-api
统一的 AI 模型枢纽,支持将多种大模型(LLM)转换为 OpenAI、Claude、Gemini 等兼容格式,提供集中化管理与分发能力。
Claude Opus 4.7
Anthropic推出的最新推理与智能编程能力最强的AI模型,专为复杂任务规划与自主代码生成设计,适合开发者与AI研究员使用。
hexgrad/kokoro
轻量级 AI 模型(82M 参数),可在本地运行,支持文本生成与对话,适合开发者快速集成或在边缘设备上部署 AI 功能。
GPT-5.6
宣称达到GPT-5.6级别的智能与效率新标准,聚焦于更高效、更强大的通用AI模型,面向开发者与AI应用构建者
shiyu-coder/Kronos
面向金融市场的基础模型,能理解并生成金融语言(如财报、市场情绪、交易信号),适合量化研究、金融分析与智能投研场景。
Gemini 3.6 Flash Family
Gemini 3.6 Flash 系列是 Google 推出的轻量级、超快速 AI 模型家族,专为需要低延迟响应的 SaaS 应用设计,适合开发者快速集成智能功能,支持多场景推理与
Chariot TTS
用于构建语音推理模型的文本转语音系统,专注于让AI理解并生成更自然、有逻辑的语音输出
NeoAI
统一接入多个顶级 AI 模型的 SaaS 平台,用户无需切换即可调用不同模型,适合需要多模型协作的开发者与企业
The-veil-12B, a Gemma 12B fine-tune that reads its tool list
The-veil-12B 是基于 Gemma 12B 微调的 AI 模型,能自主读取并理解工具列表,实现更智能的工具调用与任务执行,适用于自动化工作流场景
unsloth/DeepSeek-V4-Pro-0813-GGUF · Hugging Face
基于GGUF格式的DeepSeek-V4-Pro大模型,专为本地运行优化,支持在消费级硬件上高效部署和推理,适合本地AI开发与研究者使用,具备高性能与低资源占用优势。
Gemini 3.7 Flash
Gemini 3.7 Flash 是 Google 推出的最新 AI 模型,专为编程与智能代理任务优化,具备更强的推理能力与上下文理解,是目前最强大的 AI 工作引擎之一。
TokenPick
TokenPick 是一个 AI 模型选型工具,根据成本、性能与速度推荐最适合的 AI 模型,适合开发者与 AI 工程师。
Inference
AI推理平台,支持快速部署和运行大模型推理任务,提升AI应用开发效率
RVC-Boss/GPT-SoVITS
仅需1分钟语音数据即可训练出高质量的语音合成模型,实现极低样本量的语音克隆,适合快速个性化语音应用
We built open OpenRouter that turns usage into a better model
开源的OpenRouter平台,通过用户使用行为持续优化模型性能,实现边用边学的模型进化。
Beating GPT5.5-xhigh for Coding agent security with SLMs and IRM
用小型语言模型(SLM)与输入恢复机制(IRM)在代码生成Agent中实现比GPT-5.5-xhigh更强的安全性。
workweave/router
面向智能体系统的高性能模型路由器,能以 <50ms 延迟将提示词精准分发至最优模型,显著降低大模型调用成本
A dedicated hub to find, test, and serve LLM adapters
一个专门用于发现、测试和部署大模型适配器(LLM adapters)的枢纽平台,帮助开发者快速集成和验证模型微调效果,适合AI研究者与工程团队使用,支持多种主流大模型框架。
2x-4x cheaper GLM 5.3 for coding and research
一款针对编程与研究场景优化的低成本GLM 5.3模型,成本仅为原版的1/2至1/4,适合预算有限但需高性能AI推理的开发者和研究人员
其他标签
常见问题
「模型」这个标签是怎么归的?
标签来自每个产品的中文拆解(解决什么场景、面向谁),由模型从产品自述里归纳,不是人工逐条打的,也不接受付费打标。
这里的排序依据是什么?
按库内真实热度:投票数 / MRR / 增速,取产品实际有的那个。不是编辑推荐,也不卖位置。
数据多久更新?
追踪持续进行(分钟级),本页于 2026-09-12 生成。全部数字可经公开只读 API 复核:https://kanonagent.com/data