~/home / tags / LLM

# LLM

65 个相关产品 · 中文解读 · 按热度排序
截至 2026-09-12,KanonAgent 库内有 65 个带「LLM」标签的 AI agent 与工具,本页按真实热度排序。标签由中文拆解自动归纳,不是人工打的;数据可经公开 API 复核。
Memorist
Memorist 解决长周期 LLM 任务中上下文丢失问题,通过可审计的持久化记忆机制,让 AI 在多轮对话中保持决策一致性,避免隐式提示污染。
Openheim – a multi-provider LLM agent runtime, written in Rust
用 Rust 编写的多模型 LLM 运行时,支持灵活切换不同大模型提供商,适合构建可插拔的 AI 应用。
hyperfield/ai-file-sorter
跨平台桌面应用,利用本地或远程大模型智能分类和重命名文件,支持预览确认与用户控制。
infiniflow/ragflow
开源的 RAG 引擎,融合检索增强生成与智能体能力,为大语言模型提供更强大的上下文理解与推理支持。
jundot/omlx
专为 Apple Silicon Mac 设计的 LLM 推理服务器,支持连续批处理与 SSD 缓存,通过菜单栏轻松管理,显著提升本地大模型运行效率。
rikkahub/rikkahub
RikkaHub 是一款 Android 应用,支持接入多个大语言模型(LLM)服务,实现统一界面下的多模型切换与管理。
radixark/miles
Miles 是一个面向企业级的强化学习框架,专为 LLM 和 VLM 的后训练优化设计,基于 Slime 演化而来,支持复杂决策场景的 AI 训练。
Lathe – Use LLMs to learn a new domain, not skip past it
利用大语言模型(LLM)辅助学习新领域知识,强调深度理解而非快速跳过,适合希望系统掌握新技能的学习者。
lemonade-sdk/lemonade
Lemonade 是一个本地 AI 应用发现与运行平台,能自动调用用户本地 GPU/NPU 运行优化后的 LLM,实现高效、低延迟的本地 AI 体验。
microsoft/semantic-kernel
微软推出的语义内核框架,帮助 C# 开发者快速集成前沿大语言模型能力,构建智能应用
microsoft/SkillOpt
SkillOpt 是一个用于冻结大语言模型代理的自然语言技能优化工具,通过轨迹驱动的编辑和验证门控更新,生成可复用的技能文档,适合 AI 研究与工程团队提升 LLM 代理的可维护性
Trace – open-source, self-organizing memory for LLM agents (PyPI)
Trace 是一个开源的自组织记忆系统,专为 LLM 代理设计,帮助智能体高效存储、检索和管理长期记忆,提升决策与上下文理解能力。
Soup – organize and route Agent Skills into your LLM prompts
Soup 将 AI 代理的技能模块化并智能路由到 LLM 提示中,帮助开发者构建更可控、可组合的智能体系统,特别适合复杂任务分解与技能复用场景。
Foreman, a self-hosted LLM gateway for cost aware model routing
Foreman 是一个自托管的 LLM 网关,可根据成本、延迟和质量自动路由请求到最优大模型,帮助团队在多模型环境中实现成本控制与性能平衡。
PAI
PAI 是一个为大语言模型(LLM)设计的类 Linux 内核系统,旨在提供模块化、可扩展的 LLM 运行环境,适合开发者和 AI 工程师构建高效、可控的 AI 应用。
gptbased
基于大模型的性能排行榜工具,帮助用户判断何时该切换LLM模型
SillyTavern/SillyTavern
SillyTavern 是面向高级用户的 LLM 前端工具,支持多模型接入、角色扮演、自定义提示工程,是构建复杂 AI 交互体验的强力前端平台。
Made a Free LLM Router
一个免费的大型语言模型路由系统,可智能选择最优LLM处理请求,适合开发者与AI应用构建者,支持多模型动态调度与成本优化。
MasterVault: Stop your LLM's context file from growing stale
一个用于管理大语言模型上下文记忆的工具,防止模型因长期使用导致上下文过时或信息失真,提升推理一致性。
A Claude Code skill that finds dev tools – or stays silent
一个专为 Claude 代码模型设计的技能插件,能智能识别开发工具并推荐,否则保持沉默,避免无效输出,提升开发效率。
Open-source verification and tuning layer for self-hosted LLMs
面向自托管大语言模型(LLM)的开源验证与调优层,帮助开发者提升模型输出质量与稳定性,适用于 AI 研究者与私有化部署团队。
Stickblade Arena – I made two LLMs sword-fight to benchmark them
一个用于对比大语言模型性能的趣味性对抗平台,让两个LLM以‘剑斗’形式比拼推理与生成能力,适合AI研究员和开发者测试模型表现。
upstash/context7
Context7:为大模型和AI代码编辑器提供实时、准确的代码文档平台,帮助AI理解上下文,提升生成质量。
ride-recap, teaching a LLM my taste to automate cycling highlights
ride-recap 利用大语言模型学习用户的骑行偏好,自动剪辑并生成个性化的骑行精彩片段,适合运动爱好者和内容创作者。
Zenic
Zenic 是一个基于大语言模型的智能家居控制中枢,通过自然语言实现对家庭设备的统一管理,适合智能家居爱好者与极客用户。
CallBro – Granola, but Powered by Codex, Claude Code, or Your Local LLM
CallBro 是一个基于 Codex、Claude Code 或本地 LLM 的智能语音助手,可实现自然语言驱动的代码生成与任务执行
Relay – a self-hosted LLM gateway with eval-gated routing
一个可自托管的LLM网关,支持基于评估结果的智能路由,帮助团队高效管理多个大模型服务,适合需要灵活部署与成本控制的AI团队
LLM Context profiler for tracking context usage by tools, agents, MCPs
LLM Context Profiler 是用于监控大模型在工具、代理和MCP中上下文使用情况的分析工具,帮助开发者优化成本与性能。
Freeze the Model, Train the Harness
一种AI模型训练新范式:冻结模型参数,仅训练控制逻辑(Harness),实现高效、安全的AI代理行为定制,适合希望快速迭代AI行为而避免灾难性遗忘的团队。
MindBase – an LLM that maintains a wiki from your notes and papers
一个基于大语言模型的智能知识库系统,能自动整理用户笔记和论文,构建动态更新的个人Wiki,适合研究者和知识工作者。
Ghost Vessel – give your local LLM agent a face
为本地运行的大语言模型(LLM)赋予可视化界面和交互形象,让AI代理更直观易用,适合开发者与AI应用实验者。
Parley – self-hosted LLM mesh for the machines you own
Parley 是一个可自托管的 LLM 网络,允许用户在自有设备间构建私有大模型协作系统,实现本地化 AI 智能协同。
QuantizeLab — GGUF in minutes
QuantizeLab 是一个 SaaS 平台,可在几分钟内将 Hugging Face 上的 LLM 模型量化为 GGUF 格式,实现本地运行。
I built an RPG engine where an LLM narrates the GM, not the rules
一个由大语言模型充当游戏主持人(GM)的RPG游戏引擎,玩家无需记忆规则,由LLM实时生成剧情和互动,适合游戏开发者与叙事爱好者。
0xPlaygrounds/rig
用 Rust 构建模块化、可扩展的 LLM 应用框架,支持构建复杂的大模型应用,如多步骤推理、工具调用、记忆管理等。
zhongkaifu/TensorSharp
基于 C# 的原生 .NET 大语言模型推理引擎,支持 GGUF 模型,提供命令行、Web 聊天界面和兼容 Ollama/OpenAI 的 HTTP API,可在 Windows/
Simple self-hosted LLM assistant with user-steered compounding context
一个可自托管的轻量级 LLM 助手,支持用户主导的上下文累积机制,让对话记忆更智能、更持久,适合希望掌控数据隐私的开发者和知识工作者。
BubbleHub - a local runtime and hosting for LLM agents
本地运行与托管 LLM 代理的运行时环境,支持离线与私有化部署
Clayrune – Run Claude Code agents in parallel without losing context
并行运行 Claude 代码代理且保持上下文一致,提升多任务处理能力
NovaSky-AI/SkyRL
模块化全栈强化学习库,专为大语言模型设计,支持LLM的策略训练与部署,适合RLHF与智能体研究者
LLM control of deterministic coder – Sif 1.0 – LLMs as vibe coders
Sif 1.0 是一个基于 LLM 的确定性编码系统,让大模型以可复现、可控制的方式生成代码,适合追求稳定输出的开发者。
2027 Memory Capacity Is Reportedly Sold Out
一款用于本地运行大语言模型的工具,支持在消费级硬件上部署和运行 LLaMA 等模型,适合开发者和AI爱好者进行私有化AI实验与开发。
newo-ether/Agora
Android 上的 BYOK(自带密钥)大模型客户端,支持多模型提供商接入、智能工作流与远程设备控制,实现本地化 AI 安全计算
FAIth – a syntax-free JVM language, compiled by an LLM front-end
FAIth是一种无语法的JVM语言,由大语言模型作为前端编译器,用户用自然语言描述程序逻辑,由LLM自动转换为可执行代码,适合希望快速原型验证的开发者。
neuml/txtai
txtai 是一个集语义搜索、LLM 协调与语言模型工作流于一体的全能型 AI 框架,支持多种自然语言任务的一站式部署。
Two LLMs sword-fight in a physics SIM, humans blind-vote who reasoned
两个 LLM 在物理模拟环境中进行逻辑对战,人类观众盲投票判断谁推理更合理,面向 AI 研究者与爱好者,亮点是将 LLM 推理能力可视化并引入人类评判机制。
We Built the Agentic World Cup – LLMs Competing in 1v1 Soccer
用大语言模型(LLM)模拟真实足球比赛,让多个智能体在 1v1 比赛中自主决策,探索 AI 的策略与协作能力
Agentic World Cup
基于大语言模型的1v1足球竞技游戏,LLM作为球员进行实时对抗,融合AI与体育娱乐的创新实验
repos-as-docs
repos-as-docs 是一个开发者工具,将项目依赖的源码本地化,为 LLM 提供更准确的上下文,提升代码理解与生成质量。
Timeln
将用户的全部阅读历史作为上下文输入,赋能LLM进行更精准、个性化的对话与推理
CompareLLMS
CompareLLMS 允许用户同时调用多个大语言模型进行对比测试,所有数据本地处理,保障隐私,适合开发者评估模型性能。
Leviath – Structured context regions for LLM agents, in one Rust binary
一个将LLM代理的上下文结构化为区域的单二进制Rust工具,支持精确控制上下文范围与数据流,提升推理效率与可解释性。
Bulwark Gateway – fail-closed security proxy for LLM agents
Bulwark Gateway 是一个‘fail-closed’(故障闭锁)的安全代理,专为 LLM 智能体设计,确保在异常时自动切断访问,保障系统安全。
multica-ai/andrej-karpathy-skills
基于 Andrej Karpathy 对大模型编程缺陷的观察,提炼出的 Claude Code 优化配置文件,提升 AI 编码助手的准确性和实用性
Agnos LLM gateway
统一的LLM网关API,整合LiteLLM、Bifrost、Portkey等多模型服务,实现统一调度与成本控制
Module for LLM Homeostasis (PoC)
用于实现大语言模型(LLM)稳定性的实验性模块,旨在防止模型输出漂移,适合AI研究者与开发者测试模型一致性。
Mrigashira AI engine
Mrigashira AI 引擎是一个支持本地与云端大模型的高级交互界面引擎,适合开发者构建智能应用,亮点是统一接口与高性能推理支持。
LLMSlim
面向大模型应用的上下文优化工具,支持工具感知与合约安全机制,帮助开发者构建更可靠、可控的AI应用系统
Millnew AI – On device time-series prediction AI using PyTorch & Captum
Time-to-text 是一种基于时间序列的 AI 模型,用于减少大语言模型在生成文本时的幻觉问题,提升输出可靠性。
Unplug AI
开源安全层,为大语言模型应用提供防护,抵御提示注入等攻击,是LLM开发者必备的防御工具
Openheim – a multi-provider LLM agent runtime, written in Rust
Openheim 是用 Rust 编写的多提供商 LLM 代理运行时,支持灵活调度和管理多个大模型服务,适合构建智能应用。
IFM/K2-Horizon-MoVA-36B-A4B-GGUF · Hugging Face
K2-Horizon-MoVA-36B-A4B-GGUF 是一个开源的超大语言模型,支持本地部署,适用于高精度推理与私有化AI应用。
Telemetry.dev – OpenTelemetry-native tracing for LLM apps and agents
专为LLM应用与智能体设计的OpenTelemetry原生追踪工具,实现可观测性增强
Local 3D LLM Sandbox a tiny assistant with an attitude
Local 3D LLM Sandbox 是一个轻量级本地运行的 3D 大语言模型助手,自带个性与态度,可在本地运行实现离线智能交互。
Unabyss for Claude
Unabyss for Claude 是一个为 Claude 大模型设计的共享记忆系统,让用户在多个应用和对话中保持上下文连贯,提升 AI 交互的连续性与效率,适合需要长期记忆的开
其他标签

常见问题

「LLM」这个标签是怎么归的?

标签来自每个产品的中文拆解(解决什么场景、面向谁),由模型从产品自述里归纳,不是人工逐条打的,也不接受付费打标。

这里的排序依据是什么?

按库内真实热度:投票数 / MRR / 增速,取产品实际有的那个。不是编辑推荐,也不卖位置。

数据多久更新?

追踪持续进行(分钟级),本页于 2026-09-12 生成。全部数字可经公开只读 API 复核:https://kanonagent.com/data