~/home / tags / 性能优化

# 性能优化

36 个相关产品 · 中文解读 · 按热度排序
截至 2026-09-10,KanonAgent 库内有 36 个带「性能优化」标签的 AI agent 与工具,本页按真实热度排序。标签由中文拆解自动归纳,不是人工打的;数据可经公开 API 复核。
evo
evo 将代码库转化为自动研究循环,能自主发现需测量的指标、插入基准测试、并用并行子代理进行树搜索优化,提升代码性能。
oMLX
在 Mac 上运行的本地 LLM 服务器,通过优化推理流程将 AI Agent 的响应时间从 90 秒缩短至 5 秒,解决本地运行 AI 时延迟高的痛点,适合开发者与 AI 爱好者
Goroviz
Go 语言性能分析工具,自动聚合相似的 goroutine,帮助开发者快速定位程序性能瓶颈,避免在海量堆栈中手动排查
ThreadMine
一个用于快速分析JVM线程转储的工具,能自动检测死锁、线程泄漏、线程池耗尽等性能问题,帮助开发者秒级定位Java应用的运行瓶颈,适合后端开发与运维工程师使用。
I wrote a 1-bit WebGPU runtime to run a 1.7B LLM in the browser
一个仅1比特的WebGPU运行时,能在浏览器中运行17亿参数的大型语言模型,突破前端AI性能极限,适合Web开发者和AI实验者
Alenia Porter
Alenia Porter 是一个高性能通用媒体优化工具,支持图像、视频、音频的自动 GPU 加速处理,基于 Go 和 Nuitka 构建,具备崩溃安全回退机制
Headroom – measure your GPU's true bandwidth ceiling for local AI
Headroom 是一款用于测量本地运行 AI 模型时 GPU 实际带宽上限的工具,帮助开发者优化推理性能,解决本地 AI 推理瓶颈问题,主要面向本地部署 AI 模型的开发者和研究
Codex / Claude Code harness for Java high performance improvements
为Java开发者提供基于Codex/Claude Code的高性能代码优化工具,通过AI自动重构代码提升运行效率,解决Java应用性能瓶颈问题
ContextRot
一个本地CLI工具,用于分析Claude Code和OpenCode等AI编码助手在上下文增长时的性能退化问题,帮助开发者识别模型瓶颈与成本拐点。
Atomadic- Zero-LLM Sub-200us MCP Action Interlock (Storefront Restored)
零大模型延迟的MCP动作互锁系统,专为低延迟场景设计,实现亚200微秒级响应,适用于高性能计算或实时系统
LightKeeper MCP
一个无需注册、无API密钥的网站全球速度测试工具,可集成到AI开发代理中,跨多地区执行深度Lighthouse审计,帮助开发者优化全球性能。
Atomadic – Zero-LLM Sub-200us MCP Action Interlock
一个零大模型延迟的超低延迟MCP动作互锁系统,支持亚200微秒响应,专为高性能AI代理设计。
InterMCP – Pure-Rust MCP engine (457k ops/s, <3.8MB RAM)
一个用 Rust 编写的高性能 MCP 引擎,专为低资源环境优化,适合需要高吞吐、低内存占用的 AI 代理或工作流系统集成。
Efficio - AI Harness for speed, memory
Efficio 是一个能自动扫描Python/C++代码库、识别性能瓶颈并自动重构代码的AI工具,重构结果通过测试验证,确保安全,适用于提升工程效率的开发者。
jundot/omlx
专为 Apple Silicon Mac 设计的 LLM 推理服务器,支持连续批处理与 SSD 缓存,通过菜单栏轻松管理,显著提升本地大模型运行效率。
youssofal/MTPLX
基于 MLX 的高性能推理框架,实现 Qwen 3.8 27B 在 Apple Silicon 上 3 倍加速,原生支持 MTP 指令推测解码。
DeusData/codebase-memory-mcp
高性能代码智能MCP服务器,能毫秒级索引超150种语言的代码库并构建持久知识图谱,查询快、消耗低,适合大型项目代码理解与智能开发。
A 100% branchless, CUDA-native AI guardrail kernel written in C++20
一个用 C++20 编写的 100% 无分支、原生支持 CUDA 的 AI 安全防护内核,专为高性能 AI 推理场景设计,帮助开发者构建更安全、低延迟的 AI 应用。
Reame – a CPU inference server that gets faster as it runs
Reame 是一个能边运行边变快的 CPU 推理服务器,适合需要低延迟、高效率本地 AI 推理的开发者,通过动态优化提升性能。
Estratos – stacked memory system for AI assistants
Estratos 是为AI助手设计的分层内存系统,通过优化上下文管理提升大模型交互的连贯性与性能,适合AI应用开发者与研究者。
LLM Context profiler for tracking context usage by tools, agents, MCPs
LLM Context Profiler 是用于监控大模型在工具、代理和MCP中上下文使用情况的分析工具,帮助开发者优化成本与性能。
raullenchai/Rapid-MLX
专为Apple Silicon优化的本地AI引擎,性能比Ollama快4.2倍,支持工具调用、缓存推理与云路由,可无缝替代OpenAI接口
AutomateWolf
无需服务器访问即可实现边缘优化的 SaaS 工具,通过智能 CDN 和边缘计算提升应用性能,适合希望提升加载速度但无运维权限的开发者与企业。
Atomadic- Zero-LLM Sub-200us MCP Action Interlock (Storefront Restored)
Atomadic 是一个零大语言模型(Zero-LLM)的超低延迟 MCP 行动互锁系统,响应时间低于 200 微秒,专为高并发、低延迟的分布式系统设计,适合构建高性能基础设施。
An ultra-fast Prime Agent fork with Bun REPL
一款基于 Bun 的超快速 Prime Agent 分支,集成 REPL 交互环境,适合需要极致性能和即时反馈的开发者进行快速原型开发。
LightKeeper MCP
LightKeeper MCP 是一个 Web 应用,提供多区域性能审计与自动化优化,提升网站全球访问速度与稳定性。
fpsmode
fpsmode 是一款专为 PC 优化设计的开源工具,通过系统级调优提升游戏帧率与响应速度,适合游戏玩家和性能爱好者。
charlie12345/ROCmFPX
ROCmFPX 是 AMD GPU 的量化与特殊代理优化框架,支持更多量化格式与专用算子,提升 AI 模型在 AMD 硬件上的推理效率,适合 AI 研究与部署团队。
GPU Sizer
一款SaaS服务,帮助开发者和AI工程师精准选择适合运行大语言模型(LLM)的GPU,基于真实硬件测试数据提供推荐,提升部署效率。
Aquifer – Admission control for bursty vLLM traffic
为突发性大模型推理流量设计的准入控制工具,用于稳定 vLLM 服务在高并发下的性能与资源分配。
CuMetal – Run CUDA Programs on Apple Silicon via Metal
CuMetal实现CUDA程序在Apple Silicon芯片上通过Metal运行,让NVIDIA生态代码在M系列Mac上无缝执行,适合AI与高性能计算开发者
oMLX
oMLX 是一款开源的 Mac 本地 LLM 服务器,通过优化推理效率,将 AI 代理响应时间从 90 秒缩短至 5 秒。
SuperFlare Cache
专为WordPress优化的缓存插件,通过智能预加载与资源压缩显著提升网站加载速度
TabVitals
TabVitals 是 Chrome 浏览器扩展,帮助用户识别占用资源过多的标签页,释放内存并修复卡顿网站,提升浏览器性能。
Angular 22 + GSAP Boilerplate
基于Angular SSR与GSAP的前端开发模板,零泄漏构建高性能动态网站
Efficio - AI Harness for speed, memory
AI 无关的代码优化工具,可自动重写代码以提升运行速度、降低内存占用和成本,适用于各类开发项目
其他标签

常见问题

「性能优化」这个标签是怎么归的?

标签来自每个产品的中文拆解(解决什么场景、面向谁),由模型从产品自述里归纳,不是人工逐条打的,也不接受付费打标。

这里的排序依据是什么?

按库内真实热度:投票数 / MRR / 增速,取产品实际有的那个。不是编辑推荐,也不卖位置。

数据多久更新?

追踪持续进行(分钟级),本页于 2026-09-10 生成。全部数字可经公开只读 API 复核:https://kanonagent.com/data