对比模型效果 的 AI Skill
共 193 个,按热度排序。把对比模型效果这件事交给 AI 来做。
cc-switch
一款集成管理多个AI编程助手的桌面客户端工具。
LibreChat
开源、可自部署的多模型AI聊天平台
Antigravity-Manager
一款集AI账号管理与协议转换于一体的本地桌面应用。
@braintrust/pi-extension
为Pi AI自动追踪会话与调用到Braintrust平台
Promptibus MCP
一站式调用67+生成式AI模型的MCP工具集
Promptibus MCP
为AI智能体提供统一的模型调用与路由能力,覆盖67+主流生成模型。
pi-provider-litellm
为Pi接入LiteLLM代理,统一管理多种大模型。
pi-autoresearch
为π项目设计的自动化实验循环工具
RAG
设计、调优与调试RAG管道的专业工具
Relay To Agent
将消息中继到任何兼容OpenAI API的AI智能体,支持多轮对话和会话管理。
@d3ara1n/pi-model-roles
为PI扩展提供模型角色配置与解析的库
@booplex/bpx-consult
AI顾问委员会,提供单一或多模型共识咨询。
pi-clinepass-provider
通过ClinePass订阅,在pi中一键调用多个顶尖开源编程模型。
@apmantza/greedysearch-pi
无需API密钥的多引擎AI搜索工具,聚合Perplexity、Google AI、ChatGPT和Gemini的搜索结果。
pi-langfuse
为Pi编程助手集成Langfuse的观测与追踪能力。
LYGO Champion: delta9ra wolf
已弃用的Legacy Δ9冠军技能,请使用新版本。
@alexeiled/pi-fusion
通过并行模型评审机制,为复杂Pi问题提供更强答案。
ia-brainstorming
在编码前进行深度访谈、方案对比和设计文档撰写,澄清模糊需求。
ia-brainstorming
在编码前进行深度探索、需求澄清与方案对比的智能体技能
Skill Forge 技能熔炉
一站式技能锻造与评估工具
@duyviet1804/pi-moa
为pi提供MoA融合工作流的执行能力
pi-pulse
为Pi编码助手提供实时性能指标监控页脚。
Train Robotic AI Models using Qualia
提供云端GPU训练基础设施,用于微调机器人基础模型。
Train Robotic AI Models using Qualia
云端GPU微调机器人基础模型的CLI工具
Train Robotic AI Models using Qualia
提供云端GPU基础设施,用于微调机器人视觉语言动作(VLA)基础模型。
Train Robotic AI Models using Qualia
提供云端GPU基础设施,用于微调机器人视觉-语言-动作基础模型。
Train Robotic AI Models using Qualia
在云端GPU上微调机器人基础模型,简化机器人AI训练流程。
Modelshow V1.2.0
并行匿名对比多个AI模型的输出,进行双盲评测。
Modelshow V1.2.0
双盲并行对比不同AI模型的回答质量
Modelshow V1.2.0
双盲并行对比多个AI模型的回答质量并进行匿名排名。
@liziy/minimax-local
让Pi直接调用MiniMax官方API的扩展插件。
pi-requesty-discover
发现并管理Pi Coding Agent可用的Requesty模型
Modelshow V1.2.0
匿名双盲对比多个AI模型回答,客观评估优劣。
Modelshow V1.2.0
双盲对比AI模型回答,匿名排名
pi-fusion
为PI模型提供多模型协同推理能力。
evaluation-framework
提供加权评分、评估量规和决策阈值模式,用于系统化评估
escalation-governance
评估模型是否需要升级或更换
escalation-governance
评估AI模型是否需要升级或更换
evaluation-framework
加权评分与决策阈值的评估框架
escalation-governance
评估模型是否该升级的决策工具
gemini
通过RunAPI调用Gemini系列模型API的Skill。
claude
通过RunAPI代理调用Claude全系列模型
pi-qwencloud-provider
一站式调用通义千问、DeepSeek、智谱AI等主流大模型及文生图、文生视频服务。
claude
通过统一接口调用Claude系列模型,兼容多种SDK。
claude
通过统一接口调用Claude系列模型,支持多协议SDK
pi-external-advisor
让Pi助手调用外部AI模型提供咨询
Calliper SaaS Markdown
本地文档差异对比,并转换为LLM可读的Markdown格式。
Mumo
通过MCP服务器组织多模型(Claude/GPT等)进行结构化审议
@aa2246740/pi-fusion
为Pi智能体提供经过DRACO验证的模型融合能力。
pi-scoped-models-extra-info
Pi编码助手扩展,可视化展示模型信息与性能对比
pi-sakana-provider
为Pi平台接入Sakana AI模型的自定义提供商。
pi-models
按提供商或系列浏览AI模型的Pi插件
@llmgates_api/pi-llmgates-provider
为LLMGates平台提供Pi模型动态接入能力
@grammeaway/pi-provider-sakana-fugu
为Pi智能体框架提供Sakana Fugu模型接入能力
@milespossing/pi-copilot-discovery
为Pi AI动态获取GitHub Copilot可用模型列表
pi-scheduled-router
根据时间自动切换AI提供商和模型的Pi插件
katmer-code
Obsidian内多AI模型聚合聊天与学术写作插件
pi-alibaba-models
一站式接入阿里云通义千问、深度求索、智谱AI等主流大模型。
@danielmeneses/pi-llama-swap
为Pi平台提供动态模型切换能力的扩展
@aliou/pi-cohere
为Pi Agent集成Cohere模型能力的扩展。
@diegovisk/pi-nvidia-nim
为AI助手pi接入NVIDIA NIM全模型,提供智能处理与重试机制。
pi-ccs
本地切换AI模型与提供商,支持参数覆盖与标签
pi-zenmux-provider
在Pi中注册ZenMux为OpenAI兼容模型提供商
pi-openrouter-realtime
为 PI 增强 OpenRouter 实时模型管理与查询能力
pi-modelbench
Pi 编码代理的确定性模型基准测试工具
@aretw0/lab-skills
agents-lab实验性技能,支持原语培育、扩展评估与栈反馈
pi-blindtest
用于Pi平台的盲测模型扩展,隐藏模型信息并聚合评分。
@mcowger/pi-llmgateway
为Pi接入160+主流大模型,统一API调用
pi-proxy-models
为Pi Coding-Agent扩展主流AI模型API的代理工具。
@h00w/pi-provider-aihubmix
为Pi平台自动接入AIHubMix模型,支持多协议路由与缓存。
pi-chess
在终端里与AI下国际象棋,规则完整,带注解。
@monroewilliams/pi-local
为Pi配置多个本地大模型推理引擎的扩展工具。
pi-gpt56-switcher
键盘优先的Pi扩展,快速切换GPT-5.6模型与思考层级
@cortexkit/pi-antigravity-auth
使用谷歌账号一键授权,解锁高级AI模型访问。
@bramburn/pi-model-council
通过多模型投票提升代码决策质量
prompt-engineering-skills
一个跨平台、多模型通用的提示工程技能合集仓库。
pi-windsurf-beta
在Pi中集成Windsurf订阅,一键调用Claude、GPT等多款AI模型。
pi-switch-model
在对话中自由切换Pi的AI模型
pi-qwencloud-token-plan-provider
为Pi智能体提供调用通义千问、DeepSeek、智谱AI等云端模型的统一接口。
rejudge
为AI Agent提供独立的多模型复审工具
pi-tokenrouter-provider
为Pi平台集成TokenRouter.com作为模型提供商
pi-zai-glm
为pi AI助手扩展智谱GLM模型支持
@estebanforge/pi-mixture-of-agents
为Pi AI提供多模型混合推理与增强功能
@0xkahi/pi-model-select
为Pi添加快速切换和筛选AI模型的功能
@artale/pi-arena
模型性能评测与幻觉追踪工具
@es11225599/pi-9router
连接9router并为其模型注入models.dev元数据的Pi包
open-code-war
一个用于比较和展示不同AI编码助手Token消耗情况的排行榜工具。
@latent-variable/pi-terminal-bench
Pi模型本地基准测试套件
pi-moonshot
为Pi添加月之暗面Moonshot AI模型支持
pi-crof
为AI助手Pi扩展CrofAI模型能力的插件。
@artale/pi-eval
评估AI Agent会话表现的工具套件
pi-bench
pi coding agent 的 LLM 模型基准测试与智能选型工具
@gigachain/pi-gigachat
为pi-coding-agent提供GigaChat大模型支持的扩展插件
omniroute-pi-extension
为OmniRoute提供模型路由管理与状态显示的Pi Coding Agent插件
@philvr/pi-model-info
实时查看Pi当前使用的AI模型与思考级别。
@igor-guari/pi-omniroute
为Pi Coding Agent提供统一访问236+个AI模型的OmniRoute网关
pi-airpx
一键接入airpx代理,自动同步模型目录到Pi助手。
pi-cutlery
专为Pi设计的多会话工作流工具箱,核心是会话分叉。
pi-parallel-agents
无需预配置即可动态并行运行多个AI代理
sub-agents-skills
跨LLM编排子代理,将任务路由到不同AI编码工具。
oh-my-tps
为Pi编码助手提供实时TTFT和TPS性能读数
pi-model-effort-coloring
为Pi模型名称和思考强度添加颜色标识
@artale/pi-fi
通过fi命令行免费调用多个主流LLM服务
pi-speedometer
用于测量Pi模型单轮对话性能指标的测速器
@howaboua/pi-glm-via-anthropic
在Pi中调用智谱GLM模型
pi-fallback-provider
为AI助手提供多模型自动回退与故障转移能力
pi-openrouter-native
为PI平台原生集成OpenRouter模型路由
@mrexodia/kilo-pi-provider
Pi平台Kilo网关扩展,支持访问300余款AI模型
pi-flex-processing
Pi扩展:聊天UI切换OpenAI API普通/Flex处理模式
pi-arena
多模型并行执行同任务,并排对比输出结果
pi-model-selector-x
增强Pi /model选择器,补充模型多维度实用参数
pi-token-meter
在Pi环境中实时展示每秒生成的token数量
66julienmartin_MCP
一个Node.js实现的MCP工具,用于集成和配置Deepseek R1模型。
azure
一个集成MCP核心组件,支持与多AI模型交互的开发工具。
Claude
连接Claude与本地LM Studio,实现模型对比与双向通信的MCP工具
claude
连接Claude与本地大语言模型的MCP桥接服务器
DeepCo MCP服务器
一个功能丰富的跨平台聊天客户端,深度集成多LLM API,便于开发者快速构建AI应用。
DiffuGen MCP服务器
一个集成MCP协议,支持多AI模型的高效图像生成工具。
EnrichB2B MCP模板服务器
集成主流AI模型API,为开发者提供统一调用接口的MCP服务器。
Entity
支持JSON比较与语义分析的数据对比集成工具
gemini
一个基于MCP协议,集成Google Gemini Pro模型的TypeScript服务器。
Gemini MCP服务器
连接Claude Desktop与Google Gemini 2.5 Pro的MCP工具
just
轻量级多模型LLM统一接口服务,高效集成开发工具
MCP Gemini API服务器
为Cursor和Claude接入Google Gemini API,扩展AI能力。
mcp
为.NET开发者提供通过MCP协议与LLM交互的示例项目。
mcp
让Claude Desktop无缝调用Google Gemini模型
openapitools
一个JavaScript SDK,用于统一管理多AI平台工具,集成Claude、GPT和LangChain模型。
OpenRouter MCP服务器
一站式集成OpenRouter.ai,便捷调用多款主流AI模型。
Opik MCP
开源LLM评估框架,支持追踪、评估与监控,助力开发者构建高效AI系统。
strawhatai
集成多款开发工具,快速搭建和部署AI应用。
Swarms API MCP Server
一个支持多AI模型调度与群架构管理的REST API集成工具。
Tome
集成Ollama管理MCP服务器,简化本地LLM使用流程
vLLM Benchmark
基于MCP协议,对vLLM推理服务进行交互式性能测试与调优的工具。
any
一个统一的聊天API工具,可同时调用Claude与OpenAI模型。
AppBuilder
AI原生开发工具,集成模型调用与SDK搜索功能。
lotus
开源MCP工具,整合双AI模型,统一接口并优化调用成本。
MCP Anthropic Server
连接Anthropic实验性提示工程API的MCP工具
mcp
让Claude直接调用ChatGPT API,支持联网搜索和自定义参数。
mcp
让Claude也能调用OpenAI模型的MCP服务器工具。
mcp
在Claude中无缝调用OpenAI模型的服务
mcp
通过MCP协议直接调用OpenAI模型,支持最新o3和GPT-4o-mini。
MCPBench
一个用于评估MCP服务器性能的专业测试框架。
MLflow MCP服务器
用自然语言管理机器学习实验和模型
OmniLLM MCP
统一AI访问接口,连接Claude与多种大模型
Replicate MCP服务器
通过MCP协议便捷调用和管理Replicate平台上的AI模型。
Unichat MCP Server
一个支持连接多家AI供应商的通用聊天服务端。
Unsloth MCP Server
高效微调大语言模型,提速2倍并节省80%内存
mcp
基于MCP协议的文本差异对比Python服务器
DeepMyst
智能LLM优化与路由MCP服务器,统一管理多模型与传输方式。
gemini
支持多Gemini模型的本地化MCP集成工具
gemini
集成Google Gemini与Claude Code,扩展AI应用功能
GeminiMCP
集成Google Gemini API的MCP服务器,支持多场景AI应用开发。
mcp_connect
作为MCP网关,集成多服务器模型并支持多协议连接。
mcp_gemini
集成Google Gemini模型的MCP演示项目,提供端到端配置指南。
MCP
集成Gemini API,协调多AI服务的MCP服务器解决方案。
nsaf
连接AI助手与NSAF,支持进化算法和架构对比的MCP服务端。
openapitools
统一接口管理多个AI API,集成Claude、GPT与LangChain
vLLM MCP服务器
高性能LLM推理服务集成工具,支持多架构模型部署。
DailyForge
Claude专用的世界级提示词工程系统,用于构建、调试、翻译和对比提示词。
Trinity开源模型
免费部署的开源模型集合,助力多样化AI应用开发。
agent-eval-harness
用于评估和测试命令行智能体性能的通用框架。
agent-pulse-skills
监控本地AI Agent会话、成本与性能的工具技能
ai-comm
让多个AI助手在Kitty终端中跨窗口协作通信的工具
ai-model-selector
AI模型选择与API调用指南,助你精准调用大模型。
ai
一个通用的 AI 模型调用与集成工具包,用于在应用中集成 AI 能力。
aiephant-ai-agent-gateway
开源、兼容OpenAI的AI网关,统一管理50+供应商和320+模型。
AutoML and Hyperparameter Optimization
自动化机器学习流程,优化模型超参数,提升模型性能。
borca
一个支持多AI模型并行编码的桌面IDE。
cc-fleet
让任意第三方模型接入Claude Code的多智能体工作流
ccs
统一管理多个AI模型和服务的运行时与配置
dazee-small
开源桌面AI助手,数据本地存储,支持200+技能。
deanpeters/pol-probe
一个用于探测和评估提示词性能的AI工具
deepeval
专为LLM应用设计的开源评估框架,类似Pytest。
diffity
一个用于对比AI模型、提示词或代码差异的实用工具
eval
一个用于评估和对比AI模型、智能体或代码生成效果的技能。
harness-forge
在 Claude Code 中原生自动优化模型 harness 代码
karpathy-skill
一个模拟AI专家Andrej Karpathy思维框架的Agent视角插件。
kobo-translation-test
一个用于测试翻译效果的工具或技能
labrat
一个支持群体搜索与长期运行的AI研究实验框架
llmring
统一调用主流大语言模型的Python库,支持语义别名和成本跟踪。
lmms-eval
统一、高效、可信赖的多模态大模型评估工具包
NVIDIA/Megatron-Bridge/adding-model-support
为AI Agent添加新模型支持,扩展其能力边界。
NVIDIA/Megatron-Bridge/parity-testing
用于测试和验证大语言模型(LLM)的生成结果与参考模型是否一致的工具。
NVIDIA/Megatron-Bridge/perf-sequence-packing
优化Transformer模型训练时的序列打包,提升GPU利用率。
orca
一款支持多AI模型并行编码的桌面IDE,专为高效开发者设计。
paper-reading-zh
为AI论文阅读定制的证据规则包,强调可定位证据,减少猜测。
paseo
一个统一的界面,让你在本地并行运行多种主流AI编程助手。
posthog-for-claude
为AI编程工具集成PostHog产品分析插件
scribegoat2
评估前沿大模型在多轮对话压力下的安全持久性
veniceai/venice-models
一个用于管理和调用多种AI模型的工具库。
video-agent-skills
基于Gemini的视频分析与逆向工程工具,提供专业反馈与结构化描述。
yanex
一个轻量级、支持Git的实验跟踪工具,让研究可复现。
zero/zero-gemini
一个专为AI Agent设计的,用于连接和调用Google Gemini模型的通用技能。