⚡
渠道压力测试
切换主题
⚙️ 压测配置
Base URL
API Key
选择模型
🔍 扫描模型
全选对话
取消全选
未扫描
点击「扫描模型」获取可用模型列表,或直接在下方手动输入
手动输入(逗号分隔,仅在未勾选任何模型时生效)
并发数
目标 RPM(每分钟真实请求数)
持续时间 (秒)
测试模式
RPM 开环 (模拟真实流量)
图片生成 (image-gen)
图片理解 / 多模态理解
OTPS / TTFT 测速
每会话轮数
1
2
3
4
5
6
8
10
缓存对话模式(每用户做多轮,测缓存命中)
多模型方式(已选
0
个模型)
顺序排队 — 一个模型跑完再跑下一个
随机混合 — 多模型混着跑一份报告(均匀轮流,各模型等量,默认)
混合模式:像生图混合矩阵一样,请求均匀摊到各模型;报告里每个模型有独立的成功率/延迟/缓存明细。
上下文规模
短 — 每次约消耗 2400 token(最省,测连通/缓存推荐)
中 — 每次约消耗 2700 token
长 — 每次约消耗 4700 token,模拟 RAG / 长对话
缓存命中后第2轮起只按约 1/10 价格计费。四档缓存命中率一样,差别只是 user 消息长度。
随机参数(temperature/top_p/system 等,更像真实客户端;Claude 自动只注入安全字段)
测速样本数(每模型)
1
2
3
5
8
10
测试样本
全部样本轮转(图像 / 视频音频 / 多图音频)
只测图片理解
只测图像 + 视频帧 + 音频
只测多图 + 音频
并发分发
会根据你填写的 RPM 自动分配本地 worker,不需要手动设置。
说明
这个模式走你给我的 Gemini 多模态探针脚本,测的是图片 / 视频帧 / 音频理解,不是生图。
图片尺寸
混合尺寸:1K / 1080p / 2K / 4K 均匀分布
1024×1024(固定)
1536×1024
1024×1536
1920×1088(1080p 对齐,若上游支持)
2048×1152(2K,若上游支持)
2560×1440(2K / QHD,若上游支持)
3840×2160(UHD / 4K,若上游支持)
生图负载
混合:文生图 + 图生图需求均匀分布
只测文生图
只测图生图需求(不上传素材)
清晰度档位
混合:low / medium / high 均匀分布
固定 low(最低成本)
发射方式
一次性并发(设并发数)
RPM 开环(设每分钟张数 + 时长)
图片模式可选 1 个或多个图片模型;多选时请求会按模型均匀轮转,和尺寸/负载/清晰度矩阵一起混合并发。
检测到视频模型:自动切到单模型视频测试。将固定为单一尺寸、单一负载、单一档位;不要和普通图片模型混测。
报告标签 (PDF / 页面表头名称)
▶ 开始压测
📎 Curl
⏹ 停止
清空记忆
实时监控
多模型顺序测试
0
已发请求
0
成功
0
失败
0
限流(429)
0
QPS
0
实际RPM
0
处理中/峰值
0
待回包
0
Cache Hits
0.00s
平均延迟
0.00s
P50
0.00s
P95