
Supabase Evals
评测编程智能体在真实 Supabase 任务表现的开源基准
Supabase Evals 是 Supabase 开源的智能体评测基准与框架,用于衡量智能体完成各类 Supabase 任务的能力。每个 eval 场景包含提示词、评分器及远端项目与本地工作文件两套起始状态;experiment 定义智能体、运行时与模型配置,可组成套件做同场对比。platform-lite 运行时提供与 Management API 兼容的接口,可让 mcp-server-supabase 等真实工具直接运行
1
2026-08-01
未收录
17
工具功能
这个工具能做什么、适合谁用,以及目前已识别的核心能力。
工具简介
Supabase Evals 是 Supabase 开源的智能体评测基准与框架,用于衡量智能体完成各类 Supabase 任务的能力。每个 eval 场景包含提示词、评分器及远端项目与本地工作文件两套起始状态;experiment 定义智能体、运行时与模型配置,可组成套件做同场对比。platform-lite 运行时提供与 Management API 兼容的接口,可让 mcp-server-supabase 等真实工具直接运行
核心功能
价格信息
暂无可验证价格信息暂无足够准确的价格信息。
基础信息
- 更新频率
- 近 7 天 1 条收录动态
- 最近更新
- 2026-08-01
- 覆盖行业
更新日志
按时间记录功能更新、版本发布、新工具入库等重要变化。
- 2026-08-01开源
Supabase 以 Apache-2.0 协议开源 supabase/evals 智能体评测基准与框架:在容器化的真实 Supabase 技术栈中让 Claude Code、Codex、OpenCode 等编程智能体执行建表、调试 Edge Function、修复 RLS 策略等任务,用确定性检查加 LLM-as-a-judge 双重评分,支持 experiment 套件同场对比,并驱动公开排行榜与每日回归套件。
Supabase Evals 常见问题
关于 Supabase Evals 的定位、核心功能、价格与最近更新。
Supabase Evals 是什么?
Supabase Evals 是 Supabase 开源的智能体评测基准与框架,用于衡量智能体完成各类 Supabase 任务的能力。每个 eval 场景包含提示词、评分器及远端项目与本地工作文件两套起始状态;experiment 定义智能体、运行时与模型配置,可组成套件做同场对比。platform-lite 运行时提供与 Management API 兼容的接口,可让 mcp-server-supabase 等真实工具直接运行。
Supabase Evals 有哪些核心功能?
Supabase Evals 当前已核验的核心功能包括:工具协议集成、性能基准。
Supabase Evals 如何收费?
AI Equal 当前没有收录 Supabase Evals 的可验证价格信息。
Supabase Evals 最近有什么更新?
2026-08-01:Supabase 以 Apache-2.0 协议开源 supabase/evals 智能体评测基准与框架:在容器化的真实 Supabase 技术栈中让 Claude Code、Codex、OpenCode 等编程智能体执行建表、调试 Edge Function、修复 RLS 策略等任务,用确定性检查加 LLM-as-a-judge 双重评分,支持 experiment 套件同场对比,并驱动公开排行榜与每日回归套件。