Supabase Evals

评测编程智能体在真实 Supabase 任务表现的开源基准

Supabase Evals 是 Supabase 开源的智能体评测基准与框架,用于衡量智能体完成各类 Supabase 任务的能力。每个 eval 场景包含提示词、评分器及远端项目与本地工作文件两套起始状态;experiment 定义智能体、运行时与模型配置,可组成套件做同场对比。platform-lite 运行时提供与 Management API 兼容的接口,可让 mcp-server-supabase 等真实工具直接运行

工具协议集成性能基准
访问官网
收录动态

1

最近更新

2026-08-01

评价样本

未收录

GitHub Stars

17

工具功能

这个工具能做什么、适合谁用,以及目前已识别的核心能力。

工具简介

Supabase Evals 是 Supabase 开源的智能体评测基准与框架,用于衡量智能体完成各类 Supabase 任务的能力。每个 eval 场景包含提示词、评分器及远端项目与本地工作文件两套起始状态;experiment 定义智能体、运行时与模型配置,可组成套件做同场对比。platform-lite 运行时提供与 Management API 兼容的接口,可让 mcp-server-supabase 等真实工具直接运行

核心功能

2 项已整理
工具协议集成
性能基准

价格信息

暂无可验证价格信息

暂无足够准确的价格信息。

基础信息

更新频率
近 7 天 1 条收录动态
最近更新
2026-08-01
覆盖行业

更新日志

按时间记录功能更新、版本发布、新工具入库等重要变化。

  1. 2026-08-01开源

    Supabase 以 Apache-2.0 协议开源 supabase/evals 智能体评测基准与框架:在容器化的真实 Supabase 技术栈中让 Claude Code、Codex、OpenCode 等编程智能体执行建表、调试 Edge Function、修复 RLS 策略等任务,用确定性检查加 LLM-as-a-judge 双重评分,支持 experiment 套件同场对比,并驱动公开排行榜与每日回归套件。

Supabase Evals 常见问题

关于 Supabase Evals 的定位、核心功能、价格与最近更新。

Supabase Evals 是什么?

Supabase Evals 是 Supabase 开源的智能体评测基准与框架,用于衡量智能体完成各类 Supabase 任务的能力。每个 eval 场景包含提示词、评分器及远端项目与本地工作文件两套起始状态;experiment 定义智能体、运行时与模型配置,可组成套件做同场对比。platform-lite 运行时提供与 Management API 兼容的接口,可让 mcp-server-supabase 等真实工具直接运行。

Supabase Evals 有哪些核心功能?

Supabase Evals 当前已核验的核心功能包括:工具协议集成、性能基准。

Supabase Evals 如何收费?

AI Equal 当前没有收录 Supabase Evals 的可验证价格信息。

Supabase Evals 最近有什么更新?

2026-08-01:Supabase 以 Apache-2.0 协议开源 supabase/evals 智能体评测基准与框架:在容器化的真实 Supabase 技术栈中让 Claude Code、Codex、OpenCode 等编程智能体执行建表、调试 Edge Function、修复 RLS 策略等任务,用确定性检查加 LLM-as-a-judge 双重评分,支持 experiment 套件同场对比,并驱动公开排行榜与每日回归套件。

Supabase Evals:功能、价格、更新日志与同类对比 | AI Equal