警报

*此内容使用人工智能(Beta)翻译,可能包含错误。若要查看英文页面,请点按 此处

警报 让您主动监控您体验的关键性能指标,并在它们超过您定义的阈值时接收实时通知。您可以设置警报,自动通知您当崩溃率激增、内存使用过高或帧率下降时,而无需手动检查仪表板。

例如,以下工作流程是使用警报捕捉性能回归的典型方式:

  1. 创建警报 - 设置一个“客户端崩溃率超过 5%”的警报,持续时间为 5 分钟,严重性为关键。
  2. 添加网络钩子 - 连接到您团队的 PagerDuty 或 Discord 网络钩子。
  3. 推送更新 - 部署您的新版本。
  4. 接收警报 - 如果崩溃率在连续 5 分钟内超过 5%,您的团队会立即收到包含指标值和仪表板链接的通知。
  5. 调查并修复 - 点击网络钩子负载中的仪表板链接以查看性能图表并诊断问题。

您可以为每个体验创建最多 20 个警报。创建警报需要 创建和配置警报 权限。

查看警报页面

要访问警报页面,您必须是体验的所有者或拥有 查看所有分析 权限

  1. Creator Hub 上选择您的体验。
  2. 配置 下,选择 警报

配置 选项卡让您创建和管理警报规则。使用 分析 页面查看警报历史、活动警报和事件。

权限

警报需要特定权限以执行不同操作:

操作所需权限
创建、编辑、删除或切换警报创建和配置警报
查看警报分析页面查看所有分析
创建体验级网络钩子列出、创建、更新和删除网络钩子

创建警报

要创建警报,请在警报配置页面上点击 创建

现有警报仪表板,带有创建按钮。

警报字段

每个警报都有以下配置选项。

字段描述
名称在通知、注释和仪表板上显示的警报的唯一名称。
描述可选描述,以提供额外的上下文。
指标要监控的目标指标。
时间粒度指标评估的频率(分钟、半小时、每小时或每日)。
触发条件触发警报的条件(例如,值 > 500)
过滤器可选过滤器,以缩小指标范围,例如地方版本、操作系统或平台。仪表板上可用的所有过滤器均受支持。
细分可选细分,以检查每个细分是否满足条件。
持续时间条件必须连续满足的次数,才能触发警报(1-10)。
严重性严重性级别(关键、中等或低)。
交付渠道发送警报通知的地方。请参见 网络钩子交付

支持的指标

警报支持 性能仪表板 上所有可用的性能指标,包括:

  • 客户端帧率
  • 客户端崩溃率
  • 客户端内存使用(GB)
  • 客户端内存使用百分比
  • 意外的内存溢出退出
  • 服务器 CPU 时间
  • 服务器帧率
  • 服务器内存使用(GB)
  • 并发用户
  • 会话时间

触发条件

您可以设置两种触发条件类型之一:

  • 指标值 - 当指标超过静态数值阈值时触发。该值使用与指标相同的单位(百分比、毫秒、MB 等)。

  • 周期变化 - 当指标的变化率超过百分比阈值时触发。

    • 周比周 - 检查上周同一时间的百分比变化(例如,本周五下午 5:00 与上周五下午 5:00)。
    • 日比日 - 检查昨天同一时间的百分比变化(例如,今天上午 9:00 与昨天上午 9:00)。
    • 小时比小时 - 检查最近一小时与前一小时之间的百分比变化(例如,上午 9:05 与上午 8:05)。

例如,您可以设置一个指标值条件,如“客户端崩溃率超过 5%”,或一个周期变化条件,如“每小时变化超过 50%”。

持续时间

持续时间设置控制触发条件必须连续满足多长时间才能触发警报。这有助于减少瞬时波动带来的噪音。如果您选择 1,则在一个数据点满足您的条件时,警报会立即触发。如果您选择 5,则必须有五个连续的数据点满足条件。对于分钟粒度的警报,最小持续时间为 5 分钟,以减少噪音。

严重性级别

每个警报都有一个严重性级别,该级别包含在警报消息中,并以不同的颜色显示。

严重性用例
关键需要立即采取行动的紧急问题,例如崩溃率激增。
中等应尽快调查的显著回归。
值得跟踪的小变化,但不需要立即采取行动。

网络钩子交付

警报通过体验级网络钩子到达。当警报触发或恢复时,会向您配置的网络钩子 URL 发送一个 HTTP POST 请求,带有 JSON 负载。消息本身也是 JSON,包装在 AlertMessage 字段中作为一个字符串,如下所示:

{
"NotificationId": "11111abc-111a-1a2a-ab1a-abc1a1a111a1",
"EventType": "AnalyticsAlert",
"EventTime": "2026-06-15T22:05:10.8590762Z",
"EventPayload": {
"TargetType": "Universe",
"TargetId": "1234567890",
"AlertMessage": "{\n \"summary\": \"[♟️] 游戏已恢复\",\n \"metric\": \"PeakConcurrentPlayers\",\n \"universe_id\": \"1234567890\",\n \"evaluation_time_utc\": \"2026-06-15T22:04:47Z\",\n \"alert_history\": \"https://create.roblox.com/dashboard/creations/experiences/1234567890/alerts?tab=AlertConfiguration-Analytics&utm_medium=webhook&utm_campaign=alert_resolved\"\n}"
}
}

AlertMessage.summary 字段包含警报触发时的“触发”一词,或当指标恢复到正常状态时的“恢复”一词。

您可以使用网络钩子与外部工具(如 PagerDuty 或 Slack)集成,以便团队广泛可见。

设置网络钩子

  1. Creator Hub 上选择您的体验。

  2. 配置 下,选择 网络钩子 并点击 添加网络钩子

    网络钩子 URL 来自您的提供商。例如,Slack 的 URL 可能如下所示:

    https://hooks.slack.com/services/T00000000/B00000000/XXXXXXXXXXXXXXXXXXXXXXXX
  3. 输入您的网络钩子 URL 和名称。

  4. 可选
    包含一个密钥,这可以帮助确保您收到的请求来自 Roblox。

  5. 可选
    使用 测试响应 按钮检查您的服务是否可以接收示例请求。

  6. 点击 保存更改

  7. 在创建或编辑警报时,在 交付渠道 字段下选择您的网络钩子。

创建体验级网络钩子需要 列出、创建、更新和删除网络钩子 权限

监控警报

警报页面上的 分析 选项卡提供了您警报历史和当前状态的集中视图:

  • 触发事件 - 显示随时间推移触发的警报数量的图表。您可以调整时间范围,按警报名称搜索,并按严重性过滤。
  • 活动警报 - 显示当前活动(触发)警报的表格。
  • 历史 - 在所选时间范围内所有警报事件的时间顺序日志。
分析选项卡的截图,显示触发事件的历史。

图表注释

当警报正在触发时,相应指标图表上会出现一个范围注释。注释显示警报名称,并跨越触发期间的持续时间。

注释仅在图表应用了与警报相同的过滤器时出现。如果您的警报有细分过滤器,注释仅显示总线。

显示图表注释的截图。

体验概述

活动警报(已触发且尚未恢复的警报)出现在您体验的 概述 页面上的警报托盘中。托盘显示五个最近的活动警报及其时间戳、名称和当前指标值。点击 查看所有 以导航到完整的警报分析页面。

带有活动警报的体验概述页面

警报最佳实践

以下提示可以帮助您充分利用警报,并防止您的网络钩子端点被通知淹没:

  • 通过持续时间防止误报 - 避免将持续时间设置为 1,以应对会话时间等高度波动的指标。玩家同时加入或加载资产的突然涌入可能会导致暂时性激增。设置持续时间为 5 确保只有在问题持续时才会触发警报。
  • 有效使用细分 - 不必为 Android、iOS 和 PC 创建多个单独的警报,您可以创建一个警报并使用 细分 功能。该警报将分别评估每个平台,并在网络钩子负载中指定问题发生的位置。
  • 首先建立基线 - 在设置阈值之前,查看过去 7 到 14 天的现有分析图表。如果您的正常崩溃率徘徊在 1.2% 左右,请考虑将警报阈值设置为 2.5% 或 3%。给您的指标留出自然波动的空间可以防止误报。
  • 使用描述性、结构化的名称 - 由于警报名称直接注入到您的网络钩子负载和注释中,使用清晰的公式,如 metric - context(例如,高客户端崩溃率 - 移动)可以让您的团队一目了然地处理问题。
©2026 Roblox Corporation、Roblox、Roblox 标志及 Powering Imagination 是我们在美国及其他国家或地区的注册与未注册商标。