Token导航 LogoToken导航TokenDH.com
研究检索需要联网github未标认证来源可访问clear审计异常

observability-stack-setup可观测性堆栈设置

Agent Skill

observability-stack-setup 用于查找、检索和筛选相关信息,适合在 Codex、Claude、Cursor、Gemini CLI 中需要根据关键词、任务场景或来源线索快速定位候选结果时使用。可结合来源仓库、安装命令和原始 README 继续核验具体用法。安装前建议确认权限范围、维护状态,以及是否会触发联网、命令执行或文件读写。

总安装

54

周安装

17

GitHub Stars

9

下载量

140
CodexClaudeCursorGemini CLI

安装说明

本站只整理中文说明和来源信息,不托管安装包,也不代用户安装。

GitHub

来源数

3

许可证

MIT

最后核验

2026-05-01

来源状态

来源可访问

安装方式

通过对话安装

复制提示词发给支持本地命令或 Skills 的 AI 助手,先确认命令和权限,再让它执行。

请帮我安装这个 Agent Skill:observability-stack-setup(可观测性堆栈设置)
来源仓库:https://github.com/adaptationio/skrillz
仓库路径:skills/observability-stack-setup
安装命令:
npx skills add https://github.com/adaptationio/skrillz --skill observability-stack-setup
安装前请先检查当前环境是否支持对应 CLI,并向我确认将要执行的命令、安装目录、联网范围和文件读写权限;确认后再执行。

命令行安装

复制命令到本机终端执行。不同来源提供的安装方式可能略有差异;本站展示可直接复制的安装命令,安装前请核对来源页面。

skills.shnpx skills
npx skills add https://github.com/adaptationio/skrillz --skill observability-stack-setup

简介

用于查找、检索和筛选可观测性堆栈设置相关信息,适合在 Codex、Claude、Cursor、Gemini CLI 中快速定位候选结果。

  • 适用于需要根据关键词或任务场景从来源线索中筛选相关信息的场景。
  • 通过 npx skills add 命令从指定 GitHub 仓库安装并使用。
  • 安装前建议确认权限范围和维护状态,注意可能触发联网或文件读写操作。
  • observability-stack-setup 属于研究检索类 Skill,可作为该场景下的辅助能力补充。

SKILL.md

Observability Stack Setup

Automated deployment of the complete LGTM (Loki, Grafana, Tempo, Mimir/Prometheus) + Alloy observability stack for Claude Code monitoring.

When to Use

  • Setting up Claude Code observability for the first time
  • Deploying local development observability infrastructure
  • Need to monitor Claude Code operations (tool calls, costs, errors, performance)
  • Want pre-configured dashboards for Claude Code analysis

What This Skill Does

Automatically deploys and configures:

  • Grafana Alloy: OTEL collector (receives telemetry from Claude Code)
  • Loki: Log aggregation (stores all Claude Code logs)
  • Tempo: Distributed tracing (tracks tool calls, API requests)
  • Prometheus: Metrics storage (token usage, costs, performance)
  • Grafana: Visualization with pre-built Claude Code dashboards

Quick Start

Prerequisites

# Verify Docker installed
docker --version  # Requires ≥ 20.10

# Verify Docker Compose installed
docker compose version  # Requires ≥ 2.0

Deploy Stack

Invoke this skill and it will:

  1. Create .observability/ directory structure
  2. Generate all configuration files
  3. Start the stack with docker compose up -d
  4. Import Claude Code dashboards
  5. Verify all services healthy
  6. Output access URLs and next steps

Estimated time: 5-10 minutes

What Gets Deployed

Services

ServicePortPurpose
Grafana3000Dashboards and visualization
Grafana Alloy4317 (gRPC), 4318 (HTTP), 12345 (metrics)OTLP receiver
Loki3100Log storage and querying
Tempo3200Trace storage and querying
Prometheus9090Metrics storage and querying

Volumes

All data persisted in .observability/volumes/:

  • alloy-data/ - Alloy configuration and state
  • loki-data/ - Log storage
  • tempo-data/ - Trace storage
  • prometheus-data/ - Metrics storage
  • grafana-data/ - Dashboards, datasources, settings

Pre-built Dashboards

  1. Claude Code Overview

- Session count, duration, active time - Token usage and cost trends - Error rates by tool - Top operations

  1. Tool Performance Matrix

- Call counts per tool - Average/P95/P99 latency - Success/failure rates - Most common errors

  1. Cost Analysis

- Daily/weekly/monthly costs - Token usage breakdown - Budget tracking - Cost projections

  1. Error Tracking

- Error timeline - Error types distribution - Affected tools - Recent error details

  1. Session Analysis

- Session duration distribution - Sessions per day/week - Conversation depth - Active vs idle time

Workflow

Step 1: Verify Prerequisites

Checks Docker and Docker Compose installed with compatible versions.

Step 2: Create Directory Structure

.observability/
├── docker-compose.yml          # Main stack definition
├── alloy/
│   └── config.yaml            # OTLP receiver + exporters config
├── grafana/
│   ├── datasources/
│   │   ├── loki.yml           # Loki datasource
│   │   ├── prometheus.yml     # Prometheus datasource
│   │   └── tempo.yml          # Tempo datasource
│   └── dashboards/
│       ├── claude-code-overview.json
│       ├── tool-performance.json
│       ├── cost-analysis.json
│       ├── error-tracking.json
│       └── session-analysis.json
└── volumes/                   # Persistent data
    ├── alloy/
    ├── loki/
    ├── tempo/
    ├── prometheus/
    └── grafana/

Step 3: Generate Configurations

Creates all configuration files from templates (see references/ for details).

Step 4: Start Stack

docker compose -f .observability/docker-compose.yml up -d

Step 5: Health Checks

Verifies each service:

  • Alloy: http://localhost:12345/metrics
  • Loki: http://localhost:3100/ready
  • Tempo: http://localhost:3200/ready
  • Prometheus: http://localhost:9090/-/healthy
  • Grafana: http://localhost:3000/api/health

Step 6: Import Dashboards

Uses Grafana API to import all pre-built dashboards.

Step 7: Output Success

Displays:

  • Access URLs for all services
  • Default credentials (admin/admin)
  • OTLP endpoint for Claude Code configuration
  • Next step: Enable Claude Code telemetry

Configuration Details

Grafana Alloy (OTLP Collector)

Receives telemetry from Claude Code via OTLP protocol:

  • gRPC endpoint: localhost:4317
  • HTTP endpoint: localhost:4318

Routes telemetry to backends:

  • Logs → Loki
  • Traces → Tempo
  • Metrics → Prometheus

Retention Policies

Default: 365 days (configurable in docker-compose.yml)

  • Loki: 365 days (-ingester.max-chunk-age=365d)
  • Tempo: 365 days (-storage.trace.local.path retention)
  • Prometheus: 365 days (--storage.tsdb.retention.time=365d)

Privacy Settings

Full logging enabled (no redactions):

  • User prompts: Full content logged
  • File paths: Complete paths visible
  • Tool execution: Full command details
  • API requests: All parameters visible

This configuration assumes observability for personal use with full data access.

Troubleshooting

Port Already in Use

If ports 3000, 3100, 3200, 4317, 4318, 9090, or 12345 are in use:

Option 1: Stop conflicting services

# Find process using port
sudo lsof -i :3000
# Stop the process
sudo kill <PID>

Option 2: Modify ports in docker-compose.yml

Services Not Starting

Check logs:

docker compose -f .observability/docker-compose.yml logs [service_name]

Common issues:

  • Insufficient disk space (check with df -h)
  • Insufficient memory (Alloy needs ~512MB, others ~256MB each)
  • Permission issues on volume directories

Dashboards Not Appearing

Manually import:

# Copy dashboard JSON to container
docker cp .observability/grafana/dashboards/claude-code-overview.json \
  observability-grafana-1:/tmp/

# Import via API
curl -X POST http://localhost:3000/api/dashboards/db \
  -H "Content-Type: application/json" \
  -u admin:admin \
  -d @.observability/grafana/dashboards/claude-code-overview.json

Next Steps

After stack is running:

  1. Enable Claude Code telemetry: Use claude-code-telemetry-enable skill
  2. Use Claude Code: Run tools, read files, execute commands
  3. View dashboards: Open http://localhost:3000, explore pre-built dashboards
  4. Verify data flowing: Check Grafana → Explore → Loki/Prometheus/Tempo

Stopping the Stack

Graceful shutdown (preserves data):

docker compose -f .observability/docker-compose.yml down

Complete removal (deletes data):

docker compose -f .observability/docker-compose.yml down -v

References

  • references/docker-compose-full.yml - Complete Docker Compose configuration
  • references/alloy-config.yaml - Grafana Alloy OTLP receiver configuration
  • references/grafana-datasources/ - Datasource YAML configurations
  • references/dashboards/ - Pre-built dashboard JSON files
  • references/troubleshooting.md - Common issues and solutions

Scripts

  • scripts/setup-stack.sh - Main setup script (automated deployment)
  • scripts/verify-health.sh - Health check all services
  • scripts/import-dashboards.sh - Import Grafana dashboards

Version Information

Component Versions (latest as of 2025-11-22):

  • Grafana: 11.5.2
  • Grafana Alloy: 1.5.0
  • Loki: 3.4.2
  • Tempo: 2.7.1
  • Prometheus: 2.55.0

All versions pinned in docker-compose.yml for reproducibility.

适合场景

01

用户想查找某类 Agent Skill 时

02

需要根据任务场景推荐可安装能力包时

03

需要对比不同来源的安装命令和来源信息时

04

需要参考平台分布和安装热度时

能力概览

能力 1

按任务关键词查找相关 Skills

能力 2

展示可复制的安装命令

能力 3

保留来源站点、仓库和原始说明,方便继续核验

能力 4

补充不同宿主或平台的使用分布数据

能力 5

展示第三方安全扫描或审计结果

安装后应在对应宿主中按原始 README 的触发条件使用;具体调用方式请以来源页面和 README 为准。

平台分布

github-copilot

30.71%
按下载量换算43

Claude Code

24.45%
按下载量换算34

mcpjam

18.03%
按下载量换算25

moltbot

11.18%
按下载量换算16

windsurf

7.51%
按下载量换算11

zencoder

3.7%
按下载量换算5

安全审计

Gen Agent Trust Hub

未通过

Socket

通过

Snyk

未通过

权限和风险

需要联网

该 Skill 可能需要联网访问来源站点、仓库或外部 API;具体网络访问范围需要结合源码和 README 复核。

安装前确认

本站仅展示第三方公开信息,不托管安装包,不提供自动安装或运行环境。安装前应自行审查源码、依赖和命令行为。来源安全扫描存在 warning/failed 结果,不能写成本站确认安全。

来源信息

继续浏览同类 Skills