Agent Skills › langwatch/langwatch

langwatch/langwatch

GitHub

用于协作式 UI 开发,启动可见的 Chromium 浏览器,通过快照和实时交互接收用户反馈,编辑代码并刷新验证 UI 修复效果。

28 skills 3,498

Install All Skills

npx skills add langwatch/langwatch --all -g -y
More Options

List skills in collection

npx skills add langwatch/langwatch --list

Skills in Collection (28)

用于协作式 UI 开发,启动可见的 Chromium 浏览器,通过快照和实时交互接收用户反馈,编辑代码并刷新验证 UI 修复效果。
用户要求 'browser pair' 或 'paired browser' 用户希望进行带实时视觉反馈的 UI 迭代
.claude/skills/browser-pair/SKILL.md
npx skills add langwatch/langwatch --skill browser-pair -g -y
通过Playwright驱动真实浏览器进行交互式功能验证。自动解析端口与特性,执行数据播种并生成检查清单,协调子代理完成UI交互测试及截图收集。
需要验证特定前端功能是否正常工作 需要进行无代码文件的交互式UI验收
.claude/skills/browser-test/SKILL.md
npx skills add langwatch/langwatch --skill browser-test -g -y
基于LangWatch代码规范对项目级代码变更进行自动化审查,涵盖ID生成、多租户隔离、Prisma查询、ClickHouse过滤、类型安全及分层架构等规则。
需要检查代码变更是否符合项目特定规范时 在PR或分支合并前执行代码质量门禁
.claude/skills/code-review/SKILL.md
npx skills add langwatch/langwatch --skill code-review -g -y
维护 LangWatch 功能地图,同步代码、API、文档及技能等入口,确保产品架构与信息一致。
添加新功能或 API 更新 MCP 工具或 CLI 命令 新增 Skill
.claude/skills/feature-map/SKILL.md
npx skills add langwatch/langwatch --skill feature-map -g -y
用于启动 LangWatch 本地开发环境,包含代理/CA配置、复用现有数据库及处理 WSL2/DNS 等常见故障的运行手册。
用户请求启动本地开发环境 需要排查开发环境连接或启动失败问题
.claude/skills/haven-setup/SKILL.md
npx skills add langwatch/langwatch --skill haven-setup -g -y
管理LangWatch GitHub项目看板,支持同步状态、查看个人任务、查找停滞项、移动和分配Issue。
同步看板状态 查看个人待办 查找停滞任务 移动Issue状态 分配Issue
.claude/skills/langwatch-kanban/SKILL.md
npx skills add langwatch/langwatch --skill langwatch-kanban -g -y
通过 langwatch CLI 查询 LLM 生产环境中的追踪记录、会话及模型调用详情,用于调试失败或缓慢的 LLM 运行,以及验证编码活动是否被正确捕获。
调试失败的 LLM 运行 排查缓慢的 LLM 响应 按 ID 查找追踪记录或会话 检查编码会话活动是否被捕获
plugins/langwatch/skills/langwatch/SKILL.md
npx skills add langwatch/langwatch --skill langwatch -g -y
代表用户操作 GitHub,完成克隆、分支、提交、推送并创建真实 Pull Request。自动处理 Git 配置与 Token 安全,确保 PR 以用户身份提交,适用于修复代码或提交补丁场景。
用户要求打开 PR 修复仓库问题并提交 发送补丁 在 GitHub 上落地代码变更
services/langy-agent/skills/github/SKILL.md
npx skills add langwatch/langwatch --skill github -g -y
作为AI工程顾问,审计Agent代码、追踪及评估体系,对比最佳实践发现差距。优先修复可观测性、提示词管理等基础问题,并指导深入优化,提升Agent工程质量。
希望提升Agent开发质量 需要全面审计Agent工程实践 寻求最佳实践改进建议
skills/_compiled/native/agent-best-practices/SKILL.md
npx skills add langwatch/langwatch --skill agent-best-practices -g -y
通过 LangWatch 分析 AI Agent 生产环境的流量、追踪和成本,诊断失败模式与用户不满,生成关联真实案例的 HTML 报告。
需要分析 AI Agent 在生产环境中的实际行为表现 排查 Agent 运行时的错误、性能瓶颈或异常用例
skills/_compiled/native/agent-performance/SKILL.md
npx skills add langwatch/langwatch --skill agent-performance -g -y
将AI Agent接入LangWatch平台,配置HTTP端点、认证及W3C追踪头,注册CLI并运行模拟测试套件,以验证Agent行为。
用户希望使用LangWatch平台对已部署的Agent进行场景化测试 需要连接代码库中的AI Agent到LangWatch仿真环境
skills/_compiled/native/connect-agent/SKILL.md
npx skills add langwatch/langwatch --skill connect-agent -g -y
通过分析代码库、提示词和生产数据,生成与真实用户行为高度一致的合成评估数据集。采用交互式顾问模式,经澄清、计划确认和预览后交付完整数据集至 LangWatch。
用户要求生成用于评估或测试的数据集 用户需要构建基准测试数据
skills/_compiled/native/datasets/SKILL.md
npx skills add langwatch/langwatch --skill datasets -g -y
使用 LangWatch CLI 检查生产环境追踪数据,识别缺失输入输出、断连跨度及元数据等问题,优化可观测性配置。
追踪数据不完整或为空 需要排查链路断开问题 检查元数据标签缺失
skills/_compiled/native/debug-instrumentation/SKILL.md
npx skills add langwatch/langwatch --skill debug-instrumentation -g -y
基于 LangWatch 定位生产环境 Agent 运行故障。通过检查错误追踪、分析 Span、评估分数,逐步缩小范围以找到根本原因,适用于处理报错、响应错误或延迟飙升等问题。
生产环境出现错误 Agent 行为异常 响应延迟激增
skills/_compiled/native/debug-with-langwatch/SKILL.md
npx skills add langwatch/langwatch --skill debug-with-langwatch -g -y
用于调查 LangWatch 实验失败及评估回归问题,通过 CLI 命令定位具体失败行、评估器得分及根本原因。
实验运行失败 评估分数下降 评估结果回归
skills/_compiled/native/eval-triage/SKILL.md
npx skills add langwatch/langwatch --skill eval-triage -g -y
评估处理图像、音频或文档等多模态输入的AI代理。通过LangWatch LLM-as-judge及专用模式,验证多模态输入下的输出质量与提取准确性。
需要评估处理非文本输入(如图片、音频、PDF)的AI代理 设置多模态测试场景和文档解析评估
skills/_compiled/native/evaluate-multimodal/SKILL.md
npx skills add langwatch/langwatch --skill evaluate-multimodal -g -y
LangWatch评估请求的路由技能,用于区分预部署实验与生产在线评估。通过意图分类将请求转发至对应子技能,若歧义则引导用户选择。
用户请求进行模型或提示词评估但未明确是离线测试还是线上监控 涉及LangWatch评估工作流的初始化或分发
skills/_compiled/native/evaluations/SKILL.md
npx skills add langwatch/langwatch --skill evaluations -g -y
用于在部署前对 Agent 进行批量测试,支持提示词或模型对比、基准测试及回归检测。通过构建数据集和评估器运行实验,生成 CI 质量门禁,旨在验证效果并发现潜在问题,不用于生产环境监控。
用户希望测试 Agent 性能或准确性 需要对比不同提示词或模型的效果 执行回归测试以检测质量退化 为 CI/CD 流程配置质量门禁
skills/_compiled/native/experiments/SKILL.md
npx skills add langwatch/langwatch --skill experiments -g -y
分析RAG知识库内容,生成包含多种题型(事实、推理、边界等)的合成评估数据集。支持导出为CSV或DataFrame格式,用于LangWatch平台导入及测试数据准备,确保答案与上下文一致且覆盖全面。
需要为RAG管道生成测试数据 准备LangWatch实验所需的评估数据集 构建RAG系统的合成问答对
skills/_compiled/native/generate-rag-dataset/SKILL.md
npx skills add langwatch/langwatch --skill generate-rag-dataset -g -y
自动克隆仓库、创建分支、提交代码并推送,最终在 GitHub 上以 LangWatch app 名义发起 Pull Request。适用于用户请求修复代码、发送补丁或提交 PR 的场景。
用户要求打开 PR 修复仓库中的问题并提交 发送补丁 提出拉取请求
skills/_compiled/native/github/SKILL.md
npx skills add langwatch/langwatch --skill github -g -y
集成 LangWatch 实现 AI Agent 的全链路可观测性,包括追踪、提示词版本管理、评估实验及模拟测试。
需要为 Agent 添加完整监控和追踪功能 需要进行提示词版本管理和评估实验 需要运行 Agent 模拟测试
skills/_compiled/native/level-up/SKILL.md
npx skills add langwatch/langwatch --skill level-up -g -y
配置 LangWatch 线上评估与护栏,用于生产流量监控、实时评分及同步拦截不安全请求。专用于在线场景,不适用于批量测试实验。
用户需要对生产环境的实时轨迹或线程进行持续质量评分 用户需要设置同步护栏以拦截违规内容或执行策略
skills/_compiled/native/online-evaluations/SKILL.md
npx skills add langwatch/langwatch --skill online-evaluations -g -y
使用 LangWatch CLI 对 Agent 提示词进行版本管理。支持全量扫描硬编码提示词并接入 CLI,或针对特定提示词创建新版本,集成 Python/TypeScript 代码,处理免费计划限制及文档查阅。
需要为整个代码库设置提示词版本控制 需要对特定提示词进行版本化或更新
skills/_compiled/native/prompts/SKILL.md
npx skills add langwatch/langwatch --skill prompts -g -y
用于通过模拟场景测试AI代理,支持代码SDK和CLI平台方式。涵盖多轮对话、边缘情况测试及红队安全对抗,自动检测上下文选择方案并执行验证。
测试AI代理行为 编写场景测试代码 进行红队安全测试 语音代理测试
skills/_compiled/native/scenarios/SKILL.md
npx skills add langwatch/langwatch --skill scenarios -g -y
配置和故障排除 LangWatch CLI,涵盖云与自托管实例的认证、端点设置及项目连接问题。
CLI 未认证成功 无法连接到 LangWatch 服务 CLI 连接到错误的项目 需要配置 CI/CD 环境变量
skills/_compiled/native/setup-lw/SKILL.md
npx skills add langwatch/langwatch --skill setup-lw -g -y
用于编写CLI工具的Agent可用性测试,验证命令是否支持非交互运行、输出可解析且错误提示清晰,确保AI代理能顺利发现和使用工具。
需要验证CLI工具对AI代理的友好性 编写CLI的非交互式场景测试 检查CLI是否存在阻塞代理的交互提示
skills/_compiled/native/test-cli-usability/SKILL.md
npx skills add langwatch/langwatch --skill test-cli-usability -g -y
用于验证AI智能体在医疗、金融和法律等受监管领域是否保持观察性而非提供处方建议。通过创建边界场景测试和红队对抗测试,确保智能体遵守合规限制并提供适当免责声明。
需要测试AI智能体的合规性和边界控制 验证智能体在受监管领域(如医疗、金融、法律)中不越权提供建议 进行红队对抗测试以检测智能体的潜在风险行为
skills/_compiled/native/test-compliance/SKILL.md
npx skills add langwatch/langwatch --skill test-compliance -g -y
为代码添加 LangWatch 追踪和可观测性,支持 Python 和 TypeScript。涵盖全量代码库接入或针对特定函数/模块的定向操作,指导用户阅读文档并正确配置 instrumentation。
需要为代码库添加追踪功能 请求对特定函数或模块进行可观测性监控
skills/_compiled/native/tracing/SKILL.md
npx skills add langwatch/langwatch --skill tracing -g -y

inicio - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-08-22 04:08
浙ICP备14020137号-1 $mapa de visitantes$