Agent Skills › langwatch/langwatch

langwatch/langwatch

GitHub

提供协作式有头浏览器会话,用于UI开发。通过Playwright启动可见的Chromium,处理认证后与用户实时交互,根据视觉反馈修改代码并即时验证修复效果,实现UI结对编程。

37 skills 4,883

Install All Skills

npx skills add langwatch/langwatch --all -g -y
More Options

List skills in collection

npx skills add langwatch/langwatch --list

Skills in Collection (37)

提供协作式有头浏览器会话,用于UI开发。通过Playwright启动可见的Chromium,处理认证后与用户实时交互,根据视觉反馈修改代码并即时验证修复效果,实现UI结对编程。
用户说'browser pair' 用户说'paired browser' 用户说'let's look at this together' 用户说'open chromium' 需要带实时视觉反馈的UI迭代
.claude/skills/browser-pair/SKILL.md
npx skills add langwatch/langwatch --skill browser-pair -g -y
通过Playwright驱动真实浏览器进行交互式功能验证的编排技能。自动解析端口与特性描述,生成数据准备清单,并调度子代理执行UI测试与截图收集,无需编写传统测试文件。
需要验证前端功能是否正常 提供Feature文件或自然语言描述进行测试 运行默认冒烟测试
.claude/skills/browser-test/SKILL.md
npx skills add langwatch/langwatch --skill browser-test -g -y
针对项目代码变更执行规则检查,涵盖标识符、多租户、分层架构、命名及单一职责等规范。自动比对分支或PR差异,逐项判定通过或失败并列出具体违规位置。
需要审查代码变更是否符合项目规范 在PR流程中检查代码质量与架构合规性
.claude/skills/code-review/SKILL.md
npx skills add langwatch/langwatch --skill code-review -g -y
维护 LangWatch 功能地图文件,确保新功能、API、CLI 命令和技能的注册表与代码实现保持同步。
添加新平台功能 更新 API 或 MCP 工具 新增 CLI 命令或技能
.claude/skills/feature-map/SKILL.md
npx skills add langwatch/langwatch --skill feature-map -g -y
提供LangWatch本地开发环境的启动与故障排查指南,涵盖代理配置、CA信任、现有服务复用及WSL2等环境下的常见陷阱处理。
启动本地开发环境 解决开发栈连接或DNS问题
.claude/skills/haven-setup/SKILL.md
npx skills add langwatch/langwatch --skill haven-setup -g -y
管理LangWatch GitHub项目看板,支持同步状态、查看个人任务、识别停滞项及移动/分配Issue,通过GraphQL API实现自动化维护。
需要同步GitHub项目看板状态与实际Issue状态一致时 需要查看当前用户被分配的任务列表并按状态分组时 需要查找长时间未更新或可能被遗忘的停滞Issue时 需要将某个Issue移动到看板的不同状态列时 需要将Issue分配给当前用户并添加到看板上时
.claude/skills/langwatch-kanban/SKILL.md
npx skills add langwatch/langwatch --skill langwatch-kanban -g -y
通过 LangWatch CLI 读取 LLM 生产环境追踪数据,支持按 ID 查询会话、查看 Agent 执行转录及调试慢速或失败调用,辅助代码审查与问题排查。
调试失败的 LLM 运行 检查 LLM 调用性能 按 ID 查找特定追踪记录 验证编码会话活动是否被捕获
plugins/langwatch/skills/langwatch/SKILL.md
npx skills add langwatch/langwatch --skill langwatch -g -y
代表用户操作 GitHub,完成克隆、分支、提交、推送并创建真实 Pull Request。自动处理 Git 配置与 Token 安全,确保 PR 以用户身份提交,适用于修复代码或提交补丁场景。
用户要求打开 PR 修复仓库问题并提交 发送补丁 在 GitHub 上落地代码变更
services/langy-agent/skills/github/SKILL.md
npx skills add langwatch/langwatch --skill github -g -y
作为AI工程顾问,审计Agent代码库、追踪和评估,对比最佳实践以发现差距并提供从快速修复到深度优化的指导。
需要提升Agent工程质量时 请求对Agent进行全面审计或优化建议时
skills/_compiled/native/agent-best-practices/SKILL.md
npx skills add langwatch/langwatch --skill agent-best-practices -g -y
用于深度诊断AI智能体在生产环境中的行为表现,通过LangWatch分析流量、追踪失败模式、成本热点及异常,生成包含真实轨迹链接的HTML报告。
需要分析AI Agent生产环境的运行状况 排查Agent失败模式或用户不满原因 监控Token成本和延迟变化 生成生产环境行为分析报告
skills/_compiled/native/agent-performance/SKILL.md
npx skills add langwatch/langwatch --skill agent-performance -g -y
协助用户修改本地或GitHub代码,通过code_access获取权限后执行读写操作,创建分支和PR。适用于SDK接入、修复Agent逻辑等需直接变更源码的场景,平台配置类任务不触发此技能。
需要修改用户本地或远程仓库中的源代码文件 请求涉及SDK接入、链路追踪植入、Agent行为修复或参数添加
skills/_compiled/native/code-changes/SKILL.md
npx skills add langwatch/langwatch --skill code-changes -g -y
分析 LangWatch 编码代理会话数据,通过计算缓存重建、压缩及单次调用成本等指标,确定上下文大小在何时不再划算。旨在优化上下文管理,降低长会话的昂贵开销并提升效率。
编码代理会话成本过高 长上下文导致性能下降 需要优化上下文大小
skills/_compiled/native/context-sweet-spot/SKILL.md
npx skills add langwatch/langwatch --skill context-sweet-spot -g -y
根据自然语言问题自动生成包含 LangWatchQL 查询的 React 仪表盘组件。涵盖发现数据模式、编写查询与组件代码、保存并验证渲染全流程,适用于构建自定义可视化图表或迭代现有 widget。
需要构建自定义仪表盘组件 将自然语言问题转化为可视化图表 需要超出标准图表能力的复杂布局或逻辑
skills/_compiled/native/dashboard-widgets/SKILL.md
npx skills add langwatch/langwatch --skill dashboard-widgets -g -y
通过分析代码库、提示词和线上数据,生成与真实生产流量高度一致的评估数据集。采用交互式流程,先探索上下文,再制定计划并预览样本,最终生成高质量CSV并上传至LangWatch。
用户要求生成用于评估或测试的数据集 用户请求构建基准测试数据
skills/_compiled/native/datasets/SKILL.md
npx skills add langwatch/langwatch --skill datasets -g -y
使用 LangWatch CLI 检查生产环境追踪数据,识别输入输出缺失、断连跨度及元数据遗漏等遥测配置问题,并提供修复与验证方案。
追踪数据不完整或为空 排查链路断连或缺失标签 优化遥测仪器配置
skills/_compiled/native/debug-instrumentation/SKILL.md
npx skills add langwatch/langwatch --skill debug-instrumentation -g -y
利用 LangWatch CLI 对生产环境中的 Agent 运行故障进行根因分析。通过定位错误 Trace、检查 Span 细节及评估分数,逐步缩小问题范围并诊断失败原因。
生产环境 Agent 报错或异常 Agent 回答质量差 出现延迟 spikes
skills/_compiled/native/debug-with-langwatch/SKILL.md
npx skills add langwatch/langwatch --skill debug-with-langwatch -g -y
通过UI命令驱动用户当前页面,执行操作并读取实时状态。支持区分浏览器端与后端执行结果,确保反馈准确,适用于评估工作台等场景的交互式自动化操作。
需要直接操作用户当前打开的页面 需要在用户界面中执行动作并展示结果 处理带有未保存编辑的工作台状态
skills/_compiled/native/drive-the-ui/SKILL.md
npx skills add langwatch/langwatch --skill drive-the-ui -g -y
使用 LangWatch 排查实验失败和评估回归,定位具体行、评分器及根因。适用于实验报错、分数下降或评估退化场景。
实验运行失败 评估分数下降 评估结果退化
skills/_compiled/native/eval-triage/SKILL.md
npx skills add langwatch/langwatch --skill eval-triage -g -y
提供多模态AI代理(处理图像、音频、PDF等)的评估方案。通过LangWatch LLM-as-judge和Scenario测试模式,指导用户按模态设置评测流程、生成测试数据并验证输出质量。
需要评估处理非文本输入的AI代理 配置多模态数据的测试与验证 使用LangWatch进行LLM作为裁判的评测
skills/_compiled/native/evaluate-multimodal/SKILL.md
npx skills add langwatch/langwatch --skill evaluate-multimodal -g -y
LangWatch评估请求的路由技能,用于区分预部署实验与生产在线评估。根据用户意图将其路由至experiments或online-evaluations技能,若意图不明则通过提问澄清,不直接执行评估逻辑。
用户提出评估需求但意图不明确 需要区分批量测试与线上监控场景
skills/_compiled/native/evaluations/SKILL.md
npx skills add langwatch/langwatch --skill evaluations -g -y
用于 Agent 预部署前的批量测试,支持提示词/模型对比、回归测试、基准评估及 CI 质量门禁。通过构建领域数据集和运行实验来检测回归并推荐改进,不适用于生产监控或护栏配置。
测试 Agent 性能或行为 比较不同 Prompt 或模型效果 进行回归测试以检测代码变更影响 建立 CI/CD 中的自动化质量门禁
skills/_compiled/native/experiments/SKILL.md
npx skills add langwatch/langwatch --skill experiments -g -y
用于在 Trace Explorer 中查找匹配用户描述(如错误、用户或标签)的追踪记录。将概念转化为过滤器,返回计数和结果卡片,支持直接在页面搜索或驱动界面过滤。
查找特定条件的追踪记录 筛选用户行为或错误日志 基于概念生成追踪查询
skills/_compiled/native/find-traces/SKILL.md
npx skills add langwatch/langwatch --skill find-traces -g -y
分析RAG知识库内容,生成包含事实、推理、对比及边缘案例的多样化问答评估数据集。支持导出为CSV或DataFrame格式,用于LangWatch平台导入及检索质量验证,确保测试数据覆盖全面且无幻觉。
需要为RAG系统生成测试数据 准备LangWatch实验数据集 评估RAG管道性能
skills/_compiled/native/generate-rag-dataset/SKILL.md
npx skills add langwatch/langwatch --skill generate-rag-dataset -g -y
自动化执行GitHub PR流程,包括克隆仓库、分支提交、推送代码并创建PR。适用于用户请求修复代码或提交补丁的场景。
用户要求打开Pull Request 需要修复仓库中的问题并提交
skills/_compiled/native/github/SKILL.md
npx skills add langwatch/langwatch --skill github -g -y
处理用户注册后引导式入门流程,根据用户选择的路径(LLM Ops、编码代理等)在面板内完成配置设置。
Guided onboarding kickoff Let's set up ... then.
skills/_compiled/native/guided-onboarding/SKILL.md
npx skills add langwatch/langwatch --skill guided-onboarding -g -y
集成LangWatch为AI Agent提供全链路可观测性,涵盖追踪、提示词版本管理、评估实验及模拟测试。指导用户处理免费计划限制,并遵循顾问模式逐步优化代码与测试策略。
需要为Agent添加追踪和监控 希望进行提示词版本管理和评估 想要运行Agent模拟测试
skills/_compiled/native/level-up/SKILL.md
npx skills add langwatch/langwatch --skill level-up -g -y
将自然语言查询转换为可保存并自动更新的仪表盘图表。流程包括发现LangWatchQL数据schema、编写含保留参数的SQL、生成Vega-Lite规范并保存,最后通过运行测试验证结果后放置到目标位置。
用户请求构建或创建新的分析图表 用户要求将指标或图表保存到仪表盘
skills/_compiled/native/lwql-charts/SKILL.md
npx skills add langwatch/langwatch --skill lwql-charts -g -y
配置LangWatch在线评估与护栏,用于生产环境流量监控、质量评分及安全拦截。指导用户区分异步评估与同步护栏场景,处理免费计划限制,并管理CLI配置,避免用于批量实验。
配置生产流量在线评估 设置同步安全护栏 监控线上请求质量 拦截不安全请求或响应
skills/_compiled/native/online-evaluations/SKILL.md
npx skills add langwatch/langwatch --skill online-evaluations -g -y
自动化优化提示词的技能,通过基线评分、假设生成、编辑运行和对比分析闭环提升效果。适用于需改进提示词或提升机器人回答质量的场景。
用户要求优化或改进提示词 从工作台菜单触发优化 希望提升机器人回答质量
skills/_compiled/native/prompt-optimization/SKILL.md
npx skills add langwatch/langwatch --skill prompt-optimization -g -y
管理Agent提示词版本,支持全量扫描硬编码提示词或针对特定提示词进行版本控制。指导用户初始化LangWatch CLI、创建托管提示词并更新代码调用方式,同时处理免费计划限制问题。
设置项目提示词版本管理 为特定提示词创建新版本 将硬编码提示词迁移至LangWatch管理
skills/_compiled/native/prompts/SKILL.md
npx skills add langwatch/langwatch --skill prompts -g -y
基于真实使用数据对比不同模型提供商成本,考虑缓存命中率。涉及CLI配置、数据导出与分析,用于评估实际节省金额。
询问是否切换更便宜的模型或提供商能省钱 需要基于实际用量进行成本效益分析
skills/_compiled/native/provider-cost-comparison/SKILL.md
npx skills add langwatch/langwatch --skill provider-cost-comparison -g -y
配置 LangWatch CLI 认证与环境,涵盖本地登录、CI/CD 环境变量注入及自托管端点设置,解决连接与项目选择问题。
LangWatch CLI 未认证或登录失败 需要配置 CI/CD 中的 LangWatch 环境变量 CLI 连接到错误的端点或项目
skills/_compiled/native/setup-lw/SKILL.md
npx skills add langwatch/langwatch --skill setup-lw -g -y
验证CLI工具对AI代理的可用性,确保非交互运行、输出清晰及错误可恢复。通过场景测试防止挂起,提升Agent友好性。
编写CLI工具的自动化测试 验证CLI是否支持非交互式操作 检查CLI命令对AI代理的兼容性
skills/_compiled/native/test-cli-usability/SKILL.md
npx skills add langwatch/langwatch --skill test-cli-usability -g -y
用于测试AI代理在医疗、金融和法律等受监管领域的合规性,确保其仅提供信息而不提供处方或诊断。通过创建边界场景和对抗性红队测试来验证代理行为。
需要验证AI代理在受监管领域是否遵守合规边界 希望测试AI代理在面对用户压力时是否能保持非处方角色
skills/_compiled/native/test-compliance/SKILL.md
npx skills add langwatch/langwatch --skill test-compliance -g -y
为代码添加 LangWatch 追踪与可观测性。支持 Python 和 TypeScript,涵盖全量接入或特定模块的埋点。指导读取框架文档、安装 SDK 并正确注入追踪逻辑。
需要为代码添加追踪功能 设置应用可观测性 在特定函数或模块中集成 LangWatch
skills/_compiled/native/tracing/SKILL.md
npx skills add langwatch/langwatch --skill tracing -g -y
将代码库中的AI代理连接至LangWatch平台,以便在真实代理进程上运行测试套件。通过安装SDK、添加连接函数并启动服务,实现代理注册与在线验证,支持Python和TypeScript,并提供HTTP降级方案。
需要在真实代理上运行测试 集成LangWatch仿真平台 配置代理与监控平台连接
skills/_compiled/native/connect-agent/SKILL.md
npx skills add langwatch/langwatch --skill connect-agent -g -y
用于 AI Agent 的场景化测试与红队演练。支持通过 SDK 编写代码测试或利用 CLI 创建平台场景,涵盖用户模拟、多轮对话及对抗性安全测试,自动检测上下文并执行验证。
需要测试 AI Agent 的行为或覆盖率 进行红队演练以发现安全漏洞 验证 Agent 的多轮对话逻辑
skills/_compiled/native/scenarios/SKILL.md
npx skills add langwatch/langwatch --skill scenarios -g -y
Dependencies: langwatch/skills/connect-agent

ホーム - Wiki
Copyright © 2011-2026 iteam. Current version is 2.155.2. UTC+08:00, 2026-10-02 06:15
浙ICP备14020137号-1