AgentStack
Browse Sign in
Browse Why AgentStack Sell Docs
Sign in
SKILL verified MIT Self-run

Exp Heuristic Evaluation

skill-guofu-shiqu-ux-expert-skills-exp-heuristic-evaluation · by guofu-shiqu

启发式评估。当需要基于业界成熟的可用性启发式原则,系统性评估产品可用性问题时调用。

No reviews yet
0 installs
28 views
0.0% view→install

Install

$ agentstack add skill-guofu-shiqu-ux-expert-skills-exp-heuristic-evaluation

✓ scanned · ✓ verified, works with Claude Code, Cursor, and more.

Security review

✓ Passed

No issues found. Passed automated security review. · v0.1.0 How review works →

  • Prompt-injection patterns
  • Secret / credential exfiltration
  • Dangerous shell & filesystem operations
  • Untrusted network calls
  • Known-malicious package signatures

What it can access

  • Network access No
  • Filesystem access No
  • Shell / process execution No
  • Environment & secrets No
  • Dynamic code execution No

From automated source analysis of v0.1.0. “Used” means the capability is present in the source — more access means more to trust, not that it’s unsafe.

View the full security report →

Verified badge

Passed review? Show it. Paste this badge into your README, it links to the public security report.

AgentStack Verified badge Links to your public security report.
[![AgentStack Verified](https://agentstack.voostack.com/badges/verified.svg)](https://agentstack.voostack.com/security/report/skill-guofu-shiqu-ux-expert-skills-exp-heuristic-evaluation)

Reliability & compatibility

Security review passed
0 installs to date
no reviews yet
3mo ago

Declared compatibility

Claude CodeClaude Desktop

Compatibility is declared by the source manifest. End-to-end runtime verification is coming, see below.

Preview Execution monitoring

We're building live execution health for every listing: tool-call success rate, median latency, uptime, and last-checked timestamps, measured, not self-reported. It isn't live yet, so we don't show numbers we can't stand behind.

How agent discovery & health will work →
Are you the author of Exp Heuristic Evaluation? Claim this listing to set pricing, connect Stripe payouts, and keep 70% of every sale.
Sign up to claim

About

启发式评估

基于 Nielsen 十大可用性原则、Shneiderman 八大黄金法则等业界成熟框架,系统性评估产品可用性,快速发现体验问题。

触发条件

  • 需要快速评估产品可用性
  • 专家资源有限,需要成本较低的评估方法
  • 需要在用户测试前快速发现明显问题
  • 需要建立标准化的可用性检查清单
  • 需要向团队传达明确的可用性问题

核心能力

1. 评估框架选择

根据产品类型和评估目标,选择合适的启发式框架:

| 框架 | 原则数量 | 适用场景 | 特点 | |------|---------|---------|------| | Nielsen 十大原则 | 10 | 通用产品 | 最经典、最广泛认可 | | Shneiderman 八大法则 | 8 | 交互界面 | 侧重交互设计 | | ISO 9241-110 | 7 | 专业/工业软件 | 国际标准 | | 移动端启发式 | 10+ | App/移动端 | 考虑移动特性 | | 无障碍启发式 | 符合 WCAG | 无障碍产品 | 考虑障碍用户 | | 自定义框架 | 按需 | 特定领域 | 结合行业特点 |

Nielsen 十大原则速查:

  1. 系统状态可见性 — 用户应随时知道系统正在做什么
  2. 系统与真实世界的匹配 — 使用用户语言而非系统语言
  3. 用户控制与自由 — 提供"紧急出口"(撤销、返回)
  4. 一致性与标准 — 遵循平台规范和内部一致性
  5. 防错 — 比良好的错误提示更好的是防止错误发生
  6. 识别而非回忆 — 让用户看到选项而非记住信息
  7. 使用的灵活性与效率 — 为新手和专家都提供路径
  8. 美观与极简设计 — 对话不应包含无关或低频信息
  9. 帮助用户识别、诊断并从错误中恢复 — 错误信息应说清问题并提供解决方案
  10. 帮助与文档 — 即使系统不需要文档,也应提供

2. 评估执行流程

  1. 准备阶段 — 明确评估范围、选择启发式框架、准备评估清单
  2. 独立评估 — 评估者独立走查,记录发现的问题
  3. 问题记录 — 为每个问题标注违反的原则、严重程度、影响范围
  4. 汇总会议 — 多名评估者汇总发现,去重和优先级排序
  5. 报告输出 — 输出结构化的评估报告

3. 问题记录格式

每个发现的问题应包含:

  • 违反的原则 — 违反了哪条启发式原则
  • 问题描述 — 具体描述问题
  • 严重程度 — 0-4 分(0=无,4=致命)
  • 影响范围 — 影响哪些用户/场景
  • 修复建议 — 如何修复

4. 评估者数量建议

| 评估者数量 | 发现问题覆盖率 | 说明 | |------------|-----------|------| | 1 名 | ~35% | 快速初评,易漏问题 | | 3-5 名 | ~75% | 性价比最高 | | 5+ 名 | >75% | 边际收益递减 |

建议 ≥3 名评估者,且评估者应包含:UX 专家、领域专家、新手用户。

输出格式:启发式评估报告

【启发式评估报告】

▸ 评估概况:
  评估范围:[...]
  评估框架:[Nielsen / Shneiderman / ISO / 自定义]
  评估者:[X 名],背景:[UX专家/领域专家/新手]
  评估时间:[...]

━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━

▸ 一、问题总览

  严重程度 │ 问题数 │ 占比
  ─────────┼────────┼──────
  4-致命    │   X    │ XX%
  3-严重    │   X    │ XX%
  2-一般    │   X    │ XX%
  1-轻微    │   X    │ XX%
  0-提示    │   X    │ XX%
  ─────────┼────────┼──────
  合计       │   X    │ 100%

  未违反原则:[...]
  高频违反原则:[...]

━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━

▸ 二、问题清单(按严重程度排序)

  问题 #[X]  [严重程度:X/4]
  ─────────────────────────────
  违反原则:[原则名称]
  问题描述:[...]
  发生位置:[页面/流程/功能]
  影响范围:[影响哪些用户/场景]
  截图/描述:[...]
  修复建议:[...]
  修复成本:[高/中/低]
  优先级:[P0/P1/P2/P3]

  问题 #[X] [...]

━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━

▸ 三、按原则汇总

  原则1:系统状态可见性
    违反次数:[X]
    主要问题:[...]
    修复建议:[...]

  原则2:系统与真实世界的匹配
  ...

━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━

▸ 四、快速修复清单(P0 + P1)

  1. [问题],修复:[...],预计:[X天]
  2. [...]

━━━━━━━━━━━━━━━━━━━━━━━━━━━━━━

▸ 五、附加评估

  整体可用性评分:[X/100](基于问题数量和严重程度估算)
  主要优势:[...]
  主要短板:[...]
  建议下一步:[用户测试 / 专家评审 / 直接修复]

使用方法

当需要快速评估产品可用性时调用本 skill。评估结果可与可用性测试、认知心理学分析等 skill 衔接,将发现的可用性问题转化为深层的体验优化策略。

Source & license

This open-source skill is cataloged on AgentStack and links to its original source — we do not rehost the code.

Install and usage instructions live in the source repository linked above.

Reviews

No reviews yet, be the first.

Versions

  • v0.1.0 Imported from the upstream source.