LLM生成システムの検証設計スキル。assay-kitフレームワークを活用し、LLM特有の失敗モード(幻覚、例への過学習、部分的処理)を考慮した総合的なテストケース設計を支援する。使用タイミング:- LLMベースのワークフロー/エージェントの評価設計時- ゴールデンデータセット(golden-dataset.yaml)の設計・拡張時- 既存テストが特定パターンに過学習していないか検証時- LLM出
caphtech-plugin/skills/llm-eval-designer
Guide for performing Chromium version upgrades in the Electron project. Use when working on the roller/chromium/main bra...
指导Claude按照二哥的风格撰写求职类文章,包括公司薪资爆料、年终奖盘点、求职攻略、offer选择建议等内容。
The chat will provide safety guides, equipment suggestions, reviews, and techniques, with context-driven summary and mul...