12 packages found
A Claude Code skill that adds a rubric-based eval layer to any agent project. Framework-agnostic — generates rubric, tes
达尔文.skill —— 一个让你的Skill无限进化的系统:评估→改进→测试→保留或回滚 | Autoresearch-inspired autonomous skill optimization for Claude Code. Eva
Claude Code skills for medical research — literature search, reporting guidelines, statistical analysis, publication fig
Turn ad-hoc Claude Code / Codex / Cursor sessions into a repeatable loop — research → plan → wave-execute → close. Paral
三竞赛 (CUMCM/MCM/电工杯) 数学建模 skill — harness-agnostic, 同时支持 Claude Code 与 Codex CLI, 全程问答式 (Friendly Mode), 10 阶段 + 4 反馈层 +
CI for Claude Skills — lint, eval, and regression-test SKILL.md files across a model matrix, with a self-growing eval lo
Diff your AI agent's behavior between two runs. See exactly which tool calls, args, costs and outputs changed when you s
Evaluate & benchmark AI coding agents and Claude Code skills — sandboxed, reproducible YAML eval suites for Claude Code,
Depth-first lead finder for a pentest/bug-bounty offering: a FastMCP server (Prospeo contact resolution + lead store) dr
MCP server for Brightspace (D2L). Check grades, due dates, assignments, announcements, rosters, syllabus & course conten
A battle-tested skill for managing a professional LinkedIn profile autonomously using Claude AI. 21 automations, 12+ wee
33 battle-tested skills + minimal .claude harness for any coding agent (Claude Code, Cursor, Codex, Gemini CLI).