SKILL·399CDA

exploration-strategies

mattnigh
Aktualisiert 2 months ago
12 Ansichten
22
1
22
Auf GitHub ansehen
Anderegeneral

Über

Diese Fähigkeit unterstützt Entwickler bei der Implementierung und Fehlerbehebung von Explorationsstrategien für Reinforcement-Learning-Agenten, die mit spärlichen Belohnungen oder großen Zustandsräumen konfrontiert sind. Sie behandelt wichtige Methoden wie ε-greedy, UCB und neugiergetriebene Ansätze wie RND für intrinsische Motivation. Nutzen Sie sie, wenn ein Agent in lokalen Optima feststeckt oder wenn Sie eine geeignete Explorationstechnik auswählen und anpassen müssen.

Schnellinstallation

Claude Code

Empfohlen
Primär
npx skills add mattnigh/skills_collection -a claude-code
Plugin-BefehlAlternativ
/plugin add https://github.com/mattnigh/skills_collection
Git CloneAlternativ
git clone https://github.com/mattnigh/skills_collection.git ~/.claude/skills/exploration-strategies

Kopieren Sie diesen Befehl und fügen Sie ihn in Claude Code ein, um diese Fähigkeit zu installieren

GitHub Repository

mattnigh/skills_collection
Pfad: collection/tachyon-beep__hamlet__claude__skills__yzmir-deep-rl__skills__exploration-strategies__SKILL.md
0
FAQ

Häufig gestellte Fragen

Was ist der Skill exploration-strategies?

exploration-strategies ist ein Claude Skill von mattnigh. Skills bündeln Anweisungen und Ressourcen, die Claude bei Bedarf lädt, um Aufgaben rund um exploration-strategies ohne zusätzliche Eingaben auszuführen.

Wie installiere ich exploration-strategies?

Verwende die Installationsbefehle auf dieser Seite: Füge exploration-strategies als Plugin zu Claude Code hinzu oder klone das Repository in dein Skills-Verzeichnis. Starte Claude danach neu, damit der Skill geladen wird.

Zu welcher Kategorie gehört exploration-strategies?

exploration-strategies gehört zur Kategorie Andere.

Kann ich exploration-strategies kostenlos nutzen?

Ja. exploration-strategies ist auf AIMCP gelistet und kann kostenlos installiert werden.

Verwandte Skills

llamaguard
Andere

LlamaGuard ist Metas 7-8B-Parameter-Modell zur Moderation von LLM-Eingaben und -Ausgaben in sechs Sicherheitskategorien wie Gewalt und Hassrede. Es bietet eine Genauigkeit von 94-95 % und kann mit vLLM, Hugging Face oder Amazon SageMaker eingesetzt werden. Nutzen Sie diese Skill, um Inhaltsfilterung und Sicherheitsguardrails einfach in Ihre KI-Anwendungen zu integrieren.

Skill ansehen
cost-optimization
Andere

Diese Claude Skill unterstützt Entwickler bei der Optimierung von Cloud-Kosten durch Ressourcen-Dimensionierung, Tagging-Strategien und Ausgabenanalysen. Sie bietet einen Rahmen zur Senkung von Cloud-Ausgaben und zur Implementierung von Kosten-Governance für AWS, Azure und GCP. Nutzen Sie sie, wenn Sie Infrastrukturkosten analysieren, Ressourcen richtig dimensionieren oder Budgetvorgaben einhalten müssen.

Skill ansehen
sports-betting-analyzer
Andere

Diese Claude Skill analysiert Sportwettenmärkte inklusive Handicaps, Over/Unders und Spezialwetten, indem sie historische Trends und situative Statistiken untersucht, um Wertwetten zu identifizieren. Sie liefert strukturierte Markdown-Ausgaben mit umsetzbaren Empfehlungen zu Bildungszwecken. Entwickler sollten dies für Sportwetten-Analysetools nutzen, wobei zu beachten ist, dass es nur zur Unterhaltung/Bildung konzipiert wurde.

Skill ansehen
quantizing-models-bitsandbytes
Andere

Diese Fähigkeit quantisiert LLMs auf 8-Bit- oder 4-Bit-Präzision mittels bitsandbytes und erreicht dabei eine Speicherreduzierung von 50–75 % bei minimalem Genauigkeitsverlust. Sie ist ideal für den Betrieb größerer Modelle mit begrenztem GPU-Speicher oder zur Beschleunigung von Inferenzvorgängen und unterstützt Formate wie INT8, NF4 und FP4. Die Fähigkeit integriert sich in HuggingFace Transformers und ermöglicht QLoRA-Training sowie 8-Bit-Optimierer.

Skill ansehen