来自 Orchestra-Research/AI-Research-SKILLs 的 Skills
与 Orchestra-Research/AI-Research-SKILLs 相关的 Agent Skills,可查看 SKILL.md 并下载 zip。
25 skills
-
autoresearch
★ 5.0Orchestrates end-to-end autonomous AI research projects using a two-loop architecture. The inner loop runs rapid experiment iterations with clear optimization …
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
implementing-llms-litgpt
★ 5.0Implements and trains LLMs using Lightning AI's LitGPT with 20+ pretrained architectures (Llama, Gemma, Phi, Qwen, Mistral). Use when need clean model implemen…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
mamba-architecture
★ 5.0State-space model with O(n) complexity vs Transformers' O(n²). 5× faster inference, million-token sequences, no KV cache. Selective SSM with hardware-aware des…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
nanogpt
★ 5.0Educational GPT implementation in ~300 lines. Reproduces GPT-2 (124M) on OpenWebText. Clean, hackable code for learning transformers. By Andrej Karpathy. Perfe…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
rwkv-architecture
★ 5.0RNN+Transformer hybrid with O(n) inference. Linear time, infinite context, no KV cache. Train like GPT (parallel), infer like RNN (sequential). Linux Foundatio…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
distributed-llm-pretraining-torchtitan
★ 5.0Provides PyTorch-native distributed LLM pretraining using torchtitan with 4D parallelism (FSDP2, TP, PP, CP). Use when pretraining Llama 3.1, DeepSeek V3, or c…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
huggingface-tokenizers
★ 5.0Fast tokenizers optimized for research and production. Rust-based implementation tokenizes 1GB in <20 seconds. Supports BPE, WordPiece, and Unigram algorithms.…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
sentencepiece
★ 5.0Language-independent tokenizer treating text as raw Unicode. Supports BPE and Unigram algorithms. Fast (50k sentences/sec), lightweight (6MB memory), determini…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
axolotl
★ 5.0Expert guidance for fine-tuning LLMs with Axolotl - YAML configs, 100+ models, LoRA/QLoRA, DPO/KTO/ORPO/GRPO, multimodal support
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
llama-factory
★ 5.0Expert guidance for fine-tuning LLMs with LLaMA-Factory - WebUI no-code, 100+ models, 2/3/4/5/6/8-bit QLoRA, multimodal support
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
peft-fine-tuning
★ 5.0Parameter-efficient fine-tuning for LLMs using LoRA, QLoRA, and 25+ methods. Use when fine-tuning large models (7B-70B) with limited GPU memory, when you need …
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
unsloth
★ 5.0Expert guidance for fast fine-tuning with Unsloth - 2-5x faster training, 50-80% less memory, LoRA/QLoRA optimization
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
nnsight-remote-interpretability
★ 5.0Provides guidance for interpreting and manipulating neural network internals using nnsight with optional NDIF remote execution. Use when needing to run interpr…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
pyvene-interventions
★ 5.0Provides guidance for performing causal interventions on PyTorch models using pyvene's declarative intervention framework. Use when conducting causal tracing, …
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
sparse-autoencoder-training
★ 5.0Provides guidance for training and analyzing Sparse Autoencoders (SAEs) using SAELens to decompose neural network activations into interpretable features. Use …
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
transformer-lens-interpretability
★ 5.0Provides guidance for mechanistic interpretability research using TransformerLens to inspect and manipulate transformer internals via HookPoints and activation…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
nemo-curator
★ 5.0GPU-accelerated data curation for LLM training. Supports text/image/video/audio. Features fuzzy deduplication (16× faster), quality filtering (30+ heuristics),…
音视频 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
ray-data
★ 5.0Scalable data processing for ML workloads. Streaming execution across CPU/GPU, supports Parquet/CSV/JSON/images. Integrates with Ray Train, PyTorch, TensorFlow…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
grpo-rl-training
★ 5.0Expert guidance for GRPO/RL fine-tuning with TRL for reasoning and task-specific model training
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
miles-rl-training
★ 5.0Provides guidance for enterprise-grade RL training using miles, a production-ready fork of slime. Use when training large MoE models with FP8/INT4, needing tra…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
openrlhf-training
★ 5.0High-performance RLHF framework with Ray+vLLM acceleration. Use for PPO, GRPO, RLOO, DPO training of large models (7B-70B+). Built on Ray, vLLM, ZeRO-3. 2× fas…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
simpo-training
★ 5.0Simple Preference Optimization for LLM alignment. Reference-free alternative to DPO with better performance (+6.4 points on AlpacaEval 2.0). No reference model…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
slime-rl-training
★ 5.0Provides guidance for LLM post-training with RL using slime, a Megatron+SGLang framework. Use when training GLM models, implementing custom data generation wor…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
torchforge-rl-training
★ 5.0Provides guidance for PyTorch-native agentic RL using torchforge, Meta's library separating infra from algorithms. Use when you want clean RL abstractions, eas…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259) -
fine-tuning-with-trl
★ 5.0Fine-tune LLMs using reinforcement learning with TRL - SFT for instruction tuning, DPO for preference alignment, PPO/GRPO for reward optimization, and reward m…
研究学术 Orchestra-Research/AI-Research-SKILLsRating 5.0 (12259)