Results for “reinforcement-learning”

22 skills
More results
jiachen-t-wang
Autoaugment Learning Augmentation Strategies From Data Arxiv
AutoAugment: Learning Augmentation Strategies from Data
6
smith6jt-cop
Pytorch Common Pitfalls
Fixes common PyTorch bugs including percentile calculations, LayerNorm for Conv1d, and buffer edge cases in reinforcement learning and neural network code.
3
jiachen-t-wang
Hard Negative Mixing For Contrastive Learning Arxiv 2010 010
Hard Negative Mixing for Contrastive Learning
6
dracounion
Learn By Building
当需要高效掌握新技能并将知识转化为实际成果,避免“纸上谈兵”时
11 · bundle
jiachen-t-wang
Influence Functions In Deep Learning Arxiv 2002 08484v3
Influence Functions in Deep Learning
6
jarbitechture
Learn
Recursive self-improving holon λ(ο,Κ,Σ).τ' for knowledge compounding and schema evolution. USE WHEN learning, improving, optimizing, assessing, reflecting, debugging, synthesizing, or refining—whether human, AI, or organizational. Triggers on /learn, /compound, /improve, /refine, /optimize, /assess, /reflect, "lessons learned", "best practices", "continuous improvement". Preserves Κ-monotonicity, η≥4, homoiconicity.
0 · bundle
winbda
Badge System
Design badge and achievement systems for learning. TRIGGERS - Use when user needs help with badge-system related tasks.
3
lionelsimai
Badge System
Design badge and achievement systems for learning. TRIGGERS - Use when user needs help with badge-system related tasks.
22
sickn33
Lemmaly
Algorithm-first discipline: state Big-O, data structure, and algorithm family BEFORE writing loops, queries, or recursion. Catches O(n^2), N+1, and brute-force defaults.
45.1k
jiachen-t-wang
Curriculum Learning Crossref Icml 2009 Curriculum
Curriculum Learning
6
k-dense-ai
Stable Baselines3
Train reinforcement learning agents using PPO, SAC, DQN, TD3, DDPG, and A2C algorithms with a scikit-learn-like API. Supports custom Gymnasium environments, vectorized environments, callbacks, and model persistence.
30.2k · bundle
sinhoneyy
Lemmaly
Algorithm-first discipline: state Big-O, data structure, and algorithm family BEFORE writing loops, queries, or recursion. Catches O(n^2), N+1, and brute-force defaults.
11
jiachen-t-wang
Multimodal Few Shot Learning With Frozen Language Models Arx
Multimodal Few-Shot Learning with Frozen Language Models
6
phoroth
Lemmaly
Enforces an algorithm-first discipline: state Big-O, data structure, and algorithm family before writing loops, queries, or recursion, catching O(n^2), N+1, and brute-force defaults.
3
arjumaan
Lemmaly
Algorithm-first discipline: state Big-O, data structure, and algorithm family BEFORE writing loops, queries, or recursion. Catches O(n^2), N+1, and brute-force defaults.
1
antigravity
Lemmaly
Enforces an algorithm-first discipline: state Big-O, data structure, and algorithm family before writing loops, queries, or recursion to catch O(n²), N+1, and brute-force defaults.
42.4k
winbda
Reading Plan
Design reading plans with retention strategies. TRIGGERS - Use when user needs help with reading-plan related tasks.
3
dracounion
Failure Stacking
当需要在多个领域积累独特竞争优势,避免单一技能风险时
11 · bundle
bouclem
Deep Learning
PyTorch, TensorFlow, neural networks, CNNs, transformers, and deep learning for production
7 · bundle
francostino
Lemmaly
Algorithm-first discipline: state Big-O, data structure, and algorithm family BEFORE writing loops, queries, or recursion. Catches O(n^2), N+1, and brute-force defaults.
63
jiachen-t-wang
Multimodal Learning With Transformers A Survey Arxiv 2206 06
Multimodal Learning with Transformers: A Survey
6