Optimization and non-smooth analysis
Frank H. Clarke · 1983
Earlier work this paper cites.
Mathematical programs with equilibrium constraints
Zhi-Quan Luo, Jong-Shi Pang, and Daniel Ralph · 1996
Earlier work this paper cites.
Hyperparameter optimization with approximate gradient
Fabian Pedregosa · 2016
Earlier work this paper cites.
Forward and reverse gradient-based hyperparameter optimization
Luca Franceschi, Michele Donini, Paolo Frasconi, and Massimiliano Pontil · 2017
Earlier work this paper cites.
A first order method for solving convex bilevel optimization problems
Shoham Sabach and Shimrit Shtern · 2017
Earlier work this paper cites.
Bilevel programming for hyperparameter optimization and meta-learning
Luca Franceschi, Paolo Frasconi, Saverio Salzo, Riccardo Grazzi, and Massimiliano Pontil · 2018
Earlier work this paper cites.
Approximation methods for bilevel programming
Original
Saeed Ghadimi and Mengdi Wang · 2018
Earlier work this paper cites.
Bilevel optimization
Stephan Dempe and Alain Zemkoho · 2020
Earlier work this paper cites.
The pile: An 800gb dataset of diverse text for language modeling
Original
Leo Gao, Stella Biderman, Sid Black, Laurence Golding, Travis Hoppe, Charles Foster, Jason Phang, Horace He, Anish Thite, Noa Nabeshima, et al · 2020
Earlier work this paper cites.
A two-timescale framework for bilevel optimization: Complexity analysis and application to actor-critic, dec. 20
Original
M Hong, HT Wai, Z Wang, and Z Yang · 2020
Earlier work this paper cites.
Provably faster algorithms for bilevel optimization and applications to meta-learning
Kaiyi Ji, Junjie Yang, and Yingbin Liang · 2020
Earlier work this paper cites.
A generic first-order algorithmic framework for bi-level programming beyond lower-level singleton
Risheng Liu, Pan Mu, Xiaoming Yuan, Shangzhi Zeng, and Jin Zhang · 2020
Earlier work this paper cites.
On the dangers of stochastic parrots: Can language models be too big?
Emily M Bender, Timnit Gebru, Angelina McMillan-Major, and Shmargaret Shmitchell · 2021
Earlier work this paper cites.
On the opportunities and risks of foundation models
Original
Rishi Bommasani, Drew A Hudson, Ehsan Adeli, Russ Altman, Simran Arora, Sydney von Arx, Michael S Bernstein, Jeannette Bohg, Antoine Bosselut, Emma Brunskill, et al · 2021
Earlier work this paper cites.
Closing the gap: Tighter analysis of alternating stochastic gradient methods for bilevel problems
Tianyi Chen, Yuejiao Sun, and Wotao Yin · 2021
Earlier work this paper cites.
Lora: Low-rank adaptation of large language models
Original
Edward J Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen · 2021
Earlier work this paper cites.
A near-optimal algorithm for stochastic bilevel optimization via double-momentum
Prashant Khanduri, Siliang Zeng, Mingyi Hong, Hoi-To Wai, Zhaoran Wang, and Zhuoran Yang · 2021
Earlier work this paper cites.
Towards gradient-based bilevel optimization with non-convex followers and beyond
Risheng Liu, Yaohua Liu, Shangzhi Zeng, and Jin Zhang · 2021
Earlier work this paper cites.
Training a helpful and harmless assistant with reinforcement learning from human feedback
Original
Yuntao Bai, Andy Jones, Kamal Ndousse, Amanda Askell, Anna Chen, Nova DasSarma, Dawn Drain, Stanislav Fort, Deep Ganguli, Tom Henighan, et al · 2022
Earlier work this paper cites.
Automatic differentiation of nonsmooth iterative algorithms
Jérôme Bolte, Edouard Pauwels, and Samuel Vaiter · 2022
Earlier work this paper cites.
Red teaming language models to reduce harms: Methods, scaling behaviors, and lessons learned
Original
Deep Ganguli, Liane Lovitt, Jackson Kernion, Amanda Askell, Yuntao Bai, Saurav Kadavath, Ben Mann, Ethan Perez, Nicholas Schiefer, Kamal Ndousse, et al · 2022
Earlier work this paper cites.
Will bilevel optimizers benefit from loops
Kaiyi Ji, Mingrui Liu, Yingbin Liang, and Lei Ying · 2022
Earlier work this paper cites.
Training language models to follow instructions with human feedback
Long Ouyang, Jeffrey Wu, Xu Jiang, Diogo Almeida, Carroll Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, et al · 2022
Earlier work this paper cites.
A single-timescale analysis for stochastic approximation with multiple coupled sequences
Han Shen and Tianyi Chen · 2022
Earlier work this paper cites.
Challenging big-bench tasks and whether chain-of-thought can solve them
Original
Mirac Suzgun, Nathan Scales, Nathanael Schärli, Sebastian Gehrmann, Yi Tay, Hyung Won Chung, Aakanksha Chowdhery, Quoc V Le, Ed H Chi, Denny Zhou, et al · 2022
Earlier work this paper cites.