Fetching the paper…
Reading the bibliography…
This paper explores the non-convex composition optimization in the form including inner and outer finite-sum functions with a large number of component functions.
Stochastic neighbor embedding
Geoffrey E Hinton and Sam T Roweis · 2003
Earlier work this paper cites.
Visualizing data using t-sne
Laurens van der Maaten and Geoffrey Hinton · 2008
Earlier work this paper cites.
Accelerating stochastic gradient descent using predictive variance reduction
Rie Johnson and Tong Zhang · 2013
Earlier work this paper cites.
Introductory lectures on convex optimization: A basic course
Yurii Nesterov · 2013
Earlier work this paper cites.
Stochastic dual coordinate ascent methods for regularized loss minimization
Shai Shalev-Shwartz and Tong Zhang · 2013
Earlier work this paper cites.
A proximal stochastic gradient method with progressive variance reduction
Lin Xiao and Tong Zhang · 2014
Earlier work this paper cites.
Saga: A fast incremental gradient method with support for non-strongly convex composite objectives
Aaron Defazio, Francis Bach, and Simon Lacoste-Julien · 2014
Earlier work this paper cites.
Accelerated proximal stochastic dual coordinate ascent for regularized loss minimization
Shai Shalev-Shwartz and Tong Zhang · 2014
Earlier work this paper cites.
Accelerated proximal gradient methods for nonconvex programming
Huan Li and Zhouchen Lin · 2015
Cited alongside, same era.
Escaping from saddle points—-online stochastic gradient for tensor decomposition
Rong Ge, Furong Huang, Chi Jin, and Yang Yuan · 2015
Cited alongside, same era.
Accelerating stochastic composition optimization
Ji Liu, Mengdi Wang, and Ethan Fang · 2016
Cited alongside, same era.
Learning from conditional distributions via dual kernel embeddings
Bo Dai, Niao He, Yunpeng Pan, Byron Boots, and Le Song · 2016
Cited alongside, same era.
Improved svrg for non-strongly-convex or sum-of-non-convex objectives
Zeyuan Allen-Zhu and Yang Yuan · 2016
Cited alongside, same era.
Stochastic variance reduction for nonconvex optimization
Statistical estimation of composite risk functionals and risk optimization problems
Darinka Dentcheva, Spiridon Penev, and Andrzej Ruszczyński · 2016
Later among the works it cites.
Proximal stochastic methods for nonsmooth nonconvex finite-sum optimization
Sashank J. Reddi, Suvrit Sra, Barnabas Poczos, and Alexander J Smola · 2016
Later among the works it cites.
Gradient descent only converges to minimizers
Jason D Lee, Max Simchowitz, Michael I Jordan, and Benjamin Recht · 2016
Later among the works it cites.
Accelerated methods for non-convex optimization
Yair Carmon, John C Duchi, Oliver Hinder, and Aaron Sidford · 2016
Later among the works it cites.
Finding approximate local minima for nonconvex optimization in linear time
Naman Agarwal, Zeyuan Allen-Zhu, Brian Bullins, Elad Hazan, and Tengyu Ma · 2016
Later among the works it cites.
alphaXiv searches the wider corpus for related work and actual follow-ups.
alphaXiv is searching for related work…
Sashank J Reddi, Ahmed Hefny, Suvrit Sra, Barnabas Poczos, and Alex Smola · 2016
Cited alongside, same era.
Accelerated gradient methods for nonconvex nonlinear and stochastic programming
Saeed Ghadimi and Guanghui Lan · 2016
Cited alongside, same era.
A stochastic compositional gradient method using markov samples
Mengdi Wang and Ji Liu · 2016
Cited alongside, same era.
Stochastic compositional gradient descent: algorithms for minimizing compositions of expected-value functions
Mengdi Wang, Ethan X Fang, and Han Liu · 2017
Closest in time.
Finite-sum composition optimization via variance reduced gradient descent
Xiangru Lian, Mengdi Wang, and Ji Liu · 2017
Closest in time.