Language models are few-shot learners
Brown, T., Mann, B., Ryder, N., Subbiah, M., Kaplan, J. D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al. (2020) · 1901
Earlier work this paper cites.
Analysing mathematical reasoning abilities of neural models
Original
Saxton, D., Grefenstette, E., Hill, F., and Kohli, P. (2019) · 1904
Earlier work this paper cites.
What can neural networks reason about?
Original
Xu, K., Li, J., Zhang, M., Du, S. S., Kawarabayashi, K.-i., and Jegelka, S. (2019) · 1905
Earlier work this paper cites.
Do multi-hop readers dream of reasoning chains?
Original
Wang, H., Yu, M., Guo, X., Das, R., Xiong, W., and Gao, T. (2019) · 1910
Earlier work this paper cites.
Scaling laws for neural language models
Original
Kaplan, J., McCandlish, S., Henighan, T., Brown, T. B., Chess, B., Child, R., Gray, S., Radford, A., Wu, J., and Amodei, D. (2020) · 2001
Earlier work this paper cites.
Isarstep: a benchmark for high-level mathematical reasoning
Original
Li, W., Yu, L., Wu, Y., and Paulson, L. C. (2020) · 2006
Earlier work this paper cites.
Mathematical reasoning via self-supervised skip-tree training
Original
Rabe, M. N., Lee, D., Bansal, K., and Szegedy, C. (2020) · 2006
Earlier work this paper cites.
Generative language modeling for automated theorem proving
Original
Polu, S. and Sutskever, I. (2020) · 2009
Earlier work this paper cites.
Neural gpus learn algorithms
Original
Kaiser, Ł. and Sutskever, I. (2015) · 2015
Earlier work this paper cites.
Program induction by rationale generation: Learning to solve and explain algebraic word problems
Ling, W., Yogatama, D., Dyer, C., and Blunsom, P. (2017) · 2017
Earlier work this paper cites.
Attention is all you need
Vaswani, A., Shazeer, N., Parmar, N., Uszkoreit, J., Jones, L., Gomez, A. N., Kaiser, Ł., and Polosukhin, I. (2017) · 2017
Earlier work this paper cites.
Semantically-aligned equation generation for solving and reasoning math word problems
Original
Chiang, T.-R. and Chen, Y.-N. (2018) · 2018
Earlier work this paper cites.
Permutation equivariant models for compositional generalization in language
Gordon, J., Lopez-Paz, D., Baroni, M., and Bouchacourt, D. (2019) · 2019
Earlier work this paper cites.
Least-to-most prompting enables complex reasoning in large language models
Original
Zhou, D., Schärli, N., Hou, L., Wei, J., Scales, N., Wang, X., Schuurmans, D., Bousquet, O., Le, Q., and Chi, E. (2022) · 2019
Earlier work this paper cites.