Scalable Extraction of Training Data from (Production) Language Models
Original
Nasr, M., Carlini, N., Hayase, J., Jagielski, M., Cooper, A. F., Ippolito, D., Choquette-Choo, C. A., Wallace, E., Tramèr, F., and Lee, K · 2023
Later among the works it cites.
GPT-4 Technical Report
Original
OpenAI · 2023
Later among the works it cites.
Proving Test Set Contamination in Black Box Language Models
Original
Oren, Y., Meister, N., Chatterji, N., Ladhak, F., and Hashimoto, T. B · 2023
Later among the works it cites.
To the Cutoff… and Beyond? A Longitudinal Perspective on LLM Data Contamination
Roberts, M., Thakur, H., Herlihy, C., White, C., and Dooley, S · 2023
Later among the works it cites.
Detecting Pretraining Data from Large Language Models
Original
Shi, W., Ajith, A., Xia, M., Huang, Y., Liu, D., Blevins, T., Chen, D., and Zettlemoyer, L · 2023
Later among the works it cites.
AG Recommends Clause in Publishing and Distribution Agreements Prohibiting AI Training Uses
The Authors Guild · 2023
Later among the works it cites.
Llama 2: Open Foundation and Fine-Tuned Chat Models
Original
Touvron, H., Martin, L., Stone, K., Albert, P., Almahairi, A., Babaei, Y., Bashlykov, N., Batra, S., Bhargava, P., Bhosale, S., Bikel, D., Blecher, L., Ferrer, C. C., Chen, M., Cucurull, G., Esiobu, D., Fernandes, J., Fu, J., Fu, W., Fuller, B., Gao, C., Goswami, V., Goyal, N., Hartshorn, A., Hosseini, S., Hou, R., Inan, H., Kardas, M., Kerkez, V., Khabsa, M., Kloumann, I., Korenev, A., Koura, P. S., Lachaux, M.-A., Lavril, T., Lee, J., Liskovich, D., Lu, Y., Mao, Y., Martinet, X., Mihaylov, T., Mishra, P., Molybog, I., Nie, Y., Poulton, A., Reizenstein, J., Rungta, R., Saladi, K., Schelten, A., Silva, R., Smith, E. M., Subramanian, R., Tan, X. E., Tang, B., Taylor, R., Williams, A., Kuan, J. X., Xu, P., Yan, Z., Zarov, I., Zhang, Y., Fan, A., Kambadur, M., Narang, S., Rodriguez, A., Stojnic, R., Edunov, S., and Scialom, T · 2023
Later among the works it cites.
On Provable Copyright Protection for Generative Models
Original
Vyas, N., Kakade, S., and Barak, B · 2023
Later among the works it cites.
Large Language Models Are Not Robust Multiple Choice Selectors
Zheng, C., Zhou, H., Meng, F., Zhou, J., and Huang, M · 2023
Later among the works it cites.
Mixtral of Experts
Original
Jiang, A. Q., Sablayrolles, A., Roux, A., Mensch, A., Savary, B., Bamford, C., Chaplot, D. S., de las Casas, D., Hanna, E. B., Bressand, F., Lengyel, G., Bour, G., Lample, G., Lavaud, L. R., Saulnier, L., Lachaux, M.-A., Stock, P., Subramanian, S., Yang, S., Antoniak, S., Scao, T. L., Gervet, T., Lavril, T., Wang, T., Lacroix, T., and Sayed, W. E · 2024
Closest in time.