Aakanksha Chowdhery, Abe Ittycheriah, Alexandre Passos, Alex Castro Ros, Alex Polozov, Alicia Parrish, Ambrose Slone, Andrea Hu, Andrew M. Dai, Andrew Nystrom, Aroma Mahendru, Aurko Roy, Benjamin Lee, Brennan Saeta, Bryan Richter, Ce Zheng, Chang Lan, Christopher A. Choquette-Choo, Cl\'ement Crepy, Colin Cherry, Daniel Smilkov, Daniel Sohn, Dasha Valter, David R. So, Denny Zhou, Dmitry Lepikhin, Emanuel Taropa, Emily Reif, Erica Moreira, Eric Chu, Eric Li, Eric Ni, Ethan Dyer, Fangxiaoyu Feng, Frederick Liu, Gaurav Mishra, Gustavo Hernandez Abrego, Guy Gur-Ari, Hadi Hashemi, Hanzhao Lin, Hyeontaek Lim, Jacob Austin, Jacob Devlin, James Bradbury, Jan Botha, Jeffrey Hui, Jeremy Hurwitz, Jiahui Yu, Jian Li, John Nham, John Wieting, Jonathan H. Clark, Joshua Howland, Joshua Maynez, Junwhan Ahn, Katherine Lee, Kathleen Kenealy, Kathy Meier-Hellstern, Kefan Xiao, Kelvin Xu, Kevin Brooks, Kevin Robinson, Kiran Vodrahalli, Laurent El Shafey, Le Hou, Linting Xue, Lucas Gonzalez, Marcello Maggioni, Marie Pellat, Mark D\'iaz, Mark Omernick, Markus Freitag, Martin Polacek, Matthew Jagielski, Maxim Krikun, Maysam Moussalem, Melvin Johnson, Michael Isard, Michele Catasta, Mostafa Dehghani, Music Li, Nan Du, Orhan Firat, Paige Bailey, Parker Riley, Paul Barham, Pengcheng Yin, Pidong Wang, Qiao Zhang, Rajkumar Samuel, Reiner Pope, Renee Shelby, Rohan Anil, Sebastian Gehrmann, Sebastian Ruder, Shachi Dave, Siamak Shakeri, Siddhartha Brahma, Simon Tokumine, Siyuan Qiao, Slav Petrov, Sneha Kudugunta, Steven Hand, Steven Zheng, Sunipa Dev, Tao Wang, Vedant Misra, Vijay Vasudevan, Vlad Feinberg, Vlad Fienber, Weikang Zhou, Wei Li, Wenhao Jia, Xavier Garcia, Xuezhi Wang, Yaguang Li, Yanping Huang, Yi Tay, Yong Cheng, Yonghui Wu, Yuanzhong Xu, Yuhuai Wu, Yujing Zhang, Yunhan Xu, Zachary Nado, Zhifeng Chen, Zhongtao Liu, Zirui Wang
PaLM 2 raises quality on English, multilingual, and reasoning tasks while cutting inference time and compute compared to PaLM.
The bundle contains the canonical record plus signed events. A mirror can host it anywhere and recompute the same
current state with the deterministic merge algorithm.
Claims
C1strongest claim
PaLM 2 has significantly improved quality on downstream tasks across different model sizes, while simultaneously exhibiting faster and more efficient inference compared to PaLM.
C2weakest assumption
That the suite of English, multilingual, and reasoning benchmarks plus the responsible-AI evaluations accurately capture real-world performance and generalization without undisclosed data selection or post-training adjustments.
C3one line summary
PaLM 2 reports state-of-the-art results on language, reasoning, and multilingual tasks with improved efficiency over PaLM.
References
286 extracted · 286 resolved · 32 Pith anchors
[1] Persistent anti-muslim bias in large language models
2021
[2] Akhbardeh, F., Arkhangorodsky, A., Biesialska, M., Bojar, O., Chatterjee, R., Chaudhary, V., Costa-jussa, M. R., Espa \ n a-Bonet, C., Fan, A., Federmann, C., Freitag, M., Graham, Y., Grundkiewicz, R.
2021
[3] Guide to fair pay
2023
[5] Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback
2022
· arXiv:2204.05862
[6] Building machine translation systems for the next thousand languages
2022