ThinkLLM
ModelsCapabilitiesUse CasesBenchmarksPapersGlossary
ModelsCapabilitiesUse CasesBenchmarksPapersGlossary
AboutPrivacyTermsRSS

ThinkLLM

Spot an error in our data? Let us know.

Papers

Recent AI research papers with accessible summaries. Updated daily from arXiv, summarized for developers who don't read papers regularly.

2612 papers12 topics
AllTraining 50Efficiency 38Reasoning 37Agents 32Evaluation 32Architecture 18Applications 13Safety 12Multimodal 11scaling 6Data 5Alignment 3

Jul 15 – Jul 21, 2024(1)

Qwen2 Technical Report

Jul 15, 2024

An Yang, Baosong Yang, Binyuan Hui

Alibaba produced a globally competitive open model family — Qwen2 demonstrated that Chinese AI labs can match Western frontier models across languages.

Describes Qwen2, a family of models from 0.5B to 72B trained on 7T tokens across 27 languages. The 72B model matches Llama 3 70B while excelling on multilingual and code tasks.

scalingtrainingmultilingual