Out of 454 large-scale models with known compute, 363 are language models, of which 93 are vision-language models such as GPT-4. The first models trained with 1023 FLOP were for game-playing, but language has dominated since 2021. Other large-scale models have been developed for image and video generation, biological sequence modeling, and robotics.
| Model | Domain | Training compute (FLOP) | Organization | Publication date |
|---|---|---|---|---|
| Meena | Language | 1.1e+23 | Google Brain | 2020-01-28 |
| Qwen3-Next-80B-A3B | Language | 2.7e+23 | Alibaba | 2025-09-10 |
| Qwen3-Max | Language | 1.5e+25 | Alibaba | 2025-09-05 |
| Apertus 70B | Language | 6.7e+24 | ETH Zurich,Ecole Polytechnique F´ed´erale de Lausanne (EPFL),Swiss National Supercomputing Centre (CSCS) | 2025-09-02 |
| Seed-OSS-36B-Base | Language | 2.6e+24 | ByteDance | 2025-08-21 |
| Teuken 7B | Language | 2.1e+23 | OpenGPT-X,Fraunhofer Institute for Algorithms and Scientific Computing,Forschungszentrum Julich,Technische Universität Dresden | 2025-08-21 |
| NVIDIA-Nemotron-Nano-9B-v2 | Language | 1.5e+24 | NVIDIA | 2025-08-18 |
| NVIDIA-Nemotron-Nano-12B-v2 | Language | 1.5e+24 | NVIDIA | 2025-08-18 |
| GPT-3 175B (davinci) | Language | 3.1e+23 | OpenAI | 2020-05-28 |
| Jurassic-1-Jumbo | Language | 3.7e+23 | AI21 Labs | 2021-08-11 |
| gpt-oss-120b | Language | 4.9e+24 | OpenAI | 2025-08-05 |
| SenseChat | Language | 3.9e+24 | SenseTime | 2023-04-10 |
| BloombergGPT | Language | 2.4e+23 | Bloomberg,Johns Hopkins University | 2023-03-30 |
| LightOn Mini | Language | 2.4e+23 | LightOn | 2023-03-21 |
| PanGu-Σ | Language | 4.7e+23 | Huawei Noah's Ark Lab | 2023-03-20 |
| Falcon-40B | Language | 2.4e+23 | Technology Innovation Institute | 2023-03-15 |
| LLaMA-33B | Language | 2.7e+23 | Meta AI | 2023-02-27 |
| LLaMA-65B | Language | 5.5e+23 | Meta AI | 2023-02-24 |
| Llama 2-13B | Language | 1.6e+23 | Meta AI | 2023-07-18 |
| Claude 2 | Language | 3.9e+24 | Anthropic | 2023-07-11 |
| InternLM | Language | 1.0e+24 | Shanghai AI Lab,SenseTime | 2023-07-06 |
| Inflection-1 | Language | 1.0e+24 | Inflection AI | 2023-06-23 |
| MPT-30B | Language | 1.9e+23 | MosaicML | 2023-06-22 |
| PaLM 2 | Language | 7.3e+24 | 2023-05-10 | |
| ruGPT-3.5 13B | Language | 1.1e+23 | Sber | 2023-04-24 |
| Falcon-180B | Language | 3.8e+24 | Technology Innovation Institute | 2023-09-06 |
| Baichuan2-13B | Language | 2.0e+23 | Baichuan | 2023-09-06 |
| TigerBot-70B | Language | 1.0e+24 | Tigerobo | 2023-09-06 |
| VARCO LLM 2.0 base | Language | 1.2e+23 | NCSOFT | 2023-08-16 |
| Code Llama-34B | Language | 5.3e+23 | Meta AI | 2023-08-14 |
| Baichuan2-53B | Language | 8.3e+23 | Baichuan | 2023-08-09 |
| Llama 2-70B | Language | 8.1e+23 | Meta AI | 2023-07-18 |
| Llama 2-34B | Language | 4.1e+23 | Meta AI | 2023-07-18 |
| Jiutian | Language | 1.7e+23 | China Mobile | 2023-10-12 |
| CodeFuse-13B | Language | 3.1e+23 | Ant Group | 2023-10-10 |
| Qwen-14B | Language | 2.5e+23 | Alibaba | 2023-09-28 |
| Qwen-7B | Language | 1.0e+23 | Alibaba | 2023-09-28 |
| PLaMo-13B | Language | 1.2e+23 | Preferred Networks Inc | 2023-09-28 |
| Baichuan 2-7B | Language | 1.1e+23 | Baichuan | 2023-09-20 |
| OLMo 2 Furious 7B | Language | 1.8e+23 | Allen Institute for AI,University of Washington,New York University (NYU) | 2024-12-31 |
| OLMo 2 Furious 13B | Language | 4.6e+23 | Allen Institute for AI,University of Washington,New York University (NYU) | 2024-12-31 |
| DeepSeek-V3 | Language | 3.4e+24 | DeepSeek | 2024-12-24 |
| Granite 3.1 2B | Language | 1.8e+23 | IBM | 2024-12-18 |
| Granite 3.1 8B | Language | 5.8e+23 | IBM | 2024-12-18 |
| Falcon3-7B | Language | 5.9e+23 | Technology Innovation Institute | 2024-12-17 |
| Phi-4 | Language | 9.3e+23 | Microsoft Research | 2024-12-12 |
| Step-1 | Language | 6.2e+23 | StepFun | 2025-02-18 |
| Mistral Small 3 | Language | 1.2e+24 | Mistral AI | 2025-01-30 |
| DeepSeek-R1 | Language | 4.0e+24 | DeepSeek | 2025-01-20 |
| MiniMax-Text-01 | Language | 2.0e+24 | MiniMax | 2025-01-14 |
| Ling-Plus ("Bailing") | Language | 1.6e+24 | Ant Group | 2025-03-10 |
| YandexGPT 5 Lite | Language | 7.4e+23 | Yandex | 2025-02-25 |
| Pangu Ultra | Language | 1.1e+25 | Huawei | 2025-04-10 |
| Llama Nemotron Ultra 253B | Language | 3.9e+25 | NVIDIA | 2025-03-18 |
| OLMo 2 32B | Language | 1.3e+24 | Allen Institute for AI | 2025-03-13 |
| Ling-lite-1.5 ("Bailing") | Language | 1.5e+23 | Ant Group | 2025-03-10 |
| Qwen2.5-32B | Language | 3.5e+24 | Alibaba | 2024-09-17 |
| DeepSeek-V2.5 | Language | 1.8e+24 | DeepSeek | 2024-09-06 |
| GLM-4-Plus | Language | 3.6e+25 | Zhipu AI | 2024-08-29 |
| Pharia-1-LLM-7B | Language | 4.4e+23 | Aleph Alpha | 2024-08-26 |
| Falcon Mamba | Language | 3.9e+23 | Technology Innovation Institute | 2024-08-12 |
| EXAONE 3.0 | Language | 4.0e+23 | LG AI Research | 2024-08-07 |
| Jais-70B | Language | 9.7e+23 | G42,Inception G42 | 2024-08-05 |
| Telechat2-115B | Language | 6.9e+24 | China Telecom | 2024-09-20 |
| Qwen2.5-72B | Language | 7.8e+24 | Alibaba | 2024-09-19 |
| Qwen2.5-3B | Language | 3.3e+23 | Alibaba | 2024-09-19 |
| Qwen2.5-7B | Language | 8.2e+23 | Alibaba | 2024-09-19 |
| Qwen2.5-1.5B | Language | 1.7e+23 | Alibaba | 2024-09-19 |
| Qwen2.5-14B | Language | 1.6e+24 | Alibaba | 2024-09-19 |
| Qwen2.5-Coder (7B) | Language | 2.5e+23 | Alibaba | 2024-09-18 |
| Granite 3.0 8B | Language | 5.8e+23 | IBM | 2024-10-21 |
| Granite 3.0 2B | Language | 1.8e+23 | IBM | 2024-10-21 |
| Yi-Lightning | Language | 1.5e+24 | 01.AI | 2024-10-18 |
| Llama 3.2 3B | Language | 1.7e+23 | Meta AI | 2024-09-24 |
| EXAONE 3.5 7.8B | Language | 4.2e+23 | LG AI Research | 2024-12-09 |
| EXAONE 3.5 32B | Language | 1.3e+24 | LG AI Research | 2024-12-09 |
| Llama 3.3 70B | Language | 6.9e+24 | Meta AI | 2024-12-06 |
| Qwen2.5-Coder (32B) | Language | 1.1e+24 | Alibaba | 2024-11-12 |
| Hunyuan-Large | Language | 3.5e+24 | Tencent | 2024-11-06 |
| Doubao-pro | Language | 2.5e+25 | ByteDance | 2024-10-28 |
| Yi-Large | Language | 1.8e+24 | 01.AI | 2024-05-13 |
| Yi-1.5-34B | Language | 7.3e+23 | 01.AI | 2024-05-13 |
| Yi-1.5-9B | Language | 1.9e+23 | 01.AI | 2024-05-13 |
| Falcon 2 11B | Language | 3.6e+23 | Technology Innovation Institute | 2024-05-09 |
| DeepSeek-V2 (MoE-236B) | Language | 1.0e+24 | DeepSeek | 2024-05-07 |
| Mamba2-Hybrid | Language | 1.8e+23 | NVIDIA | 2024-06-12 |
| Qwen2-72B | Language | 3.0e+24 | Alibaba | 2024-06-07 |
| Qwen2-7B | Language | 2.9e+23 | Alibaba | 2024-06-07 |
| Qwen2-57B-A14B | Language | 3.8e+23 | Alibaba | 2024-06-07 |
| Granite 20B | Language | 3.0e+23 | IBM Research | 2024-05-31 |
| Nanbeige2-16B-Chat | Language | 4.1e+23 | Nanbeige LLM Lab | 2024-05-28 |
| 360Zhinao-7B | Language | 1.4e+23 | 360 Security Technology | 2024-05-22 |
| ALLaM 34B | Language | 1.1e+24 | Saudi Data and Artificial Intelligence Authority | 2024-05-21 |
| MAP-Neo | Language | 1.9e+23 | University of Waterloo,01.AI,Wuhan University | 2024-07-10 |
| Gemma 2 9B | Language | 4.3e+23 | Google DeepMind | 2024-06-24 |
| Gemma 2 27B | Language | 2.1e+24 | Google DeepMind | 2024-06-24 |
| JIUTIAN-139MoE | Language | 4.4e+23 | China Mobile | 2024-06-15 |
| Nemotron-4 340B | Language | 1.8e+25 | NVIDIA | 2024-06-14 |
| PLaMo-100B | Language | 1.2e+24 | Preferred Networks Inc | 2024-06-14 |
| AFM-on-device | Language | 4.5e+23 | Apple | 2024-07-29 |
| AFM-server | Language | 4.3e+24 | Apple | 2024-07-29 |
| Mistral Large 2 | Language | 2.1e+25 | Mistral AI | 2024-07-24 |
| Llama 3.1-405B | Language | 3.8e+25 | Meta AI | 2024-07-23 |
| Llama 3.1-70B | Language | 7.9e+24 | Meta AI | 2024-07-23 |
| Llama 3.1-8B | Language | 1.2e+24 | Meta AI | 2024-07-23 |
| DCLM 7B | Language | 1.1e+23 | Apple | 2024-07-20 |
| BlueLM 70B | Language | 4.2e+23 | vivo AI lab | 2023-11-02 |
| BlueLM 130B | Language | 7.8e+23 | vivo AI lab | 2023-11-02 |
| BlueLM 175B | Language | 1.1e+24 | vivo AI lab | 2023-11-02 |
| Yi 6B | Language | 1.3e+23 | 01.AI | 2023-11-02 |
| Nanbeige-16B | Language | 2.4e+23 | Nanbeige LLM Lab | 2023-11-01 |
| BlueLM 7B | Language | 1.1e+23 | vivo AI lab | 2023-10-31 |
| Mi:dm 200B | Language | 1.2e+24 | KT | 2023-10-31 |
| Skywork-13B | Language | 2.5e+23 | Kunlun Inc. | 2023-10-30 |
| Yuan 2.0 | Language | 1.8e+23 | Inspur | 2023-11-27 |
| Inflection-2 | Language | 1.0e+25 | Inflection AI | 2023-11-22 |
| Nemotron-3-8B | Language | 1.8e+23 | NVIDIA | 2023-11-15 |
| Jais-30b (phase 1) | Language | 1.0e+23 | Cerebras Systems,Mohamed bin Zayed University of Artificial Intelligence (MBZUAI),Inception G42,G42 | 2023-11-08 |
| Grok-1 | Language | 2.9e+24 | xAI | 2023-11-04 |
| Yi-34B | Language | 6.1e+23 | 01.AI | 2023-11-02 |
| Poro 34B | Language | 2.1e+23 | High-Performance Language Technologies (HPLT),University of Turku | 2023-12-14 |
| Mixtral 8x7B | Language | 7.7e+23 | Mistral AI | 2023-12-11 |
| XVERSE-65B-2 | Language | 1.2e+24 | XVERSE Technology,Shenzhen Yuanxiang Technology | 2023-12-08 |
| Qwen-72B | Language | 1.3e+24 | Alibaba | 2023-11-30 |
| Granite 13B | Language | 2.4e+23 | IBM | 2023-11-30 |
| Qwen1.5-14B | Language | 3.4e+23 | Alibaba | 2024-02-04 |
| OLMo-7B | Language | 1.0e+23 | Allen Institute for AI,University of Washington | 2024-02-01 |
| Code Llama-70B | Language | 1.3e+24 | Meta AI | 2024-01-29 |
| DeepSeek Coder 33B | Language | 4.0e+23 | DeepSeek,Peking University | 2024-01-25 |
| GLM-4 (0116) | Language | 1.2e+25 | Zhipu AI | 2024-01-17 |
| InternLM2-20B | Language | 3.1e+23 | Shanghai AI Lab,SenseTime,Chinese University of Hong Kong (CUHK),Fudan University | 2024-01-12 |
| DeepSeek LLM 67B | Language | 8.0e+23 | DeepSeek | 2024-01-05 |
| YaYi 2.0 | Language | 4.8e+23 | Yayi (Wenge) | 2023-12-22 |
| Gemma 1.1 7B Instruct | Language | 3.1e+23 | 2024-02-24 | |
| MegaScale (175B) | Language | 2.7e+23 | ByteDance,Peking University | 2024-02-23 |
| MegaScale (530B) | Language | 9.7e+23 | ByteDance,Peking University | 2024-02-23 |
| MegaScale (Production) | Language | 3.9e+24 | ByteDance,Peking University | 2024-02-23 |
| Gemma 7B | Language | 3.1e+23 | Google DeepMind | 2024-02-21 |
| Qwen1.5-72B | Language | 1.3e+24 | Alibaba | 2024-02-04 |
| Qwen1.5-7B | Language | 1.7e+23 | Alibaba | 2024-02-04 |
| Inflection-2.5 | Language | 8.0e+24 | Inflection AI | 2024-03-07 |
| Aramco Metabrain AI | Language | 1.0e+25 | Saudi Aramco | 2024-03-04 |
| StarCoder 2 15B | Language | 3.9e+23 | Hugging Face,ServiceNow,NVIDIA,BigCode | 2024-02-29 |
| StarCoder 2 7B | Language | 1.5e+23 | Hugging Face,ServiceNow,NVIDIA,BigCode | 2024-02-29 |
| Nemotron-4 15B | Language | 7.5e+23 | NVIDIA | 2024-02-27 |
| Mistral Large | Language | 1.1e+25 | Mistral AI | 2024-02-26 |
| Mixtral 8x22B | Language | 2.3e+24 | Mistral AI | 2024-04-17 |
| Stable LM 2 12B | Language | 2.9e+23 | Stability AI | 2024-04-08 |
| Viking | Language | 2.6e+23 | Silo AI,University of Turku | 2024-04-04 |
| Grok-1.5 | Language | 9.3e+24 | xAI | 2024-03-28 |
| DBRX | Language | 2.6e+24 | Databricks | 2024-03-27 |
| Multi-Token Prediction 7B | Language | 3.8e+23 | Facebook AI Research | 2024-04-30 |
| Multi-Token Prediction 13B | Language | 1.5e+23 | Facebook AI Research | 2024-04-30 |
| Arctic | Language | 3.8e+23 | Snowflake | 2024-04-24 |
| phi-3-medium 14B | Language | 4.0e+23 | Microsoft | 2024-04-23 |
| phi-3-small 7.4B | Language | 2.1e+23 | Microsoft | 2024-04-23 |
| Phi-3.5-MoE | Language | 3.0e+23 | Microsoft | 2024-04-23 |
| Llama 3-70B | Language | 7.9e+24 | Meta AI | 2024-04-18 |
| Llama 3-8B | Language | 7.2e+23 | Meta AI | 2024-04-18 |
| GLaM | Language | 3.6e+23 | 2021-12-13 | |
| Gopher (280B) | Language | 6.3e+23 | DeepMind | 2021-12-08 |
| Yuan 1.0 | Language | 3.5e+23 | Inspur | 2021-10-12 |
| Megatron-Turing NLG 530B | Language | 8.6e+23 | Microsoft,NVIDIA | 2021-10-11 |
| HyperCLOVA 82B | Language | 1.5e+23 | NAVER,Search Solutions | 2021-09-10 |
| HyperCLOVA 204B | Language | 2.0e+23 | NAVER | 2021-09-10 |
| gpt-oss-20b | Language | 5.5e+23 | OpenAI | 2025-08-05 |
| OPT-175B | Language | 4.3e+23 | Meta AI | 2022-05-02 |
| PaLM (540B) | Language | 2.5e+24 | Google Research | 2022-04-04 |
| Chinchilla | Language | 5.8e+23 | DeepMind | 2022-03-29 |
| ST-MoE | Language | 2.9e+23 | Google,Google Brain,Google Research | 2022-02-17 |
| LaMDA | Language | 3.6e+23 | 2022-02-10 | |
| AlphaCode | Language | 2.4e+23 | DeepMind | 2022-02-02 |
| ERNIE 3.0 Titan | Language | 1.0e+24 | Baidu,Peng Cheng Laboratory | 2021-12-23 |
| AlexaTM 20B | Language | 2.0e+23 | Amazon | 2022-08-02 |
| BLOOM-176B | Language | 3.7e+23 | Hugging Face,BigScience | 2022-07-11 |
| Minerva (540B) | Language | 2.7e+24 | 2022-06-29 | |
| YaLM | Language | 2.2e+23 | Yandex | 2022-06-23 |
| OPT-66B | Language | 1.1e+23 | Meta AI | 2022-06-21 |
| BIG-G 137B | Language | 5.6e+23 | 2022-06-09 | |
| UL2 | Language | 1.2e+23 | Google Research,Google Brain | 2022-05-10 |
| GPT-3.5 | Language | 2.6e+24 | OpenAI | 2022-11-28 |
| Luminous-supreme | Language | 3.5e+23 | Aleph Alpha | 2022-08-15 |
| Luminous-extended | Language | 1.0e+23 | Aleph Alpha | 2022-08-15 |
| GLM-130B | Language | 3.5e+23 | Tsinghua University | 2022-08-04 |
| Qwen3-4B | Language | 8.6e+23 | Alibaba | 2025-04-29 |
| Qwen3-1.7B | Language | 3.7e+23 | Alibaba | 2025-04-29 |
| Qwen3-0.6B | Language | 1.3e+23 | Alibaba | 2025-04-29 |
| Foundation-sec-8b | Language | 1.5e+24 | Cisco | 2025-04-28 |
| Nemotron-H 8B | Language | 7.2e+23 | NVIDIA | 2025-04-14 |
| Nemotron-H 56B | Language | 6.7e+24 | NVIDIA | 2025-04-14 |
| GLM-Z1-Rumination-32B-0414 | Language | 2.9e+24 | Tsinghua University | 2025-04-14 |
| GLM-4-9B-0414 | Language | 8.1e+23 | Tsinghua University | 2025-04-14 |
| Marin 8B | Language | 6.1e+23 | Marin | 2025-05-19 |
| Pangu Ultra MoE | Language | 3.1e+24 | Huawei | 2025-05-07 |
| Qwen3-235B-A22B | Language | 4.8e+24 | Alibaba | 2025-04-29 |
| Qwen3-30B-A3B | Language | 6.5e+23 | Alibaba | 2025-04-29 |
| Qwen3-32B | Language | 7.1e+24 | Alibaba | 2025-04-29 |
| Qwen3-14B | Language | 3.2e+24 | Alibaba | 2025-04-29 |
| Qwen3-8B | Language | 1.8e+24 | Alibaba | 2025-04-29 |
| ERNIE-4.5-21B-A3B | Language | 1.8e+23 | Baidu | 2025-06-29 |
| MiniMax-M1-80k | Language | 4.3e+24 | MiniMax | 2025-06-13 |
| MiniMax-M1-40k | Language | 4.2e+24 | MiniMax | 2025-06-13 |
| MiMo-7B-Base | Language | 1.1e+24 | Xiaomi Corp | 2025-06-05 |
| Pangu Pro MoE | Language | 1.3e+24 | Huawei | 2025-05-28 |
| Falcon-H1 | Language | 3.7e+24 | Technology Innovation Institute | 2025-05-21 |
| GLM 4.5 | Language | 4.4e+24 | Zhipu AI,Tsinghua University | 2025-08-05 |
| GLM-4.5-Air | Language | 1.7e+24 | Zhipu AI,Tsinghua University | 2025-08-05 |
| Qwen3-Coder-480B-A35B | Language | 1.6e+24 | Alibaba | 2025-07-22 |
| EXAONE 4.0 (32B) | Language | 2.7e+24 | LG AI Research | 2025-07-15 |
| Kimi K2 | Language | 3.0e+24 | Moonshot | 2025-07-11 |
| ERNIE-4.5-300B-A47B | Language | 2.8e+24 | Baidu | 2025-06-29 |
| Grok 4 | Multimodal | 5.0e+26 | xAI | 2025-07-09 |
| MiMo-VL-7B-SFT | Multimodal | 1.2e+24 | Xiaomi Corp | 2025-06-04 |
| Gemma 3n | Multimodal | 5.2e+23 | 2025-05-20 | |
| Seed1.5-VL | Multimodal | 1.4e+24 | ByteDance | 2025-05-11 |
| EXAONE 1.0 | Multimodal | 1.7e+24 | LG | 2021-12-14 |
| Galactica | Multimodal | 3.2e+23 | Meta AI | 2022-11-16 |
| PaLI | Multimodal | 1.7e+23 | 2022-09-14 | |
| Claude 3 Opus | Multimodal | 1.6e+25 | Anthropic | 2024-03-04 |
| MM1-30B | Multimodal | 4.9e+23 | Apple | 2024-03-14 |
| Reka Flash | Multimodal | 6.3e+23 | Reka AI | 2024-04-15 |
| Reka Core | Multimodal | 8.4e+24 | Reka AI | 2024-04-15 |
| Reka Edge | Multimodal | 1.9e+23 | Reka AI | 2024-04-18 |
| Gemini 1.0 Pro | Multimodal | 1.8e+24 | Google DeepMind | 2023-12-06 |
| GPT-4 Turbo | Multimodal | 2.2e+25 | OpenAI | 2023-11-06 |
| GPT-4o mini | Multimodal | 7.4e+24 | OpenAI | 2024-07-18 |
| Claude 3.5 Sonnet | Multimodal | 2.7e+25 | Anthropic | 2024-06-20 |
FragLlama: Next-fragment prediction for molecular design | Multimodal | 3.3e+23 | Facebook AI Research | 2024-05-16 |
| Gemini 1.5 Pro | Multimodal | 1.6e+25 | Google DeepMind | 2024-02-15 |
| Konan LLM 41B | Multimodal | 1.7e+23 | Konan Technology | 2023-12-15 |
| Gemini 1.0 Ultra | Multimodal | 5.0e+25 | Google DeepMind | 2023-12-06 |
| Chameleon-34B | Multimodal | 1.6e+24 | Facebook AI Research | 2024-05-16 |
| Llama 4 Scout | Multimodal | 4.1e+24 | Meta AI | 2025-04-05 |
| Llama 3.2 11B | Multimodal | 5.8e+23 | Meta AI | 2024-09-24 |
| Qwen2-VL-72B | Multimodal | 6.0e+23 | Alibaba | 2024-09-18 |
| Movie Gen Video | Multimodal | 1.6e+24 | Meta AI | 2024-10-04 |
| Aria | Multimodal | 1.4e+23 | Rhymes AI | 2024-10-08 |
| Amazon Nova Pro | Multimodal | 6.0e+24 | Amazon | 2024-12-03 |
| GPT-4o | Multimodal | 3.8e+25 | OpenAI | 2024-05-13 |
| GLM-4.5V | Multimodal | 1.8e+24 | Zhipu AI,Tsinghua University | 2025-08-15 |
| GLM-4.1V-Thinking | Multimodal | 9.2e+23 | Zhipu AI,Tsinghua University | 2025-08-15 |
| Wu Dao 2.0 | Multimodal | 1.5e+24 | Beijing Academy of Artificial Intelligence / BAAI | 2021-05-31 |
| Qwen2.5-VL-7B | Multimodal | 9.9e+23 | Alibaba | 2025-02-19 |
| Cosmos-1.0- Diffusion-14B Video2World | Multimodal | 2.8e+24 | NVIDIA | 2025-01-07 |
| GPT-4 | Multimodal | 2.1e+25 | OpenAI | 2023-03-15 |
| Hunyuan | Multimodal | 1.2e+24 | Tencent | 2023-09-07 |
| Grok-2 | Multimodal | 3.0e+25 | xAI | 2024-08-13 |
| Wan 2.1 14B I2V | Multimodal | 2.5e+23 | Alibaba | 2025-02-25 |
| GPT-4.5 | Multimodal | 2.1e+26 | OpenAI | 2025-02-27 |
| Llama 4 Maverick | Multimodal | 2.2e+24 | Meta AI | 2025-04-05 |
| Llama 4 Behemoth (preview) | Multimodal | 5.2e+25 | Meta AI | 2025-04-05 |
| Claude 3.7 Sonnet | Multimodal | 3.3e+25 | Anthropic | 2025-02-24 |
| Grok 3 | Multimodal | 3.5e+26 | xAI | 2025-02-17 |
| MiniMax-VL-01 | Multimodal | 2.1e+24 | MiniMax | 2025-01-14 |
| Qwen2.5-VL-72B | Multimodal | 9.6e+24 | Alibaba | 2025-02-19 |
| Amazon Titan | Multimodal | 4.8e+24 | Amazon | 2023-09-28 |
| Evo 2 40B | Biology | 2.3e+24 | Arc Institute,Stanford University,NVIDIA,Liquid,University of California (UC) Berkeley,Goodfire,Columbia University,University of California San Francisco | 2025-02-19 |
| Hunyuan Video | Video | 1.5e+23 | Tencent | 2024-12-03 |
| Seaweed-7B | Video | 9.0e+23 | ByteDance | 2025-04-11 |
| xTrimoPGLM -100B | Biology | 6.2e+23 | Tsinghua University,BioMap Research | 2023-07-06 |
| ESM3 (98B) | Biology | 1.1e+24 | EvolutionaryScale,University of California (UC) Berkeley | 2024-06-25 |
| Wan 2.2 14B T2V | Video | 4.2e+23 | Alibaba | 2025-07-28 |
| Evo 2 7B | Biology | 1.0e+23 | Arc Institute,Stanford University,NVIDIA,Liquid,University of California (UC) Berkeley,Goodfire,Columbia University,University of California San Francisco | 2025-02-19 |
| Step-Video-T2V | Video | 4.1e+24 | StepFun | 2025-02-24 |
| Parti | Drawing | 5.1e+23 | Google Research | 2022-06-22 |
| DALL·E 2 | Drawing | 3.4e+23 | OpenAI | 2022-04-06 |
| Whisper v2 | Speech | 1.1e+23 | OpenAI | 2022-12-05 |
| Whisper v3 | Speech | 2.7e+23 | OpenAI | 2023-11-06 |
| ViT-22B | Vision | 1.9e+23 | 2023-02-10 | |
| Movie Gen Audio | Audio | 1.4e+23 | Meta AI | 2024-10-04 |
| AlphaStar | Games | 1.1e+23 | DeepMind | 2019-10-30 |
Epoch's work is free to use, distribute, and reproduce provided the source and authors are credited under the Creative Commons BY license.

