AWS Trainium2 en disponibilité générale, Trainium3 annoncé
2024-12-03 · Éditeur : AWS · Domaine : Cloud & DevOps
À re:Invent 2024, AWS déclare les instances Trn2 en disponibilité générale avec 30 à 40 % de rapport prix-performance en plus que ses instances GPU P5e et P5en. Il annonce aussi Trainium3 et le projet Rainier avec Anthropic.
Ce qui change
- Les instances Trn2 passent en disponibilité générale : 16 puces Trainium2, 20,8 pétaflops crête.
- AWS annonce 30 à 40 % de rapport prix-performance en plus que ses instances GPU P5e et P5en (chiffre de l'éditeur).
- Les Trn2 UltraServers (64 puces, 83,2 pétaflops) sont en préversion.
- Trainium3 (3 nm) est attendue fin 2025 ; le projet Rainier réunit des centaines de milliers de puces pour Anthropic.
### Ce qui change Le 3 décembre 2024, à re:Invent, AWS annonce la disponibilité générale des instances Amazon EC2 Trn2, fondées sur sa puce d'IA Trainium2. AWS présente aussi les Trn2 UltraServers (en préversion), annonce la prochaine puce Trainium3 et dévoile le projet Rainier, un très grand cluster construit avec Anthropic. AWS présente Trainium2 comme conçue à la fois pour l'entraînement et pour l'inférence des plus grandes charges d'IA générative. ### Caractéristiques - Instance Trn2 : 16 puces Trainium2 et 20,8 pétaflops de calcul crête ; 30 à 40 % de rapport prix-performance en plus que les instances GPU EC2 P5e et P5en, selon AWS. - Trn2 UltraServer : 64 puces Trainium2 reliées par NeuronLink, jusqu'à 83,2 pétaflops de calcul crête ; en préversion à l'annonce. - Trainium3 : première puce d'AWS gravée en 3 nm, attendue fin 2025, avec un gain de performance annoncé d'un facteur 4 par rapport aux Trn2 UltraServers. - Projet Rainier : un cluster EC2 UltraCluster avec des centaines de milliers de puces Trainium2, à l'usage d'Anthropic. - Clients et partenaires cités : Anthropic, Databricks (objectif de 30 % de coût total en moins), poolside (40 % d'économie attendue face aux instances P5), Hugging Face. - Google est cité pour son soutien à l'intégration de JAX avec la pile logicielle d'AWS. ### Pourquoi c'est important AWS propose une alternative aux GPU NVIDIA pour l'entraînement et l'inférence, avec un prix annoncé inférieur. Pour les clients, le choix dépend du portage logiciel : il faut passer par le SDK Neuron, ce qui demande un effort d'ingénierie. Les chiffres de performance restent ceux de l'éditeur. ### À retenir Les hyperscalers font de leurs puces maison une vraie option face à NVIDIA ; Anthropic en est le premier grand client côté AWS.
Liens
Tags : AWS, Puces, Hyperscaler, Anthropic, Conférence