re:Invent 2025 : les UltraServers Trainium3 d'AWS en disponibilité générale

2025-12-02 · Éditeur : AWS · Domaine : Cloud & DevOps

À re:Invent 2025, AWS déclare en disponibilité générale ses EC2 Trn3 UltraServers, fondés sur Trainium3, sa première puce d'IA en 3 nm. AWS annonce jusqu'à 4,4 fois la performance des Trn2 UltraServers, avec 144 puces par serveur.

Ce qui change

  • Les EC2 Trn3 UltraServers (Trainium3, 3 nm) sont en disponibilité générale le 2 décembre 2025.
  • Jusqu'à 144 puces et 362 pétaflops FP8 par UltraServer, avec 20,7 To de HBM3e.
  • AWS annonce jusqu'à 4,4 fois la performance des Trn2 UltraServers (chiffre de l'éditeur).
  • Graviton5 (192 cœurs) est présenté en préversion pendant la même conférence.

### Ce qui change Le 2 décembre 2025, pendant re:Invent, AWS annonce la disponibilité générale des Amazon EC2 Trn3 UltraServers, équipés de Trainium3, sa quatrième génération de puce d'IA et la première gravée en 3 nm. L'annonce suit celle de décembre 2024, où AWS avait promis Trainium3 pour fin 2025. AWS présente aussi Graviton5, son processeur généraliste, en préversion. ### Caractéristiques - Par puce Trainium3 : 2,52 pétaflops en FP8, 144 Go de mémoire HBM3e et 4,9 To/s de bande passante mémoire. - Un Trn3 UltraServer assemble jusqu'à 144 puces (362 pétaflops FP8), avec 20,7 To de HBM3e et 706 To/s de bande passante mémoire agrégée ; les UltraClusters 3.0 peuvent atteindre des centaines de milliers de puces. - Selon AWS : jusqu'à 4,4 fois la performance, 3,9 fois la bande passante mémoire et 4 fois la performance par watt des Trn2 UltraServers. - Sur Amazon Bedrock, Trainium3 sert déjà des charges de production, avec jusqu'à 3 fois la performance de Trainium2. - Graviton5 (préversion) : 192 cœurs par puce et jusqu'à 25 % de performance en plus que la génération précédente, selon AWS. - Des clients comme Anthropic, Ricoh ou Metagenomi annoncent jusqu'à 50 % de coûts d'entraînement et d'inférence en moins avec Trainium. ### Pourquoi c'est important AWS poursuit un rythme annuel de renouvellement de ses puces d'IA et de ses processeurs maison. Pour les équipes qui entraînent ou servent des modèles, cela rend crédible un choix hors GPU NVIDIA, avec le coût de portage logiciel via le SDK Neuron. Les gains cités sont ceux de l'éditeur et dépendent des charges. ### À retenir Trainium3 arrive comme prévu : AWS tient sa feuille de route de silicium d'IA un an après l'avoir annoncée.

Liens

Tags : AWS, Puces, Hyperscaler, IA, Conférence