JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Plus
    • Web & Internet
    • Geek & Gadgets
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
Tech & Innovations

AMD rachète Taalas, la startup qui grave les modèles d’IA directement dans le silicium

Thibaut Delmas
Published: 8 août 2026
Last updated: 7 août 2026
Partager
Logo officiel AMD avec le nom, sur fond clair, illustrant le rachat de Taalas

AMD a annoncé ce jeudi 6 août 2026 l’acquisition de Taalas, une jeune pousse torontoise fondée en 2023 qui fabrique des puces où les poids des modèles d’intelligence artificielle sont littéralement gravés dans le silicium, transformant chaque circuit en un accélérateur dédié à un modèle unique. Le montant de la transaction n’a pas été divulgué, mais il s’agit bien d’un rachat complet, pas d’un simple acqui-hire destiné à siphonner les cerveaux.

L’idée de Taalas tient en une formule vertigineuse : au lieu de stocker les paramètres d’un réseau neuronal dans de la mémoire HBM puis de les faire transiter vers des unités de calcul généralistes, on les encode dans le métal même de la puce, dans une zone baptisée « mask-ROM recall fabric ». Le résultat est une sorte de circuit intégré spécifique au modèle (un MSIC, si l’on veut forger l’acronyme) qui élimine d’un coup les goulots d’étranglement mémoire et les allers-retours qui plombent les architectures classiques. Le cache KV et les adaptateurs de fine-tuning (type LoRA) sont eux hébergés dans une seconde région en SRAM, préservant un minimum de flexibilité. C’est radical, c’est baroque… et les premiers benchmarks donnent le tournis.

Taalas avait déjà dévoilé en février dernier son premier prototype, le HC1, gravé en 6 nm chez TSMC, un chip de la taille d’un réticule complet qui servait le modèle Llama 3.1 8B de Meta à 16 960 tokens par seconde, soit 48 fois plus vite que les GPU Nvidia de l’époque et 8,5 fois plus vite que les accélérateurs wafer-scale de Cerebras. Le HC2, attendu cet été, devrait grimper à 20 milliards de paramètres par puce. Et comme les poids se répartissent sur plusieurs accélérateurs via du parallélisme de pipeline, il suffirait en théorie de 50 puces HC2 pour faire tourner un modèle d’un trillion de paramètres, là où les systèmes LPX de Nvidia exigeraient plusieurs dizaines de GPU épaulés par au moins 2 000 LPU Groq.

« Nous avons fondé Taalas pour repenser l’inférence IA depuis la base, en construisant le matériel autour du modèle », a déclaré Ljubisa Bajic, cofondateur et PDG de la startup, qui promet que rejoindre AMD offrira à son équipe canadienne l’envergure industrielle et les ressources d’ingénierie nécessaires pour accélérer l’innovation. Du côté d’AMD, Vamsi Boppana, vice-président senior de la division intelligence artificielle, a insisté sur la complémentarité avec la plateforme existante, notamment les racks Helios, les GPU Instinct, les CPU EPYC et la pile logicielle ROCm.

L’architecture envisagée par AMD semble dessiner un tandem où les GPU Instinct traiteraient la phase de « prefill » (le traitement intensif du prompt d’entrée) tandis que les accélérateurs dérivés de Taalas prendraient en charge la génération de tokens, la partie de l’inférence où la vitesse brute par jeton compte le plus. On peut aussi imaginer un cycle de déploiement en deux temps, les clients validant d’abord leurs modèles sur Instinct avant de basculer vers des puces Taalas une fois le modèle stabilisé.

A lire également

Samsung Galaxy S26 FE, rendu concept sur fond techno abstrait
Samsung Galaxy S26 FE : la certification FCC trahit une puce Qualcomm que personne n’attendait
iPhone 18 pro concept
Apple préparerait trois nouveaux iPhone pour le printemps 2027 : changement de calendrier historique ?
crowdstrike
CrowdStrike et AWS poussent la sécurité cloud dopée à l’IA : vers des SOC plus automatisés ?

Car la contrepartie de cette performance incandescente est une rigidité structurelle assumée. Une fois les poids figés dans le silicium, tout changement substantiel du modèle impose un nouveau tirage de masques, c’est-à-dire un nouveau cycle de fabrication. Taalas tempère le problème en affirmant que seules deux couches de métal doivent être modifiées lors d’une mise à jour, ce qui réduit fortement le coût et le délai par rapport à une refonte complète. N’empêche, dans un écosystème où les modèles de fondation se renouvellent presque chaque mois, qui va s’engager à figer un réseau dans le cuivre ?

La réponse se trouve sans doute du côté des grands développeurs de modèles eux-mêmes. OpenAI, Anthropic et Meta sont déjà des clients importants des Instinct d’AMD, et Taalas estimait en février que graver les poids dans le silicium coûte 100 fois moins cher que l’entraînement d’un modèle de frontière. Pour un GPT ou un Claude stabilisé et massivement déployé en production, l’équation économique pourrait devenir irrésistible, surtout si le coût par token chute d’un ordre de grandeur. Cette baisse ouvrirait d’ailleurs la porte à un allongement du raisonnement en « test-time scaling », cette technique qui réduit les hallucinations en laissant le modèle réfléchir plus longtemps, au prix d’une consommation de tokens aujourd’hui prohibitive.

AMD positionne cette acquisition dans le contexte de la croissance explosive du marché de l’inférence, un segment qui pèse déjà bien plus lourd que l’entraînement en volume de calcul déployé et qui attire toutes les convoitises. Nvidia avait elle-même signé en décembre 2025 un accord de licence de 20 milliards de dollars avec Groq, preuve que même le roi incontesté du GPU reconnaît la nécessité de proposer des solutions d’inférence spécialisées au-delà de ses propres architectures.

La clôture de l’opération est attendue au quatrième trimestre 2026, sous réserve des approbations réglementaires habituelles. Si AMD parvient à intégrer la technologie Taalas dans ses racks Helios à un rythme soutenu, le fondeur de Santa Clara disposera d’un argument que Nvidia ne peut pas encore répliquer avec ses seuls GPU : la possibilité d’offrir à ses clients un continuum allant de l’entraînement à l’inférence ultra-optimisée, le tout sous un même toit. Reste à savoir si le marché est prêt à accepter l’idée, presque hérétique à l’ère du logiciel dévorant le monde, qu’un modèle d’IA puisse mériter son propre silicium sur mesure.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Logo Netflix en rouge avec la mention 4K sur fond noir
Netflix débloque enfin le 4K dans Google Chrome sur Windows 11 : la fin d’une frustration vieille de plusieurs années
Web & Internet
Google Pixel Watch 5, rendu concept avec cadran affiché avant la keynote Made by Google
Pixel Watch 5 : Google doublerait le stockage à 64 Go, mais laisserait la batterie au même niveau
Mobiles & Apps
Concept : un immense vaisseau discoïde non identifié survolant la Lune, fond étoilé
OVNIs géants près de la Lune : l’étude ukrainienne qui enflamme le web se heurte au mur de la physique
Sciences & Espace
Art officiel OpenAI du navigateur IA ChatGPT Atlas
ChatGPT Atlas : OpenAI débranche son navigateur IA ce 9 août, dix mois à peine après son lancement
Web & Internet

Tendance

ios 27
iOS 27 en bêta publique : Siri dopé à l’IA arrive enfin sur iPhone
Mobiles & Apps
iphone 18 pro concept
Foxconn lance son recrutement massif pour produire l’iPhone 18 Pro avant septembre
Mobiles & Apps
Windows 11
Windows 11 démembre Phone Link : la synchronisation Android s’installe au cœur du système
Informatique & Cybersécurité Mobiles & Apps
CyberGhost VPN
CyberGhost VPN casse son prix à 1,59 €/mois : 88 % de remise et 2 mois offerts
Informatique & Cybersécurité
ps6 concept
PlayStation abandonne les jeux physiques : le vrai visage de la PS6 se dessine
Consoles & Jeux Vidéo

Vous allez aussi aimer

robot humanoide marathon
IA & RobotiqueTech & Innovations

Un robot humanoïde pulvérise le record du semi-marathon

21 avril 2026
Tech transformation numérique
Tech & Innovations

Le Kazakhstan renforce ses ambitions dans les nouvelles technologies

13 juin 2023
Reformulation de texte par IA
Tech & Innovations

Top 5 des meilleurs sites IA pour reformuler un texte / paraphraser

19 février 2025
deepseek
Tech & Innovations

DeepSeek lance sa version 3.1 avec 685 milliards de paramètres et fait disparaitre R1

21 août 2025
AppleGPT
Tech & Innovations

IA : Apple prépare en secret AppleGPT pour concurrencer ChatGPT

21 juillet 2023
Main de bot intelligent
Tech & Innovations

AutoGPT : le modèle autonome basé sur GPT-4 repousse les limites de l’IA

14 avril 2023
ARC AGI
Tech & Innovations

Qu’est ce que ARC AGI, le benchmark qui mesure la véritable intelligence des IA ?

17 juillet 2025
A dramatic split-scene illustration of the American workforce being consumed by artificial intelligence: on one side, to
Tech & Innovations

L’IA dévore l’emploi américain et les chiffres s’affolent

24 mars 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Concept de puce IA sur fond techno sombre avec le logo Anthropic, illustration de l'équipe de conception de puces pour Claude
Anthropic veut concevoir ses propres puces IA pour Claude : la guerre du silicium entre dans une nouvelle dimension
IA & Robotique
interdiction reseaux sociaux moins de 15 ans
France : les réseaux sociaux interdits aux moins de 15 ans, une loi historique entre ambition et vertige technique
Réseaux Sociaux & Influence
Logo officiel Meta, symbole bleu en boucle avec le nom de la marque
Meta condamné à 567 millions de dollars au Nouveau-Mexique : la facture colossale de l’insécurité des mineurs en ligne
Réseaux Sociaux & Influence
tubi
Tubi lance une app native dans ChatGPT : le streaming gratuit entre dans l’ère de la découverte conversationnelle
Streaming & P2P Tech & Innovations

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?