JDWJDW
Font ResizerAa
  • Tech & Innovations
  • Mobiles & Apps
  • IA & Robotique
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Geek & Gadgets
  • Véhicules & e-Mobilité
  • Bons plans & promos
  • Plus
    • Blockchain & Crypto
    • Web & Internet
    • Informatique & Cybersécurité
    • Sciences & Espace
    • Réseaux Sociaux & Influence
    • e-Business & Webmarketing
    • Fintech & Néobanques
    • Streaming & P2P
Font ResizerAa
JDWJDW
Rechercher
  • Web & Internet
  • Tech & Innovations
  • Mobiles & Apps
  • Consoles & Jeux Vidéo
  • Films & Séries
  • Animes & Mangas
  • Blockchain & Crypto
  • Geek & Gadgets
  • Informatique & Cybersécurité
  • Streaming & P2P
Avez-vous déjà un compte ? Sign In
Suivez-nous
Tech & Innovations

AMD rachète Taalas, la startup qui grave les modèles d’IA directement dans le silicium

Thibaut Delmas
Published: 8 août 2026
Last updated: 7 août 2026
Partager
Logo officiel AMD avec le nom, sur fond clair, illustrant le rachat de Taalas

AMD a annoncé ce jeudi 6 août 2026 l’acquisition de Taalas, une jeune pousse torontoise fondée en 2023 qui fabrique des puces où les poids des modèles d’intelligence artificielle sont littéralement gravés dans le silicium, transformant chaque circuit en un accélérateur dédié à un modèle unique. Le montant de la transaction n’a pas été divulgué, mais il s’agit bien d’un rachat complet, pas d’un simple acqui-hire destiné à siphonner les cerveaux.

L’idée de Taalas tient en une formule vertigineuse : au lieu de stocker les paramètres d’un réseau neuronal dans de la mémoire HBM puis de les faire transiter vers des unités de calcul généralistes, on les encode dans le métal même de la puce, dans une zone baptisée « mask-ROM recall fabric ». Le résultat est une sorte de circuit intégré spécifique au modèle (un MSIC, si l’on veut forger l’acronyme) qui élimine d’un coup les goulots d’étranglement mémoire et les allers-retours qui plombent les architectures classiques. Le cache KV et les adaptateurs de fine-tuning (type LoRA) sont eux hébergés dans une seconde région en SRAM, préservant un minimum de flexibilité. C’est radical, c’est baroque… et les premiers benchmarks donnent le tournis.

Taalas avait déjà dévoilé en février dernier son premier prototype, le HC1, gravé en 6 nm chez TSMC, un chip de la taille d’un réticule complet qui servait le modèle Llama 3.1 8B de Meta à 16 960 tokens par seconde, soit 48 fois plus vite que les GPU Nvidia de l’époque et 8,5 fois plus vite que les accélérateurs wafer-scale de Cerebras. Le HC2, attendu cet été, devrait grimper à 20 milliards de paramètres par puce. Et comme les poids se répartissent sur plusieurs accélérateurs via du parallélisme de pipeline, il suffirait en théorie de 50 puces HC2 pour faire tourner un modèle d’un trillion de paramètres, là où les systèmes LPX de Nvidia exigeraient plusieurs dizaines de GPU épaulés par au moins 2 000 LPU Groq.

« Nous avons fondé Taalas pour repenser l’inférence IA depuis la base, en construisant le matériel autour du modèle », a déclaré Ljubisa Bajic, cofondateur et PDG de la startup, qui promet que rejoindre AMD offrira à son équipe canadienne l’envergure industrielle et les ressources d’ingénierie nécessaires pour accélérer l’innovation. Du côté d’AMD, Vamsi Boppana, vice-président senior de la division intelligence artificielle, a insisté sur la complémentarité avec la plateforme existante, notamment les racks Helios, les GPU Instinct, les CPU EPYC et la pile logicielle ROCm.

A lire également

Concept : capsule Hyperloop en lévitation dans un tube sur pylônes au-dessus du paysage texan à l'aube, skyline d'Austin, tunnelier en chantier — le tunnel Austin-San Antonio annoncé par Elon Musk et The Boring Company
Elon Musk veut un Hyperloop Austin-San Antonio en moins de 30 minutes chrono
Atlas 1.0, le wearable EEG posé derrière l'oreille qui suit l'activité cérébrale en continu
Atlas 1.0 : le wearable EEG à 499 dollars qui cartographie votre cerveau ouvre ses précommandes
BYD Denza N8L, grand SUV électrique 6 places de 5,20 m, photo officielle du constructeur en extérieur
BYD Denza N8L électrique : le SUV 6 places qui repousse les limites avec 960 km d’autonomie

L’architecture envisagée par AMD semble dessiner un tandem où les GPU Instinct traiteraient la phase de « prefill » (le traitement intensif du prompt d’entrée) tandis que les accélérateurs dérivés de Taalas prendraient en charge la génération de tokens, la partie de l’inférence où la vitesse brute par jeton compte le plus. On peut aussi imaginer un cycle de déploiement en deux temps, les clients validant d’abord leurs modèles sur Instinct avant de basculer vers des puces Taalas une fois le modèle stabilisé.

Car la contrepartie de cette performance incandescente est une rigidité structurelle assumée. Une fois les poids figés dans le silicium, tout changement substantiel du modèle impose un nouveau tirage de masques, c’est-à-dire un nouveau cycle de fabrication. Taalas tempère le problème en affirmant que seules deux couches de métal doivent être modifiées lors d’une mise à jour, ce qui réduit fortement le coût et le délai par rapport à une refonte complète. N’empêche, dans un écosystème où les modèles de fondation se renouvellent presque chaque mois, qui va s’engager à figer un réseau dans le cuivre ?

La réponse se trouve sans doute du côté des grands développeurs de modèles eux-mêmes. OpenAI, Anthropic et Meta sont déjà des clients importants des Instinct d’AMD, et Taalas estimait en février que graver les poids dans le silicium coûte 100 fois moins cher que l’entraînement d’un modèle de frontière. Pour un GPT ou un Claude stabilisé et massivement déployé en production, l’équation économique pourrait devenir irrésistible, surtout si le coût par token chute d’un ordre de grandeur. Cette baisse ouvrirait d’ailleurs la porte à un allongement du raisonnement en « test-time scaling », cette technique qui réduit les hallucinations en laissant le modèle réfléchir plus longtemps, au prix d’une consommation de tokens aujourd’hui prohibitive.

AMD positionne cette acquisition dans le contexte de la croissance explosive du marché de l’inférence, un segment qui pèse déjà bien plus lourd que l’entraînement en volume de calcul déployé et qui attire toutes les convoitises. Nvidia avait elle-même signé en décembre 2025 un accord de licence de 20 milliards de dollars avec Groq, preuve que même le roi incontesté du GPU reconnaît la nécessité de proposer des solutions d’inférence spécialisées au-delà de ses propres architectures.

La clôture de l’opération est attendue au quatrième trimestre 2026, sous réserve des approbations réglementaires habituelles. Si AMD parvient à intégrer la technologie Taalas dans ses racks Helios à un rythme soutenu, le fondeur de Santa Clara disposera d’un argument que Nvidia ne peut pas encore répliquer avec ses seuls GPU : la possibilité d’offrir à ses clients un continuum allant de l’entraînement à l’inférence ultra-optimisée, le tout sous un même toit. Reste à savoir si le marché est prêt à accepter l’idée, presque hérétique à l’ère du logiciel dévorant le monde, qu’un modèle d’IA puisse mériter son propre silicium sur mesure.

Partager cet article
Facebook Whatsapp Whatsapp LinkedIn Reddit Telegram Copy Link

Derniers articles

Oppo A7 Pro Max, showroom concept du lancement européen
Oppo A7 Pro Max : 599 euros et 10 000 mAh, l’endurance record qui débarque en Europe
Mobiles & Apps
Concept illustrant la détection directe d'ondes radio émises par l'aurore de l'exoplanète Beta Pictoris b captées par le radiotélescope MeerKAT
Beta Pictoris b : les astronomes captent les premières aurores d’une exoplanète
Sciences & Espace
PlayStation Rewards, programme de fidélité avec crédits portefeuille PS Store, rendu concept
PS Store : Sony offre 10 $ de cashback surprise après l’achat de jeux PS5
Consoles & Jeux Vidéo
Xiaomi Watch affichant Mi Fitness avec l'AI Health Assistant (résumés santé, plan quotidien, coaching sommeil et workout), visuel concept
Xiaomi préparerait un coach santé IA dans Mi Fitness pour analyser vos nuits et séances de sport
Geek & Gadgets

Tendance

One Piece
One Piece : où voir l’anime en streaming légalement et tous les épisodes en VF et VOSTFR ?
Animes & Mangas
Dark Web
Dark Web : ce que cache réellement la face obscure d’Internet au-delà des mythes
Informatique & Cybersécurité Web & Internet
Key art Saint Seiya Tenkai-hen Then IV, le nouveau chapitre de Kurumada annoncé pour le 18 décembre
Saint Seiya Tenkai-hen Then IV : Kurumada lance le chapitre Zeus le 18 décembre
Animes & Mangas
One UI 9 sur Galaxy Samsung - déploiement de la mise à jour
Samsung One UI 9 : le déploiement se précise pour les Galaxy S26, S25 et S24
Mobiles & Apps
Poco F9 Pro (Aurora Green) et Poco F9 Ultra (Dark Cherry), visuel de lancement généré
Xiaomi lance les Poco F9 Pro et F9 Ultra : deux monstres de puissance et déjà en précommandes à prix cassé
Web & Internet

Vous allez aussi aimer

Leapmotor B05, compacte électrique cinq étoiles ANCAP et Euro NCAP
Tech & Innovations

Leapmotor B05 décroche cinq étoiles ANCAP et Euro NCAP : la compacte chinoise double la mise sur la sécurité

6 septembre 2026
Concept Tesla en Europe : Model Y blanc sur une route qui se divise, skyline européenne (Big Ben, Tour Eiffel, Porte de Brandebourg) et wordmark TESLA, illustrant des ventes à deux vitesses selon les pays
Tech & Innovations

+279 % sur un an en France, -79 % en Norvège : l’incroyable paradoxe des ventes de Tesla en Europe

6 septembre 2026
Audacity 4.0, logo officiel et nouvelle interface audio
Tech & Innovations

Audacity 4 : l’éditeur audio gratuit le plus téléchargé au monde entre dans une nouvelle ère

5 septembre 2026
Rendu conceptuel du stellarator Infinity One de Type One Energy, première centrale à fusion nucléaire commerciale aux États-Unis
Tech & Innovations

Première licence commerciale de fusion nucléaire : le Tennessee ouvre la voie avec le stellarator de Type One Energy

1 septembre 2026
Le réacteur à fusion SPARC de Commonwealth Fusion Systems, tokamak compact en cours d'assemblage dans son hall industriel, anneau de plasma visible
Tech & Innovations

Fusion nucléaire : SPARC atteint 80% d’achèvement, CFS empoche 1 milliard de plus et bouscule le calendrier

25 août 2026
Tesla solar panels installes sur le toit d une maison, avec une Tesla garee dans l allee
Tech & InnovationsVéhicules & e-Mobilité

Tesla enterre le Solar Roof et parie 10,1 milliards de dollars sur une usine solaire texane

21 août 2026
Tesla Semi, camion électrique de Tesla sur autoroute
Tech & Innovations

Einride commande 500 Tesla Semi et s’offre la plus grande flotte de camions électriques au monde

19 août 2026
XPeng P7+, berline électrique, image officielle du constructeur
Tech & Innovations

XPeng franchit le cap des 6 000 livraisons en France et pulvérise ses records à l’export

18 août 2026

Infos légales

  • Mentions légales
  • Politique de confidentialité
  • Nous contacter
  • Partenaires

Maj récentes

Lefant M210 Pro Omni, robot aspirateur laveur avec station, logo officiel Lefant, mise en valeur
Lefant M210 Pro Omni : le prix du robot laveur chute de 720 € en vente flash Amazon
Bons plans & promos
Rendu concept du prototype Snapdragon 8 Elite Extreme Gen 6, die avec Heat Pass Block intégré, texte SNAPDRAGON 8 ELITE EXTREME GEN 6 sur fond rouge Qualcomm
Snapdragon 8 Elite Extreme Gen 6 à J-1 du Summit, le proto 2 nm défie l’A20 Pro d’Apple
Mobiles & Apps
Batman: Knightfall Part 2 Knightquest, Az-Bats, l'armure cybernétique de Jean-Paul Valley (Azrael), key art du film animé DC de Warner
Batman Knightquest : la bande-annonce propulse Azrael sous la cape du Dark Knight
Films & Séries
Fusée de lancement décollant avec les drapeaux français et canadien, illustrant le pacte spatial sur des infrastructures de lancement partagées entre la France et le Canada
Canada-France : Carney et Macron visent des lancements spatiaux partagés depuis Kourou
Sciences & Espace

Qui sommes nous ?

Le Journal du Web alias JDW a été fondé et est édité par des passionnés par l’univers web, nouvelles technologies et de la culture populaire.

Newsletter
Inscrivez-vous à notre newsletter pour recevoir nos derniers articles!
Suivez-nous
Welcome Back!

Sign in to your account

Username or Email Address
Password

Mot de passe oublié ?