Tiiny AI a dévoilé ce que le Guinness World Records a vérifié comme étant le plus petit supercalculateur personnel d'IA au monde. Il s'appelle Tiiny AI Pocket Lab et, bien qu'il ait à peu près la taille d'une banque d'alimentation, il promet des niveaux de performances qui nécessitent normalement un matériel très coûteux. D'autres petits supercalculateurs tels que le Project Digits de NVIDIA, au prix d'environ 3 000 €, et le DGX Spark, au prix de 4 000 €, se situent à des prix qui les mettent hors de portée de la plupart des utilisateurs quotidiens.


Tiiny AI affirme que le véritable goulot d'étranglement actuel de l'IA n'est pas la puissance de calcul mais notre dépendance à l'égard du cloud. Samar Bhoj, directeur de GTM, déclare que « l'intelligence ne devrait pas appartenir aux centres de données, mais aux personnes ». En exécutant de grands modèles localement, le Pocket Lab vise à réduire la dépendance au cloud, à améliorer la confidentialité et à donner l'impression que l'IA avancée est personnelle plutôt que distante.
La technologie qui alimente le supercalculateur de Tiiny AI
Le Pocket Lab ne mesure que 14,2 × 8 × 2,53 cm et ne pèse que 300 grammes, mais la société affirme pouvoir déployer de grands modèles de langage comportant jusqu'à 120 milliards de paramètres. Les modèles de cette taille sont normalement associés à des racks de serveurs ou à des GPU professionnels, mais Tiiny AI souhaite apporter cette fonctionnalité à un appareil qui tient dans votre main.


Le Pocket Lab est construit sur le dernier processeur ARM v9.2 à 12 cœurs et prend en charge les modèles open source populaires tels que GPT-OSS, Llama, Qwen, DeepSeek, Mistral et Phi. Au cœur de l'appareil se trouve une unité de traitement neuronale discrète capable de délivrer 190 TOPS. Il comprend également 80 Go de mémoire LPDDR5X, ce qui permet une quantification agressive afin que des modèles massifs puissent s'exécuter localement sans dépendre de l'infrastructure cloud.


Tiiny AI a également intégré deux technologies clés dans le système. TurboSparse est une méthode d'activation clairsemée au niveau des neurones qui améliore l'efficacité de l'inférence sans réduire l'intelligence du modèle. PowerInfer est un moteur d'inférence hétérogène qui répartit les charges de travail d'IA entre le CPU et le NPU, offrant ainsi des performances de niveau serveur tout en maintenant la demande d'énergie à un faible niveau. Cette combinaison fait du Pocket Lab une option intéressante pour toute personne expérimentant l’IA locale, que ce soit pour la recherche, la robotique ou des tâches de raisonnement avancées.
Tiiny AI prévoit de présenter l'appareil au CES 2026. Les détails des prix et de la version sont encore secrets, mais l'industrie surveillera de près les performances d'un supercalculateur aussi petit une fois qu'il atteindra de vrais utilisateurs.








