Smallest.ai lève 13 M$ pour des IA vocales en temps réel et quasi humaines
- 01Smallest.ai développe des modèles vocaux légers pour des conversations en temps réel sans latence perceptible.
- 02En cas de question complexe, le système bascule vers un LLM plus large, mimant une recherche d'information humaine.
- 03La startup a levé 13 M$ en série A, portant son total à plus de 21 M$, avec des clients comme RingCentral et Truecaller.

Smallest.ai, une startup fondée fin 2024, lève 13 millions de dollars en série A pour développer des modèles vocaux ultra-rapides conçus pour imiter les interactions humaines en temps réel.
L’entreprise mise sur des modèles vocaux spécialisés et légers, plutôt que sur l’optimisation de grands modèles de langage (LLM), afin de reproduire le fonctionnement naturel d’une conversation. Contrairement aux approches classiques où l’IA traite un bloc de texte ou d’audio avant de répondre, la technologie de Smallest.ai permet d’écouter, de traiter et de parler simultanément, réduisant ainsi les latences perçues comme artificielles. Le fondateur et PDG, Sudarshan Kamath, souligne que cette méthode s’inspire du comportement humain : l’interlocuteur peut interrompre ou réagir à tout moment, sans attendre une réponse complète.
En cas de question hors de son domaine de compétence, le modèle de Smallest.ai bascule vers un LLM plus large, simulant une recherche d’information comme le ferait un humain. Cette approche hybride vise à concilier réactivité et précision, tout en évitant les pauses prolongées qui trahissent une interaction automatisée. La startup cible spécifiquement les nuances vocales : gestion des accents, multilingue, et fonctionnement dans des environnements bruyants. Ses clients actuels incluent des acteurs du secteur vocal comme RingCentral et Truecaller, ainsi que des entreprises de support client émergentes.
Le financement de 13 M$, mené par Seligman Ventures avec la participation de Sierra Ventures et 3one4 Capital, porte le total levé par Smallest.ai à plus de 21 millions de dollars. L’objectif affiché est de rendre les assistants vocaux indistinguables d’un humain lors d’appels téléphoniques, une promesse qui repose sur une architecture technique distincte des solutions existantes.
Articles liés
Hugging Face et Cerebras déploient Gemma 4 pour l'IA vocale temps réel
Découvrez comment une collaboration entre Hugging Face et Cerebras rend l'IA vocale temps réel accessible aux développeurs.

Netflix utilise une voix IA de Gene Wilder pour son émission de télé-réalité Wonka
Une émission de télé-réalité s'appuie sur une synthèse vocale IA pour recréer la voix d'un acteur emblématique.
OpenAI enrichit son API vocale et Thinking Machines lance un modèle temps réel
Découvrir les innovations d'OpenAI en matière d'interaction vocale et le nouveau modèle de Thinking Machines pour des interactions humaines en temps réel.