
Batuhan Taskaya
@isidentical
« On ne voulait pas tout miser sur un seul modèle pour se retrouver dépassés quand le suivant arriverait. Alors on a construit un moteur d'inférence universel. »
En une phrase
Batuhan Taskaya est un ingénieur turc de 22 ans qui dirige l'ingénierie de fal.ai, une plateforme d'inférence AI valorisée 4,5 Md $. Il commence à programmer des compilateurs à 14 ans et contribue rapidement au cœur du langage Python. Il devient l'un des plus jeunes mainteneurs principaux du langage. Il rejoint ensuite fal comme Head of Engineering et construit un moteur d'inférence capable d'optimiser n'importe quel modèle de médias génératifs. Aujourd'hui, fal héberge plus de 600 modèles pour plus de 2 millions de développeurs et génère entre 285 M $ et 400 M $ de revenus annualisés.
Pourquoi il est sur Ideas.xyz
Batuhan Taskaya a construit un moteur d'inférence généraliste à une époque où la plupart des acteurs optimisaient modèle par modèle. Cette approche a permis à fal.ai de rester pertinent à chaque nouvelle génération de modèles, sans repartir de zéro à chaque fois.
À 14 ans, il commence à coder des compilateurs
Il se forme seul aux compilateurs (programmes qui transforment du code en instructions machines) et contribue au langage Python.
Il devient mainteneur principal de Python
Ses contributions au cœur du langage Python lui valent un rôle officiel de mainteneur, l'un des plus jeunes à ce poste.
Il intègre la Python Software Foundation
La Python Software Foundation (PSF) lui décerne le statut de Fellow, une reconnaissance rare pour quelqu'un de son âge.
Il rejoint fal et construit le moteur d'inférence
Recruté par le CEO Burkay Gur, il conçoit un compilateur universel pour optimiser les modèles de médias génératifs sans les traiter un par un.
fal lève 49 M $ en Series B
La plateforme accélère son développement autour de l'inférence vidéo et audio en temps réel avec ce premier grand tour de table de l'année.
fal atteint 95 M $ d'ARR et lève 125 M $
La Series C valorise fal à 1,5 Md $ alors que la plateforme dépasse 2 millions de développeurs actifs.
fal franchit les 4 Md $ de valorisation
Un tour supplémentaire d'environ 250 M $ propulse la valorisation au-delà de 4 Md $ avec des revenus annualisés autour de 200 M $.
Sequoia mène la Series D à 4,5 Md $ de valorisation
fal lève 140 M $ supplémentaires avec Sequoia, Kleiner Perkins et NVIDIA pour un total de financement d'environ 400 M $.
fal.ai est une plateforme d'inférence sans serveur (serverless) qui permet aux développeurs d'exécuter des modèles d'image, de vidéo et d'audio génératifs via une simple API, sans gérer eux-mêmes les serveurs. La plateforme héberge plus de 600 modèles et s'appuie sur 35 centres de données répartis dans le monde. Elle génère entre 285 M $ et 400 M $ de revenus annualisés et compte plus de 2 millions de développeurs. Ses clients incluent Adobe, Shopify et Canva. Batuhan pilote une équipe de 10 ingénieurs dédiée aux optimisations de performance au niveau du processeur graphique (GPU).
Stratégie Ideas.xyz associée
Cheval de Troie Open-Source
Transformer une bibliothèque open-source gratuite en point d'entrée vers des services payants en créant une dépendance technique chez les développeurs avant de monétiser via des offres premium.
Voir la stratégie →« On ne voulait pas tout miser sur un seul modèle pour se retrouver dépassés quand le suivant arriverait. Alors on a construit un moteur d'inférence universel. »
Podcast Sequoia (2025)
« On est littéralement obsédés par les médias génératifs. L'avance technique que tu peux tenir, c'est trois à six mois maximum. Ce qui compte, c'est de rester focalisé. »
Podcast a16z (2025)
« J'ai commencé à travailler sur les compilateurs à 14 ans. À l'époque, j'étais probablement le plus jeune mainteneur principal du langage Python. »
Podcast Sequoia (2025)
- a16z YouTube - How Fal.ai is Making AI Video Faster & Easier interview with Batuhan Taskaya
https://www.youtube.com/watch?v=NKNYKYoDSNA - a16z Podcast - Performance and Passion: Fal's Approach to AI Inference
https://a16z.com/podcast/speed-performance-and-passion-fals-approach-to-ai-inference - Sequoia Podcast - The Rise of Generative Media: fal's Bet on Video Infrastructure and Speed
https://sequoiacap.com/podcast/the-rise-of-generative-media-fals-bet-on-video-infrastructure-and-speed - fal.ai Blog - Key Takeaways from the First Generative Media Conference
https://blog.fal.ai/key-takeaways-from-the-first-generative-media-conference - Bessemer Venture Partners YouTube - Python in production with Astral and fal AI discussion
https://www.youtube.com/watch?v=KWUPNjtP0gw - Kindred Ventures - Our investment in fal.ai AI inference platform
https://kindredventures.com/announcement/our-investment-in-fal-ai-inference-platform-for-generative-media - Sequoia Capital - Partnering with fal: The Generative Media Company
https://sequoiacap.com/article/partnering-with-fal-the-generative-media-company - TechCrunch - This distributed data storage startup wants to take on Big Cloud mentioning Batuhan Taskaya
https://techcrunch.com/2025/10/09/this-distributed-data-storage-startup-wants-to-take-on-big-cloud - Startuphub.ai - Fal.ai's Blueprint for AI Video Dominance
https://www.startuphub.ai/ai-news/ai-video/2025/fal-ais-blueprint-for-ai-video-dominance-speed-specialization-and-relentless-optimization - fal.ai Blog - Chasing 6 TB/s: an MXFP8 quantizer on Blackwell performance post
https://blog.fal.ai/chasing-6-tb-s-an-mxfp8-quantizer-on-blackwell/