Ingénieur Big Data H/F - SOMA
- Paris - 75
- CDI
- Télétravail accepté
- SOMA
Les missions du poste
Vis le conseil So'Smart en rejoignant SOMA, le cabinet de conseil 100 % Data & IA qui met l'IA en production pour de vrai, pas en slides. Pure player depuis 2021, +75 experts, des grands comptes premium, une obsession : que ça marche vraiment.Ce qui fait notre différence :Une méthode, un vrai savoir-faire : AI·MAZING®, pour faire arriver un projet data ou IA jusqu'en production. Et notre école interne, l'AI·MAZING Academy (certifiée Qualiopi), pour monter en compétence tout au long de ton parcours.Le Facteur ×SOMA : l'IA prend le répétitif, toi tu gardes ce qui compte, ton jugement, ton exigence. Ici, l'IA ne te remplace pas, elle te libère. Pourquoi SOMA ? Chez SOMA, les missions ne sont qu'une partie de l'aventure : au-delà des projets clients, tu rejoins l'une de nos Practices. Elles sont le coeur de notre savoir-faire, pilotées par des Practice Managers proches du terrain. Chacune développe les offres SOMA et des assets réutilisables, et chaque consultant y contribue : tes meilleures missions deviennent des offres qu'on reproduit.C'est là qu'on apprend, qu'on partage, qu'on écrit, qu'on anime des workshops et qu'on intervient en avant-vente. Le but ? Créer toujours plus de valeur, ensemble. Si tu as envie d'apprendre, de partager et de construire, tu es au bon endroit.
Les modèles IA ne valent rien sans données solides. Toi, tu bâtis le socle qui les fait tourner en production. Ta mission Chez SOMA, tu conçois, construis et industrialises les architectures Big Data qui alimentent l'analytics et l'IA de nos grands comptes. Pas des pipelines qui dorment dans un POC : des plateformes robustes et scalables, qui tiennent la charge en production et ouvrent de nouveaux usages Data & IA, jusqu'aux cas d'usage GenAI et agentiques. Ce que tu construis Concevoir, développer et industrialiser des pipelines Big Data performants en PySpark et Snowpark (Snowflake). Bâtir des architectures data robustes et scalables, à la hauteur des volumes et des enjeux de nos clients. Garantir la fiabilité de bout en bout : optimisation des bases, qualité, gouvernance et sécurité de la donnée. Faire le pont vers la valeur : intégrer la donnée pour les équipes Data Science et BI, jusqu'aux cas d'usage IA. Assurer une veille active pour garder une longueur d'avance sur les outils et les pratiques.
Le profil recherché
Bac +5 informatique ou école d'ingénieur, 3 ans et + en Data Engineering dans un environnement Big Data. Expertise PySpark et Snowpark (ou Snowflake), solide maîtrise du SQL et de l'optimisation des bases. Bonne connaissance des écosystèmes Big Data (Spark, Hadoop, Hive) et à l'aise dans des environnements complexes qui bougent vite. Tu préfères un pipeline qui tient la charge un dimanche à 3 h du matin à une belle démo qui ne passera jamais en prod.