Comment héberger un LLM (partie 1)
Un serveur GPU, un an d'expérimentations : ce premier article vulgarise ce qu'est réellement un LLM (poids, biais, softmax) avant de le mettre à disposition avec vLLM, le GPU Operator NVIDIA et Kubernetes.
Un serveur GPU, un an d'expérimentations : ce premier article vulgarise ce qu'est réellement un LLM (poids, biais, softmax) avant de le mettre à disposition avec vLLM, le GPU Operator NVIDIA et Kubernetes.
Introduction On a passé la CCAF cette semaine. Autant le dire tout de suite : on est tous les deux juniors, sans des mois d'arbitrages de prod derrière nous, nous savions donc que notre expérience ne nous aiderait pas. Ce qu'on pensait,
DevLille 2026 : Comment l'IA et le pragmatisme bousculent l'ingénierie logicielle Oubliez le vibe coding, les réunions non inclusives et les architectures réseau surdimensionnées. Cette semaine, notre équipe a posé ses valises au DevLille 2026. À l&
Airflow : comprendre le Dynamic Task Mapping
Vous débutez sur un projet data sans profil technique ? Voici un guide pratique pour comprendre les notions clés, poser les bonnes questions et collaborer efficacement avec votre équipe data.
Derrière l'euphorie de l'IA générative : des travailleurs invisibles à 1€ de l'heure, des chatbots qui nous flattent plutôt que de nous informer, et une bulle que ses propres artisans n'osent plus nier.
Skills IA mal testées, mises à jour silencieuses, régressions invisibles : ce guide couvre le cycle de vie complet d'un SKILL.md — du design à l'archivage — avec des evals reproductibles en 3 couches.
UX Research face à l'IA et au Business Design : découvrez le décryptage et les insights clés de 5 talks marquants du festival UXinsight.
Retour d'expérience collectif Ippon sur TechReady 2026 (Nantes) : l'AI-Driven Development face à la réalité du delivery. Cinq enseignements sur les agents de code, le context engineering, le coût des tokens et la responsabilité humaine.
L’IA dans le sport, tout le monde en parle. Le player tracking en NBA, les analyses xG en football, les capteurs GPS dans les maillots… Mais, quand on creuse un peu, on se rend compte que certains sports restent les grands oubliés de cette r&
Retour sur le meetup Apache Airflow 3.2 organisé par Astronomer et Ippon Technologies à Paris : Partition Keys pour propager le contexte entre DAGs, Async @task pour paralléliser les micro-tâches, et un REX concret sur l'industrialisation d'Airflow à grande échelle.
L'édition 2026 du Devoxx décrypte les avancées majeures de l'IA sur l'ingénierie logicielle, des architectures multi-agents à l'informatique quantique et aux stratégies pour maintenir la qualité du code.
Découvrez Docker Bake pour standardiser vos builds Docker. Cette surcouche déclarative de Buildx offre parallélisation intelligente, cache partagé et multi-plateforme.
L'IA sur le banc de touche : les défis de l'intégration logicielle dans le rugby. Analyse des étapes cruciales pour déployer des solutions de Deep Learning : de la gestion de la qualité vidéo à l'adoption par les coachs, pour une technologie au service de l'humain.
Du Prompt-Driven Development au multi-agent orchestré : j'ai confié un projet entier à Liza, un système multi-agent open source. Ce que j'en retiens, ce que ça coûte, et pourquoi le craft fait toute la différence.