AI News
Articles techniques sur l'intelligence artificielle, consommables par les humains comme par les agents IA.
Sur iPhone/iPad : appuyez sur Partager puis « Sur l'écran d'accueil » pour activer les notifications.
Catégories
Derniers articles
-
Outils de productivité IA : le grand comparatif de juillet 2026
Montage vidéo agentique, présentations, synthèse vocale, LLM locaux et top 10 : le comparatif des outils de productivité IA, vérifié en juillet 2026.
15 min de lecture ProductivitéOutils IALLM -
Évaluer un LLM : le pattern LLM-as-a-judge
Mesurer la qualité d'un LLM sans réponse unique : limites des métriques, LLM-as-a-judge (modes, biais, mitigations), accord humain, arènes Elo, HELM.
11 min de lecture LLMÉvaluationQualité -
Embeddings et recherche vectorielle, expliqués
Un embedding transforme un texte en vecteur de sens. Apprentissage (word2vec, contrastif), similarité cosinus, ANN (HNSW/IVF/PQ), bases vectorielles, MTEB.
12 min de lecture EmbeddingsRAGRecherche vectorielle -
Agents IA et systèmes multi-agents, expliqués
La boucle penser-agir-observer, ReAct, outils, mémoire et réflexion ; patrons multi-agents (orchestrateur-workers), frameworks, évaluation et modes d'échec.
13 min de lecture Agents IAMulti-agentsOrchestration -
Modèles de raisonnement et test-time compute
Pourquoi dépenser du calcul à l'inférence : CoT, o1/o3, DeepSeek-R1 (GRPO, « aha moment »), best-of-N, PRM, recherche, lois de scaling, limites.
18 min de lecture RaisonnementTest-time computeRL -
MCP : donner des outils aux agents IA
Le Model Context Protocol standardise la connexion des LLM aux outils et aux données : architecture, primitives, transports, sécurité, écosystème 2026.
10 min de lecture MCPAgents IAOutils -
Agentic RAG et GraphRAG : raisonner et structurer au-dessus de la récupération
Au-delà du RAG naïf : boucles agentiques (Self-RAG, CRAG, routage, multi-hop), hybride + rerank, et GraphRAG (entités, Leiden, résumés). Coûts et RAGAS.
13 min de lecture RAGGraphRAGAgents IA -
Sécurité des agents IA : prompt injection et guardrails
Pourquoi les agents IA créent un nouveau risque : injection de prompt directe/indirecte, trifecta létale, OWASP LLM Top 10, et défenses en profondeur.
13 min de lecture SécuritéPrompt injectionAgents IA -
Modèles multimodaux et Vision-Language-Action (VLA)
De CLIP et ViT aux VLM (LLaVA, Flamingo, GPT-4o) puis aux VLA pour la robotique (RT-2, OpenVLA, π0) : fusion des modalités et action comme tokens.
15 min de lecture MultimodalVLARobotique -
State Space Models et Mamba (au-delà des Transformers)
SSM classiques, S4 (HiPPO, Long Range Arena), sélectivité de Mamba, dualité Mamba-2 et hybrides Jamba. Coût linéaire vs attention quadratique.
16 min de lecture SSMMambaArchitecture -
Fine-tuning et post-training (LoRA, DPO, RLHF)
Le pipeline de post-training : SFT, RLHF (reward model + PPO) et DPO, plus LoRA/QLoRA. Quand affiner vs RAG vs prompt engineering.
15 min de lecture Fine-tuningLoRARLHF -
Contexte long et gestion du KV-cache
Pourquoi le contexte long est coûteux : attention O(n²) et KV-cache linéaire. MQA/GQA, FlashAttention, PagedAttention, RoPE/YaRN, attention sinks.
12 min de lecture Contexte longKV-cacheInférence -
Mixture-of-Experts (MoE) à grande échelle
MoE : routeur, routage top-k, perte d'équilibrage, capacité, parallélisme d'experts. Paramètres totaux vs actifs (Switch, GLaM, Mixtral, DeepSeek-V3).
16 min de lecture MoEArchitectureScaling -
Quantization et inférence efficace des LLM
Formats FP32/FP16/BF16/FP8/INT8/INT4, GPTQ, AWQ, SmoothQuant, GGUF, NF4, outliers, batching continu, PagedAttention et décodage spéculatif.
13 min de lecture QuantizationInférencePerformance