Fiches mémo AI-102

L’essentiel la veille de l’examen : services, paramètres, RAG, safety, quotas et cas SOC.

1. Services Azure AI — qui fait quoi

Associez chaque besoin au bon service, sans hésiter.

BesoinService et fonctionRepère examen
Décrire une image, lire du texte (OCR)Vision Image Analysis 4.0 : captioning, tags, ReadBounding boxes, confidence
VisagesFace : détection libre, identification = accès restreintCas d’usage responsable exigé
Classifieur d’images métierCustom Vision : taguer, entraîner, publier l’itérationPrécision / rappel
Expurger des données personnellesLanguage PII : détection + rédactionPII = Language, pas Safety
Intention d’un botCLU : intentions + entitésProjets de conversation
Base de questions métierCustom Question AnsweringPaires Q/R, score seuil
Réunion multi-locuteursSpeech STT + diarisationQui parle quand
Voix de synthèse / clonéeTTS neuronal / Custom Voice (restreint)Consentement vérifiable
Factures et formulairesDocument Intelligence : prebuilt-invoice, template, neural, composedClé-valeur, tableaux
Toxicité des prompts/réponsesContent Safety : 4 catégories, 0-6Entrée ET sortie

2. Azure OpenAI — modèles et paramètres

Le cœur des 25 % GenAI de l’examen.

ÉlémentÀ retenirValeur / exemple
GPT-4o / miniPolyvalent texte + vision + audio128K contexte, mini = économique
Série oRaisonnement pas à pas (maths, code)Latence plus élevée
EmbeddingsVectorisation pour recherche3-large = 3072, ada-002 = 1536
temperature0 = déterministe, 0.7-1 = créatifFactuel : 0 + JSON + seed
top_pÉchantillonnage nucleusJamais avec temperature ensemble
max_tokensBorne la réponsePrompt + réponse ≤ fenêtre
Rôlessystem (règles), user, assistant, toolTool = résultat d’outil
DéploiementsStandard (token), Provisioned/PTU (horaire), Batch (différé)PTU = débit garanti
QuotasTPM / RPM par déploiement429 = quota dépassé

Prompt système SOC

Rôle + règles + format JSON + citations + « donnée manquante » au lieu d’inventer.

Function calling

Modèle → appel structuré → exécution code → message tool → réponse finale.

Copilote

Topics (dialogues) + knowledge (SharePoint, Dataverse) + actions (API) + garde-fous.

3. RAG et AI Search — pipeline complet

Chunking, index, retrieval : le triptyque anti-hallucination.

ÉtapeRéglages examen
Chunking512-1024 tokens, overlap 10-20 %, par paragraphes, métadonnées (source, page)
EmbeddingsMême modèle requête/index, similarité cosinus, k plus proches voisins
Champ vectorielCollection(Edm.Single), dimensions, profil HNSW (m, efConstruction, efSearch)
IngestionIndexeurs + skillsets (OCR, entités, PII, embeddings) + projections
RequêteHybride BM25 + vectoriel, fusion RRF, semantic ranker L2, top-k 3-10, captions
GénérationPrompt augmenté, citations obligatoires, aveu d’ignorance

Analyseur français

fr.microsoft : accents, élisions, lemmatisation. Mauvais analyseur = rappel effondré.

On Your Data

Liaison no-code déploiement + index avec grounding automatique. Aucun fine-tuning.

k (top-k)

Trop petit = contexte pauvre, trop grand = bruit + saturation de fenêtre.

4. Content Safety — filtrage et attaques

Quatre catégories, deux côtés du flux, deux types d’attaques.

ObjetÀ retenir
CatégoriesHaine, sexualité, violence, automutilation — gravités 0 à 6, seuils par catégorie
PlacementFiltre entrée (prompt) ET sortie (complétion) + journalisation
Jailbreak direct« Ignore tes instructions » → Prompt Shields, requête bloquée
Attaque indirecteInstruction cachée dans un document RAG → Prompt Shields + méfiance envers le contenu récupéré
ComplémentsListes de blocage métier, détection de groundedness, modération d’images

5. Production — réseau, quotas, évaluation, SOC

Ce qui distingue une maquette d’une charge d’examen.

Réseau privé

  • Private Link + accès public Disabled
  • Pare-feu VNet, TLS 1.2+
  • Managed Identity + Key Vault

Coûts et quotas

  • Tokens entrée/sortie par modèle
  • PTU horaire si prévisible
  • Mini, cache, résumés, Batch
  • 429 = TPM/RPM dépassés

Évaluation

  • Groundedness prioritaire
  • Relevance, coherence, fluency
  • Juge LLM calibré
  • Golden dataset rejoué

Supervision

  • Blocages safety, taux d’introuvable
  • Latence p95, tokens, coût
  • Logs complets (audit)

Cas SOC

  • RAG interne + triage + citations
  • Safety entrée/sortie
  • Humain dans la boucle
  • PII expurgées, réseau privé

Seuils de préparation

  • Missions : 56/80 (70 %)
  • Examen blanc : 42/60 (70 %)
  • 100 minutes chrono