Cover of the book “Les gestes”, volume 2 of 6 of Pierre Vinet’s Bibliothèque IA, on a dark background with the accent color orange
AI Library · Volume 2 of 6 · Belt 2

French-language books

The Moves

Original title (in French): Les gestes

What a model can do, modality by modality, and how to chain those moves without ever ceasing to check

  • Chapters 12 to 22
  • 321 pages
  • 33 figures
  • Format 8.5 x 11 in, full color

Coming soon on Amazon

This volume will be published in Kindle and paperback editions. Leave your email to be notified at publication.

Get notified at publication

About this volume

The Moves is the second volume of the Bibliothèque IA, a six-volume collection on artificial intelligence. This is a French-language book. A model can write, summarize, translate, extract, classify, search, analyze data, read images and documents, transcribe meetings and create images or video. These moves look like one, but each one fails in its own way and must be checked in its own way. Confusing them means applying a summary's check to an extraction and letting the error through. This volume teaches each move with the tool that performs it, its real cost and licence, and the way to verify the output, then shows how to chain the moves without ever ceasing to check. Eleven chapters cover the prompt, text, search and synthesis, data analysis and prediction, code, images and OCR, speech and meetings, image creation, video, audio, music and 3D, everyday office tools, and a first combination with fact-checking, copyright, provenance and a pre-publication checklist. The book includes 33 figures, typed call-out boxes, Quebec and Canada notes, a glossary, three appendices and the memo sheet for the second belt. Most of the moves need no code. The volume can be read on its own: it uses ready-made capabilities and points to later volumes for how they are built.

What you will be able to do

  • Break a prompt into blocks, require an output that follows a schema and apply three habits against prompt injection
  • Tell the five text tasks apart (write, summarize, translate, extract, classify) and choose the right check for each
  • Localize a product sheet for Quebec: amounts, taxes, units and terminology, not just the language
  • Extract fields from a document and measure an error rate on a sample reviewed by hand
  • Unmask a fabricated bibliographic reference and apply a published grid for evaluating a source
  • Cost an image, audio or video production before launching it, and read separately the licence of the code, the weights and the outputs
  • Build a chain of three tasks in which every link drops a dated file a human can reread

Table of contents

Partie IV — Les gestes de base : ce qu'un modèle sait faire
  1. 12La consigne : demander, cadrer et structurer
    • 12.1 L'anatomie d'une consigne
    • 12.2 La consigne système, et ce qu'elle contient sans vous
    • 12.3 Les exemples : aucun, un, quelques-uns
    • 12.4 Le réglage du raisonnement
    • 12.5 La sortie structurée
    • 12.6 Les gabarits et les bibliothèques de consignes
    • 12.7 La mise en cache du contexte
    • 12.8 Les premiers réflexes contre l'injection de consignes
  2. 13Le texte : rédiger, résumer, traduire, extraire et classer
    • 13.1 Les cinq gestes du texte, et ce qui les distingue
    • 13.2 Rédiger
    • 13.3 Résumer
    • 13.4 Traduire et localiser
    • 13.5 Extraire des champs d'un document
    • 13.6 Classer et étiqueter
    • 13.7 Vérifier une sortie de texte
  3. 14Chercher et synthétiser l'information
    • 14.1 Pourquoi un modèle seul ne sait pas chercher
    • 14.2 La recherche web assistée
    • 14.3 Les interfaces de recherche destinées aux modèles
    • 14.4 La recherche approfondie
    • 14.5 Les carnets de sources
    • 14.6 La recherche scientifique
    • 14.7 Vérifier une source
  4. 15Analyser des données et prédire
    • 15.1 Le tableur et le modèle : ce que chacun sait faire
    • 15.2 L'interpréteur de code
    • 15.3 Du texte au SQL
    • 15.4 Les copilotes de veille économique
    • 15.5 L'IA prédictive classique
    • 15.6 Les modèles de fondation pour séries temporelles
    • 15.7 Lire un résultat sans se faire avoir
  5. 16Le code : générer, expliquer et corriger
    • 16.1 Les quatre gestes du code, et où s'arrête ce chapitre
    • 16.2 La complétion dans l'éditeur
    • 16.3 La conversation dans l'éditeur
    • 16.4 Expliquer un code qu'on n'a pas écrit
    • 16.5 Corriger, tester et documenter
    • 16.6 Les modèles de code
    • 16.7 Un assistant local sur les trois systèmes
    • 16.8 Ce que mesure vraiment la productivité
  6. 17Voir et lire : images, documents et OCR
    • 17.1 Ce qu'un modèle vision-langage sait faire
    • 17.2 Décrire, comparer et extraire d'une image
    • 17.3 La reconnaissance optique de caractères
    • 17.4 L'analyse de documents : d'un PDF à une structure
    • 17.5 Le traitement intelligent de documents
    • 17.6 La vision par ordinateur appliquée
    • 17.7 Choisir sa chaîne : sur le poste ou dans le nuage
  7. 18Écouter et parler : transcription, voix et réunions
    • 18.1 La reconnaissance vocale
    • 18.2 Les produits de transcription, et les deux migrations
    • 18.3 La synthèse vocale
    • 18.4 Le clonage de voix et le consentement
    • 18.5 Le temps réel
    • 18.6 Le sous-titrage et le doublage
    • 18.7 Les assistants de réunion
  8. 19Créer des images
    • 19.1 Comment on demande une image
    • 19.2 Générer
    • 19.3 Éditer : retouche locale, extension et remplacement
    • 19.4 Contrôler : pose, profondeur, esquisse et image de référence
    • 19.5 Personnaliser : un style, un produit, un visage
    • 19.6 Agrandir et détourer
    • 19.7 Les droits, les licences et la provenance
  9. 20Créer de la vidéo, de l'audio, de la musique et de la 3D
    • 20.1 La vidéo générée : ce qui marche et ce qui ne marche pas
    • 20.2 Les produits de vidéo
    • 20.3 Le montage assisté
    • 20.4 Les avatars et la synchronisation labiale
    • 20.5 La musique et les effets sonores
    • 20.6 La 3D
    • 20.7 Les présentations et le design
    • 20.8 Le coût réel d'une seconde
  10. 21Les gestes au bureau : l'IA dans les outils de travail
    • 21.1 Ce que « l'IA dans les outils » veut dire au juste
    • 21.2 Les suites bureautiques
    • 21.3 Le courriel et le calendrier
    • 21.4 Les documents collaboratifs
    • 21.5 La messagerie d'équipe
    • 21.6 La gestion de projet
    • 21.7 La relation client
    • 21.8 Les navigateurs d'IA
    • 21.9 Ce que voit l'éditeur : données, résidence et journalisation
  11. 22Première combinaison : enchaîner les gestes et vérifier le résultat
    • 22.1 Enchaîner à la main
    • 22.2 Enchaîner par un script
    • 22.3 Ce qui casse dans un enchaînement
    • 22.4 Vérifier les faits et les sources
    • 22.5 Les droits d'auteur et le consentement
    • 22.6 La provenance : C2PA et SynthID
    • 22.7 La détection de contenu généré, et ses limites
    • 22.8 La liste de contrôle avant publication

Excerpt

Une adjointe administrative qui confie un dossier à un nouveau collègue ne lui dit pas seulement ce qu'elle veut. Elle lui dit qui il est dans l'entreprise, ce qu'il a le droit de décider, à qui il s'adresse, sur quel ton, dans quel format, et ce qu'il doit faire s'il ne trouve pas l'information. Le tout tient en deux minutes, et personne n'a l'impression d'avoir fait de l'ingénierie. Une consigne adressée à un modèle de langage est exactement cette conversation-là, à ceci près qu'elle est écrite, répétée intégralement à chaque appel, facturée au jeton, et qu'elle n'est jamais entièrement la vôtre.

Excerpt from “Les gestes” — Chapitre 12, ouverture (avant le § 12.1)

Technical details

TitleLes gestes
SubtitleCe qu'un modèle sait faire, modalité par modalité, et comment enchaîner ces gestes sans jamais cesser de vérifier
Title translated into EnglishThe Moves
SeriesBibliothèque IA
VolumeVolume 2 of 6
AuthorPierre Vinet
PublisherPierre Vinet
LanguageFrench
Chapters11 (12–22)
Pages321
Figures33
Format8.5 x 11 in, color
Planned editionsKindle and paperback

Who it is for

Office professionals (administrative assistants, communications managers, managers, freelancers) who perform these tasks with a model every day; most require no code.

Prerequisites

No prerequisite: volume 1 is useful but not required, and every notion needed is recalled in one sentence with a pointer to its original chapter. Most of the tasks require no code.

Train your teams, or put AI to work in your SME?

These books teach; we also work alongside companies in the field. Let’s talk for thirty minutes about your situation, no strings attached.