Tag: audit

Affichage 1-12 sur 18

TutorielsRoyaume-Uni
Ouvrir
24 sept. 20267 min de lecturePlaybook AgentsIntermédiaire120 min build

Appliquer des allowlists d'outils et des politiques d'exécution pour agents IA avec CTRLRun dans GitHub Actions (contexte UK)

Ajoutez une étape CTRLRun à votre CI GitHub Actions pour appliquer des politiques d'exécution, produire des journaux d'audit par exécution et restreindre l'accès aux outils des agents. Guide pas à pas, checklist de déploiement et suggestions pour petites équipes.

ActualitésÉtats-Unis
Ouvrir
29 août 20266 min de lectureBrief sortie modèleIntermédiaire

Comment les communautés EDM repèrent la musique générée par IA — guide pratique pour équipes et devs (contexte US)

Les fans et artistes EDM utilisent spectrogrammes, stems et métadonnées pour détecter des pistes probablement générées par IA. Ce guide traduit ces techniques en actions concrètes pour petites équipes, fondateurs et développeurs aux États‑Unis.

TutorielsFrance
Ouvrir
28 août 20266 min de lecturePlaybook AgentsIntermédiaire180 min build

Mesurer les taux de résolution des agents IA avec Terminal-Bench-Science v0.1 sur 70 workflows scientifiques experts

Guide pratique pour reproduire le benchmark Terminal-Bench-Science v0.1, exécuter les 70 tâches publiées, calculer les taux de résolution (meilleur modèle ≈ 30 %) et construire un pipeline d’évaluation léger et auditable.

TutorielsFrance
Ouvrir
12 août 20266 min de lecturePlaybook AgentsIntermédiaire120 min build

Audit et implémentation d’agents négociateurs LLM pour la chaîne d’approvisionnement

Guide pratique en français pour construire, tester et auditer des agents de négociation basés sur LLMs dans des scénarios d’approvisionnement — résumé des résultats expérimentaux (9 840 négociations) et checklist opérationnelle.

TutorielsRoyaume-Uni
Ouvrir
24 juin 20267 min de lectureDeep dive outillageIntermédiaire240 min build

Manuel d'audit : utiliser euromesh pour estimer si les centres de données publics européens (y compris le Royaume‑Uni) peuvent entraîner un modèle d'IA de pointe

Un playbook de quatre heures (prototype) qui transforme le snapshot euromesh en un inventaire, un estimateur à 3 scénarios de GPU‑heures et une checklist décisionnelle d'une page pour juger si le calcul public européen suffit. Le repo de départ : https://github.com/sammysltd/euromesh

TutorielsFrance
Ouvrir
19 juin 20266 min de lecturePlaybook AgentsIntermédiaire90 min build

RootSign : journaux d'audit infalsifiables pour agents IA (open-source)

RootSign est une bibliothèque open-source pour la journalisation infalsifiable des décisions et actions d'agents IA (provenance). Hypothèses : le dépôt peut contenir des intégrations pour CrewAI/LangGraph, un enchaînement de hachage cryptographique (ex. SHA‑256), checkpoints d'approbation humaine, redaction PII et un stockage local Postgres — à vérifier dans le dépôt.

TutorielsÉtats-Unis
Ouvrir
12 juin 20267 min de lectureDeep dive outillageIntermédiaire45 min build

Audit de 45 minutes pour vérifier la revendication selon laquelle Elon Musk a dépassé 1 000 milliards $ après l'IPO SPCX de SpaceX

Un workflow reproductible (≈45 minutes) pour vérifier une affirmation de richesse nette à $1T après l'IPO SPCX — validations à deux sources, entrées traçables, et PDF horodaté pour audit.

TutorielsFrance
Ouvrir
03 juin 20267 min de lecturePlaybook AgentsIntermédiaire480 min build

Identité par instance, chaîne de custodie et contrôle d'outils pour aligner les agents IA avec le règlement européen sur l'IA

Checklist pratique pour rendre les agents IA traçables et contrôlables : identifiants courts par instance, journaux de chaîne de custodie et plan de politique externe pour le contrôle des appels d'outils (inspiré par Cerbos).