human data.Nous joindre

Assurance

L’IA en assurance, des documents de réclamation aux vidéos de conduite

Des professionnels canadiens de l’assurance étiquettent les documents, les vidéos et les décisions, et testent les modèles qui agissent à partir de ceux-ci, en anglais et en français.

Vidéo sous licence avec les suivis d’objets de Human Data tracés dans le navigateur. Les suivis sont des résultats d’annotation, pas de l’inférence en direct.

Ce que nous livrons

Quatre axes de travail en assurance, chacun avec un référentiel ou un jeu de données public comme point de départ et une couche canadienne ajoutée par nos spécialistes.

Documents de réclamation, EN / FR

Libellés de polices, formulaires de réclamation, estimations et correspondance étiquetés par champ et liés aux passages sources, dans les deux langues. Les évaluations vérifient l’extraction, l’interprétation des garanties et l’escalade lorsque l’information manque.

  • Extraction de champs
  • Libellé des garanties
  • Bilingue

Vidéos de conduite et télématique

Vidéos routières et images de l’habitacle étiquetées pour les objets, les événements et le comportement du conducteur, de l’arrêt sécuritaire à la distraction. Utilisées pour les programmes de récompenses, les preuves de réclamation et les modèles de comportement.

  • Suivi d’objets
  • Comportement du conducteur
  • Horodatage des événements

Décisions de souscription et de garantie

Tâches d’appétit, d’admissibilité, de limites et de recommandation de produits sur des lignes directrices et des données de demande. Les spécialistes notent la décision et le raisonnement.

  • Appétit
  • Classification
  • Lignes directrices

Connaissances en assurance du Québec

Questions et scénarios en droit civil québécois et selon le matériel de certification des représentants en assurance, en français. L’écart entre la performance en anglais et en français est mesuré, pas présumé.

  • Droit civil
  • Matériel de certification
  • Le français d’abord

Documents de réclamation

Un seul dossier à partir de deux langues

Les champs de documents d’assurance en anglais et en français sont repérés, extraits et alignés en un seul dossier structuré. Les spécialistes lient chaque valeur extraite à son passage source et signalent ce que le document n’appuie pas.

Traitement de documents d’assurance

Vidéos de conduite

Le comportement, pas seulement les objets

Les programmes de récompenses et les preuves de réclamation dépendent de ce qu’un conducteur a fait, et non seulement de ce que la caméra a vu. Les annotateurs étiquettent les événements, les interactions et les résultats avec horodatage, et évaluent les descriptions des modèles par rapport aux vidéos.

Annotation vidéo

Les référentiels publics sur lesquels nous bâtissons

Résultats publiés pour des modèles à poids ouverts que vous pouvez exécuter vous-même. Notre travail canadien ajoute le droit civil québécois, les documents bilingues et les produits que les assureurs canadiens vendent réellement.

Référentiel public

AEPC-QA · certification en assurance du Québec

807 questions à choix multiples en français, numérisées à partir des manuels de certification des représentants en assurance du Québec, en droit civil québécois.

Publié par
Beauchemin & Khoury, Université Laval, arXiv 2603.07825
Échelle
807 questions · 51 modèles · livre fermé et avec recherche documentaire
Mesure
Exactitude (%), livre fermé / avec recherche documentaire (hasard : 25 %)
ModèleLivre ferméLivre ferméAvec recherche
DeepSeek-R1 (deepseek-reasoner)Poids ouvertsDeepSeek · licence MIT36,3 %71,77 %
R1-1776Poids ouvertsPerplexity · licence MIT49,38 %69,09 %
DeepSeek-V3 (deepseek-chat)Poids ouvertsDeepSeek · licence MIT58,23 %67,78 %
Qwen3-30B-A3BPoids ouvertsAlibaba · Apache 2.054,77 %37,78 %
QwQ-32BPoids ouvertsAlibaba · Apache 2.051,36 %27,49 %
Llama-3.3-70B-InstructPoids ouvertsMeta · licence Llama61,48 %0,99 %
Llama-3.3-Nemotron-Super-49BPoids ouvertsNVIDIA · poids ouverts47,2 %3,09 %
Granite-3.2-8B-InstructPoids ouvertsIBM · Apache 2.030 %30,86 %

Meilleur résultat global : o3 à 76,13 % à livre fermé et 78,68 % avec recherche. La recherche documentaire fait gagner 35 points à DeepSeek-R1 et fait chuter Llama-3.3-70B à 0,99 %, sous le hasard : le modèle cesse de respecter le format de réponse.

Publié par Beauchemin & Khoury, Université Laval, arXiv 2603.07825; mars 2026. Résultats tels que rapportés par les auteurs, et non des exécutions de Human Data. Statut des poids ouverts vérifié auprès de l’éditeur de chaque modèle, octobre 2026.

Référentiel public

Underwrite

Souscription en assurance commerciale de dommages : appétit, admissibilité, limites et franchises, recommandation de produits, classification d’entreprises et admissibilité des petites entreprises, avec outils SQL et consultation de lignes directrices sur une base de données et des règles d’affaires propriétaires.

Publié par
Snorkel AI, arXiv 2602.00456
Échelle
300 tâches à plusieurs tours issues de 3 000 profils de demandeurs synthétisés · 13 modèles
Mesure
Exactitude (%), juge LLM concordant à plus de 95 % avec les annotations d’experts
ModèleExactitudeExactitude
DeepSeek V3.1Poids ouvertsDeepSeek · licence MIT73,7 %
Qwen3 Coder 480BPoids ouvertsAlibaba · Apache 2.073,3 %
Kimi K2 InstructPoids ouvertsMoonshot AI · MIT modifiée56,7 %
Qwen3 235BPoids ouvertsAlibaba · Apache 2.030 %
gpt-oss-120bPoids ouvertsOpenAI · Apache 2.030 %

Meilleur résultat global : Claude Sonnet 4.5, 90,3 %. Les petits modèles ont inventé des produits d’assurance absents des lignes directrices dans 58 à 66 % des échecs; la fiabilité sur quatre tentatives (pass@k) chute d’environ 20 points.

Publié par Snorkel AI, arXiv 2602.00456; janvier 2026. Résultats tels que rapportés par les auteurs, et non des exécutions de Human Data. Statut des poids ouverts vérifié auprès de l’éditeur de chaque modèle, octobre 2026.

Jeux de données de vidéos et de vision

Les jeux de données publics de conduite et de vision en assurance établissent la base pour les étiquettes d’objets et de comportements. Notre travail sur les vidéos ajoute les routes, les saisons et la signalisation du Canada, ainsi que les étiquettes de comportement dont un expert en sinistres a besoin.

22 424images prises dans l’habitacle

State Farm Distracted Driver Detection

10 classes, de la conduite sécuritaire aux textos, à l’usage du téléphone, au geste vers l’arrière, à la boisson et à la conversation avec un passager.

State Farm · Kaggle, 2016
100 000clips vidéo de conduite d’environ 40 secondes

BDD100K

10 tâches de perception : boîtes d’objets, zone carrossable, marquage des voies, segmentation et plus; recueillis auprès de plus de 50 000 trajets.

UC Berkeley
4branches d’assurance : auto, habitation, santé, agricole

INS-MMBench

22 tâches fondamentales, 12 méta-tâches et 5 tâches de scénario pour les modèles vision-langage; 11 modèles évalués.

ICCV 2025

Référentiels de l’industrie en cours

2volets : souscription, réclamations et garanties

InsureBench

Cas fondés sur des documents rédigés avec des souscripteurs et des experts en sinistres en exercice, notés pass@1. Classement attendu en 2026.

Huzzle Labs
629cas de test d’injection d’invites sur 97 tâches

AgentDojo

Quatre suites dont une bancaire. Résultat publié à poids ouverts : Llama 3 70B accomplit 34,02 % des tâches, 18,28 % sous attaque; 25,60 % des injections réussissent.

ETH Zurich · NeurIPS 2024

Environnements RL au Canada

Des environnements RL pour l’assurance

Des tâches simulées de réclamation, de renouvellement et de souscription où un modèle agit au nom d’un assuré et où une récompense rédigée par des spécialistes note ce qu’il a fait. Construits sur les libellés de polices du Québec et de common law, en anglais et en français.

Tâches

  • Avis de sinistre et ouverture de réclamation
  • Questions de garantie selon le libellé de la police
  • Renouvellements sans changement de garantie
  • Changements de conducteur et de véhicule
  • Triage en souscription : appétit, classification, limites

Récompenses

  • Bonne police, bonne branche, bonne franchise
  • Changements de garantie divulgués, jamais silencieux
  • Exclusions et conditions appliquées telles qu’écrites
  • Escalade vers un expert en sinistres ou un souscripteur lorsque requis
  • Parité en français pour les assurés du Québec
Tester les agents qui agissent pour les assurésRéclamations habitation

Ouvrez une réclamation pour les dommages causés par la grêle jeudi dernier.

Votre réclamation est ouverte.

DemandéDommages de grêle à la toiture, police habitation
FaitRéclamation ouverte sur la police auto
Signalé par les évaluateurs de Human Data : mauvaise police.Le client détient les deux polices. La réclamation est dans la mauvaise file, avec la mauvaise franchise.
1 / 3

L’expertise canadienne en assurance.
Documents, vidéos, décisions.

Dites-nous quelle branche d’assurance et quels modèles vous évaluez.