Ta kontakt
 Varighet 21 timer

Kursplan

Grunnleggende kunnskaper om Mastra feilretting og evaluering

  • Forståelse av agentoppføringsmodeller og feilmoduser
  • Kjerneprinsipper for feilretting innenfor Mastra
  • Evaluering av deterministiske og ikke-deterministiske agenthandlinger

Innstilling av miljøer for agenttesting

  • Konfigurering av testboks og isolerte evalueringsrom
  • Samling av logger, spor og telemetri for detaljert analyse
  • Forberedelse av datasets og prompter for strukturert testing

Feilretting av AI-agent oppførsel

  • Sporing av beslutningsstier og interne resonssignaler
  • Identifisering av hallusinasjoner, feil og uønsket oppførsel
  • Bruk av observbarhetsdashboard for grunntidsundersøkelser

Evalueringsmetrikker og referansepunkt-rammeverk

  • Definering av kvantitative og kvalitative evalueringsmetrikker
  • Måling av nøyaktighet, konsistens og kontekstuell samsvar
  • Implementering av referansedatasets for gjentakelig vurdering

Pålitelighetsingeniøring for AI-agenter

  • Design av pålitelighetstester for langkjørende agenter
  • Oppdagelse av drift og nedgang i agentytelse
  • Implementering av sikkerhetstiltak for kritiske arbeidsflyter

Kvalitetskontrollprosesser og automatisering

  • Oppbygging av kvalitetskontrollpipeliner for kontinuerlig evaluering
  • Automatisering av regresjonstester for agentoppdateringer
  • Integrasjon av kvalitetskontroll med CI/CD og bedriftsarbeidsflyter

Avanserte teknikker for reduksjon av hallusinasjoner

  • Promptstrategier for å redusere uønskede utdata
  • Valideringssyklus og selvkontrollmekanismer
  • Eksperimentering med modellkombinasjoner for å forbedre pålitelighet

Rapportering, overvåking og kontinuerlig forbedring

  • Utvikling av kvalitetsrapporter og agentpoengtavler
  • Overvåking av langvarig oppførsel og feilmønstre
  • Iterering på evalueringsrammeverk for evoluerende systemer

Oppsummering og neste trinn

Krav

  • Forståelse av AI-agent oppførsel og modellinteraksjoner
  • Erfaring med feilretting eller testing av komplekse softwaresystemer
  • Kjennskap til observbarhet eller logging-verktøy

Målgruppe

  • Kvalitetsingeniører
  • AI-pålitelighetsingeniører
  • Utviklere ansvarlige for agentkvalitet og ytelse

Antall deltakere


Pris per deltaker

Kommende kurs

Relaterte kategorier