Takk for at du sendte din henvendelse! En av våre teammedlemmer vil kontakte deg straks.
Takk for at du sendte din bestilling! En av våre teammedlemmer vil kontakte deg straks.
Varighet 21 timer
Kursplan
Grunnleggende kunnskaper om Mastra feilretting og evaluering
- Forståelse av agentoppføringsmodeller og feilmoduser
- Kjerneprinsipper for feilretting innenfor Mastra
- Evaluering av deterministiske og ikke-deterministiske agenthandlinger
Innstilling av miljøer for agenttesting
- Konfigurering av testboks og isolerte evalueringsrom
- Samling av logger, spor og telemetri for detaljert analyse
- Forberedelse av datasets og prompter for strukturert testing
Feilretting av AI-agent oppførsel
- Sporing av beslutningsstier og interne resonssignaler
- Identifisering av hallusinasjoner, feil og uønsket oppførsel
- Bruk av observbarhetsdashboard for grunntidsundersøkelser
Evalueringsmetrikker og referansepunkt-rammeverk
- Definering av kvantitative og kvalitative evalueringsmetrikker
- Måling av nøyaktighet, konsistens og kontekstuell samsvar
- Implementering av referansedatasets for gjentakelig vurdering
Pålitelighetsingeniøring for AI-agenter
- Design av pålitelighetstester for langkjørende agenter
- Oppdagelse av drift og nedgang i agentytelse
- Implementering av sikkerhetstiltak for kritiske arbeidsflyter
Kvalitetskontrollprosesser og automatisering
- Oppbygging av kvalitetskontrollpipeliner for kontinuerlig evaluering
- Automatisering av regresjonstester for agentoppdateringer
- Integrasjon av kvalitetskontroll med CI/CD og bedriftsarbeidsflyter
Avanserte teknikker for reduksjon av hallusinasjoner
- Promptstrategier for å redusere uønskede utdata
- Valideringssyklus og selvkontrollmekanismer
- Eksperimentering med modellkombinasjoner for å forbedre pålitelighet
Rapportering, overvåking og kontinuerlig forbedring
- Utvikling av kvalitetsrapporter og agentpoengtavler
- Overvåking av langvarig oppførsel og feilmønstre
- Iterering på evalueringsrammeverk for evoluerende systemer
Oppsummering og neste trinn
Krav
- Forståelse av AI-agent oppførsel og modellinteraksjoner
- Erfaring med feilretting eller testing av komplekse softwaresystemer
- Kjennskap til observbarhet eller logging-verktøy
Målgruppe
- Kvalitetsingeniører
- AI-pålitelighetsingeniører
- Utviklere ansvarlige for agentkvalitet og ytelse