Introductie
Het AI Alignment-project binnen CEDA is een geleidelijk evoluerend werkterrein dat zich richt op het volgen en vergelijken van AI-modellen en -systemen met onze waarden.
Benchmarks zijn essentieel voor het evalueren van de prestaties, veiligheid en ethische implicaties van AI-modellen in onderwijscontexten. Ze bieden gestandaardiseerde maatstaven om te beoordelen hoe goed AI-systemen leerresultaten kunnen ondersteunen, de veiligheid van studenten kunnen waarborgen en gelijke toegang tot het onderwijs kunnen bevorderen. Door benchmarks in te delen in pedagogische, ethische, veiligheids- en operationele domeinen, kunnen docenten en ontwikkelaars de sterke punten en beperkingen van AI-modellen en -tools beter begrijpen, en zo goed geïnformeerde beslissingen nemen over hun inzet.
Wil je meehelpen, neem dan contact op met: Alan Berg
Informatieproducten
- Live Benchmarks Dashboard - Een dashboard dat de prestaties van AI-modellen ten opzichte van verschillende benchmarks bijhoudt.
- Informatiedashboard - Een informatiedashboard over AI Alignment. De menuoptie Scorecard/Visualization is een mock-up van een community-proces.
In de toekomst komen er meer informatieproducten bij, zoals een combinatie van live data in een community-scorecard-proces.
Communityprocessen
Deze directory bevat materialen die zijn ontworpen om workshops te ondersteunen over AI Alignment, benchmarking en de evaluatie van AI-systemen op basis van onderwijswaarden. De materialen zijn ontwikkeld onder het CEDA-project en zijn bedoeld voor gebruik door het Nederlandse onderwijsveld.
Een workshop verloopt doorgaans in drie fasen: het voorbereiden van de context en materialen, het faciliteren van betrokkenheid en het vastleggen van resultaten voor voortgang.
Je kunt hier materialen vinden voor een community-workshop die zich richt op het ontdekken van wat er al is gedaan en het plannen van een routekaart naar een set ondersteunde tools:
Introduction
The AI Alignment project under CEDA is an incrementally evolving body of work about keeping track and comparing AI models and systems against our values.
Benchmarks are essential for evaluating the performance, safety, and ethical implications of AI models in educational contexts. They provide standardized metrics to assess how well AI systems can support learning outcomes, ensure student safety, and promote equitable access to education. By categorizing benchmarks into pedagogical, ethical, safety, and operational domains, educators and developers can better understand the strengths and limitations of AI models and tools, guiding informed decisions about their deployment.
Interested in helping, contact: Alan Berg
Information Products
- Live Benchmarks Dashboard - A dashboard that tracks the performance of AI models against various benchmarks.
- Information Dashboard - An information dashboard about AI Alignment. The menu option Scorecard/Visualization is a mockup of a community process.
More information products to be added in the future, such as a merger of live data into a community scorecard process.
Community Processes
This directory contains materials designed to support workshops on AI Alignment, benchmarking, and the evaluation of AI systems against educational values. Materials are developed under the CEDA project and are intended for use by the Dutch Education community.
A workshop typically moves through three phases: preparing the context and materials, facilitating engagement, and capturing outcomes for continued progress.
You can find materials for a community workshop centered around discovering what has already been done and planning a roadmap to a set of supporting tools here: