Sprogteknologisk Konference 2026

Kom og vær med til Sprogteknologisk Konference 2026!

Digitaliseringsstyrelsen og Center for Sprogteknologi ved KU inviterer til dette års Sprogteknologisk Konference den 20. november 2026.

For sjette år i træk samler vi fagfolk, forskere og praktikere der arbejder med sprogteknologi i en dansk kontekst. Alt fra udvikling af værktøjer og modeller i den offentlige sektor til sproglige ressourcer der understøtter dansk i en digital tidsalder. Konferencen skal bruges til at dele erfaringer fra danske use-cases og belyse de særlige udfordringer og muligheder der opstår når vi udvikler og anvender sprogteknologi med afsæt i det danske sprogområde.

Dette års konference vil særligt have fokus på evaluering af sprogmodeller. Vi belyser temaet dels gennem en række oplæg fra aktører der arbejder konkret med evaluering af løsninger der bygger på generativ AI og sprogmodeller, dels gennem udvalgte forskningsoplæg der undersøger hvordan sprogmodellerne håndterer sproglig og kulturel diversitet, og frem for alt hvordan de fremover kan blive bedre til det.

Tilmeld dig allerede nu på linket nedenfor - og følg med på siden her, hvor der løbende vil komme information om programmet og om indkaldelse af posterforslag. 

 

Magnus Sahlgren, Hybridity.ai

The Frontier Fallacy: Escaping Europe’s Sovereign Pretraining Trap

As the pace of frontier model development accelerates, Europe faces a widening capability gap, and a reflexive political urge to pursue "sovereign" foundation model pretraining. Yet attempting to replicate hyperscale frontier models is neither economically viable nor strategically sound; training a domestic copy of yesterday’s baseline does not confer autonomy. True resilience demands shifting focus from model replication to system competency, domain adaptation, and, crucially, rigorous diagnostic evaluation. Today’s benchmark suites are insufficient, leaving us unable to pinpoint what (if anything) current frontier models actually lack for European needs. This talk challenges the orthodoxy of sovereign pretraining, arguing that Europe’s strategic agency lies in evaluation literacy, downstream architectural control, and resilient integration.”


Iben Nyholm Debess, Center for Sprogteknologi på Fróðskaparsetur Føroya (Færøernes Universitet)

Færøsk sprogteknologi: Fra datamangel til sproglig autonomi

De begrænsede mængder strukturerede digitaliserede sprogdata på færøsk udgør en markant barriere for udviklingen af store sprogmodeller og sprogteknologi i det hele taget.

Oplægget giver en status over det færøske sprogteknologiske område og belyser centrale udfordringer. Placeringen midt i det nordiske sprogfelt rummer både fordele og ulemper, og nationale initiativer på området har været sparsomme. Vi lægger fokus på evaluering: automatiske metrikker og oversatte benchmarks viser sig utilstrækkelige i småsprogskonteksten, og vi argumenterer for et grundlæggende behov for lingvistisk og kulturelt funderede benchmarks. Afslutningsvis diskuterer vi, hvordan systematisk evaluering understøtter færøsk sproglig digital autonomi og har sprogpolitisk påvirkning. 


Daan van Esch, Staff Technical Program Manager with Google DeepMind.

Building Inclusive Language Technologies Across the World's Languages

The foundations of today's large language models can be traced back to many years of R&D on machine translation, transcription, and speech synthesis. And the scale of today's language technologies is incredible: Google Translate alone now processes more than a trillion words a month, across more than a billion monthly active users; and there are many more billion-user products in today's digital landscape. It's vital that these large-scale technologies are linguistically and culturally inclusive for people around the world, but what does it take to get to such truly local experiences? And what opportunities for localizing language tech even more do recent advances (like agentic coding) unlock, including e.g. dialects and accents? 

Daan van Esch is a Staff Technical Program Manager with Google DeepMind. His work focuses on applying language technologies at scale, across languages, countries, and products -- such as Gboard, Translate, and Gemini, as well as key enterprise engagements. In his 14+ years with Google, he's worked on text-to-speech synthesis, automatic speech recognition, smartphone keyboards, machine translation, large language models, multi-agent systems, and more. Daan has been involved with a number of large-scale multilingual projects, like bringing nearly 1,000 languages to Gboard, and Google's 1,000 Languages Initiative across machine translation and speech tech. He also enjoys working on technology to assist linguists and communities in language documentation and revitalization efforts. Daan holds a degree in Chinese Studies from Leiden University, where his research focus was Chinese linguistics and natural-language processing.


Thea Rolskov Sloth og Gustav Aarup Lauridsen, Region Midtjylland

Evaluering af sprogteknologi på vores egen banehalvdel i sundhedsvæsenet: Vores første evalueringsdatasæt i Region Midt

Hvor passer sprogteknologi ind i sundhedsvæsnet? Der er lang vej fra sprogteknologiens potentiale til værdi i praksis. Først og fremmest skal vi have en måde at kunne måle på kvaliteten af den sprogteknologi vi implementerer, for at være sikre på at vi ikke byder uhensigtsmæssige konsekvenser indenfor på hospitalerne i jagten på at spare ressourcer.

I Region Midt er der igangsat afprøvninger af Ambient Scribe-teknologi, men for systematisk at kunne evaluere systemerne op imod hinanden og undersøge deres performance på dansk, sundhedsfagligt sprog, har vi lavet et Region Midt-specifikt evalueringsdatasæt. Vi deler ud af indsigterne fra denne proces, og fortæller om de vilkår sprogteknologien har for at leve i det offentlige Danmark.


Barbara Scalvini, post.doc ved Center for Sprogteknologi, KU

Bolette S. Pedersen, professor ved Center for Sprogteknologi, KU

Det nordiske perspektiv og kulturel sprogteknologi (CAALLM-projektet under Nordisk Ministerråd) 

Sprogmodeller udgør kernen i de ai-chatbotter vi kender som ChatGPT, Claude og Gemini, og som er under hastig udbredelse overalt i vores samfund. Selv om de gennemgående fungerer ret godt på dansk, som på de fleste andre nordiske sprog, er det også velkendt at de har stærke bias i forhold til det sprog som de primært er trænet på, nemlig engelsk. CAALLM-projektet, som er bevilget af NordForsk under ’responsible ai’-kaldet, adresserer disse sproglige og kulturelle udfordringer fra et nordisk og baltisk perspektiv. I oplægget giver vi eksempler fra vores arbejde med at tilpasse sprogmodellerne til dem vi er i Norden og Baltikum. Vi forsøger at udvikle en nuanceret tilgang til kulturel tilpasning som bedre afspejler nutidige antropologiske og multifacetterede forståelser af kultur end de kulturelle surveys som man ofte ser anvendt i NLP.

 

 

9:30-10:00 Kaffe, croissanter og registrering
10:00-10:05

Forord og praktikaliteter

V. Astrid Haug, journalist

10:05-10:15

Velkomst og præsentation af program

V. Bolette Sandford Pedersen, Center for Sprogteknologi, KU

10:15-11:00

Key-note: The Frontier Fallacy: Escaping Europe’s Sovereign Pretraining Trap

V. Magnus Sahlgren, Hybridity.ai

11:00-11:20 Kaffepause
11:20-11:50

Færøsk sprogteknologi: Fra datamangel til sproglig autonomi

V. Iben Nyholm Debess, Center for Sprogteknologi på Fróðskaparsetur Føroya

11:50-12:20

Building Inclusive Language Technologies Across the World's Languages

v. Daan van Esch, Google DeepMind

12:20-13:10 Frokost, netværk og posters
13:10-13:40

Paneldebat: Evaluering i teori og praksis

V. Kenneth Enevoldsen, Aarhus Univeristet og Danish Foundation Models, Cilia Helene Kofoed, Droids Agency og Henrik Palmer, iCourts på Juridisk fakultet ved Københavns Universitet

13:40-14:10

AI-arenaen: En platform til evaluering af svar fra sprogmodeller

V. Jakob Blaaholm Nielsen, Digitaliseringsstyrelsen og Kenneth Enevoldsen, Aarhus Univeristet og Danish Foundation Models

14:10-14:30 Kaffepause og posters
14:30-15:00

Evaluering af sprogteknologi på vores egen banehalvdel i sundhedsvæsenet: Vores første evalueringsdatasæt i Region Midt

v. Thea Rolskov Sloth og Gustav Aarup Lauridsen, Region Midt

15:00-15:30

Det nordiske perspektiv og kulturel sprogteknologi (CAALLM-projektet under Nordisk Ministerråd) 

v. Barbara Scalvini og Bolette S. Pedersen, Center for sprogteknologi, KU

15:30-15:40

Afrunding

V. Martin Jensen Buch, souschef i Digitaliseringsstyrelsen

15:40-16:30 Netværk, posters og vin

 

 

Tilmeld dig konferencen her