I samband med att GU Journalen skriver en artikel om Språkbankens 50-åriga jubileum så passade vi på att skapa en korpus (textsamling) av GU Journalens samtliga nummer sedan 1997.
Aktuellt från Språkbanken
Nyhet
(Svenska)
Researchdata.se – en ny portal för forskningsdata
Idag den 25 mars lanseras Researchdata.se, en ny nationell webbportal som gör det lätt för forskare att hitta, dela och återanvända forskningsdata från olika ämnesområden.
Nyhet
(Svenska)
Höjdpunkter på NoDaLiDa
Går det att använda språkmodeller för språkinlärning? Och kan AI-modeller bli bra på allt människan är bra på? Det var några frågor som diskuterades under NoDaLiDa 2–5 mars. Sara Stymne, föreståndare för Språkbanken Clarin, var huvudansvarig för konferensen som sponsrades av Språkbanken.
Nyhet
(Svenska)
Se en videointroduktion till vår dataplattform Mink
I Mink kan du göra automatiska språkteknologiska analys av din textsamling och utforska den vidare i plattformarna Korp och Strix.
Nyhet
(Svenska)
Göteborgare vs AI - vem kan språket bäst?
Vår forskare och biträdande föreståndare för Språkbanken Text, Sasha Berdicevskis, kommer den 5 maj att hålla ett föredrag på Göteborgs stadsbibliotek. Preliminär titel är "Göteborgare vs AI: Vem kan språket bäst?". Alla är välkomna!
Nyhet
(Svenska)
Projekt i fokus: KB-Whisper
KB-Whisper är Kungliga bibliotekets nya tal-till-textmodell. Modellen är tränad på mer än 50 000 timmar tal, bland annat dialekter från Isof, tillgängliggjorda av Språkbanken. Leonora Vesterbacka, senior data scientist på KB-labb, berättar mer.
Blogg
(Engelska)
Knowledge-sharing at HumFak Developer Forum #1
On the 11th of March, research engineers and develo
Nyhet
(Svenska)
Månadens profil: Mats Wirén
Hur kan språkteknologi för teckenspråk utvecklas? Det intresserar Mats Wirén, professor emeritus inom datorlingvistik och samordnare för teckenspråksmodulen som nu startat inom Språkbanken Clarin.
Nyhet
(Svenska)
Språkbanken Text på Vetenskapsfestivalen
När Vetenskapsfestivalen går av stapeln i april i Göteborg, kan du träffa två av Språkbanken Texts professorer för att lära dig mer om AI och humaniora.
Nyhet
(Svenska)
Folke blir korpus i Korp
Nu finns korpusen Folke i Korp. Det ger nya möjligheter för forskning, berättar Kamilla Kärrstedt och Hanna Willdal, arkivassistenter på Språkbanken Sam. Korpusen är framtagen tillsammans med Språkbanken Text, och är ett bra exempel på hur vi samarbetar inom Språkbanken.
Blogg
(Engelska)
Sparv-Superlim: A plugin for corpus analysis
Sparv-Superlim is a Sparv plugin, which uses the reference models trained for the Superlim multi-task benchmark to provide ten additional NLU annotations to the Sparv Pipeline.
Blogg
(Engelska)
sbx2hf: Towards syncing SBX resources with the Hugging Face Hub
The Hugging Face Hub is a platform for uploading models, datasets and demo apps, mainly for machine learning and deep learning. It has become one of the largest platforms of its kind and plays an integral role in deveoping AI today.
Nyhet
(Svenska)
KB lanserar ny AI-modell baserad på dialektinspelningar från Isof
Kungliga biblioteket (KB) lanserar KB-Whisper, en AI-modell som transkriberar tal till text. KB-Whisper har bland annat tränats på Isofs dialektinspelningar som tillgängliggjorts av Språkbanken.
Nyhet
(Svenska)
Ny professor vill arbeta för en säker och etisk användning av AI
Den 13 februari utnämndes Elena Volodina till professor i språkteknologi vid Göteborgs universitet. Hennes forskning fokuserar främst på hur stora textmassor kan rensas automatiskt på personuppgifter och känslig information. Hon forskar också på hur AI-tillämpningar kan vara mer rättvisa för olika demografiska grupper.
Nyhet
(Svenska)
Hur fungerar Mink? Välkommen på webbinarium!
Den 26 februari arrangerar Svensk Nationell Datatjänst ett webbinarium där forskningsingenjörer på Språkbanken Text berättar om plattformen Mink.
Nyhet
(Svenska)
Månadens profil: Fredrik Nylén
Ett lingua franca för talanalys och ett projekt kring sväljning som blivit en liten kioskvältare. Det är en del av vardagen för Fredrik Nylén, docent i logopedi vid Umeå universitet med fonetisk bakgrund, som är nodsamordnare för Språkbanken vid Humlab och bollplank för forskare.
Nyhet
(Svenska)
Språkbanken Text på Vetenskapsfestivalen
Den 2 april kl 15-19 har du möjlighet att möta två av våra forskare: Emma Sköldberg och Elena Volodina. Detta när Humanistens öppnar sina dörrar för allmänheten under Vetenskapsfestivalen.
Nyhet
(Svenska)
Sverige och ALT-Edic – ja eller nej?
Ska Sverige delta i det nationella informations- och rådgivningsarbetet om Europeiska digitala infrastrukturkonsortier ALT-Edic? En rapport som beställts av Digg och Vinnova ska fungera som beslutsunderlag för regeringen. Språkbanken har på olika sätt medverkat i rapportarbetet, berättar Rickard Domeij, föreståndare för Språkbanken Sam.
Nyhet
(Svenska)
Månadens profil: Krister Lindén
Hur kan språkteknologi underlätta forskning – och ge industrin möjligheter att utveckla appar för små språk? Det är frågor som intresserar Krister Lindén, teknologidirektör i språkteknologi på avdelningen för digital humaniora vid Helsingfors universitet, nationell koordinator för FIN-CLARIN, ledare för FIN-CLARIAH, där DARIAH-FI ingår, föreståndare för Språkbanken i Finland och sedan första januari i år ordförande för Språkbankens styrgrupp.
Nyhet
(Svenska)
Nytt år, ny finansieringsperiod!
2025 går Nationella språkbanken in i en ny finansieringsperiod. Det innebär två nyheter: Nationella språkbanken byter namn till Språkbanken och Swe-CLARIN blir en ny avdelning, Språkbanken CLARIN.