– Vi har lansert TellusR 5, og med det får både konseptet og produktet vårt et massivt løft, sier Lise Bolling Nesheim, produktsjef og medgründer i TellusR.

Lise Bolling Nesheim
Lise Bolling Nesheim Produktsjef og medgründer, TellusR

Hun sier at de nå har åpnet opp maskinrommet, og at funksjonalitet som tidligere var forbeholdt selskapets egne utviklere, nå er eksponert i et flunkende nytt administrasjonsgrensesnitt.

– Løsningene er allerede stresstestet i krevende kundeprosjekter, sier Nesheim. – Det betyr at kundene får verktøy som beviselig fungerer i praksis fra første dag.

TellusR 5-dashboardet med Quick start, statistikk over LLM-kostnad og søk per dag

Slutt på rigide arbeidsflyter

Målet med TellusR 5 er å få virksomheter raskere i gang, uten at det går på bekostning av handlefriheten.

Med den nye «Quick Start»-arbeidsflyten kan man dra og slippe dokumenter rett inn i løsningen, og umiddelbart ha en assistent klar til å snakke med dataene.

Men den virkelig store endringen under panseret i TellusR 5 henger tett sammen med hvor gode dagens språkmodeller har blitt. Mens faste, statiske prosesser fremdeles håndterer rutineoppgaver, åpner de nyeste modellene for en helt ny grad av autonomi.

– Dagens modeller kan tiltros mer ansvar. I stedet for å detaljstyre AI-en steg for steg, gir vi den nå heller en verktøykasse og lar den selv vurdere hvordan oppgaven løses best, sier Nesheim.

Dette lar kundene bygge et økosystem av samarbeidende AI-assistenter. Én assistent kan være spesialist på å hente tekst fra bilder, mens en annen er rå på å generere oppsummeringer.

– Du sier rett og slett til hovedassistenten: «Dette er verktøyene du har tilgang til. Basert på spørsmålene du får, bruk det verktøyet som passer best». Dette gir en enorm fleksibilitet, og gjør systemet i stand til å håndtere en mye større bredde av problemstillinger.

Men selv om assistentene nå kan få friere tøyler, betyr ikke det at bedriftene mister styringen.

– I repetitive prosesser ønsker man gjerne full kontroll, sier Lise Bolling Nesheim og legger til:

– Derfor er det fremdeles fullt mulig å sette opp statiske arbeidsflyter der man trenger det. I slike tilfeller kan man med fordel koble på lokale eller mindre språkmodeller for å få økt presisjon og enda strammere kostnadskontroll, sier hun.

I stedet for å detaljstyre AI-en steg for steg, gir vi den nå heller en verktøykasse og lar den selv vurdere hvordan oppgaven løses best.
Lise Bolling Nesheim Produktsjef og medgründer, TellusR

Bevis at AI-en snakker sant

Når AI får mer ansvar for komplekse oppgaver, øker behovet for kontroll dramatisk.

Key Account Manager i TellusR, Georg Baumann, sier at den tekniske terskelen for å forstå og bygge slike løsninger nå er senket betydelig – hjulpet av dokumentasjonen som følger med TellusR 5.

Georg Baumann
Georg Baumann Key Account Manager, TellusR
Dokumentasjon docs.tellusr.com Oppdatert dokumentasjon for TellusR 5. Åpnes i ny fane.

– For meg som ikke har den tyngste tekniske bakgrunnen, gjør det det veldig mye lettere å raskt gå inn og søke opp hva dette egentlig går ut på, og hva man kan bygge, sier Baumann.

I det nye dashbordet får administratorer full oversikt over tidsbruk og snittpris per spørring for hver enkelt assistent. Men det viktigste for bedrifter som krever etterprøvbarhet, er det bunnsolide testrammeverket.

Elise Skilbred Langerød peker på statistikk i TellusR 5-dashboardet, med Hasan Elahi ved siden av

– Man får med et veldig godt debug-verktøy hvor du kan spore alt som har skjedd, sier Nesheim.

I praksis betyr dette at AI-en slutter å være en svart boks.

Systemutvikler og senior architect Petter Egesund har tidligere uttalt at han har undersøkt mange lignende software-løsninger, men aldri sett noen som gjør AI like menneskelig verifiserbart gjennom testrammeverk som det TellusR gjør.

Nettopp denne sporbarheten er helt avgjørende for aktører i offentlig sektor, som nå endelig kan svare ut og dokumentere innsynsforespørsler knyttet til AI-løsninger.

Ved hjelp av metoden «LLM-as-a-judge» kan virksomheter legge inn et fasitsvar, og la en annen språkmodell vurdere om assistenten svarer riktig på innhold, form og referansebruk.

– Når vi gjør større endringer, kjører vi alltid testene før og etter for å sikre at kvaliteten ikke blir dårligere, sier Nesheim.

Testrapport i TellusR 5, med score, kostnad og sporbar vurdering av et assistent-svar

Dette gir kundene tryggheten til å bytte mellom ulike språkmodeller i dashbordets rullegardinmeny – for eksempel mellom OpenAI, Mistral eller lokale modeller – uten å frykte at kvaliteten faller.

Klikk for å se modellisten i full størrelse
Når vi gjør større endringer, kjører vi alltid testene før og etter for å sikre at kvaliteten ikke blir dårligere.
Lise Bolling Nesheim Produktsjef og medgründer, TellusR

Eller som Baumann skyter inn:

– Den skal helst bli bedre!