ProduktMjukvara och internet

Berget AI lanserar System One – varnar själv för svag träffsäkerhet

Berget AI lanserar modellkategorin System One på sitt API och öppnar den första modellen Laya för utvärdering till ett pris av 0,042 euro per miljon indatatokens. Modellen körs på servrar i Sverige men når i bolagets egna mätningar 56,4 procents träffsäkerhet på kärntestet.

Ett processorchip märkt AI med guldfärgade ben
Genrebild. Foto: Igor Omilaev/Unsplash

Kategorin är byggd för strukturerade beslutsfrågor som dirigering, sökning och dubletthantering där svaren returneras som val, poäng eller ja- och nejsannolikheter i stället för fritext. Det skriver Berget AI på sin webbplats. Modellen Laya baseras på en öppen flerspråkig beslutsmodell från ConvAI Innovations och körs i befintligt skick, samtidigt som bolaget märker upp egna beslutsdata för att finjustera den.

I Berget AI:s mätningar på en kärntestsvit svarade Laya rätt på 56,4 procent av frågorna, jämfört med 88,5 procent för modellen Jev från TypeSafe AI och 84,6 procent för Qwen 3.5-4B. Bolaget framhåller att Laya är överkonfident i sina svar, men på frågor om huruvida två dataposter är dubbletter nådde modellen 75 procent, samma resultat som för Jev och Qwen. Laya klarar samtidigt 24 av 25 kompatibilitetstester mot Jevs format, och i ett internt test tog varje beslut cirka 25 millisekunder.

Berget AI uppger att modellen enbart släpps för utvärdering bakom kvalitetsspärrar och rekommenderar att beslut med verkliga konsekvenser skickas till större modeller. Tjänsten körs på servrar i Sverige under EU-jurisdiktion med en policy om noll datalagring, vilket innebär att varken frågor eller svar sparas eller tränas på. Svar debiteras inga utdatatokens.

Bolaget, som har Andreas Lundmark som vd och Christian Landgren som produkt- och teknikchef, registrerades hos Bolagsverket i november 2024 med Stockholm som registrerad adress. Techindex skrev i september att bolaget även tagit in realtidstranskribering för svenska via modellen Klang Pianissimo på sitt API.

Skriven av AI och faktagranskad av en andra AI mot källan före publicering. Så arbetar vi

Så vet vi det16 uppgifter, var och en med ordagrant citat ur källanVisa
  1. Berget AI lanserar modellkategorin System One på sitt API.

    ”Today we are launching System One, a new model category on the Berget API.”

    Källa: berget.ai ↗
  2. Bolaget öppnar den första modellen Laya för utvärdering till ett pris av 0,042 euro per miljon indatatokens.

    ”Laya is open for evaluation now, billed at €0.042 per million input tokens — answers carry no output tokens.”

    Källa: berget.ai ↗
  3. Modellen körs på servrar i Sverige.

    ”Our first model in the category, Laya, is open for evaluation, running on infrastructure in Sweden.”

    Källa: berget.ai ↗
  4. Modellen når i bolagets egna mätningar 56,4 procents träffsäkerhet på kärntestet.

    ”On the core suite it is right for 56.4% of the questions, against 88.5% for Jev on TypeSafe's API and 84.6% for Qwen 3.5-4B — and it is overconfident about its own answers.”

    Källa: berget.ai ↗
  5. Kategorin är byggd för strukturerade beslutsfrågor som dirigering, sökning och dubletthantering där svaren returneras som val, poäng eller ja- och nejsannolikheter i stället för fritext.

    ”You send a state and a set of typed questions; every answer comes back as a structured judgement — a choice with its probabilities, a level on a scale, or a yes/no probability. No prose to parse.”

    Källa: berget.ai ↗
  6. Laya baseras på en öppen flerspråkig beslutsmodell från ConvAI Innovations och körs i befintligt skick, samtidigt som bolaget märker upp egna beslutsdata för att finjustera den.

    ”Laya today is the open multilingual decision model from ConvAI Innovations, served as-is. That gap is why Laya ships for evaluation only, behind quality gates, while we label our own decision data to fine-tune it.”

    Källa: berget.ai ↗
  7. I Berget AI:s mätningar på en kärntestsvit svarade Laya rätt på 56,4 procent av frågorna, jämfört med 88,5 procent för modellen Jev från TypeSafe AI och 84,6 procent för Qwen 3.5-4B.

    ”On the core suite it is right for 56.4% of the questions, against 88.5% for Jev on TypeSafe's API and 84.6% for Qwen 3.5-4B — and it is overconfident about its own answers.”

    Källa: berget.ai ↗
  8. Bolaget framhåller att Laya är överkonfident i sina svar, men på frågor om huruvida två dataposter är dubbletter nådde modellen 75 procent, samma resultat som för Jev och Qwen.

    ”There are early bright spots: on questions asking whether two records are duplicates, Laya scores 75%, the same as Jev and Qwen.”

    Källa: berget.ai ↗
  9. Laya klarar samtidigt 24 av 25 kompatibilitetstester mot Jevs format.

    ”Laya serves the Jev contract's request and answer shapes, usage block and batch semantics — 24 of 25 conformance checks pass; the one that fails (choosing among a single option) is an edge case under fix.”

    Källa: berget.ai ↗
  10. I ett internt test tog varje beslut cirka 25 millisekunder.

    ”One internal experiment shows the pattern: an agent searching a codebase, with Laya choosing the next step — ls, grep or cat, and on which target — in about 25 ms per decision.”

    Källa: berget.ai ↗
  11. Berget AI uppger att modellen enbart släpps för utvärdering bakom kvalitetsspärrar och rekommenderar att beslut med verkliga konsekvenser skickas till större modeller.

    ”Until the numbers move, treat Laya's probabilities as hints, and send verdicts with real consequences to a model that has earned its confidence.”

    Källa: berget.ai ↗
  12. Tjänsten körs på servrar i Sverige under EU-jurisdiktion med en policy om noll datalagring, vilket innebär att varken frågor eller svar sparas eller tränas på.

    ”System One runs on our servers in Sweden, under EU jurisdiction, with zero retention: states, questions and answers are never stored, analysed, or trained on — the same policy covers the whole platform.”

    Källa: berget.ai ↗
  13. Svar debiteras inga utdatatokens.

    ”Laya is open for evaluation now, billed at €0.042 per million input tokens — answers carry no output tokens.”

    Källa: berget.ai ↗
  14. Bolaget har Andreas Lundmark som vd och Christian Landgren som produkt- och teknikchef.

    ”Andreas Lundmark Co-founder & CEO”

    Källa: berget.ai ↗
  15. Bolaget registrerades hos Bolagsverket i november 2024 med Stockholm som registrerad adress.

    ”Registrerat hos Bolagsverket: 2024-11-13.”

    Källa: bolagsverket.se ↗
  16. Techindex skrev i september att bolaget även tagit in realtidstranskribering för svenska via modellen Klang Pianissimo på sitt API.

    ”Berget AI bygger ut sitt API med realtidstranskribering för svenska genom den öppna modellen Klang Pianissimo.”

    Källa: techindex.se ↗

Uppgifterna kommer ur bolagets egna pressmeddelanden. En andra AI har kontrollerat varje citat mot källan. Så arbetar vi

Techindex Morgon

Gårdagens technyheter i mejlen, måndag till lördag kl 06.30. Gratis, och du avslutar med ett klick.

Vi sparar bara din adress. Så hanterar vi den