Vaši podatki.
Vaša domena.
Vaš model.
Odprte modele fino uglasimo na podatkih vašega podjetja — priročnikih, zahtevkih, pogodbah, procesih, terminologiji — in napredek dokažemo na zamrznjenem merilu, preden karkoli dostavimo. Trenirano v EU. Uteži dobite vi.
| arc_easy | 0,71 | 0,78 | +7 |
| boolq | 0,83 | 0,89 | +6 |
| hellaswag | 0,59 | 0,62 | +3 |
| sl→en BLEU | 30,9 | 35,0 | +4,1 |
| ASR WER | 46,8 | 22,3 | −52 % |
Splošni modeli vašega podjetja še niso videli.
Vrhunski API-ji so odlični za povprečen primer. Vaši zahtevki, priročniki, pogodbe in procesi niso povprečen primer — in zadnjih 20 % kakovosti je tam, kjer je vrednost.
Vaših dokumentov ni prebral
Vaši priročniki, zgodovina podpore, postopki in terminologija obstajajo samo znotraj vašega podjetja. Noben model s police jih ni videl — zato ugiba, samozavestno.
Prompti vas pripeljejo do 80 %
Natančni izhodni formati, hišna terminologija, klici orodij, ki delujejo vsakič, odgovori v vašem jeziku — zadnjih 20 % se natrenira, ne pripromptá.
API na žeton se ne skalira in ni skladen
Pošiljanje podatkov strank tujemu API-ju je problem skladnosti in odvisnosti. Majhen model, naučen na vaših podatkih, teče na vaših strežnikih po fiksni ceni — in uteži so vaše.
| Kaj šteje | Javni API | Prompti + RAG | Fino uglašen z nami |
|---|---|---|---|
| Podatki ostanejo v EU, pod vašim nadzorom | ✕ | ~ | ✓ |
| Vaša terminologija in formati, vsakič | ~ | ~ | ✓ |
| Zanesljivi klici orodij v vaše sisteme | ~ | ~ | ✓ |
| Dejstva, ki se dnevno spreminjajotu spada iskanje — združimo oboje | ✕ | ✓ | ✓ |
| Fiksen strošek pri obsegu, deluje brez povezave | ✕ | ~ | ✓ |
| Model je vaš | ✕ | ✕ | ✓ |
Od surovih podatkov do modela, ki je vaš.
Šest zmožnosti, ena veriga. Vzemite katerokoli posebej ali celotno verigo od začetka do konca. Vsaka je preizkušena na modelu, ki ga lahko prenesete.
Nadaljevano predučenje (CPT)
Osnovni model naučimo celotnega jezika ali domenskega korpusa — milijarde žetonov očiščenega, dedupliciranega besedila s sledljivimi licencami.
- Učenje vseh parametrov za goste modele; QLoRA visokega ranga za mešanice ekspertov 30B+
- Perpleksnostna vrata na zadržanem besedilu po vsaki kontrolni točki
- Mešanice za ohranjanje znanja, da model obdrži, kar je osnova znala
- Pakirana zaporedja, večdnevni teki odporni na sesutja
Nadzorovano fino uglaševanje (SFT)
Oblikujemo vedenje: pogovor, prevajanje, klicanje orodij, sklepanje, identiteta — v lastni predlogi modela, tisti, ki jo vaš strežniški sklad dejansko izpisuje.
- Nativno klicanje funkcij z večkrožnimi zankami klic → rezultat → odgovor
- Destilacija sklepanja iz močnejšega učitelja, filtrirana s sodnikom
- Uglaševanje identitete, tona in pravil
- Zaporedna douglaševanja, ki gradijo na prejšnjih adapterjih
Izdelava podatkovnih zbirk
Korpusi, pripravljeni za učenje, s sledljivim izvorom — ne nabrane kupe. Polovica vsakega programa je tukaj.
- Ena shema, ocena kakovosti, natančna + vektorska deduplikacija, deterministične delitve
- Licenčna vrata: komercialna in raziskovalna mešanica iz istih virov
- Destilacija z učiteljem in sodnikom; sintetični dialogi iz preverjenih gradnikov
- Domensko prevajanje z zamrznjeno terminologijo — kode, imena, oznake ostanejo nedotaknjeni
- Izvozi za CPT, SFT in preferenčno učenje (DPO/GRPO) + zamrznjeni evalvacijski deli
Izvajanje treningov kot storitev
Prinesite podatke, dobite model. Ali ne prinesite ničesar in podatke zgradimo mi.
- GPU zmogljivosti pod našim nadzorom — lastne in preverjeni partnerji v EU — ali vaš oblak / izolirana oprema
- Ovoji s samodejnim nadaljevanjem in disciplina kontrolnih točk
- Združene uteži bf16, adapterji LoRA in kvantizacije GGUF, dostavljeni skupaj
- Kartica modela s popolnim izvorom in številkami za vsako trditev
Evalvacijski vztrajnik
»Boljše« se meri, ne trdi. Merilo je določeno, preden se dotaknemo podatkov.
- Zamrznjeni, verzionirani nabori meril — nikoli urejani, le razširjani
- Objektivna sled (točnost, BLEU/chrF, WER/CER) + sled z več sodniki
- Lestvica, ki označi nazadovanje, čez vsako različico modela
- Odločitev da/ne na podlagi številk, preden karkoli dostavimo
Namestitev in govor
Od modela 4B na prenosniku do mešanice ekspertov 35B na delovni postaji — z vidom, orodji in glasom.
- GGUF Q4–Q8 za llama.cpp / LM Studio; recepti za vLLM in transformers
- Vhodne slike in uporaba orodij, ki delujeta v produkciji, ne le na demu
- Pretočna razpoznava govora in uglaševanje sinteze govora
- Po želji gostovanje ali namestitev pri vas, ki teče brez omrežja
Pet korakov, na koncu ena številka.
Prvi izmerjeni model pride v tednih, ne v četrtletjih. Vsaka faza se konča z nečim, kar lahko preverite.
- Obseg
Določimo nalogo in merilo
Uporabniki, naloga, zamrznjen evalvacijski nabor. Pregled vaših podatkov in licenc. Zapisano merilo da/ne.
- Podatki
Zgradimo korpus
Čistimo, prevajamo, destiliramo in mešamo. Rezine za ohranjanje ščitijo, kar osnova že zna.
- Učenje
CPT → SFT → douglaševanja
Vsaka kontrolna točka gre skozi hitro evalvacijo, da slabi teki umrejo zgodaj, dobri pa dobijo proračun.
- Evalvacija
Osnova / uglašen / alternative
Iz oči v oči na zamrznjenem merilu, vključno z API-jem ali RAG postavitvijo, ki ste jo premišljali.
- Dostava
Uteži, GGUF, kartica, recept
Delavnica ob predaji. Gostovanje ali namestitev pri vas, če želite. Odvisnost od nas ne ostane.
Vse spodaj je javno.
Vsak model in vsaka zbirka je na Hugging Face s kartico, izvorom in številkami. Slovenščina je naša referenčna implementacija — ista veriga teče na vaši domeni.
Qwen3.6-35B-A3B · osnova proti CPT+SFT (slovenščina)
Slovenian-LLM-Eval · acc_norm · n=100/nalogo · 4-bitna evalvacija| Naloga | Osnova | Uglašen | Δ | osnova ░ uglašen ▓ |
|---|---|---|---|---|
| arc_easy | 0,71 | 0,78 | +0,07 | |
| arc_challenge | 0,48 | 0,51 | +0,03 | |
| hellaswag | 0,59 | 0,62 | +0,03 | |
| piqa | 0,65 | 0,64 | −0,01 | |
| openbookqa | 0,48 | 0,51 | +0,03 | |
| winogrande | 0,62 | 0,63 | +0,01 | |
| boolq | 0,83 | 0,89 | +0,06 | |
| povprečje | 0,623 | 0,654 | +0,031 |
Qwen3.6-35B-A3B Slovenian
Mešanica ekspertov 35B (3B aktivnih), naučena slovenščine z nadaljevanim predučenjem, nato SFT za pogovor in prevajanje, nato douglaševanje za klicanje orodij, ki je ohranilo jezikovne pridobitve. Vključena vid in nativni klici funkcij.
Sokol 4B — asistent na napravi
Gost model 4B, predučen na 1,78 milijarde slovenskih žetonov, nato uglašen na ~250 tisoč primerih pogovora, prevajanja, klicanja orodij in destiliranega sklepanja. En repozitorij, polne uteži in GGUF Q4–Q8. Teče na prenosniku.
Vran 27B — biomedicinski raziskovalni model
Najprej smo zgradili korpus: 140.063 slovenskih medicinskih zapisov z navodili, strojno prevedenih iz angleške zlate zbirke s sledljivim izvorom, z namenskim medicinskim prevajalnim modelom in štiriplastnimi vrati kakovosti, ter namenski evalvacijski nabor. Nato smo naučili model. Raziskovalna raba.
Slovenska pretočna razpoznava govora
Polno uglaševanje NVIDIINEGA pretočnega razpoznavalnika Nemotron 0.6B na 962 urah slovenskega govora, večano po različicah brez katastrofalnega pozabljanja. Stopnja napak besed prepolovljena na studijskem govoru in znižana za dve tretjini na večdomenskem zvoku. Nameščen na CPU kot GGUF.
Slovenski glasovi za sintezo govora
LoRA uglaševanji dveh odprtih generatorjev govora na slovenskem studijskem govoru, ki zapreta zanko popolnoma lokalnega asistenta govor-noter → govor-ven s kamero in orodji — zagnanega z enim ukazom v brskalniku.
Objavljene podatkovne zbirke
Očiščen korpus za nadaljevano predučenje, dvosmerna prevajalska SFT zbirka EN↔SL s 120.000 pari, medicinski korpus z navodili in njegov evalvacijski nabor — vsak s kartico, ki navaja vire, licence in način izdelave.
Kaj podjetja uglašujejo z nami.
Tipična izhodišča. Večina programov združi dva ali tri.
Podpora strankam in servis
Asistenti, naučeni na zgodovini vaših zahtevkov in priročnikih: dosledni odgovori, vaš ton, eskalacija ob negotovosti.
Dokumenti in ekstrakcija
Pogodbe, računi, obrazci, poročila: strukturirana ekstrakcija, klasifikacija in povzetki v vaši shemi, v vašem jeziku.
Interno znanje
Postopki, standardi, ISO dokumentacija, inženirske beležke — sodelavec, ki jih je dejansko prebral, brez povezave.
Agenti in avtomatizacija
Zanesljivo klicanje orodij v vaš ERP, CRM ali sistem zahtevkov. Naučeno na vaših podpisih funkcij, testirano na deležu uspešnih klicev.
Govor in glas
Transkripcija klicev z vašim besediščem, glasovni boti in narekovanje — razpoznava in sinteza, ki tečeta na vaših strežnikih.
Jezikovna prilagoditev
Slovenščina ali katerikoli premalo zastopan jezik: nadaljevano predučenje in uglaševanje navodil, da je model tekoč, preden je strokoven.
Vaši podatki ostanejo v EU. Model odide z vami.
Treniramo na GPU zmogljivostih pod našim nadzorom — lastnih in pri preverjenih partnerjih znotraj EU. V obeh primerih so vaši podatki obdelani pod NDA in nikoli ne zapustijo evropske jurisdikcije.
Kaj prejmete
- ModelZdružene uteži + adapterji LoRA
- NamestitevGGUF / vLLM gradnja + recept za strežbo
- PodatkiVsaka zbirka, ki smo jo zgradili, z izvorom
- EvalvacijaZamrznjeno merilo + lestvica osnova-proti-uglašen
- DokumentacijaKartica modela, kartica podatkov, učne konfiguracije
- PredajaDelavnica; po želji gostovanje ali namestitev pri vas
Pravila
- Vaši podatki so obdelani pod NDA, na infrastrukturi pod našim nadzorom, znotraj EU. GDPR je privzeto, ne dodatek.
- Za najbolj občutljive podatke izolirano učenje: tečemo z izklopljenim omrežnim kablom in predamo disk.
- Samo odprte osnove — Qwen, Gemma, Llama, Mistral, Nemotron — s sledenjem licence vsake osnove in vsakega vira podatkov.
- Prejmete uteži, adapterje, zbirke, evalvacijski nabor in zapis o izvoru. Odvisnost od nas ostane le, če jo želite.
- Vse je verzionirano — podatki, konfiguracije, kontrolne točke, rezultati — da je rezultat ponovljiv tudi čez leto dni.
Začnite majhno, izmerite, potem se odločite.
Trije načini sodelovanja. Večina ekip začne s pilotom in se odloči na podlagi številk.
Pilot
En evalvacijski nabor, ena zbirka, eno uglaševanje, eno poročilo. Najcenejši način, da izveste, kaj zmorejo vaši podatki — in ali se splača naprej.
- Teden za obseg + pregled podatkov
- Prvi uglašen model, lestvica osnova-proti-uglašen
- Zapisano priporočilo za naslednji korak
Celoten program
CPT → SFT → evalvacija → namestitev za produkcijski model, vključno z izdelavo podatkov in receptom za strežbo.
- Gradnja korpusa, prevajanje ali destilacija po potrebi
- Večstopenjsko učenje z vrati na kontrolnih točkah
- Dostava GGUF / vLLM, kartica modela, delavnica ob predaji
Vztrajnik na naročnino
Novi podatki noter, ponovno učenje, ponovna evalvacija, dostava — vsak mesec, z lestvico kot pogodbo.
- Verzionirano merilo, ki raste z vašimi primeri uporabe
- Opozorila o nazadovanju, preden jih opazijo uporabniki
- Nadgradnja osnove, ko se pojavi boljši odprti model
GPU čas je na voljo tudi samostojno za ekipe, ki prinesejo lastno verigo.
Naravnost.
Kdo je lastnik modela?
Vi. Uteži, adapterje, zbirke, ki jih zgradimo za vas, evalvacijski nabor in zapis o izvoru dostavimo vam. Ničesar ne obdržimo, česar ne želite.
Fino uglaševanje ali iskanje (RAG)?
Običajno oboje. Iskanje je pravo za dejstva, ki se dnevno spreminjajo; fino uglaševanje je pravo za vedenje — formate, terminologijo, uporabo orodij, ton in to, da majhen model zmore, kar je prej zmogel le velik. Pilot preveri, kaj dejansko premakne vašo metriko, preden se odločite.
S katerimi osnovnimi modeli delate?
S katerimkoli odprtim modelom, katerega licenca ustreza vaši rabi: Qwen, Gemma, Llama, Mistral za besedilo; Nemotron in Parakeet za razpoznavo govora; odprti TTS modeli za sintezo. Sledimo licenci vsake osnove in vsakega vira podatkov in vam povemo, če kombinacija ni komercialno uporabna.
Kateri jeziki?
Katerikoli. Večina industrijskih programov teče v jeziku stranke na močni večjezični osnovi; slovenščina je naš preverjen primer od začetka do konca. Za premalo zastopane jezike velja isti recept — nadaljevano predučenje, fino uglaševanje, zamrznjena evalvacija — in pošteno ocenimo, koliko uporabnega besedila obstaja, preden karkoli obljubimo.
Koliko podatkov potrebujem?
Za fino uglaševanje že nekaj tisoč kakovostnih primerov naredi razliko. Za nadaljevano predučenje več sto milijonov žetonov. Česar nimate, lahko zgradimo, prevedemo ali destiliramo — to je polovica tega, kar delamo.
Ali model lahko teče brez povezave?
Da. Naši modeli 4B tečejo na prenosniku; modeli 27–35B na eni GPU v delovni postaji. Vse, kar dostavimo, deluje z izklopljenim omrežnim kablom.
Ali to pomaga pri Aktu EU o umetni inteligenci?
Pri dokumentacijskem delu da: vsak model pride s kartico podatkov, zapisom o izvoru, učnimi konfiguracijami in rezultati evalvacije — artefakti, ki jih zahtevajo obveznosti preglednosti in vodenja evidenc. Nismo pravniki; vaši ekipi za skladnost damo, kar potrebuje.
Kako dolgo traja?
Izmerjen pilotni model v tednih. Celoten program je odvisen od pripravljenosti podatkov; po tednu za obseg dobite datiran urnik in vsaka faza se konča s številko, ki jo lahko preverite.
Pošljite nam petdeset primerov.
Pokažite nam petdeset resničnih vprašanj in odgovorov iz vaše domene. V enem tednu vam povemo, kaj bi zmogel model, naučen na vaših podatkih — in natančno, kaj bi bilo za to potrebno.