Goobo Labs
Cilmi-baaris
DulmarDaabacadoHalbeegyada (SomBench)Il-furanQorshaha horumarinta
Kaydadka xogtaMoodelladaBootcamp-yadaMaqaalladaBulshada
GalLatalinta
Goobo Labs

Shaybaar cilmi-baaris oo furan oo dhisaya aasaaska AI Soomaaliga.

info@goobolabs.so
Muqdisho, Soomaaliya

Cilmi-baaris

  • Dulmar
  • Daabacado
  • Cabbirro
  • Waddada

Xogta

  • SomNLP Corpus
  • SomNLP STT
  • Wikipedia Corpus
  • Hagaha xigashada

Bootcamp-yada

  • Bootcamp Data Science & ML
  • Python qof kasta
  • Bootcamp-ka Git & GitHub

Kheyraadka

  • Erayada AI & Xogta
  • Dukumeentiyada
  • Moodello & qalab
  • Il-furan
  • Maqaallada
  • Soplang

Shirkadda

  • Nagu saabsan
  • Shaqooyin
  • Saamaynta
  • Xirmada saxaafadda
  • Xaqiiji shahaadada
  • Xiriir

© 2026 Goobo Labs. Cilmi-baaris furan oo loogu talagalay AI Soomaaliga.

Siyaasadda sirtaShuruudaha adeegga
Xogta

Xogta Soomaaliga ee furan

Kheyraad qoraal iyo hadal oo la diiwaangeliyey oo la noocaynayo.

Xogta furan

Mashaariic aad maanta ku dhisi karto

Shatiyo furan, la diiwaangeliyey, oo la noocaynayo. Daawo, soo degso, oo xuso.

Eeg dhammaan xogta
Fur bogga xogta oo dhan
Fur bogga xogta oo dhan
Fur bogga xogta oo dhan
Fur bogga xogta oo dhan
Isku day hadda

NLP Soomaali, gacantaada

Muuqaal ka mid ah moodellada aan tababarno. Door jumlad oo daawo sida loo kala qaybiyo, loo kala saaro, loona turjumo — gebi ahaan Af-Soomaali.

Waxaan jeclahay barashada cilmi-nafsiga iyo AI-ga.

Tokenization · 6 tokens

Waxaanjeclahaybarashadacilmi-nafsigaiyoAI-ga

Natiijada moodelka

LuqadSoomaali · af
QoraalLatin
DareenWanaagsan
Kalsooni94%
Tijaabo muujin ah — dhibcaha kalsoonidu ma aha natiijooyin qiimeyn.
Xigasho

Sida loo xigo xogteenna

Haddii aad cilmi-baahistaada ku isticmaasho xogteenna, fadlan xuso gelitaanka ku habboon ee hoose.

SomNLP-Corpus v2
@dataset{somnlp-corpus-2026,
  title   = {SomNLP-Corpus: An Open Somali Text Corpus},
  author  = {Osman, Mohamud and Ahmed, Faadumo and Hassan, Abdirahman},
  year    = {2026},
  version = {2.0},
  url     = {https://huggingface.co/datasets/goobolabs/somnlp-corpus},
  license = {CC-BY-4.0}
}
SomNLP-STT-Corpus
@dataset{somnlp-stt-2026,
  title   = {SomNLP-STT-Corpus: Somali Automatic Speech Recognition Dataset},
  author  = {Mohamed, Haawa and Osman, Mohamud},
  year    = {2026},
  url     = {https://huggingface.co/datasets/goobolabs/somnlp-stt},
  license = {CC-BY-4.0}
}
Tirakoobka corpus-ka

Gudaha xogta

Xaggee qoraalladayadu ka yimaadaan iyo sida corpus-ku u koray tan iyo bilowgii.

Qaybinta domains — SomNLP-Corpus

News
38%
Web
28%
Literature
16%
Wikipedia
12%
Social
6%
NewsWebLiteratureWikipediaSocial

Koritaanka corpus-ka — tokens (milyan)

0M1M2M3M4MQ1 '25Q2 '25Q3 '25Q4 '25Q1 '26
Q2 '26887M ↑
Nala dhiso

Ku dhiso AI Soomaaliga si furan

Isticmaal kaydadkayaga xogta iyo moodelladayada, ka qaybqaado cilmi-baarista, ama la shuraako shaybaarka. Wax kasta oo aan si furan u wadaagi karno, waan wadaagnaa.

Ka qaybqaado GitHub Sahami kaydadka xogta
GooboLabs
976+
Xiddigo GitHub
490+
Forks
269+
Wax-ku-biiriyayaal