Home 综合新闻 拉坦-GPT:免費,開放的人工智能與拉丁美洲的合作

拉坦-GPT:免費,開放的人工智能與拉丁美洲的合作

160
0

新的Latam-GPT 在拉丁美洲開發了大型語言模型。該項目在智利非營利性國家人工智能中心(CENIA)的領導下,旨在通過開發以拉丁美洲語言和環境培訓的開源大赦國際模式來幫助該地區實現技術獨立性。

西莉亞(Celia)董事阿爾瓦羅·索托(Alvaro Soto)在接受《連線恩斯波尼爾》(Yired EnEspañol)採訪時說:“在拉丁美洲,一組或只有一個國家不能完成這項工作:這是一個需要每個人參與的挑戰。” “ Latam-GPT是一個旨在創建一個大赦國際開放和自由模型的項目,最重要的是。我們已經從基地組織到​​頂部進行了兩年的運作,並結合了來自不同國家的公民,他們想合作。最近,一些倡議也從頂部到底都看到了,有興趣的政府,並開始參與該項目。”

該項目突出了其合作精神。 Soto解釋說:“我們不想與OpenAI,DeepSeek或Google競爭。我們希望為拉丁美洲和加勒比地區一個模型,熟悉所需的要求和文化挑戰,例如了解不同的重音,該地區的歷史以及獨特的文化方面。”

得益於與拉丁美洲和加勒比地區機構的33個戰略合作夥伴關係,該項目收集了一組超過八個文本的數據,相當於數百萬本書。該數據庫使具有500億教師的語言模型的開發,這一措施與GPT-3.5相似,並使其具有執行思維,翻譯和關聯等複雜任務的中等至高能力。

Latam-GPT在一個區域數據庫中進行了培訓,該數據庫從拉丁美洲和西班牙的20個國家 /地區收集信息,共有255500個文件。數據分佈表明,該地區最大的國家的重點非常重點,巴西有685,000個文件,其次是墨西哥,有38.5萬,西班牙,32.5萬,哥倫比亞為220,000,阿根廷有210,000個文件。數字反映了這些市場的規模,它們的數字開發以及有組織的內容的可用性。

“最初,我們將啟動一種語言模型。我們希望它在公共任務接近大型商業模型中的表現,但是隨著拉丁美洲主題的出色表現。這個想法是,如果我們詢問我們地區的相關主題,那麼它的知識將會更深入。”

第一個模型是將來開發最先進技術的家族的起點,包括包含照片和視頻的家族,並擴展更大的模型。 “由於這是一個開放的項目,我們希望其他機構能夠使用它。哥倫比亞的一個團體可以適應學校教育系統或可以在衛生部門適應它。

來源連結