ООН се обръща към Google, за да подготви глобалните си данни за ИИ агенти
Организацията на обединените нации обяви в четвъртък, че работи с Google, за да направи огромната си колекция от глобални статистически данни по-лесна за достъп и използване от системи с изкуствен интелект.
Наречена UN System Data Commons, новата система е изградена върху платформата с отворен код Data Commons на Google и позволява на хората да търсят статистически данни от различни агенции на ООН чрез заявки на естествен език. Тя заменя съществуващия портал UNData, където потребителите до голяма степен трябваше да преглеждат и търсят статистически данни чрез по-традиционен интерфейс на база данни. Новата платформа поддържа и Model Context Protocol (MCP) — стандарт, който позволява на системите с изкуствен интелект да се свързват директно с външни източници на данни.
Потребителите все по-често се обръщат към инструменти с изкуствен интелект за отговори, но много системи все още срещат трудности при надеждното представяне на авторитетни данни. Бенчмарк тест на UNICEF на шест големи езикови модела, обхванал над 133 000 отговора на въпроси за глобални показатели за развитие, е показал средна точност от едва 21,2%, съобщи пред журналисти по време на виртуален брифинг Жоао Педро Азеведо, главният статистик на агенцията.
Тестът е обхванал GPT-4o и GPT-4o-mini на OpenAI, Claude Sonnet 4.5 и Haiku 4.5 на Anthropic, както и Gemini 2.5 Flash и Gemini 2.0 Flash на Google, съобщи Азеведо пред TechCrunch.
Около три от всеки пет отговора изобщо не са съдържали използваемо число, често защото моделите са давали уклончиви отговори, каза Азеведо. Когато обаче същите въпроси са били зададени отново на същите версии на моделите около два дни по-късно, моделите, които и двата пъти са дали число, са посочили идентично число само в около половината от случаите.
Проучването представлява работен документ на UNICEF, който се подготвя за изпращане в научно списание, и все още не е рецензиран. Организацията заяви, че планира да публикува методологията, кода и данните заедно с документа.
UNICEF също така е отчел рязък ръст през тази година на трафика от генеративни асистенти с изкуствен интелект към уебсайта си за данни, който получава над шест милиона посещения месечно и е сред най-популярните сайтове на агенцията. Посещенията от потребители, кликнали върху връзки в отговори на ChatGPT към сайта, са нараснали с 67% на годишна база между 1 януари и 14 септември, съобщи Азеведо пред TechCrunch. Тези препратки са представлявали 6,4% от всички сесии през тази година, докато UNICEF изчислява, че асистентите с изкуствен интелект като цяло вече отговарят за около едно от всеки 10 посещения.
ООН съобщи, че 26 нейни организации са поели ангажимент към Data Commons, като при старта са били налични данни от почти 20 от тях. Освен това организацията има за цел до 2027 г. да прехвърли 80% от статистическите набори от данни на системата на ООН в платформата.

„Сега сме с порядъци по-напреднали по отношение на мащаба, обхвата и гъвкавостта, като за първи път свързваме толкова много агенции в рамките на системата на ООН“, заяви Шантану Мукърджи, изпълняващият длъжността директор на Статистическия отдел на ООН. „И [ние] използваме този момент, за да направим данните си готови за изкуствен интелект.“
Google.org предостави 2 милиона долара финансиране за изграждане на капацитет и техническа подкрепа за създаването на основната инфраструктура на платформата. Прем Рамасвами, който ръководи екипа на Google за Data Commons, заяви пред TechCrunch, че системата е хоствана в управляван от ООН екземпляр и в крайна сметка е предназначена да бъде поддържана, управлявана и разширявана независимо от ООН.
„По време на цялото внедряване прилагахме подхода „обучи обучаващия“ и вече видяхме как екипът на системата на ООН бързо увеличава капацитета си“, каза Рамасвами.
Google стартира Data Commons през 2018 г. като опит да организира публични набори от данни от различни източници в обща рамка. Миналата година компанията добави поддръжка за MCP, което позволява на агентите с изкуствен интелект директно да отправят заявки към Data Commons за статистически данни и техните източници.
Платформата на ООН също така проследява произхода на всяка статистика, така че хората да могат да проследят данните, извлечени от система с изкуствен интелект, обратно до първоначалния източник на ООН. Азеведо заяви пред журналисти, че това е важно, тъй като все повече хора разчитат на инструменти с изкуствен интелект, за да намират и интерпретират информация.
Освен че позволява на агентите с изкуствен интелект да извличат отделни статистически данни, Google демонстрира как система с изкуствен интелект, свързана с данните на ООН чрез MCP, може да обедини множество показатели и да ги използва за създаване на табла, диаграми и писмен анализ, без потребителят да трябва ръчно да намира и комбинира базовите набори от данни.
В една от демонстрациите Google е поискал от система с изкуствен интелект да открие въздействието на Президентския план за спешна помощ за борба със СПИН на САЩ в Африка. Системата е идентифицирала релевантни статистически данни на ООН за показатели, включително ХИВ инфекции, смъртност от СПИН и очаквана продължителност на живота, и ги е използвала, за да създаде инфографика.
Предоставянето на авторитетни данни на система с изкуствен интелект обаче не означава непременно, че нейните заключения ще бъдат авторитетни. „Тъй като моделите могат да интерпретират погрешно нюансите, човек винаги трябва да преглежда резултатите, преди те да бъдат цитирани или публикувани“, каза Рамасвами.
Преведено автоматично от английски. Оригиналната статия е на връзката по-долу.