KT и Университет Корё разработали корейский AI-бенчмарк безопасности
2026-06-16 13:41
В избр.

Репортаж от Wedoany,Компания KT 16-го числа объявила о совместной с Университетом Корё разработке мультимодального бенчмарка безопасности для больших языковых моделей под названием «KSAFE-MM», предназначенного для оценки безопасности моделей искусственного интеллекта в социокультурном контексте Южной Кореи.

Данный бенчмарк, учитывающий социальные проблемы и культурный контекст Южной Кореи, состоит из двух подмножеств: «KSAFE-MM-G» преобразует глобальные общие риски в корейский культурный контекст для оценки; «KSAFE-MM-C» специально ориентирован на уникальные для южнокорейского общества темы, такие как мошенничество с чонсе (арендной платой) и спор о скалах Токто. Весь набор данных включает в общей сложности 14 135 оценочных образцов, что делает его крупнейшим на сегодняшний день в Южной Корее мультимодальным набором данных для оценки безопасности на корейском языке. На данный момент бенчмарк прошёл валидацию на 12 глобальных мультимодальных больших языковых моделях, включая Gemma и HyperCLOVA X.

Сотрудники KT разрабатывают «KSAFE-MM». (Фото: KT)

Данный бенчмарк реализован с помощью автоматизированного универсального процесса. «KSAFE-MM» обеспечивает четырёхэтапный автоматизированный процесс, охватывающий весь цикл, включая сбор чувствительных тем на основе местного сообщества, генерацию запросов на основе шаблонов, генерацию синтетических изображений, а также генерацию «джейлбрейк»-запросов, направленных на обход механизмов безопасности или этических ограничений ИИ. В KT заявили, что этот процесс позволяет быстро создавать бенчмарки безопасности, отражающие местные особенности, без привлечения экспертов в конкретной культурной области, тем самым снижая затраты и повышая эффективность.

Совместная исследовательская группа KT и Университета Корё, применив тот же процесс в пилотном эксперименте на японском языке, доказала, что данный бенчмарк может быть немедленно применён в любой культурной среде по всему миру. Результаты исследования могут быть использованы для проверки безопасности в реальных средах сервисов ИИ, тестирования «красных команд» (red teaming), оценки моделей-ограничителей (guardrails) и других целей. Результаты исследования и сам бенчмарк будут опубликованы на платформах arXiv и Hugging Face.

Пак Чжэ Хён, руководитель Frontier AI Lab в Институте будущих технологий AX компании KT, отметил, что публикация бенчмарка — это не просто распространение данных, а стремление заложить основу для совместного развития всей экосистемы исследований в области безопасности ИИ. Он выразил надежду, что KSAFE-MM станет универсальным стандартом для проверки безопасности ИИ в контексте корейского языка и корейской культуры как в академических, так и в промышленных кругах.

Данный материал скомпилирован платформой Wedoany. При цитировании материалов, созданных с помощью искусственного интеллекта (ИИ), необходимо обязательно указывать источник — «Wedoany». В случае выявления нарушения прав или иных проблем просим своевременно информировать нас. Сайт оперативно внесёт изменения или удалит материал.Электронная почта: news@wedoany.com

Эта новость является результатом компиляции и перепечатки информации из глобального Интернета и стратегических партнеров. Она предназначена только для читателей. Если у вас возникнут какие-либо нарушения или другие проблемы, пожалуйста, своевременно сообщите нам. Этот сайт изменить или удалить ее. Перепечатка этой статьи без официального разрешения строго запрещена.электронная почта:news@wedoany.com
Связанные продукты
Последние новости
1
Китайская компания Xiangdian Electromechanical выиграла тендер на обслуживание фотоэлектрической станции мощностью 1178 МВт и накопителя энергии мощностью 150 МВт в провинции Юньнань
2
Инвестиции в чистые технологии Испании и Португалии во втором квартале 2026 года составили 211,2 млн евро
3
В Лондоне планируют запустить роботакси: опасения по поводу нагрузки на электросеть и безопасности
4
Trinseo расширяет ассортимент акриловых латексных продуктов для применения в CASE
5
WesternX подает заявку на горный арендный договор для золоторудного месторождения Kingsley с запасами 73 тыс. унций в Западной Австралии
6
Две канадские компании подписали опционное соглашение на уранопроект Yurchison с возможностью получения 100% доли
7
Медный проект Los Azules стоимостью 2,7 млрд долларов в Аргентине переключается на электросеть Мендосы
8
Канадская Boreal Gold пробурила 2,41 м руды с содержанием золота 15,54 г/т
9
Исследование UCSC в Чили: экономическая эффективность грузовиков на зелёном водороде для дальних перевозок становится очевидной
10
Испанская Moeve направит 69% капитальных затрат на энергетический переход в первом полугодии 2026 года
Связанные рекомендации
Землетрясение магнитудой 7,1 в Кумамото, Япония! Два завода TEL остановили работу, TSMC постепенно возобновляет производство!
2026-08-01
В порту Виго (Испания) запустят первый пилотный проект цифрового двойника
2026-08-01
Закон ЕС об ИИ вступает в силу 2 августа 2026 года, британская CMA расследует Microsoft Copilot
2026-08-01
Американская Hughes Network Systems, дочерняя компания EchoStar, может подать заявление о банкротстве из-за долга в 1,5 миллиарда долларов
2026-08-01
Британский EE запускает оптоволоконный широкополосный сервис 8 Гбит/с на базе XGS-PON
2026-08-01
Еврокомиссия объявила тендер на строительство ИИ-гигафабрик на сумму 30 млрд евро
2026-08-01
Американская S&P Global приобретает аналитическую компанию рынка центров обработки данных datacenterHawk
2026-08-01
Бразильское агентство электросвязи в 2025 году отозвало разрешение на вхождение Plintron в Surf Telecom
2026-08-01
Совет директоров тайваньской MediaTek одобрил финансирование в размере 5 млрд долларов для разработки заказных чипов для ИИ-центров обработки данных
2026-08-01
Avocados From Mexico запускает ИИ-движок вопросов и ответов AVO.AI ко Дню авокадо в США
2026-08-01