Седмата международна конференция „Компютърна лингвистика в България“ ще се състои в София


Седмата международна конференция „Компютърна лингвистика в България“ (CLIB 2026) ще се състои от 7 до 10 септември в София. Конференцията се организира от Секцията по компютърна лингвистика към Института за български език „Проф. Любомир Андрейчин“ при Българската академия на науките (ИБЕ-БАН), съобщиха организаторите.
Форумът събира изследователи от България и чужбина, работещи в областта на компютърната лингвистика, обработката на естествения език и съвременните езикови технологии.
CLIB е международен научен форум, посветен на новите подходи и методи в компютърната лингвистика и обработката на естествения език, с особен акцент върху приложението им към езици, за които има малко езикови ресурси, като българския. Конференцията има за цел да насърчава развитието на научната общност в областта и сътрудничеството между български и международни изследователи.
Във фокуса на тазгодишното издание са едни от най-актуалните теми в областта на езиковите технологии – големите езикови модели, изкуственият интелект, обработката и оценяването на езикови данни, езиковите ресурси и разработването на технологии за езици с малко ресурси.
Специално внимание е отделено на българския език. В програмата са включени изследвания, свързани с откриването на генериран от изкуствен интелект български текст, оценяването на езиковите характеристики на генерирани от изкуствен интелект български новини, разработването на инструменти за проверка на българската граматика, както и създаването на нови езикови ресурси и методи за обработка на български език.
Изкуственият интелект и езиковите технологии
Сред основните лектори на CLIB 2026 са проф. Преслав Наков от Университета за изкуствен интелект „Мохамед бин Зайед“, проф. Руслан Митков от Университета на Ланкастър и Университета на Аликанте и д-р Халид Шукри от Европейската асоциация за езикови ресурси.
Научната програма включва теми, свързани с надеждния изкуствен интелект, мултимодалното моделиране, големите езикови модели, автоматичното създаване и оценяване на езикови ресурси, обработката на езици с малко ресурси, анализа на дезинформацията, синтетичните данни и езиковите корпуси.
Представените изследвания обхващат български, румънски, сръбски, турски, английски, украински, руски, алжирски арабски, таджикски и други езици.
По този начин конференцията поставя във фокуса и един от важните въпроси пред езиковите технологии – как съвременните технологии могат да бъдат развити така, че да отчитат спецификите и потребностите както на големите, така и на езиците, за които има малко езикови ресурси.
Специална сесия за семантични релации, Фреймнет и онтологии
В рамките на CLIB 2026 ще се състои и специална сесия, посветена на семантичните релации, Фреймнет и онтологиите. Това е петото издание на специалната сесия след успешното ѝ начало през 2018 г.
Сесията ще събере изследователи, работещи върху принципите, теорията, практиката и приложенията на семантичните релации, Фреймнет и онтологиите, както и върху свързани езикови ресурси и тяхната съвместимост.
От научните изследвания към практическите приложения
Програмата на CLIB 2026 включва и специализирани работни ателиета и практически обучения. Сред тях са CLEAR-TEXT, посветен на четивността и опростяването на текстове, и FAIR Language Resources in NLP, насочен към управлението, повторното използване и дългосрочното съхраняване на езикови ресурси.
Предвидено е и практическо обучение Ollama, No Drama: Step-by-Step Guide of Practical Local AI, посветено на използването на локален изкуствен интелект, както и обучения в областта на компютърната лингвистика и сигурността на AI системите.
Отличия за млади изследователи
CLIB 2026 ще насърчи и участието на младото поколение изследователи. В рамките на конференцията ще бъде връчена традиционната награда Promising Young Researcher Award, а през тази година за първи път ще бъдат присъдени и отличия за най-добро устно представяне и най-добро представяне с постер на млади изследователи, съобщават от ИБЕ-БАН.