Контекст във времето
Изследваме как AI разбира кое е текущо, кое е историческо и как здравните данни се променят във времето.
Как изследваме и подобряваме начина, по който AI работи със здравна информация.
Kanzen е общественополезен проект на Фондация „КанзенКай“, създаден да помага на хората да организират и разбират по-добре собствената си здравна информация. Част от работата ни е системно да изследваме колко последователно и ясно AI може да работи със здравни данни, които се натрупват през годините.
Подходът ни съчетава структурирани данни, ясни източници, проверки на поведението на AI и сравнения между български и английски език.
Нашият подход
Здравната информация има смисъл в контекст. Един лабораторен резултат, лекарство или симптом може да изглежда различно, когато се разглежда спрямо предишни резултати, промени във времето и други записи.
Затова Kanzen е насочен към longitudinal health data — информация, която се натрупва и променя във времето.
Изследваме как AI разбира кое е текущо, кое е историческо и как здравните данни се променят във времето.
Целта е отговорите да бъдат максимално свързани с наличната информация, а не с предположения.
Изследваме как сложна здравна информация може да бъде обяснявана по ясен и полезен начин.
Какво изследваме
Research програмата на KanzenKai е фокусирана върху това как AI може да работи по-надеждно с лични здравни записи и как тези системи могат да бъдат оценявани по измерим и възпроизводим начин.
Изследваме дали твърденията на AI могат да бъдат отнесени до конкретни записи и факти.
Проверяваме дали AI правилно различава стари и нови резултати, започнати и прекратени лекарства и други промени.
Изследваме дали системата може коректно да показва, когато липсва достатъчно информация за сигурен извод.
Сравняваме поведението на AI при еквивалентни здравни сценарии на български и английски език.
Проверяваме дали сходни въпроси и сходни данни водят до стабилни и предвидими резултати.
Метод
За първоначалните изследвания използваме синтетични здравни записи, създадени специално за тестове. Те имитират реалистични ситуации, без да съдържат данни на реални пациенти.
Създаваме различни сценарии с лабораторни резултати, лекарства, симптоми, измервания и събития във времето. След това проверяваме как AI се справя при ясна, непълна, противоречива или променяща се информация.
Това ни позволява да сравняваме различни модели, настройки и подходи по един и същ набор от контролирани тестове.
Оценка
Всеки въпрос, който изследваме, има нужда от мярка, която друг екип може да приложи върху същия материал и да получи същото число.
| Показател | Какво означава |
|---|---|
| Grounding accuracy | Дали отговорът се базира на наличните здравни записи. |
| Source accuracy | Дали посоченият източник действително подкрепя твърдението. |
| Temporal accuracy | Дали правилно се разбира кое е актуално и кое историческо. |
| Uncertainty handling | Дали AI показва, когато информацията е недостатъчна. |
| Consistency | Дали сходни случаи водят до сходно поведение. |
| Multilingual robustness | Дали качеството се запазва между български и английски. |
В техническите оценки измерваме и unsupported claim rate — честотата на твърдения, които не могат да бъдат подкрепени от предоставените данни.
Обхват
Kanzen е създаден като помощник за работа със собствената ти здравна информация — да я организира, обяснява и поставя в контекст.
Той не е предназначен да замества лекар или друг медицински специалист. При важни медицински решения професионалната преценка остава най-важна.
Тази страница описва какво изследваме и какво планираме да оценяваме. Тя не описва възможности, които продуктът вече гарантира.
Първоначалната research програма използва синтетични записи, създадени специално за тестове.
Това позволява да оценяваме поведението на AI, без за тези експерименти да са необходими идентифициращи здравни данни на реални хора.
Open research
Целта ни не е само да подобряваме Kanzen. Където е практично, планираме да публикуваме методология, синтетични benchmark компоненти, обобщени резултати и наблюдения, които могат да бъдат полезни и за други екипи, работещи по отговорни health-AI системи.
Особен фокус е оценката на AI на български език — област, за която в момента има значително по-малко публични данни и benchmarks в сравнение с английски.
Текуща изследователска програма
Проект
Фокус на изследването
Планирана продължителност
6 месеца
Състояние
Програмата е в подготовка / фаза на оценка
Програмата се води и финансира от Фондация „КанзенКай“. Не твърдим финансиране или одобрение от AI доставчик.
Кратка бележка как е устроена оценката — за читатели, които работят по същите въпроси.
Партньорства
KanzenKai е отворена за партньорства с университети, медицински специалисти, health informatics изследователи и организации, които работят върху безопасно и полезно използване на AI в здравеопазването.
Kanzen е общественополезен проект за работа с лична здравна информация на Фондация „КанзенКай“. Описаните тук изследвания са насочени към оценка на AI и работа със здравна информация и не представляват клинично изследване, диагностика, лечение или медицински съвет.