9 жовтня 2026 року Journal of Medical Systems опублікував оцінку восьми систем розпізнавання мовлення. Одна людина прочитала 100 опублікованих описів хірургічних випадків; системи разом створили 800 транскриптів. Залежно від системи, 30–68% транскриптів містили щонайменше одну помилку, яку дослідники визнали клінічно значущою.
Йдеться про зміни змісту, які важко помітити з першого погляду та які можуть ввести читача в оману й потенційно вплинути на допомогу пацієнту. Фактичної шкоди пацієнтам дослідження не вимірювало.
Тестування проводили з 22 жовтня до 1 листопада 2025 року. Перевіряли транскрипцію в контрольованих умовах, без оцінки повного процесу створення нотаток із консультації. Висновки стосуються тодішніх версій і налаштувань та не дають підстав ранжувати сьогоднішні продукти.
Практичний висновок редакції для клініки: визначте лікаря, який перевірятиме чернетки перед внесенням до медичної картки. У пілоті враховуйте час на перевірку й виправлення поряд із часом, заощадженим на введенні тексту. Технічні тести починайте з вигаданих випадків; до використання реальних записів узгодьте заходи захисту даних пацієнтів. Самої перевірки недостатньо, щоб довести безпечність системи.
Наявні настанови NHS England також передбачають перевірку створених ШІ нотаток перед внесенням до картки. Це довідковий контекст для Англії, а не нова норма, запроваджена дослідженням.
9 жовтня є датою журнальної версії. У репозитарії King’s College London також є запис про рукопис, прийнятий до друку; дату його першого оприлюднення не встановлено.
Читайте також: де потрібна перевірка людиною.



