Sağlık Sektörü Yapay Zekası için Tıbbi Veri Kataloğu
Healthcare AI projenizi hızlı bir şekilde başlatmak için kullanıma hazır Sağlık Hizmetleri/Tıbbi Veri Kümeleri
Makine Öğrenimi için Tıp ve Sağlık Hizmetleri veri kümeleri
Shaip Tıbbi Veri Kataloğu Neleri İçeriyor?
Shaip Tıbbi Veri Kataloğu, 31 tıp uzmanlık alanını kapsayan, HIPAA uyumlu, kullanıma hazır, kimliksizleştirilmiş sağlık eğitimi verilerinden oluşan bir kütüphanedir. Bu kütüphane, 257,977 saatlik doktor dikte ses kayıtları, transkript edilmiş tıbbi kayıtlar, elektronik sağlık kayıtları ve çok modlu veri kümelerini içermektedir. Her veri kümesi, ticari yapay zeka eğitimi için lisanslıdır ve Güvenli Liman veya Uzman Kararı ile kimliksizleştirme yöntemiyle birlikte sunulmaktadır.
Doktor Dikte Ses Verileri
Sağlık hizmetlerine ilişkin kimliği gizlenmiş veri setimiz, hekimler tarafından belirlenen 31 uzmanlık alanındaki hastaların klinik durumlarını ve klinik ortamda hekim-hasta karşılaşmalarına dayalı bakım planlarını açıklayan ses dosyalarını içerir.
Kullanıma Hazır Doktor Dikte Ses Dosyaları:
- Sağlık Konuşma modellerini eğitmek için 257,977 uzmanlık alanından 31 saatlik Gerçek Dünya Hekim Dikte Konuşma Veri Seti
- Telefon Dikte (%54.3), Dijital Kaydedici (%24.9), Konuşma Mikrofonu (%5.4), Akıllı Telefon (%2.7) ve Bilinmeyen (%12.7) gibi çeşitli cihazlardan alınan dikte sesi
- HIPAA ile uyumlu olarak Güvenli Liman Yönergelerine bağlı PII Düzeltilmiş Ses ve Transkriptler
Yazılı Tıbbi Kayıtlar
Yazılı tıbbi kayıtlar, hekim ve hasta görüşmelerinin, tıbbi raporların ve tıbbi değerlendirmelerin yazıya geçirilmesini ifade eder. Hastanın tıbbi geçmişinin gelecekteki ziyaretler için haritalanmasına yardımcı olur ve aynı zamanda doktorlar için bir referans noktası görevi görür. Hastanın mevcut durumunun değerlendirilmesine ve uygun bir tedavi önerilmesine yardımcı olur.
Kullanıma Hazır Yazılı Tıbbi Kayıtlar:
- Healthcare Speech modellerini eğitmek için 257,977 uzmanlıktan 31 saatlik Gerçek Dünya Doktor Diktesinin transkripsiyonu
- Ameliyat Raporu, Taburcu Özeti, Konsültasyon Notu, Kabul Notu, Acil Servis Notu, Klinik Notu, Radyoloji Raporu vb. gibi çeşitli iş türlerinden Tıbbi Kayıtların Yazıya Dökülmesi
- HIPAA ile uyumlu olarak Güvenli Liman Yönergelerine bağlı PII Düzeltilmiş Ses ve Transkriptler
Elektronik Sağlık Kayıtları (EHR)
Elektronik Sağlık Kayıtları veya EHR, hastanın tıbbi geçmişini, teşhislerini, reçetesini, tedavi planlarını, aşı veya aşı tarihlerini, alerjileri, radyoloji görüntülerini (CT Taraması, MRI, X-Işınları) ve laboratuvar testlerini ve daha fazlasını içeren tıbbi kayıtlardır.
Kullanıma Hazır Elektronik Sağlık Kayıtları (EHR):
- 5.1 uzmanlık alanında 31M+ Kayıt ve doktor ses dosyaları
- Clinical NLP ve diğer Document AI modellerini eğitmek için gerçek dünyada altın standartta tıbbi kayıtlar
- MRN (Anonimleştirilmiş), Kabul Tarihi, Taburcu Tarihi, Kalış Günlerinin Uzunluğu, Cinsiyet, Hasta Sınıfı, Ödeyen, Mali Sınıf, Eyalet, Taburcu Durumu, Yaş, DRG, DRG Açıklaması, $ Geri Ödeme, AMLOS, GMLOS, Risk ölüm oranı, Hastalığın şiddeti, Orfoz, Hastane Posta Kodu, vb.
- ABD'nin çeşitli eyaletlerinden ve bölgesinden Tıbbi Kayıtlar - Kuzey Doğu (%46), Güney (%9), Ortabatı (%3), Batı (%28), Diğerleri (%14)
- Kapsanan tüm Hasta Sınıflarına ait Tıbbi Kayıtlar - Yatarak, Ayakta Hasta (Klinik, Rehabilitasyon, Tekrarlayan, Cerrahi Gündüz Bakımı), Acil.
- Tüm Hasta Yaş Gruplarına ait Tıbbi Kayıtlar <10 yıl (%7.9), 11-20 yıl (%5.7), 21-30 yıl (%10.9), 31-40 yıl (%11.7), 41-50 yıl (%10.4) ), 51-60 yaş (%13.8), 61-70 yaş (%16.1), 71-80 yaş (%13.3), 81-90 yaş (%7.8), 90+ yaş (%2.4)
- Hasta Cinsiyet oranı %46 (Erkek) ve %54 (Kadın)
- HIPAA'ya uygun olarak Güvenli Liman Yönergelerine bağlı PII Düzeltilmiş Belgeler
Alıcıların beş nedeni Shaip lisansı Birbirine dikmek yerine.
Shaip Tıbbi Veri Kataloğu, çoğu sağlık alanındaki yapay zeka ekibinin tek bir model eğitilmeden önce uyumlu eğitim verisi bulmak için dokuz ila on iki ay kaybetmesi nedeniyle ortaya çıkmıştır . Bu aylar geri döndüğünde neler değişiyor, işte burada açıklanıyor.
Çoğu takımın ulaşamayacağı bir katalog ölçeği.
Shaip kataloğu, 257,977 saatlik doktor diktesi, 31 tıp uzmanlık alanından transkripsiyonlar ve her hasta yaş grubunu kapsayan elektronik sağlık kayıtları içeriyor; bu tür bir hacim, alıcıların düzinelerce açık veri setini bir araya getirmeye gerek kalmadan modelleri eğitmesine ve değerlendirmesine olanak tanıyor.
Uyumluluk bir başlangıç koşuludur, bir özellik değil.
Shaip'in tüm tıbbi veri setleri, varsayılan olarak HIPAA Güvenli Liman kimliksizleştirme , talep üzerine Uzman Değerlendirmesi, GDPR uyumlu işleme ve kapsama giren kuruluşlar için BAA uyumluluğu ile birlikte gelir. Alıcıların sonradan uyumluluk sağlamak için ek düzenlemeler yapmasına gerek yoktur.
Sağlık alanında eğitim almış uzmanlar, genel geçer kalabalık çalışanlar değil.
Shaip tıbbi kataloğundaki açıklama ekleme, transkripsiyon ve kalite kontrolü, sağlık alanında eğitim almış uzmanlar tarafından gerçekleştirilir . Shaip iş akışı, klinik doğruluk standartlarına göre kalibre edilmiş çok katmanlı kalite kontrolü ve insan müdahalesi gerektiren doğrulama süreçlerini içerir.
Bugün hazır, sipariş üzerine özel üretim.
Alıcılar, mevcut Shaip veri kümelerini hemen lisanslayabilir veya belirli demografik özelliklere, coğrafyalara, dillere ve yöntemlere yönelik özel veri toplama hizmeti sipariş edebilirler; bu işlem için tedarikçi değiştirmeye veya uyumluluk incelemesini yeniden çalıştırmaya gerek yoktur.
Veri ekiplerinin halihazırda çalıştığı yerlerde mevcuttur.
Shaip'in anonimleştirilmiş elektronik sağlık kayıtları ve doktor dikte verileri, veri ve makine öğrenimi ekiplerinin halihazırda kullandığı JSON, CSV, WAV formatlarında Databricks Pazaryeri'nde mevcuttur. Herhangi bir taahhütte bulunmadan önce örnek veri setlerine erişilebilir.
Güvenlik ve Uyumluluk
Aradığınızı bulamıyor musunuz?
Tüm veri türlerinde kullanıma hazır yeni tıbbi veri kümeleri toplanıyor
Sağlık eğitimi veri toplama endişelerinizi gidermek için şimdi bizimle iletişime geçin
Sıkça Sorulan Sorular (SSS)
1. Tıbbi veri setleri nelerdir?
Tıbbi veri kümeleri, yapay zeka/makine öğrenimi modellerini eğitmek, değerlendirmek ve geliştirmek için kullanılan sağlık verileridir. Bunlar arasında doktor dikte ses kayıtları, transkript edilmiş tıbbi kayıtlar, elektronik sağlık kayıtları, sentetik doktor-hasta diyalogları ve ilgili metin, konuşma ve yapılandırılmış klinik verileri birleştiren çok modlu sağlık veri kümeleri yer alabilir.
2. Shaip Tıbbi Veri Kataloğu'nda neler yer almaktadır?
Shaip Tıbbi Veri Kataloğu, doktor dikte ses kayıtlarını, transkripte edilmiş tıbbi kayıtları, elektronik sağlık kayıtlarını, sentetik doktor-hasta diyaloglarını ve hasta veya görüşme düzeyinde metin, konuşma ve yapılandırılmış klinik verileri birbirine bağlayan çok modlu veri kümelerini içerir. 31 tıbbi uzmanlık alanında 257,977 saatlik doktor dikte ses kaydı içerir ve ticari yapay zeka eğitimi için kullanılabilir.
3. Shaip'in tıbbi veri kümeleri HIPAA uyumlu mu?
Evet. Shaip'in tıbbi veri kümeleri, HIPAA Güvenli Liman (Safe Harbor) kapsamında varsayılan olarak anonimleştirilir ve HIPAA Gizlilik Kuralı'nda belirtilen 18 kategori tanımlayıcı kaldırılır. İstatistiksel sertifikasyon gerektiğinde Uzman Değerlendirmesi ile anonimleştirme de mevcuttur ve Shaip, kapsama giren kuruluşlar için BAA'ya hazırdır.
4. Shaip'in tıbbi veri kümeleri GDPR ve diğer sağlık verisi gereksinimlerini karşılayabilir mi?
Evet. Shaip'in tıbbi veri kümeleri, proje kapsamına, coğrafyaya, veri türüne ve sözleşme şartlarına bağlı olarak HIPAA, GDPR ve diğer geçerli sağlık verisi gereksinimlerini destekleyecek şekilde hazırlanabilir.
5. Sağlık verisi setlerini hazır olarak satın alabilir miyim, yoksa bunları kendim mi toplamam gerekiyor?
Her iki seçenek de mevcuttur. Shaip, ticari yapay zeka eğitimi için Shaip Tıbbi Veri Kataloğu aracılığıyla hazır sağlık veri kümeleri sunmaktadır. Bir proje belirli bir dil, demografik özellik, uzmanlık alanı, yöntem veya klinik ortam gerektiriyorsa, Shaip aynı uyumluluk standartları altında özel tıbbi veri toplama da gerçekleştirebilir.
6. Shaip tıbbi veri setleri özelleştirilebilir mi?
Evet. Shaip, tıbbi veri kümelerini uzmanlık alanı, hasta yaş aralığı, cinsiyet, coğrafya, dil, yöntem, klinik ortam, format, hacim ve proje gereksinimlerine göre özelleştirebilir. Özel veri kümeleri, iş tanımı belgesiyle belirlenir ve geçerli kimliksizleştirme ve uyumluluk standartlarına uyar.
7. Lisanslama işleminden önce örnek bir veri seti görebilir miyim?
Evet. Shaip, yapay zeka ekiplerinin lisanslama öncesinde formatı, kaliteyi, demografik kapsamı ve model uyumunu değerlendirebilmeleri için gizlilik sözleşmesi (NDA) kapsamında temsili örnek veri kümeleri sunmaktadır. Örnek veri setlerine erişim, genellikle Standart Lisans veya Özel Veri Toplama anlaşmasından önceki ilk adımdır.
8. Shaip tıbbi veri kümelerini hangi formatlarda teslim ediyor?
Shaip, yapılandırılmış kayıtlar için JSON, CSV ve FHIR dahil olmak üzere yapay zekaya hazır formatlarda tıbbi veri kümeleri sunar; ses verileri için eşleştirilmiş transkriptler içeren WAV dosyaları; ve konuşma ve dil veri kümeleri için transkript dosyaları sağlar. Çok modlu veri kümeleri, metin, ses ve yapılandırılmış klinik kayıtları birbirine bağlayan bildirim dosyaları içerebilir.
9. Shaip tıbbi veri kümelerinin kalitesini nasıl sağlıyor?
Shaip, uzman incelemesi, alan uzmanı açıklaması, doğrulama iş akışları ve yapılandırılmış kalite güvence kontrolleri yoluyla tıbbi veri setlerinin kalitesini sağlar. Bu süreçler, sağlık alanında yapay zeka geliştirme için doğruluk, güvenilirlik ve model hazır olma durumunu sağlamaya yardımcı olur.
10. Shaip'in tıbbi veri kümeleri büyük yapay zeka/makine öğrenimi projeleri için ölçeklenebilir mi?
Evet. Shaip'in tıbbi veri kümeleri hem küçük ölçekli pilot projeler hem de kurumsal yapay zeka/makine öğrenimi projeleri için ölçeklenebilirdir. Büyük miktarda tıbbi kayıt, yapılandırılmış klinik veri, transkript veya yüz binlerce saatlik doktor dikte ses kaydı gerektiren projeleri destekleyebilirler.
11. Shaip tıbbi veri kümeleri mevcut yapay zeka modellerine ve iş akışlarına entegre edilebilir mi?
Evet. Shaip, JSON, CSV, FHIR, WAV ve transkript dosyaları gibi kullanıma hazır formatlarda tıbbi veri kümeleri sunar. Bu formatlar, mevcut yapay zeka, makine öğrenimi, doğal dil işleme, konuşma, sağlık hizmetleri dil öğrenimi ve çok modlu model geliştirme iş akışlarına entegrasyonu destekler.
12. Shaip tıbbi veri setini almak ne kadar sürer?
Hazır tıbbi veri setleri, örnek incelemesi, sözleşme imzalanması ve lisanslama işlemlerinin tamamlanmasının ardından genellikle birkaç gün içinde teslim edilebilir. Özel veri toplama süreleri, proje kapsamına, veri seti boyutuna, yöntemine, uyumluluk gereksinimlerine ve karmaşıklığına bağlıdır ve iş tanımında belirtilir.
13. Tıbbi veri setlerinin maliyeti ne kadar?
Tıbbi veri setlerinin maliyeti, veri seti türüne, yöntemine, hacmine, özelleştirme gereksinimlerine, lisans koşullarına, teslimat zaman çizelgesine ve uyumluluk ihtiyaçlarına bağlıdır. Ekipler, özel bir fiyat teklifi almak için gereksinimlerini İletişim Formu aracılığıyla paylaşabilirler.
14. Tıbbi veri kümeleri sağlık hizmetlerinde yapay zeka/makine öğrenimi için neden önemlidir?
Yüksek kaliteli tıbbi veri kümeleri, doğru, güvenilir ve klinik açıdan faydalı sağlık yapay zeka modellerinin eğitilmesi için çok önemlidir. Tıbbi dokümantasyonun, klinik doğal dil işlemenin, konuşma tanımanın, özetlemenin, karar desteğinin, otomasyonun, hasta bakım iş akışlarının ve sağlık veri zekasının geliştirilmesine yardımcı olurlar.