Dönüştürücü

Görselden Markdown'a dönüştürücü

Görselden Markdown'a, PNG, JPG, WEBP ve TIFF'i bugün OCR ile okuyan bir dönüştürücüdür. Herkese açık deneme 10 MB'a kadar dosya kabul eder.

Henüz belge dönüştürülmedi
Temiz Markdown çıktısını burada görmek için bir dosya yükleyin.
Yapay zekâ görsel açıklaması Yüksek doğruluklu OCR Geliştirmeleri kullanmak için oturum açın

Bir plan seçmeden önce bir dosyayı deneyin.

  • Hesap yok: dosya başına 10 MB ve 25 sayfaya kadar, saatte 3 ve günde 10 dönüştürme, tarayıcıda önizleme ve kopyalama.
  • Oturum açık: günde 20 ücretsiz dönüştürme, kitaplığınıza kaydedilir.
  • Lite, Pro ve Max; dönüştürme kredileri, toplu işleme, API erişimi ve kaydedilmiş geçmiş içerir. Lite 30 günlük geçmiş içerir.

Nasıl yapılır

Bir görselden Markdown'a nasıl dönüştürülür

Neleri yükleyebilirsiniz

  • Dosya türleri: .png .jpg .jpeg .webp .tif .tiff
  • Hesapsız deneyin: dosya başına 10 MB ve 25 sayfaya kadar, saatte 3 ve günde 10 dönüştürme
  • Lite 100 MB'a, Pro 200 MB'a kadar dosya kabul eder
  • Max'in dosya başına boyut sınırı yoktur; dönüştürmeler kredilerle sınırlıdır
Görselden Markdown'a dönüştürücü: PNG görseli OCR ile Markdown penceresine dönüşür

Neden kullanılır

Görselden Markdown'a neden kullanılır

Yazılı içerik için OCR

Bir ekran görüntüsünden, fotoğraftan veya taramadan görünen metni çıkarın, sonra sonucu kullanmadan önce belirsiz karakterleri inceleyin.

Yapılandırılmış bir metin sonucu

Desteklenen başlıklar, paragraflar ve tablolar, yapılandırılmamış bir metin dökümünden gözden geçirilmesi daha kolay Markdown'a dönüşür.

Belge sarmalayıcı gerekmez

Yalnızca bir ekran görüntüsünü içine yapıştırmak için bir Word belgesi oluşturmak yerine elinizdeki görselle başlayın.

Tanınan sayıları denetleyin

Birimleri, noktalamayı ve sayısal hücreleri kaynak görselle karşılaştırın; özellikle sonuç bir karara yön veriyorsa.

Görsel kaynağı saklayın

Bir grafik, ok veya düzen ilişkisi tek başına tanınan etiketlerle açıklanamadığında görseli Markdown'ın yanında kullanın.

Görsel API yolu

Aynı kaynak kalitesinden temsili OCR çıktılarını denetledikten sonra desteklenen görsel dosyalarını API'den gönderin.

Sorun

Bir ekran görüntüsünün neden metin katmanı yoktur

Metin katmanı yok

Görseller seçilebilir metin taşımaz; içeriğin kullanılabilmesi için önce tanınması gerekir.

Ekran görüntüleri birikir

Belge ekran görüntüleri her yerdedir ama metne dönüşene kadar aranması zordur.

Düzen önemlidir

Bir görselin içindeki başlıklar ve tablolar tek bir satıra düzleşmek yerine ayakta kalmalıdır.

OCR ile Markdown'a dönüştürme: bozuk yapıştırılmış metin ile temiz Markdown yapısı yan yana

Neler korunur

Bu görsel dönüştürücüsü neleri okur

OCR ile metin çıkarma
Metin bugün görsellerden OCR ile çıkarılır; doğruluk görsel kalitesine, yazı tipi netliğine ve kontrasta göre değişir.Source: product pipeline
Ekran görüntüleri ve taranmış sayfalar için en uygun
Temiz ekran görüntüleri ve net baskılı taranmış belgeler en iyi sonucu verir; el yazısı veya düşük çözünürlüklü görseller daha düşük doğruluğa sahip olabilir.Source: ISO/IEC 15948 PNG
Düzen yoğun görseller
Çok sütunlu dergi sayfaları veya yoğun formlar gibi karmaşık düzenler uzamsal yapıyı tam olarak korumayabilir, ancak metin içeriği yine de çıkarılır.Source: product pipeline
Desteklenen biçimler
PNG, JPG/JPEG, WEBP ve TIFF kabul edilir; herkese açık dönüştürücüde 10 MB'a kadar.Source: ISO/IEC 15948 PNG

Örnek: markitdown.ai fiyatlandırma tablosunun OCR'ı· https://markitdown.ai/pricing

# Credits per page, by content. Text-layer documents and OCR pages cost the same per page. AI extras for figures and images are opt-in and metered separately. |  Item | Best for | Rate | 150 credits buy  || --- | --- | --- | --- ||  Documents | Text-layer PDF, Office files and HTML | 1 credit / page | 150 pages  ||  Scans & images | OCR for scanned pages, photos and screenshots | 1 credit / page | 150 pages  ||  AI figure enhancement | Charts and figures described in PDFs · paid plans | 3 credits / figure | 50 figures  ||  AI image understanding | Image content described, not just OCR · paid | 5 credits / image | 30 images  | GOOD TO KNOW **Monthly reset** Monthly credits reset at the start of each billing period; unused credits don't roll over. **Annual up front** Annual plans are 20% off and grant the full year's credits at once — 1,800 on Lite. **One balance** The web app, Batch and the API all draw from the same credit balance. **When credits run out** Conversions pause until your next reset or an upgrade; upgrades top up the difference immediately. 

Kullanım durumları

Gerçek iş akışlarında Görselden Markdown'a

Ekran görüntüsü notları

Bir ekran görüntüsünden yazılı içeriği kurtarın ve adları, bağlantıları ve noktalamayı özgünle doğrulayın.

Taranmış kayıtlar

Okunabilir bir taramadan düzenlenebilir metin oluşturun; belirsiz veya sonuç doğuran her pasaj için görseli saklayın.

Araştırma yakalama

Fotoğraflanan bir tabloyu taslak bir metin tablosuna çevirin ve analizden önce satırlarını denetleyin.

OCR değerlendirme

Tekrarlanan tanımayı bir uygulamaya yerleştirmeden önce temiz ve zor kaynak görsellerden gelen sonuçları karşılaştırın.

Resimden Markdown'a dönüştürme: bir ekran görüntüsü RAG dizini, istemler ve notları besler

API

Görselden Markdown'a API'si

Bir x-api-key başlığı ve desteklenen bir kaynak dosyayla POST /v1/convert/image kullanın. Tamamlanan bir istek çıktıları satır içinde döndürebilir; HTTP 202 ise dönüştürmenin hâlâ sürdüğü anlamına gelir. Location yanıt başlığını okuyun ve dosya çıktılarına erişmeden önce onu yoklayın. Bir multipart istek en fazla 100 dosya kabul eder; abonelik ve toplam istek sınırları da geçerlidir. API anahtarlarını sunucu ortamınızda tutun. API erişimi bir Lite, Pro veya Max aboneliği gerektirir.

API kılavuzunu okuyun
curl -i "https://api.markitdown.ai/v1/convert/image" \  -H "x-api-key: $MARKITDOWN_API_KEY" \  -F "file=@source.png"# If HTTP 202, GET the Location URL with the same API key.

OCR'ın okuduğu

Görselden Markdown'a, bir görseldeki yazılı içeriği tanımak ve desteklenen yapıyı Markdown olarak temsil etmek için OCR kullanır. Bir belgenin net bir ekran görüntüsü yararlı başlıklar, paragraflar ve tablolar üretebilirken, bulanık bir fotoğraf belirsiz karakterler bırakabilir. OCR görünen metni okur; bir grafiğin eğilimini, bir diyagramın oklarını ya da bir fotoğrafın anlamını açıklayacağının garantisi değildir. Tanınan etiketleri, görselin kendisinin açıklamasından ayırın. Önemli bilgi yalnızca grafikse, görseli sonucun yanında saklayın ve doğrudan gözden geçirin. Kısa bir metin dışa aktarımını, kaynak görselin tüm anlamının yakalandığının kanıtı olarak ele almayın.

Görseli hazırlama

Görselden Markdown'a dönüştürmeye, sahip olduğunuz en net özgün görselle başlayın. Sıkıştırılmış bir ekran görüntüsünü tekrar tekrar kaydetmek, OCR başlamadan önce noktalamayı ve küçük metni bulanıklaştırabilir. Alt yazıları, birimleri veya tablo başlıklarını kaldırmadan yapabiliyorsanız, ilgisiz çevreyi kırpın. Belirgin bir döndürmeyi düzeltin ve kaynağın normal yakınlaştırmada okunabilir olduğunu denetleyin. Bir fotoğrafta, parlama ve perspektif bozulması çözünürlük kadar önemli olabilir. Bir karakteri kendiniz ayırt edemiyorsanız, dönüştürmenin eksik kanıtı yeniden kuracağını beklemek yerine karşılık gelen çıktıyı dikkatle gözden geçirin. Kaynağı iyileştirmek, aynı hasarlı görseli tekrar tekrar gönderip en akla yatkın görünen sonucu seçmekten genellikle daha yararlıdır.

Çıktıyı gözden geçirme

Görselden Markdown'a tablolarını kaynağa karşı satır satır okuyun; özellikle görsel yoğun sayılar içeriyorsa. Düşürülmüş bir ondalık ayırıcı ya da kaymış bir değer, temiz işlenmeye devam eden bir tablo bırakırken anlamı değiştirebilir. Sütun etiketlerini, birimleri, toplamları ve dipnotları ayrı kanıt parçaları olarak denetleyin. Bir tablo, Markdown'ın doğrudan ifade edemeyeceği birleştirilmiş hücreler veya görsel gruplamalar kullanıyorsa, gruplamayı sonucu kullandığınız belgede açıklayın. Özgünü incelemesi gereken bir okuyucu için ekran görüntüsünü erişilebilir tutun. OCR yeniden yazmayı önler, ancak tanınan sayıların sonuç doğuran her kullanımı yine bir doğrulama adımı gerektirir.

Görsel ve özgün

Görselden Markdown'a'yı, sahip olduğunuz kaynak görsel olduğunda kullanın: bir ekran görüntüsü, fotoğraflanan bir sayfa veya dışa aktarılmış bir tarama. Ayrıca özgün Word belgesi, elektronik tablo veya HTML sayfası varsa, önce onun kendi dönüştürücüsünü seçin. O kaynak, bir görselin piksele indirdiği yapıyı ve karakterleri ortaya koyabilir. Çok sayfalı taranmış bir rapor için PDF dönüştürücüsü genellikle sayfaları bir arada tutmak için daha doğal yerdir. Tek bir ekran görüntüsü için görsel OCR, yalnızca metni çıkarmak adına bir ara belge oluşturmaktan kaçınır. Her iki durumda da kaynak dosya adını veya referansını notlarınızda saklayın; böylece Markdown, gözden geçirdiğiniz materyale kadar izlenebilir.

OCR ve görsel anlama

Herkese açık görsel dönüştürücüsü bugün OCR ile işlenir: piksellerden basılı veya dijital glifleri okur ve Markdown üretir. Bu, ücretli plan hesaplarının görsel başına 5 krediyle kullanabildiği ve ek bir yapay zekâ destekli Markdown çıktısı üreten yapay zekâ görsel anlama ile aynı şey değildir. Bu sayfa, ücretsiz bir ekran görüntüsü için anlamayı varsayılan yol olarak ele almaz.

  • Bu dönüştürücüde görsel yüklemeleri için bugün OCR, yayımlanmış yoldur.
  • Ücretli plan yapay zekâ görsel anlama, görsel başına 5 kredi ile ayrıca faturalanır.
  • El yazısı veya düşük kontrastlı fotoğraflar OCR'a uygun değildir; temiz ekran görüntüleri ve taramalar daha iyi çalışır.

Taranmış sayfalar

Taranmış sayfalar, seçilebilir metin katmanı olmadığı için başlıca kullanım durumudur. Düzen yoğun dergi sayfaları uzamsal yapıyı tam olarak koruyamayabilir, ancak tanınan metin yine de çıkarılır.

SSS

Görselden Markdown'a soruları

Görselden Markdown'a nasıl çalışır?

Görselden Markdown'a, desteklenen kaynağı gözden geçirme ve yeniden kullanım için okunabilir Markdown'a çevirir. Anonim deneme, dosya başına 10 MB ve 25 sayfaya kadar kabul eder; IP başına saatte 3, günde 10 dönüştürme yapılabilir. Kullanmadan önce sonucu kaynakla karşılaştırın.

Azami görsel boyutu nedir?

Herkese açık dönüştürücü, 10 MB'a kadar görsel dosyası kabul eder.

OCR bir ekran görüntüsünde ne kadar isabetli?

Görseller bugün OCR ile işlenir. Temiz ve yüksek kontrastlı görseller, düşük çözünürlüklü veya el yazısı içerikten daha iyi sonuç verir.

Bu sayfada yapay zekâ görsel anlama varsayılan mı?

Hayır. Bu dönüştürücü bugün OCR kullanır. Ücretli plan yapay zekâ görsel anlama, görsel başına 5 kredilik ayrı bir ücretlendirmedir ve herkese açık varsayılan değildir.

Görsellerin içindeki tabloları işleyebilir mi?

Görsellerdeki tablo yapısı mümkün olduğunda tanınır; doğruluk, görsel netliğine ve tablo ızgarasının ne kadar net tanımlandığına bağlıdır.

Taranmış belgelerde çalışır mı?

Evet. Taranmış sayfalar başlıca kullanım durumudur. Temiz ve yüksek çözünürlüklü taramalar daha iyi Markdown çıktısı üretir.

El yazısı içerik ne olacak?

El yazısı metin mevcut OCR ardışık düzeni tarafından güvenilir biçimde çıkarılmaz. Araç en iyi basılı veya dijital metinle çalışır.

Görselleri API'den dönüştürebilir miyim?

Evet. Görseli, bir PDF yükler gibi yükleyin, sonra dönüştürün ve yoklayın. /developers sayfasına bakın.

Görsel biçimini ölçekli olarak Markdown'a dönüştürün.

Denemesi ücretsiz — kayıt gerekmez.