पहचान कैसे काम करती है पर वापस जाएँOMR में नया क्या है

PDF और फ़ोटो स्कैनिंग: नया क्या है।

ऑप्टिकल म्यूज़िक रिकग्निशन (OMR) से संचालित Opuscan की स्कैनिंग लगातार बेहतर होती जा रही है। यह पेज PDF और फ़ोटो इम्पोर्ट के अपडेट दर्ज करता है, सबसे नया पहले।

प्रविष्टियों का अंग्रेज़ी से स्वचालित अनुवाद किया गया है। अंग्रेज़ी में मूल पढ़ें

28 सितंबर·सुधारा गया·

नया मॉडल संस्करण, जो असामान्य ताल संकेत और सुर-चिह्न के बिना पंक्तियाँ पढ़ता है

हमारे स्कैनिंग मॉडल को अपडेट किया गया है। इस अपडेट में ताल संकेतों, सुर-चिह्नों और कई मात्राओं तक चलने वाले विरामों पर ध्यान दिया गया है।

  • अब ज़्यादा ताल संकेत छपे हुए रूप में ही पढ़े जाते हैं। मॉडल अब 29 ताल संकेतों के साथ कॉमन टाइम और कट टाइम भी पहचानता है। इस महीने नए जोड़े गए संकेत हैं: 6/4, 7/4, 8/4, 9/4, 10/8, 11/8, 13/8, 14/8, 15/8, 9/16, 11/16, 13/16, 15/16 और 17/16। ये लोक संगीत, जैज़ और समकालीन संगीत में आम हैं। पहले इन्हें किसी परिचित ताल संकेत से बदल दिया जाता था (10/8 को 12/8 और 8/4 को 5/4 पढ़ा जाता था)। इससे मात्राओं का हिसाब बिगड़ जाता था और उन्हें ठीक करने के लिए स्वर हटा दिए जाते थे। देखें स्कैनिंग में समर्थित सभी संगीत संकेत।
  • कई मात्राओं तक चलने वाले विराम अपनी सही अवधि बनाए रखते हैं। बैंड और ऑर्केस्ट्रा के पार्ट में लंबे विराम के ऊपर लिखी संख्या बताती है कि कितनी मात्राएँ गिननी हैं। अब यह संख्या बहुत कम गलत पढ़ी जाती है। पहले "10" को 100 पढ़ा जा सकता था, जिससे आपके पार्ट में दर्जनों अतिरिक्त खाली मात्राएँ जुड़ जाती थीं।
  • सुर-चिह्न के बिना पंक्तियों में स्वरों की सही ऊँचाई बनी रहती है। कई पार्ट में, खासकर जैज़ चार्ट और पुराने संस्करणों में, सुर-चिह्न पृष्ठ की केवल पहली पंक्ति पर छपता है। पहले मॉडल बाकी पंक्तियों का सुर-चिह्न अनुमान से तय करता था। गलत अनुमान से पंक्ति का हर स्वर ऊपर या नीचे खिसक जाता था। अब उन पंक्तियों पर पिछली पंक्ति का सुर-चिह्न लागू रहता है।
  • पृष्ठ पर मौजूद न होने वाली चीज़ें कम जुड़ती हैं। ट्रिपलेट के ऊपर छोटे "3" को अब उँगली की संख्या नहीं समझा जाता, जहाँ ऑक्टेव रेखा (8va) नहीं छपी है वहाँ उसे नहीं जोड़ा जाता, और पूरी पंक्ति में मौन रहने वाली स्वर-पंक्ति को ड्रम के स्वरों से नहीं भरा जाता।
  • आपके ज़्यादा स्वर स्कोर में शामिल होते हैं। अगर किसी मात्रा में उसके ताल संकेत से अधिक बीट पढ़ी जाती हैं, तो हिसाब ठीक करने के लिए कुछ स्वर हटाने पड़ते हैं। अब लय और ताल संकेत अधिक सटीकता से पढ़े जाते हैं, इसलिए ऐसा बहुत कम होता है: हमने जिन आयातों का परीक्षण किया, उनमें लगभग 70% कम स्वर गायब हुए।

सितंबर में भी

32 छोटे बदलाव
7 अगस्त·सुधारा गया·

इम्प्लिसिट ट्यूपलेट्स के समर्थन के साथ मॉडल का नया संस्करण

हमारे इन-हाउस मॉडल का एक नया संस्करण अब हर PDF और फ़ोटो इम्पोर्ट को संचालित करता है, खास तौर पर इस बात पर ध्यान देते हुए कि पेज पर ट्यूपलेट्स कैसे छपे होते हैं।

  • इम्प्लिसिट ट्यूपलेट्स अब समर्थित हैं। एंग्रेवर आम तौर पर किसी अंश के केवल पहले ट्रिपलेट या सेक्स्ट्यूपलेट के ऊपर छोटा "3" या "6" छापते हैं, और उसके बाद आने वाले समूहों को बिना किसी चिह्न के छोड़ देते हैं — वादक से अपेक्षा की जाती है कि वह उसी पैटर्न को आगे जारी रखे। ऐसे बिना चिह्न वाले समूह इम्प्लिसिट ट्यूपलेट्स होते हैं: उन्हें ट्यूपलेट्स की तरह बजाया जाता है, भले ही ऐसा बताने के लिए कुछ भी छपा न हो। ये 19वीं सदी के संस्करणों, अभ्यास-रचनाओं और वैरिएशनों में बहुत आम हैं। स्कैनिंग अब माप की लय से इन्हें फिर से निर्मित करती है, बजाय इसके कि माप को उसके time signature में फिट करने के लिए नोट्स हटा दिए जाएँ।
  • अब हवा में से गढ़े गए ट्यूपलेट्स कम होंगे। पहले मॉडल साधारण beamed समूहों को भी ट्रिपलेट के रूप में चिह्नित कर देता था, भले ही उनके ऊपर कोई संख्या छपी न हो, और वे संख्याएँ आपके स्कोर में दिखाई देती थीं। अब यह ट्यूपलेट तभी लिखता है जब वह वास्तव में पेज पर अंकित हो।

अगस्त में भी

19 छोटे बदलाव
29 जुलाई·सुधारा गया·

स्कैन किए गए संगीत की सटीकता पर केंद्रित मॉडल का नया संस्करण

हमारे इन-हाउस मॉडल का नया संस्करण अब हर PDF और फ़ोटो इम्पोर्ट को संचालित करता है, और हमारे स्कैन किए गए शीट म्यूज़िक बेंचमार्क पर 22% से 51% कम त्रुटियाँ देता है। सुधार सबसे ज़्यादा कठिन पेजों पर हैं — पुरानी एन्ग्रेविंग और असमान प्रिंट वाले पेजों पर।

24 जुलाई·सुधारा गया·

नोटेशन सुधारों पर केंद्रित मॉडल का नया संस्करण

Flat के इन-हाउस मॉडल का बेहतर संस्करण अब हर PDF और फ़ोटो इम्पोर्ट को संचालित करता है, खास तौर पर:

  • साझा विराम और अदृश्य विराम वाले बहु-स्वरांश अब समर्थित हैं।
  • बारलाइन और रिपीट एंडिंग (voltas) अब मात्राओं के भीतर सही जगह रखे जाते हैं।
  • बीम अब अधिक विश्वसनीय रूप से पहचाने जाते हैं।
  • कई स्टेव्स पर लिखे गए टाइम सिग्नेचर, जैसे ऑर्केस्ट्रल स्कोर में, अब पहचाने जाते हैं।
  • कुछ chord symbols, जो MusicXML में non-standard chord type के साथ एक्सपोर्ट हो रहे थे, उन्हें ठीक किया गया है।
21 जुलाई·नया·

Windows के लिए Opuscan

Opuscan - स्कैन-से-स्कोर के लिए हमारा स्टैंडअलोन ऐप - अब Windows पर भी उपलब्ध है, macOS, iPhone, iPad और Android के साथ। किसी पेज को स्कैन करें या PDF खोलें, और एक संपादन योग्य, चलाने योग्य स्कोर पाएँ जिसे आप MusicXML और MIDI में एक्सपोर्ट कर सकते हैं - इसके लिए Flat खाते की ज़रूरत नहीं है।

15 जुलाई·नया·

iPhone और iPad के लिए Opuscan

Opuscan — हमारा अलग scan-to-score ऐप — अब iPhone और iPad के लिए App Store पर उपलब्ध है, और macOS व Android ऐप्स के साथ जुड़ गया है। किसी पेज की फ़ोटो लें या PDF खोलें, और एक संपादन योग्य, चलाने योग्य स्कोर पाएँ जिसे आप MusicXML और MIDI में एक्सपोर्ट कर सकते हैं — Flat खाते की ज़रूरत नहीं है।

10 जुलाई·नया·

macOS और Android के लिए समर्पित Opuscan ऐप्स

Opuscan — हमारा स्टैंडअलोन scan-to-score ऐप — अब macOS और Android के लिए समर्पित ऐप्स के साथ उपलब्ध है। Flat की तरह उसी इन-house OMR इंजन पर बना यह ऐप किसी भी व्यक्ति को शीट म्यूज़िक की PDF या फ़ोटो को संपादन योग्य और चलाकर सुनाई जा सकने वाले स्कोर में बदलने देता है, और उसे MusicXML तथा MIDI में एक्सपोर्ट करने देता है — Flat खाते की आवश्यकता नहीं है। यह उन लोगों के लिए बनाया गया है जो केवल स्कैनिंग तकनीक का उपयोग अपने पसंदीदा music software के साथ करना चाहते हैं, चाहे वे notation editors (MuseScore, Dorico, Sibelius, Finale) हों या DAWs (GarageBand, Logic Pro, Ableton Live)। इसे Mac App Store या Google Play से प्राप्त करें।

जुलाई में भी

11 छोटे बदलाव
23 जून·सुधारा गया·

जटिल लेआउट के लिए अधिक सटीक पेज विश्लेषण

हमने स्कैनिंग द्वारा पेज के लेआउट को पढ़ने के तरीके में सुधार किया है। अब PDF और फ़ोटो के इम्पोर्ट से अधिक साफ़ और अधिक सटीक स्कोर मिलते हैं, खासकर जटिल लेआउट में:

  • घने पेज अब सही तरीके से अलग किए जाते हैं। जिन पेजों पर कई छोटे सिस्टम एक-दूसरे के ऊपर लगे होते हैं, वे अब एक साथ नहीं मिलते — हर सिस्टम अलग से पहचाना जाता है।
  • ऑर्केस्ट्रा और बड़े एंसेंबल के स्कोर के लिए बेहतर। पियानो और ऑर्गन जैसे बहु-स्टाफ वाद्ययंत्रों, और कई स्टाफ वाले बड़े स्कोर, अब अधिक विश्वसनीय तरीके से पहचाने जाते हैं।
  • चौड़े, लैंडस्केप और बुकलेट लेआउट। लैंडस्केप पेज अब बाएँ किनारे से कटते नहीं हैं (जिससे clefs कट सकते थे), और बहु-पृष्ठ तथा बुकलेट स्कैन अब सही तरीके से संभाले जाते हैं।
  • बेतरतीब पहचान कम। पेज के फ़ुटर और मार्जिन के पास के अनचाहे तत्व अब संगीत के रूप में नहीं पहचाने जाते।
15 जून·सुधारा गया·

एक अधिक सटीक मॉडल

अब हर PDF और फ़ोटो इम्पोर्ट को Flat के अपने इन-हाउस मॉडल से प्रोसेस किया जाता है। यह रिलीज़ एक बड़ा नया संस्करण है, जिसका मुख्य फ़ोकस ट्रांसक्रिप्शन की सटीकता पर है: संगीतात्मक शुद्धता (वे स्वर, लय, tie और accidental जो तय करते हैं कि कोई स्कोर सही है या नहीं) सभी टेस्ट सेट में बेहतर हुई है, और सबसे बड़े सुधार इन क्षेत्रों में हैं:

  • Dynamics: +39%
  • Fermata, articulation, tie, accidental: +30 से 37%
  • स्वरों की अवधि: +22%
  • Slur, dotted note, rest, staff और voice assignment: +14 से 20%

टेक्स्ट, dynamics और layout placement भी अब अधिक सटीक हैं: lyrics, chord names और dynamics अब सही स्वरों से अधिक भरोसेमंद तरीके से जुड़ते हैं, यहाँ तक कि जटिल layouts में भी, जैसे piano grand staff और clef changes वाले parts.

1 जून·नया·

हमारा अपना AI मॉडल अब रोल आउट होना शुरू हो रहा है

हम PDF और फ़ोटो इम्पोर्ट के लिए Flat का अपना AI मॉडल रोल आउट कर रहे हैं। इसे हमारी टीम ने ही डिज़ाइन और ट्रेन किया है, ताकि लॉन्च के समय इस्तेमाल किए गए third-party engine की जगह ली जा सके। इस तकनीक पर शुरू से अंत तक हमारा अपना नियंत्रण होने से हम सटीकता को और बेहतर बना सकते हैं, पहचानी जाने वाली चीज़ों का दायरा बढ़ा सकते हैं, सुधार कहीं तेज़ी से जारी कर सकते हैं, और परिणामों को Flat के अपने notation format के अनुरूप रख सकते हैं, ताकि इम्पोर्ट बाकी प्रोडक्ट में स्वाभाविक रूप से फिट हों। इस पहले रिलीज़ में ही यह आपके संगीत का कहीं अधिक हिस्सा पढ़ लेता है:

notation का अधिक व्यापक कवरेज। अब नई पहचान में शामिल हैं:

  • Chord symbols, जिन्हें उनके musical meaning के अनुसार सही तरह से editable chords के रूप में encode किया जाता है, सिर्फ़ plain text के रूप में नहीं
  • Measure repeats और rhythm slashes
  • Tempo और metronome markings (BPM सहित)

ज़्यादा भाषाओं में lyrics और text। Lyrics, rehearsal marks और अन्य text अब Latin script वाली भाषाओं में डिफ़ॉल्ट रूप से पहचाने जाते हैं, साथ ही Japanese, Korean और Chinese में भी।

मूल लेआउट के अधिक अनुरूप। अब इम्पोर्ट source score के लेआउट का कहीं अधिक क़रीब से पालन करते हैं—हर पंक्ति में measures की संख्या, हर पेज पर systems की संख्या, और पूरी संरचना सहित। इससे बड़े और जटिल score, जैसे orchestral works और piano जैसे multi-staff instruments, पर वास्तविक फ़र्क पड़ता है। यह अब और अधिक page formats को भी support करता है, जिनमें landscape pages भी शामिल हैं, जिन्हें पहले support नहीं किया जाता था।

जून में भी

8 छोटे बदलाव