AI ऑप्टिकल म्यूज़िक रिकग्निशन

PDF, स्कैन, या फ़ोटो को पूरी तरह एडिट करने योग्य स्कोर में बदलें।

Opuscan का AI-संचालित ऑप्टिकल म्यूज़िक रिकग्निशन (OMR) पेज पर छपे संगीत को पढ़ता है और उसे असली नोटेशन के रूप में फिर से बनाता है, जिसे आप बजा सकते हैं, transpose कर सकते हैं, अरेंज कर सकते हैं, और MusicXML या MIDI में एक्सपोर्ट कर सकते हैं। शीट म्यूज़िक आप लाएँ। टाइपिंग का काम AI कर देगा।

Mozart के पहले स्ट्रिंग क्वार्टेट का एक प्रिंटेड पेज, जिसे मूल एंग्रेविंग से स्कैन किया गया है।

प्रिंटेड पेज

  • .musicxml
  • .midi
उसी क्वार्टेट को Opuscan ने एक साफ़, पूरी तरह एडिट करने योग्य स्कोर के रूप में फिर से बनाया है।

एडिट करने योग्य स्कोर

Tutteo के अपने AI मॉडल द्वारा संचालित

ऐसा AI रिकग्निशन सिस्टम जिसे हम खुद बनाते, ट्रेन करते और लगातार बेहतर करते हैं।

हर PDF और फ़ोटो को Tutteo के अपने in-house deep-learning model से प्रोसेस किया जाता है, किसी third-party engine से नहीं। यह सिर्फ़ symbols नहीं पहचानता, बल्कि उन्हें संगीत के संदर्भ में पढ़ता है, ठीक वैसे जैसे कोई प्रशिक्षित संगीतकार पढ़े, ताकि यह जो स्कोर फिर से तैयार करता है, वह सच में समझ में आए।

  • लय, सुर और लेआउट को अलग-अलग symbols की तरह नहीं, बल्कि संदर्भ के साथ मिलाकर पढ़ता है
  • वाद्यों और voices को अलग करता है, और lyrics, chords और text को सही notes से जोड़ता है
  • शुरू से अंत तक पूरी तरह in-house बनाया गया है, इसलिए हर release के साथ यह मापने योग्य रूप से बेहतर होता जाता है

यह कैसे काम करता है

  1. अपना संगीत इम्पोर्ट करेंअपने कंप्यूटर पर कोई PDF या छवि इम्पोर्ट करें, या सीधे Opuscan मोबाइल ऐप में फोटो खींचें।
  2. Opuscan पेज को पढ़ता हैयह हर पेज को स्कैन करता है और स्टाफ, नोट्स और चिह्नों को पहचानता है।
  3. जांचें, संपादित करें और एक्सपोर्ट करेंआपका संगीत पूरी तरह संपादन योग्य स्कोर के रूप में खुलता है। सब कुछ जांचें और जो भी सुधार करना हो, उसे करें। फिर उसे ट्रांसपोज़ करें, व्यवस्थित करें, चलाकर सुनें, या अपने नोटेशन एडिटर के लिए MusicXML और MIDI में एक्सपोर्ट करें।

अपने फोन से कैप्चर करें। इन-ऐप कैमरा डिवाइस पर ही दस्तावेज़ स्कैनिंग का उपयोग करता है, जो पेज को पहचानता है, उसे क्रॉप करता है और पहचानने से पहले छवि को सीधा व समतल करता है। कैप्चर जितना साफ़ होगा, कन्वर्ज़न उतना ही बेहतर होगा।

Opuscan क्या पढ़ सकता है

Opuscan का OMR मानक पश्चिमी संगीत लिपि के मुद्रित रूप के लिए बनाया गया है, यानी ऐसा संगीत जो नोटेशन सॉफ़्टवेयर से टाइपसेट किया गया हो या पेशेवर ढंग से प्रिंट किया गया हो। इसमें ज़्यादातर शीट म्यूज़िक, मेथड बुक्स, पार्ट्स और लीड शीट्स शामिल हैं।

अच्छी तरह काम करता है

  • प्रिंट किया हुआ या डिजिटल रूप से एंग्रेव्ड शीट म्यूज़िक, जिसमें प्रिंट किए गए पन्नों के स्कैन और फोटो भी शामिल हैं
  • सोलो पार्ट्स, पियानो और अन्य ग्रैंड-स्टाफ संगीत, तथा कई वाद्यों वाले स्कोर
  • कॉर्ड चिह्नों वाले लीड शीट्स

समर्थित नहीं है

  • हाथ से लिखा हुआ या हाथ से नकल किया गया संगीत
  • Tablature (guitar/bass tab), जो अभी समर्थित नहीं है
  • ऐसे पेज जिनमें मानक संगीत लिपि नहीं है (केवल टेक्स्ट, केवल गीत के बोल, कवर पेज)

कौन-कौन सी संगीत लिपियां समर्थित हैं?

मुद्रित पश्चिमी संगीत लिपि के भीतर, Opuscan कई तरह के चिह्नों को पहचानता है, जिनमें शामिल हैं:

श्रेणीOpuscan क्या पहचानता है
क्लेफ़सभी स्थानों पर ट्रेबल (G), बास (F), ऑल्टो और टेनर (C) क्लीफ़, साथ ही सप्तक बदले हुए और तालवाद्य के क्लीफ़। इनमें रचना के बीच क्लीफ़ बदलना और ऐसे वाद्य-भाग भी शामिल हैं जिनमें क्लीफ़ केवल पहली पंक्ति में छपा होता है।
की सिग्नेचरसभी की सिग्नेचर, 7 फ्लैट्स से 7 शार्प्स तक
टाइम सिग्नेचर2/2, 3/2, 4/2, 2/4, 3/4, 4/4, 5/4, 6/4, 7/4, 8/4, 9/4, 3/8, 5/8, 6/8, 7/8, 9/8, 10/8, 11/8, 12/8, 13/8, 14/8, 15/8, 3/16, 6/16, 9/16, 11/16, 13/16, 15/16 और 17/16, साथ ही कॉमन टाइम और कट टाइम
नोट वैल्यूwhole से लेकर 1024th notes तक, साथ ही breve, long और maxima, तथा augmentation dots के साथ
विरामसामान्य विराम और multi-measure rests
ट्यूपलेट्सट्रिपलेट्स और अन्य अनुपात (3:2, 2:3, 5:4, 6:4, 7:4, 7:8, 9:8, और भी)
बीम्समानक बीम्स, partial beams, hooks, कस्टम beaming patterns, और विरामों के आर-पार बीम्स
स्वर-ऊंचाइयाँ और कॉर्डलेजर लाइनों, कॉर्ड्स और एक ही स्टाफ पर कई वॉइसेज़ सहित पूरी स्वर-सीमा
आकस्मिक चिह्नशार्प, फ्लैट, नैचरल, डबल शार्प/फ्लैट, सौजन्यसूचक और माइक्रोटोनल (क्वार्टर-टोन) विकार चिह्न
टाइज़, स्लर्स और ग्रेस नोट्सटाइज़, स्लर्स, ग्रेस नोट्स, acciaccatura, और cue (small) notes
डायनेमिक्स और हेयरपिनppp से fff तक, साथ में sf, sfz, fz, fp, rfz और अन्य, crescendo और decrescendo हेयरपिन सहित
उच्चारण चिह्नstaccato, staccatissimo, tenuto, accent, marcato, detached legato, breath marks, caesuras और जैज़ मार्क्स
अलंकरण और ट्रेमोलोट्रिल, मॉर्डेंट, टर्न, लहरदार रेखा और 1 से 4 स्ट्रोक वाले ट्रेमोलो
रेखाएँ और टेम्पोऑक्टेव रेखाएँ (8va, 8vb, 15ma, 15mb), BPM सहित मेट्रोनोम चिह्न, और rit./accel।
बारलाइन्स और रिपीट्ससामान्य, डबल, फ़ाइनल, रिपीट और heavy-light barlines; voltas, Segno, Coda, D.C., D.S., To Coda, और Fine
मेज़र रिपीट्ससिंगल-बार रिपीट्स (%) और रिदम स्लैशेज़
नोटहेड्समानक, X, circle-X, cross, diamond, triangle, square, slash, और hidden नोटहेड्स
मल्टी-स्टाफ और परकशनpiano और grand-staff वाद्ययंत्र (अधिकतम 7 स्टाफ), percussion स्टाफ और नोटहेड्स
कॉर्ड प्रतीककॉर्ड प्रतीक और चार्ट्स, जिन्हें केवल टेक्स्ट नहीं बल्कि संपादन-योग्य कॉर्ड्स के रूप में पहचाना जाता है
तकनीकें और पेडलharmonics, fingerings, bowing, pizzicato, stopped/open strings, thumb position, और sustain पेडल
पाठ और गीतगीत, rehearsal marks, और टेक्स्ट टिप्पणियाँ

गैर-लैटिन भाषाओं में गीत. लैटिन-लिपि वाली भाषाएँ अपने-आप पहचानी जाती हैं। जापानी, कोरियाई, चीनी और सिरिलिक-लिपि वाली भाषाओं के लिए, स्कैन करने से पहले कन्वर्ट स्क्रीन में बस भाषा चुनें।

सटीक स्कैन के लिए सर्वोत्तम तरीके

AI अच्छा है, लेकिन वह पेज पर जो है उसे तभी साफ़-साफ़ पढ़ सकता है जब वह स्पष्ट दिखे। कुछ अच्छी आदतें आपकी बदली हुई स्कोर की सटीकता में बड़ा फर्क डालती हैं।

सबसे अहम नियम. अगर किसी इंसान के लिए पढ़ना मुश्किल है, तो AI के लिए भी पढ़ना मुश्किल होगा। आपका स्रोत जितना साफ़ और स्पष्ट होगा, कन्वर्ज़न उतना बेहतर होगा।

यह करें

  • उच्च-रिज़ॉल्यूशन स्कैन, या तेज़ और अच्छी रोशनी वाली फ़ोटो का उपयोग करें
  • पेज को सीधा रखते हुए सपाट रखें और फ्रेम को उसी से भरें
  • मुद्रित या डिजिटल रूप से तैयार किए गए संगीत को प्राथमिकता दें
  • इन-ऐप कैमरा का उपयोग करें, ताकि पेज अपने-आप क्रॉप और सीधा हो जाए
  • हर फ़ाइल में एक ही पीस इम्पोर्ट करें, और solo parts के लिए हर फ़ाइल में एक ही वाद्ययंत्र रखें

किन चीज़ों से पहचान प्रभावित होती है

  • कम रिज़ॉल्यूशन या धुंधली फ़ाइलें
  • मुड़े, विकृत, या घुमावदार स्टाफ (किताब की बाइंडिंग के पास फ़ोटो लेते समय)
  • हल्का, आंशिक रूप से मिटाया गया, या बहुत अधिक निशान लगा हुआ नोटेशन
  • स्कैनिंग आर्टिफैक्ट्स, परछाइयाँ, या तिरछे और घुमाए गए पेज

Optical music recognition की व्याख्या

Optical music recognition (OMR) क्या है?

OMR संगीत के लिए वही है जो लिखे हुए शब्दों के लिए OCR है: ऐसा सॉफ़्टवेयर जो पन्ने पर छपी संगीत की स्वरलिपि पढ़कर उसे व्यवस्थित, संपादन योग्य रूप में बदल देता है। Opuscan अपने AI मॉडल से स्टाफ़, स्वर, लय, गीत के बोल और ध्वनि की तीव्रता के संकेत पहचानता है। फिर आपको एक असली संगीत स्कोर मिलता है जिसे आप सुन और एक्सपोर्ट कर सकते हैं। Opuscan का संगीत OCR सॉफ़्टवेयर देखें।

क्या AI शीट म्यूज़िक के PDF को संपादन-योग्य स्कोर में बदल सकता है?

हाँ। Opuscan प्रिंटेड या एनग्रेव्ड शीट म्यूज़िक के PDFs और फ़ोटो को पूरी तरह संपादन-योग्य स्कोर में बदलता है, और MuseScore, Dorico, Sibelius, Flat, तथा किसी भी DAW के लिए मानक MusicXML और MIDI एक्सपोर्ट करता है।

क्या यह मेरे फ़ोन से ली गई फ़ोटो पर काम करता है?

हाँ। ऐप में मौजूद कैमरा पहचान से पहले पेज को ढूँढ़ने, क्रॉप करने और समतल करने के लिए डिवाइस पर ही दस्तावेज़ स्कैनिंग का उपयोग करता है। सबसे सटीक नतीजे के लिए ऊपर दिए गए बेहतरीन तरीकों देखें।

क्या हस्तलिखित संगीत या टैब्लेचर समर्थित है?

अभी नहीं। Opuscan मानक पश्चिमी नोटेशन के लिए बनाया गया है जिसे एनग्रेव्ड या प्रिंट किया गया हो। हस्तलिखित संगीत, गिटार/बास टैब्लेचर, और ऐसे पेज जिनमें मानक नोटेशन न हो, समर्थित नहीं हैं।

डेवलपर्स

स्कोर कन्वर्ज़न को स्वचालित करें।

Opuscan को चलाने वाली वही पहचान अब API के रूप में उपलब्ध है। PDF या इमेज भेजें, और बदले में संरचित MusicXML पाएँ, जो स्टोर करने, रेंडर करने, या संपादित करने के लिए तैयार हो।

स्केल के लिए बनाया गया

एक API, आपका पूरा कैटलॉग।

  • PDF या इमेज अपलोड करें, MusicXML या MIDI डाउनलोड करें
  • ऐप्स के पीछे वही मॉडल, सटीकता में कोई समझौता नहीं
  • पूरे कैटलॉग को बैच में प्रोसेस करें, बिना मैन्युअल हस्तक्षेप के

ऐसी पहचान जो
लगातार बेहतर होती जा रही है।

हम स्कैनिंग को लगातार बेहतर बनाते रहते हैं। देखें कि क्या-क्या बदला है।

Opuscan के उपयोग के उदाहरण देखें