Skip to content

What’s new in scanned music import

How Flat for Education turns PDFs and photos of sheet music into editable scores: model versions, what is recognized, what got fixed.

The same engine powers Opuscan and the OMR API. This page lists the changes as they reach Flat for Education.

All changes

प्रविष्टियों का अंग्रेज़ी से स्वचालित रूप से अनुवाद किया जाता है। अंग्रेज़ी में मूल संस्करण पढ़ें

सितंबर में

24 छोटे बदलाव
7 अगस्त·सुधारा गया·

इम्प्लिसिट ट्यूपलेट्स के समर्थन के साथ मॉडल का नया संस्करण

हमारे इन-हाउस मॉडल का एक नया संस्करण अब हर PDF और फ़ोटो इम्पोर्ट को संचालित करता है, खास तौर पर इस बात पर ध्यान देते हुए कि पेज पर ट्यूपलेट्स कैसे छपे होते हैं।

  • इम्प्लिसिट ट्यूपलेट्स अब समर्थित हैं। एंग्रेवर आम तौर पर किसी अंश के केवल पहले ट्रिपलेट या सेक्स्ट्यूपलेट के ऊपर छोटा "3" या "6" छापते हैं, और उसके बाद आने वाले समूहों को बिना किसी चिह्न के छोड़ देते हैं — वादक से अपेक्षा की जाती है कि वह उसी पैटर्न को आगे जारी रखे। ऐसे बिना चिह्न वाले समूह इम्प्लिसिट ट्यूपलेट्स होते हैं: उन्हें ट्यूपलेट्स की तरह बजाया जाता है, भले ही ऐसा बताने के लिए कुछ भी छपा न हो। ये 19वीं सदी के संस्करणों, अभ्यास-रचनाओं और वैरिएशनों में बहुत आम हैं। स्कैनिंग अब माप की लय से इन्हें फिर से निर्मित करती है, बजाय इसके कि माप को उसके time signature में फिट करने के लिए नोट्स हटा दिए जाएँ।
  • अब हवा में से गढ़े गए ट्यूपलेट्स कम होंगे। पहले मॉडल साधारण beamed समूहों को भी ट्रिपलेट के रूप में चिह्नित कर देता था, भले ही उनके ऊपर कोई संख्या छपी न हो, और वे संख्याएँ आपके स्कोर में दिखाई देती थीं। अब यह ट्यूपलेट तभी लिखता है जब वह वास्तव में पेज पर अंकित हो।

अगस्त में भी

16 छोटे बदलाव
29 जुलाई·सुधारा गया·

स्कैन किए गए संगीत की सटीकता पर केंद्रित मॉडल का नया संस्करण

हमारे इन-हाउस मॉडल का नया संस्करण अब हर PDF और फ़ोटो इम्पोर्ट को संचालित करता है, और हमारे स्कैन किए गए शीट म्यूज़िक बेंचमार्क पर 22% से 51% कम त्रुटियाँ देता है। सुधार सबसे ज़्यादा कठिन पेजों पर हैं — पुरानी एन्ग्रेविंग और असमान प्रिंट वाले पेजों पर।

24 जुलाई·सुधारा गया·

नोटेशन सुधारों पर केंद्रित मॉडल का नया संस्करण

Flat के इन-हाउस मॉडल का बेहतर संस्करण अब हर PDF और फ़ोटो इम्पोर्ट को संचालित करता है, खास तौर पर:

  • साझा विराम और अदृश्य विराम वाले बहु-स्वरांश अब समर्थित हैं।
  • बारलाइन और रिपीट एंडिंग (voltas) अब मात्राओं के भीतर सही जगह रखे जाते हैं।
  • बीम अब अधिक विश्वसनीय रूप से पहचाने जाते हैं।
  • कई स्टेव्स पर लिखे गए टाइम सिग्नेचर, जैसे ऑर्केस्ट्रल स्कोर में, अब पहचाने जाते हैं।
  • कुछ chord symbols, जो MusicXML में non-standard chord type के साथ एक्सपोर्ट हो रहे थे, उन्हें ठीक किया गया है।
15 जुलाई·नया·

PDF या फ़ोटो को समीक्षा चरण के साथ संपादन योग्य स्कोर में आयात करें

PDF या फ़ोटो से शीट म्यूज़िक आयात करने के लिए वेब ऐप में अब एक नया फ़्लो है, जो Flat के अपने recognition engine पर आधारित है। यह सभी के लिए पिछले PDF import की जगह लेता है।

  • वे पेज चुनें जो आप चाहते हैं। एक PDF या कई फ़ोटो अपलोड करें, फिर केवल वे पेज रखें जिनमें संगीत है। आपके द्वारा रखा गया हर पेज एक credit इस्तेमाल करता है।
  • चलते समय recognition की प्रगति देखें। एक progress bar दिखाता है कि scan कहाँ तक पहुँचा है, पेज दर पेज, और इसके चलते समय भी आप Flat का उपयोग जारी रख सकते हैं।
  • स्कोर बनने से पहले समीक्षा करें। जब engine को किसी instrument के बारे में पूरा भरोसा नहीं होता, तो वह आपसे title और पहचाने गए instruments की पुष्टि करने के लिए कहता है, और पेज पर छपे part names हर एक के साथ दिखाता है। जब हर instrument के बारे में पूरा भरोसा होता है, तो यह चरण छोड़ दिया जाता है।

यह Flat में उपलब्ध है और शिक्षकों व administrators के लिए Flat for Education में भी। नया फ़्लो आने वाले हफ्तों में iOS ऐप में आएगा।

10 जुलाई·नया·

OMR अब developer API के रूप में उपलब्ध है

Flat का OMR इंजन अब developer API के ज़रिए प्रोग्रामेटिक रूप से उपलब्ध है। PDF या फ़ोटो भेजें, पहचान की प्रगति पर नज़र रखें, पहचाने गए वाद्ययंत्रों की समीक्षा करें, फिर परिणाम को Flat लाइब्रेरी में editable score के रूप में इम्पोर्ट करें या MusicXML या MIDI के रूप में एक्सपोर्ट करें। यही वही in-house model है जो editor में PDF और फ़ोटो import को संचालित करता है, और अब आपके अपने apps और workflows के लिए बड़े पैमाने पर उपलब्ध है।

समर्पित OMR API (v2.24.0), v2.23.0 में score creation में जोड़े गए background PDF import पर आधारित है: फ़ाइल import करते समय task support का अनुरोध करें और score तैयार होने तक task को poll करें। दोनों releases के विवरण के लिए API changelog देखें।

जुलाई में भी

8 छोटे बदलाव
23 जून·सुधारा गया·

जटिल लेआउट के लिए अधिक सटीक पेज विश्लेषण

हमने स्कैनिंग द्वारा पेज के लेआउट को पढ़ने के तरीके में सुधार किया है। अब PDF और फ़ोटो के इम्पोर्ट से अधिक साफ़ और अधिक सटीक स्कोर मिलते हैं, खासकर जटिल लेआउट में:

  • घने पेज अब सही तरीके से अलग किए जाते हैं। जिन पेजों पर कई छोटे सिस्टम एक-दूसरे के ऊपर लगे होते हैं, वे अब एक साथ नहीं मिलते — हर सिस्टम अलग से पहचाना जाता है।
  • ऑर्केस्ट्रा और बड़े एंसेंबल के स्कोर के लिए बेहतर। पियानो और ऑर्गन जैसे बहु-स्टाफ वाद्ययंत्रों, और कई स्टाफ वाले बड़े स्कोर, अब अधिक विश्वसनीय तरीके से पहचाने जाते हैं।
  • चौड़े, लैंडस्केप और बुकलेट लेआउट। लैंडस्केप पेज अब बाएँ किनारे से कटते नहीं हैं (जिससे clefs कट सकते थे), और बहु-पृष्ठ तथा बुकलेट स्कैन अब सही तरीके से संभाले जाते हैं।
  • बेतरतीब पहचान कम। पेज के फ़ुटर और मार्जिन के पास के अनचाहे तत्व अब संगीत के रूप में नहीं पहचाने जाते।
15 जून·सुधारा गया·

एक अधिक सटीक मॉडल

अब हर PDF और फ़ोटो इम्पोर्ट को Flat के अपने इन-हाउस मॉडल से प्रोसेस किया जाता है। यह रिलीज़ एक बड़ा नया संस्करण है, जिसका मुख्य फ़ोकस ट्रांसक्रिप्शन की सटीकता पर है: संगीतात्मक शुद्धता (वे स्वर, लय, tie और accidental जो तय करते हैं कि कोई स्कोर सही है या नहीं) सभी टेस्ट सेट में बेहतर हुई है, और सबसे बड़े सुधार इन क्षेत्रों में हैं:

  • Dynamics: +39%
  • Fermata, articulation, tie, accidental: +30 से 37%
  • स्वरों की अवधि: +22%
  • Slur, dotted note, rest, staff और voice assignment: +14 से 20%

टेक्स्ट, dynamics और layout placement भी अब अधिक सटीक हैं: lyrics, chord names और dynamics अब सही स्वरों से अधिक भरोसेमंद तरीके से जुड़ते हैं, यहाँ तक कि जटिल layouts में भी, जैसे piano grand staff और clef changes वाले parts.

1 जून·नया·

हमारा अपना AI मॉडल अब रोल आउट होना शुरू हो रहा है

हम PDF और फ़ोटो इम्पोर्ट के लिए Flat का अपना AI मॉडल रोल आउट कर रहे हैं। इसे हमारी टीम ने ही डिज़ाइन और ट्रेन किया है, ताकि लॉन्च के समय इस्तेमाल किए गए third-party engine की जगह ली जा सके। इस तकनीक पर शुरू से अंत तक हमारा अपना नियंत्रण होने से हम सटीकता को और बेहतर बना सकते हैं, पहचानी जाने वाली चीज़ों का दायरा बढ़ा सकते हैं, सुधार कहीं तेज़ी से जारी कर सकते हैं, और परिणामों को Flat के अपने notation format के अनुरूप रख सकते हैं, ताकि इम्पोर्ट बाकी प्रोडक्ट में स्वाभाविक रूप से फिट हों। इस पहले रिलीज़ में ही यह आपके संगीत का कहीं अधिक हिस्सा पढ़ लेता है:

notation का अधिक व्यापक कवरेज। अब नई पहचान में शामिल हैं:

  • Chord symbols, जिन्हें उनके musical meaning के अनुसार सही तरह से editable chords के रूप में encode किया जाता है, सिर्फ़ plain text के रूप में नहीं
  • Measure repeats और rhythm slashes
  • Tempo और metronome markings (BPM सहित)

ज़्यादा भाषाओं में lyrics और text। Lyrics, rehearsal marks और अन्य text अब Latin script वाली भाषाओं में डिफ़ॉल्ट रूप से पहचाने जाते हैं, साथ ही Japanese, Korean और Chinese में भी।

मूल लेआउट के अधिक अनुरूप। अब इम्पोर्ट source score के लेआउट का कहीं अधिक क़रीब से पालन करते हैं—हर पंक्ति में measures की संख्या, हर पेज पर systems की संख्या, और पूरी संरचना सहित। इससे बड़े और जटिल score, जैसे orchestral works और piano जैसे multi-staff instruments, पर वास्तविक फ़र्क पड़ता है। यह अब और अधिक page formats को भी support करता है, जिनमें landscape pages भी शामिल हैं, जिन्हें पहले support नहीं किया जाता था।

जून में भी

8 छोटे बदलाव

क्या आप कुछ पुराना खोज रहे हैं?

पुराने अपडेट Flat ब्लॉग पर हर रिलीज़ के हिसाब से लिखे गए हैं।