Skip to content

What’s new in scanned music import

How Flat turns PDFs and photos of sheet music into editable scores: model versions, what is recognized, what got fixed.

The same engine powers Opuscan and the OMR API. This page lists the changes as they reach Flat.

All changes

各項內容均由英文自動翻譯。 閱讀英文原文

於 9月

24 smaller changes
8月7日·改進·

支援隱式連音的新模型版本

我們自家研發模型的新版本現已用於所有 PDF 和相片匯入,重點改進對頁面上連音組排印方式的識別。

  • 現在支援隱式連音。 製譜人員通常只會在一段樂句中第一組三連音或六連音上方標示一個小小的「3」或「6」,之後相同的分組則不再重複標示——預設演奏者會延續這個模式。這些沒有標記的分組就是隱式連音:實際上要按連音演奏,但頁面上沒有明確寫出來。它們在 19 世紀版本、練習曲和變奏曲中非常常見。現在,掃描會根據小節的節奏將它們還原出來,而不是為了讓小節符合拍號而刪掉音符。
  • 憑空產生的連音更少了。 過去,即使普通的符槓分組上方沒有印上數字,模型也可能把它們判成三連音,於是這些數字會出現在你的樂譜裡。現在,只有在頁面上確實畫出了連音標記的地方,才會寫入連音。
8月4日·新增·

在桌面應用程式中匯入 PDF 或相片

在 Flat 中,印刷樂譜變成可編輯樂譜

Mac 和 Windows 應用程式現在可以將 PDF 或紙本樂譜相片轉換為可編輯樂譜,並提供與網頁版相同的檢查步驟。

  • 無需離開應用程式即可匯入。 選擇檔案、檢查掃描辨識結果,然後開啟樂譜。
  • 可在 Mac App Store 版應用程式內購買 AI credits,這樣匯入時就不用特地前往網站。

亦見於8月

16 smaller changes
7月24日·改進·

新模型版本重點修正記譜問題

Flat 自家模型的改良版本現已用於所有 PDF 和相片匯入,尤其包括:

  • 現已支援帶有共用休止符和隱形休止符的多聲部段落。
  • 小節線和反覆結尾括號(volta)現在可在小節內正確放置。
  • 連桁的辨識現在更可靠。
  • 現在可以辨識如管弦樂總譜那樣跨越多個譜表書寫的拍號。
  • 修正了部分和弦符號匯出到 MusicXML 時使用非標準和弦類型的問題。
7月15日·新增·

將 PDF 或相片匯入為可編輯樂譜,並加入檢查步驟

在網頁版應用程式中,從 PDF 或相片匯入樂譜現已採用全新流程,基於 Flat 自家的辨識引擎。這會為所有使用者取代先前的 PDF 匯入方式。

  • 選擇你需要的頁面。 上傳一個 PDF 或多張相片,然後只保留包含樂譜的頁面。每保留一頁都會使用 1 個額度。
  • 在辨識進行時追蹤進度。 進度列會逐頁顯示掃描進行到哪個階段,而且你可以在處理期間繼續使用 Flat。
  • 在建立樂譜前先檢查。 當辨識引擎無法確定某個樂器時,它會請你確認標題及所偵測到的樂器,並在每個項目旁顯示該頁面上印刷的聲部名稱。若所有樂器都已明確辨識,則會略過這個步驟。

Flat 已提供此功能;對教師和管理員而言,也可在 Flat for Education 中使用。這個新流程將於未來幾週內登陸 iOS 應用程式。

7月10日·新增·

OMR 現已作為開發者 API 提供

Flat 的 OMR 引擎現已可透過開發者 API以程式方式使用。你可以傳送 PDF 或相片、追蹤辨識進度、檢查偵測到的樂器,然後將結果作為可編輯的樂譜匯入 Flat 資料庫,或匯出為 MusicXMLMIDI。這與編輯器中用於匯入 PDF 和相片的內部模型相同,現在亦可大規模用於你自己的應用程式和工作流程。

專用 OMR API(v2.24.0)建基於 v2.23.0 中加入到樂譜建立流程的背景 PDF 匯入功能:匯入檔案時要求任務支援,並輪詢該任務直到樂譜準備就緒。有關這兩個版本的詳細資訊,請參閱 API 更新日誌

亦見於7月

9 smaller changes
6月23日·改進·

複雜版面可獲得更精準的頁面分析

我們改進了掃描時讀取頁面版面的方式。現在匯入 PDF 和照片時,產生的樂譜會更乾淨、更準確,尤其是在複雜版面中:

  • 密集頁面現在可正確分開。 對於上下堆疊許多短系統的頁面,不會再被合併在一起——每個系統都會被獨立偵測。
  • 更適合管弦樂總譜及大型合奏總譜。 鋼琴、管風琴等多譜表樂器,以及包含許多譜表的大型總譜,現在都能更可靠地辨識。
  • 寬版、橫向及小冊子版面。 橫向頁面的左邊緣不再被裁切(否則可能會切掉譜號),多頁掃描和小冊子掃描現在也能正確處理。
  • 更少誤判。 頁尾和頁邊附近的雜散元素不再被誤識別為音樂內容。
6月15日·改進·

更精確的模型

現在,所有 PDF 和相片匯入都會由 Flat 自家開發的內部模型處理。這個版本是一個重大的新版本更新,重點提升轉譜準確度:在所有測試集中,樂譜的音樂正確性(決定樂譜是否正確的音符、節奏、連結線和臨時記號)都有所提升,其中提升最明顯的是:

  • 力度記號:+39%
  • 延長記號、演奏法、連結線、臨時記號:+30 to 37%
  • 音符時值:+22%
  • 連線、附點音符、休止符、譜表和聲部分配:+14 to 20%

文字、力度記號和版面位置也更精確:歌詞、和弦名稱和力度記號現在能更可靠地附加到正確的音符上,包括鋼琴大譜表以及帶有譜號變更的聲部等複雜版面。

6月1日·新增·

我們自研的 AI 模型開始逐步推出

我們正在逐步推出 Flat 自研的 PDF 和相片匯入 AI 模型。這個模型由我們內部設計及訓練,用來取代產品推出時使用的第三方引擎。掌握端到端的技術能力,讓我們可以進一步提升準確度、擴大可辨識的記譜內容、更快推出改進,並讓結果更貼合 Flat 自家的樂譜格式,令匯入內容能更自然地融入產品的其他部分。即使是這個首個版本,已經能讀取你樂譜中更多內容:

更廣的記譜涵蓋範圍。 新增可辨識內容:

  • 和弦符號,會按其音樂意義正確編碼為可編輯的和弦,而不只是普通文字
  • 小節反覆記號和節奏斜線
  • 速度記號和節拍器標記(含 BPM)

支援更多語言的歌詞和文字。 現在預設可辨識以拉丁字母書寫的語言中的歌詞、排練記號及其他文字,亦支援日語、韓語和中文。

更貼近原始版面。 現在匯入結果會更緊密地跟隨來源樂譜的版面配置,包括每行的小節數、每頁的系統數,以及整體結構。這對大型而複雜的樂譜,例如管弦樂作品,以及像鋼琴這類多譜表樂器,會帶來明顯差異。現在亦支援更多頁面格式,包括之前未支援的橫向頁面。

亦見於6月

8 smaller changes

想尋找較早期的內容?

較早前的更新會按版本逐一刊載於 Flat 網誌。