返回「辨識如何運作」OMR 最新消息

PDF 與照片掃描的最新消息。

由光學樂譜辨識(OMR)驅動的 Opuscan 掃描功能持續進步。此頁面記錄了 PDF 與照片匯入的更新內容,依最新順序排列。

項目由英文自動翻譯。 閱讀英文原文

9月28日·改進·

新版掃描模型可辨識較少見的拍號與未標示譜號的譜行

我們更新了掃描模型,重點改善拍號、譜號和多小節休止符的辨識。

  • 更多拍號能依照樂譜原樣辨識。 模型現在能辨識 29 種拍號,以及普通拍子和二分拍子。本月新增:6/4、7/4、8/4、9/4、10/8、11/8、13/8、14/8、15/8、9/16、11/16、13/16、15/16 和 17/16,這些拍號常見於民謠、爵士樂和當代音樂。過去,這些拍號會被替換成較常見的拍號(例如 10/8 變成 12/8、8/4 變成 5/4),導致小節拍數不符,音符也會被刪除以配合拍號。查看掃描支援的所有記譜符號。
  • 多小節休止符會保留正確長度。 在管樂團和管弦樂團的分譜中,長休止符上方的數字表示要數過多少個小節。現在這個數字被誤讀的情況大幅減少。過去,「10」可能被讀成 100,讓分譜多出數十個空白小節。
  • 未標示譜號的譜行會維持正確音高。 許多分譜,尤其是爵士樂譜和舊版樂譜,只在頁面的第一個譜行印出譜號。過去,模型會猜測其他譜行的譜號;一旦猜錯,該譜行的所有音符都會偏高或偏低。現在,這些譜行會沿用前一個譜行的譜號。
  • 減少辨識出樂譜上不存在的內容。 三連音上方的小「3」不再被讀成指法,未印出的八度線(8va)不會憑空出現,整個譜行都沒有演奏內容的譜表也不再被填入鼓音符。
  • 更多音符能保留在樂譜中。 如果辨識出的某個小節拍數超過拍號允許的範圍,就必須略去部分音符,才能讓小節拍數吻合。現在節奏和拍號的辨識更準確,這種情況也大幅減少:在我們測試的匯入樂譜中,遺漏的音符減少了約 70%。

亦見於 9月

32 項小幅變更
8月7日·改進·

支援隱含連音的新模型版本

我們的自研模型推出了新版本,現在所有 PDF 與照片匯入都由它處理,這次特別針對頁面上連音的印刷方式進行了優化。

  • 現在支援隱含連音。 排譜者通常只會在一個樂句中的第一個三連音或六連音上方標示小小的「3」或「6」,後續的音群則不再重複標示——演奏者會被預期延續這個模式。這些沒有標記的音群就是隱含連音:實際上要按連音演奏,但譜面上沒有任何標示。這種寫法在 19 世紀的版本、練習曲與變奏曲中非常常見。現在掃描功能會根據小節的節奏還原這些連音,而不再為了配合拍號而刪除音符。
  • 憑空誤判的連音更少了。 先前模型有時會把一般的符槓音群誤標成三連音,即使上方根本沒有印出數字,這些數字也會出現在你的樂譜中。現在只有在頁面上確實畫出連音標示時,才會寫入連音。

亦見於 8月

19 項小幅變更
7月29日·改進·

聚焦掃描樂譜精準度的新模型版本

我們自研模型的新版本現已用於所有 PDF 與照片匯入,在掃描樂譜基準測試中,錯誤率降低了 22% 到 51%。提升在較困難的頁面上最為明顯,例如較舊的雕版印刷與印刷不均的樂譜。

7月24日·改進·

專注於樂譜記譜修正的新模型版本

改良版的 Flat 自研模型現已用於所有 PDF 和照片匯入,尤其包括:

  • 現已支援帶有共用休止符與隱形休止符的多聲部段落。
  • 小節線與反覆結尾(voltas)現在會正確放置在小節內。
  • 連桿的辨識現在更可靠。
  • 現已可辨識跨越多個譜表繪製的拍號,例如管弦樂總譜中的拍號。
  • 修正了部分和弦符號匯出為 MusicXML 時使用非標準和弦類型的問題。
7月21日·新增·

Windows 版 Opuscan

Opuscan 這款可獨立使用的掃描轉譜應用程式,現已支援 Windows,與 macOS、iPhone、iPad 和 Android 並列。掃描樂譜頁面或開啟 PDF,即可取得可編輯、可播放的樂譜,並匯出為 MusicXML 和 MIDI,無需 Flat 帳號。

7月15日·新增·

適用於 iPhone 和 iPad 的 Opuscan

Opuscan——我們獨立的掃描轉樂譜 app——現在已於 App Store 推出 iPhone 與 iPad 版本,加入 macOS 和 Android app 的行列。拍攝樂譜頁面或開啟 PDF,即可取得可編輯、可播放的樂譜,並匯出為 MusicXML 和 MIDI——無需 Flat 帳號。

7月10日·新增·

適用於 macOS 與 Android 的專屬 Opuscan 應用程式

Opuscan——我們獨立的掃描轉樂譜應用程式——現在已推出專屬的 macOS 與 Android 應用程式。它採用與 Flat 相同的自家 OMR 引擎,可讓任何人將 PDF 或樂譜照片轉換為可編輯、可播放的樂譜,並匯出為 MusicXML 與 MIDI——不需要 Flat 帳號。它專為只想使用掃描技術並匯入自己偏好的音樂軟體的使用者而設計,無論是記譜軟體(MuseScore、Dorico、Sibelius、Finale)或 DAW(GarageBand、Logic Pro、Ableton Live)都適用。你可以在 Mac App Store 或 Google Play 下載。

亦見於 7月

11 項小幅變更
6月23日·改進·

更精準地分析複雜版面頁面

我們改進了掃描時讀取頁面版面的方式。現在匯入 PDF 和照片時,產生的樂譜會更乾淨、更準確,尤其是在複雜版面上:

  • 現在能正確分開密集頁面。 由許多短系統上下密集排列的頁面,不再被合併在一起;每個系統都會分別偵測。
  • 更適合管弦樂總譜與大型合奏譜。 像鋼琴與管風琴這類多譜表樂器,以及含有許多譜表的大型樂譜,現在都能更可靠地辨識。
  • 支援寬幅、橫向與小冊子版面。 橫向頁面不再裁掉左側邊緣(避免譜號被截斷),多頁與小冊子掃描也能正確處理。
  • 減少雜訊誤判。 頁尾與頁邊附近的無關元素,不再被誤判為音樂內容。
6月15日·改進·

更精準的模型

現在,所有 PDF 和照片匯入都會由 Flat 自家開發的模型處理。這次發佈是以轉譜精準度為重點的重大新版本:在所有測試集中,樂譜辨識的正確性(決定樂譜是否正確的音符、節奏、連結線與臨時記號)都有提升,其中進步最明顯的是:

  • 力度記號: +39%
  • 延長記號、演奏記號、連結線、臨時記號: +30 to 37%
  • 音符時值: +22%
  • 圓滑線、附點音符、休止符、譜表與聲部分配: +14 to 20%

文字、力度記號與版面位置也更加精確:歌詞、和弦名稱與力度記號能更可靠地附加到正確的音符上,即使是在鋼琴大譜表或包含譜號變更的聲部等複雜版面中也是如此。

6月1日·新增·

Flat 自家的 AI 模型開始逐步推出

我們正逐步推出 Flat 自家的 AI 模型,用於 PDF 和照片匯入。這個模型由我們內部設計與訓練,將取代產品推出時使用的第三方引擎。從頭到尾掌握這項技術,讓我們能進一步提升辨識準確度、擴大可辨識的內容、更快推出改進,並讓結果更貼合 Flat 自有的記譜格式,使匯入內容能更自然地融入產品的其他功能。這個第一版已經能讀取你更多的樂譜內容:

更廣的記譜涵蓋範圍。 新增可辨識項目:

  • 和弦記號,會依其音樂意義正確編碼為可編輯的和弦,而不只是一般文字
  • 小節反覆記號與節奏斜線
  • 速度與節拍器標記(含 BPM)

更多語言的歌詞與文字。 預設可辨識以拉丁字母書寫的語言中的歌詞、排練記號及其他文字,另外也支援日文、韓文與中文。

更忠於原始版面。 現在匯入結果會更貼近來源樂譜的版面配置,包括每行的小節數、每頁的樂系數,以及整體結構。這對大型、複雜的樂譜,例如管弦樂作品,以及像鋼琴這類多譜表樂器的樂譜,會帶來明顯差異。現在也支援更多頁面格式,包括先前不支援的橫向頁面。

亦見於 6月

8 項小幅變更