專家解讀 | 健全衍生數據治理機制 釋放數字經濟新動能
數據已成為數字經濟發展的關鍵生產要素。衍生數據作為經加工處理形成的高附加值數據形態,在產業實踐和社會治理中展現出巨大潛力,廣泛應用于電商、交通、醫療和金融等領域,為精準決策和公共服務提供有力支撐。國家高度重視衍生數據的開發利用。《中共中央 國務院關于構建數據基礎制度更好發揮數據要素作用的意見》(以下簡稱“數據二十條”)首次提出保護數據衍生產品的經營權。健全衍生數據治理機制,科學識別、合理配置數據產權,將為保障多方權益、激勵技術創新、推動數字經濟高質量發展提供堅實制度基礎。
一、衍生數據:推動數字經濟發展的“新引擎”
衍生數據是對原始數據進行加工、建模分析、關鍵信息提取等處理而形成的,具有高附加值的數據形態。相較于原始數據,衍生數據具有結構更優化、價值更顯著、應用更廣泛的特征,服務于金融、交通、醫療等諸多領域,為產業升級、公共治理和社會服務提供了全新動力。例如,在金融領域,銀行和保險機構在保障數據安全、遵守個人信息保護相關要求等的前提下,對經去標識化、匿名化處理的用戶行為數據開展深度建模,形成風險控制和精準營銷所需的衍生數據,有效提升了服務水平與防范風險能力。在交通出行領域,交通運輸企業通過對車流量數據的整合分析,生成的衍生數據可支撐線路優化、運力調度和智慧交通建設,讓群眾出行更加便捷高效??梢哉f,衍生數據不僅極大地提升了數據的“可用性”,也直接決定了數字經濟創新的深度與廣度。正因如此,如何識別和規范衍生數據,已經不只是技術或產業問題,更關系到數據要素能否順暢實現產業化和數據價值能否充分釋放。
從制度層面看,將衍生數據納入數據產權制度的調整范圍,并對其產權歸屬作出明確安排,是完善數據產權制度的重要一環?!?span id="6wg7a0fr" class="" link-id="link-1774755914767-0.21336890462409075">數據二十條”明確提出,要探索“對經加工、分析形成的數據或數據衍生產品的經營權”,為衍生數據區別于原始數據、獲得獨立評價提供了明確的政策指引。
當前,衍生數據受到的關注不斷增多,爭議焦點主要集中在兩方面:一是數據加工到何種程度構成衍生數據;二是衍生數據的歸屬應當如何認定。尤其是通過自動化程序收集公開數據進而形成衍生數據的情形,相關權屬爭議更為集中、更為復雜。對衍生數據法律地位的界定與權利歸屬的明確,有助于回應產業界關于衍生數據“是否應當單獨確權、如何配置權利”的現實關切,從而為數據的深度開發和價值創造提供制度支撐,真正推動數據“用起來、活起來”。隨著數據要素市場建設不斷推進、應用場景持續擴展,建立清晰、可操作的衍生數據識別標準與產權配置規則,已成為數據產權制度建設中的重要內容。
二、什么是“衍生數據”:衍生數據的識別標準
衍生數據的準確識別是后續確權、授權和流通的前提。衍生數據的生成過程本質上是一種數據加工行為,需要以原始數據為基礎,同時依賴加工者的主動投入形成區別于原始數據的“新數據”。那么,經由何種程度的數據處理,衍生數據才能在規范意義上被評價為已經發生質變,從而脫離原始數據成為一項“新數據”?可以從兩個維度理解:一方面,數據在形態上的實質變化,這是衍生數據與原始數據的物理區分;另一方面,數據因加工而發生價值躍升,從而防止將一般性的整理、篩選或復制誤認為創造衍生數據。
數據自身形態的實質變化表現為數據本身因加工而發生的實質改變。對于數據是否滿足實質改變標準,可通過數據內容、結構或形式等多個維度進行判斷。數據內容改變意味著數據承載的信息發生了變化;數據結構改變主要是指數據的邏輯組織方式與存儲形式發生變化,具體表現為數據的訪問方式、組織結構、存儲方法等方面的調整;數據形式改變則體現為數據呈現方式在抽象與直觀之間相互轉化。例如,語義信息提取技術可以從圖片、文本、視頻等人類可讀取的數據中提取出語義標簽等信息,將機器難以直接讀取的非結構化數據轉換為結構化數據,這一過程即可構成數據形式改變。
數據的價值生成表現為數據加工成果相較于原始數據是否在使用價值和交換價值上顯著提升。數據的使用價值主要體現在兩個方面:一方面,數據能夠提供知識、智慧和洞見,為當下的決策提供實用和及時的支持;另一方面,數據的分析和挖掘能力,即數據經過進一步加工處理后所增加的價值。數據的交換價值則體現在其作為商品或服務在市場上的交易流通能力。相較原始數據,衍生數據往往更結構化、更具可用性,與具體業務場景結合更加緊密。同時,通過數據的合規處理與去標識化,數據上的相關信息權益負擔得以消解,買方拿來即可用,因此衍生數據更容易被市場接受,也更容易實現更高的交易價值。
需要指出的是,隨著技術發展、行業差異和應用場景的動態發展,衍生數據的識別標準也會更加細化。實踐和學界討論中有觀點主張將“不可逆向還原”作為判斷衍生數據是否真正脫離原始數據的重要考量因素。“不可逆向還原”是指衍生數據相較于原始數據已發生永久性改變,無法在合理成本和可行技術條件下通過逆向工程恢復原始數據。引入這一判斷維度,主要是避免加工者通過衍生數據反向獲取原始數據,從而侵害在先權利人的合法權益。
三、如何配置數據產權:衍生者賦權與在先權利保護
賦予衍生數據權利,應以數據處理者對原始數據享有使用權并保障各方合法權益為前提。對非法獲取的數據進行加工,不能通過衍生數據的產權制度獲得法律保護。為了確保數據要素市場的運行效率和權利秩序,衍生數據的產權配置規則應當在確認加工者的投入和創新價值的同時,合理保護原始數據權利人和信息主體的合法權益,從而實現激勵與約束的平衡。
在衍生數據的產權配置上,首先應遵循意思自治原則。倘若雙方對于衍生數據的權屬已有約定,應當允許其通過合意約定衍生數據的權利歸屬。對衍生數據的權屬約定需符合公平、自愿和誠信原則,避免因壟斷或不平等條款損害交易對方利益。其次,在衍生數據權屬無約定或約定不明確,且無相關法律規定的情況下,衍生數據的持有權、使用權和經營權原則上歸屬于衍生數據的處理者,其原因在于,這有助于實現數據要素收益的合理分配,并可在不侵犯原始數據產權人和信息主體合法權益的基礎上,激勵數據處理者加大對數據深度加工的投入,推動數據資源價值的充分釋放。
產業界存在這樣一種擔心:一旦承認衍生數據的產權由加工者享有,原始數據權利人的利益會不會被“掏空”?其實,衍生數據的權屬認定與對在先權利人的利益保護并不存在沖突。即使因實質性投入與創造性勞動,數據加工者對其形成的衍生數據享有財產權益,這一認定本身并不消除或覆蓋其上可能承載的他人既有合法權利。衍生數據的開發利用,必須以合法取得、合法使用原始數據為前提,不得侵害原始數據權利人享有的人格權益、商業秘密、知識產權以及其他合法權益。
總體而言,健全的衍生數據產權配置規則能夠在多個層面發揮制度效用。對加工者而言,明確的權屬安排既有助于保障其合理收益預期,也能夠激勵持續投入與技術創新;對原始數據權利人而言,對在先權利的有效保護,可以防止其合法權益在數據再利用過程中被侵蝕;從社會整體來看,衍生數據權屬的明確,有助于激發各類主體深度挖掘和持續創造數據價值的動力,進而提升數據要素的流通效率與創新創造能力。

