登陆注册
49625400000017

第17章 内容的表达和元数据(1)

内容管理系统的核心是它管理的内容对象。内容管理的主要任务是在对象的生命周期内优化内容的处理和开发。对象的生命周期是指从内容的获取、制作、传输,到归档和存储的过程。内容对象在系统中怎样存储和表示对于检索和应用处理是至关重要的。然而内容的表示并不只与内容对象本身有关,还与内容对象所处的使用环境有关。因此,内容的表示模型应该考虑到这个因素,从而提供一个内容数据和信息的各种处理过程的抽象。

元数据是内容管理系统中不可或缺的部分,它被定义为“有关数据的数据”。元数据在从不同方面描述内容对象时考虑了不同的观点、方面、工作流、处理程序和存在的信息模型,这对于在需要时随时管理、搜索、查找、检索内容信息是很重要的。因此,内容的描述和描述的质量对内容管理系统提供快速便捷的查找内容的能力是很重要的。元数据要考虑不同的用户角色和与系统的交互运行,以及提供相应的视图。理想的内容管理系统支持所有的原始材料进入系统的创建处理过程和描述过程,以及所有相关工作和内容的分配、处理过程。这种情况下需要考虑的不仅是与内容的直接交互工作,还包括相关领域,如统计计算、权限管理和程序计划。

除了纯粹的描述和检索以外,元数据还管理着内容的内部组织和对外组织关系方式。因此,优化实际的交换和信息的转译交换都需要一定的标准。因为标准通常只提供大致的共同特征说明,标准本身并不能提供个体组织所需要的具体功能支持。因此,标准只能覆盖对于具体功能和主题背景很重要的特定方面。

目前已经开发出了很多数据模型、内容描述方案以及内容的表示和描述的参考模型。它们通常从不同角度描述内容,因此不是完全可比较的。不存在通用的内容描述方案。在内容管理系统中,针对不同方面的应用要使用不同的内容表示方案。本章给出了根据不同环境描述内容的概念。接下来介绍了元数据的结构和元数据方案应该捕获的信息。本章还介绍了元数据的交换和数据模型,介绍了许多主要表示模型和描述方案,以及元数据的编码和交换协议,给出了该领域目前的发展概况。另外,本章还说明了目前在不同环境下表示元数据的不同方法。具体方案或者模型的适合程度还要视其在具体实例中的使用情况而定,本章的讨论将有助于形成这种评价。

4.1内容的表示

内容对象的核心是素材,即包含实际信息或思想的部分。然而有时候内容的信息比内容对象本身还要重要,例如有关内容的所有管理任务。甚至在生产工作流中具体的元信息(元数据、摘要和低码率的素材版本)要比内容对象本身更重要(2.2.1节)。在这种情况下就需要选择适当的方法和适合的元数据,以表示对与内容对象有关的各种工作流和管理程序给予最好的支持。尽管数据模型、内容表示和工作流的详细信息根据不同的内容和不同的组织而不同,但是主要的内容特征和用例是大致相同的。

媒体对象(视频、音频轨道、图片等)可以被表示成为所谓的“代理”。代理对应于基于特定环境的特定方面的内容的具体视图。代理更加强调特定特征,表示特定视图或可视化的具体属性,因此更容易访问。代理可以有不同的媒体形式。视音频内容可以用多媒体代理来表示(综合使用不同媒体类型来表示)。其他代理有:摘要、编辑决策列表(Edit Decision List, EDL)、数据库记录等。

纯文本代理是有关内容的文档,包括摘要、产品文档(如产品单)、校本、EDL、日志文件(例如和时码有关的文本转换语句和注解)、合约、法律文档等等。这一组代理包含了一般文本中表示内容或者内容的特定部分的所有文档类型,可以对这些文档建立索引以便查找。

数据库代理是存储于数据库管理系统(Database Management System, DBMS)的全部内容的表示。DBMS的特性是可以管理巨大数量的数据。内容对象被表示成为一种抽象模型,称为“数据模型”。数据模型存储于数据库中。所有相关特征由一个结构化文本表示器来采集,它能够优化简便查找,并重新按照属性查找。文本和数据库代理通常和元数据有关。元数据定义为描述核心创作媒体对象数据的数据,这种媒体对象包含创作者需要传递的实际信息。

多媒体代理是表示如低码率副本、视听摘要和不同媒体类型的组合内容的表示方法。内容的低码率副本可以不用实际接触材料就能预览,因此能在窄带宽的链接上传输,在低配置的设备上输出。视听摘要是视听内容的组合,这些摘要通过显示素材的一部分而提供了素材的纵览,典型代表有关键帧或浏览。视听摘要通常通过自动分析程序自动提取和编译。不同媒体类型的组合可以通过链接文本、图片视频和视听信息提供实际内容的更好的总览。例如,情节串联图板就是包含内容描述信息和片断的关键帧和时码的组合,还有与低分辨率素材副本有关的文字材料等。如果内容对象是连续媒体类型,那么不连续的媒体内容表示部分也有与内容对象时码有关的时间参数。

广义的多媒体代理可以被看做是元数据,它们有附属的特征而且主要对象是优化内容的表述和检索。多媒体代理的文本部分显然是元数据描述内容对象的一部分。可视化摘要也有描述的特性。然而,低码率内容副本则是不带有描述信息的对素材的表示。

4.2元数据:内容的描述

元数据用来描述内容并在系统和系统组件中表示内容,它要遍布整个媒体制作的工作流程,从预制作到存档。另外,它还要容纳权限不同及对内容不同方面感兴趣的不同用户组。因此,对于内容的描述,有不同的方面和目的。

元数据最初在计划阶段产生,在内容对象的整个生命周期内被使用和不断修正。使用元数据的阶段有:生产、传输、媒体管理和其他开发过程。元数据要捕捉程序计划、生产计划(包括原材料、个人计划和相关贡献的参考),还有计划阶段的编辑准备(绘制、调查、收集和情节串联)。元数据应用的其他程序和用例包括:文档撰写、IPR、许可证、分析数据和位置相关数据(存储管理、位置ID等)。另一组元数据是有关内容的使用和开发的,通常这部分包括传输历史记录、程序交换和程序材料的数据和内容销售的信息(市场信息)。新一类的元数据是有关在互联网上使用的内容的数据,此时的数据记录是有关历史访问记录、负责人员(版主或者编辑者)等方面的。

元数据必须捕获和描述过多的特征和工作流,因此存在处理元数据的不同方案和(子)系统。元数据可以根据它所描述的实体来进行分组,有关于对象和关于片段的元数据。关于对象的元数据包括所有以描述媒体对象的特定特征为主题的元数据,而关于片段的元数据用于描述由于空间或时间界限(如图片边界和时码)所分割的内容对象的一个部分。

4.2.1关于对象的元数据

关于对象的元数据将内容对象作为一个整体描述。部分关于对象的元数据是内容描述(主题、作者、导演等)、相关组织数据(如项目位置、责任编辑办公室等信息)、内容标识和参加团体(处理内容的个人或组织,及其关系、角色和权利)。另外,关于内容的元数据包括技术元数据和所有商业过程(包括媒体制作的所有工作流步骤)。

关于对象的元数据通常存储在数据库中,有时也存储在结构化文件中,以全文检索引擎建立索引,以便于检索。内容对象的相关文档(如注解和合同)也可以以电子形式存储和建立索引来方便搜索。当文档需要像元数据一样存储于硬盘上时(如文章的法律文件),这些文档的相关资料可以(有时是必须)存储于内容管理系统的数据模型之中。

4.2.1.1工作流和内容描述

为了便于内容管理,内容的特征要被获取为结构化元数据。这可以使用描述对象(实体)本身和对象间链接的提取程序来完成。此时,工作流是要考虑的最主要的处理过程。元数据通过工作流被合成,因此,这些工作流定义了内容生命周期特定点所产生的元数据。然而,元数据的产生和标记是由系统定义的。本节介绍一些一般的与内容管理有关的工作流(如内容获取和解析、制作、存储以及归档)。具体的分析需要根据实际的组织及其系统和工作流才能进行,这需要在处理内容的系统中独立进行。

元数据可能在生成的时候就被处理并联系到一部分素材上。记录的位置(比如通过GPS得到的)、日期、时间等信息在产生记录时就自动与材料相关联了。然而,通常在输入和解析过程中,内容进入系统,元数据与内容对象建立关联。

理想情况下,大多数在这个过程中加入的元数据被自动处理。这些信息有:材料相关参数和自动分析程序检索的数据。这个过程中收集到的元数据被编入元数据集合,这些集合的结构有赖于特定系统的实际数据模型。

在查找阶段收集的典型元数据主要是与材料相关的,包括:

·视频源格式。

·视频压缩格式。

·音频源格式。

·音频压缩格式。

·记录参数(摄像和话筒设置)。

·生产信息。

在上载过程中,加入元数据可以用来标识内容,同时也用来支持快速检索和提供一个初始水平,该信息通常要手动输入系统。上载过程中加入的典型的元数据有:

·生产序号。

·标题。

·日期、时间和位置。

·源名(如机构名称、摄像者等)。

·剪辑描述(画面内容的文本摘要)。

·起始或结束标志(磁带或文件的剪辑)。

·拍摄质量。

不同的系统、部门和用户都参与了制作过程,这表现在其产生、引用和用来检索的元数据中。这些不同的系统有服务器组件(上载、制作和播出服务器)、制作条目的记者和编辑、最终内容条目的编辑、提供材料的归档和编目的归档部门。在所有这些处理过程中,额外的元数据被制作出来,并且与内容对象相关联起来。下面的元数据集即表现了后期制作和非线性编辑的典型的关于对象元数据集的例子:

·文献开始或结束。

·时码。

·副标题。

·授权信息。

·电子VTR卡。

·剪辑者、编辑者和制作人的名字等。

附加元数据可能被制作和搜集在另外的元数据集合中,如编辑集合、传输集合、描述集合等等。这些元数据集合更加明确地指向具体的任务和工作流步骤。

一旦材料被制作好之后就可以被分发播出。在广播系统中,分发播出是根据节目单进行的,并且被记录在播出节目(Program as Broadcast, PasB)中,此时相关数据有:

·首播日期。

·首播时间。

·播出频道。

·统计信息(观众或听众数量)。

·重播信息。

内容条目的生命周期最后一步是分类和深层编目。在这一步中,内容被分类和详细描述,以便查找、访问和复用。在制作过程中,添加的元数据在这一步中被修正和整合。应用的分类方案有赖于媒体类型和具体组织结构。这个过程中添加的典型数据有:

·目录表。

·编目时间。

·题目分类。

·节目关系。

·摘要。

在这一步产生了详细的内容描述,也就是关于片段元数据的一部分。

4.2.1.2关于权利的元数据

知识产权(Intellectual Property Rights, IPR)是关于对象元数据的一种特殊类型,它和内容的开发以及内容管理过程有紧密联系。然而,IPR通常是在内容管理系统之外的独立的版权管理系统中被管理,这是由于内容管理系统还没有覆盖到复杂组织的结构和法律领域。版权管理系统维护着IPR体系、合同信息和其他与内容对象有关的法律文档。版权管理系统管理的信息要和内容管理系统中内容对象的信息联系起来。

IPR描述了特定内容对象的所有权和使用限制。这些权限有可能很复杂,通常需要专业人士的解释。该版权有所有权(作者、作曲者、导演、摄影师等)、演出权(演员、音乐家等)、个人版权和其他很多版权。在使用(重用)作品时要充分考虑版权拥有者的具体权利。因此要妥善保管内容对象的法律文档并及时更新。

除了要考虑所有权、用户限制之外,还要考虑以下版权:

·地域限制(通常指地理限制)。

·传输和传播方法(通过电视、电影、广播和网络)。

·传输和传播时间(先于或后于某一天)。

·使用期限。

·用户(传输者)数量。

不仅要注意内容管理系统中和数据有关的某些基本版权,还应该注意在内容对象中享有其他版权的对象内容。然而,因为组织和法律原因,这些只能是象征性的。内容管理系统的用户要从法律部门得到更多有关版权的信息,以便在能用到内容的情况下保证尊重所有的版权。

同类推荐
  • 构建学校规范化管理的方法

    构建学校规范化管理的方法

    本书内容全面指导学校如何制定各项科学的管理规划、如何明确学校长远的内涵发展目标、如何制定合理的管理计划和规范管理的每个细节、如何规范管理思想和提升管理理念、如何规范化管理的全过程等内容,具有很强的系统性、实用性、实践性和指导性,是大中小学学校领导、教师,在校专业大学生、研究生、博士生以及有关人员进行学校管理和研究的最佳指导读物,也是各级图书馆珍藏的最佳版本。
  • 晚清学堂学生与社会变迁

    晚清学堂学生与社会变迁

    晚清学堂学生与社会变迁绪论近代中国的青年。学生,是除旧布新的重要社会力量,在民主革命的各个阶段,在社会变迁的各个方面,常常起着先锋和桥梁的作用。1919年。的五四运动,便是在青年。学生运动的前奏曲中拉开序幕的。学生的行动不仅促使新文化运动与反帝爱国政治运动相结合,而且将少数先驱者的引吭高歌变奏为全国各阶层民众的雄浑合唱,产生了巨大的历史回响。
  • 教育信息技术的掌握与应用(教师继续教育丛书)

    教育信息技术的掌握与应用(教师继续教育丛书)

    本书主要讲述的是:教育信息化的应用与展望、电化教学的运用、积极发展学校的电化教学、现代教学手段的使用和教育改革、多媒体技术在课件制作中的应用、教育信息化的理性反思等。
  • 平民历史

    平民历史

    本书记录的故事,都发生在60-70年代动荡无序的中国。如果你曾经历过文革时期的暴风骤雨,如果你曾度过苦乐交融的知青岁月。如果你曾是77年艰难而又幸运的大学生,那么,40年前在时代磨难中经历过的一切苦乐与血泪,真正的历史是不容忘却的。本书试图给你的记忆一条清晰的线索,以个人“心灵史”的视角,呈现给你平民心中最深切的记忆。
  • 广播电视节目创优

    广播电视节目创优

    广播电视节目创优已经成为全行业的共同追求!也是行业竞争的重要手段“节目创优的意义也是人所共知的”。
热门推荐
  • 期待遇见爱情

    期待遇见爱情

    讲述的是一个女孩遇见了一个让她感觉温暖的男孩,照亮她的生活,让她看见希望。可是她和那个男孩无缘在一起,最后男孩结婚了。
  • 山东明清进士通览(清代卷)

    山东明清进士通览(清代卷)

    这套书分为明、清两卷,以传略的形式,按照时间顺序记叙、整理了两朝4188名进士的传略性史料,整体体现了山东明清两代各科所取进士数量、籍贯、家族、仕历、甲第名次以及重要事迹。作为可以索检明、清两代进士及考镜当时社会现状的重要工具书,它的意义和价值不言而喻。前代学者在进士传略的纂辑方面也做出过很多的尝试和努力,但今天我们却不能完整地看到一部考证性、总录类的著作,给史学界的专家了解故实、查证人物时带来难题和遗憾。“不为生人立传,盖棺方可论定”是古代史学家为史、志编写所定立的原则,正如罗燕生先生序所说,“贤达人士作传多冠以耆旧、先贤、士林、乡宦等类名。那些登科入仕,无至高官,历迹不彰,艺术不显,著作又不见于后世的人,正史无载,往往杂入‘人物门’之中”。
  • 斗罗之绝世

    斗罗之绝世

    少年不幸到了斗罗世界,在这里,他是会高傲的走下去,还是会默默的准备一鸣惊人呢?
  • 穿成大佬的小公主

    穿成大佬的小公主

    【外表乖乖女内里娇娇女公主vs身体力行口嫌体正直太子】 在她原本的那个时代,她遇见他之后,才知道什么是天高地厚!顾非非:我本是楚国高高在上的公主啊!凭什么在遇见你之后我就这么轻而易举地挂掉了!容宴:对不起我的小公主......下辈子把你捧在我的手心里,好不好......一睁开眼就发现自己来到了一个完全陌生的时代,顾非非只能接受。她开始塑造自己,改变自己,沉淀自己,营造出自己是一个乖乖女的形象。她不再是那个不知天高地厚的公主了...... 后来,又再一次遇见了他!天知道自己是多么的惊恐!还有那条蛇!可怕......在不知不觉中,他撕碎了自己伪装已久的面具。不小心弄坏了他的衬衫,赔就赔!自己又不欠他的。索性在他的衬衫上画了一个Q版的穿着古装的他。 有一次,她心疼他。 容宴身体力行地表示:我很好!不过,我喜欢你为我着想的样子。喜欢她对他撒娇,想把她捧在手心,想把她宠成公主,让她再也离不开他! 我爱你,我的公主殿下。
  • 槐树街的猫

    槐树街的猫

    四季不断流转变化,透过这扇窗。在这一眼望到尽头的方方正正的房间里面。那外面变化的四季也仿佛隔绝了一般。她感觉到的只是这样而已。梦,这是一个永远没有尽头的梦。什么时候开始,什么时候进行着她已经完全不知道了。她只知道她要去到那里,那个约定的地方,无论多少时间,无论多少等待。慢慢的世界所给予的那名为希望小小碎片就掉落在这。我的愿望是。。。。
  • 齐天火帝

    齐天火帝

    本人第一次写小说,请大家给给面子,给我些鼓励,我会加油的。
  • 安先生硬要和我结婚

    安先生硬要和我结婚

    一纸婚约,甩到熊晴晴脸上……亲爸亲妈竟然给她订了一门娃娃亲!什么世交安家二公子,安泽轩?和她年纪相仿,郎才女貌,天生一对?熊晴晴就这样,被常年出差的考古学家父母,无情的丢到了安家放养。然后安二公子成日不在,安大公子竟然……安泽衍:婚约上改一个字,安泽轩变成安泽衍。熊晴晴:……安泽轩:和我订婚便宜你了。熊晴晴:哔了个未婚夫!你有见过,这么厚颜有耻,硬要和她结婚的安先生吗?
  • 克莱格恩帝国

    克莱格恩帝国

    一个纯野生奥特曼在各个世界穿梭建立庞大的位面宇宙帝国的故事
  • 宫苑斗:深宫绝恋

    宫苑斗:深宫绝恋

    她十五岁的时候,舅妈就开始忙碌起来,一心一意要将她嫁入皇室。她是个才女,向往自由的人生,却必须来到深宫中度过今后的生活……是谁给了她这一切?她该恨那些改变她生活的人,还是该爱他们给了她看似荣华富贵的一生?
  • 月色撩人寒倾语

    月色撩人寒倾语

    一段前世今生的抵死缠绵,一段刻骨铭心的凄美爱情;充满神秘的“无影”组合在黑夜里悄悄绽放,悄然无声;三个现代性格迥异的女孩经历着不为人知的旅途,阴谋的背后却是心痛的真相,无情的咒印逐渐揭开,爱与不爱只在弹指一瞬,原本冰冷的心却因爱而渐渐融化。