科技界一般都认同“第四次工业革命”大约是从2016年开始的,当时支撑科技宠儿人工智能(AI)的工具如深度学习、卷积神经网络(CNN)和循环神经网络(RNN)等,成了电脑视觉、语音和图像识别,以及部分自然语言处理任务的主导。AI也开始进入制造业与工业、物流与供应链、农业与医疗、金融能源以及科学研究等领域,进展循序缓慢。2022年后,由于大语言模型以及相关科技的突破,一瞬间,AI以廉价普及的方式飞快走入市场,其中翘楚“生成式AI”突然间广泛地令几乎每个人都可以随意应用它,也打开AI可能失控的潘朵拉之盒。
现在坊间应用最多的,是利用AI与大语言模型的功能,通过代码、文本、图像、音频和视频等的生成,为个人或公司处理各种以文本为基础的作业。AI在这方面的应用,肯定会节省资源,提高作业流程的效率和生产力,不过在应用之前,我们应注意用生成式AI创作的几个固有限制,以免无意中踩踏红线。
首先是有关版权和知识产权的问题。当我们指示AI生成作品,如文章、图像、音频和视频的时候,不可能知道AI之前是从什么时候、什么地方和什么资源,学习了多少技巧,才替我们生成这个作品的。如果没有关于这内容的专业知识,或者没有专人审查,也或者根本不熟悉知识产权的法律涵盖,就算踩到红线也不自知,就等着面对日后法律诉讼的风险。虽说我们也可以指示AI,不要抄袭某某人或某某风格,但我们不知道个别AI的机器学习模式,所以这样的指令没有什么实际作用。
