英伟达推出新型DNA模型,突破传统文本生成限制
随着人工智能技术的发展,传统的基于语言的方法在处理结构化数据时遇到了瓶颈。英伟达推出了一种新的DNA基础模型JEPA-DNA,它通过引入隐空间预测目标来补充传统掩码语言建模(MLM)方法的不足。这种新架构不仅保留了原有的文本生成能力,还能够更好地理解基因序列的功能意义,为生物研究提供了更有效的工具。与传统的基于字符重建的方法不同,JEPA-DNA监督模型在隐空间中的全局序列嵌入,预测被掩码基因片段的功能表示而非逐字的字符组成。这种方法证明了预测架构可以在不牺牲生成能力的情况下产生更适合生物学任务的数据结构。
