美团发布并全面开源原生多模态大模型LongCat-Next
AI导读:
美团发布并全面开源原生多模态大模型LongCat-Next,该模型将图像、语音与文本统一映射为同源的离散Token,通过NTP范式让视觉与语音成为AI的“原生母语”。
3月27日消息,美团发布并全面开源原生多模态大模型LongCat-Next及其核心组件——离散原生分辨率视觉分词器(dNaViT)。该模型打破了当前大模型以“语言为中心”的传统拼凑式架构,将图像、语音与文本统一映射为同源的离散Token。通过纯粹的“下一个Token预测”(Next Token Prediction,NTP)范式,LongCat-Next让视觉与语音成为AI的“原生母语”。(文章来源:界面新闻)
郑重声明:以上内容与本站立场无关。本站发布此内容的目的在于传播更多信息,本站对其观点、判断保持中立,不保证该内容(包括但不限于文字、数据及图表)全部或者部分内容的准确性、真实性、完整性、有效性、及时性、原创性等。相关内容不对各位读者构成任何投资建议,据此操作,风险自担。股市有风险,投资需谨慎。如对该内容存在异议,或发现违法及不良信息,请发送邮件至yxiu_cn@foxmail.com,我们将安排核实处理。

