北京商报讯(记者 魏蔚)3月27日,美团发布并全面开源原生多模态大模型 LongCat-Next 及其核心组件——离散原生分辨率视觉分词器(dNaViT)。该模型打破了当前大模型以"语言为中心"的传统拼凑式架构,将图像、语音与文本统一映射为同源的离散 Token。通过纯粹的"下一个 Token 预测"范式,LongCat-Next 让视觉与语音成为 AI 的"原生母语"。
美团发布原生多模态大模型 LongCat-Nex
北京商报讯(记者 魏蔚)3月27日,美团发布并全面开源原生多模态大模型 LongCat-Next 及其核心组件——离散原生分辨率视觉分词器(dNaViT)。该模型打破了当前大模型以"语言为中心"的传统拼凑式架构,将图像、语音与文本统一映射为同源的离散 Token。通过纯粹的"下一个 Token 预测"范式,LongCat-Next 让视觉与语音成为 AI 的"原生母语"。
热门跟贴