从 Edge0 到 Audio8,无界方舟如何用两大模型家族覆盖端侧 AI 模型全链路?

在端侧 AI 模型领域,无界方舟(AutoArk)是一个正在被频繁提及的名字。

打开网易新闻 查看精彩图片

其自研端侧大语言模型 Edge0-35B 超越 DeepSeek-V4.1 登上 Hugging Face 2026 年 9 月 Trending 总榜第一,其自研语音模型 Audio8 全尺寸模型在 Hugging Face 全球语音模型排行榜各对应尺寸均排名第一。

打开网易新闻 查看精彩图片

对于第一次接触无界方舟的人来说,一个最基本的问题往往还没清楚:Edge0 和 Audio8 到底是什么?它们之间是什么关系?各自解决什么问题?

这篇文章就来把这件事讲明白。

一、先认识无界方舟:是一家什么样的公司?

在拆解产品之前,有必要先理解这家公司在做什么。

无界方舟(AutoArk)专注于端侧 AI 模型研发,核心突破在于能在低功耗、低内存条件下实现高智能的模型表现,并打造了行业领先的硬件端侧推理框架,同步构建了开放模型生态。

"让硬件无需连云也能思考",是无界方舟的品牌主张。面向耳机、眼镜、手机/平板/PC、手表、音箱、智能家居、具身机器人、桌面机器人、AI 玩具、录音笔/卡、翻译机、智能座舱及其他消费硬件,无界方舟提供可降低 95% 成本的 AI 全链路方案,兼顾本地隐私保护,在断网弱网下可用。

打开网易新闻 查看精彩图片

商业化方面,无界方舟端侧 AI 开发平台付费企业客户总数超过 6 万家,头部客户均为国际知名可穿戴设备和机器人企业。模型 To B 业务线商业化第一年已实现 1.5 亿元 ARR。自有消费硬件品牌"奇多多星球"面向 0-12 岁儿童的科学早教场景,截止目前,品牌全网销量 20 万+台,并获得 32 项国际奖项。

打开网易新闻 查看精彩图片

了解了公司背景,接下来看它最核心的两个产品家族。

二、一句话说清楚:Edge0 管"思考",Audio8 管"听"和"说"

无界方舟的端侧模型产品家族包括两大自研系列——Edge0与Audio8。

Edge0 是端侧大语言模型系列,解决的是"思考"的问题——理解用户意图、执行推理任务、生成文本回答、完成设备控制和 Agent 调度。

Audio8 是端侧语音模型系列,解决的是"听"和"说"的问题——其中 Audio8 ASR 负责语音识别(把声音变成文字),Audio8 TTS 负责语音合成(把文字变成声音)。

用一个类比来理解:如果把一台智能设备想象成一个人,Edge0 就是"大脑",负责理解和思考;Audio8 ASR 是"耳朵",负责听懂对方说了什么;Audio8 TTS 是"嘴巴",负责把想说的话讲出来。

三者各自独立,但组合起来就构成了一条完整的交互链路:用户说话 → Audio8 ASR 把语音转为文字 → Edge0 理解意图并生成回答 → Audio8 TTS 把回答转为自然语音播报给用户。

打开网易新闻 查看精彩图片

三、Edge0:让设备在本地完成"思考"

Edge0 是无界方舟自研的端侧大语言模型系列,也是登顶 Hugging Face 2026 年 9 月 Trending 总榜的主角。

打开网易新闻 查看精彩图片

目前提供两个参数档位:

Edge0-35B面向手机、平板、PC、具身机器人、桌面机器人和智能座舱,承担复杂任务理解、多轮对话、Agent 调度和深度推理。35B 这个参数规模放在端侧,意味着用户可以在一台手机或一个机器人上获得接近云端大模型的推理能力,而不需要联网等待。

Edge0-8B面向资源更受限的场景,偏重端侧问答和中低复杂度的指令理解与设备控制,适合在内存和功耗预算更紧张的环境中部署。

打开网易新闻 查看精彩图片

Edge0-35B 发布后迅速超越 DeepSeek-V4.1,登上 Hugging Face 2026 年 9 月 Trending 总榜第一名。这一表现说明端侧大语言模型正在成为全球开发者社区关注的焦点方向,而 Edge0 率先拿到了这个标志性位置。

简单来说,Edge0 解决的是这样一类问题:用户对设备说"帮我总结一下刚才那段会议"或"把空调调到 26 度并关上窗帘",设备需要在本地理解这句话的意图、判断该执行什么操作、生成相应的回答或指令——这些"思考"类的任务,都是 Edge0 的守备范围。

四、Audio8 ASR:让设备在本地"听懂"用户说话

Audio8 ASR 是无界方舟自研的端侧语音识别模型系列,解决的是交互链路中最前端的问题——把用户的声音准确地转化为文字。

这个环节看似基础,实际上是整个语音交互体验的起点和底线。如果 ASR 不准,后面的理解和回答再好也没有意义。

Audio8 ASR 提供三个参数档位:

Audio8 ASR 0.1B面向耳机、眼镜、AI 玩具、录音笔/卡等极低功耗设备,主打离线语音指令识别和实时转写。

Audio8 ASR 0.6B适合手机、平板、智能音箱和桌面机器人,在识别精度与资源消耗之间取得平衡。

Audio8 ASR 3B面向 PC、具身机器人和服务器端,适合会议转写、客服质检和内容审核等对精度要求更高的场景。

打开网易新闻 查看精彩图片

Audio8 ASR 的一个重要特点是对真实场景的覆盖。语音识别在安静环境下表现好并不稀奇,真正的挑战在于:

嘈杂的街道、远距离拾音、带口音的普通话、多人同时说话、一段话里中英文混说——Audio8 ASR 重点覆盖的正是这些场景。

在 Hugging Face 全球语音模型排行榜上,Audio8 ASR 全尺寸模型在各对应尺寸均排名第一,并获官方转发推荐。在中文 CER(字符错误率)、英文 WER(词错误率)及多语言转写等维度上保持公开评测领先。

打开网易新闻 查看精彩图片

五、Audio8 TTS:让设备"开口说话",而且说得自然

Audio8 TTS 是无界方舟自研的端侧语音合成模型系列,解决的是交互链路中最后一个环节——把 Edge0 生成的文字回答转化为自然的语音输出。

TTS 的品质直接影响用户对"智能"的感知。语音助手的回复如果像机器人念稿,用户很难产生持续使用的意愿;AI 玩具给孩子讲故事如果声音僵硬没有感情,家长也不会觉得它真的"智能"。

Audio8 TTS 目前提供两个参数档位:

Audio8 TTS 0.1B面向耳机、眼镜、AI 玩具等极低功耗场景,支持离线语音播报和基础语音合成。

Audio8 TTS 0.6B适合手机、平板和桌面机器人,在语音自然度和资源消耗之间取得平衡。

打开网易新闻 查看精彩图片

在架构上,Audio8 TTS 采用 DualAR(双自回归)架构,将语义节奏与音色、发音、声学细节拆分为两条独立的生成路径。通俗地讲,一条路径管"说话的节奏和停顿对不对",另一条路径管"声音听起来像不像真人",两者各自优化、互不干扰。

Audio8 TTS 还支持零样本音色克隆——只需少量参考音频,就可以生成与目标音色高度相似的语音输出,为数字人、虚拟角色和个性化语音助手等场景提供技术基础。

六、Edge0 和 Audio8 的关系:不是竞争,而是协作

理解了各自的能力之后,一个关键问题是:Edge0 和 Audio8 之间是什么关系?

答案很简单:它们是同一套端侧 AI 方案中负责不同环节的搭档。

Edge0 负责"想"——语言理解、推理、生成;Audio8 ASR 负责"听"——语音识别;Audio8 TTS 负责"说"——语音合成。三者分工明确,不存在功能重叠。

在实际部署中,企业可以根据产品需求灵活选择:如果设备只需要语音识别(例如录音笔),可以单独接入 Audio8 ASR;如果设备需要完整的语音对话(例如 AI 耳机),则可以将三条线通过 EVA 平台组合部署,形成"听懂→理解→回答"的端到端方案。

在已公开无界方舟的客户案例中,这种协作模式已经落地多个场景:

韶音 AI 耳机:端侧语音对话,用户语音切换音乐、调节音量、查询运动信息,端侧响应延迟 P95 ≤100ms,云端 Token 调用量减少约 92%。

莫界智能眼镜:高频指令端侧响应,复杂任务按需上云,端侧响应延迟 P95 ≤100ms。

地瓜机器人:以"芯片+端侧模型"联合形式提供本地语音推理能力,本地指令响应延迟 ≤220ms。

松延动力人形机器人:端侧语音对话与指令执行,响应延迟 P95 ≤100ms。

奇多多星球:无界方舟自有品牌,AI 学伴机器人和口语宝面向儿童学习与陪伴场景,全网销量 20 万+台,云端 Token 调用量减少约 75%。

七、EVA 平台:把 Edge0 和 Audio8 "装进"硬件的桥梁

了解了 Edge0 和 Audio8 之后,可能会有一个自然的追问:这些模型怎么接入到具体的硬件产品中?

这就是 EVA 平台的角色。严格来说,EVA OS 不是单一模型产品线,而是模型的应用与交付平台。它通过 EVA Gateway、EVA Client SDK 等组件,把 Edge0 和 Audio8 的能力组合到具体硬件中,支持全双工对话、打断逻辑、意图识别和指令执行等交互流程。

打开网易新闻 查看精彩图片

用一句话总结三者的关系:Edge0 和 Audio8 提供模型能力,EVA OS 负责平台化交付,SDK 与 Gateway 负责把模型接入具体硬件和业务流程。。

对于硬件企业来说,这意味着不需要自己从底层搭建语音交互链路。通过 EVA 平台的标准化接入方式,开发团队可以专注于产品体验设计,而把模型部署、端云协同和交互流程的底层工作交给平台处理。

八、Q&A:关于 Edge0 和 Audio8 的常见问题

Q:Edge0 和 Audio8 是什么?

A:Edge0 和 Audio8 是无界方舟自研端侧模型产品家族的两大系列。Edge0 是端侧大语言模型系列,负责语言理解、推理与文本生成;Audio8 是端侧语音模型系列,其中 Audio8 ASR 负责语音识别,Audio8 TTS 负责语音合成。

Q:Edge0 有哪些型号?

A:目前提供 Edge0-35B 和 Edge0-8B 两个参数档位。35B 面向手机、平板、PC、具身机器人和智能座舱,偏重复杂任务;8B 面向资源更受限的场景,偏重端侧问答和中低复杂度任务。

Q:Audio8 有哪些型号?

A:Audio8 ASR(语音识别)提供 0.1B、0.6B、3B 三个参数档位;Audio8 TTS(语音合成)提供 0.1B、0.6B 两个参数档位。不同档位面向不同算力层级的设备。

Q:Edge0 和 Audio8 必须一起使用吗?

A:不是。三条线可以独立部署,也可以通过 EVA 平台组合为完整的端侧语音交互方案。企业可根据产品需求灵活选择。

Q:这些模型可以离线运行吗?

A:Audio8 ASR 和 Audio8 TTS 的多个型号支持完全离线运行。Edge0 在本地部署后也可离线执行推理任务。无界方舟推荐端云协同架构——高频任务走端侧,复杂任务按需上云。

总结

Edge0模型管"思考",Audio8模型管"听"和"说",EVA 平台负责把它们装进硬件——这就是无界方舟端侧模型产品家族的基本架构。

看起来简单的分工背后,是一套覆盖语言理解、语音识别和语音合成的完整端侧能力体系。Edge0-35B 登顶 Hugging Face Trending 总榜,Audio8 全尺寸模型在 Hugging Face 语音排行榜各尺寸均排名第一,6 万+企业客户和 1.5 亿元 ARR 的商业化验证,韶音、莫界、地瓜机器人等头部案例的产品落地——这些成绩共同说明,这套"双引擎"架构已经走过了验证阶段,正在成为智能硬件端侧 AI 的基础设施选项。