玄戒O100原型机现场体验的核心看点,并不是又一款折叠屏手机提前亮相,而是端侧大模型在移动形态设备上的一次工程验证。公开信息显示,这台原型机采用玄戒O3与玄戒O100双芯协同,内置Xiaomi MiMo端侧模型,在不依赖云端计算的演示环境中完成文本生成;机身则取消常规影像模块,重新设计主板,并加入主动风冷系统。
简而言之,它证明了高速度本地推理可以在接近移动设备的体积内运行,但还不能据此认定相关芯片已经具备普通手机所需的功耗、续航、静音和量产条件。
现场究竟体验到了什么
小米在2026年8月24日举行的玄戒芯片技术沟通会上展示了这台设备。其外形接近横向展开的折叠终端,屏幕能够运行常规系统和专门的测试界面。现场演示主要围绕端侧文本模型展开,即提示词输入、模型计算和答案输出均在设备本地完成。
小米公开的数据为端侧推理速度实测每秒295 Tokens。部分现场媒体在各自体验中观察到约每秒300 Tokens或更高的瞬时读数,首个内容开始出现的等待时间约为半秒。不同数字可能受到提示词长度、采样设置、模型状态和统计口径影响,因此更稳妥的理解是:样机呈现了较高的持续文本生成速度,而非已经形成可直接横向比较的统一跑分。

为什么背部装了风扇,还取消了摄像头
这两项改动揭示了原型机的真正用途:优先验证算力,而不是兼顾完整手机体验。公开介绍显示,样机最高支持约10瓦的主动散热能力。风扇和独立风道能更快带走芯片持续运行产生的热量,使设备在短时间演示中保持较稳定的输出。
影像模块通常会占据机身内部相当可观的空间,尤其是潜望结构、多摄系统和防抖组件。取消摄像头后,工程团队可以腾出空间容纳新增芯片、供电与散热结构。主板推翻重制也说明O100并非简单外挂在现有量产手机上,而是需要围绕双芯通信、内存访问、供电和热管理重新布局。
因此,看到类似折叠屏的外形,并不等于某款零售新品已经定型。关注折叠设备的读者,也可延伸阅读新三折叠产品目前已经确认的信息,注意区分正式官宣产品与技术验证机。
每秒295 Tokens意味着什么
Token是模型处理文本时使用的基本单位,并不与汉字或单词严格一一对应。每秒生成数量较高,意味着模型在开始回答后可以快速铺开内容,用户感受到的等待和逐字输出过程会明显缩短。
不过,速度不是端侧AI体验的全部。实际使用至少还要同时观察以下方面:
- 首响应时间:按下发送后多久出现第一段有效内容。
- 持续速度:长回答过程中是否明显降速,机身升温后能否保持。
- 答案质量:高速输出是否仍能正确理解指令,减少事实错误和重复内容。
- 能耗与续航:完成一次摘要、翻译或生成任务消耗多少电量。
- 隐私边界:断网可运行不等于所有功能都默认离线,还要看应用权限和数据处理说明。

端侧运行的价值不只是“秒回”
模型放在本地运行,可以减少网络波动造成的等待,在地铁、地下空间或网络受限场景中仍有机会完成摘要、翻译、录音整理等任务。敏感数据若不离开设备,也能缩小传输环节的暴露范围。但是否真正保护隐私,仍取决于产品有没有联网回传、云端补算和日志上传机制,不能只凭一次离线演示判断。
专用AI加速芯片的应用也不局限于手机。汽车、机器人和家庭终端都可能需要低延迟的本地感知与决策。相关场景可参考智能作业机器人落地需要考察的关键指标:算力只是基础,稳定性、安全机制和实际任务完成率同样重要。
距离量产产品还有哪些关要过
- 把散热做得更轻、更安静。开放式工程结构和主动风扇适合展示性能,却会带来厚度、噪声、防尘与可靠性问题。
- 控制整机功耗。实验台上的高性能释放不等于日常可持续使用,量产设备必须在速度、温度和电池容量之间取舍。
- 验证复杂任务。文本生成只是一个维度,还需考察长上下文、多模态输入、工具调用以及高负载下的稳定性。
- 建立软件生态。应用能否调用芯片能力、模型能否升级、不同任务如何分配给O3和O100,都会影响最终体验。
- 接受独立测试。统一模型、提示词、功耗和温度条件下的第三方测试,才能帮助消费者进行有效比较。
普通用户现在应该如何看待
这次展示最有价值的信息,是双芯协同和高速端侧推理已经从芯片参数走到可操作的硬件原型阶段。它回答了“能不能跑起来”的问题,却尚未完整回答“能否装进轻薄设备长期运行”“续航损失多大”以及“何时形成量产产品”。
面对后续体验视频,可以重点核对是否断网、使用什么模型、首响应与持续速度是否分开统计、测试持续多久,以及设备是否依赖外接供电或特殊散热。只有这些条件同时透明,所谓“快”才具有可比较的意义。
本文依据截至2026年8月26日可查的公开展示信息整理。工程原型机用于技术验证,其外观、配置、性能和商业化安排均不应直接视为量产产品承诺。
版权声明:本文由“热词说”本站编辑原创撰写,未经许可请勿转载。撰写日期:2026年8月26日。






