端侧 AI 解决方案
玄铁处理器以强大的核调度能力,支持 RVV 1.0、VLEN 最高 4096-bit 的成熟 Vector IP,并提供定制化关键算子加速,兼容主流开源端侧模型——让端侧 AI 芯片零门槛接入、开箱即用、大模型算子性能大幅跃升。
Challenge
端侧推理的挑战
Agentic AI 时代,大模型推理正从云端走向端侧,将面临如下挑战。
01
NPU 调度更复杂
模型迭代加速、跨类别架构差异显著,对主控核的 NPU 调度能力与生态兼容性提出了更高要求。
02
自研 Vector 投入大、周期长
从单元设计到 NPU 接入验证,需要大量研发投入,集成周期漫长。
03
软件适配拉长量产周期
算子适配、量化调优、框架兼容等工作显著增加软件投入与产品上市时间。
Solution
三层能力协同,覆盖端侧推理全场景
玄铁端侧 AI 解决方案面向 NPU / AI SoC 设计厂商,以 AI 定制调度核 + Titan 高性能向量 IP + 算子底层优化与配套软件,覆盖端侧推理全场景。
0bit
VLEN 超宽矢量位宽
0.00×
Qwen3-1.7B TTFT 总耗时提升
0.0×
Qwen3-1.7B Softmax 耗时优化
0条
RVV 1.0 之上的玄铁 Vector 扩展指令
玄铁产品重点(Scalar 控制核 C908X/C920 · Vector 引擎)NPU 既有模块数据通路 / 存储
Benefits
开箱即用 · 把门槛降低
从调度协同到生态兼容,玄铁把端侧 AI 芯片的集成门槛降低。
硬件快速集成
支持调度核和运算单元的灵活拓扑结构,显著降低客户接入成本、缩短集成周期。
丰富的软件生态适配
可交付 177 个算子、软件工具支持裁剪。
多场景客户验证,路径可复制
已在边缘计算盒、AI PC、人形机器人等场景完成商用验证,方案成熟。
Use Cases
典型应用场景
从边缘计算盒到 AI PC,玄铁端侧 AI 方案适配多种具体任务。

把云端推理下沉到本地,在门店、园区等现场完成视频分析与实时决策。
省带宽 · 保隐私 · 降延迟

多模态感知 + 决策,同时运行视觉、语音与 LLM 决策模型。
功耗 / 体积受限下的高能效推理

高帧率 + 高精度的产线实时检测,替代传统通用加速方案难以承受的功耗与成本。
高帧率高精度 · 更优功耗成本比

大模型本地运行,敏感数据不出本机,无需订阅云端服务。
数据不出本机的合规需求 · 免订阅费
Featured Products
相关IP
玄铁方案已成功适配头部客户产品并实现规模量产,真实商用落地。贴合不同客户的差异化需求,按需选配。
AI 增强处理器
玄铁 C908X
效率调度 + Vector 能力,面向需要向量加速的端侧 AI 场景。
- 超宽 VLEN 最高 4096-bit,大模型算子性能大幅跃升
- RVV 1.0 + 66 条玄铁自研 Vector 扩展指令
- GIU 扩展支持用户自定义 DSA,适配灵活芯片拓扑
灵活配置,五维可裁剪
核心数量
1 / 2 / 3 / 4 核 · 多 Cluster
Vector 宽度
VLEN 512 / 1024 / 4096
执行资源
SFU / Reduction / CVT
存储系统
L1 / L2 / ITCM / DTCM
接口与系统
扩展接口 / Linux / 可靠性

