中数国科集团
导航菜单
可重构数据流 AI 芯片 CAISA 430
第四代可重构数据流架构 AI 芯片,采用 12nm 制程工艺,峰值算力达 16 TOPS@INT8,原生支持 INT16 与 FP32 精度计算。芯片利用率经工信部认证高达 91.19%,以更低芯片资源实现同等性能,摆脱先进制程限制,实现国产自主可控。
可重构数据流12nm 制程16 TOPS91.19% 利用率国产化边缘 AI
产品概述
CAISA® 430 是全新推出的第四代可重构数据流架构 AI 芯片,采用 12nm 制程工艺,峰值算力达 16 TOPS@INT8,并原生支持 INT16 和 FP32 精度计算,兼顾边缘端与高性能 AI 推断应用场景。芯片基于 CAISA 4.0 数据流架构,彻底突破传统指令集架构的设计路径,芯片利用率高达 91.19%(经工信部中国电子技术标准化研究院 benchmark 测试认证),仅需 1/4 芯片资源即可实现同等性能,摆脱先进制程工艺限制,实现国产自主可控。
CAISA 430 AI 芯片
芯片架构
全新自研数据流架构 CAISA 4.0
全新自研数据流架构 CAISA 4.0
采用全新自研数据流架构 CAISA 4.0,打破冯诺依曼内存瓶颈,大幅降低人工智能算力成本,不跟随国际主流 GPU 厂商以指令集架构为基础的演进路径,实现 134 倍处理速度提升、4.1 倍性能提升和 12.1 倍芯片利用率提升。
数据驱动计算
数据流过硬件的同时完成计算,不需要指令级控制,消除指令执行时间的开销,数据传输和计算时间重叠,芯片始终执行有效计算而非等待数据。
分布式存储
嵌入在数据流路径中,前级结果从输入 buffer 读出、处理、写入输出 buffer 供下一级使用,无需写回单一中央存储,打破指令级数据依赖——计算在空间上是顺序的,但在时间上是并行的。
可重构能力
支持传统 CNN 和流行 Transformer 算法,提供数据结构管理配置、算子计算模式配置、算子计算顺序配置三个级别的配置,编译器为不同算法模型生成配置,既保留精确硬件控制的高效性,又具备支持所有算法的灵活性。
张量粒度的优化计算单元
计算单元的功能和数量根据算法需求创建,基于算法高度优化,粗粒度实现消除软件干预,进一步提升性能和效率。
核心能力
01
核心技术公式
实测性能由芯片理论峰值算力与芯片利用率共同决定。芯片理论峰值算力受制于制程工艺,而制程工艺已经无法实现算力的大幅提升,实测性能的突破口在于芯片底层架构,真正的使用性能决定最终算力性价比。
架构对比:数据流架构 vs 指令集架构
02
架构对比:数据流架构 vs 指令集架构
以一个卷积案例为例,指令集架构计算实现方式需经过 IF、ID、RD、MUL、WB、ADD、ACT、WB 等多次存取与写回操作,芯片利用率仅为 7~32%;而数据流架构计算实现方式无需指令集控制,数据流过硬件的同时直接完成计算,无需多次写回中央存储,芯片利用率达 65~95.4%。
CAISA 430 芯片规格
03
CAISA 430 芯片规格
12nm 制程,峰值算力 16 TOPS@INT8,支持 INT16 和 FP32;24 核 ARM Cortex-A55 CPU;最高 48GB LPDDR4x 内存,带宽 89.6GBps;64 路 1080p 视频解码、8 路编码;工作温度 -40℃~85℃。
基于 CAISA 430 的一体化算力解决方案
N430 系列边缘小站
N430 系列边缘小站
基于 CAISA 430 芯片,提供 4~16 TOPS 峰值算力,具备可重构数据流架构、一站式开发工具链、丰富 IO 接口及可扩展无线通讯等核心能力。产品采用高可靠工业级无风扇设计,一体式鳍片中框结构保障高效散热,在 -20℃ 至 60℃ 宽温范围内稳定运行,全封闭机身彻底消除积尘、噪音与故障风险,实现坚固免维护。
N430 系列边缘一体机
N430 系列边缘一体机
基于 CAISA 430 芯片,提供 16~48 TOPS 峰值算力,具备可重构数据流架构与一站式开发工具链,无需 x86 成本。产品集成机箱风扇确保边缘环境长时间稳定运行,内置 M.2 NVMe SSD 满足边缘高频数据访问需求,高带宽与大容量内存支持高并发与高效推理响应,1U 标准高度机箱紧凑节省空间,内置网络路由支持节点高速直连与边缘集群部署。
N460H 加速卡与视频分析服务器
N460H 加速卡与视频分析服务器
N460H 加速卡搭载 72 核 CAISA 引擎,提供 48 TOPS@INT8 峰值算力,算力效率高达 90%。支持 96 路 H.264/H.265 1080P@25fps 高清视频解码及分析、24 路高清视频编码,最大支持 144GB LPDDR4X 内存。兼容 TensorFlow、Caffe、PyTorch、ONNX、PaddlePaddle 等主流深度学习开发框架,适配 Intel、鲲鹏、海光处理器及主流服务器。基于 N460H 加速卡可进一步提供星空 N460H 系列视频分析服务器,支持中算力(16~128 路)与大算力(64~512 路)两档配置。
产品开发与部署
RainBuilder 工具链:一站式开发工具包
01
RainBuilder 工具链:一站式开发工具包
RainBuilder 工具链基于先进的 LLVM 后端框架、利用 MLIR 承载算法信息而设计的模块化可扩展结构,由模型解析器、离线编译器、在线运行三大核心模块组成。兼容 TensorFlow、Caffe、PyTorch、ONNX 等主流开发框架,支持 C++/Python API,用户只需简单两步操作即可完成算法移植;同时支持各类 CNN 算法模型和基于 Transformer 的 VFM 大模型。
RBStreamer 开发框架:低代码视觉流水线设计
02
RBStreamer 开发框架:低代码视觉流水线设计
RBStreamer 提供模块化流水线开发模式,将业务逻辑、IO、推理封装为独立节点,支持 GUI 可视化拖拽式开发,零代码连接节点即可自由组合,应用开发周期从传统模式缩短至几分钟到几小时。框架提供丰富的预封装组件(解码器、预处理器、YOLO、ResNet 等),实现即插即用,并支持 C++/Python API 无缝扩展复杂逻辑。
03
多种部署合作模式,精准匹配需求
针对全自主开发客户提供硬件平台与算法移植工具链;针对算法自研客户提供端到端视频 AI 应用开发支持;针对部分算法自研客户提供开放式算法生态与成熟软件平台即插即用。依托 400+ 验证算法、5000+ 落地案例规模验证,有效缩短移植周期并大幅降低项目风险。
04
全周期开发支持体系
鲲云提供全周期开发支持体系,从算法移植到应用落地全程护航。提供 RBAIDEV 开发套件,预装编译器、SDK 与多媒体开发套件,盒卡 API 统一,实现分钟级开发环境搭建。RBCC 编译引擎支持模型到二进制自动转换、量化工具自动生成与瓶颈分析工具。响应体系完备,包含社区论坛、问题单系统与硬件经理全程跟踪,专属护航服务提供芯片原厂直连支持与远程部署升级能力。
产品试用及使用指南
联系我们以获取产品试用链接及相关指南,如需试用其他产品,参见技术支持-产品试用
联系我们
7*24小时全时段服务
资深团队专属对接
全流程隐私保护