MXFP4research
Coming Soon

Garbage in garbage out Don’t waste my GPU

Throughput
模型吞吐量优化
面向大规模模型服务场景,提升单位时间内的推理吞吐与资源利用率
Edge Inference
边缘设备推理
在算力受限的边缘端实现低延迟、低功耗的神经网络推理部署
Architecture
神经网络架构
探索高效网络结构设计,在参数量与表达能力之间寻求最优平衡
In development