主页 - VnYzm的博客(第1页)


昇腾310P使用记录


课题组最近的项目需要用到华为的昇腾计算卡,和CUDA汗牛充栋的教程和文档相比,作为一款比较新的计算卡产品,昇腾在网上基本没什么教程,可以参考的只有官方文档、官方代码仓库和官方论坛。因此我在使用的过程中,也经过了很多探索...

2024年10月1日

Xilinx_HLS使用记录


最近做一个FPGA加速项目,不想写HDL,所以又选择了HLS。之前的文章《Ultra96V2开发板简单使用》中介绍了如何用HLS写IP核并且在Ultra96V2开发板上通过Pynq环境跑起来,但是我现在用的是OpenSSD开发板...

2024年6月30日

Faiss和Rapidsai_Raft使用记录


最近在做基于图的近似向量检索的实验,需要用到Faiss库和Rapids系列的Raft库,同时由于要统计一些算法内部的数据,因此不能直接使用它们预编译的Python库,而要手动从源码编译并通过C++调用...

2024年5月8日

Windows上使用VTune分析PyTorchExtension调用的Cpp程序


最近在实现一个通过PyTorch Extension扩展PyTorch算子的C++算法,需要分析代码的运行瓶颈进行针对性优化。Intel VTune就是一个能从汇编级和源码级分析CPU运行瓶颈的工具。由于不明原因我没在服务器上跑通命令行版的VTune...

2024年1月1日

SpinalHDL上板过程记录


最近帮老师做一个硬件项目,使用SpinalHDL实现。实际用起来还是觉得这玩意不错,它能够抽象到“生成Verilog代码”这一层面,通过程序简化生成的逻辑,可以减少很多直接用Verilog需要编写的重复代码...

2023年11月25日

自定义CUDA实现PyTorch算子的四种简单方法


在探索新的深度学习算法的时候,我们可能会遇到PyTorch提供的算子不能满足需求的情况,这时候就需要自定义PyTorch算子,将我们的算法集成到PyTorch的工作流中。同时,为了提高运算效率...

2023年9月2日

SSH实现多跳代理


我们实验室有两台服务器,其中一台无法从外网访问,另一台设置了内网穿透。我平常在无法从外网访问的那台服务器上做实验,所以如果在实验室外要连接那台服务器就需要将设置了内网穿透的服务器作为跳板,通过两次ssh登进实验服务器...

2023年4月13日

flv重封装H264、AAC流


学校有一个网课系统,该系统的客户端是使用Silver light(一个.NET相关的技术框架,类似Flash)实现的,不支持跨平台。我对它的代码进行了分析,发现它会从服务器中接收H264格式的视频裸流和AAC格式的音频裸流...

2023年3月30日

CSP模板


CSP考试所用材料,包含宏定义、常用算法、简捷Vim配置等...

2023年2月27日

markdown测试


测试一下本博客(准确来说是Pandoc)的Markdown支持...

2022年2月25日

关于我


前偏远小渔村边缘OIer,HUST计院普通大学生,现在是ICT搬砖工。

Github Gitee上也有同名账户,同步大部分项目。

我的博客园 也是我的博客,有过去的一些文章以及细致的文章分类。

联系方式:eXpteXptOTlAb3V0bG9vay5jb20=