AI技术汇总
模型量化
训练优化
梯度
神经网络
手搓llama.cpp / GGUF格式 / GGML / 什么是llama
达芬奇
ollama:是运行大模型的工具
llama是meta公司研发的大模型
qwen、deepseek、chatgpt、gemini、grok都是大模型
下载并且运行了ollama,使用ollama下载常规模型,使用pycharm调用模型
执行如下命令:!mkdir build%cd build!cmake .. -DGGML_CUDA=ON!cm…
NAVI1.点击“NAVI protocol”进入网站,网址为naviprotocol.io2.在网站上点击“…
整体流程 1. 安装CANN 2. 安装torch,torch_npu 3. 下载qwen3的权重,做好权重转…
为什么他们要换成 CMake? 既然你关注架构设计,这背后的原因主要有三点: 你可以现在尝试运行上面的 CMa…