| 应用篇 |
| 1-Chatbot-与-Prompt |
| 第一次对话-01.txt应用篇/1-Chatbot-与-Prompt/第一次对话-01.txt | plain text | 1.6 KB | 下载 |
| 第一次对话-02.ts应用篇/1-Chatbot-与-Prompt/第一次对话-02.ts | typescript | 81 B | 下载 |
| 第一次对话-03.ts应用篇/1-Chatbot-与-Prompt/第一次对话-03.ts | typescript | 83 B | 下载 |
| 第一次对话-04.ts应用篇/1-Chatbot-与-Prompt/第一次对话-04.ts | typescript | 135 B | 下载 |
| 一个更好的问题-05.md应用篇/1-Chatbot-与-Prompt/一个更好的问题-05.md | markdown | 2.1 KB | 下载 |
| 一个更好的问题-06.ts应用篇/1-Chatbot-与-Prompt/一个更好的问题-06.ts | typescript | 465 B | 下载 |
| 一个更好的问题-07.ts应用篇/1-Chatbot-与-Prompt/一个更好的问题-07.ts | typescript | 462 B | 下载 |
| Prompt-B-注意力分析-08.ts应用篇/1-Chatbot-与-Prompt/Prompt-B-注意力分析-08.ts | typescript | 696 B | 下载 |
| 多次发送同一个问题-09.txt应用篇/1-Chatbot-与-Prompt/多次发送同一个问题-09.txt | plain text | 47 B | 下载 |
| 调整Temperature参数,观察模型输出-10.py应用篇/1-Chatbot-与-Prompt/调整Temperature参数,观察模型输出-10.py | python | 677 B | 下载 |
| 2-AI-效果与评测 |
| 执行评测-01.txt应用篇/2-AI-效果与评测/执行评测-01.txt | plain text | 316 B | 下载 |
| gpt-4o-mini-02.txt应用篇/2-AI-效果与评测/gpt-4o-mini-02.txt | plain text | 132 B | 下载 |
| DeepSeek-V3-非联网版-03.txt应用篇/2-AI-效果与评测/DeepSeek-V3-非联网版-03.txt | plain text | 198 B | 下载 |
| 以这个AI新闻摘要任务为例,输入数据-04.txt应用篇/2-AI-效果与评测/以这个AI新闻摘要任务为例,输入数据-04.txt | plain text | 284 B | 下载 |
| 我们可以人为设计一个预期输出-05.txt应用篇/2-AI-效果与评测/我们可以人为设计一个预期输出-05.txt | plain text | 123 B | 下载 |
| 计算评测指标的代码-06.py应用篇/2-AI-效果与评测/计算评测指标的代码-06.py | python | 1.7 KB | 下载 |
| 使用AI评测提示词-07.js应用篇/2-AI-效果与评测/使用AI评测提示词-07.js | javascript | 658 B | 下载 |
| 使用AI评测提示词-08.txt应用篇/2-AI-效果与评测/使用AI评测提示词-08.txt | plain text | 622 B | 下载 |
| 一句话AI新闻摘要评测-09.txt应用篇/2-AI-效果与评测/一句话AI新闻摘要评测-09.txt | plain text | 688 B | 下载 |
| 可以用这个脚本下载数据集,存储到本地-10.py应用篇/2-AI-效果与评测/可以用这个脚本下载数据集,存储到本地-10.py | python | 1.2 KB | 下载 |
| 3-工作流与-AI-编排 |
| dify+deepseek-01.json应用篇/3-工作流与-AI-编排/dify+deepseek-01.json | json | 4.7 KB | 下载 |
| Coze+豆包Seed-02.json应用篇/3-工作流与-AI-编排/Coze+豆包Seed-02.json | json | 6.6 KB | 下载 |
| 使用代码实现工作流-03.py应用篇/3-工作流与-AI-编排/使用代码实现工作流-03.py | python | 6.2 KB | 下载 |
| 4-Function-Call与Tool-Call |
| 4-Function-Call与Tool-Call-01.txt应用篇/4-Function-Call与Tool-Call/4-Function-Call与Tool-Call-01.txt | plain text | 130 B | 下载 |
| 在工作流中调用工具-02.txt应用篇/4-Function-Call与Tool-Call/在工作流中调用工具-02.txt | plain text | 34 B | 下载 |
| 2-使用代码运行节点,配置类似-03.py应用篇/4-Function-Call与Tool-Call/2-使用代码运行节点,配置类似-03.py | python | 129 B | 下载 |
| 添加两个输入变量-04.json应用篇/4-Function-Call与Tool-Call/添加两个输入变量-04.json | json | 310 B | 下载 |
| 调整LLM节点的Prompt-05.txt应用篇/4-Function-Call与Tool-Call/调整LLM节点的Prompt-05.txt | plain text | 82 B | 下载 |
| 创建一个工具-06.json应用篇/4-Function-Call与Tool-Call/创建一个工具-06.json | json | 563 B | 下载 |
| 创建一个工具-07.txt应用篇/4-Function-Call与Tool-Call/创建一个工具-07.txt | | 417 B | 下载 |
| 使用OpenAI-API实现Function-Call-08.py应用篇/4-Function-Call与Tool-Call/使用OpenAI-API实现Function-Call-08.py | python | 8.0 KB | 下载 |
| 5-MCP协议与Agent智能体 |
| 使用高德地图MCP-Server-01.py应用篇/5-MCP协议与Agent智能体/使用高德地图MCP-Server-01.py | python | 63 B | 下载 |
| 回忆一下上一章的场景-02.txt应用篇/5-MCP协议与Agent智能体/回忆一下上一章的场景-02.txt | plain text | 129 B | 下载 |
| 实现股票分析工具集-03.py应用篇/5-MCP协议与Agent智能体/实现股票分析工具集-03.py | python | 955 B | 下载 |
| 实现股票分析工具集-04.py应用篇/5-MCP协议与Agent智能体/实现股票分析工具集-04.py | python | 5.0 KB | 下载 |
| 启动服务器-05.sh应用篇/5-MCP协议与Agent智能体/启动服务器-05.sh | bash | 29 B | 下载 |
| 输出结果-07.py应用篇/5-MCP协议与Agent智能体/输出结果-07.py | python | 150 B | 下载 |
| 使用manus编写科技金融资讯-08.txt应用篇/5-MCP协议与Agent智能体/使用manus编写科技金融资讯-08.txt | plain text | 208 B | 下载 |
| 1-列出计划,规划待执行的任务-09.txt应用篇/5-MCP协议与Agent智能体/1-列出计划,规划待执行的任务-09.txt | plain text | 266 B | 下载 |
| 使用manus编写科技金融资讯-10.txt应用篇/5-MCP协议与Agent智能体/使用manus编写科技金融资讯-10.txt | plain text | 377 B | 下载 |
| 使用manus编写科技金融资讯-11.txt应用篇/5-MCP协议与Agent智能体/使用manus编写科技金融资讯-11.txt | plain text | 616 B | 下载 |
| 5-撰写新闻资讯文章-12.txt应用篇/5-MCP协议与Agent智能体/5-撰写新闻资讯文章-12.txt | plain text | 117 B | 下载 |
| 1-补充内容指令,例如-13.txt应用篇/5-MCP协议与Agent智能体/1-补充内容指令,例如-13.txt | plain text | 34 B | 下载 |
| Manus的做法是重新执行了下述步骤-14.txt应用篇/5-MCP协议与Agent智能体/Manus的做法是重新执行了下述步骤-14.txt | plain text | 133 B | 下载 |
| RIPER阶段划分如下-15.txt应用篇/5-MCP协议与Agent智能体/RIPER阶段划分如下-15.txt | plain text | 668 B | 下载 |
| 完整的RIPER-5-Rule-16.txt应用篇/5-MCP协议与Agent智能体/完整的RIPER-5-Rule-16.txt | plain text | 3.7 KB | 下载 |
| stocktoolsserver.py应用篇/5-MCP协议与Agent智能体/stocktoolsserver.py | python | 920 B | 下载 |
| 6-多模态模型与AIGC |
| 在豆包或Chat-GPT中上传图片-01.txt应用篇/6-多模态模型与AIGC/在豆包或Chat-GPT中上传图片-01.txt | plain text | 258 B | 下载 |
| 在豆包或Chat-GPT中上传图片-02.md应用篇/6-多模态模型与AIGC/在豆包或Chat-GPT中上传图片-02.md | markdown | 6.6 KB | 下载 |
| 使用ChatGPT进行文生图-03.py应用篇/6-多模态模型与AIGC/使用ChatGPT进行文生图-03.py | python | 126 B | 下载 |
| 使用即梦进行文生图-04.py应用篇/6-多模态模型与AIGC/使用即梦进行文生图-04.py | python | 77 B | 下载 |
| 图生图-05.txt应用篇/6-多模态模型与AIGC/图生图-05.txt | plain text | 83 B | 下载 |
| 传统的模型翻译方法-06.txt应用篇/6-多模态模型与AIGC/传统的模型翻译方法-06.txt | plain text | 263 B | 下载 |
| GPT-Realtime-07.txt应用篇/6-多模态模型与AIGC/GPT-Realtime-07.txt | plain text | 261 B | 下载 |
| 例如这个Prompt-08.txt应用篇/6-多模态模型与AIGC/例如这个Prompt-08.txt | plain text | 215 B | 下载 |
| 视频提示词-09.txt应用篇/6-多模态模型与AIGC/视频提示词-09.txt | plain text | 1.3 KB | 下载 |
| 音频提示词-10.txt应用篇/6-多模态模型与AIGC/音频提示词-10.txt | plain text | 476 B | 下载 |
| 模型篇 |
| 2-模型部署-Ollama-vs-vLLM |
| 在云服务上使用vLLM部署模型-01.sh模型篇/2-模型部署-Ollama-vs-vLLM/在云服务上使用vLLM部署模型-01.sh | bash | 587 B | 下载 |
| 如果使用国内的云厂商,可能连接比较慢,可以指定pip镜像提供地址,例如腾讯云的地址-02.sh模型篇/2-模型部署-Ollama-vs-vLLM/如果使用国内的云厂商,可能连接比较慢,可以指定pip镜像提供地址,例如腾讯云的地址-02.sh | bash | 218 B | 下载 |
| 下载模型-03.sh模型篇/2-模型部署-Ollama-vs-vLLM/下载模型-03.sh | bash | 80 B | 下载 |
| 下载模型-04.sh模型篇/2-模型部署-Ollama-vs-vLLM/下载模型-04.sh | bash | 42 B | 下载 |
| 运行模型-05.txt模型篇/2-模型部署-Ollama-vs-vLLM/运行模型-05.txt | | 87 B | 下载 |
| 使用serve命令启动vLLM服务推荐-06.txt模型篇/2-模型部署-Ollama-vs-vLLM/使用serve命令启动vLLM服务推荐-06.txt | plain text | 353 B | 下载 |
| 可以使用命令重写拉起模型-07.sh模型篇/2-模型部署-Ollama-vs-vLLM/可以使用命令重写拉起模型-07.sh | bash | 90 B | 下载 |
| 或者使用多张卡-08.sh模型篇/2-模型部署-Ollama-vs-vLLM/或者使用多张卡-08.sh | bash | 64 B | 下载 |
| 启动后,可以另起一个窗口来访问模型-09.sh模型篇/2-模型部署-Ollama-vs-vLLM/启动后,可以另起一个窗口来访问模型-09.sh | bash | 281 B | 下载 |
| 测试Ollama部署模型的基础响应时间-10.sh模型篇/2-模型部署-Ollama-vs-vLLM/测试Ollama部署模型的基础响应时间-10.sh | bash | 243 B | 下载 |
| 使用Python脚本对Ollama部署的模型进行详细测试-11.py模型篇/2-模型部署-Ollama-vs-vLLM/使用Python脚本对Ollama部署的模型进行详细测试-11.py | python | 2.2 KB | 下载 |
| 需要暂停掉之前正在运行的模型-12.sh模型篇/2-模型部署-Ollama-vs-vLLM/需要暂停掉之前正在运行的模型-12.sh | bash | 197 B | 下载 |
| 运行benchmark测试-13.py模型篇/2-模型部署-Ollama-vs-vLLM/运行benchmark测试-13.py | python | 2.5 KB | 下载 |
| 3-SFT微调实战 |
| 测试基座模型-01.py模型篇/3-SFT微调实战/测试基座模型-01.py | python | 1.2 KB | 下载 |
| 启动微调任务-02.py模型篇/3-SFT微调实战/启动微调任务-02.py | python | 1.6 KB | 下载 |
| 保存评测数据-03.py模型篇/3-SFT微调实战/保存评测数据-03.py | python | 242 B | 下载 |
| 方案二-调整后的配置方案-04.py模型篇/3-SFT微调实战/方案二-调整后的配置方案-04.py | python | 332 B | 下载 |
| 1-环境准备-05.py模型篇/3-SFT微调实战/1-环境准备-05.py | python | 586 B | 下载 |
| 下载模型-06.json模型篇/3-SFT微调实战/下载模型-06.json | json | 84 B | 下载 |
| 下载模型-07.py模型篇/3-SFT微调实战/下载模型-07.py | python | 1.2 KB | 下载 |
| 执行命令-09.sh模型篇/3-SFT微调实战/执行命令-09.sh | bash | 44 B | 下载 |
| 运行命令-11.sh模型篇/3-SFT微调实战/运行命令-11.sh | bash | 47 B | 下载 |
| validation_sft-运行命令-13.sh模型篇/3-SFT微调实战/validation_sft-运行命令-13.sh | bash | 122 B | 下载 |
| 全参微调资源开销较大,需要调整配置-15.yaml模型篇/3-SFT微调实战/全参微调资源开销较大,需要调整配置-15.yaml | yaml | 1.6 KB | 下载 |
| 运行训练-16.sh模型篇/3-SFT微调实战/运行训练-16.sh | bash | 47 B | 下载 |
| 使用LLaMA-Factory-框架进行全参数微调Full-FT-18.py模型篇/3-SFT微调实战/使用LLaMA-Factory-框架进行全参数微调Full-FT-18.py | python | 2.0 KB | 下载 |
| 模型导出和优化-19.py模型篇/3-SFT微调实战/模型导出和优化-19.py | python | 1.1 KB | 下载 |
| 执行导出-20.py模型篇/3-SFT微调实战/执行导出-20.py | python | 812 B | 下载 |
| 保存量化模型-21.py模型篇/3-SFT微调实战/保存量化模型-21.py | python | 2.8 KB | 下载 |
| 在命令行中拉起服务-22.py模型篇/3-SFT微调实战/在命令行中拉起服务-22.py | python | 62 B | 下载 |
| 在另一个窗口调用服务-23.py模型篇/3-SFT微调实战/在另一个窗口调用服务-23.py | python | 127 B | 下载 |
| confquicktest.yaml模型篇/3-SFT微调实战/confquicktest.yaml | yaml | 1.3 KB | 下载 |
| confsftqwenfull.yaml模型篇/3-SFT微调实战/confsftqwenfull.yaml | bash | 570 B | 下载 |
| confsftqwenlora.yaml模型篇/3-SFT微调实战/confsftqwenlora.yaml | python | 1.7 KB | 下载 |
| eval.json模型篇/3-SFT微调实战/eval.json | yaml | 3.5 KB | 下载 |
| validationsft.py模型篇/3-SFT微调实战/validationsft.py | bash | 161 B | 下载 |
| 训练 / 数据文件 |
| dataset_info.json模型篇/3-SFT微调实战/files/dataset_info.json | json | 810 B | 下载 |
| eval.json模型篇/3-SFT微调实战/files/eval.json | json | 254 KB | 下载 |
| qwen_base_evaluation_results.csv模型篇/3-SFT微调实战/files/qwen_base_evaluation_results.csv | csv | 19.7 KB | 下载 |
| sst2_small_evaluation_results_ep-20250910165054-fsn68_job-20250910154559_global_step_3.xlsx模型篇/3-SFT微调实战/files/sst2_small_evaluation_results_ep-20250910165054-fsn68_job-20250910154559_global_step_3.xlsx | xlsx | 24.2 KB | 下载 |
| sst2_small_evaluation_results_ep-20250910212745-r7mz8_job-20250910203325_global_step_2.xlsx模型篇/3-SFT微调实战/files/sst2_small_evaluation_results_ep-20250910212745-r7mz8_job-20250910203325_global_step_2.xlsx | xlsx | 24.1 KB | 下载 |
| sst2_small_evaluation.xlsx模型篇/3-SFT微调实战/files/sst2_small_evaluation.xlsx | xlsx | 17.5 KB | 下载 |
| sst2_small_train_volcano.jsonl模型篇/3-SFT微调实战/files/sst2_small_train_volcano.jsonl | jsonl | 241 KB | 下载 |
| sst2_test_volcano.xlsx模型篇/3-SFT微调实战/files/sst2_test_volcano.xlsx | xlsx | 72.7 KB | 下载 |
| sst2_test.csv模型篇/3-SFT微调实战/files/sst2_test.csv | csv | 192 KB | 下载 |
| sst2_train.csv模型篇/3-SFT微调实战/files/sst2_train.csv | csv | 3.7 MB | 下载 |
| sst2_validation.csv模型篇/3-SFT微调实战/files/sst2_validation.csv | csv | 93.6 KB | 下载 |
| sst2_volcano_converted_results.xlsx模型篇/3-SFT微调实战/files/sst2_volcano_converted_results.xlsx | xlsx | 98.4 KB | 下载 |
| train_small.json模型篇/3-SFT微调实战/files/train_small.json | json | 240 KB | 下载 |
| train.json模型篇/3-SFT微调实战/files/train.json | json | 15.8 MB | 下载 |
| 4-从零开始训练模型 |
| 收集和处理预训练数据-01.py模型篇/4-从零开始训练模型/收集和处理预训练数据-01.py | python | 8.3 KB | 下载 |
| 输出目录结构-02.md模型篇/4-从零开始训练模型/输出目录结构-02.md | markdown | 107 B | 下载 |
| torchdatasetloader-02.py模型篇/4-从零开始训练模型/torchdatasetloader-02.py | bash | 193 B | 下载 |
| 词汇表关键指标-03.sh模型篇/4-从零开始训练模型/词汇表关键指标-03.sh | bash | 74 B | 下载 |
| torchdatasetloader-03.py模型篇/4-从零开始训练模型/torchdatasetloader-03.py | python | 5.8 KB | 下载 |
| 训练集、验证集和测试集-04.json模型篇/4-从零开始训练模型/训练集、验证集和测试集-04.json | json | 487 B | 下载 |
| 运行脚本-06.sh模型篇/4-从零开始训练模型/运行脚本-06.sh | bash | 181 B | 下载 |
| 这里是一个计算语料长度分布的脚本-07.py模型篇/4-从零开始训练模型/这里是一个计算语料长度分布的脚本-07.py | python | 5.3 KB | 下载 |
| Padding-estimate-over-candidates-08.sh模型篇/4-从零开始训练模型/Padding-estimate-over-candidates-08.sh | bash | 274 B | 下载 |
| Padding-estimate-over-candidates-09.py模型篇/4-从零开始训练模型/Padding-estimate-over-candidates-09.py | python | 9.1 KB | 下载 |
| 运行脚本-10.sh模型篇/4-从零开始训练模型/运行脚本-10.sh | bash | 258 B | 下载 |
| 运行命令-12.sh模型篇/4-从零开始训练模型/运行命令-12.sh | bash | 218 B | 下载 |
| 执行脚本-14.sh模型篇/4-从零开始训练模型/执行脚本-14.sh | bash | 187 B | 下载 |
| 运行脚本-17.sh模型篇/4-从零开始训练模型/运行脚本-17.sh | bash | 327 B | 下载 |
| 训练脚本-19.py模型篇/4-从零开始训练模型/训练脚本-19.py | python | 6.4 KB | 下载 |
| 使用单卡训练-20.sh模型篇/4-从零开始训练模型/使用单卡训练-20.sh | bash | 342 B | 下载 |
| 效果评估脚本-22.py模型篇/4-从零开始训练模型/效果评估脚本-22.py | python | 37.8 KB | 下载 |
| 运行评估-23.sh模型篇/4-从零开始训练模型/运行评估-23.sh | bash | 383 B | 下载 |
| 运行评估-25.py模型篇/4-从零开始训练模型/运行评估-25.py | python | 20.8 KB | 下载 |
| eval_bert_sentiment-运行命令-26.sh模型篇/4-从零开始训练模型/eval_bert_sentiment-运行命令-26.sh | bash | 278 B | 下载 |
| 保存报告-27.py模型篇/4-从零开始训练模型/保存报告-27.py | python | 341 B | 下载 |
| 保存报告-28.py模型篇/4-从零开始训练模型/保存报告-28.py | python | 748 B | 下载 |
| 保存报告-29.py模型篇/4-从零开始训练模型/保存报告-29.py | python | 808 B | 下载 |
| 保存报告-30.sql模型篇/4-从零开始训练模型/保存报告-30.sql | sql | 613 B | 下载 |
| 5-开始训练循环-31.py模型篇/4-从零开始训练模型/5-开始训练循环-31.py | python | 1.0 KB | 下载 |
| 6-清理-在分布式模式下销毁进程组-32.py模型篇/4-从零开始训练模型/6-清理-在分布式模式下销毁进程组-32.py | python | 58 B | 下载 |
| 调整训练参数-33.sh模型篇/4-从零开始训练模型/调整训练参数-33.sh | bash | 488 B | 下载 |
| 导出模型,进行微调-34.py模型篇/4-从零开始训练模型/导出模型,进行微调-34.py | python | 19.4 KB | 下载 |
| 清理分布式训练-35.sh模型篇/4-从零开始训练模型/清理分布式训练-35.sh | bash | 411 B | 下载 |
| 清理分布式训练-36.json模型篇/4-从零开始训练模型/清理分布式训练-36.json | json | 615 B | 下载 |
| evaluatepretrainedbert.py模型篇/4-从零开始训练模型/evaluatepretrainedbert.py | bash | 876 B | 下载 |
| packjsonltoshards.py模型篇/4-从零开始训练模型/packjsonltoshards.py | python | 5.3 KB | 下载 |
| torchdatasetloader.py模型篇/4-从零开始训练模型/torchdatasetloader.py | python | 7.1 KB | 下载 |
| trainminibert.py模型篇/4-从零开始训练模型/trainminibert.py | bash | 488 B | 下载 |
| trainwordpiecetokenizer.py模型篇/4-从零开始训练模型/trainwordpiecetokenizer.py | bash | 7.5 KB | 下载 |
| validation.jsonl模型篇/4-从零开始训练模型/validation.jsonl | bash | 248 B | 下载 |
| 训练 / 数据文件 |
| tokenizer.zip模型篇/4-从零开始训练模型/files/tokenizer.zip | zip | 286 KB | 下载 |
| validation.jsonl模型篇/4-从零开始训练模型/files/validation.jsonl | jsonl | 2.8 MB | 下载 |
| 开发者篇 |
| 1-RAG-与上下文管理 |
| 使用这个Prompt进行提问-01.txt开发者篇/1-RAG-与上下文管理/使用这个Prompt进行提问-01.txt | plain text | 46 B | 下载 |
| 方式二-使用问答对Q&A-提升召回效果-02.py开发者篇/1-RAG-与上下文管理/方式二-使用问答对Q&A-提升召回效果-02.py | python | 436 B | 下载 |
| 方式二-使用问答对Q&A-提升召回效果-03.txt开发者篇/1-RAG-与上下文管理/方式二-使用问答对Q&A-提升召回效果-03.txt | plain text | 189 B | 下载 |
| 方式二-使用问答对Q&A-提升召回效果-04.txt开发者篇/1-RAG-与上下文管理/方式二-使用问答对Q&A-提升召回效果-04.txt | | 140 B | 下载 |
| 实现一个简单的智能客服Agent-06.txt开发者篇/1-RAG-与上下文管理/实现一个简单的智能客服Agent-06.txt | plain text | 854 B | 下载 |
| rerankservice.py开发者篇/1-RAG-与上下文管理/rerankservice.py | python | 6.2 KB | 下载 |
| 2-MCP+PostgreSQL数据库实战 |
| 安装uv环境-01.sh开发者篇/2-MCP+PostgreSQL数据库实战/安装uv环境-01.sh | bash | 91 B | 下载 |
| 编写一个最简单的mcp-server-02.py开发者篇/2-MCP+PostgreSQL数据库实战/编写一个最简单的mcp-server-02.py | python | 259 B | 下载 |
| 使用装饰器,标识某一个方法是tool方法-03.py开发者篇/2-MCP+PostgreSQL数据库实战/使用装饰器,标识某一个方法是tool方法-03.py | python | 25 B | 下载 |
| 使用装饰器,标识某一个方法是tool方法-04.json开发者篇/2-MCP+PostgreSQL数据库实战/使用装饰器,标识某一个方法是tool方法-04.json | json | 492 B | 下载 |
| 调用成功的响应-05.json开发者篇/2-MCP+PostgreSQL数据库实战/调用成功的响应-05.json | json | 225 B | 下载 |
| 调用失败的响应-06.json开发者篇/2-MCP+PostgreSQL数据库实战/调用失败的响应-06.json | json | 304 B | 下载 |
| 客户端发送initialize请求-07.json开发者篇/2-MCP+PostgreSQL数据库实战/客户端发送initialize请求-07.json | json | 749 B | 下载 |
| 服务端Response-08.json开发者篇/2-MCP+PostgreSQL数据库实战/服务端Response-08.json | json | 845 B | 下载 |
| 使用装饰器,标识某一个方法是tool方法-09.ts开发者篇/2-MCP+PostgreSQL数据库实战/使用装饰器,标识某一个方法是tool方法-09.ts | typescript | 64 B | 下载 |
| 客户端发送的Request-10.json开发者篇/2-MCP+PostgreSQL数据库实战/客户端发送的Request-10.json | json | 117 B | 下载 |
| Response-11.json开发者篇/2-MCP+PostgreSQL数据库实战/Response-11.json | json | 1.1 KB | 下载 |
| 客户端发出Request-12.json开发者篇/2-MCP+PostgreSQL数据库实战/客户端发出Request-12.json | json | 232 B | 下载 |
| 服务端Response-13.json开发者篇/2-MCP+PostgreSQL数据库实战/服务端Response-13.json | json | 269 B | 下载 |
| 支持网络传输-14.json开发者篇/2-MCP+PostgreSQL数据库实战/支持网络传输-14.json | json | 224 B | 下载 |
| 使用-Streamable-HTTP-进行传输-15.py开发者篇/2-MCP+PostgreSQL数据库实战/使用-Streamable-HTTP-进行传输-15.py | python | 689 B | 下载 |
| Start-the-streamable-HTTP-server-16.py开发者篇/2-MCP+PostgreSQL数据库实战/Start-the-streamable-HTTP-server-16.py | python | 60 B | 下载 |
| Start-the-streamable-HTTP-server-17.sh开发者篇/2-MCP+PostgreSQL数据库实战/Start-the-streamable-HTTP-server-17.sh | bash | 515 B | 下载 |
| MCP-SSE初始化消息-18.proto开发者篇/2-MCP+PostgreSQL数据库实战/MCP-SSE初始化消息-18.proto | protobuf | 293 B | 下载 |
| 添加MCP方法,连接数据库-19.sh开发者篇/2-MCP+PostgreSQL数据库实战/添加MCP方法,连接数据库-19.sh | bash | 25 B | 下载 |
| 添加MCP方法,连接数据库-20.sh开发者篇/2-MCP+PostgreSQL数据库实战/添加MCP方法,连接数据库-20.sh | bash | 349 B | 下载 |
| 数据库连接配置-21.py开发者篇/2-MCP+PostgreSQL数据库实战/数据库连接配置-21.py | python | 1.2 KB | 下载 |
| 数据库连接配置-22.py开发者篇/2-MCP+PostgreSQL数据库实战/数据库连接配置-22.py | python | 964 B | 下载 |
| 启动服务器-24.sh开发者篇/2-MCP+PostgreSQL数据库实战/启动服务器-24.sh | bash | 167 B | 下载 |
| dbserver.py开发者篇/2-MCP+PostgreSQL数据库实战/dbserver.py | python | 3.4 KB | 下载 |
| 3-数据工程与评测工程 |
| 使用Label-Studio进行数据标注-01.sh开发者篇/3-数据工程与评测工程/使用Label-Studio进行数据标注-01.sh | bash | 81 B | 下载 |
| 安装Label-Studio-02.xml开发者篇/3-数据工程与评测工程/安装Label-Studio-02.xml | xml | 205 B | 下载 |
| 调整图片标注配置模板,改为-03.xml开发者篇/3-数据工程与评测工程/调整图片标注配置模板,改为-03.xml | xml | 329 B | 下载 |
| 使用Langfuse进行结果评测-04.sh开发者篇/3-数据工程与评测工程/使用Langfuse进行结果评测-04.sh | bash | 163 B | 下载 |
| 使用Langfuse进行RFHL的示例-05.py开发者篇/3-数据工程与评测工程/使用Langfuse进行RFHL的示例-05.py | python | 1.5 KB | 下载 |
| 使用Bradley-Terry模型-06.py开发者篇/3-数据工程与评测工程/使用Bradley-Terry模型-06.py | python | 503 B | 下载 |
| 4-FastAPI-封装模型服务 |
| 搭建FastAPI服务框架-01.sh开发者篇/4-FastAPI-封装模型服务/搭建FastAPI服务框架-01.sh | bash | 60 B | 下载 |
| 创建基础服务-02.py开发者篇/4-FastAPI-封装模型服务/创建基础服务-02.py | python | 1.9 KB | 下载 |
| 模拟文本处理逻辑-03.sh开发者篇/4-FastAPI-封装模型服务/模拟文本处理逻辑-03.sh | bash | 112 B | 下载 |
| 或者使用uvicorn命令-04.sh开发者篇/4-FastAPI-封装模型服务/或者使用uvicorn命令-04.sh | bash | 223 B | 下载 |
| 测试文本处理-05.json开发者篇/4-FastAPI-封装模型服务/测试文本处理-05.json | json | 95 B | 下载 |
| 封装LLM模型-06.sh开发者篇/4-FastAPI-封装模型服务/封装LLM模型-06.sh | bash | 42 B | 下载 |
| 模型服务实现-07.py开发者篇/4-FastAPI-封装模型服务/模型服务实现-07.py | python | 6.3 KB | 下载 |
| 1-单文本分析测试-08.sh开发者篇/4-FastAPI-封装模型服务/1-单文本分析测试-08.sh | bash | 166 B | 下载 |
| 模型信息端点-09.json开发者篇/4-FastAPI-封装模型服务/模型信息端点-09.json | json | 206 B | 下载 |
| 批量分析测试-10.sh开发者篇/4-FastAPI-封装模型服务/批量分析测试-10.sh | bash | 204 B | 下载 |
| 模型信息端点-11.json开发者篇/4-FastAPI-封装模型服务/模型信息端点-11.json | json | 567 B | 下载 |
| 实现流式响应和完整监控-12.py开发者篇/4-FastAPI-封装模型服务/实现流式响应和完整监控-12.py | python | 9.7 KB | 下载 |
| 1-流式响应测试-13.sh开发者篇/4-FastAPI-封装模型服务/1-流式响应测试-13.sh | bash | 212 B | 下载 |
| 流式响应结果-14.txt开发者篇/4-FastAPI-封装模型服务/流式响应结果-14.txt | plain text | 5.6 KB | 下载 |
| 测试流式文本生成-15.txt开发者篇/4-FastAPI-封装模型服务/测试流式文本生成-15.txt | plain text | 337 B | 下载 |
| 其他文件 |
| 3-创建融合kernel-26.py开发者篇/3-创建融合kernel-26.py | python | 1.2 KB | 下载 |
| 标准注意力计算示例无缓存-15.sh开发者篇/标准注意力计算示例无缓存-15.sh | bash | 262 B | 下载 |
| 单机多卡配置一,张量并行-01.sh开发者篇/单机多卡配置一,张量并行-01.sh | bash | 165 B | 下载 |
| 动态批处理机制-19.py开发者篇/动态批处理机制-19.py | python | 1.1 KB | 下载 |
| 多机多卡配置-05.sh开发者篇/多机多卡配置-05.sh | bash | 142 B | 下载 |
| 工作节点3-192-168-1-103-08.py开发者篇/工作节点3-192-168-1-103-08.py | python | 816 B | 下载 |
| 工作节点启动命令-07.sh开发者篇/工作节点启动命令-07.sh | bash | 925 B | 下载 |
| 混合并行-4张GPU,2个流水线阶段,每个阶段2张GPU张量并行-04.txt开发者篇/混合并行-4张GPU,2个流水线阶段,每个阶段2张GPU张量并行-04.txt | plain text | 188 B | 下载 |
| 计算输出-22.sh开发者篇/计算输出-22.sh | bash | 126 B | 下载 |
| 计算输出-23.py开发者篇/计算输出-23.py | python | 1.1 KB | 下载 |
| 聚合结果-14.py开发者篇/聚合结果-14.py | python | 2.1 KB | 下载 |
| 量化-20.py开发者篇/量化-20.py | python | 996 B | 下载 |
| 每次都需要重新计算所有位置的K和V-16.py开发者篇/每次都需要重新计算所有位置的K和V-16.py | python | 421 B | 下载 |
| 如果worker崩溃,Ray会自动重启-11.py开发者篇/如果worker崩溃,Ray会自动重启-11.py | python | 2.2 KB | 下载 |
| 使用2张GPU进行张量并行推理-02.txt开发者篇/使用2张GPU进行张量并行推理-02.txt | plain text | 139 B | 下载 |
| 使用2张GPU进行张量并行推理-03.sh开发者篇/使用2张GPU进行张量并行推理-03.sh | bash | 285 B | 下载 |
| 使用融合的激活函数kernel-24.py开发者篇/使用融合的激活函数kernel-24.py | python | 559 B | 下载 |
| 算子优化-21.py开发者篇/算子优化-21.py | python | 1.5 KB | 下载 |
| 所有操作在一个CUDA-kernel中完成-25.py开发者篇/所有操作在一个CUDA-kernel中完成-25.py | python | 1.7 KB | 下载 |
| 通信开销优化-12.py开发者篇/通信开销优化-12.py | python | 961 B | 下载 |
| 在vLLM中管理KV-Cache-17.py开发者篇/在vLLM中管理KV-Cache-17.py | python | 981 B | 下载 |
| 只传输重要的梯度-13.py开发者篇/只传输重要的梯度-13.py | python | 1.5 KB | 下载 |
| 主节点启动命令-06.sh开发者篇/主节点启动命令-06.sh | bash | 386 B | 下载 |
| GPU资源的自动管理和容错-09.py开发者篇/GPU资源的自动管理和容错-09.py | python | 229 B | 下载 |
| vLLM使用分页内存管理KV-Cache-18.sh开发者篇/vLLM使用分页内存管理KV-Cache-18.sh | bash | 232 B | 下载 |
| worker的容错和恢复机制-10.py开发者篇/worker的容错和恢复机制-10.py | python | 263 B | 下载 |
| 基础理论篇 |
| 1-线性代数与embedding |
| 1-词嵌入-Embedding-01.txt基础理论篇/1-线性代数与embedding/1-词嵌入-Embedding-01.txt | | 64 B | 下载 |
| 2-Transformer与注意力机制 |
| 1-FNN-前馈神经网络-01.py基础理论篇/2-Transformer与注意力机制/1-FNN-前馈神经网络-01.py | python | 291 B | 下载 |
| 5-Softmax-02.py基础理论篇/2-Transformer与注意力机制/5-Softmax-02.py | python | 158 B | 下载 |
| for-i-in-P-i-0-03.py基础理论篇/2-Transformer与注意力机制/for-i-in-P-i-0-03.py | python | 269 B | 下载 |
| 3-扩散模型 |
| 我们可以把这些信息和概率画成一个图-01.txt基础理论篇/3-扩散模型/我们可以把这些信息和概率画成一个图-01.txt | plain text | 190 B | 下载 |
| 3-扩散模型训练的数学流程-02.txt基础理论篇/3-扩散模型/3-扩散模型训练的数学流程-02.txt | plain text | 146 B | 下载 |
| 3-扩散模型训练的数学流程-03.py基础理论篇/3-扩散模型/3-扩散模型训练的数学流程-03.py | python | 272 B | 下载 |
| U-Net的数学公式-04.txt基础理论篇/3-扩散模型/U-Net的数学公式-04.txt | plain text | 109 B | 下载 |
| U-Net架构-05.txt基础理论篇/3-扩散模型/U-Net架构-05.txt | plain text | 206 B | 下载 |
| 3-扩散模型训练的数学流程-06.txt基础理论篇/3-扩散模型/3-扩散模型训练的数学流程-06.txt | plain text | 247 B | 下载 |
| 3-扩散模型训练的数学流程-07.txt基础理论篇/3-扩散模型/3-扩散模型训练的数学流程-07.txt | plain text | 52 B | 下载 |
| 3-扩散模型训练的数学流程-08.txt基础理论篇/3-扩散模型/3-扩散模型训练的数学流程-08.txt | plain text | 76 B | 下载 |
| 4-扩散模型的推理过程-09.txt基础理论篇/3-扩散模型/4-扩散模型的推理过程-09.txt | plain text | 170 B | 下载 |
| DDPM代码示意-10.py基础理论篇/3-扩散模型/DDPM代码示意-10.py | python | 710 B | 下载 |
| 计算方差-11.py基础理论篇/3-扩散模型/计算方差-11.py | python | 149 B | 下载 |
| DDIM代码示意-12.py基础理论篇/3-扩散模型/DDIM代码示意-12.py | python | 734 B | 下载 |