暂无搜索历史
本文档为 MysticMirror 自研大模型的全覆盖自动化回归测试套件,整合原有 22 项基础回归测试与 20 项新增边界能力测试,共计 42 个测试用例。全...
前文《基于 LlamaIndex+PostgreSQL 实现 RAG 持久化》已完成向量数据库持久化部署,并封装了 RAGService 基础检索服务,解决了 ...
传统LangChain是LLM应用的组件工具箱,以Chain与Runnable为核心抽象,提供提示词模板、文档处理、向量检索、工具调用、记忆能力等标准化组件,目...
大模型的网络文件是模型训练的核心参考。例如 MiniMind 项目中 /model/model_minimind.py 这份网络结构文件,它用来定义整套大模型的...
前文《基于 LlamaIndex 实现 RAG 向量检索入门》已完成本地大模型与 Embedding 向量检索的基础搭建,但仅支持临时向量存储,无法持久化复用。...
本章将通过多个案例实现私有数据集检索功能,虽然 LangChain 也可以实现向量检索,但在企业级项目中,通常会选用 LlamaIndex 这类专门面向检索场景...
在大模型二次开发学习阶段,手写训练代码可以帮助我们吃透模型微调底层逻辑,做到知其然更知其所以然。但落地到企业生产环境,我们更追求标准化流程、高复用能力与稳定可靠...
在大模型开发流程中,分词器(Tokenizers)是文本预处理的核心组件。神经网络无法直接理解人类的原始文本,分词器的核心作用,就是将自然语言转换为模型可用于计...
企业内部私有环境部署大模型推理集群时,很容易遇到流量调度混乱、节点负载失衡、会话上下文丢失、接口缺少鉴权防护等一系列问题,单 vLLM 推理节点难以支撑并发请求...
LLaMA Factory 是一款开源、低代码、一站式大语言与多模态模型微调框架,用于降低大模型的微调落地门槛。框架兼容 Qwen、LLaMA、ChatGLM、...
大模型微调是实现模型领域定制的核心方案,本文承接《千问大模型二次 LoRA‑SFT 指令微调指南》部分内容,聚焦 Qwen3.5‑Base 纯文本基座全参数微调...
大模型微调是实现模型领域定制的核心方案。本文基于 Ubuntu 22.04 服务器环境,依托 NVIDIA RTX 家用高性能显卡,选用千问 Qwen3.5‑0...
本文将教大家在Ubuntu系统中,从零完成Ollama本地大模型部署与Open-WebUI可视化网页配置,全程采用虚拟环境隔离依赖、配置系统自启服务,最终搭建可...
3.在 settings 中的 INSTALLED_APPS 添加 'rest_framework'
Nginx 是一款轻量级、高性能、高并发的开源Web服务器、反向代理与负载均衡软件,凭借低资源占用、高稳定性的核心优势,成为当下互联网行业主流的服务部署组件,广...
Apache 是全球使用排名第一的 Web 服务器软件,具备极强的跨平台兼容性,可运行在几乎所有主流计算机平台,凭借出色的稳定性、安全性与高性能,成为目前最流行...
本文基于 Ubuntu 22.04 服务器环境,依托 NVIDIA RTX 家用高性能显卡,手把手讲解 MiniMind 轻量大语言模型从零搭建、数据集部署、全...
本文基于 Ubuntu 26.04 系统、纯CPU无CUDA硬件环境,完整演示基于 llama.cpp 实现 HF 原始模型转换 GGUF 格式与CPU量化的落...
LangChain 是目前大模型应用开发领域最主流、最成熟的开源框架之一,广泛应用于私有化部署、智能体开发、工具调用、流式交互等各类场景。本文基于 LangCh...
本文以通义千问Qwen量化GGUF模型为案例,基于Llama.cpp框架展示本地大模型调用与功能开发的完整实现原理及流程。全文采用原生Python编写代码案例,...