AI 与智能体 第8页
Dify 入门与本地部署:认识平台并在 Linux 上跑起来-AI运维探索者

Dify 入门与本地部署:认识平台并在 Linux 上跑起来

一、Dify 到底是什么 Dify 是一个面向大语言模型应用的开源开发平台,它的目标是让开发者、产品经理甚至业务同学,都能通过可视化方式快速搭建 AI 应用、智能体和 API。 它的几个核心价值可以概...
LLaMA-Factory 微调 Qwen3-4B 实战:环境准备与数据配置-AI运维探索者

LLaMA-Factory 微调 Qwen3-4B 实战:环境准备与数据配置

一、先明确整体思路 这套流程的目标是:在 AutoDL 云服务器上安装 `LLaMA-Factory`,然后对 `Qwen3-4B` 做微调。 二、环境准备 2.1 购买云主机 笔记里建议使用 AutoDL,选择 3090 显卡即可。如...
开源大模型私有化部署思路与阿里云 PAI 快速部署-AI运维探索者

开源大模型私有化部署思路与阿里云 PAI 快速部署

- 一、开源模型一般去哪里找 * Hugging Face:`https://huggingface.co/models` * 魔塔社区:`https://modelscope.cn/models` 一、部署前先把思路定下来 1.1 先确定目标模型 例如以 `QWQ-32B` ...
Dify+k8s运维智能体:部署MCP并创建Kubernetes Agent-AI运维探索者

Dify+k8s运维智能体:部署MCP并创建Kubernetes Agent

一、部署python版本的mcp 项目地址:https://pypi.org/project/mcpkubernetesserver 该项目已经纳入pip的仓库了,可以直接使用pip install安装,非常方便。 该mcp提供了非常多的工具 1.1 命令行...
开源版 Coze 私有部署实战:用 Docker 跑起 Coze Studio-AI运维探索者

开源版 Coze 私有部署实战:用 Docker 跑起 Coze Studio

一、先准备机器 一个入门级实验环境就够了: * CPU:2C * 内存:4G * 磁盘:40G * 系统:Ubuntu 22.04 如果你只是做实验,使用云上的抢占式实例会更省钱,用完及时销毁即可。 二、安装 Docker ...
大模型压测入门:核心指标与常见压测工具-AI运维探索者

大模型压测入门:核心指标与常见压测工具

一、大模型压测为什么特别重要 相比传统 API,大模型服务的性能不只是“请求快不快”,还涉及: * 首个 Token 出来的速度; * 后续 Token 生成的节奏; * 并发下吞吐是否塌陷; * GPU 利用率是...
用AI生成PRD并落地开发:从需求文档到项目实现-AI运维探索者

用AI生成PRD并落地开发:从需求文档到项目实现

一、先让 AI 生成需求文档 这是最推荐的起点,因为它能把你脑子里的模糊想法先整理成结构化文档。 1.1 企业官网 PRD 示例 例如可以直接给出这样的需求: 1.2 AI 原生应用 PRD 示例 如果你要做一...
OpenClaw接入飞书:应用创建、Channel配置与测试-AI运维探索者

OpenClaw接入飞书:应用创建、Channel配置与测试

一、在飞书开放平台创建企业自建应用 访问https://open.feishu.cn/app?lang=zhCN,点击“创建企业自建应用” 定义“应用名称”、“应用描述” 添加机器人 权限管理 另外还需要开启“contact:con...
RAGFlow 入门:它的特点、适用场景,以及和 FastGPT 的区别-AI运维探索者

RAGFlow 入门:它的特点、适用场景,以及和 FastGPT 的区别

一、RAGFlow 是什么 RAGFlow 是一个基于深度文档理解的开源 RAG 引擎,目标是为企业提供更高质量的知识检索与问答能力。 官网: `https://ragflow.io/` GitHub: `https://github.com/infiniflo...
大模型私有化部署硬件选型策略与企业案例-AI运维探索者

大模型私有化部署硬件选型策略与企业案例

- 一、先按需求驱动做决策 - 1.1 数据安全与合规性优先 适用场景 * 金融、医疗、政府等需要遵守数据安全与个人信息保护要求的行业。 * 涉及国家机密,或者跨境数据传输受限的企业。 硬件选型要...