AI 与智能体 第7页
大模型与Ollama初体验-AI运维探索者

大模型与Ollama初体验

一、Ollama介绍与特性 1.1 什么是Ollama Ollama是一个轻量级、易于使用的大模型管理和部署工具,主要用于简化大模型的运行和交互。并且为开发者和用户提供了快速加载、管理和调用多种主流大模型...
开源大模型私有化部署思路与阿里云 PAI 快速部署-AI运维探索者

开源大模型私有化部署思路与阿里云 PAI 快速部署

- 一、开源模型一般去哪里找 * Hugging Face:`https://huggingface.co/models` * 魔塔社区:`https://modelscope.cn/models` 一、部署前先把思路定下来 1.1 先确定目标模型 例如以 `QWQ-32B` ...
Ollama 私有化部署实战:云主机、模型运行与 OpenWebUI-AI运维探索者

Ollama 私有化部署实战:云主机、模型运行与 OpenWebUI

一、先准备云主机 1.1 AutoDL AutoDL 官网: `https://autodl.com/home` 它的优势通常是便宜、按量付费、适合做实验,但因为是容器化虚拟机,性能体验可能略差一些。 1.2 阿里云 / 腾讯云 GPU ...
OpenClaw接入企业微信:内网穿透、通道配置与使用-AI运维探索者

OpenClaw接入企业微信:内网穿透、通道配置与使用

一、OpenClaw 接入企业微信的整体流程 说明:企业微信回调需要访问OpenClaw的公网IP,我们是私有部署,只能做内网穿透,这里使用FPR实现。 如果你使用带公网的云主机部署,这一节可以跳过。 二...
Dify+Zabbix MCP:监控平台智能体落地-AI运维探索者

Dify+Zabbix MCP:监控平台智能体落地

一、部署zabbix环境 准备两台机器分别部署zabbixserver和zabbixagent,其中机器和版本信息:Zabbix 6.0、Rocky9、数据库使用MariaDB、Web环境使用PHP+Apache 1.1 准备工作(两台都执行) 关闭Se...
大模型量化入门:GPTQ、AWQ 和 Qwen3-1.7B 实操-AI运维探索者

大模型量化入门:GPTQ、AWQ 和 Qwen3-1.7B 实操

一、为什么量化很重要 量化的本质是把模型从更高精度的数据格式压缩到更低精度,例如: * FP16 -> INT8 * FP16 -> INT4 这样做带来的主要收益有: * 模型体积更小; * 显存占用更低; * ...
Claude Code 与 Codex:命令行 AI 编程助手实战-AI运维探索者

Claude Code 与 Codex:命令行 AI 编程助手实战

一、Claude Code 是什么 Claude Code 是 Anthropic 推出的终端原生 AI 编程助手,核心特点是: 直接运行在命令行里; 更适合复杂任务、多步骤修改和大型代码库理解; 能把自然语言指令转成实际...
OpenClaw Skills入门:为什么需要Skills、怎么自定义、如何用ClawHub-AI运维探索者

OpenClaw Skills入门:为什么需要Skills、怎么自定义、如何用ClawHub

一、OpenClaw Skills 是什么 OpenClaw Skills,本质上是给Agent配的“专项能力包”。 它不是模型本身,而是让模型在特定任务里“按固定方法做事“的一层标准化机制。 二、为什么需要 Skills 很多...
大模型私有化部署前,如何估算硬件配置-AI运维探索者

大模型私有化部署前,如何估算硬件配置

- 一、硬件核心配置逻辑 - 1.1 GPU 选型原则 * 显存容量:每 10 亿参数(1B)大约需要 1-2GB 显存,例如 70B 模型通常需要 80GB 级别显存,常见推荐是 A100 或 H100。 * 计算能力:优先选择 FP1...
OpenClaw接入钉钉:应用创建、通道配置与通信测试-AI运维探索者

OpenClaw接入钉钉:应用创建、通道配置与通信测试

一、在钉钉开发者平台创建应用 1、创建企业内部应用 访问钉钉开发者后台(https://opendev.dingtalk.com/),选择“钉钉应用”,点击“创建应用” 定义应用名称、应用描述 2、添加「机器人」能...