少女祈祷中...
雨落Droplogue

雨落Droplogue

Windows上玩转本地大模型:AI Max 395 + Ollama 从零到精通

Windows上玩转本地大模型:AI Max 395 + Ollama 从零到精通

AMD Ryzen AI Max 395凭借96GB统一内存架构,成为本地部署大模型的绝对性能怪兽。但如何在Windows环境下通过Ollama最大化压榨这96GB共享显存,实现多模型并行加载与推理隔离?本文将深入解析BIOS显存分配阈值设置、Ollama多实例端口映射技巧、不同精度量化的显存占用配比,以及长上下文模型的内存优化策略。无论你是想同时跑DeepSeek-R1-32B+Llama-3.3-70B做对比测试,还是搭建支持多用户并发的本地知识库服务,这份96GB显存并行部署指南都能让你的AI Max 395发挥出媲美A100的本地AI集群性能。

MoE架构深度解析:AMD平台PyTorch模型微调实战

MoE架构深度解析:AMD平台PyTorch模型微调实战

随着MoE(混合专家)架构成为大模型主流,如何在消费级硬件上微调这些千亿参数模型成为开发者关注的焦点。AMD AI Max+ 395平台凭借128GB统一内存(最高可分配96GB作为显存)的独特优势,成为本地运行和微调MoE模型的理想选择。本文将详细介绍从PyCharm安装到MoE模型微调的完整流程。

DevOps炼成记:后端工程师 MySQL 生存指南

DevOps炼成记:后端工程师 MySQL 生存指南

后端工程师必备的 MySQL 指令大全:从 DDL/DML 到事务隔离、索引优化、主从复制,涵盖 5.7/8.0 版本差异与 DevOps 实战技巧,助你掌握数据库高可用架构与性能调优。面试总被问 MySQL 优化?生产环境慢查询搞不定?这篇生存指南覆盖 200+ 条核心指令、窗口函数、JSON 存储与锁机制,让后端工程师轻松应对高并发场景与数据库运维挑战。

LLM原理深度解析:从Transformer到智能涌现

LLM原理深度解析:从Transformer到智能涌现

2022年末,ChatGPT的发布标志着人工智能进入了一个新时代。这个能写诗、编代码、解数学题的AI,其背后的大语言模型(LLM)展现出了惊人的"智能涌现"现象——当模型参数突破某个阈值,能力突然跃迁,仿佛拥有了推理与创造的火花。本文将深入Transformer的数学本质,解析从注意力机制到智能涌现的完整技术脉络,揭开LLM"思考"的物理基础。

不会VBA?用JavaScript玩转WPS自动化:15个实战场景全解析

不会VBA?用JavaScript玩转WPS自动化:15个实战场景全解析

WPS JS宏怎么用?JavaScript如何替代VBA实现Excel自动化?这是无数办公族和数据分析师的痛点。本文提供15个即学即用的WPS JS宏实战案例,从零基础入门到企业级应用,手把手教你用JS代码批量处理Excel数据、自动生成图表、搭建进销存系统。