新手学电脑,请多多指教。
好奇宝宝在这个时代如何跟着 AI 学习
背景 最近在家里给 Broadwell 老机器(5代酷睿)+ 华硕 Z97 主板插上了一张 NVIDIA V100 32G 显卡。BIOS 给 PCIe RC 分配的 64-bit Prefetchable BAR…
为什么我们的 AI 不说人话?
最近尝试用 LLM 进行一些知识的学习,也会在博客记录一些学习的过程,但发现抛开代码后, LLM 的回答的用词有时候非常奇怪,甚至有些不符合人类的表达习惯。最近学习了一些 Transformer 原理后,对这个事情有了进一步认知,也写了个可视化小工具探索词表,并用它找到了词表里的近义词! 原理 我们以 DeepSeek v4 Flash 为例,来看看它的模型结构,其他 Transformer 模型的结构也大同小异: flowchart TB IN(["input_ids"])…
从 Qwen 3.8 谈谈模型量化与硬件支持
1. 前言 最近 Qwen 3.8 27B 火了起来,很容易在网上看到大家纷纷用 24G 显存的显卡或者统一内存的笔记本跑起来。我实测了一下 Coding 和 Debug 能力也确实有接近 Opus 4.6 的水准,而且配合 Speculative Decoding…
4 卡 RTX 4090 P2P 折腾记 —— 如何 Hack Rebar 和 Above 4G Decoding
背景 最近拿到了一台 4 卡 RTX 4090 的机器,但用的是一代至强可扩展(Skylake)+ 技嘉 C621-WD12 主板。我们直接把显卡装上虽然可以使用,但是缺少了 P2P 功能对 LLM 推理跑 TP 不友好,因此我进行了一番折腾。 由于 PCIe…
AI 时代,知识与工程师价值如何定义
背景 最近因为 上一篇博客 被同事发现接触到了一些新的技术领域,同时这周也发生了一些有趣的事情,包括: 老朋友和我讨论上一篇博客的 AI 味(没错,也是第一篇基本靠 AI 写的博客) 跳脱出了技术圈子,跨界 meet 了一次数学出身的 startup 老板 龙芯杯比赛让往届选手录制一份十周年采访视频,回忆了很多,也思考了如果在有 Agent 的今天,我的决策的价值 这些事情突然让我重新思考,AI…
LLM 新人的压榨本地 DeepSeek V4 Flash 推理记
0. 背景 最近 DeepSeek-V4-Flash-0731 模型能力的提升令人瞩目,刚好自己有一台 AMD Strix Halo, 于是就想看看在这台统一内存的 APU 上能跑多快。因此,我跟着 Fable-5 学习了一些 LLM 的基础知识,让 AI 帮我进行了一些优化实验,最终把 batch-1…
模拟 USB HID 修好了无限重启 (boot loop) 的 Android 手机 —— 如何在 2s 时间内快速打开 ADB
背景 m1luf0 在她的 OnePlus 12 上安装了 Island 创建隔离的 Work Profile,然后进行了一些 App 的 Clone 后 Destroy 再次重新创建,在创建过程中手机就自动重启,接着开机后,每次输入密码大概 2-4s 左右的时间又会自动重启(前3次只重启…
Opus 4.6 级别的 AI 真的可以取代程序员吗?
背景 因为自 Opus 4.6 以来的 AI 能力快速提升,使得自己效率得到了充分提高,便开启好几个 AI Agent 同时进行各种各样的 Project(曾经梦想着毕业后带一个团队来干很多心里认为有趣的idea,结果在 AI 时代提前低成本实现了),有自己论文的完善,也有新论文的实现以及探索,还有一些大工程性质的玩具。然而,我很快发现,如果当前 AI 的上下文能力或者记忆能力不能在现在的 Baseline 上指数级提升,对复杂的任务依然只有加速能力而非完全的取代能力。 曾经在电视上看到过脑部受伤,海马体受损无法产生新记忆的人(如“笔记本男孩”…
裸 die 芯片散热请务必使用相变硅脂
背景 自己在京东上买的磐镭YO-1 AMD Strix Halo 小主机在短短半年的时间内经历了2次高温死机问题的售后。而在上个月跑一些自己的研究代码测性能期间,我发现了严重的单核降频问题(5.1GHz Turbo 跑出来只有 4.6GHz),最终定位到问题在于,原厂普通硅脂的pump-out effect(蹦出效应)导致的问题。 经过 2025.6.6 购入小主机 2025.6.18 经历第一次高负载死机,京东换新 2025.10.8 经历第二次高负载死机,京东换新 后面几个月持续安稳…