我在飞机上用 AI 写代码,竟然和地面上一样丝滑 上个月飞上海,飞机上没网。换平时我打开 VS Code 就只能写纯文本,但那天我完整地写了一整个 Spring Boot 接口——包括代码、JUnit 测试、JavaDoc——全程离线。AI 补全每一下都响应,比有网的时候还快。 靠的是这三件套:Ollama(本地大模型)+ OpenCode(AI 编程终端)+ VS Code 插件。总成本 $0(不算硬件),不用连网,不烧 API 额度,不担心隐私泄露。 这篇文章不是"怎么做"的百科,是我从踩坑到跑通的真实过程。如果你有一台 16G+ 内存的电脑,照着走一遍,2 小时能搞定。 这篇是 本地部署大模型实战:Ollama + Open WebUI 的进阶篇。如果你还不会装 Ollama,先看那篇。 先看硬件:你的电脑能不能跑 配置 能跑的模型 补全体验 16G 内存 + 集成显卡 Qwen2.5 7B (CPU) 2-5 tok/s,够用但慢 16G 内存 + 8G 显存 Qwen2.5-Coder 7B (GPU) 15-25 tok/s,流畅 32G 内存 + 12G 显存 Qwen2.... Ollama + OpenCode + VS Code 打造完全免费离线的 AI 代码补全方案 ai
我们工作室买了台 4090 服务器,结果变成了"插队抢号"现场 事情是这样的。我和三个朋友合伙做外包,年初凑钱买了一台 4090 工作站,装了 OpenCode + Ollama + 几个商业 API Key。本意是大家一起用,结果是灾难现场: A 同事忘了关调试模式,一晚上烧了 $30 的 API 额度 B 同事把自己的 API Key 写进代码里,传到 GitHub 上,10 分钟后收到 Anthropic 的封号邮件 C 同事同时开了 12 个并发请求,把 Ollama 的 24G 显存直接撑爆 (实测)三周后,我们蹲在服务器前把所有问题捋清楚,搭了一套完整的权限体系。从那以后零事故。这篇文章就是那次重构的记录。 这篇是 本地部署大模型实战 的进阶篇——单机你用得很顺了,下一步就是给团队用。如果你还没搭好单机,先看那篇。 核心问题:团队共享 API 有三个雷区 雷区 典型场景 后果 Key 泄露 同事把 Key 写进代码,推 GitHub 封号 + 余额被盗刷 额度被滥用 调试时忘记切换环境,疯狂调用 一晚烧 $30-100 资源抢占 多人并发抢 GPU,模型 OOM 谁的请求都.... OpenCode 局域网内给团队共享 API Key 权限设置教程:4090 服务器搭建实录 ai
我在本地部署 OpenCode 知识库时踩的向量数据库大坑 先交代背景:我日常开发用的是 OpenCode(开源 AI 编程智能体,MIT 协议),它支持接入本地知识库(RAG)。我的需求很简单——把我积累的几百份技术文档、项目规范、踩坑记录导入 OpenCode,让它在写代码时自动参考这些内部资料。 (实测)装 OpenCode 本体花了 10 分钟,配知识库花了 4 个小时。 为什么?因为中间有三道坎:向量数据库选型、嵌入模型配置、文档导入格式。每一步都能报一堆错,每一步的报错信息都像是另一个维度的语言。 这篇文章把我踩的坑全列出来,每个问题附修复方法。 先搞清:OpenCode 本地知识库的完整链路 在修任何报错之前,要理解数据是怎么流转的: 你的文档(MD/TXT/PDF) ↓ 切片(Chunking) 若干个小文本块(每个 500-1000 字符) ↓ 嵌入(Embedding) 每个文本块 → 一个向量(一串浮点数) ↓ 存储(Vector DB) 向量 + 原文存入向量数据库 ↓ 查询(Retrieval) 用户提问 → 相似度搜索 → 返回最相关的文本块 → 喂给大模型.... OpenCode 本地知识库导入失败怎么解决?5 个向量数据库报错逐个修复 ai
我花 3 天画的 Figma 原型,Claude 用 5 分钟解决了 上周有个朋友,产品经理,拿 Figma 画一个 SaaS 后台的仪表盘原型,画了三天。我让他用 Claude Artifacts 试一下,同样的需求,Claude 用 5 分钟给他生成了一份能点、能动、能拖拽的交互页面。 他看完后第一反应是:“卧槽,那我学 Figma 干嘛?” 不是 Figma 没用,而是大部分产品原型不需要像素级设计。你需要的是一个能直观展示交互逻辑、能给别人演示的东西。这正是 Claude Artifacts 最擅长的。 这是 2026 AI 编程工具与大模型终极指南 的 Cluster 文章。如果你还不会用 Artifacts,可以先看 Claude Artifacts 导出网页代码报错怎么修复 了解怎么把生成的东西下载到本地跑。 先搞懂一个概念:Artifacts 不是"设计工具",是"交互生成器" 很多人把 Artifacts 当成"AI 版 Figma"用,直接描述长相,结果是生成出来像个图,但点不动。 正确用法:用自然语言同时描述"长什么样"和"点哪里会发生什么"。Claude 会直接.... Claude Artifacts 一键生成动效可交互原型图:产品经理的 AI 原型实战指南 ai
Artifacts 导出的页面在本地跑不起来?你不是一个人 上周有个读者私信我:“哥,Claude Artifacts 生成的登录页面在网页版里看着好好的,下载下来直接用浏览器打开,一片空白。” 他连试了三个页面:一个登录页、一个数据看板、一个 Markdown 预览器。三个全翻车。他把代码发给我,我一看——不是代码写错了,是 Artifacts 导出的文件结构和依赖方式和本地完全不一样。 这个问题几乎所有用 Artifacts 的人都会遇到,但网上居然没有一篇正经的修复指南。下面是我的排查和修复方案,针对 5 个最常见报错。 先搞清楚:Artifacts 的代码为什么在本地跑不起来 Claude Artifacts 运行在一个内置的沙盒环境里,这个环境有几个特点: 特性 Artifacts 环境 本地浏览器 后果 React/Vue CDN 自动注入 不注入 JS 框架找不到 CSS 预处理器 Tailwind 自动注入 不注入 样式全丢了 外部 API 调用 通过代理 直接请求 CORS 报错 Node.js 依赖 内置 没有 npm 包找不到 (来源:Anthropic 官方 A.... Claude Artifacts 导出为独立网页代码报错怎么修复?5 个问题逐个根治 ai
你用 Claude 读长论文时的小白困境 我表妹是中文系研究生,上周在微信上问我:“哥,Claude 网页版怎么老是提示’输入过长’啊?我就贴了一篇 2 万字的论文而已。” 我听完差点笑出声——2 万字对 Claude 来说相当于把一本《活着》全塞进去。网页版 Claude 的输入限制大概在 4000-8000 字符左右(取决于版本和时段),超出就弹红框。 但这不是"Claude 不好用",而是你没找到分段的方法。这篇文章专门写给非技术背景的用户(文科生、学生、文字工作者),不需要写代码,纯靠复制粘贴+对话模板,就能让 Claude 帮你处理任何长度的论文。 先搞清楚:为什么 Claude 会提示"输入过长" (来源:Anthropic 官方文档 + 网页端实测) Claude 网页版和 API 是两套东西: 网页版 Claude API 版 Claude 输入长度限制 约 4000-8000 字符(动态调整) 20 万 token(约 15 万中文字) 目标用户 普通用户 开发者 处理长文方式 不支持 原生支持 所以你没有用错 Claude——是免费的网页版本来就不设计给长文处理用的.... Claude 网页端提示词过长怎么办?分段喂数据的 3 个实战模板(小白/文科生专用) ai
我被 Anthropic 封了三次号后,终于找到了最稳的绑卡方案 先说结论:国内独立开发者想稳定用 Claude 3.5 Sonnet,虚拟信用卡是唯一靠谱方案。别问我怎么知道的——我被 Anthropic 封了三次号,烧了 200 多美金学费,才踩出这条路。 (实测)第一次用招行 Visa 绑定,5 分钟后收到 “Your account has been suspended” 邮件。第二次用中行 Visa,活了 3 天。第三次终于学聪明了,用虚拟信用卡,现在这个号已经稳定跑了 6 个月。 这是 2026 AI 编程工具与大模型终极指南 的 Cluster 文章。如果你还没用过 Claude,可以先看 Claude Code 深度评测 了解它的实际能力。 为什么国内信用卡会被拒?Anthropic 的风控逻辑 先搞清楚敌人在想什么。 (来源:Anthropic 官方文档 + 社区反馈汇总)Anthropic 的风控分三层: 第一层:发卡行地区 Anthropic 的支付合作方是 Stripe,而 Stripe 对中国大陆发行的信用卡默认拒绝率极高。原因很复杂: 中国信用卡的欺诈率在国.... 2026 年国内升级 Claude 3.5 Sonnet 最稳银行卡绑定教程:虚拟信用卡 + 避坑指南 ai
我的 Claude API 从"丝滑"到"429"的完整历程 上周凌晨 2 点,我的自动化脚本第三次因为 429 over_limit 中断,跑了一半的数据清洗任务直接废了。我盯着屏幕上的报错,血压一下就上来了。 这已经不是第一次。从 5 月初开始,我调用 Claude API(通过 Anthropic 官方)的频率从每天 500 次涨到 5000 次后,429 报错开始频繁出现。最夸张的一次,一小时内连续被限流 12 次,每次 retry 间隔从 10 秒到 5 分钟不等。 这篇文章不跟你讲官方文档里的套话,只说一个被限流逼疯的开发者是怎么一步步解决这个问题的。 先搞清楚:429 over_limit 到底是什么 Claude API 的 429 over_limit 本质上是请求频率限制。它分两种: 限制类型 触发条件 恢复时间 RPM(每分钟请求数) 超过账户等级的每分钟最大请求数 通常 60 秒内 TPM(每分钟 Token 数) 超过账户等级的每分钟最大 Token 数 通常 60 秒内 并发请求数 同时发起的请求数超过限制 立即 (来源:Anthropic 官方 API 文.... Claude API 429 限流完全解决指南:一个 Java 程序员从被限流到架构优化的实战经验 ai
为什么我关心 RTX 3090 跑大模型的速度 去年我写过一篇 本地部署大模型实战:Ollama + Open WebUI 完整教程,当时用的结论是"本地 7B-14B 够用,别追求极致性能"。但半年过去,情况变了——Qwen3.5-27B 在单张 3090 上跑出了 129.5 tok/s。 什么概念?我 Ollama 跑 Qwen2.5-14B 大概 40 tok/s,14B 参数翻倍到 27B 还快了 3 倍多。这说明不是模型变快,是解码方法进化了。 上周看到七牛云 trycua 团队的一篇工程实践(来源:SegmentFault《如何在单张 RTX 3090 上让 Qwen3.5-27B token 生成速度提升 6 倍》),他们用了三个组合手段把速度干到这个数字。我花了两天时间理解他们的方案,下面是我消化后的版本——重点是普通人能学到什么,而不是复现他们的代码。 先搞懂:Qwen3.5-27B 是个什么怪物 很多人看到 Qwen3.5 就以为是普通 Transformer,不是的。它的 64 层结构里: 层类型 数量 特点 完整 softmax attention 16 层(.... 单张消费级显卡跑大模型有多快?RTX 3090 + Qwen3.5-27B 提速 6 倍的工程实践 ai
我为什么折腾本地大模型 事情起因很简单:有次半夜我在改一段涉及公司核心业务的代码,想用 AI 帮忙生成测试用例,但那段代码有商业敏感信息,传到云端的 DeepSeek、GPT 我心里没底。于是我开始折腾本地部署。 折腾了两个月,我把 Ollama + Open WebUI 这套组合彻底跑顺了。结论先放这:如果你是程序员、有一台 16G+ 内存的机器,本地跑个 7B-14B 的模型完全够用,而且不用担心数据外泄。这篇就是完整教程,把我踩的坑都写出来,让你少走弯路。 这是 2026 AI 编程工具与大模型终极指南 的 Cluster 文章。本地部署适合的是"隐私敏感 + 中等复杂度"的场景,如果你要处理超长代码库或复杂推理,还是得用云端大模型——这两者定位不同,我在文末会说清边界。 先搞清楚:本地部署到底解决什么问题 别一上来就装,先想清楚你要解决啥: 你的需求 该不该本地部署 隐私敏感代码(公司核心业务) ✅ 强烈推荐 离线/断网环境开发 ✅ 推荐 学大模型原理、做 RAG 实验 ✅ 推荐 要最强推理能力(写复杂算法) ❌ 用云端 要处理超长上下文(整个代码库) ❌ 本地显存撑不住 (实.... 本地部署大模型实战:Ollama + Open WebUI 完整教程 ai
为什么我要写一篇 Prompt 模板合集 我用 AI 辅助开发大概两年了,从最早 ChatGPT 到现在 Claude Code、DeepSeek、GLM 切着用。我发现一个规律:真正提升效率的不是哪个模型更聪明,而是你手里有没有一套经过验证的、能直接抄的 Prompt 模板。 每次新需求来了,我不想再从零想"这次该怎么问"。所以我把自己高频用到的场景固化成了下面这套模板,都是 Java / Spring Boot / MySQL / Redis 这套我每天都在摸的技术栈。 (实测)这套模板我用了大半年,覆盖了 CRUD、SQL 优化、单元测试、异常排查、代码审查、缓存设计这些日常 80% 的场景。你直接抄,改改表名、字段名就能用。 这篇是 2026 AI 编程工具与大模型终极指南 的 Cluster 文章。如果你想先理解"为什么这么写 prompt",建议先看 DeepSeek 高级用法:10 个 Prompt 技巧,这篇是它的落地版。 通用骨架 每个模板都遵循这个结构,你照着填就行: 【角色】你是 X 年经验的 Java 后端工程师 【上下文】技术栈 + 相关表结构 / 现有代码 .... 程序员必备 AI Prompt 模板:Java / Spring Boot / MySQL 场景合集 ai
写在前面:DeepSeek 不是"更强的 ChatGPT" 我用 DeepSeek 大概半年多了,主力是 DeepSeek-V3 和 R1。说实话,一开始我也把它当"查资料的工具"用,问点概念、让它写点小函数。后来有一次我让它帮我重构一个 800 行的 Spring Boot Service 类,结果它给我的代码把事务边界全搞错了——我才意识到,问题不在模型,在于我提问的方式。 (实测)同样一个模型,换一种问法,输出质量能差出两个级别。下面这 10 个 Prompt 技巧,都是我在这半年里反复踩坑后总结出来的,不是网上那种"请扮演专家"的套话。每一条我都会告诉你它解决过什么实际问题。 这篇文章是 2026 AI 编程工具与大模型终极指南 的 Cluster 文章,如果你还没看过那篇,建议先看,能帮你把 DeepSeek 放进整个 AI 工具图谱里。 1. 用"角色 + 上下文 + 约束"三件套替代"帮我写个 XX" 90% 的人用 AI 的方式是:帮我写个用户注册接口。这种问法,模型只能给你一个最通用的、没人会用的模板。 我现在的标准提问结构是: 你是一个有 10 年经验的 Java .... DeepSeek 高级用法:10 个你不知道的 Prompt 技巧 ai
两个工具我都在用,但用法完全不同 先说结论,免得你往下翻半天:Cursor 是"主力编辑器",Copilot 是"插件补充"。这两个不是二选一的关系,至少在我这里不是。我每天开 Cursor 写大部分代码,但写 Java 的时候又切回 IntelliJ IDEA + Copilot 插件。 这半年我把两个工具交叉用了挺久,正好把真实感受写清楚。不是那种"Cursor 更智能,Copilot 更稳定"的万能废话,而是具体到什么场景该用哪个。 这是 2026 AI 编程工具与大模型终极指南 的 Cluster 文章。另一篇 Claude Code 深度评测 讲的是命令行 AI 工具,和这篇的"编辑器内 AI"是两种形态,可以对照看。 先认清两者定位 维度 Cursor GitHub Copilot 形态 独立编辑器(VS Code fork) IDE 插件(VS Code / JetBrains 全家桶) 主语言倾向 前端 / TS / Python / 脚本 全语言(Java 生态支持最好) 核心能力 多文件编辑、Composer、对话改码 行内补全、Chat、智能重构 价格 $20/月.... Cursor vs GitHub Copilot 2026 对比:哪个 AI 代码编辑器更好用? ai
我为什么开始用 Claude Code 先说背景(实测):我是 Java 后端,日常 Jstack 是 Spring Boot + MyBatis + MySQL + Redis,用 IDEA 写了十年代码。2025 年开始用 Cursor,感觉 Tab 补全挺爽的,但始终觉得差点什么——Cursor 是在 IDE 里帮我写代码,但我没法让它自主完成一个完整的任务。 2026 年初开始用 Claude Code。说实话,第一次用有点不适应——没有 GUI,纯命令行,感觉回到了上世纪。但用了一周之后,真香。 这篇文章记录我一个月来用 Claude Code 的真实体验,不讲营销话术,只说一个程序员视角的好坏。 Claude Code 到底是什么? 简单说:Claude Code 是 Anthropic 出的一个终端 AI 编程代理。它不是 IDE 插件,是直接在终端里运行的。你告诉它"我要做什么",它会自主读代码、改文件、跑命令、调测试。 和 Cursor/Copilot 的核心区别: Cursor / Copilot Claude Code 运行方式 IDE 内 终端独立 交互模式 你.... Claude Code 深度评测:一个 Java 程序员用了一个月的真实感受 ai
为什么你需要关注 AI 编程工具? 2026 年,AI 编程工具不再是"尝鲜"阶段,而是程序员日常开发中不可或缺的一部分。不管你是 Java 后端、前端全栈、还是独立开发者,掌握一两款 AI 编程工具,开发效率至少翻倍。 但问题来了:工具太多,选哪个? Claude Code、Cursor、GitHub Copilot、Codex、通义灵码……每个都说自己最好用。大模型方面,GPT-5、Gemini 3、DeepSeek、GLM-4、Qwen 各有千秋。作为程序员,我们需要的不是营销话术,而是真实的体验对比。 这篇文章基于我(一个写了十年 Java 的程序员)的真实使用经验,帮你梳理 2026 年 AI 编程工具和大模型的现状,并给出实用的选型建议。 AI 编程工具篇:六大主流工具深度解析 1. Claude Code — 终端里的 AI 程序员 Claude Code 是 Anthropic 推出的命令行 AI 编程工具,2025 年底正式发布。它直接在终端里运行,不需要 IDE,用自然语言就能完成代码编写、调试、重构等任务。 核心特点: 终端原生:在终端里直接输入需求,Claude.... 2026 AI 编程工具与大模型终极指南:从入门到精通 ai
引言 你可能还没意识到,AI已经悄悄融入了我们的日常生活。很多人一提起AI,就觉得是程序员才会用的高科技,和普通人没关系。其实现在的AI工具早就做到了开箱即用,不需要任何技术背景就能上手。今天就给大家分享5个普通人每天都能用得上的AI场景,看完你就能立刻试试。 现在的AI大模型已经非常贴近日常生活,从修图写文案到规划行程,不用写代码就能轻松使用。据统计,2026年已有超过60%的网民每周至少使用一次AI工具,普通人也能享受到科技带来的便利。 智能修图:不用学PS,AI一秒修好旅行照 2025年社交媒体用户调研显示,72%的年轻用户表示会用AI来修社交媒体照片。现在的AI修图工具已经非常智能,根本不用学复杂的PS操作,上传照片就能自动优化。 我上个月去海边玩,拍的照片要么背光太暗,要么路人太多,用AI工具上传之后,一键就能自动调整光线、去除多余的路人,还能修复老照片、生成各种风格的滤镜。以前要花半小时修的图,现在几秒钟就搞定了,而且效果比我自己修的还好。 文案助手:写祝福、写文案、写邮件都能搞定 2026年职场效率调查报告显示,职场人士用AI写邮件平均能节省40%的时间。不管是节日祝福、.... 不用写代码,普通人也能用上的5个AI实用场景 ai
Skill 是 Claude Code 生态中最强大的能力扩展机制,它是预构建的专业化能力模块,覆盖软件开发、营销运营、安全合规、管理决 策等上百种场景,让你无需从零编写复杂逻辑,直接调用即可能力。本文将从学习现有Skill、正确使用Skill、自定义开发Skill三个 维度,帮你全面掌握Skill体系。 一、如何学习现有Skill:快速掌握上百种专业化能力 Claude Code 内置了超过200个官方Skill,覆盖几乎所有常见工作场景,学习路径可以遵循以下四步: 先建立全局认知:梳理Skill分类 官方Skill按场景可分为六大类,先了解分类能帮你快速找到所需能力: 掌握Skill的核心信息:三个关键属性 每个Skill都有三个核心属性,学习时重点关注: 触发条件:部分Skill会自动触发,比如当代码中导入@anthropic-ai/sdk时,claude-api Skill会自动激活,提供 Claude API 开发的专属支持; 入参规则:明确Skill支持的参数,比如code-review --comment会自动将审查结果作为PR inline评论提交; 适用场景:每个Sk.... Skill 从入门到自定义开发完全指南 ai
在各大社交媒体上,你一定刷到过这种“无被动收入”的副业神话:“利用 AI 一键生成电子书,上架亚马逊 KDP(Kindle Direct Publishing),躺着就能月入过万”。 听上去极其诱人对吧?作为一个执行力超强、同时保持高度理性的博主,我决定亲自试水。我不花一分钱买课,完全利用免费的 AI 工具和 Canva 设计软件,制作了一本关于《极简数字生活指南》的 40 页英文电子书,并成功上架亚马逊。 今天,上架刚好满 15 天。我不搞任何虚头巴脑的套路,直接为你公开我这半个月来的后台真实账单和最真实的踩坑全记录。 制作过程:AI 并没有想象中那么“一键” 我首先使用大模型帮我生成了电子书的内容大纲,并让它扩写了章节。必须提醒大家,指望 AI 一键输出整本书是完全不可能的。AI 输出的内容极其同质化,我花了整整 3 天时间,手动修改了至少 40% 的语句,加入了我自己的实操案例,才让这本书看起来像是一本“活人写的书”。 接着,我打开 Canva,搜索了免费的“Ebook Layout”模板,将文本黏贴进去,并利用 Canva 自带的免费免版权插图进行了简单的排版。最后导出了标准的.... 零基础用Canva加AI做电子书在 Amazon 售卖 ai
作为一个重度知识管理控,Notion 几乎承载了我所有的工作流。当官方推出 Notion AI 升级包(每月 10 美元)时,我毫不犹豫地订阅了。然而,随着市面上各种大模型 API 的降价,我开始思考:每个月花这 70 多块钱买官方 AI,到底是不是交了智商税? 为了寻找答案,我用两个不同的 Notion 账户进行了长达 30 天的对比测试:一个账户直接付费订阅官方 Notion AI;另一个账户通过第三方插件,接入了 Anthropic 官方给新用户的免费额度/低成本的 Claude 3.5 Sonnet API。以下是基于我个人真实使用数据的硬核评测。 成本与算力对比:官方包月 vs 按量付费 Notion AI 官方版最大的优势是“省心”,每月 10 刀无限次使用(虽然高频使用后会被限速)。 而在我的另一个测试号上,我使用了免费的第三方浏览器插件,直接填入了 Claude 的 API Key。由于 Anthropic 经常给新注册的开发者账户赠送 5 美元的免费额度,前两周我几乎是零成本使用。即便是免费额度用完后,由于我主要进行文本润色和结构化大纲生成,按量计费(Pay-as-y.... Notion AI升级vs接入免费Claude API ai
在把代码编辑器换成 Cursor 并尝试接入性价比极高的 DeepSeek-R1 时,很多人都会卡在最后一步。明明在 DeepSeek 后台刚复制了最新生成的 sk-… 密钥,黏贴到 Cursor 并在侧边栏提问时,却弹红字报错:Invalid API Key 或 Authentication Failed。 别慌,这通常不是你的 Key 真的失效了,而是 Cursor 目前对第三方模型通道的格式兼容存在一个小 Bug。按照以下 3 步,用时不到 2 分钟,保姆级帮你彻底解决。 第一步:彻底清理并关闭原有的默认 Open AI 通道 Cursor 的设置界面有时候会有“缓存残留”。当你直接在 Override 框里修改 URL 时,它可能仍在后台尝试呼叫 OpenAI 的服务器,从而导致报 API 错误。 点击 Cursor 右上角的 Gear(齿轮图标) 进入设置。 切换到 Models 标签页。 找到 OpenAI 的开关,将其暂时切换为 OFF。 展示 Cursor 设置页面中,Models 标签下关闭 OpenAI 默认开关的完整界面,并用红框圈出开关位置。 第二步:正确配置 .... Cursor编辑器配置DeepSeek报错API Key无效 ai