博客

开发者工具使用指南、技术科普与最佳实践。

全部AI AgentAI 编程助手AI基础设施AI安全AI工程化AI智能体AI编程AI编程助手AI编程工具AI编辑器AI集群AgentAnthropicApache2.0Base64CSPCSSCacheClaudeClaude CodeComfyUICopilotCursorDeepSeekDeepSeek V4EmbeddingEric XingFunction CallingGitHub CopilotH3HTTPSHugging FaceIDEIDE插件IFMINT4JSONK2 HorizonKV CacheKimi K3LLMLLM安全LLM应用开发LLM部署LM StudioLangChainLinux基金会LlamaMCPMLXMarkdownMetaMiniCPM5MiniMaxMoEMuse GlimmerNVIDIANatureNode.jsOllamaOpenAIOpenBMBPAIRPagedAttentionProductionPrompt InjectionPromptInjectionPrompt注入QdrantQwen3.8RAGRAG安全ReactSEOSSLSecurityTransformerTypeScriptURLUnicodeUnixVS CodeWebGPUWebLLMWeb安全Web开发WindsurfXMLXSSgpt-ossllama.cpptransformers.jsvLLM代码审查代码编辑器代码规范代码重构供应链写作前端向量数据库向量检索图片在线工具大模型安全实战实战经验密码工程实践幻觉开发工具开发效率开发者体验开发者工具开源开源协议开源大模型开源模型开源生态强化学习性能优化成本优化推理优化提效提示注入提示词搜索引擎收购效率效率工具数据库数据格式文本处理文档时间戳智能密度本地AI本地推理格式化检索检索优化检索增强检索增强生成模型选型正则表达式流量浏览器推理渗透测试生产力生产实践生产环境生产部署知识库端侧AI端侧推理类型系统编码编程编程助手网站速度英伟达视频生成计算机基础设计证书语义搜索踩坑经验量化防御方案防御架构隐私保护面壁智能颜色黄仁勋
AI技术·

MiniMax H3 开源实战:2K视频+原生立体声,单人显卡就能跑

MiniMax H3于2026年8月3日正式开源,支持2K分辨率加原生立体声视频生成,单张RTX 3060即可本地运行,本文详解其架构、部署方法和实际应用。

MiniMaxH3视频生成开源模型ComfyUI
AI技术·

OpenAI 首次开源!gpt-oss 来了,闭源帝国裂开一道缝

OpenAI 自 GPT-2 后六年首次开源模型权重,gpt-oss-120b 和 gpt-oss-20b 以 Apache 2.0 协议发布,单卡可跑、接口兼容 OpenAI SDK,开源 LLM 格局或生变局。

OpenAIgpt-oss开源大模型本地推理Apache2.0
开源生态·

2026年8月开源大模型集体爆发:一张表看懂怎么选

2026年8月,DeepSeek V4 Pro、Qwen3.8 开源、Kimi K3、GLM-5.3、MiniMax H3 相继亮相,开源阵营第一次在多个维度逼近闭源。这篇按场景帮你选型。

开源大模型Qwen3.8DeepSeek V4Kimi K3模型选型
端侧与硬件·

INT4量化实战:把7B模型塞进手机,踩坑全记录

上周把 Llama 3.1 8B 做了 INT4 量化,装进 iPhone 15 Pro 跑推理。过程挺曲折,把踩的坑都记下来。

INT4量化端侧AIllama.cppMLX
前端与全栈·

浏览器端跑LLM:WebGPU推理的现在与将来

WebGPU 推理目前就是个"能用但别指望多好用"的状态,但它确实解决了一个实际问题——隐私敏感场景下数据无需离开设备。

WebGPU浏览器推理LLMWebLLMtransformers.js
端侧与硬件·

llama.cpp 本地推理实战:从安装到优化的完整指南

一线开发者实测:如何在消费级硬件上跑起LLM,量化带来的精度损失到底有多少,以及那些文档里没写踩坑记录

llama.cpp量化本地推理端侧AI

显示第 13-18 篇,共 103 篇