博客
开发者工具使用指南、技术科普与最佳实践。
全部AI AgentAI 编程助手AI基础设施AI安全AI工程化AI智能体AI编程AI编程助手AI编程工具AI编辑器AI集群AgentAnthropicApache2.0Base64CSPCSSCacheClaudeClaude CodeComfyUICopilotCursorDeepSeekDeepSeek V4EmbeddingEric XingFunction CallingGitHub CopilotH3HTTPSHugging FaceIDEIDE插件IFMINT4JSONK2 HorizonKV CacheKimi K3LLMLLM安全LLM应用开发LLM部署LM StudioLangChainLinux基金会LlamaMCPMLXMarkdownMetaMiniCPM5MiniMaxMoEMuse GlimmerNVIDIANatureNode.jsOllamaOpenAIOpenBMBPAIRPagedAttentionProductionPrompt InjectionPromptInjectionPrompt注入QdrantQwen3.8RAGRAG安全ReactSEOSSLSecurityTransformerTypeScriptURLUnicodeUnixVS CodeWebGPUWebLLMWeb安全Web开发WindsurfXMLXSSgpt-ossllama.cpptransformers.jsvLLM代码审查代码编辑器代码规范代码重构供应链写作前端向量数据库向量检索图片在线工具大模型安全实战实战经验密码工程实践幻觉开发工具开发效率开发者体验开发者工具开源开源协议开源大模型开源模型开源生态强化学习性能优化成本优化推理优化提效提示注入提示词搜索引擎收购效率效率工具数据库数据格式文本处理文档时间戳智能密度本地AI本地推理格式化检索检索优化检索增强检索增强生成模型选型正则表达式流量浏览器推理渗透测试生产力生产实践生产环境生产部署知识库端侧AI端侧推理类型系统编码编程编程助手网站速度英伟达视频生成计算机基础设计证书语义搜索踩坑经验量化防御方案防御架构隐私保护面壁智能颜色黄仁勋
标签:#LLM · 清除筛选
前端与全栈·
浏览器端跑LLM:WebGPU推理的现在与将来
WebGPU 推理目前就是个"能用但别指望多好用"的状态,但它确实解决了一个实际问题——隐私敏感场景下数据无需离开设备。
WebGPU浏览器推理LLMWebLLMtransformers.js
开源生态·
vLLM、Ollama、LM Studio 横评:自托管 LLM 到底该选谁?
试了一圈主流自托管方案,从吞吐实测到踩坑复盘,帮你找到最适合你场景的 LLM 部署方式。
vLLMOllamaLM StudioLLM部署开源模型
AI技术·
别再给 AI 画饼了:一个 RAG 踩坑一年的血泪总结
RAG 系统从搭建到上线,半年调 chunk 半年治幻觉。本文总结了一个 RAG 项目的真实踩坑经验。
RAGLLMEmbedding检索增强
AI技术·
别再给 AI 画饼了:一个 RAG 踩坑一年的血泪总结
RAG 系统从搭建到上线,半年调 chunk 半年治幻觉。本文总结了一个 RAG 项目的真实踩坑经验。
RAGLLMEmbedding检索增强
端侧与硬件·
本地跑 LLM 不崩溃:我的 llama.cpp 实战踩坑录
从模型选型到量化方案,手把手教你在本地稳定运行 LLM,附真实踩坑经验。
LLMllama.cpp端侧推理量化
前端与全栈·
WebGPU 浏览器推理:把 LLM 跑进 Chrome 不是梦
实测 WebLLM + WebGPU 在浏览器端跑 LLM,性能基准、踩坑记录和完整示例代码。
WebGPUWebLLM浏览器推理前端
显示第 1-6 篇,共 34 篇