智元界
智元界 Zyentor AI 开发者社区
🔎
登录 注册
全部 AI AI开发实战 FastAPI/Flask LangChain/AutoGPT LoRA/QLoRA Milvus/Qdrant React/Vue asyncio 学习笔记 容器化部署 开发实战 开源推荐 技术博客 技术选型 提示词工程 检索增强生成 版本控制 踩坑记录
2024后端框架选型实战:Spring Boot vs Quarkus,谁才是微服务王者?

2024后端框架选型实战:Spring Boot vs Quarkus,谁才是微服务王者?

微服务架构下,Spring Boot与Quarkus的竞争愈演愈烈。本文从启动速度、内存占用、生态兼容性与实际生产案例四个维度,深度对比两款框架的优劣,帮你根据项目规模与团队技术栈做出最优选择,附踩坑实录与性能数据。

阿Linux玩家手记 1299 270 0 2026-07-24
手把手教你用LangChain+Ollama搭建本地RAG问答系统实战

手把手教你用LangChain+Ollama搭建本地RAG问答系统实战

本文记录了我用LangChain和Ollama搭建本地RAG系统的全流程,从环境配置到向量库构建,再到检索增强生成,包含代码示例和踩坑经验。适合想本地部署大模型并实现文档问答的开发者参考。

实战派推理加速炼金室 1236 240 0 2026-07-24
记一次生产环境Docker容器频繁OOM的排查与修复全过程

记一次生产环境Docker容器频繁OOM的排查与修复全过程

生产环境Java应用容器频繁触发OOM Killer,重启后几分钟又挂。本文详细记录从现象定位、内存快照分析到最终发现是JVM参数与CGroup内存限制不匹配,以及堆外内存泄漏的完整排查过程,附带具体命令和修复方案。

一线低代码手记 1195 244 0 2026-07-24
手把手教你用LangChain搭建本地知识库RAG系统,30分钟搞定企业级问答

手把手教你用LangChain搭建本地知识库RAG系统,30分钟搞定企业级问答

本文从零开始,详细讲解如何利用LangChain+Ollama+ChromaDB搭建一个可运行的本地知识库RAG系统。包括文档加载、向量存储、检索增强生成全流程,并附有完整代码示例和踩坑记录,适合有Python基础想入门RAG的开发者。

认真做战略增长记 1372 249 0 2026-07-24
2025年后端框架选型指南:Spring Boot 3 vs Quarkus vs Go Gin实战对比

2025年后端框架选型指南:Spring Boot 3 vs Quarkus vs Go Gin实战对比

本文基于2025年最新技术栈,从启动速度、内存占用、生态成熟度、云原生适配四个维度,对比Spring Boot 3、Quarkus 3与Go Gin框架。结合一个高并发订单服务的重构案例,给出不同业务场景下的选型建议,拒绝纸上谈兵。

深夜云原生学习簿 1330 248 0 2026-07-24
手搓一个RAG问答系统:从PDF解析到LLM回答的全流程实战

手搓一个RAG问答系统:从PDF解析到LLM回答的全流程实战

本文记录了我用LangChain+ChromaDB搭建一个本地RAG问答系统的全过程。从PDF文档解析、文本分块、向量化存储,到语义检索与大模型生成回答,所有代码均可直接运行。适合想入门RAG但不想看一堆理论的同学。

生产级智能体落地指南 1336 244 0 2026-07-24
记一次Docker容器内Java应用频繁Full GC的排查与修复

记一次Docker容器内Java应用频繁Full GC的排查与修复

线上Java服务在Docker容器中运行一周后突然频繁Full GC,导致接口超时飙升。本文从JVM参数、容器内存限制、GC日志分析入手,最终定位到Swap与CGroup内存限制不匹配的问题,并给出修复方案。

深夜后端方法论 1285 234 0 2026-07-24
别再纠结了!2024年微服务框架选型终极指南:Spring Cloud vs. Dubbo vs. Istio

别再纠结了!2024年微服务框架选型终极指南:Spring Cloud vs. Dubbo vs. Istio

微服务框架选型是每个架构师都绕不开的难题。本文将从社区活跃度、服务治理、性能、学习曲线及实际坑点四个维度,对比Spring Cloud、Dubbo和Istio三巨头。结合一个电商项目的重构实战,帮你理清什么场景该选谁,避免盲目跟风。

野生Java玩家手记 1386 259 0 2026-07-24
RAG系统落地实战:用LangChain+Chroma构建智能文档问答机器人

RAG系统落地实战:用LangChain+Chroma构建智能文档问答机器人

手把手教你从零搭建一个RAG智能问答系统,用LangChain做流程编排,Chroma做向量存储,结合百度文心一言API实现中文文档精准问答。内含完整代码示例和踩坑记录,适合AI应用开发者直接复现。

深度学习探索频道 1328 252 0 2026-07-24
2025年后端技术选型终极指南:Spring Boot还是Quarkus?我全都要!

2025年后端技术选型终极指南:Spring Boot还是Quarkus?我全都要!

微服务架构下,Spring Boot与Quarkus的“冷启动”与“内存占用”之争愈演愈烈。本文基于一个实际电商订单服务的重构案例,从启动速度、运行时资源、开发体验、生态兼容性四个维度进行深度对比,并给出“混合架构”的选型建议,帮你做出不后悔的技术决策。

写作案例库 1214 248 0 2026-07-24
2024年后端框架横评:Spring Boot vs Quarkus vs Micronaut,谁更香?

2024年后端框架横评:Spring Boot vs Quarkus vs Micronaut,谁更香?

本文深度对比Spring Boot 3、Quarkus 3和Micronaut 4三款主流Java后端框架,从启动速度、内存占用、开发体验、生态成熟度四个维度,结合真实项目案例给出选型建议,帮你少走弯路、选对技术栈。

一线职场案例库 1369 257 0 2026-07-23
从入门到实战:一文读懂大语言模型RLHF核心原理与实现

从入门到实战:一文读懂大语言模型RLHF核心原理与实现

RLHF(基于人类反馈的强化学习)是ChatGPT等大模型能力跃升的关键技术。本文从技术原理出发,拆解“奖励模型训练”与“PPO微调”两大核心流程,结合开源代码与训练数据案例,帮你理解RLHF为什么能让模型更“懂人话”。

山海问道录 1351 269 0 2026-07-23
炸裂!GitHub 30K星开源项目教你用AI一键生成3D场景

炸裂!GitHub 30K星开源项目教你用AI一键生成3D场景

还在手动搭建3D场景?试试这个开源神器!本文深度解析GitHub上爆火的Three.js + AI项目“Wonder3D”,从安装配置到实战案例,手把手教你用文本或图片生成高质量3D模型,提升开发效率10倍。

保持好奇全栈修炼册 1336 246 0 2026-07-23
LoRA微调7B模型:数据准备、训练配置与效果对比全记录

LoRA微调7B模型:数据准备、训练配置与效果对比全记录

面对垂直领域任务,7B模型基座能力虽强但缺乏领域知识。本文记录使用LoRA(Low-Rank Adaptation)微调Qwen2.5-7B-Instruct的全过程,包含数据清洗与格式化、QLoRA 4bit量化训练配置(lr=2e-4, rank=8, alpha=16)、单卡A100 80G下loss曲线从1.2降至0.3的收敛过程,以及微调前后在领域问答任务上的准确率对比(53%→89%)

狐狸研究AI日记 1952 246 0 2026-07-20
FastAPI性能调优:Profiling、SQL查询与缓存策略压测实录

FastAPI性能调优:Profiling、SQL查询与缓存策略压测实录

一次线上API接口响应时间从850ms降至45ms的调优过程。文章详细记录了使用cProfile定位HotSpot、优化N+1查询(SQLAlchemy 2.0)、引入Redis缓存(cachetools+aioredis)以及基于Locust的压测数据。涉及FastAPI 0.110、Python 3.12、PostgreSQL 16、Redis 7.2。包含完整可复现的代码和前后对比数据,适合

深夜云原生笔记 1995 223 0 2026-07-20
Docker Compose编排多服务实战:网络、健康检查与启动顺序

Docker Compose编排多服务实战:网络、健康检查与启动顺序

本文通过一个实际的多服务项目(Nginx + Go API + PostgreSQL + Redis),详细讲解Docker Compose的完整配置方案。项目涉及4个容器、2个自定义网络、持久化卷挂载、3个健康检查探针以及严格的启动顺序控制。经过优化后,平均服务启动时间缩短至18秒,健康检查误报率降至0.3%。文中提供可直接运行的docker-compose.yml和Dockerfile,包含具

阿运维人 2051 238 0 2026-07-20
从零构建LangChain AI Agent:工具链·记忆环·异常恢复

从零构建LangChain AI Agent:工具链·记忆环·异常恢复

当任务需要调用3个外部API并处理中途错误时,普通LLM调用失败率超70%。本文用LangChain 0.3+OpenAI GPT-4o,手写一个具备工具定义、记忆管理、错误重试和循环控制的Agent。通过实现Web搜索+代码执行+文件写入的复合任务,在5轮对话内完成数据采集与报表生成,成功率从32%提升至89%。全文包含完整可复现代码与性能对比表。

长期关注用户研究思考录 2344 240 0 2026-07-20
Docker Compose三服务编排:网络、卷挂载与健康检查实战

Docker Compose三服务编排:网络、卷挂载与健康检查实战

接手一个遗留项目,需同时启动Nginx反向代理、Go后端API和PostgreSQL数据库。传统手动docker run方式每次启动至少敲8条命令,且常因启动顺序混乱导致Nginx无法代理后端、API连不上数据库。改用Docker Compose后,一次`docker compose up -d`即可完成全部部署,启动速度从2分钟缩短至15秒。本文分享一个含自定义网络、命名卷挂载、健康检查及dep

数据库别催的程序员 2285 209 0 2026-07-20
Git工作流重塑:基于Trunk的分支策略与CI/CD落地实践

Git工作流重塑:基于Trunk的分支策略与CI/CD落地实践

去年接手一个20人团队的项目,代码冲突每周消耗5小时,发布前合并常出回归Bug。我们重构了Git工作流:采用Trunk-based分支策略,结合Gerrit的Code Review流水线和Jenkins的CI/CD自动门禁。改造后,代码冲突率下降73%,发布周期从3天缩短到4小时,线上故障率降低62%。本文分享分支模型、Review流程、CI/CD配置(含Jenkinsfile和Gerrit钩子脚

保持好奇全栈修炼册 2424 223 0 2026-07-20
RAG系统三阶段优化:chunk重划分、embedding切换与rerank集成

RAG系统三阶段优化:chunk重划分、embedding切换与rerank集成

从零搭建的RAG系统上线后,用户反馈“搜不到关键合同条款”,召回准确率仅61%。本文记录了一次完整的优化过程,覆盖chunk策略从固定256字符到语义段落划分、embedding模型从text2vec-base到bge-large-zh-v1.5切换、以及引入bge-reranker-v2-m3后的效果对比。优化后召回率提升至89%,首条命中率提升42%,并附带了完整的代码实现与性能数字。适合正在

运营拆解所 2454 197 0 2026-07-20
上一页 1 2 3 ... ... 25 26 27 下一页

作者推荐