程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
编程
当 C/C++ 遇上 Rust:llama.cpp 与 LiteBox 深度架构对比——2026 年本地 LLM 推理框架的心智模型之战
2026-07-16 12:50:04 +0800 CST
view 272
深度对比 llama.cpp 与 LiteBox 两大本地 LLM 推理框架:GGUF 格式设计、K-Quant 量化内核、KV cache 管理、多后端抽象、并发架构,配完整代码实战与性能实测数据。
llama.cpp
LiteBox
GGUF
量化
KV cache
本地LLM
推理框架
Rust
C/C++
模型压缩
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
编程
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
2026-04-09 00:53:51 +0800 CST
view 1538
2026年4月8日智谱发布GLM-5.1,744B参数MIT开源,SWE-bench Pro 58.4分超越Claude Opus 4.6,全球首个支持8小时长程自治的开源模型。
GLM-5.1
智谱AI
开源大模型
MoE
SWE-bench
长程自治
LLM
Hermes Agent 深度解析:当 AI Agent 终于学会「记住一切、学会一切、成为一切」
编程
Hermes Agent 深度解析:当 AI Agent 终于学会「记住一切、学会一切、成为一切」
2026-04-09 01:07:00 +0800 CST
view 1892
36k+ stars 的开源自进化 AI Agent,Nous Research 出品,支持记忆持久化、跨平台网关、自创建技能和 $5 VPS 运行能力
AI Agent
Hermes Agent
Nous Research
自进化
记忆系统
Agent-Reach 深度拆解:一个CLI工具,如何用17行核心代码让AI Agent「看见」整个互联网
编程
Agent-Reach 深度拆解:一个CLI工具,如何用17行核心代码让AI Agent「看见」整个互联网
2026-07-27 20:46:42 +0800 CST
view 245
深度拆解 GitHub 24K Stars 开源项目 Agent-Reach:从架构设计、17平台渠道适配、MCP集成到生产实战,解析如何用工程现实主义解决 AI Agent 的互联网接入难题。
AI Agent
Agent-Reach
MCP
GitHub
CLI
Python
OpenClaw
Claude Code
NousResearch Hermes Agent 深度实战:自我进化的 AI Agent 架构设计与 47K Star 现象级开源密码全解析
编程
NousResearch Hermes Agent 深度实战:自我进化的 AI Agent 架构设计与 47K Star 现象级开源密码全解析
2026-05-09 02:36:51 +0800 CST
view 679
深度剖析 NousResearch Hermes Agent 的三层记忆架构、强化学习进化引擎与多模型协同编排,从源码层面理解自我进化的 AI Agent 设计密码。
AI Agent
强化学习
Hermes Agent
NousResearch
Python
Rust
用 Obsidian + Claude 整了个 AI 记忆外挂:claude-obsidian 深度测评
编程
用 Obsidian + Claude 整了个 AI 记忆外挂:claude-obsidian 深度测评
2026-07-04 16:22:16 +0800 CST
view 514
claude-obsidian是GitHub上8.5K Stars的开源AI知识引擎,将PDF/文本自动整理为wiki知识图谱,hot.md持久化跨会话记忆,autoresearch三轮自主研究+归档,支持PARA/LYT/Zettelkasten四种知识组织方法论,MIT协议数据不锁死。
Obsidian
Claude
AI第二大脑
知识图谱
claude-obsidian
hot缓存
autoresearch
PARA
LYT
Zettelkasten
Markdown
MIT
开源
Hermes Agent 深度拆解:62K Star 的「自进化 AI Agent」如何用闭环学习系统重新定义个人助手——从三层记忆架构到 DSPy+GEPA 技能进化的全栈工程哲学
编程
Hermes Agent 深度拆解:62K Star 的「自进化 AI Agent」如何用闭环学习系统重新定义个人助手——从三层记忆架构到 DSPy+GEPA 技能进化的全栈工程哲学
2026-08-03 20:13:41 +0800 CST
view 205
深度拆解Hermes Agent 62K Star开源AI Agent框架:闭环学习系统自动创建/改进技能、三层记忆架构(FTS5+Honcho用户建模)、DSPy+GEPA技能进化引擎、同步Agent循环设计、40+工具与404个Skill、研究级RL训练环境,附完整代码示例与部署实战指南
Hermes Agent
AI Agent
自进化
Nous Research
闭环学习
DSPy
GEPA
技能系统
记忆架构
Python
2026年4月24日:大模型军备竞赛进入新纪元——DeepSeek V4 与 GPT-5.5 深度技术对比解析
编程
2026年4月24日:大模型军备竞赛进入新纪元——DeepSeek V4 与 GPT-5.5 深度技术对比解析
2026-04-28 08:54:41 +0800 CST
view 1033
2026年4月24日,DeepSeek V4与GPT-5.5同日发布。本文从MoE架构、注意力机制、性能基准、Engram记忆模块、mHC超连接、Muon优化器等核心技术点进行硬核深度对比,配大量代码示例,为开发者提供实用的技术选型指南。
AI大模型
LLM
GitHub精选
开源项目
TechNews
Agent-Reach 深度解析:给 AI Agent 装上互联网的「万能眼睛」——从脚手架架构到 11 平台全覆盖、从零成本接入到生产级部署的完整技术指南(2026)
编程
Agent-Reach 深度解析:给 AI Agent 装上互联网的「万能眼睛」——从脚手架架构到 11 平台全覆盖、从零成本接入到生产级部署的完整技术指南(2026)
2026-07-04 16:42:45 +0800 CST
view 601
深度解析 Agent-Reach 项目:给 AI Agent 装上互联网能力的脚手架工具,覆盖 11 大平台,零成本接入,包含完整技术指南和生产部署最佳实践。
Agent-Reach
AI Agent
互联网访问
Claude Code
OpenClaw
Cursor
MCP
GitHub
Twitter
YouTube
脚手架
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
编程
vLLM 0.5 深度解析:PagedAttention 架构原理与生产级 LLM 推理优化实战
2026-07-04 18:15:46 +0800 CST
view 459
深度解析 vLLM 0.5 的 PagedAttention 架构原理,涵盖 KV Cache 分页管理、MoE 优化、分布式推理、量化技术,并通过代码实战和性能对比,帮助开发者掌握生产级 LLM 推理最佳实践。
vLLM
PagedAttention
LLM推理
CUDA
KV Cache
深度学习
AI基础设施
Python
生产部署
性能优化
2026 大模型推理框架选型实战:从 vLLM、TGI 到 TensorRT-LLM 的全链路架构拆解与性能防线
编程
2026 大模型推理框架选型实战:从 vLLM、TGI 到 TensorRT-LLM 的全链路架构拆解与性能防线
2026-08-12 11:14:56 +0800 CST
view 128
深度拆解 2026 年四大主流推理框架 vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9 的核心技术、性能对比与选型指南,涵盖 PagedAttention、Continuous Batching、量化优化、分布式推理与生产踩坑清单。
vLLM
TensorRT-LLM
TGI
DeepSpeed-MII
大模型推理
KV Cache
PagedAttention
推理优化
量化
分布式推理
DuckDB 1.5 + Iceberg 写入深度拆解:当单机分析引擎终于长出湖仓的手——从 positional deletes 到 DuckLake v0.4 的元数据取舍
编程
DuckDB 1.5 + Iceberg 写入深度拆解:当单机分析引擎终于长出湖仓的手——从 positional deletes 到 DuckLake v0.4 的元数据取舍
2026-08-12 11:48:14 +0800 CST
view 110
DuckDB-Iceberg v1.4.2 全面支持 insert/update/delete。深度拆解 Iceberg 四层寻址链、positional deletes 与 merge-on-read 读放大、事务快照钉住带来的数量级优化、DuckLake v0.4 元数据入 SQL 库的架构取舍,含 Docker+SQL+Python 七个实战与 18 条生产踩坑清单。
DuckDB
Apache Iceberg
DuckLake
湖仓一体
Lakehouse
merge-on-read
数据湖
Parquet
VARIANT
数据库
Hermes Agent 深度拆解:当 AI Agent 学会「自我进化」——闭环学习、Blackboard 架构与 GRPO 强化学习的工程全貌
编程
Hermes Agent 深度拆解:当 AI Agent 学会「自我进化」——闭环学习、Blackboard 架构与 GRPO 强化学习的工程全貌
2026-07-17 00:45:44 +0800 CST
view 162
深度拆解 Hermes Agent:闭环学习系统、三层记忆架构、Blackboard 协作范式、GRPO 强化学习与自动技能生成,配完整代码示例与生产部署指南。
Hermes Agent
AI Agent
自进化
闭环学习
GRPO
Blackboard架构
强化学习
NousResearch
Hermes Agent 深度实战:当 AI Agent 学会了「自我进化」——从闭环学习到三层记忆架构、从 GEPA 进化算法到 200+ 模型适配的生产级完全指南(2026)
编程
Hermes Agent 深度实战:当 AI Agent 学会了「自我进化」——从闭环学习到三层记忆架构、从 GEPA 进化算法到 200+ 模型适配的生产级完全指南(2026)
2026-06-21 12:54:22 +0800 CST
view 359
2026年最火的自进化AI Agent框架Hermes Agent深度解析:闭环学习、三层记忆架构、GEPA进化算法、200+模型适配,含完整代码实战和生产级部署方案。
Hermes Agent
AI Agent
自进化
GEPA
Nous Research
DesktopCommanderMCP 深度拆解:当 MCP 协议把 AI 变成真正的操作系统级 Agent
编程
DesktopCommanderMCP 深度拆解:当 MCP 协议把 AI 变成真正的操作系统级 Agent
2026-07-14 17:17:22 +0800 CST
view 309
深度拆解 GitHub Trending #1 项目 DesktopCommanderMCP:从 MCP 协议机制、终端控制架构、安全沙箱设计、内存代码执行到多客户端生态,一次把「让 AI 操控整台电脑」的操作系统级 Agent 方案讲透。
DesktopCommanderMCP
MCP协议
AI Agent
操作系统
JSON-RPC
沙箱
Docker
TypeScript
开源
GitHub Trending
Linux 7.0 内核深度解析:从 TIP 时间片扩展到 EEVDF 调度器——Linus 亲自操刀的性能革命
编程
Linux 7.0 内核深度解析:从 TIP 时间片扩展到 EEVDF 调度器——Linus 亲自操刀的性能革命
2026-05-02 11:04:50 +0800 CST
view 707
Linux 7.0内核深度技术解析:EEVDF调度器取代CFS、TIP时间片扩展优化游戏性能、XFS自我修复、Atomic Writes存储加速、Sheaves内存管理、开放树命名空间容器启动飞跃、IO_uring零拷贝网络
Linux
内核
EEVDF
调度器
TIP
XFS
Atomic Writes
IO_uring
万字深度解析 Supermemory:当 AI 遇见「持久记忆大脑」——从三大基准第一到生产级记忆引擎的完整技术指南(2026)
编程
万字深度解析 Supermemory:当 AI 遇见「持久记忆大脑」——从三大基准第一到生产级记忆引擎的完整技术指南(2026)
2026-07-02 04:12:19 +0800 CST
view 547
2026年AI记忆引擎赛道领跑者Supermemory深度解析:三大基准测试第一(LongMemEval 81.6%),召回延迟<300ms。涵盖架构设计、核心算法、API集成、性能优化、竞品对比与生产级部署指南。
Supermemory
AI记忆
上下文工程
向量数据库
知识图谱
LongMemEval
LoCoMo
RAG
AI Agent
记忆引擎
Linux 7.2 存储栈深度实战:当两行代码让 IOPS 提升 5%——从 iomap 框架到 io_uring 零拷贝、从 Block Layer 到 NVMe 高并发存储引擎的生产级完全指南
编程
Linux 7.2 存储栈深度实战:当两行代码让 IOPS 提升 5%——从 iomap 框架到 io_uring 零拷贝、从 Block Layer 到 NVMe 高并发存储引擎的生产级完全指南
2026-06-20 07:28:05 +0800 CST
view 471
深度解析 Linux 7.2 iomap 框架优化:两行代码让 IOPS 提升 5%。从 iomap_iter 热路径分析到 io_uring 异步引擎实战,涵盖 Block Layer、NVMe 驱动、性能调优全链路。
Linux
io_uring
iomap
NVMe
存储
内核优化
OmniRoute深度解析:聚合237+AI提供商的免费智能路由网关——从RTK+Caveman压缩到四级自动降级的完整实战指南
编程
OmniRoute深度解析:聚合237+AI提供商的免费智能路由网关——从RTK+Caveman压缩到四级自动降级的完整实战指南
2026-07-06 03:13:06 +0800 CST
view 677
深度解析OmniRoute开源AI网关:聚合237+提供商(50+免费)、RTK+Caveman双层Token压缩(节省15-95%)、四级自动降级、17种路由策略、三层弹性保障。含Python/Go/TypeScript完整代码实战、与LiteLLM/OpenRouter竞品对比、生产部署指南。
OmniRoute
AI网关
Token压缩
智能路由
LLM
开源
TypeScript
成本优化
Rust 重塑前端工具链:从 Rolldown 到 Oxc,一场静悄悄的性能革命(2026 完全指南)
编程
Rust 重塑前端工具链:从 Rolldown 到 Oxc,一场静悄悄的性能革命(2026 完全指南)
2026-06-04 13:42:02 +0800 CST
view 800
2026年Rust全面重塑前端工具链,Rolldown、Oxc、Rspack、SWC、Biome五大核心工具深度解析,含架构分析、代码实战和渐进式迁移策略
Rust
前端工具链
Rolldown
Oxc
Rspack
SWC
Biome
Vite
Web性能优化
JavaScript
OmniRoute 深度实战:一个开源 AI 网关如何用 RTK+Caveman 双层压缩算法省掉你 95% 的 Token 账单
编程
OmniRoute 深度实战:一个开源 AI 网关如何用 RTK+Caveman 双层压缩算法省掉你 95% 的 Token 账单
2026-07-10 10:47:32 +0800 CST
view 320
深度拆解 OmniRoute:237家AI提供商聚合、RTK+Caveman双层压缩算法(节省15-95%Token)、四级断路器自动故障转移,从架构设计到生产部署的完整实战指南
OmniRoute
AI网关
RTK压缩
Caveman
Token优化
开源
AI Agent
TypeScript
Headroom 深度实战:让 AI Agent 的 Token 消耗暴降 60-95% 的上下文压缩层完全解析
编程
Headroom 深度实战:让 AI Agent 的 Token 消耗暴降 60-95% 的上下文压缩层完全解析
2026-06-29 05:12:24 +0800 CST
view 701
Headroom v0.5.18 完整实战:六层压缩管道深度拆解、SmartCrusher/CodeCompressor/Kompress-base算法原理、四种集成方式代码实战、性能基准验证、headroom learn跨Agent记忆共享。让Token消耗暴降60-95%。
AI Agent
Token压缩
Headroom
上下文管理
LLM优化
编程工具
Python
TypeScript
自建大模型统一网关:多模型路由、故障转移与成本治理的工程实战
编程
自建大模型统一网关:多模型路由、故障转移与成本治理的工程实战
2026-07-23 02:41:45 +0800 CST
view 330
从协议碎片化病根讲起,拆解生产级 LLM 网关必须解决的六类工程问题,并用手写 Go 网关+Python 语义缓存跑通路由、熔断、重试与成本记账。
LLM Gateway
大模型网关
多模型路由
故障转移
成本治理
LiteLLM
OmniRoute
Headroom 全解析:从 Rust 内核到 CCR 可逆协议,AI Agent Token 优化的终极方案(2026)
编程
Headroom 全解析:从 Rust 内核到 CCR 可逆协议,AI Agent Token 优化的终极方案(2026)
2026-06-29 08:15:21 +0800 CST
view 403
深度解析 Headroom:从 Rust 内核到 CCR 可逆协议,六大压缩算法引擎,五种部署模式,实测 60-95% Token 节省,答案准确度零损失。
AI Agent
Token优化
Headroom
Rust
上下文压缩
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
34
35
36
37
38
...
101
下一页