程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
llm-d进入CNCF:Kubernetes正式迈入AI原生时代
编程
llm-d进入CNCF:Kubernetes正式迈入AI原生时代
2026-04-08 12:29:41 +0800 CST
view 850
IBM、红帽、谷歌联合向CNCF捐赠llm-d项目,标志着Kubernetes正式迈入AI原生时代。本文深度解析llm-d架构设计、性能数据及实践建议。
Kubernetes
云原生
AI
大模型
llm-d
CNCF
Headroom 深度实战:当 AI Agent 学会「省着吃」——从 Token 暴降 60-95% 到可逆上下文压缩的生产级完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 学会「省着吃」——从 Token 暴降 60-95% 到可逆上下文压缩的生产级完全指南(2026)
2026-06-09 14:16:12 +0800 CST
view 582
Headroom 是一个开源的 AI Agent 上下文压缩中间层,通过六大专用算法实现 60-95% 的 Token 节省,CCR 可逆存储确保信息零丢失,跨 Agent 记忆打破协作孤岛。
AI Agent
Headroom
上下文压缩
Token优化
LLM
开源项目
AI Agent 修 Bug 的隐秘成本:斯坦福研究揭示编码任务中 Token 消耗的惊人真相
编程
AI Agent 修 Bug 的隐秘成本:斯坦福研究揭示编码任务中 Token 消耗的惊人真相
2026-05-08 11:38:56 +0800 CST
view 735
斯坦福、MIT、密歇根大学联合研究揭示:AI Agent 修复 Bug 的 Token 消耗是普通代码问答的 1000 倍。本文深入剖析 Token 消耗的根因、模型间效率差异,以及从工程层面优化 AI 编程助手成本的方法。
AI Agent
Token成本
LLM
斯坦福研究
工程实践
成本优化
WinRM for Go — 用Go语言远程管理Windows机器
编程
WinRM for Go — 用Go语言远程管理Windows机器
2026-07-04 07:36:57 +0800 CST
view 334
WinRM for Go是纯Go实现的Windows远程管理库,支持Basic/NTLM/Kerberos认证,可通过SSH隧道穿透内网。让Go开发者像SSH连Linux一样远程操作Windows服务器,执行命令、获取输出,适合自动化运维场景。
WinRM
Go
Windows
远程管理
NTLM
Kerberos
SSH隧道
运维
PowerShell
Hermes Agent 深度拆解:110K Star 背后的「自进化」架构哲学——当一个 AI Agent 决定「越用越聪明」后,闭环学习、三层记忆与 400+ 技能的工程实战
编程
Hermes Agent 深度拆解:110K Star 背后的「自进化」架构哲学——当一个 AI Agent 决定「越用越聪明」后,闭环学习、三层记忆与 400+ 技能的工程实战
2026-08-03 08:43:47 +0800 CST
view 179
深度拆解Hermes Agent 110K Star自进化AI Agent架构:闭环学习五阶段、三层记忆系统(情景/语义/程序性)、400+技能生态、工具自注册+Toolset组合、多平台统一网关、SQLite+FTS5状态持久化,附完整代码示例与生产部署指南
Hermes Agent
Nous Research
AI Agent
自进化
闭环学习
记忆系统
Skill
Python
多平台网关
开源
Hermes Agent 深度实战:自进化 AI Agent 的架构设计与生产级部署完全指南(2026)
编程
Hermes Agent 深度实战:自进化 AI Agent 的架构设计与生产级部署完全指南(2026)
2026-05-30 16:41:27 +0800 CST
view 686
深入解析 Nous Research 开源的 Hermes Agent:六层核心架构、GEPA 自进化闭环、三层持久记忆系统、200+ 模型支持,以及从 $5 VPS 到 Modal Serverless 的完整生产级部署实战指南。
AI Agent
Hermes Agent
Nous Research
自进化
GEPA
Skill系统
生产部署
PageIndex:无向量推理驱动 RAG 革命,AI 检索如何告别向量嵌入依赖
编程
PageIndex:无向量推理驱动 RAG 革命,AI 检索如何告别向量嵌入依赖
2026-08-11 13:27:39 +0800 CST
view 169
深度拆解 PageIndex 无向量推理检索框架:从传统向量 RAG 的切块陷阱与 Embedding 失真问题出发,详细解析树形索引构建、LLM 推理定位、精确答案提取的全链路架构,含完整 Python 代码实战、性能对比与生产选型指南。
PageIndex
RAG
向量数据库
推理检索
AI
LLM
检索增强生成
无向量
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
编程
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
2026-07-16 04:19:16 +0800 CST
view 294
从工程师视角深度拆解 vLLM:PagedAttention 分页注意力、连续批处理、V1 引擎架构、KV Cache 管理、量化与投机解码,配 OpenAI 兼容服务、引导解码与生产调优实战。
vLLM
PagedAttention
连续批处理
大模型推理
GPU推理服务
KV缓存
V1引擎
CVE-2026-47101 深度解析:当 AI 网关的 RBAC 被一行 API 调用彻底瓦解——从权限校验缺陷到 proxy_admin 提权的全链路完全指南(2026)
编程
CVE-2026-47101 深度解析:当 AI 网关的 RBAC 被一行 API 调用彻底瓦解——从权限校验缺陷到 proxy_admin 提权的全链路完全指南(2026)
2026-06-15 12:16:01 +0800 CST
view 986
2026年AI基础设施领域最危险的安全事件之一:CVE-2026-47101 LiteLLM权限提升漏洞深度解析,CVSS 8.8,影响全球11.8万+实例,从漏洞根因到生产修复全链路指南
CVE
LiteLLM
RBAC
AI安全
权限提升
Python
漏洞分析
网络安全
AI基础设施
记忆宫殿走进AI时代:Milla Jovovich 开源的 MemPalace 如何让 AI 拥有真正的长期记忆
编程
记忆宫殿走进AI时代:Milla Jovovich 开源的 MemPalace 如何让 AI 拥有真正的长期记忆
2026-04-17 19:14:38 +0800 CST
view 784
好莱坞女星Milla Jovovich参与开源的AI记忆系统MemPalace深度解析:四层记忆栈架构、Drawer抽象机制、与Graphify/Claude-Mem的深度对比,以及完整的集成实战教程。
AI记忆系统
MemPalace
长期记忆
开源项目
Milla Jovovich
AI Agent
记忆宫殿
MCP协议
Pathway 深度解析:当 Python 遇上 Rust 引擎,实时 ETL 的性能革命
编程
Pathway 深度解析:当 Python 遇上 Rust 引擎,实时 ETL 的性能革命
2026-04-08 15:34:42 +0800 CST
view 937
Pathway 是一个用 Python 写业务逻辑、用 Rust 执行计算的实时 ETL 框架,基于 Differential Dataflow 实现真正的增量计算。本文深度解析其架构原理、核心用法、LLM xpack 的 RAG 应用,以及在 AI 数据流水线中的独特价值。
Pathway
ETL
Rust
Python
流处理
LLM
RAG
增量计算
四层记忆栈 + Drawer 抽象:深度解析 Milla Jovovich 开源的 MemPalace AI 记忆系统
编程
四层记忆栈 + Drawer 抽象:深度解析 Milla Jovovich 开源的 MemPalace AI 记忆系统
2026-04-17 19:14:59 +0800 CST
view 814
深度解析Milla Jovovich参与开源的MemPalace AI长期记忆系统:四层记忆栈架构、Drawer统一抽象、与Graphify/Claude-Mem的核心差异对比及集成实战。
AI记忆系统
MemPalace
长期记忆
开源项目
Milla Jovovich
AI Agent
记忆宫殿
MCP协议
Browser-Use 深度拆解:当 AI 学会「看懂网页」——可访问性树、Playwright 内核与感知-决策-执行闭环如何重写浏览器自动化的心智模型
编程
Browser-Use 深度拆解:当 AI 学会「看懂网页」——可访问性树、Playwright 内核与感知-决策-执行闭环如何重写浏览器自动化的心智模型
2026-07-16 06:44:38 +0800 CST
view 614
从工程师视角深度拆解 Browser-Use:Playwright/CDP 内核、可访问性树感知、感知-决策-执行闭环、动作空间与系统提示词设计,并手写一个迷你 browser agent,配 Token 优化与自愈实战。
Browser-Use
AI浏览器自动化
Playwright
可访问性树
AI Agent
RPA
LLM
Skills:AI Agent 基础设施化的全链路深度解析——从概念验证到生产落地的架构革命
编程
Skills:AI Agent 基础设施化的全链路深度解析——从概念验证到生产落地的架构革命
2026-08-12 01:20:30 +0800 CST
view 189
深度拆解 2026年8月 GitHub Trending 上 AI Agent Skills/Radio/Memory 三层基础设施架构,涵盖 Skills 标准化技能规范、Radio 多 Agent 通信协议、Memory 持久化记忆系统,含完整 Python/JavaScript 代码实战与 20 条生产踩坑清单。
AI Agent
Skills层
Radio层
Memory层
Multi-Agent
多智能体
基础设施
开源生态
Hermes Agent 深度拆解:当 AI 终于学会「从经验中学习」——三层记忆、Skill 自进化与后台 Review 机制的全链路实战
编程
Hermes Agent 深度拆解:当 AI 终于学会「从经验中学习」——三层记忆、Skill 自进化与后台 Review 机制的全链路实战
2026-08-18 10:14:12 +0800 CST
view 93
深度拆解 Hermes Agent:三层记忆架构(L1 核心记忆 + L2 用户画像 + L3 会话记忆)、Skill 自进化机制(前台执行 + 后台 Review)、闭环学习系统。配完整代码实战与生产部署指南。
Hermes Agent
AI Agent
三层记忆
Skill 自进化
Nous Research
VibeVoice 深度实战:当微软把「超长对话语音」开源——从 7.5Hz 连续分词到 Next-Token Diffusion、从 90 分钟 TTS 到 60 分钟 ASR 的生产级完全指南(2026)
编程
VibeVoice 深度实战:当微软把「超长对话语音」开源——从 7.5Hz 连续分词到 Next-Token Diffusion、从 90 分钟 TTS 到 60 分钟 ASR 的生产级完全指南(2026)
2026-06-21 05:52:51 +0800 CST
view 529
深度解析微软开源语音AI项目VibeVoice:从7.5Hz连续分词器到Next-Token Diffusion架构,从90分钟TTS到60分钟ASR的生产级完全指南。
VibeVoice
语音AI
微软开源
TTS
ASR
扩散模型
LLM
OmniRoute 深度解析:237家AI提供商的智能网关——从架构原理到生产级部署的完整技术指南(2026)
编程
OmniRoute 深度解析:237家AI提供商的智能网关——从架构原理到生产级部署的完整技术指南(2026)
2026-07-04 12:13:30 +0800 CST
view 841
OmniRoute 深度解析:开源AI网关,连接237家AI提供商(90+免费),RTK+Caveman压缩节省15-95% token,17种路由策略,4层自动降级,从架构原理到生产部署。
OmniRoute
AI网关
LLM路由
AI编程
Token压缩
成本优化
开源
2077
1300人收藏的元Skill创建框架:yao-meta-skill工程化构建可复用技能包
编程
1300人收藏的元Skill创建框架:yao-meta-skill工程化构建可复用技能包
2026-06-21 07:12:20 +0800 CST
view 487
yao-meta-skill 是1300+人收藏的元Skill创建框架,提供从意图对话到跨平台打包的完整工程化流程。支持三种运行模式、多层次质量评估、中立元数据跨平台分发,可移植性评分100/100。
AI
Skill工程
Agent
开源
提示词
工程化
MCP
跨平台
评估
治理
AI Agent的Skills管理指南:从混乱到有序的三步整理法
编程
AI Agent的Skills管理指南:从混乱到有序的三步整理法
2026-04-28 03:26:55 +0800 CST
view 806
AI Agent Skills装太多找不到?三步整理法:让Agent帮你分类、建立Skills索引文件、定期清理归档。覆盖Claude Code、OpenClaw、Cursor、Hermes Agent等多平台适配,附赠索引模板、场景映射表和清理检查清单。
AI Agent
Skills管理
整理方法
效率提升
Zig 语言宣布「封杀」AI 贡献:开源社区最激烈的一次价值撕裂
编程
Zig 语言宣布「封杀」AI 贡献:开源社区最激烈的一次价值撕裂
2026-05-15 18:44:30 +0800 CST
view 703
深入剖析 Zig 语言官方封杀 AI 贡献的核心逻辑,从 Contributor Poker 概念出发,探讨 LLM 如何摧毁开源社区的信任基础设施,以及 Bun fork 的连锁反应。
Zig
AI
LLM
开源社区
编程语言
具身智能深度拆解:当 AI 走出屏幕、走进现实——从感知到行动的物理世界闭环全链路实战
编程
具身智能深度拆解:当 AI 走出屏幕、走进现实——从感知到行动的物理世界闭环全链路实战
2026-08-18 13:17:03 +0800 CST
view 139
深度拆解 2026 年最热技术方向——具身智能(Physical AI/Embodied AI):从多模态感知、大模型任务规划、强化学习控制到生产部署的全链路实战,附完整 Python/ROS2/C++ 代码
具身智能
Physical AI
机器人
LLM任务规划
强化学习
力位混合控制
Isaac Gym
多模态感知
工业机器人
人形机器人
智能制造
机器臂控制
编程
MarkItDown 深度解析:微软开源的文档转换神器如何重塑 LLM 时代的知识处理流水线
2026-04-18 06:17:21 +0800 CST
view 740
深度解析微软开源的 MarkItDown 文档转换工具,从架构设计、源码实现到实战应用,揭秘它如何成为 LLM 时代知识处理的基础设施。
MarkItDown
微软开源
文档转换
LLM
RAG
Python工具
Markdown
PDF转换
编程
Microsoft Markitdown 深度解析:AI工作流中的文档转换基础设施——从架构原理到生产级部署的完整技术指南(2026)
2026-07-04 14:12:12 +0800 CST
view 299
深度解析Microsoft Markitdown:Python文档转换工具,支持PDF/Word/Excel/PPT/图片/音频转Markdown,为LLM/AI工作流量身定制。涵盖架构原理、Python API实战、RAG集成、性能优化、生产部署最佳实践。
Markitdown
Microsoft
文档转换
RAG
AI工作流
Python
LLM
Markdown
向量数据库
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
编程
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
2026-08-03 17:14:27 +0800 CST
view 605
深度拆解Qwen3.8-Max 2.4万亿参数MoE大模型架构:稀疏混合专家路由机制、混合注意力1M上下文、GQA KV Cache优化、量化部署实战、vLLM推理优化,附完整代码示例与性能基准分析
Qwen3.8
MoE
大模型
阿里巴巴
通义千问
混合专家
1M上下文
稀疏注意力
量化部署
vLLM
开源
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
91
92
93
94
下一页