程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
从PagedAttention到Prefix Caching:2026年LLM推理KV Cache优化工程实践
编程
从PagedAttention到Prefix Caching:2026年LLM推理KV Cache优化工程实践
2026-07-07 16:15:25 +0800 CST
view 209
深入解析2026年大模型推理中的KV Cache优化技术栈:从PagedAttention虚拟分页管理、Prefix Caching缓存复用、Speculative Decoding并行验证,到INT8量化与Continuous Batching生产实践,配合代码示例与性能对比,助你系统性掌握LLM推理优化的核心要领。
LLM
KV Cache
PagedAttention
Prefix Caching
vLLM
推理优化
Speculative Decoding
命令行是 AI Agent 的「高考」:Terminal Bench 2.1 如何用真实任务测出模型上限
编程
命令行是 AI Agent 的「高考」:Terminal Bench 2.1 如何用真实任务测出模型上限
2026-08-15 17:16:04 +0800 CST
view 143
深度拆解2026年最权威AI Agent评测体系Terminal Bench 2.1:用真实终端任务替代静态题库,从规划能力、工具选择、错误处理等五大维度全面评估Agent水平
Terminal Bench
AI Agent
评测基准
模型评估
LLM
强化学习
Shell
命令行
Browser-Use 深度解析:当AI学会看网页——79k Stars背后的浏览器自动化革命
编程
Browser-Use 深度解析:当AI学会看网页——79k Stars背后的浏览器自动化革命
2026-04-14 06:26:31 +0800 CST
view 1320
Browser-Use是GitHub 79k+ Stars的AI浏览器自动化框架,通过LLM驱动实现自然语言控制浏览器。本文深度解析其架构设计、双模态页面理解、多模型集成机制,并附完整代码实战示例。
Browser-Use
浏览器自动化
AI Agent
Playwright
LLM驱动
Karpathy AutoResearch 深度解析:630行代码如何让AI学会「自己做研究」
编程
Karpathy AutoResearch 深度解析:630行代码如何让AI学会「自己做研究」
2026-04-23 10:51:04 +0800 CST
view 966
深入解析Andrej Karpathy的开源项目AutoResearch,630行Python代码如何实现AI自主研究,探讨约束驱动的设计哲学与工程实践
Python
机器学习
AI Agent
深度学习
自动优化
Scrapling 深度实战:当网页抓取学会「反侦察」——从反爬虫战争到 AI Agent 数据采集的完全指南(2026)
编程
Scrapling 深度实战:当网页抓取学会「反侦察」——从反爬虫战争到 AI Agent 数据采集的完全指南(2026)
2026-06-13 19:21:12 +0800 CST
view 568
深入解析 Scrapling——GitHub 52k+ Star 的自适应网页抓取框架,融合反爬绕过、AI 智能选器与 auto_match 自适应解析,深度剖析其在 AI Agent 数据采集场景中的实战应用
Scrapling
Python
爬虫
AI Agent
反爬技术
数据采集
Web Scraping
Agent 能力哪家强?2026 年 8 月主流大模型 Terminal Bench 横向评测:数据、趋势与选型指南
编程
Agent 能力哪家强?2026 年 8 月主流大模型 Terminal Bench 横向评测:数据、趋势与选型指南
2026-08-15 17:19:35 +0800 CST
view 145
2026年8月最新Terminal Bench 2.1评测数据横评:Kimi K3/DeepSeek V4-Pro/Claude Opus 4.8等六大模型在五大维度的真实表现差异,配选型决策框架与成本效益分析
Terminal Bench
AI Agent
评测基准
大模型对比
Kimi
DeepSeek
Claude
Fable 5
选型指南
Odysseus 深度实战:当 YouTuber 之王用代码掀翻云端 AI 霸权——从自托管工作空间到生产级本地 Agent 的完全指南(2026)
编程
Odysseus 深度实战:当 YouTuber 之王用代码掀翻云端 AI 霸权——从自托管工作空间到生产级本地 Agent 的完全指南(2026)
2026-06-13 19:51:26 +0800 CST
view 760
PewDiePie开源的Odysseus自托管AI工作空间深度实战指南:从架构设计、LLM集成、Agent系统、记忆系统到安全架构的完全解析
Odysseus
自托管AI
PewDiePie
Agent
MCP
本地LLM
FastAPI
ChromaDB
Hermes Agent 深度解析:自进化 AI 代理框架的设计哲学与工程实践
编程
Hermes Agent 深度解析:自进化 AI 代理框架的设计哲学与工程实践
2026-04-23 12:09:35 +0800 CST
view 752
深度解析 Hermes Agent 的架构设计、三层能力体系、四阶段闭环学习机制,附部署实战与性能优化指南,约12000字。
AI Agent
Hermes
自我进化
Nous Research
持久记忆
技能系统
Claude写代码错误率从41%降到3%:Karpathy的12条CLAUDE.md规则实战全解
编程
Claude写代码错误率从41%降到3%:Karpathy的12条CLAUDE.md规则实战全解
2026-06-13 21:46:46 +0800 CST
view 741
从Karpathy原始4条规则到扩展12条规则的完整实战指南,覆盖token预算、测试质量、多步骤工作流等原始规则未触达的核心场景
AI编程
Claude Code
Karpathy
CLAUDE.md
Agent工程化
Prompt工程
CUA 深度实战:当 AI Agent 真正掌控桌面操作系统——从沙盒隔离到 Computer-Use Agents 的生产级基础设施完全指南(2026)
编程
CUA 深度实战:当 AI Agent 真正掌控桌面操作系统——从沙盒隔离到 Computer-Use Agents 的生产级基础设施完全指南(2026)
2026-06-18 23:28:31 +0800 CST
view 1103
深入解析 trycua/cua 开源项目:Computer-Use Agents 领域的生产级基础设施,包含五大核心模块的架构剖析、代码实战与安全架构设计
AI Agent
Computer Use
CUA
开源
沙盒
LLM
LangGraph 深度实战:从状态图到生产级 Agent 系统——用图结构重新定义 AI 工程边界
编程
LangGraph 深度实战:从状态图到生产级 Agent 系统——用图结构重新定义 AI 工程边界
2026-04-14 10:54:15 +0800 CST
view 1078
深度解析 LangGraph 核心架构与实战用法:状态机、节点/边设计、Human-in-the-Loop、多 Agent 协作、生产级持久化部署,附代码审查 Agent 完整案例,5000字+实战长文。
LangGraph
AI Agent
Python
LangChain
多智能体
Hermes Agent 生态全攻略:一文搞定 80+ 高阶工具配置
案例
Hermes Agent 生态全攻略:一文搞定 80+ 高阶工具配置
2026-05-05 19:03:32 +0800 CST
view 1114
Hermes Agent全生态配置工具清单,80+款工具14大分类,知识库、Token监控、内容抓取、浏览器自动化、一键部署全覆盖,17项零成本方案
Hermes
AI Agent
工具配置
工作流
零成本方案
Superpowers 深度解析:让 AI 编程助手拥有「超能力」的工程化工作流框架——从 TDD 强制执跑到生产级代码交付的完整技术内幕
编程
Superpowers 深度解析:让 AI 编程助手拥有「超能力」的工程化工作流框架——从 TDD 强制执跑到生产级代码交付的完整技术内幕
2026-05-18 14:18:05 +0800 CST
view 968
深度解析 GitHub 78,000+ Star 的 AI 编程工程化框架 Superpowers,揭秘其如何通过结构化技能系统将 AI 编码助手从「代码生成器」进化为「软件工程师伙伴」
AI编程
AI Agent
TDD
工程化
Superpowers
trycua/cua 深度实战:YC支持的 Computer-Use Agents 开源基础设施完全指南——五大模块架构解析、沙盒操控与生产级代码实战(2026)
编程
trycua/cua 深度实战:YC支持的 Computer-Use Agents 开源基础设施完全指南——五大模块架构解析、沙盒操控与生产级代码实战(2026)
2026-06-18 23:29:38 +0800 CST
view 717
深入解析 trycua/cua 开源项目:Computer-Use Agents 领域的生产级基础设施,包含五大核心模块的架构剖析、代码实战与安全架构设计
AI Agent
Computer Use
CUA
开源
沙盒
LLM
Cursor Origin: GitHub的终结者?AI Agent时代的代码基础设施革命
编程
Cursor Origin: GitHub的终结者?AI Agent时代的代码基础设施革命
2026-07-07 20:48:33 +0800 CST
view 337
2026年6月Cursor发布Origin平台,从零构建面向AI Agent的代码托管基础设施。本文深入解析Origin的技术架构、与GitLab Next Gen/Zed DeltaDB的竞争格局,以及AI时代开发者生产力度量标准的革命性变化。
Cursor
Origin
GitHub
AI Agent
代码托管
Infrastructure
AI 时代的 USB 接口迎来最大升级:MCP 协议 2026-07-28 规范候选版深度解析
编程
AI 时代的 USB 接口迎来最大升级:MCP 协议 2026-07-28 规范候选版深度解析
2026-06-26 14:16:30 +0800 CST
view 521
45天后这些代码将全部失效——深度解析MCP 2026-07-28规范的七大破坏性变更:会话移除、OAuth 2.1强制接入、Streamable HTTP传输层升级,以及从有状态到无状态的完整迁移实战指南。
MCP
AI-Protocol
OAuth
开发者工具
Agent
无状态架构
Streamable HTTP
协议规范
TypeScript
Python
Superpowers 深度解析:当AI编码智能体学会"测试驱动开发"——从提示词工程到工程化工作流的范式革命
编程
Superpowers 深度解析:当AI编码智能体学会"测试驱动开发"——从提示词工程到工程化工作流的范式革命
2026-04-14 13:57:16 +0800 CST
view 1200
Superpowers是GitHub 11万+星的开源项目,通过强制性TDD工作流让AI编码助手从"会写代码"进化到"会做工程"。本文深度解析其技能系统、子代理驱动开发和工程化实践。
AI
Agent
TDD
Superpowers
Claude Code
Cursor
测试驱动开发
工程化
MiniMax M3 & MSA 深度实战:当国产大模型用「稀疏注意力」重写 Transformer 规则——从 1M 上下文架构原理到生产级 Agent 部署的完全指南(2026)
编程
MiniMax M3 & MSA 深度实战:当国产大模型用「稀疏注意力」重写 Transformer 规则——从 1M 上下文架构原理到生产级 Agent 部署的完全指南(2026)
2026-06-13 23:46:46 +0800 CST
view 645
深度拆解MiniMax M3的MSA稀疏注意力架构:两级路由原理、MSA vs MoE技术对比、1M上下文实战、Agent部署、性能基准测试、选型决策指南
MiniMax M3
MSA
稀疏注意力
大模型
Agent
AI
Transformer
开源模型
TencentDB Agent Memory 深度解析:让 AI Agent 拥有真正「记忆」的分层架构革命——从61.38% Token节省到四层金字塔的技术内幕
编程
TencentDB Agent Memory 深度解析:让 AI Agent 拥有真正「记忆」的分层架构革命——从61.38% Token节省到四层金字塔的技术内幕
2026-05-18 15:13:25 +0800 CST
view 556
腾讯云开源TencentDB Agent Memory,用四层金字塔架构解决AI Agent健忘问题。实测最高节省61.38% Token,任务通过率提升51.52%。
AI Agent
记忆系统
腾讯云
开源项目
架构设计
80个Agent之后,AI团队终于不用自己写Agent了
代码
80个Agent之后,AI团队终于不用自己写Agent了
2026-07-02 13:29:20 +0800 CST
view 261
Rakuten France用4人AI团队服务全公司80+Agent,关键是把Agent从项目变成生产线:Agent Builder让业务团队自己创建Agent,Shared SOP统一规范,Registry解决治理难题。
AI
Agent
组织变革
数字化转型
Rakuten
Notion
民主化
MiMo Code 深度实战:当小米用 1 万亿参数杀入 AI 编程 Agent 赛道——从持久记忆到 Max Mode、从四层记忆体系到动态工作流的生产级完全指南(2026)
编程
MiMo Code 深度实战:当小米用 1 万亿参数杀入 AI 编程 Agent 赛道——从持久记忆到 Max Mode、从四层记忆体系到动态工作流的生产级完全指南(2026)
2026-06-19 01:25:01 +0800 CST
view 773
2026年6月小米正式开源MiMo Code V0.1.0,一款面向终端的AI编程助手。本文深度解析其架构设计:计算层Max Mode多采样机制、记忆层四层持久记忆体系、进化层Dream/Distill模式,以及与Claude Code的深度对比评测。
AI编程
MiMo Code
小米
Agent
长程任务
编程助手
DeepSeek Harness:开源智能体框架的架构革命,从 Cordis 插件驱动到 Vibe Coding 全链路实战
编程
DeepSeek Harness:开源智能体框架的架构革命,从 Cordis 插件驱动到 Vibe Coding 全链路实战
2026-08-15 19:43:44 +0800 CST
view 174
深度解析DeepSeek Harness的架构设计:Cordis插件协议、三层记忆上下文管理、ReAct+Plan混合推理模式,配完整代码示例与生产级代码审查Agent实战
DeepSeek Harness
DSH
Cordis
Agent框架
智能体
开源
AI编程
Vibe Coding
插件协议
MCP v0.28 规范深度解剖:无状态核心、能力治理与证据链——从连接协议到生产级 AI 基础设施的完整指南
编程
MCP v0.28 规范深度解剖:无状态核心、能力治理与证据链——从连接协议到生产级 AI 基础设施的完整指南
2026-07-26 07:48:38 +0800 CST
view 175
测试文章
MCP
AI Agent
PraisonAI:5行代码部署多智能体团队的全功能AI框架
编程
PraisonAI:5行代码部署多智能体团队的全功能AI框架
2026-05-13 17:59:33 +0800 CST
view 754
PraisonAI是一个全功能多智能体AI框架,5行代码即可部署多智能体团队。支持AutoGen、CrewAI等多种后端,提供可视化界面和简化API,降低多Agent开发门槛。
PraisonAI
多智能体
AI Agent
开源框架
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
49
50
51
52
53
...
92
下一页