程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Agent Skills 深度解析:Addy Osmani 如何用纯 Markdown 给 AI 编程助手装上「工程纪律」
编程
Agent Skills 深度解析:Addy Osmani 如何用纯 Markdown 给 AI 编程助手装上「工程纪律」
2026-05-11 15:53:36 +0800 CST
view 842
Google Chrome 工程总监 Addy Osmani 发布了一个名为 agent-skills 的开源项目,通过将 Google 内部严苛的工程规范编码为 AI Agent 可直接执行的纯 Markdown 工作流,让 AI 编程助手从「能跑就行」进化到「可以安全合并」。
Agent Skills
AI编程
Addy Osmani
Claude Code
工程规范
Cursor
Markdown
工作流
Google工程
llmfit 深度拆解:一条命令算出你的电脑能跑哪些大模型——硬件感知适配引擎的工程解剖
编程
llmfit 深度拆解:一条命令算出你的电脑能跑哪些大模型——硬件感知适配引擎的工程解剖
2026-07-24 18:44:04 +0800 CST
view 234
深度拆解 GitHub Trending 开源工具 llmfit:四维评分系统、量化自动试探、MoE 精算、带宽速度模型、Plan 模式与 bench 众包校准,从第一性原理讲透本地大模型的硬件适配方法论。
llmfit
本地大模型
LLM
Rust
量化
Ollama
llama.cpp
Apple Silicon
硬件适配
开源
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
编程
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
2026-07-19 09:14:11 +0800 CST
view 1124
纯C语言实现的大模型推理引擎,仅用1300行代码在25GB内存笔记本上运行744B参数的GLM-5.2 MoE模型,含完整代码示例与技术解析
C语言
GLM-5.2
MoE
大模型推理
量化
AVX2
MLA注意力
推测解码
Apple Silicon
OpenCode 深度解析:160K Stars 的开源 AI 编程 Agent 如何用 LSP 感知 + 多会话并行 + 75+ 模型支持重新定义终端编程体验——从架构设计到生产级工作流的完整实战指南
编程
OpenCode 深度解析:160K Stars 的开源 AI 编程 Agent 如何用 LSP 感知 + 多会话并行 + 75+ 模型支持重新定义终端编程体验——从架构设计到生产级工作流的完整实战指南
2026-07-06 21:15:45 +0800 CST
view 391
深度解析GitHub 160K+ Stars的OpenCode开源AI编程Agent:LSP代码智能感知、Plan/Build双模式工作流、75+模型提供商支持、Zen模型网关、MCP协议扩展、多会话并行、Bubble Tea TUI架构、Agent技能系统、OAuth自动认证、GitHub Copilot集成。从架构设计到生产级工作流的完整实战指南,含完整代码示例与竞品对比分析。
OpenCode
AI编程
终端
开源
Agent
LSP
MCP
Bubble Tea
Zen
多会话
万字深度解析 Everything Claude Code(ECC):当AI编程助手拥有工程化武装——从Agent Harness架构到生产级AI开发工作流的完整指南(2026)
编程
万字深度解析 Everything Claude Code(ECC):当AI编程助手拥有工程化武装——从Agent Harness架构到生产级AI开发工作流的完整指南(2026)
2026-07-01 09:30:58 +0800 CST
view 475
2026年GitHub最火AI编程增强项目深度解析:Everything Claude Code以20万Star登顶,涵盖六层架构、61个子代理、246个技能、AgentShield安全体系的生产级实战指南
ECC
AI编程
Claude Code
Agent
Agent Harness
工程化
Skills
Rules
Instincts
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
编程
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
2026-07-01 14:44:55 +0800 CST
view 372
Nano-vLLM:用约1200行Python代码实现的轻量级vLLM替代方案。深度解析KV Cache管理、GQA注意力、RoPE位置编码、Continuous Batching等核心技术,Benchmark性能超越vLLM 5.3%。适合学习大模型推理原理和内网轻量级部署。
Nano-vLLM
大模型推理
LLM
Tensor Parallelism
KV Cache
Continuous Batching
Python
PyTorch
Qwen2
开源项目
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
编程
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
2026-05-18 06:15:03 +0800 CST
view 821
Redis之父antirez开源ds4.c项目深度解析:用纯C语言在MacBook上运行284B参数大模型,不对称2-bit量化、KV缓存磁盘化、OpenAI/Anthropic API兼容,打造首个真正的本地Agent推理后端
AI推理
本地大模型
Redis
Apple Silicon
DeepSeek
A2A Protocol 深度解析:让 AI Agent 真正"组队开黑"的通信革命
编程
A2A Protocol 深度解析:让 AI Agent 真正"组队开黑"的通信革命
2026-07-07 18:44:21 +0800 CST
view 277
深度解析 Google 开源的 A2A Protocol(Agent-to-Agent Protocol),这是让不同框架、不同厂商的 AI Agent 能够相互发现、通信和协作的开放标准。文章涵盖协议设计、核心概念、实战代码、企业级应用实践,以及与 MCP 的对比分析。
A2A
Agent
Protocol
AI
Google
Linux Foundation
Go 1.24 深度实战:统一类型参数、if-switch 泛型增强与标准库新增的 collections/prr 三大特性全景解析
编程
Go 1.24 深度实战:统一类型参数、if-switch 泛型增强与标准库新增的 collections/prr 三大特性全景解析
2026-08-15 17:35:36 +0800 CST
view 110
深度解析Go 1.24三大新特性:统一类型参数让渐进式泛化成为可能,if-switch泛型增强让类型分支获得编译时优化,collections/prr让优先队列开箱即用,配完整代码示例与性能对比
Go
Go1.24
泛型
collections
prr
类型参数
工程实践
Golang
Go 1.24 新特性实战:泛型三大改进如何让代码库平滑演进
编程
Go 1.24 新特性实战:泛型三大改进如何让代码库平滑演进
2026-08-15 17:36:44 +0800 CST
view 115
Go 1.24泛型三大改进实战:统一类型参数实现零成本迁移,if-switch获得编译时优化,collections/prr替代手写heap
Go
Go1.24
泛型
collections
prr
类型参数
工程实践
Golang
AI 时代的 USB 接口迎来最大升级:MCP 协议 2026-07-28 规范候选版深度解析
编程
AI 时代的 USB 接口迎来最大升级:MCP 协议 2026-07-28 规范候选版深度解析
2026-06-26 14:16:30 +0800 CST
view 527
45天后这些代码将全部失效——深度解析MCP 2026-07-28规范的七大破坏性变更:会话移除、OAuth 2.1强制接入、Streamable HTTP传输层升级,以及从有状态到无状态的完整迁移实战指南。
MCP
AI-Protocol
OAuth
开发者工具
Agent
无状态架构
Streamable HTTP
协议规范
TypeScript
Python
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
编程
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
2026-07-20 18:18:40 +0800 CST
view 470
深度拆解 Ollama 工程架构:Go 服务层封装 llama.cpp、CGO 内存边界、GGUF 量化格式、Modelfile DSL、OpenAI 兼容层、Metal GPU 加速与生产部署实战,配完整 Go/Python/Shell 代码示例。
Ollama
本地大模型
llama.cpp
GGUF
Go
CGO
量化
Apple Silicon
Swift 6 深度实战:Strict Concurrency Checking 如何把「数据竞争」从语言层面赶尽杀绝——从 Actor 模型到 Sendable 协议全链路拆解
编程
Swift 6 深度实战:Strict Concurrency Checking 如何把「数据竞争」从语言层面赶尽杀绝——从 Actor 模型到 Sendable 协议全链路拆解
2026-08-16 13:45:04 +0800 CST
view 150
深度拆解 Swift 6 的 Strict Concurrency Checking:从 Actor 模型、Sendable 协议、strict-concurrency-checking 三种模式,到 Sendable 违规修复、生产级 Actor 架构设计与性能优化,配完整可运行代码与迁移指南。
Swift
Swift 6
Strict Concurrency
Actor
Sendable
并发编程
iOS开发
Bun 从 Zig 到 Rust 的六天重写:当 AI 开始重写运行时本身——从内存泄漏到 --cpu-prof-md、从 Claude Code 到开发者工具链的 AI 原生革命(2026)
编程
Bun 从 Zig 到 Rust 的六天重写:当 AI 开始重写运行时本身——从内存泄漏到 --cpu-prof-md、从 Claude Code 到开发者工具链的 AI 原生革命(2026)
2026-06-20 10:56:29 +0800 CST
view 452
Bun六天从Zig重写为Rust的深度分析:内存泄漏、--cpu-prof-md AI原生调试、Claude Code与运行时质量之问、Drizzle ORM JIT优化实战
Bun
Rust
Zig
AI编程
JavaScript运行时
Claude Code
CPU Profiling
Drizzle ORM
Rust core::simd 跑进 GPU warp:VectorWare 把 SIMT 还原成 SIMD 的那一刀——从 lane 映射到类型化 Warp IR 的全链路拆解
编程
Rust core::simd 跑进 GPU warp:VectorWare 把 SIMT 还原成 SIMD 的那一刀——从 lane 映射到类型化 Warp IR 的全链路拆解
2026-08-11 05:20:02 +0800 CST
view 126
深度拆解 VectorWare 让 Rust portable SIMD 跑上 GPU:为何 SIMT 本质就是 SIMD、warp-as-thread 与 lane-as-simd-lane 的双层映射、四类算子到 shfl.sync/vote.sync/redux.sync 的下降路径、类型化 Warp IR 如何用 const generic 杜绝非法程序、strip mining 与掩码加载实战、寄存器压力与横向算子同步点的性能陷阱,含十四条踩坑清单。
Rust
core::simd
GPU编程
SIMT
CUDA
PTX
warp
portable SIMD
rust-gpu
异构计算
向量化
VectorWare
性能优化
编译器
从「通用大模型」到「专业同事」:Anthropic 官方开源 Knowledge Work Plugins 完全解读(2026)
编程
从「通用大模型」到「专业同事」:Anthropic 官方开源 Knowledge Work Plugins 完全解读(2026)
2026-05-30 18:13:23 +0800 CST
view 824
Anthropic 官方开源 Knowledge Work Plugins,11个职业角色插件让 Claude 从通用AI进化为专业同事。深度解析三层架构、技能命令、MCP连接器,以及如何构建企业专属AI插件。
Claude
Anthropic
Knowledge Work Plugins
MCP
AI Agent
Cowork
企业AI
职业AI
开源
2026
llmfit 深度拆解:Rust 写就的本地大模型选型神器——一行命令把"显存够不够跑"从玄学变成算术
编程
llmfit 深度拆解:Rust 写就的本地大模型选型神器——一行命令把"显存够不够跑"从玄学变成算术
2026-08-18 08:15:14 +0800 CST
view 159
llmfit 是一款 Rust 编写的本地大模型选型工具,一行命令自动检测硬件配置,精确计算显存占用,给出 Fit 评分和速度估算,支持 Ollama、llama.cpp、MLX 等多运行时,配可运行代码与最佳实践。
llmfit
Rust
TUI
本地大模型
LLM推理
Ollama
llama.cpp
模型选型
量化
Apple Silicon
GPU
显存计算
MLX
命令行工具
从购物清单到 AI 编程助手:深度解析 Bubble Tea 架构如何驱动 14 万星开源项目 OpenCode
编程
从购物清单到 AI 编程助手:深度解析 Bubble Tea 架构如何驱动 14 万星开源项目 OpenCode
2026-04-17 21:18:16 +0800 CST
view 810
深度解析 Bubble Tea(基于 Elm 架构的 Go 语言 TUI 框架)如何驱动 GitHub 14.4万星的开源 AI 编程助手 OpenCode,涵盖三层 Agent 架构、Provider-Agnostic 设计、客户端/服务器架构等核心技术。
Bubble Tea
OpenCode
TUI
Go
AI编程助手
Elm架构
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
编程
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
2026-05-15 17:47:40 +0800 CST
view 1054
深入解析 antirez(Redis 作者)新开源项目 ds4:DwarfStar 4 本地推理引擎,专门为 DeepSeek V4 Flash 打造,支持 Metal/CUDA 后端,2-bit 量化可在 96GB 内存 MacBook 上运行 284B 参数模型。
AI推理
本地部署
DeepSeek
Redis
Apple Silicon
CUDA
Metal
MoE
量化
OpenClaw 深度拆解:当 33 万 Star 的开源 AI Agent 决定「住在你的机器上」——Gateway、Skill、LCM 三层架构如何重新定义「个人 AI 助手」
编程
OpenClaw 深度拆解:当 33 万 Star 的开源 AI Agent 决定「住在你的机器上」——Gateway、Skill、LCM 三层架构如何重新定义「个人 AI 助手」
2026-08-03 16:43:09 +0800 CST
view 235
深度拆解OpenClaw 33万Star开源AI Agent架构:Gateway多通道消息网关、Agent智能体层、Skill可插拔技能系统、LCM无损上下文管理DAG存储、插件化设计、多平台接入50+通信平台,附完整代码示例与性能优化实战指南
OpenClaw
AI Agent
Gateway
Skill
LCM
Lossless Context Management
插件系统
多通道网关
本地优先
开源
OpenClaw 架构全解析:Gateway+Agent+Skill 三层协同如何让 AI 助手真正「住在你的机器上」——从 33 万 Star 到无损记忆系统的工程实践
编程
OpenClaw 架构全解析:Gateway+Agent+Skill 三层协同如何让 AI 助手真正「住在你的机器上」——从 33 万 Star 到无损记忆系统的工程实践
2026-08-03 16:46:25 +0800 CST
view 210
深度拆解OpenClaw 33万Star开源AI Agent架构:Gateway多通道消息网关、Agent智能体层、Skill可插拔技能系统、LCM无损上下文管理DAG存储、插件化设计、多平台接入50+通信平台,附完整代码示例与性能优化实战指南
OpenClaw
AI Agent
Gateway
Skill
LCM
Lossless Context Management
插件系统
多通道网关
本地优先
开源
A2A Protocol 深度解析:让所有 AI Agent 说同一种语言——从 Agent Card 到任务生命周期、从跨框架协作到生产级部署的完整技术指南(2026)
编程
A2A Protocol 深度解析:让所有 AI Agent 说同一种语言——从 Agent Card 到任务生命周期、从跨框架协作到生产级部署的完整技术指南(2026)
2026-07-04 15:16:17 +0800 CST
view 581
2026年AI Agent协议深度解析:Google主导的A2A协议如何让不同框架的Agent说同一种语言。涵盖Agent Card、任务状态机、SSE流式处理、A2A vs MCP对比、Python/TypeScript代码实战、企业级部署案例。
A2A Protocol
Agent-to-Agent
AI Agent
多智能体协作
Google A2A
Linux Foundation
OpenTelemetry 2.0 深度拆解:从「三大支柱」到「四位一体」——Continuous Profiling 时代工程师生存指南
编程
OpenTelemetry 2.0 深度拆解:从「三大支柱」到「四位一体」——Continuous Profiling 时代工程师生存指南
2026-08-12 10:15:53 +0800 CST
view 168
> 本文聊聊 OpenTelemetry 2.0 路线图、Continuous Profiling 工程化落地,以及 2026 年可观测性领域最值得关注的三个范式迁移。配 Go/Python/TypeScript 完整代码实战,以及生产踩坑清单。 过去十年,Metrics(指标)、Logging(日志)、Tracing(追踪)被并称为可观测性的"三大支柱"。这个框架由 Google SRE Book 推广,被 Prometheus 社区和 CNCF 生态广泛采纳,几乎成了某种行业公理。 但这个框架有一个根本
OpenTelemetry
OTel 2.0
Continuous Profiling
eBPF
云原生
可观测性
Go
Python
Java
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
编程
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
2026-06-16 01:17:28 +0800 CST
view 980
llama.cpp 是端侧 LLM 推理的事实标准(180K+ Stars)。本文从源码架构、GGUF 格式、量化方法、跨平台后端、生产部署、性能优化到 DeepSeek V4 Flash 实战,全方位讲解本地 AI 推理。
llama.cpp
GGUF
量化
端侧推理
本地AI
C/C++
Apple Silicon
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
38
39
40
41
42
...
97
下一页