程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Peri 深度拆解:一个 14MB 的 Rust 编程智能体如何「复刻」Claude Code——从 ACP 协议到 99% AI 生成代码的工程哲学
编程
Peri 深度拆解:一个 14MB 的 Rust 编程智能体如何「复刻」Claude Code——从 ACP 协议到 99% AI 生成代码的工程哲学
2026-08-03 18:12:06 +0800 CST
view 237
深度拆解Peri 14MB Rust编程智能体架构:ACP开放协议前端解耦、7子代理Fork模式、Ultracode动态工作流、Goal跨回合目标追踪、95-99%缓存命中率、Claude Code生态零迁移兼容,附完整安装代码与多模型配置实战指南
Peri
Rust
AI Agent
Claude Code
ACP
编程智能体
终端AI
代码生成
DeepSeek
开源
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
编程
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
2026-08-03 19:12:41 +0800 CST
view 286
深度拆解DeepSeek V4-Flash 284B MoE架构:CSA+HCA混合压缩注意力机制让1M上下文KV Cache降至V3.2的7%,Muon优化器替代AdamW,Agent能力跃迁至Terminal Bench 82.7分,13B激活参数推理成本仅0.88元/530万token,附完整部署代码与性能优化实战指南
DeepSeek
V4-Flash
MoE
CSA
HCA
Muon优化器
Agent
大模型
开源
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
编程
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
2026-04-28 08:19:25 +0800 CST
view 773
深度解析 DeepSeek V4:混合注意力机制、MoE 架构、100万token 上下文、Agent 能力,从技术原理到部署实战,全面剖析开源模型新天花板
DeepSeek
AI大模型
开源
长上下文
MoE
混合注意力
Agent
DwarfStar 4深度解析:Redis之父如何用500行C代码重塑本地大模型推理
编程
DwarfStar 4深度解析:Redis之父如何用500行C代码重塑本地大模型推理
2026-06-29 01:19:31 +0800 CST
view 363
Redis创始人antirez开源项目DwarfStar 4深度解析:如何用5000行C代码为DeepSeek V4 Flash打造专用推理引擎,实现Mac上26 tok/s的本地大模型推理体验。
AI推理
本地大模型
DeepSeek
C语言
Metal
DeepSeek-TUI 深度解析:半个月狂揽 1.9 万 Star——Rust 驱动的终端 AI 编程助手,如何对标 Claude Code?
编程
DeepSeek-TUI 深度解析:半个月狂揽 1.9 万 Star——Rust 驱动的终端 AI 编程助手,如何对标 Claude Code?
2026-05-15 22:44:40 +0800 CST
view 783
DeepSeek-TUI 由独立开发者 Hunter Bown 用 Rust 编写,半个月狂揽 1.9 万 GitHub Star。本文从架构、核心能力、竞品对比、实战 demo 四个维度深度解析这一终端 AI 编程助手。
DeepSeek-TUI
AI编程
终端Agent
Rust
Claude Code对比
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 859
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
2026 大模型推理框架选型实战:从 vLLM、TGI 到 TensorRT-LLM 的全链路架构拆解与性能防线
编程
2026 大模型推理框架选型实战:从 vLLM、TGI 到 TensorRT-LLM 的全链路架构拆解与性能防线
2026-08-12 11:14:56 +0800 CST
view 181
深度拆解 2026 年四大主流推理框架 vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9 的核心技术、性能对比与选型指南,涵盖 PagedAttention、Continuous Batching、量化优化、分布式推理与生产踩坑清单。
vLLM
TensorRT-LLM
TGI
DeepSpeed-MII
大模型推理
KV Cache
PagedAttention
推理优化
量化
分布式推理
3.2万Star开源本地AI知识库:Open Notebook支持18家模型+播客生成+MCP集成
编程
3.2万Star开源本地AI知识库:Open Notebook支持18家模型+播客生成+MCP集成
2026-06-21 12:21:16 +0800 CST
view 397
Open Notebook 是3.2万Star的开源本地AI知识库,Google Notebook LM替代品。支持18家AI模型切换、1-4人播客生成、RAG对话+来源标注、MCP集成、REST API。MIT协议,Docker两分钟部署,数据全在本地。
AI知识库
开源
RAG
播客
MCP
Ollama
DeepSeek
本地部署
隐私
DeepSeek Harness 深度拆解:当「一切皆插件」把 AI Agent 开发从框架锁定中解放出来——从 Cordis 微内核到生产级部署的全链路实战
编程
DeepSeek Harness 深度拆解:当「一切皆插件」把 AI Agent 开发从框架锁定中解放出来——从 Cordis 微内核到生产级部署的全链路实战
2026-08-18 21:18:05 +0800 CST
view 77
2026年8月13日DeepSeek发布的DeepSeek Harness v0.1预览版,以「一切皆插件」的架构理念彻底重构了AI Agent开发范式。本文从Cordis微内核、插件开发实战、事件溯源、安全模型到生产级部署进行全链路深度拆解。
DeepSeek
Harness
Cordis
AI Agent
插件化架构
事件溯源
沙箱安全
生产部署
Python
开源框架
OpenTelemetry Collector 深度拆解:当遥测数据管道变成「可编程中间件」——从 Receiver/Processor/Exporter 到自定义组件与生产级调优的全链路实战
编程
OpenTelemetry Collector 深度拆解:当遥测数据管道变成「可编程中间件」——从 Receiver/Processor/Exporter 到自定义组件与生产级调优的全链路实战
2026-08-18 23:12:31 +0800 CST
view 73
深度拆解OpenTelemetry Collector:从五种组件模型、数据流动架构,到手写Go自定义Processor并用OCB编译进发行版,配生产级config.yaml与memory_limiter/batch/tail_sampling调优清单。
OpenTelemetry
Collector
可观测性
OTLP
自定义Processor
OCB
尾部采样
链路追踪
WebSocket 实时通信架构深度解析:从在线协作到金融交易的生产级实战指南
编程
WebSocket 实时通信架构深度解析:从在线协作到金融交易的生产级实战指南
2026-07-28 08:15:35 +0800 CST
view 187
WebSocket 生产级实战指南:从协议原理、技术选型、集群架构到性能优化、容错安全,深度解析实时通信系统的设计与实现,包含在线协作编辑、即时通讯等场景的完整代码示例。
WebSocket
实时通信
架构设计
性能优化
在线协作
Node.js
Go
Rust
Socket.io
WebTransport
百度 Unlimited OCR 深度解析:端到端架构、R-SWA 常数量化 KV Cache,以及让 AI 像人一样抄书的工程革命
编程
百度 Unlimited OCR 深度解析:端到端架构、R-SWA 常数量化 KV Cache,以及让 AI 像人一样抄书的工程革命
2026-07-05 05:41:29 +0800 CST
view 423
深度解析百度2026年开源的Unlimited OCR模型:端到端架构、R-SWA常数量化KV Cache机制、MoE解码器设计,以及让AI像人一样连续解析长文档的工程革命。含完整代码实战。
OCR
百度
端到端OCR
R-SWA
KV Cache
文档识别
多模态
AMD ROCm 7.14 正式版深度解析:从技术预览到生产级 AI 基础设施的完整蜕变
编程
AMD ROCm 7.14 正式版深度解析:从技术预览到生产级 AI 基础设施的完整蜕变
2026-07-23 12:16:06 +0800 CST
view 380
深度解析 AMD ROCm 7.14 正式版:TheRock 构建系统、Ryzen AI Max PRO 400 硬件支持、PyTorch 2.12 + JAX 0.10.0 框架支持、HIPify CUDA 迁移实战与 vLLM 推理部署完整指南。
ROCm
AMD GPU
HIP
CUDA迁移
PyTorch
JAX
MI350P
Ryzen AI Max
ROCm 7.14
百度 Unlimited-OCR 深度解析:R-SWA 注意力机制如何用 3B 参数打爆百亿模型
编程
百度 Unlimited-OCR 深度解析:R-SWA 注意力机制如何用 3B 参数打爆百亿模型
2026-06-30 16:16:03 +0800 CST
view 349
2026年6月百度开源Unlimited-OCR深度解析:R-SWA参考滑动窗口注意力机制将KV Cache从线性增长压成常数,3B MoE模型用500M激活参数在OmniDocBench上以93.92%总分刷新SOTA,打爆Qwen3-VL 72B和Gemini 2.5 Pro。万字长文从架构原理到代码实战全覆盖。
Unlimited-OCR
端到端OCR
R-SWA
百度
注意力机制
大模型
MoE
深度学习
AI开源
文档解析
百度Unlimited-OCR深度解析:R-SWA常量KV缓存如何让OCR一口气吃下几十页文档——从单图解析到多页PDF的完整实战指南
编程
百度Unlimited-OCR深度解析:R-SWA常量KV缓存如何让OCR一口气吃下几十页文档——从单图解析到多页PDF的完整实战指南
2026-07-06 11:16:05 +0800 CST
view 448
深度解析百度开源Unlimited-OCR:13K+ Stars,R-SWA常量KV缓存让端到端OCR模型在32K上下文下一次性转录几十页文档。从架构设计到vLLM/SGLang生产部署完整实战指南。
Unlimited-OCR
百度
R-SWA
OCR
KV缓存
文档解析
长文档
vLLM
万字深度解析百度 Unlimited OCR:当 R-SWA 遇见 MoE——3B 参数如何碾压端到端 OCR 全场(2026)
编程
万字深度解析百度 Unlimited OCR:当 R-SWA 遇见 MoE——3B 参数如何碾压端到端 OCR 全场(2026)
2026-07-01 03:42:17 +0800 CST
view 350
2026年6月百度开源Unlimited OCR,5天GitHub Star破万。深度解析R-SWA注意力机制、MoE架构、16倍视觉Token压缩,以及为何能将KV Cache从线性增长压成常数。
Unlimited OCR
OCR
R-SWA
MoE
百度
深度学习
计算机视觉
文档识别
KV Cache
MCP 深度解剖:Model Context Protocol——AI Agent 工具集成的 USB-C 标准
编程
MCP 深度解剖:Model Context Protocol——AI Agent 工具集成的 USB-C 标准
2026-07-25 08:14:11 +0800 CST
view 213
深度拆解 MCP 协议:三层架构、Tools/Resources/Prompts 三大原语、JSON-RPC 2.0 通信、从零搭建企业 MCP Server 实战,以及 MCP vs LangChain/Function Calling 横向对比。
MCP
AI Agent
工具集成
Protocol
Model Context Protocol
Claude
Cursor
万字深度解析百度 Unlimited-OCR:当端到端OCR遇见R-SWA革命,从逐页失忆到40页文档一口气解析(2026)
编程
万字深度解析百度 Unlimited-OCR:当端到端OCR遇见R-SWA革命,从逐页失忆到40页文档一口气解析(2026)
2026-07-02 10:46:07 +0800 CST
view 328
深度解析百度2026年开源的Unlimited-OCR模型:3B参数的端到端OCR系统,R-SWA机制实现常数级KV缓存,OmniDocBench 93.92% SOTA评分,可一口气解析40页文档
Unlimited-OCR
百度
OCR
R-SWA
MoE
CLIP
端到端
长文档处理
深度学习
多模态
R-SWA如何让OCR「过目不忘」:百度Unlimited-OCR的KV缓存革命与40页长文档解析实战(2026)
编程
R-SWA如何让OCR「过目不忘」:百度Unlimited-OCR的KV缓存革命与40页长文档解析实战(2026)
2026-07-02 10:47:12 +0800 CST
view 431
深度解析百度2026年开源的Unlimited-OCR模型:3B参数的端到端OCR系统,R-SWA机制实现常数级KV缓存,OmniDocBench 93.92% SOTA评分,可一口气解析40页文档
Unlimited-OCR
百度
OCR
R-SWA
MoE
CLIP
端到端
长文档处理
深度学习
多模态
GLM-OCR 深度解析:0.9B 参数的文档理解小钢炮,OmniDocBench 拿下 94.62 分的秘密
编程
GLM-OCR 深度解析:0.9B 参数的文档理解小钢炮,OmniDocBench 拿下 94.62 分的秘密
2026-05-13 22:15:56 +0800 CST
view 680
GLM-OCR是智谱AI推出的0.9B参数文档理解多模态模型,凭借布局感知两阶段流水线和GRPO强化学习,在OmniDocBench v1.5以94.62分领先。本文深度解析其CogViT架构、MTP解码加速、印章识别技术及完整部署实战。
GLM-OCR,智谱AI,OCR,多模态模型,文档理解
百度 Unlimited OCR 深度实战:告别「越生成越慢」,一次性解析整本书的 OCR 革命
编程
百度 Unlimited OCR 深度实战:告别「越生成越慢」,一次性解析整本书的 OCR 革命
2026-06-27 02:13:37 +0800 CST
view 612
深度解析百度2026年6月开源的Unlimited OCR模型,介绍其R-SWA机制如何解决长文档OCR的KV cache线性增长问题,包含完整实战代码和性能优化技巧。
Unlimited OCR
百度
OCR
深度学习
MoE
R-SWA
长文档解析
TypeScript 巫师的 21 个 Claude 技能:当 AI 编程从"氛围"走向"工程"
编程
TypeScript 巫师的 21 个 Claude 技能:当 AI 编程从"氛围"走向"工程"
2026-05-06 11:34:54 +0800 CST
view 1101
深度解析 Matt Pocock 开源的 21 个 Claude Code Agent Skills,涵盖 TDD、PRD 生成、Git 安全守护等核心技能,探索「知识资产结构化共享」的 AI 原生工程范式。
TypeScript
Claude Code
AI编程
Agent Skills
Matt Pocock
Agent Skills 深度拆解:当 AI 编程助手学会「工程纪律」——mattpocock/skills、addyosmani/agent-skills 与 Superpowers 如何用可组合 SOP 重写人机协作的心智模型
编程
Agent Skills 深度拆解:当 AI 编程助手学会「工程纪律」——mattpocock/skills、addyosmani/agent-skills 与 Superpowers 如何用可组合 SOP 重写人机协作的心智模型
2026-07-15 12:18:39 +0800 CST
view 437
从工程师视角深度拆解 Agent Skills 运动:mattpocock/skills、addyosmani/agent-skills 与 Superpowers 如何用可组合 SOP、Checkpoint 与反合理化给 AI 编程助手装上工程纪律,配 SKILL.md、TDD、CI 与 MCP 协同实战。
Agent Skills
AI编程
工程纪律
mattpocock
addyosmani
Superpowers
SKILL.md
TDD
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
编程
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
2026-06-28 06:43:54 +0800 CST
view 621
百度2026年6月开源Unlimited OCR:30亿参数仅激活5亿,R-SWA注意力把KV Cache压成常数,一次前向推理处理几十页文档,OmniDocBench v1.6得分93.92%刷新SOTA。
百度 Unlimited OCR
OCR
R-SWA
长文档
端到端
MoE
SGLang
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
6
7
8
9
10
...
40
下一页