程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Loop Engineering 深度解析:2026 年 AI 工程范式从 Prompt 到 Loop 的四阶跃迁——Boris Cherny 和 Peter Steinberger 联手定义的 Agent 循环工程实战指南
编程
Loop Engineering 深度解析:2026 年 AI 工程范式从 Prompt 到 Loop 的四阶跃迁——Boris Cherny 和 Peter Steinberger 联手定义的 Agent 循环工程实战指南
2026-07-07 08:13:00 +0800 CST
view 411
深度解析2026年AI工程范式从Prompt到Loop的四阶跃迁:Loop Engineering循环工程的核心概念、六块积木架构、47次实验验证数据、完整生产级实战。涵盖自动化调度、Git Worktree并行、Skill持久化、MCP连接器、子Agent审查、记忆系统,含完整代码示例与未来展望。
Loop Engineering
循环工程
AI Agent
Prompt Engineering
Harness Engineering
Claude Code
OpenClaw
多Agent编排
AI编程
工程范式
DeepSeek DeepGEMM 2026年4月重磅更新:Mega MoE融合算子、FP4精度与极致性能优化
编程
DeepSeek DeepGEMM 2026年4月重磅更新:Mega MoE融合算子、FP4精度与极致性能优化
2026-04-23 08:41:45 +0800 CST
view 808
深度解析DeepSeek DeepGEMM 2026年4月重大更新:Mega MoE融合算子(dispatch+Linear+SwiGLU+Combine五合一,NVLink通信与Tensor Core计算重叠)、FP8xFP4 GEMM、FP4 Indexer、PDL调度优化与JIT加速,附完整代码实战。
DeepGEMM
DeepSeek
GPU优化
CUDA
FP8
FP4
MoE
AI Infra
高性能计算
NVIDIA
DeepSeek Harness 深度实战:GitHub史上最快破2万星的开源Agent框架——从Cordis微内核到生产级Coding Agent全链路拆解
编程
DeepSeek Harness 深度实战:GitHub史上最快破2万星的开源Agent框架——从Cordis微内核到生产级Coding Agent全链路拆解
2026-08-16 12:45:49 +0800 CST
view 62
深度拆解DeepSeek Harness:GitHub史上最快破2万星的开源Agent框架,从Cordis微内核架构、四层架构设计、双Surface物理隔离、遥测第一公民设计,到生产级Coding Agent代码实战与模型路由策略,配完整TypeScript代码示例与性能调优指南。
DeepSeek
DSH
Agent框架
智能体框架
开源
Node.js
Cordis
微内核
插件化架构
模型路由
成本优化
遥测
代码审查
Coding Agent
Harness Engineering
DeepSeek Harness 开发者预览版:一切皆插件
编程
DeepSeek Harness 开发者预览版:一切皆插件
2026-08-14 08:17:01 +0800 CST
view 218
DeepSeek AI 推出的智能体框架,采用「一切皆插件」架构,由 Cordis 驱动。模型、工具、技能、会话、沙箱、存储、循环、调度、UI 等 Agent 所有能力均由插件组合而成,可以自由替换和灵活重组。GitHub 41.1K Star,MIT 协议,一行命令启动 Web UI。
AI
Agent
DeepSeek
Go
DeepSeek-Reasonix 深度解析:13K+ Stars 的 DeepSeek 原生编码 Agent 如何用 Go 重写 + Cache-First 架构让长会话成本暴跌 80%——从 prefix-cache 原理到生产级实战的完整指南
编程
DeepSeek-Reasonix 深度解析:13K+ Stars 的 DeepSeek 原生编码 Agent 如何用 Go 重写 + Cache-First 架构让长会话成本暴跌 80%——从 prefix-cache 原理到生产级实战的完整指南
2026-07-06 23:42:51 +0800 CST
view 413
深度解析GitHub 13K+ Stars的DeepSeek-Reasonix终端AI编码代理:Go从零重写、Cache-First Loop架构、99%缓存命中率、Tool-Call Repair自愈、R1 Thought Harvest思维链收割、Auto模型切换、Tauri桌面客户端、QQ频道远程控制。从prefix-cache原理到生产级实战,含完整代码示例与竞品对比。
DeepSeek
Reasonix
AI Agent
终端编程
prefix-cache
Go
缓存优化
开源
百度 Unlimited OCR 开源:用常数级 KV Cache 一次性吃下整本书
编程
百度 Unlimited OCR 开源:用常数级 KV Cache 一次性吃下整本书
2026-06-29 06:14:12 +0800 CST
view 470
百度开源 Unlimited OCR 模型,用常数级 KV Cache 解决长文档识别难题。30亿参数端到端架构,推理仅激活5亿参数,单次前向识别几十页文档,OmniDocBench v1.6 总分93.92%刷新SOTA。
OCR
开源
百度
DeepSeek
端到端
长文档
Context Engineering:超越 Prompt Engineering 的 AI 工程新范式
编程
Context Engineering:超越 Prompt Engineering 的 AI 工程新范式
2026-07-05 01:47:09 +0800 CST
view 258
深入探讨Context Engineering的核心概念、架构设计、上下文压缩技术和生产环境最佳实践。
AI工程
Context Engineering
Prompt Engineering
大模型
上下文管理
开源追上闭源!OpenRouter 2026开源F4深度解析:DeepSeek GLM MiniMax NVIDIA谁才是你的菜
编程
开源追上闭源!OpenRouter 2026开源F4深度解析:DeepSeek GLM MiniMax NVIDIA谁才是你的菜
2026-06-29 07:42:37 +0800 CST
view 497
OpenRouter 2026年6月发布最值得关注的4个开源模型:DeepSeek V4 Flash极致性价比、GLM 5.2智力天花板、MiniMax M3原生多模态、NVIDIA Nemotron企业级部署。本文从架构、性能、成本、场景四维度深度解析,助你做出正确技术选型。
AI
开源模型
DeepSeek
GLM
MiniMax
NVIDIA
技术选型
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
编程
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
2026-07-10 17:44:16 +0800 CST
view 441
深度对比2026年四大主流LLM推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9,涵盖PagedAttention、FP8量化、ZeRO-3、连续批处理等核心技术原理,配生产级代码示例与实测性能数据。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
量化
AI部署
DeepSeek 专家模式深度解析:当低调更新成为AGI赛道的产品哲学宣言
编程
DeepSeek 专家模式深度解析:当低调更新成为AGI赛道的产品哲学宣言
2026-04-09 10:23:56 +0800 CST
view 903
2026年4月8日,DeepSeek悄然上线「专家模式」,无发布会无公告,却被业内视为V4发布前最有分量的产品预告。本文深度拆解双模式技术架构差异,实测数理推理、专业编程、创意写作三大场景,并解读这一低调更新背后的产品哲学与行业信号。
DeepSeek
AI大模型
V4
专家模式
推理模型
产品设计
国产AI
场景分层
2026 大模型推理框架深度对比:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9 性能与成本终极较量
编程
2026 大模型推理框架深度对比:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9 性能与成本终极较量
2026-07-23 08:13:30 +0800 CST
view 372
2026年四大主流大模型推理框架深度对比:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9。从核心技术优化、吞吐量延迟、算力成本、部署适配性四大维度开展极致测评,为企业技术选型提供精准参考。
vLLM
TensorRT-LLM
TGI
DeepSpeed-MII
大模型推理
PagedAttention
FlashAttention
量化推理
GPU推理优化
DSpark:DeepSeek联手北大「投机解码」登顶,推理速度飙升85%背后真相
编程
DSpark:DeepSeek联手北大「投机解码」登顶,推理速度飙升85%背后真相
2026-06-29 13:45:21 +0800 CST
view 411
深度解析DeepSeek联合北京大学发布的DSpark置信度调度投机解码框架,剖析半自回归候选生成、动态验证调度、硬件感知前缀缓存三大核心创新
DeepSeek
DSpark
投机解码
大模型推理
置信度调度
Speculative Decoding
ClickHouse 深度拆解:当列式存储开始吞掉数据仓库——从 MergeTree 引擎家族到向量化执行与 SharedMergeTree 云原生的完全指南(2026)
编程
ClickHouse 深度拆解:当列式存储开始吞掉数据仓库——从 MergeTree 引擎家族到向量化执行与 SharedMergeTree 云原生的完全指南(2026)
2026-08-13 02:44:57 +0800 CST
view 177
2026 年 ClickHouse 年化收入破 2.5 亿美元。本文从列式存储本质讲起,拆解 MergeTree 引擎家族、稀疏主键与向量化执行管线,用可运行的实时事件分析系统(AggregatingMergeTree+物化视图+原生JSON+SharedMergeTree)落地,并给出 15 条生产踩坑清单。
ClickHouse
MergeTree
列式存储
向量化执行
SharedMergeTree
OLAP
实时分析
物化视图
DSpark深度解析:DeepSeek如何用半自回归推测解码将大模型推理速度提升85%
编程
DSpark深度解析:DeepSeek如何用半自回归推测解码将大模型推理速度提升85%
2026-07-05 13:43:59 +0800 CST
view 426
深度解析DeepSeek联合北大发布的DSpark推理加速框架,详解半自回归推测解码、动态推测窗口、置信度调度三大核心创新,在DeepSeek-V4上实现60%-85%推理速度提升。
DeepSeek
DSpark
推测解码
推理加速
大模型优化
半自回归
GPU加速
Pascal Editor 深度实战:当 WebGPU 遇见 3D 建筑可视化——从浏览器零安装到生产级架构的完全指南(2026)
编程
Pascal Editor 深度实战:当 WebGPU 遇见 3D 建筑可视化——从浏览器零安装到生产级架构的完全指南(2026)
2026-06-16 15:34:34 +0800 CST
view 383
Pascal Editor 是一个基于 WebGPU 和 React Three Fiber 构建的开源 3D 建筑编辑器,运行在浏览器中无需安装。本文深度解析其 Monorepo 架构、场景状态管理、WebGPU 渲染管线、CSG 布尔运算和性能优化策略。
WebGPU
Three.js
React Three Fiber
Pascal Editor
3D编辑器
Turborepo
Bun
Monorepo
CSG
前端工程化
DeepSeek+Runway联合工作流:1小时出4K电影级短片,手把手保姆级教程
编程
DeepSeek+Runway联合工作流:1小时出4K电影级短片,手把手保姆级教程
2026-04-29 12:18:40 +0800 CST
view 898
DeepSeek写分镜脚本+Runway生图生视频,1小时完成从想法到4K电影级成片的完整工作流。无需拍摄、无需演员、不用专业剪辑,手把手保姆级教程含避坑指南和3个爆款模板。
AI视频
DeepSeek
Runway
4K视频
分镜脚本
短视频创作
AI工作流
AIGC
影视制作
Free Claude Code:让Claude Code接入任意模型,打破Anthropic绑定
编程
Free Claude Code:让Claude Code接入任意模型,打破Anthropic绑定
2026-04-29 12:20:38 +0800 CST
view 1406
Free Claude Code是让Claude Code接入任意模型的代理层项目,打破Anthropic绑定,支持NVIDIA NIM/OpenRouter/DeepSeek/Ollama/LM Studio等后端,适合想降成本或本地部署AI编程环境的人。
Claude Code
AI编程
开源工具
OpenRouter
DeepSeek
Ollama
LM Studio
AI Coding
Anthropic
DeepSeek V4 Flash 深度解析:284B总参、13B激活的MoE开源模型,凭什么成为2026年度「性价比之王」?
编程
DeepSeek V4 Flash 深度解析:284B总参、13B激活的MoE开源模型,凭什么成为2026年度「性价比之王」?
2026-06-29 22:12:39 +0800 CST
view 1277
深度解析DeepSeek V4 Flash架构:CSA/HCA混合注意力、MoE细粒度路由、DSpark推测解码技术,附完整部署代码与Benchmark对比
DeepSeek
V4
MoE
开源模型
AI推理
DSpark
CSA
大模型
OmniRoute 深度拆解:一个开源 AI 网关如何终结「AI 路由焦虑」,290+ 厂商、19 种策略与 Token 暴降 60% 的工程实践
编程
OmniRoute 深度拆解:一个开源 AI 网关如何终结「AI 路由焦虑」,290+ 厂商、19 种策略与 Token 暴降 60% 的工程实践
2026-07-29 03:15:11 +0800 CST
view 219
深度拆解 GitHub 28.8k Star 的 OmniRoute:一个开源本地 AI 网关的完整架构解析,涵盖 19 种智能路由策略、RTK+Caveman 双引擎 Token 压缩(成本降低 60%)、配额感知动态路由,以及与 Claude Code、Cursor 等工具的深度集成实战,附生产级配置指南。
OmniRoute
AI网关
智能路由
Token压缩
API聚合
成本优化
Claude Code
Cursor
OpenAI
Anthropic
DeepSeek
RTK
Caveman
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
案例
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
2026-05-10 08:40:22 +0800 CST
view 846
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎ds4.c,C+Metal从头编写,Mac Studio M3 Ultra上预填充468 token/s。关键优化:非对称量化(MoE专家层2-bit)、KV缓存搬硬盘、内置OpenAI/Anthropic双API。128GB Mac可跑,专为coding agent优化。
DeepSeek
AI推理
Mac
Redis
antirez
Metal
本地推理
MoE
GGUF
C语言
Apple Silicon
Claude Code
OpenAI API
Anthropic API
从碎片化到统一:OmniRoute 架构设计、19 种路由策略与 Token 暴降 60% 实战
编程
从碎片化到统一:OmniRoute 架构设计、19 种路由策略与 Token 暴降 60% 实战
2026-07-29 03:15:39 +0800 CST
view 211
深度拆解 GitHub 28.8k Star 的 OmniRoute:一个开源本地 AI 网关的完整架构解析,涵盖 19 种智能路由策略、RTK+Caveman 双引擎 Token 压缩(成本降低 60%)、配额感知动态路由,以及与 Claude Code、Cursor 等工具的深度集成实战,附生产级配置指南。
OmniRoute
AI网关
智能路由
Token压缩
API聚合
成本优化
Claude Code
Cursor
OpenAI
Anthropic
DeepSeek
RTK
Caveman
DeepSeek V4 专家模式深度解析:当国产大模型终于学会「分场景思考」
编程
DeepSeek V4 专家模式深度解析:当国产大模型终于学会「分场景思考」
2026-04-10 07:21:56 +0800 CST
view 882
DeepSeek V4专家模式深度解析:双模式架构、LTM长期记忆技术、6710亿参数、场景分层设计,标志着国产大模型从参数比拼转向精细化竞争
DeepSeek
V4
专家模式
国产大模型
AI
TileKernels 深度解析:DeepSeek 用 80 行代码榨干 GPU,算子开发范式的降维打击
编程
TileKernels 深度解析:DeepSeek 用 80 行代码榨干 GPU,算子开发范式的降维打击
2026-04-30 03:22:15 +0800 CST
view 975
深度解析 DeepSeek 开源的高性能 GPU 算子库 TileKernels:基于 TileLang DSL 用 80 行代码实现手写 CUDA 级性能,覆盖 MoE Gating/Routing、FP8/FP4 量化、Engram 门控等七大算子家族,首次原生支持 NVIDIA Blackwell 架构,并通过 TVM 编译器打通昇腾等国产芯片。
DeepSeek
TileKernels
GPU
CUDA
TileLang
MoE
算子优化
2026 大模型推理框架终极对决:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9——从架构原理到生产级部署的完全指南
编程
2026 大模型推理框架终极对决:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9——从架构原理到生产级部署的完全指南
2026-06-16 23:24:43 +0800 CST
view 350
深度对比四大主流LLM推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9。从PagedAttention架构原理、FlashAttention优化、量化支持到生产级部署实战,包含统一环境下的性能测试数据与代码示例,帮助你做出最优选型决策。
LLM
推理框架
vLLM
TensorRT
DeepSpeed
性能优化
AI
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
5
6
...
44
下一页