程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
DSpark:DeepSeek联手北大「投机解码」登顶,推理速度飙升85%背后真相
编程
DSpark:DeepSeek联手北大「投机解码」登顶,推理速度飙升85%背后真相
2026-06-29 13:45:21 +0800 CST
view 423
深度解析DeepSeek联合北京大学发布的DSpark置信度调度投机解码框架,剖析半自回归候选生成、动态验证调度、硬件感知前缀缓存三大核心创新
DeepSeek
DSpark
投机解码
大模型推理
置信度调度
Speculative Decoding
DSpark深度解析:DeepSeek联合北大开源的推测解码框架——半自回归生成+置信度调度如何让大模型推理速度飙升85%
编程
DSpark深度解析:DeepSeek联合北大开源的推测解码框架——半自回归生成+置信度调度如何让大模型推理速度飙升85%
2026-07-06 07:43:51 +0800 CST
view 573
深度解析DeepSeek联合北京大学开源的DSpark推测解码推理加速框架:半自回归生成架构解决后缀衰减、置信度调度验证机制避免算力浪费、单用户生成速度提升60%-85%、吞吐量最高暴涨661%。含完整代码实战与性能基准测试。
DSpark
DeepSeek
推测解码
Speculative Decoding
推理加速
半自回归
置信度调度
大模型推理
大模型部署太慢?这个超级引擎帮你搞定!SGLang速通指南
编程
大模型部署太慢?这个超级引擎帮你搞定!SGLang速通指南
2026-04-22 09:27:57 +0800 CST
view 905
DeepSeek官方推荐!SGLang高性能大模型推理框架速通指南,RadixAttention前缀缓存、零开销调度、OpenAI API兼容,性能碾压vLLM。
SGLang
大模型推理
DeepSeek
开源
vLLM
LMCache 深度拆解:当 KV Cache 变成可复用资产——LLM 推理的「免费午餐」完整指南
编程
LMCache 深度拆解:当 KV Cache 变成可复用资产——LLM 推理的「免费午餐」完整指南
2026-07-14 18:47:11 +0800 CST
view 234
深度拆解 LMCache 项目:从 Transformer Attention 机制出发,详细讲解 KV Cache 原理、三层存储架构、生产部署实战、Docker Compose 配置、CacheGen 压缩算法、PD 分离、跨实例 KV Cache 共享,以及与 vLLM/SGLang 的集成,配完整代码示例与性能调优指南。实测 DeepSeek 多轮对话 3~5 倍 TTFT 改善。
LMCache
KV Cache
LLM推理
vLLM
SGLang
推理优化
DeepSeek
分布式缓存
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 859
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
DeerFlow 深度解析:字节跳动开源超级智能体如何重构AI Agent执行系统
编程
DeerFlow 深度解析:字节跳动开源超级智能体如何重构AI Agent执行系统
2026-04-29 08:14:31 +0800 CST
view 886
深度解析字节跳动开源DeerFlow超级智能体框架,探讨其如何重构AI Agent执行系统,包括架构设计、核心概念、代码实战和性能优化。
AI Agent
开源项目
字节跳动
智能体架构
DeerFlow
DeerFlow 2.0 深度解析:当字节跳动把「深度研究助手」变成「超级智能体执行底座」
编程
DeerFlow 2.0 深度解析:当字节跳动把「深度研究助手」变成「超级智能体执行底座」
2026-04-10 03:51:48 +0800 CST
view 1471
2026年2月28日,字节跳动开源了DeerFlow 2.0,发布24小时内登顶GitHub Trending,Star数突破57k。本文深度解析这款从深度研究助手进化为超级智能体执行底座的AI框架。
DeerFlow
字节跳动
AI Agent
超级智能体
开源框架
DeerFlow 2.0 源码级深度解析:字节跳动如何用 Lead Agent + Middleware Chain 重新定义 AI Agent 运行时
编程
DeerFlow 2.0 源码级深度解析:字节跳动如何用 Lead Agent + Middleware Chain 重新定义 AI Agent 运行时
2026-05-17 00:14:33 +0800 CST
view 594
深度拆解字节跳动DeerFlow 2.0的源码架构:Lead Agent调度、Middleware Chain中间件链、沙盒执行环境、三层记忆系统、自动知识提取与Skill打包
DeerFlow
AI Agent
字节跳动
中间件
沙盒
知识提取
DeerFlow 2.0 深度解析:57K Star 背后的超级智能体编排革命
编程
DeerFlow 2.0 深度解析:57K Star 背后的超级智能体编排革命
2026-04-21 04:15:29 +0800 CST
view 795
深度解析字节跳动开源的 DeerFlow 2.0 超级智能体框架:四层架构设计、子智能体编排、沙箱执行环境、长期记忆系统、技能系统等核心技术,以及实战案例与选型建议。
AI Agent
DeerFlow
智能体
字节跳动
开源框架
DeerFlow 深度解析:字节跳动开源超级智能体运行时——从架构设计到生产级 Multi-Agent 编排的完整技术内幕
编程
DeerFlow 深度解析:字节跳动开源超级智能体运行时——从架构设计到生产级 Multi-Agent 编排的完整技术内幕
2026-05-18 09:43:33 +0800 CST
view 705
深入解析字节跳动开源的 DeerFlow 超级智能体运行时框架,从核心架构、执行引擎、Multi-Agent 编排到生产级部署,完整呈现这一 GitHub Trending 榜首项目的技术内幕。
AI Agent
DeerFlow
字节跳动
Multi-Agent
开源项目
DeerFlow 深度实战:字节跳动开源超级智能体运行时——从长时任务调度到三层记忆系统的全链路解析
编程
DeerFlow 深度实战:字节跳动开源超级智能体运行时——从长时任务调度到三层记忆系统的全链路解析
2026-05-06 03:06:38 +0800 CST
view 638
DeerFlow 是字节跳动 2026 年开源的超级智能体运行时,本文从架构设计、核心组件、代码实战、性能优化四个维度进行全链路深度解析,帮助开发者掌握这款生产级 Agent 框架。
AI Agent
开源项目
字节跳动
DeerFlow
字节跳动DeerFlow 2.0技术全解析:从零构建生产级AI智能体系统(2026完整实战指南)
编程
字节跳动DeerFlow 2.0技术全解析:从零构建生产级AI智能体系统(2026完整实战指南)
2026-05-19 11:18:35 +0800 CST
view 747
DeerFlow 2.0是字节跳动开源的企业级多智能体协作框架,本文从架构设计、核心机制、源码分析、实战部署、性能调优五个维度进行深度解析。
DeerFlow
AI Agent
字节跳动
智能体框架
多智能体
DeerFlow 深度解析:字节跳动开源超级智能体运行时,30天4.9万Star背后的技术架构与实战指南
编程
DeerFlow 深度解析:字节跳动开源超级智能体运行时,30天4.9万Star背后的技术架构与实战指南
2026-05-15 12:13:56 +0800 CST
view 841
深度解析字节跳动开源的DeerFlow超级智能体运行时:架构设计、Sandbox安全隔离、记忆系统、代码实战与生产实践,全面了解这款30天斩获4.9万Star的GitHub Trending榜首项目。
AI Agent
DeerFlow
开源项目
字节跳动
智能体运行时
Trae 深度解析:字节跳动如何用 AI 原生 IDE 重新定义程序员的工作流
编程
Trae 深度解析:字节跳动如何用 AI 原生 IDE 重新定义程序员的工作流
2026-04-27 17:24:18 +0800 CST
view 927
从 MarsCode 到 Trae 2.0,字节跳动的 AI 编程工具经历了怎样的进化?SOLO 模式、Tab-Cue 引擎、多智能体调度——这些底层技术究竟如何运作?本文从架构设计到代码实战,全面拆解这款 2026 年最炙手可热的 AI 原生 IDE。
Trae
AI IDE
字节跳动
AI编程
SOLO模式
Tab-Cue
多智能体
Builder模式
Seed模型
豆包
Goose 深度实战:当 Rust 遇见本地 AI Agent——从 Block 开源到 Linux Foundation AAIF 的生产级完全指南(2026)
编程
Goose 深度实战:当 Rust 遇见本地 AI Agent——从 Block 开源到 Linux Foundation AAIF 的生产级完全指南(2026)
2026-06-16 02:47:41 +0800 CST
view 764
Goose 是由 Block 开源、现已迁入 Linux Foundation AAIF 的 Rust AI Agent。支持 15+ LLM、70+ MCP 扩展,本文深度解析其架构与实战。
Goose
Rust
AI Agent
MCP
AACP
Linux Foundation
Chrome DevTools MCP 深度实战:让 AI 编程助手真正看懂并操控浏览器的技术革命
编程
Chrome DevTools MCP 深度实战:让 AI 编程助手真正看懂并操控浏览器的技术革命
2026-05-16 04:43:16 +0800 CST
view 641
Chrome DevTools MCP 让 AI 编程助手通过 MCP 协议直接控制浏览器,实现深度调试、性能分析和自动化测试。本文详解架构、实战和性能优化。
Chrome DevTools
MCP
AIAgent
前端调试
自动化测试
Headroom 全解析:从 Rust 内核到 CCR 可逆协议,AI Agent Token 优化的终极方案(2026)
编程
Headroom 全解析:从 Rust 内核到 CCR 可逆协议,AI Agent Token 优化的终极方案(2026)
2026-06-29 08:15:21 +0800 CST
view 420
深度解析 Headroom:从 Rust 内核到 CCR 可逆协议,六大压缩算法引擎,五种部署模式,实测 60-95% Token 节省,答案准确度零损失。
AI Agent
Token优化
Headroom
Rust
上下文压缩
Google AI Edge Gallery:手机离线跑大模型时代来了,2.2万Star端侧AI神器
案例
Google AI Edge Gallery:手机离线跑大模型时代来了,2.2万Star端侧AI神器
2026-05-09 07:36:45 +0800 CST
view 1271
Google开源AI神器AI Edge Gallery斩获2.2万Star,支持iOS和Android手机离线运行Gemma 4等大模型,提供AI Chat、Ask Image、Audio Scribe、Agent Skills四大功能,消费级入口形态让普通用户轻松体验端侧AI
端侧AI
手机大模型
离线推理
Gemma 4
Google开源
iOS
Android
Headroom 深度实战:当 AI Agent 学会了「精打细算」——从 Token 成本黑洞到上下文压缩的底层原理、从 CCR 可逆存储到六大压缩算法的生产级完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 学会了「精打细算」——从 Token 成本黑洞到上下文压缩的底层原理、从 CCR 可逆存储到六大压缩算法的生产级完全指南(2026)
2026-06-21 15:57:54 +0800 CST
view 396
深度解析开源项目 Headroom:AI Agent 的上下文压缩中间层,60-95% Token 节省,CCR 可逆存储,六大压缩算法完全指南。
AI编程
Token压缩
Headroom
上下文管理
LLM推理优化
AI Agent
Goose深度解析:Linux Foundation的Rust原生AI Agent框架,47万行代码重新定义AI安全
编程
Goose深度解析:Linux Foundation的Rust原生AI Agent框架,47万行代码重新定义AI安全
2026-06-29 09:10:57 +0800 CST
view 563
Goose是Linux Foundation AAIF孵化的Rust原生AI Agent框架,47万行代码重新定义AI安全。本文深度解析其架构设计、安全机制、实战案例,以及与OpenClaw、AutoGPT的对比。
Goose
Rust
AI Agent
Linux Foundation
AI安全
Google TimesFM 深度解析:14K Star 的时间序列基础模型如何用 200M 参数颠覆零样本预测
编程
Google TimesFM 深度解析:14K Star 的时间序列基础模型如何用 200M 参数颠覆零样本预测
2026-04-28 18:22:55 +0800 CST
view 759
深度解析 Google TimesFM:200M 参数如何在 1000 亿时间点上预训练后实现零样本超越有监督模型,覆盖架构原理、代码实战、性能对比与生产部署完整指南。
AI大模型
时间序列预测
Google
TimesFM
零样本预测
深度学习
GitHub开源
预训练模型
Headroom深度解析:让AI Agent「吃得少、营养好」的上下文压缩革命
编程
Headroom深度解析:让AI Agent「吃得少、营养好」的上下文压缩革命
2026-07-05 04:43:37 +0800 CST
view 289
Headroom是一个开源的LLM上下文压缩中间件,能减少60-95%的token消耗,同时保持97%+的信息精度。本文深度解析其四层压缩管线、架构设计、使用模式和实战案例。
AI Agent
上下文压缩
Headroom
LLM
Token优化
Genkit Go:Google官方AI SDK让Go成为AI应用开发优选语言
编程
Genkit Go:Google官方AI SDK让Go成为AI应用开发优选语言
2026-05-16 11:22:09 +0800 CST
view 692
Google推出Genkit Go,面向AI应用开发的全栈框架,支持Gemini/Claude/Ollama等多模型,提供类型安全输出、Flow可观测执行、中间件系统等能力。
开源项目
AI SDK
Go语言
Google
MoonBit 深度拆解:IDEA 研究院造了一门AI原生编程语言,一个代码仓库同时跑在 WASM/JS/原生三端
编程
MoonBit 深度拆解:IDEA 研究院造了一门AI原生编程语言,一个代码仓库同时跑在 WASM/JS/原生三端
2026-07-28 14:17:26 +0800 CST
view 281
深度拆解 IDEA 研究院出品的 MoonBit 月兔编程语言:四路编译管线(WASM/WASM-GC/JS/Native)、结构化类型系统、WASM组件模型实战、云端部署完整指南,附生产级代码示例与性能横评。
MoonBit
WASM
WebAssembly
编程语言
IDEA研究院
编译器
类型系统
WASM-GC
云原生
AI编程
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
11
12
13
14
15
...
107
下一页