程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
shell 相关搜索结果(第7页)
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
50|
µP 深度拆解:当调参侠终于破解 scaling 诅咒——从最大更新参数化到万亿参数大模型超参迁移的工程全貌(2026)
编程
µP 深度拆解:当调参侠终于破解 scaling 诅咒——从最大更新参数化到万亿参数大模型超参迁移的工程全貌(2026)
2026-07-19 08:43:41
深度拆解微软/ OpenAI 的 µP(最大更新参数化)理论:从 Tensor Programs 数学框架、为什么标准参数化失效、到 PyTorch mup 库完整实战代码,含 Transformer 层、AdamW 配置、跨尺度超参数迁移验证与生产级 Pipeline。
µP
Max Update Parametrization
超参数迁移
Tensor Programs
深度学习
Transformer
LLM训练
AdamW
mup
微软
Hermes Agent 深度拆解:自进化 AI Agent 架构全解析——从闭环学习到持久记忆的工程真相
编程
Hermes Agent 深度拆解:自进化 AI Agent 架构全解析——从闭环学习到持久记忆的工程真相
2026-07-20 15:48:15
深度解析 Nous Research 开源的 Hermes Agent:五大核心模块、自进化学习循环实现、FTS5 记忆系统、Docker/Ollama 部署实战、MCP 协议集成与 2026 年工程最佳实践
Hermes Agent
AI Agent
自进化
Nous Research
MCP
Python
2026
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
编程
当 WASM 遇上 WebGPU:浏览器端 AI 推理的第三次革命——用 Web 技术重写本地智能的心智模型
2026-07-15 14:17:19
深度拆解 2026 年 WebGPU、WASM 与 WebNN 融合技术:三层计算模型、WGSL 编写、GEMM 量化推理、KV Cache、算子融合,配完整代码与性能基准。
WebGPU
WASM
WebNN
浏览器AI
WGSL
端侧推理
WebLLM
前端工程化
KV Cache 深度拆解:当推理引擎决定把「注意力状态」做成一套存储系统——从 PagedAttention 分页、PD 分离成本方程到分层缓存盈亏平衡点的 Goodput 工程学
编程
KV Cache 深度拆解:当推理引擎决定把「注意力状态」做成一套存储系统——从 PagedAttention 分页、PD 分离成本方程到分层缓存盈亏平衡点的 Goodput 工程学
2026-08-09 02:16:55
深度拆解 LLM 推理的 KV Cache 工程体系:为什么北极星指标必须从 Throughput 换成 Goodput、PagedAttention 的链式 hash 与前缀树实现、PD 分离的盈亏平衡方程(长输入短输出为何是负优化)、KVConnector 逐层流水传输、分层存储的盈亏平衡带宽公式与运行时决策函数、缓存感知路由,含可运行代码、调优清单与十条踩坑。
KV Cache
vLLM
PD分离
PagedAttention
LLM推理
Goodput
前缀缓存
RDMA
分层存储
性能优化
DuckDB Quack 协议深度实战:从嵌入式分析到分布式多写者的架构进化
编程
DuckDB Quack 协议深度实战:从嵌入式分析到分布式多写者的架构进化
2026-05-22 06:50:01
DuckDB Quack 协议让嵌入式分析数据库支持多并发写入的客户端-服务器模式,从协议架构、实战部署、性能调优到生产级高可用设计的完整指南
DuckDB
Quack
数据库
OLAP
Arrow
数据分析
Hermes Agent 深度解析:Nous Research 如何用「自进化闭环」重新定义 AI Agent 的工程边界
编程
Hermes Agent 深度解析:Nous Research 如何用「自进化闭环」重新定义 AI Agent 的工程边界
2026-04-13 17:26:10
深度拆解 Nous Research 开源的 Hermes Agent,从三层记忆系统、自动技能生成、MCP 双向协议等核心机制,探讨自进化 AI Agent 的工程实践与未来方向。
AI Agent
Hermes Agent
Nous Research
自我进化
记忆系统
开源
编程
MarkItDown深度解析:微软开源137K Star文档转Markdown神器,AI时代的文档预处理工业革命
2026-06-29 19:15:52
深度解析微软开源137K Star的MarkItDown工具:从PDF/Word/PPT到Markdown的AI友好转换,涵盖架构设计、源码剖析、LLM集成、Azure服务集成、Plugin生态、性能优化与生产实践。
MarkItDown
微软开源
文档转换
Markdown
LLM
AI预处理
Python
RAG
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
编程
LLM 推理服务引擎深度拆解:从 PagedAttention 到 PD 分离,把 GPU 榨干的七层优化栈
2026-07-30 21:49:19
深度拆解 LLM 推理服务的七层优化栈:PagedAttention 分页显存与写时复制、连续批处理消灭队头阻塞、前缀缓存命中率实操、Chunked Prefill 与 PD 分离决策、KV Cache 分层复用的拉取/重算临界点、投机解码加速比数学与失效场景、量化与并行选型。附大量可运行代码、压测骨架、调优顺序与七个常见误区。
LLM推理
vLLM
SGLang
PagedAttention
PD分离
KV Cache
前缀缓存
投机解码
Chunked Prefill
性能优化
LLM 推理引擎 2026 终极对决:vLLM、SGLang、TensorRT-LLM、LMDeploy 谁才是你的最优解?
编程
LLM 推理引擎 2026 终极对决:vLLM、SGLang、TensorRT-LLM、LMDeploy 谁才是你的最优解?
2026-08-16 07:15:42
深度拆解四大主流LLM推理引擎——vLLM、SGLang、TensorRT-LLM、LMDeploy——从核心架构、关键技术、性能基准到选型决策,配完整代码实战,帮你找到最适合业务场景的最优解。
LLM推理
vLLM
SGLang
TensorRT-LLM
LMDeploy
PagedAttention
RadixAttention
性能优化
大模型部署
Rolldown 1.0 深度实战:当 Rust 重写前端打包器——从 Vite 8 底层引擎到 10-30 倍性能飞跃的生产级完全指南
编程
Rolldown 1.0 深度实战:当 Rust 重写前端打包器——从 Vite 8 底层引擎到 10-30 倍性能飞跃的生产级完全指南
2026-06-15 17:21:29
Rolldown 1.0 用 Rust 融合 Rollup 生态兼容与 esbuild 极致性能,成为 Vite 8 统一底层引擎。从架构设计到 Tree-shaking 精度革命、代码分割策略、插件兼容、Vite 迁移实战的生产级完全指南。
Rolldown
Rust
Vite
打包器
Tree-shaking
前端工程化
oxc
Manus被越狱:提示词注入再现江湖
编程
Manus被越狱:提示词注入再现江湖
2025-03-10 19:37:20
Manus是一个AI助手,旨在帮助用户完成各种任务,包括信息收集、数据处理、内容创作和编程等。它具备多种工具和能力,能够分析用户需求,选择合适的工具,逐步执行任务,并在完成后提供结果。Manus的工作语言为英语,能够适应用户的语言偏好,确保高效沟通。
人工智能
自动化
技术支持
内容生成
自进化 AI Agent 实战:Nous Research Hermes Agent 源码级深度拆解——三层记忆、闭环学习、Skill 工程全指南(2026)
编程
自进化 AI Agent 实战:Nous Research Hermes Agent 源码级深度拆解——三层记忆、闭环学习、Skill 工程全指南(2026)
2026-07-18 12:16:30
源码级深度拆解 Nous Research 的 Hermes Agent:三层记忆架构、闭环自进化学习循环、Skill 自动创建机制、Honcho用户建模、200+模型接入,含完整代码实战与生产部署指南。
Hermes Agent
Nous Research
AI Agent
自进化
Skill系统
三层记忆
OpenClaw
Python
开源
数字员工
Hermes Agent 深度拆解:当 AI 学会「自我进化」——从动态技能生成、三层记忆架构到强化学习闭环的工程全貌(2026)
编程
Hermes Agent 深度拆解:当 AI 学会「自我进化」——从动态技能生成、三层记忆架构到强化学习闭环的工程全貌(2026)
2026-07-18 07:15:45
深度拆解 Hermes Agent:21.6万 Stars 的自进化 AI Agent 框架。从动态技能生成、三层记忆架构(Built-in/External/Session)、ACP 跨 Agent 通信协议到 GRPO 强化学习闭环的完整工程全貌,配代码实战与部署指南。
Hermes Agent
AI Agent
自进化
记忆系统
强化学习
GRPO
ACP协议
Nous Research
llama.cpp 深度实战:当端侧 LLM 成为生产级事实标准——从 GGUF 量化到跨平台部署的完全指南(2026)
编程
llama.cpp 深度实战:当端侧 LLM 成为生产级事实标准——从 GGUF 量化到跨平台部署的完全指南(2026)
2026-06-11 00:19:05
全面解析 llama.cpp 推理引擎,从 GGUF 格式、量化原理、架构设计到跨平台部署,提供生产级代码实战和性能优化指南。
llama.cpp
GGUF
量化
端侧推理
大语言模型
OXC 深度实战:当 Rust 重写 JavaScript 工具链——从 AST 到底层架构、从 Parser 到 100 倍性能跨越的生产级完全指南(2026)
编程
OXC 深度实战:当 Rust 重写 JavaScript 工具链——从 AST 到底层架构、从 Parser 到 100 倍性能跨越的生产级完全指南(2026)
2026-06-19 14:28:15
深入解析 OXC(The Oxidation Compiler):字节跳动开源的 Rust 版 JavaScript 工具链,Parser 比 SWC 快 3 倍,Linter 比 ESLint 快 50-100 倍。涵盖 AST 设计、Arena 内存分配、六大核心工具及生产接入实战。
Rust
JavaScript
TypeScript
前端工具链
性能优化
编译器
Hermes Agent 深度实战:Nous Research 开源自进化 AI Agent——从闭环学习到生产级部署的完整指南
编程
Hermes Agent 深度实战:Nous Research 开源自进化 AI Agent——从闭环学习到生产级部署的完整指南
2026-05-23 13:15:28
Hermes Agent 是由 Nous Research 开源的自进化 AI Agent 框架,内置学习闭环,能从经验中自动创建技能、持久化记忆、跨会话召回,越用越强。本文深度解析其架构设计、核心实现与生产级部署实践。
AI Agent
自进化
Nous Research
Python
LLM
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
编程
稀疏注意力架构革命:2026年长上下文大模型核心技术解析
2026-07-09 08:45:09
深入解析2026年稀疏注意力技术革命,涵盖SubCube、CSA/HCA、MSA三大架构的技术原理、代码实现与实战指南,探讨长上下文大模型的最新发展。
AI
大模型
Transformer
稀疏注意力
LongContext
DeepSeek
MiniMax
Headroom 深度实战:当 AI Agent 学会压缩上下文——从 Token 暴降 60-95% 到生产级工程落地的完全指南(2026)
编程
Headroom 深度实战:当 AI Agent 学会压缩上下文——从 Token 暴降 60-95% 到生产级工程落地的完全指南(2026)
2026-06-19 10:57:59
深度拆解 Headroom 上下文压缩中间层架构设计与生产级落地
Headroom
AI Agent
上下文压缩
Token优化
LLM
Docker AI Toolkit 2026 深度实战:生产级 AI 工程化完全指南
编程
Docker AI Toolkit 2026 深度实战:生产级 AI 工程化完全指南
2026-05-30 19:42:17
从 MLOps 到边缘推理,从模型编译到统一部署——Docker AI Toolkit 2026 如何将 AI 工程化从「手工炼丹」升级为「工业流水线」
Docker
AI
工程化
MLOps
容器化
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
编程
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
2026-08-01 14:17:55
深度解析 Kimi K3 的三大架构创新:KDA 混合线性注意力、Attention Residuals 注意力残差、Stable LatentMoE 分位数均衡路由,从第一性原理配代码示例吃透 2.8 万亿参数 MoE 模型。
Kimi
K3
MoE
KDA
AttnRes
StableLatentMoE
LLM
开源大模型
Headroom深度解析:让AI Agent「吃得少、营养好」的上下文压缩革命
编程
Headroom深度解析:让AI Agent「吃得少、营养好」的上下文压缩革命
2026-07-05 04:43:37
Headroom是一个开源的LLM上下文压缩中间件,能减少60-95%的token消耗,同时保持97%+的信息精度。本文深度解析其四层压缩管线、架构设计、使用模式和实战案例。
AI Agent
上下文压缩
Headroom
LLM
Token优化
编程
MarkItDown 深度解析:微软如何用轻量级 Python 工具重新定义文档转换——从 PDF 到 Markdown 的工程革命
2026-04-15 07:53:17
深度解析微软开源的 MarkItDown 工具——GitHub 10万+ Star 的文档转换利器,涵盖架构设计、核心转换器实现、插件系统、RAG管道集成和生产级优化策略。
Python
Markdown
PDF
微软
RAG
开源
DeerFlow 2.0 深度解析:字节跳动开源的超级AI智能体框架——从LangGraph架构到生产级Multi-Agent系统的完整技术内幕
编程
DeerFlow 2.0 深度解析:字节跳动开源的超级AI智能体框架——从LangGraph架构到生产级Multi-Agent系统的完整技术内幕
2026-05-18 22:20:46
DeerFlow 2.0是字节跳动开源的超级AI智能体框架,基于LangGraph 1.0+LangChain构建,支持主从Agent架构、Docker沙箱安全执行、上下文自动压缩等特性,让AI真正"动手做事"。本文深入拆解其架构设计、核心技术栈、Multi-Agent协作机制,并通过完整代码示例带你从零构建一个生产级AI自动化工作流。
AI Agent
Multi-Agent
LangGraph
字节跳动
DeerFlow
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
…
4
5
6
7
8
9
10
…
248
下一页
共 248 页
到第
页
确定