程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
AI Scientist-v2 深度解析:当人工智能学会「从零开始做科研」——Agentic Tree Search 如何改写科学发现的游戏规则
编程
AI Scientist-v2 深度解析:当人工智能学会「从零开始做科研」——Agentic Tree Search 如何改写科学发现的游戏规则
2026-04-12 15:55:06 +0800 CST
view 1022
AI Scientist-v2 由 Sakana AI 联合牛津大学等机构研发,于 2026 年正式发表于 Nature,首次实现端到端科研自动化。其核心创新 Agentic Tree Search 让 AI 在 ML 领域生成论文通过 ICLR Workshop 双盲评审,获 6.33 分高于 55% 人类投稿。本文全面解析其系统架构、核心算法与未来方向。
AI Scientist
Sakana AI
Agentic Tree Search
科研自动化
AI Agent
LLM
Nature
从零手写一个 Rust 异步运行时:吃透 Future、Waker 与 Reactor,造一个能跑 TCP 服务的 mini-tokio(附完整实现)
编程
从零手写一个 Rust 异步运行时:吃透 Future、Waker 与 Reactor,造一个能跑 TCP 服务的 mini-tokio(附完整实现)
2026-08-01 05:15:47 +0800 CST
view 121
从 Future 协议第一性原理出发,手写一个能跑真实 TCP echo 服务的 mini-tokio:RawWaker vtable、单/多线程执行器、work-stealing 调度、基于 epoll 的 Reactor 与异步 TcpStream,附 async 八大踩坑清单。
Rust
异步编程
async
Tokio
Future
Waker
Reactor
epoll
运行时
并发编程
Vite 8 深度拆解:当 Vite 亲手拆掉「esbuild + Rollup」双引擎——Rolldown、Oxc 与打包式开发的范式回收
编程
Vite 8 深度拆解:当 Vite 亲手拆掉「esbuild + Rollup」双引擎——Rolldown、Oxc 与打包式开发的范式回收
2026-08-11 04:49:04 +0800 CST
view 77
Vite 8 深度拆解:Rolldown 如何终结 esbuild+Rollup 双打包器时代、Oxc 统一工具链的跨层优化、自动/手动分包算法模型与 codeSplitting 取代 manualChunks 的根因、Lazy Barrel 让 antd 少编译 92% 模块、CJS 互操作语义统一陷阱、Vite 8.1 Bundled Dev Mode 与 Chunk Import Map。含完整迁移剧本与十六条踩坑清单。
Vite
Vite 8
Rolldown
Oxc
前端工具链
打包器
代码分割
Lazy Barrel
Lightning CSS
Rust
构建性能
前端工程化
Tree Shaking
CommonJS
Open Code Review 深度拆解:阿里如何用「确定性工程 + LLM Agent」混合架构终结 AI 代码审查的三大顽疾——从 70 条静态规则到 Agent 工具调用的全链路架构哲学
编程
Open Code Review 深度拆解:阿里如何用「确定性工程 + LLM Agent」混合架构终结 AI 代码审查的三大顽疾——从 70 条静态规则到 Agent 工具调用的全链路架构哲学
2026-08-03 04:43:14 +0800 CST
view 158
深度拆解阿里开源Open Code Review混合架构:确定性工程层四机制(精准文件选择、智能分组、规则匹配、位置校准)+ LLM Agent两阶段审查(Plan+Review),附完整执行链路、CI集成配置与实测对比分析
Open Code Review
阿里开源
AI代码审查
LLM Agent
Code Review
确定性工程
AACR-Bench
GitHub开源
开发工具
CI/CD
Rolldown 1.0 深度实战:当 Vite 用 Rust 重写打包器,10–30 倍性能背后到底发生了什么?
编程
Rolldown 1.0 深度实战:当 Vite 用 Rust 重写打包器,10–30 倍性能背后到底发生了什么?
2026-07-11 00:44:38 +0800 CST
view 249
2026年6月 Rolldown 1.0 正式发布,作为 Vite 8 默认打包器比 Rollup 快 10-30 倍。本文从架构、代码、性能三维度深度拆解:双引擎原罪、OXC 并行解析、bitset 可达性 tree-shaking、智能分块,配可运行实战与迁移指南。
Rolldown
Vite 8
Rust
前端工程化
打包器
构建工具
OXC
Rollup
性能优化
Tree Shaking
从PagedAttention到Prefix Caching:2026年LLM推理KV Cache优化工程实践
编程
从PagedAttention到Prefix Caching:2026年LLM推理KV Cache优化工程实践
2026-07-07 16:15:25 +0800 CST
view 179
深入解析2026年大模型推理中的KV Cache优化技术栈:从PagedAttention虚拟分页管理、Prefix Caching缓存复用、Speculative Decoding并行验证,到INT8量化与Continuous Batching生产实践,配合代码示例与性能对比,助你系统性掌握LLM推理优化的核心要领。
LLM
KV Cache
PagedAttention
Prefix Caching
vLLM
推理优化
Speculative Decoding
OpenWorker 深度解析:吴恩达的桌面 AI 智能体,从 aisuite 到生产级 Agent 架构的完整演进
编程
OpenWorker 深度解析:吴恩达的桌面 AI 智能体,从 aisuite 到生产级 Agent 架构的完整演进
2026-07-26 12:13:55 +0800 CST
view 439
深度解析吴恩达开源的桌面AI智能体OpenWorker:aisuite统一模型接口、Agent运行时架构、权限沙箱、记忆系统、任务规划、ReAct执行循环、工具系统、多模型策略、成本优化与实战应用。
OpenWorker
AI Agent
aisuite
桌面智能体
吴恩达
Andrew Ng
多模型
Ollama
本地LLM
Agent架构
Vite 8.0 深度拆解:当 Rolldown 用 Rust 统一打包器——从双引擎到单核的架构革命如何让前端构建快 30 倍
编程
Vite 8.0 深度拆解:当 Rolldown 用 Rust 统一打包器——从双引擎到单核的架构革命如何让前端构建快 30 倍
2026-08-03 23:43:00 +0800 CST
view 107
深度拆解 Vite 8.0 + Rolldown 架构革命:从双引擎到单核的架构变革、Rust 原生打包器五阶段流水线、30 倍性能提升的技术原理、Vite 8.1 实验性特性、完整迁移指南与性能基准对比
Vite
Rolldown
Rust
前端构建
esbuild
Rollup
性能优化
Tree-shaking
WebAssembly
OXC
打包器
HMR
Scope Hoisting
pi-mono 深度拆解:libGDX 作者的 4 万 Star AI Agent 全家桶,不到 1000 token 的 System Prompt 凭什么成为 OpenClaw 的引擎
编程
pi-mono 深度拆解:libGDX 作者的 4 万 Star AI Agent 全家桶,不到 1000 token 的 System Prompt 凭什么成为 OpenClaw 的引擎
2026-07-28 05:13:25 +0800 CST
view 284
深度拆解 libGDX 作者 badlogic 的 4 万 Star 项目 pi-mono:7 包 Monorepo 架构、pi-ai 统一 LLM 层、不到 1000 token 的极简 System Prompt 与学徒哲学,附自定义工具实战与 Claude Code/Codex 对比选型。
pi-mono
AI Agent
Coding Agent
TypeScript
LLM
开源
OpenClaw
开发者工具
vLLM
终端工具
Nushell 0.111 深度解析:用 Rust 重写 Shell,让命令行终于有了数据类型
编程
Nushell 0.111 深度解析:用 Rust 重写 Shell,让命令行终于有了数据类型
2026-05-12 01:44:53 +0800 CST
view 724
深度解析Nushell 0.111核心架构:结构化数据管道替代POSIX字符串流、IR优化器实现管道融合与谓词下推带来3-10倍性能提升、栈式虚拟机执行器保证类型安全与即时错误反馈,附DevOps实战、插件开发与渐进迁移指南
Nushell,Shell,Rust,命令行,结构化数据,数据管道,终端工具,DevOps,CLI,编程工具
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
编程
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
2026-07-10 17:44:16 +0800 CST
view 419
深度对比2026年四大主流LLM推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9,涵盖PagedAttention、FP8量化、ZeRO-3、连续批处理等核心技术原理,配生产级代码示例与实测性能数据。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
量化
AI部署
llmfit 深度拆解:一条命令算清你的机器能跑哪个大模型,Rust 硬件探测与适配度评分引擎全解析
编程
llmfit 深度拆解:一条命令算清你的机器能跑哪个大模型,Rust 硬件探测与适配度评分引擎全解析
2026-07-24 07:14:55 +0800 CST
view 190
深度拆解 GitHub Trending 破万星的 llmfit:Rust 硬件探测、权重与 KV cache 显存估算公式、内存带宽速度模型、MoE offload 运行模式,附 100 行 Python 复现 mini-llmfit 与工程集成实战。
llmfit
Rust
本地大模型
Ollama
llama.cpp
量化
KV cache
MoE
硬件选型
开源
LLM推理引擎终极对决:vLLM vs TensorRT-LLM深度解析与2026生产环境选型指南
编程
LLM推理引擎终极对决:vLLM vs TensorRT-LLM深度解析与2026生产环境选型指南
2026-04-20 13:45:31 +0800 CST
view 925
深度对比vLLM与TensorRT-LLM两大LLM推理框架,从PagedAttention到Kernel Fusion,从量化技术到生产部署,助你做出正确的技术选型决策
LLM
vLLM
TensorRT-LLM
推理优化
大模型部署
量化技术
AI工程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
编程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
2026-08-06 06:16:32 +0800 CST
view 140
深度拆解2026年四大主流LLM推理框架:vLLM 0.5 PagedAttention进化、TGI 2.0流式输出优化、TensorRT-LLM 1.8算子融合、DeepSpeed-MII 0.9自动优化,含完整架构分析、代码实战、性能基准测试与成本计算
LLM
vLLM
TensorRT-LLM
推理框架
PagedAttention
量化
GPU
H100
大模型
DeepSpeed
TGI
2026大模型推理框架年度横评:vLLM/TGI/TensorRT-LLM/DeepSpeed-MII 架构深度解析与生产级选型指南
编程
2026大模型推理框架年度横评:vLLM/TGI/TensorRT-LLM/DeepSpeed-MII 架构深度解析与生产级选型指南
2026-06-18 17:54:54 +0800 CST
view 850
深度横评2026年四大主流大模型推理框架,涵盖PagedAttention架构、ContinuousBatching、算子融合、FP8量化、NVMe卸载等核心技术,配实测数据与生产级选型指南
大模型
LLM
推理框架
vLLM
TensorRT-LLM
TGI
DeepSpeed
GPU推理
AI部署
NVIDIA
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
编程
LLM推理引擎深度实战:从PagedAttention到生产级部署,万字长文吃透2026年最关键的AI基础设施
2026-06-27 12:44:29 +0800 CST
view 389
2026年LLM推理引擎深度实战:从PagedAttention、连续批处理、量化技术到生产级K8s部署,万字长文覆盖vLLM、SGLang、TensorRT-LLM、TGI四大框架架构原理与实测对比
LLM推理
vLLM
PagedAttention
SGLang
推理优化
TensorRT-LLM
生产部署
KV Cache
量化
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
编程
KV Cache 显存优化深度解析:从 PagedAttention 到 2026 年最新压缩技术演进
2026-08-01 15:47:00 +0800 CST
view 171
从第一性原理深度剖析 KV Cache 显存困境,系统拆解 PagedAttention 核心原理,对比 vLLM/TensorRT-LLM/SGLang 三大推理框架技术路线,涵盖 FP8/INT4 量化、前缀缓存、StreamingLLM 等 2026 年最新压缩技术,含完整代码示例与生产调优指南。
KV Cache
PagedAttention
vLLM
TensorRT-LLM
SGLang
LLM推理
GPU优化
显存优化
量化
深度学习
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
编程
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
2026-07-03 13:49:04 +0800 CST
view 455
深度对比 vLLM 0.5、TensorRT-LLM 1.8、TGI 2.0、DeepSpeed-MII 0.9 四大推理框架,从核心技术原理、性能数据、成本账本到生产部署实战,帮你做出正确的框架选型决策。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
大模型部署
GPU优化
TensorRT-LLM 深度实战:从 Blackwell 架构到 INT4 量化的 LLM 推理性能革命
编程
TensorRT-LLM 深度实战:从 Blackwell 架构到 INT4 量化的 LLM 推理性能革命
2026-05-22 06:19:51 +0800 CST
view 796
深入解析TensorRT-LLM推理框架,从Paged KV Cache、连续批处理到INT4/INT8/FP8量化实战,覆盖Blackwell架构适配、Triton部署与K8s生产方案
TensorRT-LLM
LLM推理
量化
INT4
Blackwell
GPU优化
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
编程
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
2026-06-21 08:54:17 +0800 CST
view 775
Ollama 0.30 深度解析:双引擎推理架构、Gemma 4 QAT、Cohere2 MoE、ollama launch 生态与生产级部署完全指南
Ollama
LLM
本地推理
AI编程
llama.cpp
MLX
Gemma
开源
PostgreSQL 19 深度解析:从零停机 REPACK 到「自治 Vacuum」,PostgreSQL 的运维范式革命
编程
PostgreSQL 19 深度解析:从零停机 REPACK 到「自治 Vacuum」,PostgreSQL 的运维范式革命
2026-07-23 01:47:24 +0800 CST
view 184
PostgreSQL 19 深度解析:零停机 REPACK、并行与优先级 Autovacuum 三大特性,从 MVCC 病根到可落地调优,终结 DBA 的熬夜运维。
PostgreSQL 19
REPACK
Autovacuum
并行清理
数据库运维
MVCC
表膨胀
Code Review Graph 深度拆解:GitHub Trending 第一的 AI 代码审查图谱,如何把 Token 消耗降低 82 倍
编程
Code Review Graph 深度拆解:GitHub Trending 第一的 AI 代码审查图谱,如何把 Token 消耗降低 82 倍
2026-07-28 09:15:14 +0800 CST
view 126
深度拆解 2026 年 7 月登顶 GitHub Trending 的 code-review-graph:Tree-sitter+知识图谱+MCP 协议,如何把 AI 代码审查的 Token 消耗降低 82 倍,从架构原理到 GitHub Action 实战完整覆盖
code-review-graph
Tree-sitter
MCP
AI编程
知识图谱
代码审查
template-vue3-gin-fullstack:Vue3+Go Gin前后端分离全栈项目模板,开箱即用
案例
template-vue3-gin-fullstack:Vue3+Go Gin前后端分离全栈项目模板,开箱即用
2026-05-09 10:27:01 +0800 CST
view 634
template-vue3-gin-fullstack:一款基于Vue3+Go Gin的前后端分离全栈项目模板。技术栈涵盖Vue3.4+TypeScript5+Vite5+Pinia+TailwindCSS前端,以及Go1.22+Gin1.9+GORM+PostgreSQL+Redis+JWT+Zap后端。目录分层清晰(Handler/Service/Repository),JWT认证、Swagger文档、GitHub Actions CI/CD全部配好,clone即可开写业务代码。
全栈模板
Vue3
Go Gin
前后端分离
TypeScript
项目架构
CI/CD
GitHub Actions
PostgreSQL
Redis
JWT
Valkey 深度拆解:当 Redis 把钥匙交出去——从异步 I/O 线程、嵌入式哈希表到 2000 节点集群的工程革命(2026)
编程
Valkey 深度拆解:当 Redis 把钥匙交出去——从异步 I/O 线程、嵌入式哈希表到 2000 节点集群的工程革命(2026)
2026-07-17 08:15:16 +0800 CST
view 309
深度拆解 Valkey:从 Redis 许可证地震、异步 I/O 线程重写、嵌入式哈希表内存优化、双通道复制,到集群原子槽位迁移、2000 节点规模与 RESP3,附 Docker/Go/Lua 集群部署与 Redis 迁移实战。
Valkey
Redis
内存键值数据库
缓存
集群
RESP3
异步IO
Linux基金会
嵌入式哈希表
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
78
79
80
81
82
...
116
下一页