程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
编程
百度 Unlimited OCR 深度解析:端到端长文档 OCR 的新范式——从 R-SWA 机制到 3B 参数模型、从 KV Cache 压缩到生产级部署的完整技术指南(2026)
2026-07-04 03:13:57 +0800 CST
view 276
2026年6月百度开源Unlimited OCR,5天GitHub Star破1万。深度解析R-SWA机制、3B参数模型架构、KV Cache压缩原理,含完整部署代码与生产级应用案例。
百度
Unlimited OCR
OCR
R-SWA
KV Cache
长文档识别
端到端OCR
多模态模型
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
编程
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
2026-06-28 06:43:54 +0800 CST
view 435
百度2026年6月开源Unlimited OCR:30亿参数仅激活5亿,R-SWA注意力把KV Cache压成常数,一次前向推理处理几十页文档,OmniDocBench v1.6得分93.92%刷新SOTA。
百度 Unlimited OCR
OCR
R-SWA
长文档
端到端
MoE
SGLang
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
编程
TensorRT-LLM 1.0 深度实战:当 PyTorch 架构成为默认体验,NVIDIA 的 LLM 推理引擎正式走向成熟
2026-07-22 10:46:37 +0800 CST
view 82
深度解析 TensorRT-LLM 1.0:PyTorch 架构正式稳定、LLM API 稳定化、多模态 VLM 原生支持、Qwen3 MoE 优化、LoRA 生产级管理、trtllm-serve 推理服务化,配完整部署实战代码。
TensorRT-LLM
LLM推理
GPU加速
PyTorch
NVIDIA
深度学习
模型部署
推理优化
JetBrains 2026 全线产品深度解析:ACP 注册表内置 AI 智能体、MCP 服务器、Recap/Insights——传统 IDE 的「绝地反击」
编程
JetBrains 2026 全线产品深度解析:ACP 注册表内置 AI 智能体、MCP 服务器、Recap/Insights——传统 IDE 的「绝地反击」
2026-05-15 09:18:50 +0800 CST
view 724
JetBrains 2026全线IDE发布:ACP注册表让Codex/Claude Agent等智能体内置IDE、MCP服务器暴露IDE代码理解能力、Recap和Insights主动式AI辅助、Git工作树人机并行开发。深度解析6大IDE核心特性与AI时代战略。
JetBrains,IntelliJ IDEA,ACP,MCP,AI Agent,IDE
CSP 3.0 与 WebAssembly:浏览器安全策略的范式革命
编程
CSP 3.0 与 WebAssembly:浏览器安全策略的范式革命
2026-07-27 06:14:24 +0800 CST
view 16
2026年深度解析CSP 3.0对WebAssembly的安全控制:wasm-unsafe-eval原理、Worker双重检查、生产配置最佳实践与性能影响,程序员视角的WASM安全指南。
WebAssembly
CSP 3.0
浏览器安全
CSP
WASM
W3C
前端安全
Content-Security-Policy
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM——从编译原理到性能极致优化的完整技术指南(2026)
编程
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM——从编译原理到性能极致优化的完整技术指南(2026)
2026-07-04 05:42:15 +0800 CST
view 465
Vue 3.6 Vapor Mode 深度解析:跳过虚拟 DOM,直接操作真实 DOM,内存砍半,性能媲美 SolidJS 和 Svelte 5。含完整代码示例与生产级部署指南。
Vue
Vapor Mode
虚拟DOM
前端框架
性能优化
编译时优化
SolidJS
Svelte
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 496
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
Svelte 5 完全解析:从 Runes 语法到响应式革命,前端性能的新天花板
编程
Svelte 5 完全解析:从 Runes 语法到响应式革命,前端性能的新天花板
2026-06-15 09:21:13 +0800 CST
view 351
深入解析 Svelte 5 的 Runes 语法系统,对比 React Hooks 和 Vue Composition API,探讨编译时优化的原理与实践
Svelte
Runes
前端
响应式
性能优化
Svelte 5 深度拆解:当编译时框架学会「显式响应式」——Runes 符文、信号机制与零虚拟 DOM 如何重写前端性能心智模型
编程
Svelte 5 深度拆解:当编译时框架学会「显式响应式」——Runes 符文、信号机制与零虚拟 DOM 如何重写前端性能心智模型
2026-07-16 03:12:49 +0800 CST
view 126
从背景、核心概念、编译器架构、代码实战到性能优化,彻底拆解 Svelte 5 的 Runes 响应式系统与信号机制。
Svelte 5
Runes
响应式
信号
前端框架
编译时
零虚拟DOM
性能优化
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
编程
vLLM 深度拆解:当大模型推理学会「分页注意力」——PagedAttention、连续批处理与 V1 引擎如何重写 GPU 推理服务的心智模型
2026-07-16 04:19:16 +0800 CST
view 140
从工程师视角深度拆解 vLLM:PagedAttention 分页注意力、连续批处理、V1 引擎架构、KV Cache 管理、量化与投机解码,配 OpenAI 兼容服务、引导解码与生产调优实战。
vLLM
PagedAttention
连续批处理
大模型推理
GPU推理服务
KV缓存
V1引擎
别再手写汇编了!Go 1.27 原生SIMD,性能直接起飞
编程
别再手写汇编了!Go 1.27 原生SIMD,性能直接起飞
2026-07-04 08:18:54 +0800 CST
view 211
Go 1.27正式支持原生SIMD,无需手写Plan9汇编即可使用向量指令。底层archsimd包+高层Highway封装,两步走策略。Green Tea GC已用SIMD让GC开销降10%,runtime.freegc让strings.Builder扩容翻2倍。高性能计算牌桌上Go正式入座。
Go
SIMD
AVX
AVX-512
ARM64
NEON
SVE
高性能计算
并行计算
GreenTeaGC
编译器优化
CVE-2026-47101 深度解析:当 AI 网关的 RBAC 被一行 API 调用彻底瓦解——从权限校验缺陷到 proxy_admin 提权的全链路完全指南(2026)
编程
CVE-2026-47101 深度解析:当 AI 网关的 RBAC 被一行 API 调用彻底瓦解——从权限校验缺陷到 proxy_admin 提权的全链路完全指南(2026)
2026-06-15 12:16:01 +0800 CST
view 549
2026年AI基础设施领域最危险的安全事件之一:CVE-2026-47101 LiteLLM权限提升漏洞深度解析,CVSS 8.8,影响全球11.8万+实例,从漏洞根因到生产修复全链路指南
CVE
LiteLLM
RBAC
AI安全
权限提升
Python
漏洞分析
网络安全
AI基础设施
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,185万行/秒的速度意味着什么?
编程
Pyrefly 深度解析:Facebook 用 Rust 重写 Python 类型检查器,185万行/秒的速度意味着什么?
2026-07-27 13:16:46 +0800 CST
view 7
深度解析 Facebook 出品的 Pyrefly:Rust 实现的 Python 类型检查器,每秒检查 185 万行代码,比 Pyright 快 15 倍。涵盖架构设计、性能优化、Tensor Shapes、AI 编程集成,附实战指南与竞品对比。
Python
类型检查器
Rust
Meta
Facebook
Pyright
Mypy
LSP
AI编程
Tensor Shapes
从购物清单到 AI 编程助手:深度解析 Bubble Tea 架构如何驱动 14 万星开源项目 OpenCode
编程
从购物清单到 AI 编程助手:深度解析 Bubble Tea 架构如何驱动 14 万星开源项目 OpenCode
2026-04-17 21:18:16 +0800 CST
view 651
深度解析 Bubble Tea(基于 Elm 架构的 Go 语言 TUI 框架)如何驱动 GitHub 14.4万星的开源 AI 编程助手 OpenCode,涵盖三层 Agent 架构、Provider-Agnostic 设计、客户端/服务器架构等核心技术。
Bubble Tea
OpenCode
TUI
Go
AI编程助手
Elm架构
当 AI 编程遇上 Context-Mode:上下文管理范式的降维打击
编程
当 AI 编程遇上 Context-Mode:上下文管理范式的降维打击
2026-06-09 22:20:29 +0800 CST
view 505
登顶GitHub Trending的Context-Mode如何让AI编程成本降低98%?系统拆解上下文外置隔离、语义智能检索、计算逻辑外移、输出范式精简四大核心降本技术,附生产级落地指南。
AI编程
Context-Mode
MCP
上下文管理
Token优化
Go 1.26 深度实战:绿茶GC、泛型自愈与栈分配革命——从语言内核到生产级性能调优的完整指南
编程
Go 1.26 深度实战:绿茶GC、泛型自愈与栈分配革命——从语言内核到生产级性能调优的完整指南
2026-05-22 04:49:01 +0800 CST
view 555
2026年2月,Go 1.26 正式发布。这场被社区称为"史上最强性能更新"的版本,带来了全新的"绿茶"(Green Tea)垃圾回收算法、泛型类型约束的自我引用突破、栈分配逃逸分析的智能化升级。本文将从底层原理到生产实践,带你完整掌握 Go 1.26 的所有重大变革。
Go 1.26
Green Tea GC
泛型
性能优化
栈分配
SIMD
Go语言
Temporal 深度解析:分布式持久化执行引擎如何终结微服务编排的地狱模式
编程
Temporal 深度解析:分布式持久化执行引擎如何终结微服务编排的地狱模式
2026-04-18 02:45:06 +0800 CST
view 818
深度解析Temporal持久化执行引擎的架构设计、事件溯源机制、Go SDK实战与生产调优,从微服务编排困境到分布式容错的全链路技术剖析
Temporal
分布式
微服务
Go
工作流引擎
Go 1.26 深度实战:Green Tea GC 与泛型增强——从逃逸分析到 SIMD 加速的生产级性能调优
编程
Go 1.26 深度实战:Green Tea GC 与泛型增强——从逃逸分析到 SIMD 加速的生产级性能调优
2026-05-22 04:49:25 +0800 CST
view 748
2026年2月,Go 1.26 正式发布。这场被社区称为"史上最强性能更新"的版本,带来了全新的"绿茶"(Green Tea)垃圾回收算法、泛型类型约束的自我引用突破、栈分配逃逸分析的智能化升级。本文将从底层原理到生产实践,带你完整掌握 Go 1.26 的所有重大变革。
Go 1.26
Green Tea GC
泛型
性能优化
栈分配
SIMD
Go语言
TEN Framework 深度解析:当实时多模态语音 AI 遇上真正的"即插即用"
编程
TEN Framework 深度解析:当实时多模态语音 AI 遇上真正的"即插即用"
2026-04-08 19:04:47 +0800 CST
view 642
TEN Framework 是一个开源的实时多模态对话 AI 框架,让开发者能够像搭积木一样快速构建低延迟、高质量的实时语音/视频 AI Agent。本文深度解析其核心架构、实战应用与性能优化策略。
TEN Framework
语音AI
实时多模态
WebRTC
AI Agent
异步 Rust 的未来之战:Tokio 调度器深度解析——从协作式调度到多线程负载均衡
编程
异步 Rust 的未来之战:Tokio 调度器深度解析——从协作式调度到多线程负载均衡
2026-06-15 18:48:40 +0800 CST
view 371
深入解析 Tokio 调度器架构:从 Future 状态机本质、Work-Stealing 无锁队列,到多线程负载均衡、生产级性能调优,结合 Tonic 加入 gRPC 等 2026 年生态新动态
Rust
async
Tokio
异步编程
Work-Stealing
调度器
Go 1.26 深度实战:当「精益求精」遇上「性能暴击」——从 Green Tea GC 到 new(expr) 语法糖的全方位完全指南(2026)
编程
Go 1.26 深度实战:当「精益求精」遇上「性能暴击」——从 Green Tea GC 到 new(expr) 语法糖的全方位完全指南(2026)
2026-06-15 19:20:33 +0800 CST
view 507
Go 1.26 全面解析:Green Tea GC 默认启用降低 10-40% CPU 开销,new(expr) 语法糖革新指针初始化,go fix 彻底重构,slog 正式转正,Crypto 库重构加速 29-81%,从原理到实战深度讲解。
Go语言
Golang
GC
性能优化
GreenTea
编程
TensorRT-LLM 深度实战:从 Blackwell 架构到 INT4 量化的 LLM 推理性能革命
编程
TensorRT-LLM 深度实战:从 Blackwell 架构到 INT4 量化的 LLM 推理性能革命
2026-05-22 06:19:51 +0800 CST
view 605
深入解析TensorRT-LLM推理框架,从Paged KV Cache、连续批处理到INT4/INT8/FP8量化实战,覆盖Blackwell架构适配、Triton部署与K8s生产方案
TensorRT-LLM
LLM推理
量化
INT4
Blackwell
GPU优化
Open-WebUI 深度实战:当本地大模型遇上生产级 Web 界面——从 RAG 管道到多模型统一编排的完全指南(2026)
编程
Open-WebUI 深度实战:当本地大模型遇上生产级 Web 界面——从 RAG 管道到多模型统一编排的完全指南(2026)
2026-06-10 03:16:35 +0800 CST
view 736
深入剖析 Open-WebUI 架构设计、RAG 实现原理、多模型编排机制,含大量可运行代码示例,覆盖从本地部署到生产级优化的完整流程。
Open-WebUI
本地大模型
RAG
FastAPI
Svelte
给 AI Agent 装上生产级可观测性:用 OpenTelemetry 把 LLM 工作流从黑盒变白盒
编程
给 AI Agent 装上生产级可观测性:用 OpenTelemetry 把 LLM 工作流从黑盒变白盒
2026-07-10 11:47:48 +0800 CST
view 210
深度解析2026年AI工程化最关键方向——AI Agent可观测性,涵盖OpenTelemetry LLM语义约定、MCP协议链路追踪、OpenLIT全链路平台,附生产级Go代码实现
AI Agent
OpenTelemetry
LLM
可观测性
生产级
Go
链路追踪
Token优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
72
73
74
75
下一页