程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
SPEC CPU 2026 深度解析:九年磨一剑,52 个基准测试如何重塑 CPU 性能评估标准
编程
SPEC CPU 2026 深度解析:九年磨一剑,52 个基准测试如何重塑 CPU 性能评估标准
2026-05-18 17:44:27 +0800 CST
view 748
2026年5月5日SPEC正式发布SPEC CPU 2026基准测试套件,九年来首次重大版本更新。52个基准测试、源码行数翻倍、内存需求64GB、全面拥抱AI工作负载。本文深度解析新特性、技术架构升级及Intel/AMD/NVIDIA实测对比。
CPU
基准测试
SPEC
Intel
AMD
Arm
编译器
LLVM
性能优化
服务器
从 43 到 52:SPEC CPU 2026 深度解析——九年磨一剑,CPU 性能评估标准全面重塑
编程
从 43 到 52:SPEC CPU 2026 深度解析——九年磨一剑,CPU 性能评估标准全面重塑
2026-05-18 17:48:07 +0800 CST
view 1244
2026年5月5日SPEC正式发布SPEC CPU 2026基准测试套件,九年来首次重大版本更新。52个基准测试、源码行数翻倍、内存需求64GB、全面拥抱AI工作负载。本文深度解析新特性、技术架构升级及Intel/AMD/NVIDIA实测对比。
CPU
基准测试
SPEC
Intel
AMD
Arm
编译器
LLVM
性能优化
服务器
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
编程
XY-Serve 深度实战:当昇腾 NPU 终于学会「驯服动态负载」——从元原语分解、Token级调度到 Attention/Linear 双内核优化的完整工程指南(2026)
2026-07-21 08:20:26 +0800 CST
view 157
华为联合清华大学开源的 XY-Serve 论文被 ASPLOS 2026 录用,解决了 NPU 上高效运行动态 LLM 负载的核心挑战。吞吐量提升95%,Attention 内核提速21.5%,Linear 内核提速14.6%。
XY-Serve
华为昇腾
NPU
LLM推理
Meta-Attention
虚拟填充
动态负载
ASPLOS
AI基础设施
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
编程
FlashPrefill 深度解析:当瞬时注意力遇上 GPU 原语——从 O(N²) 困境到 27 倍速的工程革命
2026-04-15 17:20:25 +0800 CST
view 741
深度解析中科院与腾讯微信联合研发的 FlashPrefill 如何通过即时注意力模式发现和动态阈值筛选,将 25.6 万字符长文本处理速度提升 27.78 倍,同时保持近乎完美的精度。
LLM推理优化
FlashAttention
GPU计算
长文本处理
注意力机制
Transformer
深度学习
MoneyPrinterTurbo 深度拆解:一个关键词如何端到端跑出一条高清短视频——AI 视频生成流水线的工程内幕
编程
MoneyPrinterTurbo 深度拆解:一个关键词如何端到端跑出一条高清短视频——AI 视频生成流水线的工程内幕
2026-07-14 19:41:50 +0800 CST
view 224
从 LLM 脚本、Pexels 素材检索、Edge TTS 配音、字幕生成到 FFmpeg 合成,深度拆解 MoneyPrinterTurbo 的端到端 AI 视频生成流水线架构,并附可运行核心代码与规模化性能优化。
MoneyPrinterTurbo
AI视频生成
短视频自动化
FFmpeg
LLM
TTS
Python
内容创作
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
编程
Kimi K3 架构深度解析:从第一性原理吃透 2.8 万亿参数 MoE 模型的三层核心创新
2026-08-01 14:17:55 +0800 CST
view 128
深度解析 Kimi K3 的三大架构创新:KDA 混合线性注意力、Attention Residuals 注意力残差、Stable LatentMoE 分位数均衡路由,从第一性原理配代码示例吃透 2.8 万亿参数 MoE 模型。
Kimi
K3
MoE
KDA
AttnRes
StableLatentMoE
LLM
开源大模型
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
编程
Vibe-Trading 深度拆解:当 LLM 学会「炒股」——自然语言量化交易的多智能体架构与工程实践
2026-07-15 11:45:26 +0800 CST
view 488
深度拆解港大HKUDS开源的Vibe-Trading项目:ReAct循环驱动的自然语言量化交易Agent、69个金融技能按需加载、30个多智能体Swarm团队、四大市场回测引擎、456个Alpha因子库,以及Shadow Account行为诊断功能,配完整代码示例与工程边界分析。
Vibe-Trading
LLM
量化交易
多智能体
ReAct
金融科技
HKUDS
Alpha Zoo
Shadow Account
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
编程
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
2026-06-08 20:52:38 +0800 CST
view 429
2026年3月Google Research在ICLR 2026发表TurboQuant算法,将LLM的KV缓存压缩至3-bit,实现6倍内存缩减和8倍推理加速。本文深入剖析TurboQuant的技术原理,并提供生产级部署指南。
TurboQuant
KV缓存压缩
LLM推理优化
量化算法
Google Research
ICLR2026
OpenTelemetry 深度实战:从 SDK 埋点、W3C 上下文传播到 Collector 流水线、尾部采样与全链路关联的工程全解(2026)
编程
OpenTelemetry 深度实战:从 SDK 埋点、W3C 上下文传播到 Collector 流水线、尾部采样与全链路关联的工程全解(2026)
2026-07-22 04:44:03 +0800 CST
view 164
OpenTelemetry 深度实战:从 SDK 手动埋点、W3C 上下文传播到 Collector 流水线、尾部采样与全链路关联,配 Go/Python 代码与生产级 Collector 配置,覆盖采样策略与基数控制等性能优化。
OpenTelemetry
可观测性
分布式追踪
OTLP
Collector
W3C
尾部采样
OpenTelemetry 深度实战:从三大信号模型、Collector 管线、W3C 上下文传播到尾部采样与 eBPF 无侵入埋点的生产级可观测性完全指南(2026)
编程
OpenTelemetry 深度实战:从三大信号模型、Collector 管线、W3C 上下文传播到尾部采样与 eBPF 无侵入埋点的生产级可观测性完全指南(2026)
2026-07-09 05:43:14 +0800 CST
view 336
从原理到落地的 OpenTelemetry 长文:讲清 traces/metrics/logs 三大信号模型、OTLP 协议、Collector 接收-处理-导出管线,手写 Go/Python 埋点与跨进程 W3C Trace Context 传播,配置尾部采样与 eBPF 零代码埋点,并给出采样、批处理、基数的生产级性能优化清单。
OpenTelemetry
可观测性
分布式追踪
Collector
eBPF
WinRM for Go — 用Go语言远程管理Windows机器
编程
WinRM for Go — 用Go语言远程管理Windows机器
2026-07-04 07:36:57 +0800 CST
view 236
WinRM for Go是纯Go实现的Windows远程管理库,支持Basic/NTLM/Kerberos认证,可通过SSH隧道穿透内网。让Go开发者像SSH连Linux一样远程操作Windows服务器,执行命令、获取输出,适合自动化运维场景。
WinRM
Go
Windows
远程管理
NTLM
Kerberos
SSH隧道
运维
PowerShell
Google AI Edge Gallery 深度拆解:当手机成为大模型的「离线战场」——从 LiteRT 推理引擎到端侧 GenAI 的工程全貌(2026)
编程
Google AI Edge Gallery 深度拆解:当手机成为大模型的「离线战场」——从 LiteRT 推理引擎到端侧 GenAI 的工程全貌(2026)
2026-07-18 12:44:38 +0800 CST
view 209
深度拆解 Google AI Edge Gallery 开源项目:LiteRT 推理引擎架构、INT4 量化原理、多模态支持、模型转换实战、企业级落地场景,配完整 Kotlin 代码示例与性能优化指南。
Google AI Edge Gallery
LiteRT
端侧AI
大模型
Android
量化
多模态
离线推理
移动端部署
GenAI
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
编程
DiffusionGemma 深度实战:当文本扩散重新定义本地AI推理——从'打字机'到'印刷机'的4倍速架构革命
2026-06-12 17:21:39 +0800 CST
view 342
2026年6月Google发布DiffusionGemma,首个生产级文本扩散大模型,本地推理速度提升4倍。本文深入剖析其从自回归到并行生成的架构革命,附完整代码实战。
DiffusionGemma
文本扩散
本地AI
Gemma
大模型推理
扩散模型
Python
Ollama
Google AI Edge Gallery 深度实战:让 Mac/Android 离线运行 Gemma 3——从原理到生产级本地 AI 部署完全指南(2026)
编程
Google AI Edge Gallery 深度实战:让 Mac/Android 离线运行 Gemma 3——从原理到生产级本地 AI 部署完全指南(2026)
2026-06-04 21:14:37 +0800 CST
view 483
深入剖析 Google AI Edge Gallery 的技术架构、Gemma 模型家族、端侧部署全流程,并通过完整代码示例,带你从零构建一个生产级本地 AI 应用。
Google AI Edge Gallery
本地AI
Gemma模型
端侧推理
Mac AI
Android AI
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
编程
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
2026-06-21 08:54:17 +0800 CST
view 650
Ollama 0.30 深度解析:双引擎推理架构、Gemma 4 QAT、Cohere2 MoE、ollama launch 生态与生产级部署完全指南
Ollama
LLM
本地推理
AI编程
llama.cpp
MLX
Gemma
开源
综合
Tkinter 焕新利器:ttkbootstrap —— 打造美观现代的 Bootstrap 主题
2024-11-19 04:25:20 +0800 CST
view 3110
ttkbootstrap是Tkinter的主题扩展,提供现代化的Bootstrap风格主题,具有高度可定制性和丰富的组件。支持按需加载,优化内存使用,兼容多个平台。用户可以通过简单的CSS修改或使用ttkcreator工具进行定制。ttkbootstrap适用于各种应用程序,如数据可视化工具、管理系统和教育软件,提升用户体验和界面美观性。
Tkinter
主题
用户界面
开发工具
跨平台
Claude Code 暗藏后门:一次被逆向工程曝光的「主动投毒」事件全记录
编程
Claude Code 暗藏后门:一次被逆向工程曝光的「主动投毒」事件全记录
2026-07-10 15:14:53 +0800 CST
view 334
2026年7月,Anthropic旗下Claude Code被逆向工程曝光内置隐蔽检测机制。本文深度还原技术细节:XOR加密域名黑名单、Unicode隐写术传递用户画像、工信部官方警告与阿里全面禁用的完整记录。
Claude Code
安全
后门
逆向工程
隐写术
Anthropic
AI编程工具
隐私
Context Engineering:超越 Prompt Engineering 的 AI 工程新范式
编程
Context Engineering:超越 Prompt Engineering 的 AI 工程新范式
2026-07-05 01:47:09 +0800 CST
view 222
深入探讨Context Engineering的核心概念、架构设计、上下文压缩技术和生产环境最佳实践。
AI工程
Context Engineering
Prompt Engineering
大模型
上下文管理
Ant 深度拆解:当一个 9MB 的 JavaScript 运行时决定「干掉 V8」——从自研 Silver 引擎到 MIR JIT 后端,一个 Show HN 爆款如何重新定义边缘计算的运行时范式
编程
Ant 深度拆解:当一个 9MB 的 JavaScript 运行时决定「干掉 V8」——从自研 Silver 引擎到 MIR JIT 后端,一个 Show HN 爆款如何重新定义边缘计算的运行时范式
2026-08-04 01:13:29 +0800 CST
view 30
深度拆解Ant JavaScript运行时:9MB二进制、5.5ms冷启动、自研Silver引擎、MIR JIT后端的技术原理与工程实践,附完整竞品对比与迁移指南
JavaScript
运行时
Ant
边缘计算
Serverless
V8
JIT
WebAssembly
TypeScript
MIR
Go 1.24 深度解析:Swiss Tables 革新 map 性能、泛型类型别名解禁、weak 包登场
编程
Go 1.24 深度解析:Swiss Tables 革新 map 性能、泛型类型别名解禁、weak 包登场
2026-04-28 16:23:21 +0800 CST
view 634
深入解析 Go 1.24 重大更新:Swiss Tables 让 map 性能提升 20-30%、泛型类型别名八年解禁、weak 包和 runtime.AddCleanup 登场、FIPS 140-3 合规与后量子加密标准库支持。附完整代码示例与迁移指南。
Go
map
Swiss Tables
泛型
标准库
后量子
FIPS140
weak
runtime
crypto
eBPF 可观测性革命:从内核无侵入采集到生产级全链路追踪的深度实战
编程
eBPF 可观测性革命:从内核无侵入采集到生产级全链路追踪的深度实战
2026-07-23 03:43:51 +0800 CST
view 147
深度解析 eBPF 如何在不改一行业务代码的前提下,从内核态无侵入采集系统调用、网络与文件 I/O,并用 bpftrace、BCC、Aya 实战构建生产级可观测性与零埋点分布式追踪。
eBPF
可观测性
内核
bpftrace
BCC
Aya
分布式追踪
OpenTelemetry
Go 1.26 深度实战:Green Tea GC、new(expr)、Secret 模式与生产级迁移全链路解析
编程
Go 1.26 深度实战:Green Tea GC、new(expr)、Secret 模式与生产级迁移全链路解析
2026-05-09 07:37:34 +0800 CST
view 659
从生产环境视角深度解析 Go 1.26 全部核心特性:Green Tea GC 性能实测、new(expr) 语法实战、Secret 安全执行域、SIMD 向量计算、后量子加密 HPKE、goroutine 泄漏检测,以及完整的生产级迁移检查清单。
Go
GC
Green Tea
runtime
SIMD
HPKE
泛型
生产迁移
React 19.2 深度实战:Activity、useEffectEvent 与部分预渲染——一次重写前端渲染心智模型的工程实践
编程
React 19.2 深度实战:Activity、useEffectEvent 与部分预渲染——一次重写前端渲染心智模型的工程实践
2026-07-10 18:44:59 +0800 CST
view 198
深度实战 React 19.2 三大新特性:Activity 可控活动边界、useEffectEvent 事件逻辑解耦、部分预渲染与 cacheSignal,配可运行 TSX 代码与性能优化地图。
React 19.2
Activity
useEffectEvent
部分预渲染
React Compiler
前端渲染
DuckDB 深度拆解:当「分析界的 SQLite」装上湖仓引擎——从向量化执行、VARIANT 类型到 DuckLake 三层架构革命(2026)
编程
DuckDB 深度拆解:当「分析界的 SQLite」装上湖仓引擎——从向量化执行、VARIANT 类型到 DuckLake 三层架构革命(2026)
2026-07-17 04:43:20 +0800 CST
view 200
深度拆解 DuckDB 1.5 Variegata:进程内向量化执行引擎、VARIANT 半结构化类型、与 DuckLake 湖仓三层架构,含 Python/SQL 实战与性能优化。
DuckDB
OLAP
向量化执行
VARIANT
DuckLake
湖仓一体
列式存储
数据分析
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
54
55
56
57
58
...
83
下一页