程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
编程
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
2026-06-16 01:17:28 +0800 CST
view 704
llama.cpp 是端侧 LLM 推理的事实标准(180K+ Stars)。本文从源码架构、GGUF 格式、量化方法、跨平台后端、生产部署、性能优化到 DeepSeek V4 Flash 实战,全方位讲解本地 AI 推理。
llama.cpp
GGUF
量化
端侧推理
本地AI
C/C++
Apple Silicon
前端工具链的Rust革命:从Vite 8到Vite+,尤雨溪的「一次编写、极速构建」终极愿景
编程
前端工具链的Rust革命:从Vite 8到Vite+,尤雨溪的「一次编写、极速构建」终极愿景
2026-07-23 01:12:52 +0800 CST
view 180
深度解析Vite 8底层革命:Rolldown替换esbuild+Rollup双轨制,性能提升10~30倍。全面解读Vite+一体化工具链设计哲学,从项目创建到生产构建的统一入口。涵盖Rolldown技术架构、Oxc工具链、性能基准测试及实战迁移指南。
Vite 8
Rolldown
Vite+
Oxc
Rust
前端工具链
VoidZero
前端构建工具
Module Federation
Vite Plus
Google AI Edge Gallery:手机离线跑大模型时代来了,2.2万Star端侧AI神器
案例
Google AI Edge Gallery:手机离线跑大模型时代来了,2.2万Star端侧AI神器
2026-05-09 07:36:45 +0800 CST
view 1025
Google开源AI神器AI Edge Gallery斩获2.2万Star,支持iOS和Android手机离线运行Gemma 4等大模型,提供AI Chat、Ask Image、Audio Scribe、Agent Skills四大功能,消费级入口形态让普通用户轻松体验端侧AI
端侧AI
手机大模型
离线推理
Gemma 4
Google开源
iOS
Android
Google TimesFM 深度解析:14K Star 的时间序列基础模型如何用 200M 参数颠覆零样本预测
编程
Google TimesFM 深度解析:14K Star 的时间序列基础模型如何用 200M 参数颠覆零样本预测
2026-04-28 18:22:55 +0800 CST
view 657
深度解析 Google TimesFM:200M 参数如何在 1000 亿时间点上预训练后实现零样本超越有监督模型,覆盖架构原理、代码实战、性能对比与生产部署完整指南。
AI大模型
时间序列预测
Google
TimesFM
零样本预测
深度学习
GitHub开源
预训练模型
DiffusionGemma 深度实战:当文本生成告别逐字蹦字——从离散扩散到 1100 tokens/s 的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当文本生成告别逐字蹦字——从离散扩散到 1100 tokens/s 的生产级完全指南(2026)
2026-06-16 07:18:07 +0800 CST
view 384
Google DeepMind 开源 DiffusionGemma 离散文本扩散模型深度实战:从并行去噪原理到 1100 tokens/s 推理,完整代码示例与 Agent 构建
DiffusionGemma
文本扩散
离散扩散
LLM
开源模型
Google DeepMind
Sidecarless服务网格深度解析:Rust+eBPF如何引爆2026年云原生性能革命
编程
Sidecarless服务网格深度解析:Rust+eBPF如何引爆2026年云原生性能革命
2026-05-16 08:17:15 +0800 CST
view 572
深入解析2026年云原生领域最热门的技术趋势——Sidecarless服务网格架构,讲解Rust+eBPF组合如何实现近乎零开销的流量治理,涵盖eBPF内核编程、Cilium/Hubble可观测性、Kmesh双层架构原理,并提供完整的生产环境部署实战代码。
Rust
eBPF
Sidecarless
Kubernetes
云原生
服务网格
Cilium
性能优化
PersonaPlex 深度解析:当 NVIDIA 让全双工语音对话进入「角色扮演」时代
编程
PersonaPlex 深度解析:当 NVIDIA 让全双工语音对话进入「角色扮演」时代
2026-04-09 11:32:36 +0800 CST
view 1019
NVIDIA发布的PersonaPlex在Moshi架构基础上增加了角色扮演和语音克隆能力,让AI可以扮演教师、客服等不同身份进行实时语音对话。本文从架构、代码、实战角度全面解析这项技术突破。
PersonaPlex
NVIDIA
Moshi
全双工语音
AI对话
角色扮演
Tauri 2.0 vs Electron 2026终极横评:桌面跨平台开发的生死局,谁才是未来?
编程
Tauri 2.0 vs Electron 2026终极横评:桌面跨平台开发的生死局,谁才是未来?
2026-06-29 12:15:49 +0800 CST
view 587
2026年Tauri 2.0与Electron终极横评:架构原理、性能数据、安全模型、开发体验、生态对比,并给出真实项目的选型决策树,助你做出正确的技术决策。
Tauri
Electron
桌面开发
跨平台
Rust
JavaScript
TypeScript
zero-native 深度实战:Vercel 用 Zig 杀入桌面应用赛道——超轻量原生壳如何颠覆 Electron 生态
编程
zero-native 深度实战:Vercel 用 Zig 杀入桌面应用赛道——超轻量原生壳如何颠覆 Electron 生态
2026-05-16 09:14:57 +0800 CST
view 934
Vercel Labs 开源 zero-native,用 Zig 构建超轻量桌面应用原生壳,挑战 Electron 的臃肿生态。深度解析架构设计、安全模型、双引擎策略,并与 Tauri 进行全面对比。
Zig
桌面开发
Electron
跨平台
zero-native
Little Snitch for Linux 开源深度解析:当 macOS 传奇防火墙「杀入」Linux 生态
编程
Little Snitch for Linux 开源深度解析:当 macOS 传奇防火墙「杀入」Linux 生态
2026-04-10 00:25:47 +0800 CST
view 751
2026年4月8日Objective Development开源Little Snitch for Linux的eBPF核心代码。本文从源码出发,深度拆解其架构设计、过滤引擎算法、eBPF内核空间实现与用户态程序。
Linux
eBPF
网络安全
Rust
Firewall
Little Snitch
Rust 1.95.0 深度解析:cfg_select! 宏、if let 守卫与标准库进化,一场关于表达力的革命
编程
Rust 1.95.0 深度解析:cfg_select! 宏、if let 守卫与标准库进化,一场关于表达力的革命
2026-04-29 03:40:52 +0800 CST
view 589
Rust 1.95.0 全面解析:cfg_select! 宏替代 cfg-if、match if let 守卫简化嵌套、Vec push_mut 新 API、标准库进化与 Linux 7.0 Rust 内核协同,附完整代码实战。
Rust
cfg_select
模式匹配
标准库
编译器
性能优化
Linux内核
Genkit Go:Google官方AI SDK让Go成为AI应用开发优选语言
编程
Genkit Go:Google官方AI SDK让Go成为AI应用开发优选语言
2026-05-16 11:22:09 +0800 CST
view 577
Google推出Genkit Go,面向AI应用开发的全栈框架,支持Gemini/Claude/Ollama等多模型,提供类型安全输出、Flow可观测执行、中间件系统等能力。
开源项目
AI SDK
Go语言
Google
Tauri 2.0 深度实战:当 Rust 后端遇上系统 WebView——从架构原理到生产级桌面应用开发的完全指南(2026)
编程
Tauri 2.0 深度实战:当 Rust 后端遇上系统 WebView——从架构原理到生产级桌面应用开发的完全指南(2026)
2026-06-10 18:21:18 +0800 CST
view 558
Tauri 2.0深度实战教程,从架构原理到生产级桌面应用开发,包含IPC通信、权限模型、插件生态、性能优化与完整项目实战
Tauri
Rust
桌面开发
Electron
WebView
跨平台
Google LangExtract 深度解析:从非结构化文本到结构化知识的工程化桥梁——零微调实现 100% 可溯源的信息提取
编程
Google LangExtract 深度解析:从非结构化文本到结构化知识的工程化桥梁——零微调实现 100% 可溯源的信息提取
2026-05-09 16:13:25 +0800 CST
view 593
2026年4月Google开源LangExtract,一个基于LLM的结构化信息提取框架。核心创新:字符级溯源(Source Grounding)实现100%可验证提取,零微调只需3-5个示例即可适配任何领域。本文深入解析其技术架构、长文档处理策略、医疗/法律/金融实战应用及生产部署最佳实践。
LangExtract
LLM
信息提取
结构化数据
医疗AI
RAG
Google开源
vLLM 2026 推理引擎全解:从 PagedAttention 到分离式 Prefill,如何把大模型跑出 GPU 极限性能
编程
vLLM 2026 推理引擎全解:从 PagedAttention 到分离式 Prefill,如何把大模型跑出 GPU 极限性能
2026-06-29 17:16:04 +0800 CST
view 508
2026年vLLM 0.18深度解析:PagedAttention显存管理、EAGLE3推测解码、连续批处理、分离式Prefill、FP4量化,附生产级部署代码与Benchmark对比
vLLM
LLM推理
PagedAttention
推测解码
EAGLE3
FP4量化
CUDA
GPU性能优化
万字长文拆解 vLLM 0.18:PagedAttention 如何用操作系统思维颠覆大模型推理
编程
万字长文拆解 vLLM 0.18:PagedAttention 如何用操作系统思维颠覆大模型推理
2026-06-29 17:17:00 +0800 CST
view 273
2026年vLLM 0.18深度解析:PagedAttention显存管理、EAGLE3推测解码、连续批处理、分离式Prefill、FP4量化,附生产级部署代码与Benchmark对比
vLLM
LLM推理
PagedAttention
推测解码
EAGLE3
FP4量化
CUDA
GPU性能优化
PostgreSQL 19 Parallel Autovacuum:从单线程清理到并行革命的深度技术剖析
编程
PostgreSQL 19 Parallel Autovacuum:从单线程清理到并行革命的深度技术剖析
2026-05-16 13:50:16 +0800 CST
view 508
深入剖析PostgreSQL 19的Parallel Autovacuum新特性,从MVCC原理到并行架构设计,从参数调优到生产实战,全面掌握大表清理性能提升3-5倍的秘诀。
PostgreSQL 19
Parallel Autovacuum
数据库优化
MVCC
性能调优
Rust 1.95.0 深度解析:cfg_select! 宏与编译器优化的实战指南
编程
Rust 1.95.0 深度解析:cfg_select! 宏与编译器优化的实战指南
2026-04-29 10:11:38 +0800 CST
view 669
2026年4月Rust 1.95.0正式发布,cfg_select!宏正式稳定、match表达式支持if let guards、编译器优化全面升级。本文从实战角度深入解析新特性,助你全面掌握Rust最新版本。
Rust
Rust1.95
cfg_select
编译器优化
编程语言
PostgreSQL Active-Active 逻辑复制深度解析:Google Cloud 如何推动开源数据库进入企业级高可用新时代
编程
PostgreSQL Active-Active 逻辑复制深度解析:Google Cloud 如何推动开源数据库进入企业级高可用新时代
2026-04-19 12:43:27 +0800 CST
view 683
Google Cloud 向 PostgreSQL 上游贡献 Active-Active 逻辑复制架构,实现多节点同时写入、自动冲突检测。本文深度解析架构原理、实战部署与性能优化,带你掌握企业级分布式数据库核心技术。
PostgreSQL
逻辑复制
Active-Active
Google Cloud
高可用
数据库架构
云原生
Google I/O 2026 深度解析:Gemini 3.5 Flash 如何以 4 倍速度颠覆 AI 编程——从基准测试到生产级 Agent 开发完全指南
编程
Google I/O 2026 深度解析:Gemini 3.5 Flash 如何以 4 倍速度颠覆 AI 编程——从基准测试到生产级 Agent 开发完全指南
2026-05-23 01:16:34 +0800 CST
view 686
2026年Google I/O大会深度解析:Gemini 3.5 Flash以289 tokens/s的输出速度4倍碾压竞品,从基准测试、技术架构到生产级Agent开发实战,全面解读谷歌Agentic AI战略。
Google I/O 2026
Gemini 3.5 Flash
AI编程
Agent开发
基准测试
NVIDIA PersonaPlex 全双工语音 AI 深度解析:从 Moshi 架构到实时对话的工程实践
编程
NVIDIA PersonaPlex 全双工语音 AI 深度解析:从 Moshi 架构到实时对话的工程实践
2026-04-19 14:16:23 +0800 CST
view 907
深度解析 NVIDIA PersonaPlex:基于 Moshi 架构的 7B 参数全双工语音 AI 模型,170ms 打断延迟,MIT 商用许可,从架构原理到代码实战的完整技术指南。
NVIDIA
PersonaPlex
全双工语音
Moshi
Kyutai
AI语音
实时对话
语音AI
DiffusionGemma 深度实战:当 Google 用「扩散」颠覆自回归——从离散文本扩散原理到 MoE 架构、本地推理加速与生产级部署的完全指南(2026)
编程
DiffusionGemma 深度实战:当 Google 用「扩散」颠覆自回归——从离散文本扩散原理到 MoE 架构、本地推理加速与生产级部署的完全指南(2026)
2026-06-16 18:52:52 +0800 CST
view 509
Google DeepMind联合NVIDIA发布DiffusionGemma——基于离散文本扩散的实验性开源模型。本文深入解读26B MoE架构、双向注意力机制、本地推理4倍加速原理,附完整代码示例和部署实战。
Google
DiffusionGemma
扩散模型
MoE
开源LLM
本地推理
AI推理加速
Gemma 4 架构解密:MoE 路由 × GQA 注意力 × Thinking Mode——31B 如何击败 20 倍参数对手
编程
Gemma 4 架构解密:MoE 路由 × GQA 注意力 × Thinking Mode——31B 如何击败 20 倍参数对手
2026-04-19 17:47:49 +0800 CST
view 792
深入解析 Google Gemma 4 的核心技术架构:MoE 稀疏专家路由、GQA 分组查询注意力、PLE 逐层嵌入、Thinking Mode 推理机制,详解 31B 模型如何以小博大击败 20 倍参数对手,附全场景部署实战代码。
Gemma
Google
AI
开源大模型
MoE
GQA
Transformer
深度学习
模型架构
TimesFM 2.5 深度解析:Google 如何用 200M 参数的时间序列基础模型颠覆传统预测范式
编程
TimesFM 2.5 深度解析:Google 如何用 200M 参数的时间序列基础模型颠覆传统预测范式
2026-04-19 19:46:34 +0800 CST
view 898
Google TimesFM 2.5 时间序列基础模型深度解析:Patched Decoder 架构、XReg 协变量机制、LoRA 微调实战、BigQuery ML 部署,从零样本预测到生产落地全链路指南
TimesFM
时间序列
机器学习
Google
深度学习
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
33
34
35
36
37
...
91
下一页