程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
TimesFM 2.5 深度解析:当时间序列预测终于学会零样本
编程
TimesFM 2.5 深度解析:当时间序列预测终于学会零样本
2026-04-08 16:35:10 +0800 CST
view 1124
Google TimesFM 2.5 时间序列预测基础模型深度解析:200M参数零样本预测,16k上下文,Decoder-only Transformer架构,Patch分词,Monash基准测试击败监督模型
时间序列
机器学习
Google
Transformer
agent-skills:Google工程师开源20个Skill,强制AI写代码守规矩
编程
agent-skills:Google工程师开源20个Skill,强制AI写代码守规矩
2026-05-15 18:35:28 +0800 CST
view 626
Google Gemini团队工程师Addy Osmani开源agent-skills,20个Skill文件覆盖完整研发生命周期,7个斜杠命令强制工程规范,解决AI写代码四大痛点。
开源项目
AI Agent
编码规范
Google工程实践
A2A Protocol 深度解析:让所有 AI Agent 说同一种语言——从 Agent Card 到任务生命周期、从跨框架协作到生产级部署的完整技术指南(2026)
编程
A2A Protocol 深度解析:让所有 AI Agent 说同一种语言——从 Agent Card 到任务生命周期、从跨框架协作到生产级部署的完整技术指南(2026)
2026-07-04 15:16:17 +0800 CST
view 511
2026年AI Agent协议深度解析:Google主导的A2A协议如何让不同框架的Agent说同一种语言。涵盖Agent Card、任务状态机、SSE流式处理、A2A vs MCP对比、Python/TypeScript代码实战、企业级部署案例。
A2A Protocol
Agent-to-Agent
AI Agent
多智能体协作
Google A2A
Linux Foundation
Google Antigravity 2.0 深度实战:从 Agent-First 工作平台到本地 SDK 开发——AI 编程工具格局的重构与开发者实践指南
编程
Google Antigravity 2.0 深度实战:从 Agent-First 工作平台到本地 SDK 开发——AI 编程工具格局的重构与开发者实践指南
2026-05-22 07:20:00 +0800 CST
view 1193
Google I/O 2026 发布的 Antigravity 2.0 深度解析:从架构设计、Project 模型、SDK 实战、多 Agent 协作到性能优化,全面拆解 AI 编程工具的 Agent 操作系统化演进。
Antigravity
Google
AI Agent
SDK
Python
Google Genkit:Firebase 出品的全栈 AI 应用开发框架
编程
Google Genkit:Firebase 出品的全栈 AI 应用开发框架
2026-04-18 09:17:44 +0800 CST
view 751
Google Firebase 团队开源的 Genkit 框架,一个框架支持 JavaScript/TypeScript、Go、Python 三种语言,统一接口接入多模型,提供 Flows、Dotprompt、RAG、Tool Calling 等核心能力,v0.5.0 已进入生产就绪状态。
AI
Google
Genkit
Firebase
TypeScript
开源框架
Google ADK 2.0 深度解析:从单 Agent 到多智能体协作,Google 交出了怎样的工程化答卷?
编程
Google ADK 2.0 深度解析:从单 Agent 到多智能体协作,Google 交出了怎样的工程化答卷?
2026-07-10 14:46:35 +0800 CST
view 265
2026年4月Google发布ADK 2.0,从架构设计、核心原理、代码实战、工程落地四维度深度解析多智能体协作框架,对比LangGraph、CrewAI、AutoGen
Google ADK
多智能体
AI Agent
A2A协议
MCP协议
Graph工作流
LangGraph
CrewAI
Vertex AI
Cloud Run
Google Gemma 4 深度解析:当开源AI进入「逐层嵌入平行化」时代
编程
Google Gemma 4 深度解析:当开源AI进入「逐层嵌入平行化」时代
2026-04-09 04:54:56 +0800 CST
view 1025
Google于2026年4月发布Gemma 4开源模型系列,首次全面切换Apache 2.0许可证,搭载Per-Layer Embedding架构创新,26B MoE以3.8B激活参数击败Qwen3-235B。本文深度解析PLE架构、稀疏激活机制与全规格产品矩阵。
Gemma 4
Google
开源模型
Apache 2.0
MoE
Per-Layer Embedding
Brunost:一个强制使用挪威语Nynorsk编写代码的编程语言——深度解析与实战
编程
Brunost:一个强制使用挪威语Nynorsk编写代码的编程语言——深度解析与实战
2026-04-18 13:16:43 +0800 CST
view 643
深入解析Brunost:一款用Zig编写、强制使用挪威语Nynorsk书写代码的函数式编程语言。涵盖语法、架构设计、实战代码、性能分析。
Brunost
Nynorsk
编程语言
Zig
WebAssembly
函数式编程
Gleam
自然语言编程
Google ADK 2.0 工程化实践:如何用 Graph 工作流构建生产级多 Agent 系统?
编程
Google ADK 2.0 工程化实践:如何用 Graph 工作流构建生产级多 Agent 系统?
2026-07-10 14:47:43 +0800 CST
view 211
2026年4月Google发布ADK 2.0,从架构设计、核心原理、代码实战、工程落地四维度深度解析多智能体协作框架
Google ADK
多智能体
AI Agent
A2A协议
MCP协议
Graph工作流
LangGraph
CrewAI
Vertex AI
Cloud Run
多 Agent 协作框架横评:Google ADK 2.0 的工程化答案,与 LangGraph、CrewAI、AutoGen 正面交锋
编程
多 Agent 协作框架横评:Google ADK 2.0 的工程化答案,与 LangGraph、CrewAI、AutoGen 正面交锋
2026-07-10 14:49:00 +0800 CST
view 284
2026年4月Google发布ADK 2.0,对比LangGraph、CrewAI、AutoGen等主流框架,从架构设计、核心原理、代码实战角度深度解析
Google ADK
多智能体
AI Agent
A2A协议
MCP协议
Graph工作流
LangGraph
CrewAI
Vertex AI
Cloud Run
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
编程
2026年大模型推理框架横评:vLLM 0.5 vs TGI 2.0 vs TensorRT-LLM 1.8 vs DeepSpeed-MII 0.9
2026-07-10 17:44:16 +0800 CST
view 364
深度对比2026年四大主流LLM推理框架:vLLM 0.5、TGI 2.0、TensorRT-LLM 1.8、DeepSpeed-MII 0.9,涵盖PagedAttention、FP8量化、ZeRO-3、连续批处理等核心技术原理,配生产级代码示例与实测性能数据。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
量化
AI部署
LMCache 实战:大模型推理的 KV Cache 终极优化方案
编程
LMCache 实战:大模型推理的 KV Cache 终极优化方案
2026-07-23 08:44:51 +0800 CST
view 178
LMCache 实战指南:通过智能 KV Cache 管理,实现 LLM 推理吞吐量最高 10 倍提升,显存占用降低 40%-60%。包含 vLLM/TGI 集成、分布式缓存、性能调优最佳实践。
LMCache
KV Cache
LLM推理优化
vLLM
RAG性能优化
LLM推理引擎终极对决:vLLM vs TensorRT-LLM深度解析与2026生产环境选型指南
编程
LLM推理引擎终极对决:vLLM vs TensorRT-LLM深度解析与2026生产环境选型指南
2026-04-20 13:45:31 +0800 CST
view 901
深度对比vLLM与TensorRT-LLM两大LLM推理框架,从PagedAttention到Kernel Fusion,从量化技术到生产部署,助你做出正确的技术选型决策
LLM
vLLM
TensorRT-LLM
推理优化
大模型部署
量化技术
AI工程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
编程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
2026-08-06 06:16:32 +0800 CST
view 89
深度拆解2026年四大主流LLM推理框架:vLLM 0.5 PagedAttention进化、TGI 2.0流式输出优化、TensorRT-LLM 1.8算子融合、DeepSpeed-MII 0.9自动优化,含完整架构分析、代码实战、性能基准测试与成本计算
LLM
vLLM
TensorRT-LLM
推理框架
PagedAttention
量化
GPU
H100
大模型
DeepSpeed
TGI
2026大模型推理框架年度横评:vLLM/TGI/TensorRT-LLM/DeepSpeed-MII 架构深度解析与生产级选型指南
编程
2026大模型推理框架年度横评:vLLM/TGI/TensorRT-LLM/DeepSpeed-MII 架构深度解析与生产级选型指南
2026-06-18 17:54:54 +0800 CST
view 794
深度横评2026年四大主流大模型推理框架,涵盖PagedAttention架构、ContinuousBatching、算子融合、FP8量化、NVMe卸载等核心技术,配实测数据与生产级选型指南
大模型
LLM
推理框架
vLLM
TensorRT-LLM
TGI
DeepSpeed
GPU推理
AI部署
NVIDIA
万字深度解析 LMCache:当 KV Cache 遇见分布式存储革命——从常数级显存到千亿Token并发的完整技术指南(2026)
编程
万字深度解析 LMCache:当 KV Cache 遇见分布式存储革命——从常数级显存到千亿Token并发的完整技术指南(2026)
2026-07-02 13:46:08 +0800 CST
view 397
深度解析 LMCache 开源 KV Cache 管理层项目:从三层存储架构、多后端支持、Disaggregated Prefill、CacheBlend、Segmented Prefill、P2P 共享到 Kubernetes 生产级部署的完整技术指南,含性能基准测试与代码实战
LMCache
KV Cache
LLM
vLLM
分布式
RDMA
Kubernetes
推理优化
Redis
NIXL
万字深度解析 LMCache:当 LLM 推理遇见 KV Cache 革命——从 TTFT 优化到跨引擎 KV 复用、从 GPU/CPU/Disk 三级存储到分布式 P2P 共享的完整技术指南(2026)
编程
万字深度解析 LMCache:当 LLM 推理遇见 KV Cache 革命——从 TTFT 优化到跨引擎 KV 复用、从 GPU/CPU/Disk 三级存储到分布式 P2P 共享的完整技术指南(2026)
2026-07-03 03:14:31 +0800 CST
view 310
深度解析LMCache KV Cache管理层:从TTFT优化原理、GPU/CPU/Disk三级存储架构、跨引擎KV复用、分布式P2P共享,到与vLLM深度集成的生产级部署实战,含完整代码和性能调优指南。
LMCache
LLM推理
KV Cache
vLLM
TTFT优化
GPU优化
AI推理加速
分布式缓存
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
编程
LLM 推理框架选型实战:vLLM、TensorRT-LLM、TGI、DeepSpeed-MII 深度对比与生产部署指南
2026-07-03 13:49:04 +0800 CST
view 406
深度对比 vLLM 0.5、TensorRT-LLM 1.8、TGI 2.0、DeepSpeed-MII 0.9 四大推理框架,从核心技术原理、性能数据、成本账本到生产部署实战,帮你做出正确的框架选型决策。
LLM
vLLM
TensorRT-LLM
TGI
DeepSpeed
推理优化
大模型部署
GPU优化
vLLM V1 深度拆解:当一个 LLM 推理引擎决定「从零重写」——PagedAttention、分离式推理与 LMCache 如何重新定义大模型服务的性能天花板
编程
vLLM V1 深度拆解:当一个 LLM 推理引擎决定「从零重写」——PagedAttention、分离式推理与 LMCache 如何重新定义大模型服务的性能天花板
2026-08-03 09:43:58 +0800 CST
view 123
深度拆解vLLM V1引擎四大核心架构:PagedAttention V2融合块表与前缀树缓存、分离式推理Prefill/Decode架构、KV Connector标准化接口、LMCache三层KV Cache管理,附完整部署配置与性能基准测试
vLLM
PagedAttention
LMCache
分离式推理
大模型推理
KV Cache
推理引擎
LLM Serving
GPU优化
开源
Rust 2026 生态全景:从系统语言到 AI Agent 运行时,一次性把 Rust 的来龙去脉讲透
编程
Rust 2026 生态全景:从系统语言到 AI Agent 运行时,一次性把 Rust 的来龙去脉讲透
2026-07-29 15:45:42 +0800 CST
view 150
深度拆解 2026 年 Rust 生态全景:AI Agent 记忆层(AndaDB/KIP/SurrealDB)、Tauri 2.x 跨平台应用开发、WASI Preview 2 组件实战、Bubble Tea/Zed 工具链与生产部署完整指南
Rust
AI Agent
Tauri
Wasm
SurrealDB
AndalDB
KIP
工具链
2026
Engram 深度实战:当 AI 编程助手终于学会「记住」——从 SQLite FTS5 内核、MCP 协议到 Git 同步与 Cloud 复制的生产级完全指南
编程
Engram 深度实战:当 AI 编程助手终于学会「记住」——从 SQLite FTS5 内核、MCP 协议到 Git 同步与 Cloud 复制的生产级完全指南
2026-07-12 08:44:12 +0800 CST
view 293
深度解析 Engram:AI Coding Agent 的持久化记忆系统,从 SQLite FTS5 全文检索内核、MCP 协议、20 个工具、Git 同步到 Cloud 复制,配生产级实战案例与性能优化指南。
Engram
AI编程
MCP
SQLite
FTS5
记忆系统
Claude Code
Cursor
Windsurf
Vibe Coding 深度解析:当自然语言成为编程语言——从 Karpathy 的一条推文到 MIT 十大突破技术,128 亿美元市场的开发者生存指南
编程
Vibe Coding 深度解析:当自然语言成为编程语言——从 Karpathy 的一条推文到 MIT 十大突破技术,128 亿美元市场的开发者生存指南
2026-07-06 22:13:06 +0800 CST
view 233
深度解析Vibe Coding编程范式革命:从Andrej Karpathy的一条推文到MIT十大突破技术,128亿美元市场全景。涵盖六大AI编程工具横评(Cursor/Claude Code/Windsurf/Codex/TRAE/v0)、五步工作流、Agentic Engineering高级实践、五大陷阱避坑指南、完整SaaS实战代码示例与开发者生存策略。
Vibe Coding
AI编程
自然语言编程
Cursor
Claude Code
Windsurf
TRAE
编程范式
SurrealDB 深度解析:Rust 打造的六合一多模型数据库如何用 Record Links + 向量检索 + ACID 事务让 AI Agent 的「记忆」不再碎片化——从 SurrealQL 语法到生产级知识图谱实战的完整指南
编程
SurrealDB 深度解析:Rust 打造的六合一多模型数据库如何用 Record Links + 向量检索 + ACID 事务让 AI Agent 的「记忆」不再碎片化——从 SurrealQL 语法到生产级知识图谱实战的完整指南
2026-07-07 03:41:54 +0800 CST
view 257
深度解析Rust编写的SurrealDB多模型数据库:六种数据模型(文档+图+关系+向量+时序+KV)统一到单一引擎,Record Links记录链接自动解引用、HNSW向量索引、ACID事务、实时订阅。从SurrealQL语法到AI Agent知识图谱生产实战,含Python/Go SDK完整代码示例与企业案例。
SurrealDB
多模型数据库
Rust
Record Links
向量检索
ACID
AI Agent
SurrealQL
知识图谱
开源
PakePlus:Rust+Tauri把网页打包成桌面App,比Electron小20倍,支持Win/Mac/Linux/Android/iOS
编程
PakePlus:Rust+Tauri把网页打包成桌面App,比Electron小20倍,支持Win/Mac/Linux/Android/iOS
2026-07-25 13:46:57 +0800 CST
view 143
PakePlus(网页桌面化工具):Rust+Tauri 2底层、输入网址3步生成Windows/macOS/Linux/Android/iOS应用、体积比Electron小20倍(<5MB)、无需配置Node/Rust/SDK环境、支持JS注入(自动登录/去广告/填表)、支持系统API调用(下载/窗口/命令)、内置调试模式和云端/本地两种打包方式,前端开发者必备。
PakePlus
Tauri
桌面应用
网页打包
Electron替代
桌面化
Rust
前端工具
Tauri2
多端打包
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
12
13
14
15
16
...
37
下一页