程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
KTransformers 深度拆解:单张 4090 跑满血 DeepSeek-R1 671B,清华团队如何用 CPU/GPU 异构推理实现 28 倍加速
编程
KTransformers 深度拆解:单张 4090 跑满血 DeepSeek-R1 671B,清华团队如何用 CPU/GPU 异构推理实现 28 倍加速
2026-07-29 09:44:03
view 287
深度拆解清华开源的 KTransformers:MoE 稀疏性卸载、AMX/Marlin 高性能算子、CUDA Graph 与 YAML 注入框架四层架构,单张 4090 跑满血 DeepSeek-R1 671B,附完整部署实战与性能调优清单。
KTransformers
异构推理
MoE
DeepSeek
AMX
CUDA Graph
大模型部署
性能优化
开源
W3C震撼官宣:WebAssembly正式成为Web一等编程语言——从 "JavaScript小弟" 到 "原生级性能霸主" 的完整技术解析
编程
W3C震撼官宣:WebAssembly正式成为Web一等编程语言——从 "JavaScript小弟" 到 "原生级性能霸主" 的完整技术解析
2026-05-16 21:49:12
view 762
2026年3月W3C正式将WebAssembly定为Web一等编程语言。本文深度解析WASM如何打破JavaScript垄断,直接DOM操作、多语言支持(Rust/C++/Go/Python)、并行计算与GPU加速,以及Blazor从4.2秒优化到300ms的实战案例。
WebAssembly
WASM
Rust
性能优化
浏览器
WASI
边缘计算
并行计算
GPU加速
Goose 深度解析:Block 开源的 Rust 驱动 AI 工程自动化代理,如何在本地跑赢 Claude Code?
编程
Goose 深度解析:Block 开源的 Rust 驱动 AI 工程自动化代理,如何在本地跑赢 Claude Code?
2026-04-20 08:16:16
view 775
35K+ Stars,Rust 内核,MCP 原生,BoxLite 沙箱隔离——Block 开源的 Goose 不是又一个 AI 代码补全工具,而是一个能自主完成整个工程任务的本地 AI 代理。本文从架构设计到代码实战,全面解析 Goose 的核心能力。
Goose
AI Agent
Rust
MCP
Block
WasmGC 深度实战:从 GC Types 到跨语言浏览器高性能运行——下一代 Web 性能革命的架构完全指南
编程
WasmGC 深度实战:从 GC Types 到跨语言浏览器高性能运行——下一代 Web 性能革命的架构完全指南
2026-05-23 11:44:37
view 587
深入解析 WasmGC 提案:从底层原理、WAT 字节码结构到 Kotlin/Dart 生产级编译实战,探讨 Docker WASM 云端部署与 WebGPU 协同优化的完整指南
WebAssembly
WasmGC
浏览器性能
Kotlin
WASM
Goose 全链路解析:Block 如何用 Rust 构建本地 AI 工程代理,打破 Claude Code 的厂商绑定
编程
Goose 全链路解析:Block 如何用 Rust 构建本地 AI 工程代理,打破 Claude Code 的厂商绑定
2026-04-20 08:17:11
view 1140
35K+ Stars,Rust 内核,MCP 原生,BoxLite 沙箱隔离——Block 开源的 Goose 不是又一个 AI 代码补全工具,而是一个能自主完成整个工程任务的本地 AI 代理。本文从架构设计到代码实战,全面解析 Goose 的核心能力。
Goose
AI Agent
Rust
MCP
Block
Codex 深度拆解:当 OpenAI 决定「把 Codex 塞进 Claude Code 的身体」——30.4K Star 的跨厂商 Agent 协作插件如何用 App Server 协议和双 Harness 架构重新定义 AI 编程的终极形态
编程
Codex 深度拆解:当 OpenAI 决定「把 Codex 塞进 Claude Code 的身体」——30.4K Star 的跨厂商 Agent 协作插件如何用 App Server 协议和双 Harness 架构重新定义 AI 编程的终极形态
2026-08-05 02:14:30
view 233
深度拆解OpenAI官方发布的Claude Code插件codex-plugin-cc:30.4K Star的跨厂商Agent协作方案,双Harness架构、App Server协议、Thread/Turn/Item三层会话模型、三档沙箱安全机制,附完整实战代码与最佳实践
Codex
Claude Code
OpenAI
AI编程
Agent
插件
App Server
代码审查
跨厂商协作
DuckLake 1.0 深度解析:SQL-Only Lakehouse 如何用数据库元存储终结数据湖的小文件噩梦
编程
DuckLake 1.0 深度解析:SQL-Only Lakehouse 如何用数据库元存储终结数据湖的小文件噩梦
2026-04-20 08:47:08
view 912
DuckLake 1.0 发布:用数据库管理元数据的 Lakehouse 格式,Data Inlining 终结小文件问题,支持 Multiplayer DuckDB 多玩家协作模式
DuckDB
DuckLake
数据湖
Lakehouse
Iceberg
Delta Lake
OLAP
WebGPU + WebAssembly:2026年浏览器端到端高性能计算的完整实战指南
编程
WebGPU + WebAssembly:2026年浏览器端到端高性能计算的完整实战指南
2026-05-16 23:21:19
view 823
深度解析WebGPU与WebAssembly协同计算,从底层原理到工程实战,涵盖渲染管线、并行计算、SIMD加速、零拷贝数据传输等核心技能
WebGPU
WebAssembly
前端
图形
性能优化
Rust
JavaScript
DeepSeek V4 Flash 深度解析:开源大模型的 Agent 时代新范式
编程
DeepSeek V4 Flash 深度解析:开源大模型的 Agent 时代新范式
2026-06-30 09:16:27
view 1165
深度解析 DeepSeek V4 Flash 的 Ultra-MoE、CSA+HCA 混合注意力、mHC 流形约束、Engram 条件记忆四大架构创新,以及 DSpark 投机解码带来的 60-85% 推理加速。涵盖 SWE-bench 79% 性能分析、API 调用实战与部署方案。
DeepSeek
V4 Flash
MoE
开源大模型
AI Agent
Codex 深度拆解:OpenAI 官方插件如何让 Claude Code 和 Codex 双剑合璧——30.4K Star 的跨厂商 Agent 协作架构全解析
编程
Codex 深度拆解:OpenAI 官方插件如何让 Claude Code 和 Codex 双剑合璧——30.4K Star 的跨厂商 Agent 协作架构全解析
2026-08-05 02:20:14
view 252
深度拆解OpenAI官方发布的Claude Code插件codex-plugin-cc:30.4K Star的跨厂商Agent协作方案,双Harness架构、App Server协议、Thread/Turn/Item三层会话模型、三档沙箱安全机制,附完整实战代码与最佳实践
Codex
Claude Code
OpenAI
AI编程
Agent
插件
App Server
代码审查
跨厂商协作
Lightpanda 深度实战:当 AI Agent 有了自己的浏览器——从 Zig 零构建引擎到 CDP/MCP 双协议生产级部署完全指南
编程
Lightpanda 深度实战:当 AI Agent 有了自己的浏览器——从 Zig 零构建引擎到 CDP/MCP 双协议生产级部署完全指南
2026-06-11 10:49:09
view 648
Lightpanda是用Zig从零构建的无头浏览器,专为AI和自动化设计。100并行页面比Chrome快9倍、内存省16倍,支持CDP和MCP双协议
Lightpanda
Zig
Headless Browser
AI Agent
MCP
CDP
Puppeteer
Web Automation
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
编程
KTransformers 深度拆解:一块 RTX 5090 跑 100B+ 大模型,CPU/GPU 异构推理凭什么改写 LLM 本地部署规则
2026-07-24 07:44:31
view 283
KTransformers 通过 CPU/GPU 异构计算,让一块 RTX 5090(32GB 显存)能跑起 100B+ MoE 大模型,且无需量化压缩,保持原精度 FP16。实测比 llama.cpp Q8_0 快 4.5 倍。本文深度拆解其专家细粒度卸载、异步预取、DMA 优化等核心技术,以及实战部署指南。
KTransformers
LLM推理
MoE
异构计算
DeepSeek
SGLang
CPU Offload
本地部署
GPU优化
DeepSeek V4 Flash 深度拆解:当一个「轻量级」模型单日吞掉8万亿Token——静态知识分离、MoE稀疏路由与百万上下文如何重新定义AI推理的经济底线
编程
DeepSeek V4 Flash 深度拆解:当一个「轻量级」模型单日吞掉8万亿Token——静态知识分离、MoE稀疏路由与百万上下文如何重新定义AI推理的经济底线
2026-08-05 04:13:52
view 276
深度拆解DeepSeek V4 Flash:284B总参数13B激活参数的MoE架构如何通过静态知识分离和两级路由器实现单日8万亿Token调用量,百万token上下文+极致定价重新定义AI推理经济底线
DeepSeek
V4 Flash
MoE
静态知识分离
稀疏路由
百万Token上下文
AI推理
开源大模型
成本优化
Kubernetes v1.36「春」深度实战:从 User Namespaces 到 Mutating Admission Policies——生产级安全加固与 AI 工作负载完全指南
编程
Kubernetes v1.36「春」深度实战:从 User Namespaces 到 Mutating Admission Policies——生产级安全加固与 AI 工作负载完全指南
2026-05-23 16:16:09
view 744
Kubernetes v1.36(代号 Haru/春)深度解析:User Namespaces GA 带来的安全革新、Mutating Admission Policies 对 Webhook 的取代、AI/ML 工作负载增强,以及大规模集群调优完全指南。
Kubernetes
云原生
安全加固
AI工作负载
User Namespaces
Meta Muse Glimmer 深度拆解:300亿参数端侧Agent模型的工程革命——从知识蒸馏到4bit量化的完整实战指南(2026)
编程
Meta Muse Glimmer 深度拆解:300亿参数端侧Agent模型的工程革命——从知识蒸馏到4bit量化的完整实战指南(2026)
2026-08-13 18:49:00
view 133
深度拆解Meta 2026年8月发布的Muse Glimmer:300亿参数开放权重Dense模型,4bit量化可在单张RTX 3090/4090上本地运行。涵盖架构设计、知识蒸馏、量化原理、本地部署实战与性能基准测试。
Muse Glimmer
端侧AI
知识蒸馏
4bit量化
Agent本地部署
300亿参数
Meta
Apache 2.0
llama.cpp
Ollama
vLLM 0.5 深度拆解:当 PagedAttention 重塑 LLM 推理内存——从 OS 分页思想到 MoE 分布式推理的工程全貌(2026)
编程
vLLM 0.5 深度拆解:当 PagedAttention 重塑 LLM 推理内存——从 OS 分页思想到 MoE 分布式推理的工程全貌(2026)
2026-07-18 13:17:37
view 251
深度拆解 vLLM 0.5 的 PagedAttention 核心原理、连续批处理架构、MoE 推理优化、分布式部署策略,以及 2026 年四大推理框架生产级性能横评。
vLLM
PagedAttention
LLM推理
ContinuousBatching
MoE
FusedMoE
量化
分布式推理
Muse Glimmer 端侧Agent革命:300亿参数模型如何在消费级GPU上跑出生产级性能(2026实战)
编程
Muse Glimmer 端侧Agent革命:300亿参数模型如何在消费级GPU上跑出生产级性能(2026实战)
2026-08-13 18:50:11
view 173
深度拆解Meta 2026年8月发布的Muse Glimmer:300亿参数开放权重Dense模型,4bit量化可在单张RTX 3090/4090上本地运行。涵盖架构设计、知识蒸馏、量化原理、本地部署实战与性能基准测试。
Muse Glimmer
端侧AI
知识蒸馏
4bit量化
Agent本地部署
300亿参数
Meta
Apache 2.0
llama.cpp
Ollama
Hermes WebUI 深度实战:随时随地用手机/浏览器驱动 Hermes Agent——从 SSE 流式传输到多模型路由的完全指南(2026)
编程
Hermes WebUI 深度实战:随时随地用手机/浏览器驱动 Hermes Agent——从 SSE 流式传输到多模型路由的完全指南(2026)
2026-06-02 21:45:53
view 858
Hermes WebUI 今日飙升 1725 星。本文深度拆解其架构设计、SSE流式传输机制、多模型路由策略、工具调用可视化实现,以及从本地部署到生产级优化的完整指南。
Hermes
WebUI
SSE
LLM
Agent
Goose:Block 开源、Linux 基金会托管——本地 AI 编程代理的终极答案
编程
Goose:Block 开源、Linux 基金会托管——本地 AI 编程代理的终极答案
2026-05-11 09:23:06
view 769
Goose 是由 Block 开源、现已捐献给 Linux 基金会 AAIF 的本地 AI 编程代理。最新版本 v1.32.0(2026年5月6日)支持 Exa AI 搜索、桌面通知、@agent 协作、/skills 命令、自动压缩上下文、语音听写等功能。Rust 开发,支持 MCP 协议,可连接任何 LLM(OpenAI、Ollama、Kimi Code 等),完全本地运行无需订阅。
Goose
AI编程
本地LLM
MCP
Rust
Linux基金会
Block
WebAssembly 2.0 深度实战:当浏览器性能突破原生壁垒——从 GC/线程/WASI 到生产级高性能计算完全指南(2026)
编程
WebAssembly 2.0 深度实战:当浏览器性能突破原生壁垒——从 GC/线程/WASI 到生产级高性能计算完全指南(2026)
2026-06-11 13:52:44
view 621
深入解析 WebAssembly 2.0 核心新特性:GC 类型系统、多线程并行、Component Model 跨语言互操作、WASI 0.2 全平台支持、CSP 3.0 安全集成,配合 Rust 实战代码和性能实测数据。
WebAssembly
WASM
WASM 2.0
WASI
高性能计算
前端性能
浏览器性能
Rust
browser-harness:狂揽 11.9K Stars!让 AI Agent 真正丝滑操控浏览器
案例
browser-harness:狂揽 11.9K Stars!让 AI Agent 真正丝滑操控浏览器
2026-05-11 10:18:42
view 790
11.9K Stars 的开源项目 browser-harness,通过 CDP 框架直接连接 AI Agent 与真实 Chrome 浏览器,完全模拟人的行为,让 Agent 可以丝滑地浏览网页、搜索资料、填写表单、发布内容,不会触发任何反爬虫检测。
browser-harness
AI Agent
CDP
浏览器自动化
Claude Code
WebSocket
反爬虫
1.6万亿参数,1M上下文,仅需27%算力:DeepSeek-V4-Pro 如何重新定义长文本推理
编程
1.6万亿参数,1M上下文,仅需27%算力:DeepSeek-V4-Pro 如何重新定义长文本推理
2026-05-11 10:53:54
view 782
DeepSeek-V4-Pro 以 1.6T 总参数、49B 激活参数的 MoE 架构,原生支持 100 万 token 上下文,同时将推理算力降至 V3.2 的 27%、KV Cache 降至 10%。本文深度解析 CSA/HCA 混合注意力机制、mHC 流形约束超连接、KV Cache 极致优化、Muon 优化器等核心技术创新,以及如何在 Ollama、vLLM、官方 API 三种方式下部署运行。
DeepSeek-V4,MoE架构,CSA注意力,HCA注意力,KV Cache,1M上下文,长文本推理,开源大模型
DeepSeek-TUI 深度解析:Rust 打造的终端 AI 编程 Agent——从 1M 上下文到 RLM 多智能体并发的完整技术架构
编程
DeepSeek-TUI 深度解析:Rust 打造的终端 AI 编程 Agent——从 1M 上下文到 RLM 多智能体并发的完整技术架构
2026-05-17 07:14:51
view 880
深度拆解 DeepSeek-TUI:99.3% Rust 编写的终端 AI 编程 Agent,1M 上下文、RLM 多智能体并发、前缀缓存优化、OS 级沙箱的完整技术架构与实战指南
DeepSeek
AI编程
Rust
终端Agent
开源项目
DeepSeek Harness 深度拆解:从「一切皆插件」架构到 Agent 生产级落地的完整实战指南(2026)
编程
DeepSeek Harness 深度拆解:从「一切皆插件」架构到 Agent 生产级落地的完整实战指南(2026)
2026-08-14 01:19:14
view 582
深度拆解 DeepSeek Harness:从「一切皆插件」架构设计、插件分类、Agent Loop 实现、与 OpenClaw/Claude Code 对比到本地部署实战,完整覆盖 2026 年最值得关注的开源 Agent 框架。
DeepSeek
Agent Harness
插件架构
AI Agent
开源框架
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
...
102
103
104
105
106
...
113
下一页