程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
oMLX 深度实战:当 Apple Silicon 遇见本地大模型推理——从 MTP 加速到分层 KV 缓存的生产级完全指南(2026)
编程
oMLX 深度实战:当 Apple Silicon 遇见本地大模型推理——从 MTP 加速到分层 KV 缓存的生产级完全指南(2026)
2026-06-16 16:46:05 +0800 CST
view 936
深度解析 2026 年 Apple Silicon 本地大模型推理技术栈:从 llama.cpp 量化体系到 oMLX 分层 KV 缓存架构,从 MTP 加速到 CoreAI 全栈指南,包含实测 Benchmark 与生产级部署方案。
Apple Silicon
MLX
llama.cpp
oMLX
MTP
本地大模型
量化
本地推理
Zed 深度拆解:当 Rust 决定「干掉全部 Electron 代码编辑器」——一个 88K Star 的 GPU 原生编辑器如何用 GPUI 和 Agent Client Protocol 重新定义「代码编辑器」的终极形态
编程
Zed 深度拆解:当 Rust 决定「干掉全部 Electron 代码编辑器」——一个 88K Star 的 GPU 原生编辑器如何用 GPUI 和 Agent Client Protocol 重新定义「代码编辑器」的终极形态
2026-08-04 17:44:55 +0800 CST
view 172
深度拆解Zed 88K Star GPU原生代码编辑器:GPUI自研渲染引擎、多Agent并行编排、ACP开放协议、DeltaDB下一代版本控制、Zeta编辑预测模型,重新定义AI时代的代码编辑器架构
Zed
Rust
GPUI
Agent Client Protocol
ACP
GPU加速
代码编辑器
Parallel Agents
DeltaDB
Zeta
AI编辑器
开源
OpenWork 深度拆解:当 AI Agent 工作台从订阅制走向开源本地——Electron + OpenCode 的 18.7k Stars 革命(2026)
编程
OpenWork 深度拆解:当 AI Agent 工作台从订阅制走向开源本地——Electron + OpenCode 的 18.7k Stars 革命(2026)
2026-08-13 06:43:46 +0800 CST
view 29
深度拆解 OpenWork:Electron + React + TypeScript 架构、OpenCode 引擎工具编排、与 Claude Cowork 对比、多模型支持、本地数据主权、工具扩展插件机制、生产实战代码审查与文档生成、15条踩坑清单。
OpenWork
AI Agent
Electron
开源
桌面应用
OpenCode
工具扩展
MCP协议
Redis之父的「孤注一掷」:ds4.c如何让284B参数模型在128GB MacBook上跑起来
编程
Redis之父的「孤注一掷」:ds4.c如何让284B参数模型在128GB MacBook上跑起来
2026-07-11 16:17:33 +0800 CST
view 273
Redis之父 Salvatore Sanfilippo 2026年5月发布的新项目 ds4.c,专为 DeepSeek V4 Flash + Apple Silicon Metal 打造本地推理引擎,8000行代码实现2.5倍性能提升。本文深度解析其架构设计、Graph Executor、KV Cache页式管理与Metal Shader实现。
推理引擎
Apple Silicon
DeepSeek
Metal
Redis
ds4.c
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
编程
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
2026-04-11 10:24:48 +0800 CST
view 945
深度解析 Apple Silicon 上的视觉语言模型推理引擎 MLX-VLM,涵盖架构设计、模型支持、性能优化与实战部署。
Apple Silicon
MLX
视觉语言模型
VLM
Mac本地AI
多模态推理
OpenWork 深度拆解:当 AI Agent 工作台遇上开源革命——从 Claude Cowork 平替到 MCP 生态的完全指南(2026)
编程
OpenWork 深度拆解:当 AI Agent 工作台遇上开源革命——从 Claude Cowork 平替到 MCP 生态的完全指南(2026)
2026-08-13 13:12:21 +0800 CST
view 15
深度拆解 OpenWork 开源 AI Agent 工作台:MCP 协议集成、可视化执行时间轴、权限审批系统、技能插件架构、多模型路由,配完整部署指南与 15 条生产踩坑清单。
OpenWork
AI Agent
MCP
Claude Cowork
开源工具
Electron
工作流自动化
技能系统
Zig 深度拆解:当系统编程语言决定「干掉全部隐藏控制流」——从 comptime 到 C 互操作,一个 39K Star 的语言如何用极简哲学重新定义底层开发的终极形态
编程
Zig 深度拆解:当系统编程语言决定「干掉全部隐藏控制流」——从 comptime 到 C 互操作,一个 39K Star 的语言如何用极简哲学重新定义底层开发的终极形态
2026-08-05 02:48:25 +0800 CST
view 114
深度拆解Zig系统编程语言:comptime编译时执行、显式内存分配器、零隐藏控制流、无缝C互操作,TigerBeetle生产级案例分析,Zig vs Rust全方位对比
Zig
系统编程
comptime
内存管理
C互操作
TigerBeetle
性能优化
编程语言
开源
底层开发
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
编程
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
2026-06-22 17:24:05 +0800 CST
view 619
oMLX 是专为 Apple Silicon 优化的 LLM 推理服务器,通过连续批处理、分层 KV Cache、MLX 后端加速和 macOS 菜单栏管理,让本地 AI 推理从可用走向实用。
LLM
Apple Silicon
MLX
本地推理
MCP
React Compiler 迁移到 Rust 深度拆解:当 Meta 决定「用 Rust 重写自动记忆化编译器」——从 TypeScript 到 Rust 的 3 倍加速,一个 LLM 辅助完成 1725 个测试用例的重写项目如何重新定义前端编译器的终极形态
编程
React Compiler 迁移到 Rust 深度拆解:当 Meta 决定「用 Rust 重写自动记忆化编译器」——从 TypeScript 到 Rust 的 3 倍加速,一个 LLM 辅助完成 1725 个测试用例的重写项目如何重新定义前端编译器的终极形态
2026-08-05 09:47:53 +0800 CST
view 85
深度拆解React Compiler从TypeScript到Rust的重写:3-10倍性能提升、LLM辅助完成1725个测试用例、Arena分配器与索引数据结构、从Babel插件到Turbopack原生集成,附完整架构分析与代码实战
React Compiler
Rust
前端工具链
自动记忆化
Turbopack
SWC
编译器
React 19
性能优化
LLM
DwarfStar 4 深度拆解:当 Redis 之父决定「给 284B 大模型造一个专属引擎」——从 Metal GPU 到磁盘 KV 缓存,一个 10K Star 的极简推理栈如何用 One Model One Engine 哲学重新定义本地 AI 推理的终极形态
编程
DwarfStar 4 深度拆解:当 Redis 之父决定「给 284B 大模型造一个专属引擎」——从 Metal GPU 到磁盘 KV 缓存,一个 10K Star 的极简推理栈如何用 One Model One Engine 哲学重新定义本地 AI 推理的终极形态
2026-08-05 12:17:17 +0800 CST
view 161
深度拆解Redis创始人antirez打造的DeepSeek V4 Flash专用本地推理引擎DwarfStar 4:One Model One Engine哲学、非对称量化策略、磁盘KV缓存、双协议兼容层,附完整架构分析与性能基准
DwarfStar
DeepSeek
本地推理
MoE
Metal
Apple Silicon
antirez
Redis
AI推理
开源
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
编程
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
2026-07-24 17:17:27 +0800 CST
view 256
深度解析 omlx:专为 Mac 优化的本地 LLM 推理服务器,通过连续批处理、分层 KV Cache、SSD 缓存和菜单栏管理,实现便捷与控制兼得的推理体验。涵盖技术架构、性能调优、RAG 实战和最佳实践。
LLM
Mac
Apple Silicon
推理优化
本地部署
omlx
llmfit 深度拆解:一条命令算出你的电脑能跑哪些大模型——硬件感知适配引擎的工程解剖
编程
llmfit 深度拆解:一条命令算出你的电脑能跑哪些大模型——硬件感知适配引擎的工程解剖
2026-07-24 18:44:04 +0800 CST
view 188
深度拆解 GitHub Trending 开源工具 llmfit:四维评分系统、量化自动试探、MoE 精算、带宽速度模型、Plan 模式与 bench 众包校准,从第一性原理讲透本地大模型的硬件适配方法论。
llmfit
本地大模型
LLM
Rust
量化
Ollama
llama.cpp
Apple Silicon
硬件适配
开源
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
编程
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
2026-07-19 09:14:11 +0800 CST
view 1032
纯C语言实现的大模型推理引擎,仅用1300行代码在25GB内存笔记本上运行744B参数的GLM-5.2 MoE模型,含完整代码示例与技术解析
C语言
GLM-5.2
MoE
大模型推理
量化
AVX2
MLA注意力
推测解码
Apple Silicon
OpenCode 深度解析:160K Stars 的开源 AI 编程 Agent 如何用 LSP 感知 + 多会话并行 + 75+ 模型支持重新定义终端编程体验——从架构设计到生产级工作流的完整实战指南
编程
OpenCode 深度解析:160K Stars 的开源 AI 编程 Agent 如何用 LSP 感知 + 多会话并行 + 75+ 模型支持重新定义终端编程体验——从架构设计到生产级工作流的完整实战指南
2026-07-06 21:15:45 +0800 CST
view 348
深度解析GitHub 160K+ Stars的OpenCode开源AI编程Agent:LSP代码智能感知、Plan/Build双模式工作流、75+模型提供商支持、Zen模型网关、MCP协议扩展、多会话并行、Bubble Tea TUI架构、Agent技能系统、OAuth自动认证、GitHub Copilot集成。从架构设计到生产级工作流的完整实战指南,含完整代码示例与竞品对比分析。
OpenCode
AI编程
终端
开源
Agent
LSP
MCP
Bubble Tea
Zen
多会话
React Compiler 深度解析:让 React 终于学会「自动优化」的编译器魔法
编程
React Compiler 深度解析:让 React 终于学会「自动优化」的编译器魔法
2026-05-12 02:15:08 +0800 CST
view 647
深度解析React Compiler(React Forget)的工作原理:通过静态分析自动推导依赖关系、自动插入useMemo/useCallback记忆化代码、构建数据流图与活性分析算法、Babel插件实现细节、与手动优化性能对比,附Vite/Next.js集成指南与渐进式迁移策略
React,React Compiler,性能优化,自动记忆化,useMemo,useCallback,React.memo,Babel插件,静态分析,前端性能
Moltis 深度拆解:当 Rust 决定「把个人 AI Agent 做成一个二进制文件」——从零依赖部署到容器级沙箱,一个 MIT 开源的持久化 Agent 服务器如何用「单二进制 + Rust 所有权安全」重新定义本地 AI 助手的终极形态
编程
Moltis 深度拆解:当 Rust 决定「把个人 AI Agent 做成一个二进制文件」——从零依赖部署到容器级沙箱,一个 MIT 开源的持久化 Agent 服务器如何用「单二进制 + Rust 所有权安全」重新定义本地 AI 助手的终极形态
2026-08-06 04:17:33 +0800 CST
view 91
深度拆解Moltis:Rust编写的持久化个人AI Agent服务器,单二进制部署、容器级沙箱隔离、零化内存密钥处理、混合搜索记忆系统,重新定义本地AI助手的安全与性能
Moltis
Rust
AI Agent
个人AI助手
沙箱
内存安全
单二进制
Apple Container
WASM
持久化Agent
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
编程
万字深度解析 Nano-vLLM:当1200行Python代码重构大模型推理——从架构设计到性能超越vLLM的完整技术指南(2026)
2026-07-01 14:44:55 +0800 CST
view 318
Nano-vLLM:用约1200行Python代码实现的轻量级vLLM替代方案。深度解析KV Cache管理、GQA注意力、RoPE位置编码、Continuous Batching等核心技术,Benchmark性能超越vLLM 5.3%。适合学习大模型推理原理和内网轻量级部署。
Nano-vLLM
大模型推理
LLM
Tensor Parallelism
KV Cache
Continuous Batching
Python
PyTorch
Qwen2
开源项目
Zig 深度拆解:当一门系统语言决定「向 AI 代码说不」——从 comptime 编译期元编程到显式分配器模型,一个被 TigerBeetle 和 Bun 选中的语言如何用「零隐藏控制流 + 零隐藏内存分配」重新定义系统编程的终极形态
编程
Zig 深度拆解:当一门系统语言决定「向 AI 代码说不」——从 comptime 编译期元编程到显式分配器模型,一个被 TigerBeetle 和 Bun 选中的语言如何用「零隐藏控制流 + 零隐藏内存分配」重新定义系统编程的终极形态
2026-08-06 07:45:33 +0800 CST
view 111
深度拆解Zig编程语言:comptime编译期元编程革命、显式分配器模型掌控内存、零隐藏设计哲学、错误联合类型机制、跨编译工具链,以及为什么TigerBeetle和Bun选择Zig,Zig为何向AI代码说不
Zig
comptime
系统编程
内存分配
TigerBeetle
Bun
Rust
C++
编译期元编程
显式分配器
错误处理
跨编译
开源
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
编程
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
2026-05-18 06:15:03 +0800 CST
view 754
Redis之父antirez开源ds4.c项目深度解析:用纯C语言在MacBook上运行284B参数大模型,不对称2-bit量化、KV缓存磁盘化、OpenAI/Anthropic API兼容,打造首个真正的本地Agent推理后端
AI推理
本地大模型
Redis
Apple Silicon
DeepSeek
Swift 6.4 所有权系统深度拆解——从 ARC 到 ~Copyable,Swift 为何开始"硬刚"Rust
编程
Swift 6.4 所有权系统深度拆解——从 ARC 到 ~Copyable,Swift 为何开始"硬刚"Rust
2026-07-31 06:17:59 +0800 CST
view 146
深度拆解Swift 6.4所有权系统:从ARC的历史债讲起,到~Copyable的核心语法、Ref/MutableRef安全借用、UniqueArray极致性能,与Rust内存安全模型横向对比,探讨Swift为何开始"硬刚"Rust。
Swift
所有权
Ownership
NonCopyable
Rust
内存安全
Ref
UniqueArray
ARC
Pixelle-Video:阿里开源全自动视频生成,输入一句话串起整条产线,GitHub 2.2万 Star
编程
Pixelle-Video:阿里开源全自动视频生成,输入一句话串起整条产线,GitHub 2.2万 Star
2026-06-13 12:45:50 +0800 CST
view 467
Pixelle-Video是阿里国际AI团队开源的全自动视频生成工具,输入主题自动写文案/生成配图/合成语音/加BGM,支持ComfyUI本地/RunningHub云端/直连API三种配图方案,数字人口播+动作迁移,零成本可选。
Pixelle-Video
阿里开源
视频生成
AI
全自动
ComfyUI
数字人
动作迁移
Streamlit
AIGC
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
编程
Ollama 深度拆解:从傻瓜式本地大模型部署到底层 llama.cpp 调度器的工程全貌(2026·完整版)
2026-07-20 18:18:40 +0800 CST
view 366
深度拆解 Ollama 工程架构:Go 服务层封装 llama.cpp、CGO 内存边界、GGUF 量化格式、Modelfile DSL、OpenAI 兼容层、Metal GPU 加速与生产部署实战,配完整 Go/Python/Shell 代码示例。
Ollama
本地大模型
llama.cpp
GGUF
Go
CGO
量化
Apple Silicon
Bumblebee 深度实战:Perplexity 开源的企业级供应链安全扫描器——从架构原理到生产级部署完全指南(2026)
编程
Bumblebee 深度实战:Perplexity 开源的企业级供应链安全扫描器——从架构原理到生产级部署完全指南(2026)
2026-06-05 16:10:09 +0800 CST
view 622
Bumblebee 是 Perplexity AI 开源的零依赖 Go 单二进制工具,一次扫描 npm/pypi/Go/MCP 等 13+ 生态系统的本地包元数据,精准回答 CVE 披露后「公司有多少台机器装了这个包」。
供应链安全
Go语言
SBOM
DevSecOps
Perplexity
开源工具
网络安全
React Compiler 移植 Rust 深度实战:当前端编译器学会「零拷贝」——从 Arena 分配器到 10x 性能飞跃的完全指南(2026)
编程
React Compiler 移植 Rust 深度实战:当前端编译器学会「零拷贝」——从 Arena 分配器到 10x 性能飞跃的完全指南(2026)
2026-06-14 06:18:48 +0800 CST
view 742
React团队合并PR#36173将Compiler从TypeScript移植到Rust,Babel插件快3倍核心逻辑快10倍。本文从Arena分配器、NAPI绑定、OXC/SWC集成逐层拆解
React
Rust
Compiler
前端工程
性能优化
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
42
43
44
45
46
...
104
下一页