程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
oMLX 深度实战:当 Apple Silicon 遇见本地大模型推理——从 MTP 加速到分层 KV 缓存的生产级完全指南(2026)
编程
oMLX 深度实战:当 Apple Silicon 遇见本地大模型推理——从 MTP 加速到分层 KV 缓存的生产级完全指南(2026)
2026-06-16 16:46:05 +0800 CST
view 1040
深度解析 2026 年 Apple Silicon 本地大模型推理技术栈:从 llama.cpp 量化体系到 oMLX 分层 KV 缓存架构,从 MTP 加速到 CoreAI 全栈指南,包含实测 Benchmark 与生产级部署方案。
Apple Silicon
MLX
llama.cpp
oMLX
MTP
本地大模型
量化
本地推理
oMLX 深度解析:Apple Silicon 原生的本地大模型推理服务器——从分层 KV 缓存到菜单栏级 AI 编码伴侣
编程
oMLX 深度解析:Apple Silicon 原生的本地大模型推理服务器——从分层 KV 缓存到菜单栏级 AI 编码伴侣
2026-05-21 22:30:11 +0800 CST
view 999
深入解析 oMLX 的分层 KV 缓存架构(热 RAM + 冷 SSD)、Copy-on-Write 优化、与 Claude Code 的深度集成,以及 Apple Silicon 原生的推理性能优化。
oMLX
Apple Silicon
本地大模型
KV缓存
MLX
推理服务器
HTML 解析器性能深度横评:从 Lexbor 的 SIMD 优化到 BeautifulSoup 的易用性权衡——2026 年爬虫基础设施选型指南
编程
HTML 解析器性能深度横评:从 Lexbor 的 SIMD 优化到 BeautifulSoup 的易用性权衡——2026 年爬虫基础设施选型指南
2026-06-30 07:15:57 +0800 CST
view 429
深度解析2026年主流HTML解析器性能差异:从Lexbor的SIMD指令集优化、Arena内存分配器到BeautifulSoup的设计权衡,附完整基准测试数据与生产级选型指南。
HTML解析器
性能优化
爬虫
Lexbor
BeautifulSoup
lxml
SIMD
Arena分配器
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
编程
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
2026-07-24 17:17:27 +0800 CST
view 297
深度解析 omlx:专为 Mac 优化的本地 LLM 推理服务器,通过连续批处理、分层 KV Cache、SSD 缓存和菜单栏管理,实现便捷与控制兼得的推理体验。涵盖技术架构、性能调优、RAG 实战和最佳实践。
LLM
Mac
Apple Silicon
推理优化
本地部署
omlx
RLX 深度拆解:MIT 如何用纯 Rust 写出一个「编译器+运行时合一」的 ML 框架——从 JAX 形状的张量 IR 到 15 种硬件后端的全栈工程哲学
编程
RLX 深度拆解:MIT 如何用纯 Rust 写出一个「编译器+运行时合一」的 ML 框架——从 JAX 形状的张量 IR 到 15 种硬件后端的全栈工程哲学
2026-08-04 01:43:34 +0800 CST
view 183
深度拆解MIT RLX纯Rust ML编译器架构:统一IR贯穿图优化到内核调度、15种硬件后端支持、JAX形自动微分、INT8量化感知训练、FPGA综合、Iroh NAT穿透分布式训练,附完整代码示例与性能优化实战指南
RLX
Rust
ML编译器
张量IR
自动微分
边缘计算
WebGPU
CUDA
Apple Silicon
量化部署
开源
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
编程
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
2026-04-11 10:24:48 +0800 CST
view 976
深度解析 Apple Silicon 上的视觉语言模型推理引擎 MLX-VLM,涵盖架构设计、模型支持、性能优化与实战部署。
Apple Silicon
MLX
视觉语言模型
VLM
Mac本地AI
多模态推理
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
编程
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
2026-06-22 17:24:05 +0800 CST
view 712
oMLX 是专为 Apple Silicon 优化的 LLM 推理服务器,通过连续批处理、分层 KV Cache、MLX 后端加速和 macOS 菜单栏管理,让本地 AI 推理从可用走向实用。
LLM
Apple Silicon
MLX
本地推理
MCP
Mano-P + Cider:4B模型本地操控Mac,端侧GUI Agent新时代
案例
Mano-P + Cider:4B模型本地操控Mac,端侧GUI Agent新时代
2026-05-07 13:34:32 +0800 CST
view 618
明略科技开源Mano-P(4B量化模型本地操控Mac)和Cider(MLX推理加速框架)。476 tokens/s预填充,76 tokens/s解码,峰值内存4.3GB,完全本地运行数据不出设备,离线长任务自主规划
GUI Agent
端侧AI
Apple Silicon
MLX
视觉理解
本地运行
Mano-P
Cider
llmfit 深度拆解:Rust 写就的本地大模型选型神器——一行命令把"显存够不够跑"从玄学变成算术
编程
llmfit 深度拆解:Rust 写就的本地大模型选型神器——一行命令把"显存够不够跑"从玄学变成算术
2026-08-18 08:15:14 +0800 CST
view 80
llmfit 是一款 Rust 编写的本地大模型选型工具,一行命令自动检测硬件配置,精确计算显存占用,给出 Fit 评分和速度估算,支持 Ollama、llama.cpp、MLX 等多运行时,配可运行代码与最佳实践。
llmfit
Rust
TUI
本地大模型
LLM推理
Ollama
llama.cpp
模型选型
量化
Apple Silicon
GPU
显存计算
MLX
命令行工具
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
编程
Ollama 0.30 深度实战:当本地 LLM 推理有了双引擎——从 llama.cpp + MLX 双后端到 Gemma 4 QAT、从 Cohere2 MoE 到 ollama launch AI 编程助手生态的生产级完全指南(2026)
2026-06-21 08:54:17 +0800 CST
view 823
Ollama 0.30 深度解析:双引擎推理架构、Gemma 4 QAT、Cohere2 MoE、ollama launch 生态与生产级部署完全指南
Ollama
LLM
本地推理
AI编程
llama.cpp
MLX
Gemma
开源
Rust 异步 ORM 新选择:Toasty 深度实战指南——来自 Tokio 团队的下一代查询引擎
编程
Rust 异步 ORM 新选择:Toasty 深度实战指南——来自 Tokio 团队的下一代查询引擎
2026-05-25 10:04:23 +0800 CST
view 622
深度解析Tokio团队推出的新一代异步ORM框架Toasty,探讨其统一SQL与NoSQL的设计理念、核心特性、CRUD实战与性能对比
Rust,ORM,Toasty,Tokio,异步编程,数据库,SQLx,SeaORM
Rust Web 框架 2026 生态全景:Axum vs Actix-web vs Warp,TechEmpower 160K req/s 背后的技术真相
编程
Rust Web 框架 2026 生态全景:Axum vs Actix-web vs Warp,TechEmpower 160K req/s 背后的技术真相
2026-05-15 03:13:09 +0800 CST
view 1196
TechEmpower Round 23 数据深度解析:Actix-web 160K req/s、Axum 148K req/s 领先 Go Gin 1.5-1.7 倍。从架构设计、SQLx/SeaORM/Diesel 数据库集成、生产部署到与 Go 选型对比,2026 年 Rust Web 框架完整选型指南。
Rust,Axum,Actix-web,Warp,Web框架,SQLx,SeaORM,后端开发
sqlh:Go 语言零样板 SQL 库,结构体标签生成 CRUD,50 行搞定
编程
sqlh:Go 语言零样板 SQL 库,结构体标签生成 CRUD,50 行搞定
2026-07-09 07:57:04 +0800 CST
view 277
Go语言零样板SQL库sqlh,结构体标签自动生成CRUD,泛型类型安全,自动事务,SQLite/MySQL/PostgreSQL支持,约200KB,115行→50行缩减57%。
Go
SQL
ORM
sqlx
GORM
CRUD
数据库
SQLite
泛型
开源
基于 OpenCode 的开源智能体平台:code-agent 让 AI 帮你在 UBML 低代码场景做页面开发
编程
基于 OpenCode 的开源智能体平台:code-agent 让 AI 帮你在 UBML 低代码场景做页面开发
2026-07-05 08:54:51 +0800 CST
view 391
code-agent是基于OpenCode的开源AI智能体平台,为UBML低代码场景做了领域扩展。支持Agent对话写代码、UBML知识包让AI理解低代码组件、YAML DSL描述页面一键编译校验预览反编译、OpenSpec规约驱动开发。Apache-2.0+MIT双协议。
OpenCode
code-agent
UBML
低代码
AI Agent
智能体平台
YAML DSL
页面生成
Apache-2.0
开源
Bun
Farris
Deno 2.8 深度实战:当 Node.js 兼容性突破 76%、后量子密码学降临,JavaScript 运行时三国杀格局如何重塑(2026)
编程
Deno 2.8 深度实战:当 Node.js 兼容性突破 76%、后量子密码学降临,JavaScript 运行时三国杀格局如何重塑(2026)
2026-06-16 19:27:04 +0800 CST
view 519
深入解析 Deno 2.8 的重大更新:Node.js 兼容性突破 76%、后量子密码学 ML-KEM/ML-DSA 首次支持、性能大幅提升,从架构原理到生产级部署的完整实战指南。
Deno
JavaScript
TypeScript
Node.js
Bun
后量子密码学
ML-KEM
ML-DSA
Web开发
运行时
liboqs 深度拆解:当 RSA/ECC 遇见量子末日——从 ML-KEM、ML-DSA 到 TLS 混合加密的生产级迁移全指南(2026)
编程
liboqs 深度拆解:当 RSA/ECC 遇见量子末日——从 ML-KEM、ML-DSA 到 TLS 混合加密的生产级迁移全指南(2026)
2026-07-19 07:18:33 +0800 CST
view 312
深度拆解 liboqs 后量子密码学库:从 ML-KEM、ML-DSA 的格理论基础,到 TLS 混合加密与 OpenSSL 集成,含完整 C/Rust/Python/Go/Java 代码实战与生产迁移最佳实践
PQC
后量子密码学
ML-KEM
ML-DSA
liboqs
密码学
网络安全
TLS
Go 1.27 深度解读:泛型方法史诗级补全与后量子密码学时代的降临
编程
Go 1.27 深度解读:泛型方法史诗级补全与后量子密码学时代的降临
2026-06-25 20:16:08 +0800 CST
view 628
Go 1.27深度解析:泛型方法史诗级补全、encoding/json v2涅槃重生、标准库uuid、ML-DSA/ML-KEM后量子加密、实验性SIMD包,六大核心特性逐一击破。万字长文带你全面掌握2026年最重要的Go版本。
Go 1.27
泛型方法
encoding/json v2
后量子加密
ML-DSA
ML-KEM
SIMD
标准库
Go 1.27 六大特性全景解析:泛型方法终于落地、JSON v2涅槃重生、后量子密码全面拥抱
编程
Go 1.27 六大特性全景解析:泛型方法终于落地、JSON v2涅槃重生、后量子密码全面拥抱
2026-06-25 20:17:45 +0800 CST
view 780
深度解析Go 1.27六大核心特性:泛型方法终于支持类型参数、encoding/json v2性能飞跃、标准库uuid、ML-DSA后量子签名、ML-KEM密钥交换、实验性SIMD包,12000字生产级指南。
Go 1.27
泛型方法
JSON v2
UUIDv7
后量子加密
ML-DSA
ML-KEM
SIMD
你睡觉,AI 干活:Karpathy 的 AutoResearch 如何让大模型自己学会训练自己
编程
你睡觉,AI 干活:Karpathy 的 AutoResearch 如何让大模型自己学会训练自己
2026-04-19 18:47:36 +0800 CST
view 1028
深入解析 Andrej Karpathy 的 AutoResearch 开源项目,揭示其让 AI agent 自主修改训练代码、在真实执行中验证改进的核心机制,探讨对算法工程师职业的影响。
AI研究
机器学习
AutoML
LLM训练
Andrej Karpathy
GitHub开源
自动化调参
Python
研究效率
Agent
你睡觉AI在训练:Karpathy AutoResearch如何让AI自主优化GPT模型
编程
你睡觉AI在训练:Karpathy AutoResearch如何让AI自主优化GPT模型
2026-04-11 10:54:43 +0800 CST
view 690
深入解析Karpathy开源的AutoResearch框架,探讨AI自主训练循环的工程实现与研究范式转变
AI
Karpathy
AutoML
LLM
GitHub
GPU白嫖指南:Karpathy AutoResearch把深度学习调参变成AI托管服务
编程
GPU白嫖指南:Karpathy AutoResearch把深度学习调参变成AI托管服务
2026-04-11 10:55:13 +0800 CST
view 745
深入解析Karpathy开源的AutoResearch框架,探讨AI自主训练循环的工程实现与研究范式转变
AI
Karpathy
AutoML
LLM
GitHub
Rust 1.94.0 深度解析:array_windows、Cargo 配置模块化与 TOML 1.1——一场静水深流的工程化升级
编程
Rust 1.94.0 深度解析:array_windows、Cargo 配置模块化与 TOML 1.1——一场静水深流的工程化升级
2026-04-11 11:55:49 +0800 CST
view 1145
深入解析 Rust 1.94.0 三大核心特性:array_windows 编译期安全窗口迭代、Cargo 配置 include 模块化、TOML 1.1 全面升级,结合生产级代码示例和性能对比
Rust
编程语言
系统编程
Cargo
TOML
Chrome 新提案:HTML 反杀 JavaScript,声明式局部更新来了
编程
Chrome 新提案:HTML 反杀 JavaScript,声明式局部更新来了
2026-07-06 08:56:10 +0800 CST
view 295
Chrome正在推进Declarative Partial Updates,让HTML原生支持页面局部更新,服务端直接流式输出HTML patch,浏览器自动替换,无需JavaScript。
HTML
JavaScript
Chrome
前端
Web
W3C
浏览器
开源
Go 1.26 深度拆解:Green Tea GC 转正、new(expr) 终结指针辅助函数,一次「白送」的性能升级
编程
Go 1.26 深度拆解:Green Tea GC 转正、new(expr) 终结指针辅助函数,一次「白送」的性能升级
2026-07-30 04:45:50 +0800 CST
view 215
深度拆解 Go 1.26:Green Tea GC 按 span 批量扫描如何砍掉 10%~40% GC 开销、new(expr) 与泛型自引用约束落地、go fix 重生为现代化流水线,附实测数据、GOMEMLIMIT 联动调优与升级清单。
Go
Green Tea GC
垃圾回收
new expr
泛型
go fix
cgo
性能优化
GOMEMLIMIT
开源
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
...
22
下一页