程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
编程
当 Apple Silicon 遇上视觉大模型:MLX-VLM 如何把「本地多模态推理」变成现实
2026-04-11 10:24:48
view 1007
深度解析 Apple Silicon 上的视觉语言模型推理引擎 MLX-VLM,涵盖架构设计、模型支持、性能优化与实战部署。
Apple Silicon
MLX
视觉语言模型
VLM
Mac本地AI
多模态推理
llmfit 深度拆解:一条命令算清你的机器能跑哪个大模型,Rust 硬件探测与适配度评分引擎全解析
编程
llmfit 深度拆解:一条命令算清你的机器能跑哪个大模型,Rust 硬件探测与适配度评分引擎全解析
2026-07-24 07:14:55
view 238
深度拆解 GitHub Trending 破万星的 llmfit:Rust 硬件探测、权重与 KV cache 显存估算公式、内存带宽速度模型、MoE offload 运行模式,附 100 行 Python 复现 mini-llmfit 与工程集成实战。
llmfit
Rust
本地大模型
Ollama
llama.cpp
量化
KV cache
MoE
硬件选型
开源
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
编程
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
2026-06-22 17:24:05
view 799
oMLX 是专为 Apple Silicon 优化的 LLM 推理服务器,通过连续批处理、分层 KV Cache、MLX 后端加速和 macOS 菜单栏管理,让本地 AI 推理从可用走向实用。
LLM
Apple Silicon
MLX
本地推理
MCP
Claude Code 集成 iOS 模拟器:AI 编程的「最后一公里」被谁打通了?
编程
Claude Code 集成 iOS 模拟器:AI 编程的「最后一公里」被谁打通了?
2026-07-24 09:43:46
view 262
深度拆解 Anthropic Claude Code 集成 iOS 模拟器的技术原理:无障碍树读取、系统级触控事件注入、专用面板隔离设计,以及这一集成对 AI 编程工具链的深远影响。
Claude Code
iOS开发
SwiftUI
Xcode
AI编程
模拟器自动化
Apple
移动端开发
llama.cpp 深度实战:从 GGUF 量化到 CUDA 内核优化——纯 C/C++ 如何在 CPU/GPU 上榨出 LLM 推理的极限性能
编程
llama.cpp 深度实战:从 GGUF 量化到 CUDA 内核优化——纯 C/C++ 如何在 CPU/GPU 上榨出 LLM 推理的极限性能
2026-05-23 17:18:22
view 2384
2026年深度拆解 llama.cpp 的核心架构:GGUF 格式原理、20+量化方法对比、KV Cache 优化、多硬件后端性能实测,与 Ollama/vLLM 完整横评。
llama.cpp
GGUF
量化
CUDA
Metal
LLM推理
C++
本地部署
性能优化
GGML
Ollama深度解析:Go语言打造的本地LLM推理引擎——从Modelfile容器化到GPU调度的完整实战指南
编程
Ollama深度解析:Go语言打造的本地LLM推理引擎——从Modelfile容器化到GPU调度的完整实战指南
2026-07-06 05:48:17
view 336
深度解析Ollama本地LLM推理引擎架构与实战
Ollama
本地推理
LLM
Go
llama.cpp
GGUF
GPU
Modelfile
MCP 2026-07-28 深度拆解:当 AI 工具协议决定「干掉全部会话状态」——从有状态握手到无状态自包含,一个被 10 万+ Agent 采用的协议如何用 9 项破坏性变更重新定义工具集成的终极形态
编程
MCP 2026-07-28 深度拆解:当 AI 工具协议决定「干掉全部会话状态」——从有状态握手到无状态自包含,一个被 10 万+ Agent 采用的协议如何用 9 项破坏性变更重新定义工具集成的终极形态
2026-08-05 08:13:42
view 327
深度拆解MCP 2026-07-28规范:9项破坏性变更,从有状态握手到无状态自包含,MRTR替代双向流,MCP Apps和Tasks扩展框架,OAuth企业级适配,附完整迁移代码与性能基准
MCP
Model Context Protocol
AI Agent
无状态
MRTR
MCP Apps
Tasks
OAuth
工具集成
协议
DwarfStar 4 深度拆解:当 Redis 之父决定「给 284B 大模型造一个专属引擎」——从 Metal GPU 到磁盘 KV 缓存,一个 10K Star 的极简推理栈如何用 One Model One Engine 哲学重新定义本地 AI 推理的终极形态
编程
DwarfStar 4 深度拆解:当 Redis 之父决定「给 284B 大模型造一个专属引擎」——从 Metal GPU 到磁盘 KV 缓存,一个 10K Star 的极简推理栈如何用 One Model One Engine 哲学重新定义本地 AI 推理的终极形态
2026-08-05 12:17:17
view 245
深度拆解Redis创始人antirez打造的DeepSeek V4 Flash专用本地推理引擎DwarfStar 4:One Model One Engine哲学、非对称量化策略、磁盘KV缓存、双协议兼容层,附完整架构分析与性能基准
DwarfStar
DeepSeek
本地推理
MoE
Metal
Apple Silicon
antirez
Redis
AI推理
开源
BitNet 1.58-bit:微软如何用三个值就让大模型在 CPU 上飞奔
编程
BitNet 1.58-bit:微软如何用三个值就让大模型在 CPU 上飞奔
2026-05-11 13:55:11
view 800
微软开源BitNet 1.58-bit大模型推理框架,2B参数模型仅需0.4GB内存、29ms/token推理速度。核心创新:训练时量化、-1/0/+1三值权重、位运算加速,精度损失<5%却比INT4表现更好。纯CPU运行,71%能耗降低。
BitNet,1.58bit,微软,大模型量化,1bit LLM,CPU推理,bitnet.cpp,训练时量化,位运算加速,模型压缩
微信小程序开发框架深度解析:50K Star资源清单背后的9年生态演进
编程
微信小程序开发框架深度解析:50K Star资源清单背后的9年生态演进
2026-05-11 15:35:58
view 991
从50.9K Star的awesome-wechat-weapp资源清单出发,深度解析微信小程序9年生态演进:uni-app/Taro/MPX三足鼎立,mpvue/WePY/chameleon/Remax已死,2026年选型指南
微信小程序
uni-app
Taro
MPX
跨端开发
WePY
mpvue
鸿蒙
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
编程
omlx:Mac 本地 LLM 推理的终极方案——从菜单栏管理到 SSD 缓存的完整工程实践
2026-07-24 17:17:27
view 350
深度解析 omlx:专为 Mac 优化的本地 LLM 推理服务器,通过连续批处理、分层 KV Cache、SSD 缓存和菜单栏管理,实现便捷与控制兼得的推理体验。涵盖技术架构、性能调优、RAG 实战和最佳实践。
LLM
Mac
Apple Silicon
推理优化
本地部署
omlx
Uni-app 也能像 Vue 一样用 App.vue?这款插件做到了!
编程
Uni-app 也能像 Vue 一样用 App.vue?这款插件做到了!
2025-07-25 19:33:08
view 1513
本文介绍了如何使用`@uni-ku/root`插件为uni-app提供根组件支持,使其能够像Vue一样使用App.vue。通过该插件,开发者可以轻松集成全局组件,如Toast、Loading等,解决了uni-app中全局状态共享和组件挂载的痛点。文章还提供了详细的安装和配置步骤,以及示例代码,帮助开发者更好地使用uni-app。
uni-app
Vue
前端开发
插件
组件
Agent Lightning 深度拆解:当强化学习遇上 AI Agent——从「零代码变更」到多智能体协同进化的生产级实战指南(2026)
编程
Agent Lightning 深度拆解:当强化学习遇上 AI Agent——从「零代码变更」到多智能体协同进化的生产级实战指南(2026)
2026-08-14 07:45:23
view 236
深度拆解微软开源 Agent Lightning 框架:从零代码变更架构到多智能体协同优化,从 LangChain/AutoGen/CrewAI 集成到 Reward 设计与收敛调试,配完整代码实战与 15 条生产踩坑清单。
Agent Lightning
强化学习
AI Agent
微软
开源框架
PPO
GRPO
LangChain
AutoGen
多智能体
编程
vue中使用rsa加密和数字签名和后端如php进行加密交互
2024-11-19 02:17:27
view 4368
本文介绍了如何在后端使用RAS加密,包括安装jsencrypt和crypto-js库,公私钥的生成与使用,以及如何进行数据的加密、解密和签名验证。提供了代码示例,展示了如何在uniapp项目中实现这些功能,并强调了保护公私钥的重要性,以防止被他人轻易获取。
加密
安全
后端开发
uniapp
数据保护
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
编程
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
2026-07-19 09:14:11
view 1140
纯C语言实现的大模型推理引擎,仅用1300行代码在25GB内存笔记本上运行744B参数的GLM-5.2 MoE模型,含完整代码示例与技术解析
C语言
GLM-5.2
MoE
大模型推理
量化
AVX2
MLA注意力
推测解码
Apple Silicon
资讯
商城APP开发费用解析:如何判断报价是否合理?
2024-11-19 01:02:48
view 1947
本文分析了商城APP开发费用的影响因素,包括功能复杂度、开发方式、开发团队选择、设计与用户体验、后期维护等。提供了判断开发报价合理性的参考,强调源码交付和功能扩展的重要性。企业在开发前应明确需求,了解报价细节,以确保合理预算和高质量交付。
APP开发
软件开发
移动互联网
定制软件开发
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
编程
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
2026-04-12 22:56:41
view 1260
2026年深度解析 llama.cpp 架构设计与 GGUF 量化格式,从底层原理到工程实战,涵盖 K-Quant/IQ 量化、Flash Attention、KV Cache 优化、Intel NPU/GPU 部署全流程。
llama.cpp
GGUF
量化
大模型
C++
本地部署
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
编程
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
2026-05-18 06:15:03
view 839
Redis之父antirez开源ds4.c项目深度解析:用纯C语言在MacBook上运行284B参数大模型,不对称2-bit量化、KV缓存磁盘化、OpenAI/Anthropic API兼容,打造首个真正的本地Agent推理后端
AI推理
本地大模型
Redis
Apple Silicon
DeepSeek
Agent Lightning 深度拆解:当强化学习成为 AI Agent 的「进化引擎」——零代码接入 RL 训练的生产级实战指南
编程
Agent Lightning 深度拆解:当强化学习成为 AI Agent 的「进化引擎」——零代码接入 RL 训练的生产级实战指南
2026-08-15 09:16:12
view 160
深度拆解微软Agent Lightning项目:训练-代理分离架构、三要素设计、生产级部署避坑指南,零代码接入RL训练让AI Agent越用越聪明
Agent Lightning
强化学习
AI Agent
微软
RL
PPO
生产级AI
模型优化
Lilishop:全开源 Java 多商户商城系统,一套代码通吃 PC、H5 和小程序
编程
Lilishop:全开源 Java 多商户商城系统,一套代码通吃 PC、H5 和小程序
2026-05-12 12:12:44
view 809
Lilishop是一个全开源的Java B2B2C多商户商城系统,基于SpringBoot+Vue+uni-app,一套代码通吃PC/H5/小程序/APP,支持多商家入驻、分销、秒杀拼团、Elasticsearch搜索、Docker部署。
Lilishop
Java商城
B2B2C
多商户
开源电商
uni-app
uni-app 也能实现全局 Toast?这套方案彻底搞定!
编程
uni-app 也能实现全局 Toast?这套方案彻底搞定!
2025-08-17 18:33:39
view 1822
本文介绍了一种在uni-app中实现全局Toast的解决方案,解决了传统方法的局限性。通过wd-toast组件、Layout插件和Pinia状态管理,用户可以在任何地方调用Toast,支持网络请求失败提示、路由守卫提醒等功能。该方案还具备良好的扩展性,能够实现全局加载和弹窗等功能,提升用户体验。
uni-app
前端开发
用户体验
组件化
状态管理
PyTorch 2.13 深度解析:一次把框架换心与跨平台革命讲透
编程
PyTorch 2.13 深度解析:一次把框架换心与跨平台革命讲透
2026-07-14 01:14:51
view 579
2026年7月PyTorch 2.13重磅发布:FlexAttention在Apple Silicon实现12倍加速、CuTeDSL提供CUTLASS级GEMM代码生成、融合损失函数将大词汇量训练峰值显存削减4倍、torchcomms革新分布式通信后端、ExecuTorch正式并入核心,深度拆解六大核心更新与实战代码。
PyTorch
深度学习
机器学习框架
GPU
Distributed Training
FlexAttention
CUDA
GEMM
ROCm
Apple Silicon
MPS
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
编程
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
2026-07-14 03:43:32
view 341
深度拆解 Ollama 本地大模型推理工程化:从 GGUF 量化原理、MoE 专家调度、推理栈与 KV 缓存,到 Modelfile 定制、自量化、Python 客户端、FastAPI 生产服务、Docker 部署与性能调优,配完整可运行代码与 vLLM 对比。
Ollama
本地大模型
llama.cpp
GGUF量化
大模型部署
AI工程化
隐私计算
推理优化
Ollama 完全指南:本地大模型部署的事实标准——从原理到生产级 AI 应用开发(2026)
编程
Ollama 完全指南:本地大模型部署的事实标准——从原理到生产级 AI 应用开发(2026)
2026-06-05 04:13:34
view 581
Ollama 本地大模型部署完全指南,从架构原理到生产级部署,涵盖 RAG 集成、性能优化、Docker/K8s 部署等核心内容。
Ollama
本地大模型
AI应用开发
Go语言
llama.cpp
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
2
3
4
5
6
...
78
下一页