程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
编程
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
2026-07-19 09:14:11 +0800 CST
view 904
纯C语言实现的大模型推理引擎,仅用1300行代码在25GB内存笔记本上运行744B参数的GLM-5.2 MoE模型,含完整代码示例与技术解析
C语言
GLM-5.2
MoE
大模型推理
量化
AVX2
MLA注意力
推测解码
Apple Silicon
资讯
商城APP开发费用解析:如何判断报价是否合理?
2024-11-19 01:02:48 +0800 CST
view 1851
本文分析了商城APP开发费用的影响因素,包括功能复杂度、开发方式、开发团队选择、设计与用户体验、后期维护等。提供了判断开发报价合理性的参考,强调源码交付和功能扩展的重要性。企业在开发前应明确需求,了解报价细节,以确保合理预算和高质量交付。
APP开发
软件开发
移动互联网
定制软件开发
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
编程
从原理到实战:llama.cpp 与 GGUF 量化格式的工程实践全解
2026-04-12 22:56:41 +0800 CST
view 1068
2026年深度解析 llama.cpp 架构设计与 GGUF 量化格式,从底层原理到工程实战,涵盖 K-Quant/IQ 量化、Flash Attention、KV Cache 优化、Intel NPU/GPU 部署全流程。
llama.cpp
GGUF
量化
大模型
C++
本地部署
Moltis 深度拆解:当 Rust 决定「把个人 AI Agent 做成一个二进制文件」——从零依赖部署到容器级沙箱,一个 MIT 开源的持久化 Agent 服务器如何用「单二进制 + Rust 所有权安全」重新定义本地 AI 助手的终极形态
编程
Moltis 深度拆解:当 Rust 决定「把个人 AI Agent 做成一个二进制文件」——从零依赖部署到容器级沙箱,一个 MIT 开源的持久化 Agent 服务器如何用「单二进制 + Rust 所有权安全」重新定义本地 AI 助手的终极形态
2026-08-06 04:17:33 +0800 CST
view 12
深度拆解Moltis:Rust编写的持久化个人AI Agent服务器,单二进制部署、容器级沙箱隔离、零化内存密钥处理、混合搜索记忆系统,重新定义本地AI助手的安全与性能
Moltis
Rust
AI Agent
个人AI助手
沙箱
内存安全
单二进制
Apple Container
WASM
持久化Agent
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
编程
ds4.c 深度解析:Redis之父如何用纯C代码在MacBook上跑通284B大模型——从不对称量化到KV缓存磁盘化的完整技术内幕
2026-05-18 06:15:03 +0800 CST
view 677
Redis之父antirez开源ds4.c项目深度解析:用纯C语言在MacBook上运行284B参数大模型,不对称2-bit量化、KV缓存磁盘化、OpenAI/Anthropic API兼容,打造首个真正的本地Agent推理后端
AI推理
本地大模型
Redis
Apple Silicon
DeepSeek
Shimmy 深度解析:纯 Rust WebGPU 推理引擎如何用一行命令颠覆浏览器端 AI 推理
编程
Shimmy 深度解析:纯 Rust WebGPU 推理引擎如何用一行命令颠覆浏览器端 AI 推理
2026-07-25 15:14:38 +0800 CST
view 127
深度解析 Shimmy v2.3.0:纯 Rust WebGPU 推理引擎如何实现浏览器端原生运行 GGUF 量化模型,OpenAI API 兼容,零依赖部署。
WebGPU
Rust
GGUF
AI推理
浏览器
llama.cpp
OpenAI API
前端工程
Lilishop:全开源 Java 多商户商城系统,一套代码通吃 PC、H5 和小程序
编程
Lilishop:全开源 Java 多商户商城系统,一套代码通吃 PC、H5 和小程序
2026-05-12 12:12:44 +0800 CST
view 640
Lilishop是一个全开源的Java B2B2C多商户商城系统,基于SpringBoot+Vue+uni-app,一套代码通吃PC/H5/小程序/APP,支持多商家入驻、分销、秒杀拼团、Elasticsearch搜索、Docker部署。
Lilishop
Java商城
B2B2C
多商户
开源电商
uni-app
uni-app 也能实现全局 Toast?这套方案彻底搞定!
编程
uni-app 也能实现全局 Toast?这套方案彻底搞定!
2025-08-17 18:33:39 +0800 CST
view 1717
本文介绍了一种在uni-app中实现全局Toast的解决方案,解决了传统方法的局限性。通过wd-toast组件、Layout插件和Pinia状态管理,用户可以在任何地方调用Toast,支持网络请求失败提示、路由守卫提醒等功能。该方案还具备良好的扩展性,能够实现全局加载和弹窗等功能,提升用户体验。
uni-app
前端开发
用户体验
组件化
状态管理
Svelte 5 深度解析:Runes 革命与响应式编程的范式跃迁
编程
Svelte 5 深度解析:Runes 革命与响应式编程的范式跃迁
2026-05-12 14:11:40 +0800 CST
view 641
深度解析Svelte 5的重大革新:Runes响应式系统、//新语法、Snippets代码片段、TypeScript原生支持、性能提升33%。包含Runes系统深度解析、Svelte 4迁移指南、性能优化实战。
Svelte5
Runes系统
响应式编程
SvelteKit
Snippets
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
编程
把大模型装进机房:Ollama 本地推理工程化实战——量化、并发、缓存与生产部署一次讲透(2026)
2026-07-14 03:43:32 +0800 CST
view 230
深度拆解 Ollama 本地大模型推理工程化:从 GGUF 量化原理、MoE 专家调度、推理栈与 KV 缓存,到 Modelfile 定制、自量化、Python 客户端、FastAPI 生产服务、Docker 部署与性能调优,配完整可运行代码与 vLLM 对比。
Ollama
本地大模型
llama.cpp
GGUF量化
大模型部署
AI工程化
隐私计算
推理优化
Ollama 完全指南:本地大模型部署的事实标准——从原理到生产级 AI 应用开发(2026)
编程
Ollama 完全指南:本地大模型部署的事实标准——从原理到生产级 AI 应用开发(2026)
2026-06-05 04:13:34 +0800 CST
view 478
Ollama 本地大模型部署完全指南,从架构原理到生产级部署,涵盖 RAG 集成、性能优化、Docker/K8s 部署等核心内容。
Ollama
本地大模型
AI应用开发
Go语言
llama.cpp
Ollama 完全指南:本地大模型部署的事实标准——架构、实战与生产级部署(2026)
编程
Ollama 完全指南:本地大模型部署的事实标准——架构、实战与生产级部署(2026)
2026-06-05 04:13:52 +0800 CST
view 632
Ollama 本地大模型部署完全指南,从架构原理到生产级部署,涵盖 RAG 集成、性能优化、Docker/K8s 部署等核心内容。
Ollama
本地大模型
AI应用开发
Go语言
llama.cpp
资讯
定制开发一个App到底需要多少钱?
2024-11-19 01:06:47 +0800 CST
view 1909
定制开发App的成本受多种因素影响,包括功能复杂度、设计要求、开发团队、开发周期、测试与质量保证、维护与更新及市场推广。开发流程包括需求分析、UI/UX设计、开发、测试及上线审核。定制开发的优势在于精确满足需求、独特用户体验、性能优化、安全保障、易于维护和高投资回报。团队由营销专家、设计师和工程师组成,致力于提供优质服务。
App开发
定制开发
用户体验
市场推广
技术服务
Rust 1.95.0 深度实战:cfg_select!、原子更新与 Apple 全生态支持——从语言设计到工程落地的完整指南
编程
Rust 1.95.0 深度实战:cfg_select!、原子更新与 Apple 全生态支持——从语言设计到工程落地的完整指南
2026-04-23 19:41:03 +0800 CST
view 733
深度解析Rust 1.95.0:cfg_select!宏替代cfg-if、Atomic::update告别手写CAS、Apple全生态Tier2支持、core::range嵌入式闭区间、性能优化实战与完整迁移指南
Rust
Rust1.95
cfg_select
原子操作
Apple开发
无锁并发
嵌入式
no_std
Gemma 4 12B 深度实战:当 Google 把「无编码器多模态」塞进 16GB 笔记本——从统一架构原理到生产级本地 Agent 的完全指南(2026)
编程
Gemma 4 12B 深度实战:当 Google 把「无编码器多模态」塞进 16GB 笔记本——从统一架构原理到生产级本地 Agent 的完全指南(2026)
2026-06-14 04:46:45 +0800 CST
view 507
深度解析 Google DeepMind Gemma 4 12B 的无编码器统一多模态架构,从原理到代码实战,涵盖 llama.cpp 部署、量化策略、Agent 工作流和生产级架构设计(2026)。
Gemma 4
Google DeepMind
多模态
本地部署
Agent
llama.cpp
开源大模型
llama.cpp 架构深度拆解:从 GGML 到 GGUF、量化内核到跨平台推理栈,一文吃透本地 LLM 推理工程化
编程
llama.cpp 架构深度拆解:从 GGML 到 GGUF、量化内核到跨平台推理栈,一文吃透本地 LLM 推理工程化
2026-08-01 08:18:35 +0800 CST
view 133
深度拆解 llama.cpp 全栈架构:从 GGML 到 GGUF 格式演进、K-Quant 量化内核原理、ggml 张量计算图层、libllama 推理逻辑层、10+ 硬件后端调度,以及生产调优实战与踩坑清单。
llama.cpp
GGUF
GGML
量化
本地LLM
CPU推理
GPU加速
跨平台
K-Quant
HyperFrames 深度解析:HeyGen 开源的「HTML 写视频」革命——从 FrameAdapter 架构到 AI Agent 驱动的内容生产新范式
编程
HyperFrames 深度解析:HeyGen 开源的「HTML 写视频」革命——从 FrameAdapter 架构到 AI Agent 驱动的内容生产新范式
2026-05-19 00:47:13 +0800 CST
view 1050
HeyGen 开源的 HyperFrames 框架深度解析:HTML+GSAP 写视频的革命性技术,FrameAdapter 架构、Puppeteer 逐帧捕获、FFmpeg 编码、AI Agent 自动化生产完整指南,对比 Remotion 与生产级实战
HyperFrames
AI视频
GSAP
Puppeteer
FFmpeg
视频渲染
前端工具
HeyGen
AI Agent
自动化生产
html-ppt-skill:AI原生的HTML演示文稿技能,20天2600+Star
案例
html-ppt-skill:AI原生的HTML演示文稿技能,20天2600+Star
2026-05-06 17:02:28 +0800 CST
view 1468
20天2600+Star的神级skill!html-ppt-skill让AI帮你做PPT,输出纯HTML文件,零构建零依赖。36套主题、15套模板、31种布局、47个动效、像素级演讲者模式
AI PPT
HTML演示
Agent Skill
Claude Code
演示文稿
零依赖
演讲者模式
苹果 container 深度实战:41K Star 的原生容器工具,Apple Silicon 上的 Linux 容器新范式
编程
苹果 container 深度实战:41K Star 的原生容器工具,Apple Silicon 上的 Linux 容器新范式
2026-06-27 09:45:33 +0800 CST
view 500
苹果开源41K Star的Linux容器工具apple/container,深度解析per-container VM架构、Containerization Swift包、Virtualization.framework集成、多架构镜像构建与生产部署实战。
container
Apple Silicon
Swift
OCI
容器化
Docker
macOS
Virtualization framework
开源
多架构
腾讯混元开源 HyOCR-1.5 深度解读:端到端 OCR 的工程哲学与 DFlash 投机解码完全指南
编程
腾讯混元开源 HyOCR-1.5 深度解读:端到端 OCR 的工程哲学与 DFlash 投机解码完全指南
2026-07-21 12:46:56 +0800 CST
view 177
2026年7月腾讯混元开源HyOCR-1.5端到端OCR大模型,1B参数OmniDocBench 94.74分霸榜。深度拆解DFlash投机解码6.37倍加速、Agentic Data Flow自动化数据闭环、三阶段训练配方,以及vLLM/llama.cpp全场景部署实战。
HyOCR
HunyuanOCR
腾讯混元
端到端OCR
DFlash
投机解码
多模态模型
文档解析
文字识别
视觉语言模型
OmniDocBench
vLLM
llama.cpp
深度学习
UniApp H5跨域问题终极解决方案:两种代理配置方式详解
编程
UniApp H5跨域问题终极解决方案:两种代理配置方式详解
2025-09-01 20:46:27 +0800 CST
view 1822
本文介绍了在UniAppH5项目中解决跨域问题的两种方法:通过修改manifest.json文件和创建vue.config.js文件进行代理配置。详细说明了每种方法的配置步骤、参数解释及注意事项,并提供了请求封装的示例代码,帮助开发者提高代码的可维护性和复用性。
前端开发
UniApp
跨域问题
API
开发工具
Ollama 深度实战:当本地大模型成为生产级基础设施——从模型量化到高并发推理、从 REST API 到 Kubernetes 部署的完全指南(2026)
编程
Ollama 深度实战:当本地大模型成为生产级基础设施——从模型量化到高并发推理、从 REST API 到 Kubernetes 部署的完全指南(2026)
2026-06-20 01:25:22 +0800 CST
view 655
Ollama本地大模型生产级部署完全指南:从GGUF格式原理、INT4/INT8量化实战、REST API集成、多语言SDK(Python/Go/TypeScript)、GPU显存管理、Kubernetes+Helm生产部署、性能调优到RAG知识库构建,全流程深度实战。
Ollama
本地大模型
LLM部署
模型量化
GGUF
llama.cpp
REST API
Kubernetes
GPU
RAG
1.58-bit 大模型极限量化实战:从 BitNet 三值权重到单颗 CPU 跑起 100B 模型
编程
1.58-bit 大模型极限量化实战:从 BitNet 三值权重到单颗 CPU 跑起 100B 模型
2026-07-21 16:20:29 +0800 CST
view 188
2026极限量化实战:BitNet三值权重、absmean/absmax量化、BitLinear实现、带宽数学与bitnet.cpp内核优化,单CPU跑100B模型。
BitNet
1.58-bit
大模型量化
LLM
端侧推理
bitnet.cpp
Node.js 26 深度实战:当 TypeScript 第一次"裸奔"进 V8——Type Stripping 如何用"只擦除不转译"重写 Node 跑 TS 的心智模型
编程
Node.js 26 深度实战:当 TypeScript 第一次"裸奔"进 V8——Type Stripping 如何用"只擦除不转译"重写 Node 跑 TS 的心智模型
2026-07-15 06:42:33 +0800 CST
view 219
TypeScript 第一次无需编译直接跑进 V8:拆解 Node.js 26 Type Stripping 的"只擦除不转译"原理、能力边界(enum/namespace/装饰器为何报错)、与 tsx/ts-node/tsc 的取舍,附可运行代码与工程迁移实战。
Node.js 26
TypeScript
Type Stripping
原生 TS
类型擦除
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
3
4
5
6
...
33
下一页