程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
1.6万亿参数,1M上下文,仅需27%算力:DeepSeek-V4-Pro 如何重新定义长文本推理
编程
1.6万亿参数,1M上下文,仅需27%算力:DeepSeek-V4-Pro 如何重新定义长文本推理
2026-05-11 10:53:54 +0800 CST
view 743
DeepSeek-V4-Pro 以 1.6T 总参数、49B 激活参数的 MoE 架构,原生支持 100 万 token 上下文,同时将推理算力降至 V3.2 的 27%、KV Cache 降至 10%。本文深度解析 CSA/HCA 混合注意力机制、mHC 流形约束超连接、KV Cache 极致优化、Muon 优化器等核心技术创新,以及如何在 Ollama、vLLM、官方 API 三种方式下部署运行。
DeepSeek-V4,MoE架构,CSA注意力,HCA注意力,KV Cache,1M上下文,长文本推理,开源大模型
Supermemory 深度实战:AI 时代的记忆引擎完全指南——从混合检索到知识图谱的架构全解析(2026)
编程
Supermemory 深度实战:AI 时代的记忆引擎完全指南——从混合检索到知识图谱的架构全解析(2026)
2026-06-03 03:46:07 +0800 CST
view 837
Supermemory 深度实战:从混合检索到知识图谱的架构全解析。GitHub 24,537 ⭐,单日 677 stars,LongMemEval 85.2% SOTA。完整代码示例,生产级部署。
AI Agent
Supermemory
记忆引擎
RAG
知识图谱
TypeScript
生产实战
百度 Unlimited-OCR 深度解析:R-SWA 注意力机制如何用 3B 参数打爆百亿模型
编程
百度 Unlimited-OCR 深度解析:R-SWA 注意力机制如何用 3B 参数打爆百亿模型
2026-06-30 16:16:03 +0800 CST
view 314
2026年6月百度开源Unlimited-OCR深度解析:R-SWA参考滑动窗口注意力机制将KV Cache从线性增长压成常数,3B MoE模型用500M激活参数在OmniDocBench上以93.92%总分刷新SOTA,打爆Qwen3-VL 72B和Gemini 2.5 Pro。万字长文从架构原理到代码实战全覆盖。
Unlimited-OCR
端到端OCR
R-SWA
百度
注意力机制
大模型
MoE
深度学习
AI开源
文档解析
OpenClaw 深度解析:30万星开源 AI Agent 框架的技术内核——从 Gateway 到 Memory 的完整架构革命
编程
OpenClaw 深度解析:30万星开源 AI Agent 框架的技术内核——从 Gateway 到 Memory 的完整架构革命
2026-06-30 16:44:48 +0800 CST
view 297
2026年最火爆的开源项目,30万Star背后的技术密码。万字长文拆解Gateway、Agent、Skills、Memory四大核心模块,从架构原理到代码实战全覆盖。
OpenClaw
AI Agent
Gateway
Skills
Memory
开源框架
人工智能
本地优先
DwarfStar 4 深度拆解:当 Redis 之父决定「给 284B 大模型造一个专属引擎」——从 Metal GPU 到磁盘 KV 缓存,一个 10K Star 的极简推理栈如何用 One Model One Engine 哲学重新定义本地 AI 推理的终极形态
编程
DwarfStar 4 深度拆解:当 Redis 之父决定「给 284B 大模型造一个专属引擎」——从 Metal GPU 到磁盘 KV 缓存,一个 10K Star 的极简推理栈如何用 One Model One Engine 哲学重新定义本地 AI 推理的终极形态
2026-08-05 12:17:17 +0800 CST
view 181
深度拆解Redis创始人antirez打造的DeepSeek V4 Flash专用本地推理引擎DwarfStar 4:One Model One Engine哲学、非对称量化策略、磁盘KV缓存、双协议兼容层,附完整架构分析与性能基准
DwarfStar
DeepSeek
本地推理
MoE
Metal
Apple Silicon
antirez
Redis
AI推理
开源
MOSS-TTS-Nano:0.1B参数纯CPU实时语音生成与克隆,MacBook Air单核就能跑
编程
MOSS-TTS-Nano:0.1B参数纯CPU实时语音生成与克隆,MacBook Air单核就能跑
2026-04-20 22:53:28 +0800 CST
view 1614
复旦大学OpenMOSS团队开源的0.1B参数多语言TTS模型,纯CPU运行、支持零样本语音克隆、48kHz双声道、20种语言、流式推理,MacBook Air单核即可流畅运行
TTS
语音合成
语音克隆
AI
开源
CPU推理
OpenMOSS
Kimi K3 深度拆解:2.8 万亿参数开放权重,KDA 线性注意力与 896 专家稀疏路由如何撑起 100 万 token 上下文
编程
Kimi K3 深度拆解:2.8 万亿参数开放权重,KDA 线性注意力与 896 专家稀疏路由如何撑起 100 万 token 上下文
2026-07-30 05:44:46 +0800 CST
view 126
深度拆解月之暗面开源的 Kimi K3:2.8T 参数 Stable Latent MoE(896选16)、KDA 混合线性注意力、AttnRes 与 MXFP4 量化训练,附玩具级代码实现、1M 上下文整库审查实战与冷静的成本边界分析。
Kimi K3
开放权重
MoE
线性注意力
KDA
长上下文
大模型
MXFP4
AI Agent
开源
微信小程序开发资源汇总
编程
微信小程序开发资源汇总
2026-05-11 16:11:29 +0800 CST
view 702
本文档汇总了微信小程序开发的官方资源(设计指南、开发教程、框架、组件、API、开发者工具)以及丰富的第三方工具、插件、组件和后端SDK。
微信小程序
开发资源
前端框架
UI组件
Demo示例
工具插件
SmolVM 深度解析:冷启动 200ms 的微虚拟机如何用独立内核为 AI Agent 打造「用完即焚」的安全沙箱——从 libkrun 架构到生产级部署的完整实战指南
编程
SmolVM 深度解析:冷启动 200ms 的微虚拟机如何用独立内核为 AI Agent 打造「用完即焚」的安全沙箱——从 libkrun 架构到生产级部署的完整实战指南
2026-07-06 15:16:27 +0800 CST
view 315
深度解析SmolVM微虚拟机:基于libkrun的轻量VMM,冷启动<200ms,OCI镜像兼容,跨平台支持macOS/Linux/Windows。为AI Agent提供硬件级安全沙箱,比Docker隔离强、比QEMU快100倍。含完整架构分析、代码实战与生产部署指南。
SmolVM
microVM
libkrun
AI Agent
沙箱
虚拟化
Rust
容器
TypeScript 7.0 深度拆解:编译器 Go 重写——当最强类型系统遇上系统语言,一场改变前端工具链格局的工程豪赌
编程
TypeScript 7.0 深度拆解:编译器 Go 重写——当最强类型系统遇上系统语言,一场改变前端工具链格局的工程豪赌
2026-07-19 07:43:11 +0800 CST
view 299
2026年7月微软发布TypeScript 7.0,编译器核心从TypeScript/JavaScript移植到Go,实现8-12倍性能提升。本文深度拆解Go重写的技术架构、并行化策略、配置迁移与生态影响。
TypeScript
Go重写
编译器
前端工具链
并行化
类型系统
性能优化
monorepo
迁移指南
Qwen3.8-Max 深度拆解:当阿里决定「把 2.4 万亿参数的 Max 模型开源」——从 MoE 架构到 16 天自主编程,一个首次开源的旗舰大模型如何用「激活 95B 跑出 2.4T 效果」重新定义开源模型的终极形态
编程
Qwen3.8-Max 深度拆解:当阿里决定「把 2.4 万亿参数的 Max 模型开源」——从 MoE 架构到 16 天自主编程,一个首次开源的旗舰大模型如何用「激活 95B 跑出 2.4T 效果」重新定义开源模型的终极形态
2026-08-05 18:47:19 +0800 CST
view 141
深度拆解阿里Qwen3.8-Max:2.4万亿参数MoE旗舰,首次开源Max级权重,100万token上下文,16天自主编程oh-my-cli项目,Gated DeltaNet混合注意力架构,Arena全球第二,Apache 2.0完全可商用
Qwen3.8
Qwen
阿里
大模型
MoE
开源
人工智能
Apache 2.0
自主编程
oh-my-cli
万字深度解析百度 Unlimited OCR:当 R-SWA 遇见 MoE——3B 参数如何碾压端到端 OCR 全场(2026)
编程
万字深度解析百度 Unlimited OCR:当 R-SWA 遇见 MoE——3B 参数如何碾压端到端 OCR 全场(2026)
2026-07-01 03:42:17 +0800 CST
view 328
2026年6月百度开源Unlimited OCR,5天GitHub Star破万。深度解析R-SWA注意力机制、MoE架构、16倍视觉Token压缩,以及为何能将KV Cache从线性增长压成常数。
Unlimited OCR
OCR
R-SWA
MoE
百度
深度学习
计算机视觉
文档识别
KV Cache
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
编程
colibrì 深度拆解:当1300行纯C在25GB笔记本上跑起744B大模型——纯C运行时、MoE稀疏激活与智谱GLM-5.2的工程奇迹(2026)
2026-07-19 09:14:11 +0800 CST
view 1054
纯C语言实现的大模型推理引擎,仅用1300行代码在25GB内存笔记本上运行744B参数的GLM-5.2 MoE模型,含完整代码示例与技术解析
C语言
GLM-5.2
MoE
大模型推理
量化
AVX2
MLA注意力
推测解码
Apple Silicon
DeepSeek V4 Flash 深度拆解:当后训练决定「不改架构只改脑子」——从 DSA2 混合注意力到 98% 缓存命中,一个 13B 激活参数的轻量模型如何用「后训练革命」在 9 项 Agent 基准上全面超越自家 1.6 万亿旗舰预览版
编程
DeepSeek V4 Flash 深度拆解:当后训练决定「不改架构只改脑子」——从 DSA2 混合注意力到 98% 缓存命中,一个 13B 激活参数的轻量模型如何用「后训练革命」在 9 项 Agent 基准上全面超越自家 1.6 万亿旗舰预览版
2026-08-05 22:19:15 +0800 CST
view 172
深度拆解DeepSeek V4-Flash正式版:13B激活参数如何通过后训练革命在9项Agent基准上超越1.6万亿旗舰预览版,98%缓存命中实现/bin/zsh.03单任务成本,DSA2混合注意力架构全面解析
DeepSeek
V4-Flash
MoE
DSA2
Agent
开源大模型
稀疏注意力
后训练
成本优化
国产算力
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
编程
DiffusionGemma 深度实战:当谷歌用图像扩散的逻辑重塑文本生成——从离散扩散原理到 4 倍推理加速的生产级完全指南(2026)
2026-06-17 23:28:33 +0800 CST
view 594
2026年6月谷歌开源DiffusionGemma,26B MoE参数仅激活3.8B,通过离散扩散实现4倍推理加速。本文从原理、架构、代码实战、性能优化全面深度解析这一范式级创新。
DiffusionGemma
谷歌
文本扩散
MoE
AI推理
Gemma
开源模型
离散扩散
并行生成
深度学习
万字深度解析 DeepSeek V4:当 1.6 万亿参数遇见 DSA 稀疏注意力——开源大模型如何让 API 账单暴降 95%(2026)
编程
万字深度解析 DeepSeek V4:当 1.6 万亿参数遇见 DSA 稀疏注意力——开源大模型如何让 API 账单暴降 95%(2026)
2026-07-01 07:13:58 +0800 CST
view 426
2026年4月DeepSeek V4发布,1.6万亿参数+百万上下文+SWE-Bench 80.6%,API成本暴降95%。深度解析DSA稀疏注意力、MoE架构、生产级部署实战。
DeepSeek V4
DSA 稀疏注意力
MoE 架构
百万上下文
开源大模型
API 成本优化
大模型部署
Agent 能力
SWE-Bench
DeepSeek
从 KVCache 到 AI SSD:存储如何成为大模型推理的「第三层」
编程
从 KVCache 到 AI SSD:存储如何成为大模型推理的「第三层」
2026-08-14 13:16:01 +0800 CST
view 26
深度拆解 NVIDIA G3.5 与 CMX、Mooncake KVCache 分离式架构、AI SSD 三大技术路线(英韧 N3X、群联 aiDAPTIV、江波龙 SPU、寅谱-联芸),从 Prefill/Decode 数据路径到生产部署踩坑清单,配完整代码实战与 15 条生产级建议。
AI存储
KVCache
G3.5
CMX
Mooncake
NVIDIA
推理优化
SSD
NVMe
CXL
存储架构
AI基础设施
AI 推理的「存储升维」:NVIDIA G3.5 层、Mooncake 与四大 AI SSD 路线深度对比(2026)
编程
AI 推理的「存储升维」:NVIDIA G3.5 层、Mooncake 与四大 AI SSD 路线深度对比(2026)
2026-08-14 13:16:52 +0800 CST
view 31
深度拆解 NVIDIA G3.5 与 CMX、Mooncake KVCache 分离式架构、AI SSD 四大技术路线(英韧/群联/江波龙/寅谱联芸),从 Prefill/Decode 数据路径到生产部署踩坑清单。
AI存储
KVCache
G3.5
CMX
Mooncake
NVIDIA
推理优化
SSD
NVMe
CXL
存储架构
AI基础设施
TypeScript 7.0 深度拆解:微软用 Go 重写编译器,10倍性能飞跃背后的工程哲学
编程
TypeScript 7.0 深度拆解:微软用 Go 重写编译器,10倍性能飞跃背后的工程哲学
2026-07-19 13:13:22 +0800 CST
view 267
2026年7月微软正式发布TypeScript 7.0,深度拆解从TypeScript/JavaScript到Go语言的编译器全量移植:10倍性能提升的工程原理、共享内存并行架构、破坏性变更与完整迁移指南
TypeScript
TypeScript 7.0
Go语言
编译器
性能优化
共享内存
monorepo
微软
Token经济学重写存储格局:NVIDIA CMX/Mooncake 引领推理数据路径革命(2026实战)
编程
Token经济学重写存储格局:NVIDIA CMX/Mooncake 引领推理数据路径革命(2026实战)
2026-08-14 13:17:12 +0800 CST
view 31
从 Prefill/Decode 数据路径到生产部署,深度拆解 NVIDIA CMX G3.5 层、Mooncake KVCache 分离式架构与四大 AI SSD 路线。
AI存储
KVCache
CMX
Mooncake
NVIDIA
推理优化
SSD
NVMe
CXL
存储架构
AI基础设施
微软 TypeScript 7.0 正式发布:Go 重写、10 倍性能提升、编译器材料革命完整解析
编程
微软 TypeScript 7.0 正式发布:Go 重写、10 倍性能提升、编译器材料革命完整解析
2026-07-19 13:14:23 +0800 CST
view 321
2026年7月微软正式发布TypeScript 7.0,深度拆解从TypeScript到Go语言的编译器全量移植:10倍性能提升、共享内存并行架构、破坏性变更与完整迁移指南
TypeScript
TypeScript 7.0
Go语言
编译器重写
性能优化
共享内存
monorepo
微软
TypeScript 7.0 vs 6.0:破坏性变更、并行检查器与完整迁移路线图(2026)
编程
TypeScript 7.0 vs 6.0:破坏性变更、并行检查器与完整迁移路线图(2026)
2026-07-19 13:15:22 +0800 CST
view 277
TypeScript 7.0 完整迁移指南:从5.x到7.0的破坏性变更解析、并行检查器调优、monorepo构建优化与完整升级路线图
TypeScript 7.0
TypeScript 6.0
迁移指南
破坏性变更
并行检查器
构建优化
monorepo
Vite+ 深度解剖:从 Rolldown 到 Oxlint,尤雨溪的统一工具链革命
编程
Vite+ 深度解剖:从 Rolldown 到 Oxlint,尤雨溪的统一工具链革命
2026-07-25 07:16:09 +0800 CST
view 219
深度拆解 Vite+ 一体化工具链:Rolldown 统一打包器终结 esbuild+Rollup 双引擎时代、Oxlint 比 ESLint 快 50 倍、Oxc 类型检查快 10 倍、LightningCSS 快 100 倍,统一配置文件、内置 Monorepo 任务调度、从 Turbo/Webpack 迁移实战。
Vite
Rolldown
Oxlint
前端工具链
Rust
尤雨溪
VoidZero
构建工具
Monorepo
Kimi K2.6 开源:12小时连续编码,300个Agent并行,4000次工具调用
编程
Kimi K2.6 开源:12小时连续编码,300个Agent并行,4000次工具调用
2026-04-21 11:06:57 +0800 CST
view 811
Kimi K2.6 开源版发布:SWE-Bench Pro 58.6,多项榜单压GPT-5.4和Claude Opus 4.6,支持300个并行sub-agent、12小时持续编码、4000次工具调用,开源SOTA位置稳固
Kimi
K2.6
开源
SWE-Bench
Agent
Swarm
长程编码
AI编程
模型开源
HuggingFace
Moonshot
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
20
21
22
23
24
...
50
下一页