程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
MoonBit 深度解析:为 AI 智能体而生的下一代编程语言
编程
MoonBit 深度解析:为 AI 智能体而生的下一代编程语言
2026-07-26 15:46:30 +0800 CST
view 159
深度解析 MoonBit:IDEA 研究院出品的 AI 原生编程语言,涵盖类型系统、编译器架构、多目标编译(WebAssembly/JavaScript/Native)、工具链生态,以及 AI Agent 开发的实战代码示例。
MoonBit
AI原生编程语言
WebAssembly
多目标编译
类型系统
GLM-5.2 深度解析:百万上下文 + 异步Agent RL + MIT开源,国产大模型里程碑级突破
编程
GLM-5.2 深度解析:百万上下文 + 异步Agent RL + MIT开源,国产大模型里程碑级突破
2026-06-27 18:46:30 +0800 CST
view 1119
智谱AI发布GLM-5.2旗舰开源大模型:744B MoE架构+40B激活参数、1M百万Token稳定上下文、异步Agent RL训练、IndexShare稀疏注意力将计算量降低2.9倍。SWE-bench Pro编程能力超越GPT-5.5,MIT协议完全开源。本文深度解析其技术架构、训练方法、性能评测与生产实践。
GLM-5.2
Z.ai
开源大模型
MoE
异步Agent RL
百万上下文
MIT协议
DeepSeek-V4 深度解析:百万Token上下文与MoE架构的技术革命
编程
DeepSeek-V4 深度解析:百万Token上下文与MoE架构的技术革命
2026-04-26 08:10:21 +0800 CST
view 854
深度解析DeepSeek-V4的技术突破:百万Token原生上下文、万亿级MoE架构、国产芯片适配。从技术原理到工程实践,全面剖析这场开源AI的革命。
DeepSeek
大模型
MoE
百万上下文
开源AI
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
编程
ds4 (DwarfStar) 深度实战:当 Redis 之父学会「大模型量化」——从非对称 2-bit 量化到磁盘 KV 缓存的生产级完全指南(2026)
2026-06-15 00:18:14 +0800 CST
view 757
深度剖析 Redis 之父 antirez 的最新项目 ds4 (DwarfStar),专为 DeepSeek V4 Flash 设计的本地推理引擎。涵盖非对称 2-bit 量化、磁盘 KV 缓存、Metal/CUDA 优化、内置 Coding Agent 等核心技术。
ds4
DwarfStar
antirez
Redis
大模型推理
MoE架构
量化
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
编程
DeepSeek V4 架构全拆解:MLA 压缩、MoE 动态路由与 1.6T 参数的工程哲学——从训练到推理的全栈重构
2026-08-03 00:13:26 +0800 CST
view 167
深度拆解 DeepSeek V4 四大核心架构创新:MLA 16x KV Cache 压缩、MoE-Routing v2 Token级动态路由、HAAA混合注意力、antirez ds4.c推理引擎,附完整代码示例与生产部署指南
DeepSeek
MoE
MLA
KV Cache
大模型
AI推理
开源
性能优化
混合注意力
量化
Kimi K2 系列深度实战:月之暗面开源编码大模型架构解析与生产级部署完全指南
编程
Kimi K2 系列深度实战:月之暗面开源编码大模型架构解析与生产级部署完全指南
2026-06-28 03:15:43 +0800 CST
view 611
深度解析月之暗面Kimi K2系列(K2.5/K2.6/K2.7 Code)的MoE架构、多模态能力、Token优化策略,附Ollama本地部署、OpenRouter API集成、OpenCode实战及Agent工作流完整代码。
Kimi K2
月之暗面
MoE架构
编码大模型
AI编程
Token优化
本地部署
OpenRouter
多模态
Agent工作流
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
编程
当 Redis 之父遇上 DeepSeek V4 Flash:ds4.c 如何用 900 行代码重写本地大模型推理
2026-07-15 18:15:32 +0800 CST
view 295
Redis创始人antirez开源ds4.c:用C语言+Metal GPU手写DeepSeek V4 Flash推理引擎,26 tok/s性能,2-bit MoE量化,KV缓存磁盘分层管理
ds4.c
DeepSeek V4 Flash
Metal推理
Redis之父
MoE量化
KV缓存分层
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
编程
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
2026-06-28 06:43:54 +0800 CST
view 572
百度2026年6月开源Unlimited OCR:30亿参数仅激活5亿,R-SWA注意力把KV Cache压成常数,一次前向推理处理几十页文档,OmniDocBench v1.6得分93.92%刷新SOTA。
百度 Unlimited OCR
OCR
R-SWA
长文档
端到端
MoE
SGLang
Biome 深度拆解:一个 Rust 工具链如何终结 JavaScript 十年之痛——从 Rome 遗产到 500 条 Lint 规则的架构哲学
编程
Biome 深度拆解:一个 Rust 工具链如何终结 JavaScript 十年之痛——从 Rome 遗产到 500 条 Lint 规则的架构哲学
2026-08-03 04:12:16 +0800 CST
view 124
深度拆解Biome Rust工具链架构:CST具体语法树与Green/Red Tree零拷贝设计、增量格式化算法、500条Lint规则分层架构、不依赖TypeScript编译器的类型推断引擎、跨文件模块图分析、GritQL插件系统,附完整代码示例与ESLint+Prettier迁移实战
Biome
Rust
JavaScript
前端工具链
ESLint
Prettier
代码格式化
Lint
类型推断
CST
Rome
GritQL
Monorepo
Web开发
GLM-5.2 深度实战:当开源编程模型首次摸到 Opus 4.8 的天花板——从 753B MoE 架构到 1M 无损上下文、从 DSA 稀疏注意力到国产算力 Day-0 部署的生产级完全指南(2026)
编程
GLM-5.2 深度实战:当开源编程模型首次摸到 Opus 4.8 的天花板——从 753B MoE 架构到 1M 无损上下文、从 DSA 稀疏注意力到国产算力 Day-0 部署的生产级完全指南(2026)
2026-06-20 15:52:19 +0800 CST
view 1017
GLM-5.2 开源深度解析:753B MoE 架构、1M 无损上下文、DSA 稀疏注意力、生产级部署完全指南
AI
开源模型
GLM
智谱
编程工具
MoE
大模型
Qwen3.8深度拆解:2.4万亿参数稀疏MoE架构的技术革命,从模型设计到开源落地的全链路复盘
编程
Qwen3.8深度拆解:2.4万亿参数稀疏MoE架构的技术革命,从模型设计到开源落地的全链路复盘
2026-08-11 10:55:36 +0800 CST
view 17
深度拆解阿里Qwen3.8的2.4万亿参数稀疏MoE架构:专家池设计、负载均衡、混合注意力机制、100万Token上下文、编程能力突破、开源生态影响与生产部署指南
Qwen3.8
大模型
MoE架构
稀疏激活
开源AI
千问
AI编程
深度学习
Transformer
Kimi K2.6开源:13小时编码与300子Agent集群,国产大模型抢滩长程编程高地
编程
Kimi K2.6开源:13小时编码与300子Agent集群,国产大模型抢滩长程编程高地
2026-04-27 14:52:59 +0800 CST
view 865
深度解析月之暗面开源的Kimi K2.6模型:13小时不间断编码、300子Agent集群协作、5天自主运行的技术架构与实测案例分析
Kimi K2.6
开源模型
长程编程
AI Agent
国产大模型
Moonshot AI
Agent集群
编程助手
DeepSeek V4 深度解析:DSA 稀疏注意力与 mHC 流形约束——百万上下文普惠化的技术革命(2026)
编程
DeepSeek V4 深度解析:DSA 稀疏注意力与 mHC 流形约束——百万上下文普惠化的技术革命(2026)
2026-07-04 06:44:28 +0800 CST
view 336
2026年4月DeepSeek V4发布,开创百万上下文普惠化时代。深度解析DSA稀疏注意力、mHC流形约束、Muon优化器三大技术创新,含完整代码实战与部署指南。
DeepSeek V4
大模型
MoE
稀疏注意力
长上下文
DSA
mHC
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 589
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
TypeScript 7.0 深度拆解:当微软决定用 Go 语言重写编译器——14年最大架构变革全链路解析
编程
TypeScript 7.0 深度拆解:当微软决定用 Go 语言重写编译器——14年最大架构变革全链路解析
2026-08-11 14:58:02 +0800 CST
view 8
2026年7月微软发布TypeScript 7.0,编译器核心从JavaScript移植到Go,性能提升8~12倍。本文深度解析tsgo架构设计、Go语言选择理由、并行类型检查、共享内存模型、语言服务重构与生产迁移策略。
TypeScript
TypeScript 7
Go语言
编译器
性能优化
前端工具链
tsgo
Go重写
语言服务
monorepo
6G通感算智融合架构深度解析:当通信基站进化为「超级智能体」——从协议栈到底层原理的完全指南(2026)
编程
6G通感算智融合架构深度解析:当通信基站进化为「超级智能体」——从协议栈到底层原理的完全指南(2026)
2026-06-09 19:51:27 +0800 CST
view 728
深度解析6G通感算智融合架构:太赫兹通信、通感一体化ISAC、天地一体组网、算力网络协同。含代码示例和架构分析。
6G
通信技术
通感算智融合
ISAC
太赫兹
天地一体
边缘计算
网络架构
低轨卫星
MIMO
Remotion 深度拆解:当 React 决定「吞噬」视频制作——从 DOM 即胶片到逐帧截图的范式革命,一个 30K Star 框架如何让程序员用代码造视频
编程
Remotion 深度拆解:当 React 决定「吞噬」视频制作——从 DOM 即胶片到逐帧截图的范式革命,一个 30K Star 框架如何让程序员用代码造视频
2026-08-03 13:43:51 +0800 CST
view 154
深度拆解Remotion四大核心架构:时间帧驱动模型、React渲染引擎、逐帧截图管线、Lambda分布式渲染,附完整数据可视化视频代码示例与性能优化实战指南
Remotion
React
视频生成
程序化视频
TypeScript
FFmpeg
Lambda
前端开发
视频制作
开源
4万Star的AI Agent底层框架pi-mono:OpenClaw的发动机,用4个工具做到了极致
编程
4万Star的AI Agent底层框架pi-mono:OpenClaw的发动机,用4个工具做到了极致
2026-04-27 21:05:47 +0800 CST
view 1046
pi-mono是一个4万Star的TypeScript单仓项目,专门用来构建AI Agent和管理LLM部署。OpenClaw的核心运行时就是基于Pi的SDK构建的。核心只有4个工具,系统提示词不到1000个token,通过7个独立npm包实现模块化架构。
Agent框架
开源项目
AI编程
GitHub
pi-mono
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
编程
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
2026-08-03 17:14:27 +0800 CST
view 368
深度拆解Qwen3.8-Max 2.4万亿参数MoE大模型架构:稀疏混合专家路由机制、混合注意力1M上下文、GQA KV Cache优化、量化部署实战、vLLM推理优化,附完整代码示例与性能基准分析
Qwen3.8
MoE
大模型
阿里巴巴
通义千问
混合专家
1M上下文
稀疏注意力
量化部署
vLLM
开源
WorldMonitor 深度拆解:75K Stars 的「全球态势感知仪表板」,凭什么把 500+ 信源、56 种地图图层和本地 AI 塞进一个浏览器标签页
编程
WorldMonitor 深度拆解:75K Stars 的「全球态势感知仪表板」,凭什么把 500+ 信源、56 种地图图层和本地 AI 塞进一个浏览器标签页
2026-07-27 19:15:02 +0800 CST
view 262
深度拆解 75K Stars 开源项目 WorldMonitor:500+ 信源聚合、双地图引擎、284 个 Protobuf 合约、CII 国家不稳定指数、三级缓存与 60+ Edge Functions,以及 MCP/SDK/llms.txt 构成的 Agent-native 完整范本。
WorldMonitor
OSINT
deck.gl
MCP
Protobuf
Tauri
Edge Functions
开源
态势感知
AI Agent
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
编程
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
2026-04-09 00:53:51 +0800 CST
view 1486
2026年4月8日智谱发布GLM-5.1,744B参数MIT开源,SWE-bench Pro 58.4分超越Claude Opus 4.6,全球首个支持8小时长程自治的开源模型。
GLM-5.1
智谱AI
开源大模型
MoE
SWE-bench
长程自治
LLM
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
编程
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
2026-08-03 19:12:41 +0800 CST
view 170
深度拆解DeepSeek V4-Flash 284B MoE架构:CSA+HCA混合压缩注意力机制让1M上下文KV Cache降至V3.2的7%,Muon优化器替代AdamW,Agent能力跃迁至Terminal Bench 82.7分,13B激活参数推理成本仅0.88元/530万token,附完整部署代码与性能优化实战指南
DeepSeek
V4-Flash
MoE
CSA
HCA
Muon优化器
Agent
大模型
开源
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
编程
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
2026-04-28 08:19:25 +0800 CST
view 717
深度解析 DeepSeek V4:混合注意力机制、MoE 架构、100万token 上下文、Agent 能力,从技术原理到部署实战,全面剖析开源模型新天花板
DeepSeek
AI大模型
开源
长上下文
MoE
混合注意力
Agent
小米 MiMo UltraSpeed 深度解析:当 SWA 架构重塑 LLM 推理——从 O(n²) 困境到 1000 tokens/s 的极致跨越
编程
小米 MiMo UltraSpeed 深度解析:当 SWA 架构重塑 LLM 推理——从 O(n²) 困境到 1000 tokens/s 的极致跨越
2026-06-15 21:20:49 +0800 CST
view 307
深入解析小米MiMo UltraSpeed如何通过SWA架构在通用GPU上突破1000 tokens/s推理速度,从O(n²)困境到极致跨越的完整技术指南。
SWA
Sliding Window Attention
LLM推理
小米MiMo
推理优化
Transformer
PagedAttention
量化推理
端侧AI
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
22
23
24
25
26
...
71
下一页