程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
Kimi K2.7 Code 完全指南:当 1 万亿参数 MoE 遇见编码 Agent——256K 上下文×thinking-token 暴降 30% 的生产级实战(2026)
编程
Kimi K2.7 Code 完全指南:当 1 万亿参数 MoE 遇见编码 Agent——256K 上下文×thinking-token 暴降 30% 的生产级实战(2026)
2026-06-17 08:28:57 +0800 CST
view 448
深度解析月之暗面Kimi K2.7 Code开源编程模型:1T MoE架构、256K超长上下文、thinking-token暴降30%的生产级完全指南。涵盖架构原理、API接入、本地部署、Agent集成、性能优化等全链路实战。
Kimi
K2.7
AI编程
MoE架构
长上下文
Agent
MiMo Code 深度实战:当小米杀入 AI 编程赛道——从 SQLite FTS5 持久记忆到子智能体编排、Max Mode 并行推理与 Compose 自进化工作流的生产级完全指南(2026)
编程
MiMo Code 深度实战:当小米杀入 AI 编程赛道——从 SQLite FTS5 持久记忆到子智能体编排、Max Mode 并行推理与 Compose 自进化工作流的生产级完全指南(2026)
2026-06-17 13:23:19 +0800 CST
view 638
深度拆解小米 MiMo Code V0.1.0 的架构设计、持久记忆系统、子智能体编排、Goal 裁判模型、Max Mode 并行推理与 Compose 工作流
AI编程
MiMo Code
小米
Coding Agent
开源项目
Kimi K3 深度拆解:2.8 万亿参数开放权重,KDA 线性注意力与 896 专家稀疏路由如何撑起 100 万 token 上下文
编程
Kimi K3 深度拆解:2.8 万亿参数开放权重,KDA 线性注意力与 896 专家稀疏路由如何撑起 100 万 token 上下文
2026-07-30 05:44:46 +0800 CST
view 69
深度拆解月之暗面开源的 Kimi K3:2.8T 参数 Stable Latent MoE(896选16)、KDA 混合线性注意力、AttnRes 与 MXFP4 量化训练,附玩具级代码实现、1M 上下文整库审查实战与冷静的成本边界分析。
Kimi K3
开放权重
MoE
线性注意力
KDA
长上下文
大模型
MXFP4
AI Agent
开源
LongCat-2.0 深度解析:美团万亿参数大模型如何用「零计算专家」和「稀疏注意力」在国产算力上跑出 SWE-bench Pro 59.5 分——从架构设计到 API 接入的完整实战指南
编程
LongCat-2.0 深度解析:美团万亿参数大模型如何用「零计算专家」和「稀疏注意力」在国产算力上跑出 SWE-bench Pro 59.5 分——从架构设计到 API 接入的完整实战指南
2026-07-06 11:44:38 +0800 CST
view 410
深度解析美团开源LongCat-2.0万亿参数大模型:MoE架构1.6T参数/48B激活、LongCat稀疏注意力(LSA)实现1M上下文、零计算专家动态激活、MOPD多专家融合、五万卡国产算力全流程训练、SWE-bench Pro 59.5超越GPT-5.5。含完整API接入代码实战。
LongCat
美团
大模型
MoE
稀疏注意力
国产算力
Agentic Coding
开源
SmolVM 深度解析:冷启动 200ms 的微虚拟机如何用独立内核为 AI Agent 打造「用完即焚」的安全沙箱——从 libkrun 架构到生产级部署的完整实战指南
编程
SmolVM 深度解析:冷启动 200ms 的微虚拟机如何用独立内核为 AI Agent 打造「用完即焚」的安全沙箱——从 libkrun 架构到生产级部署的完整实战指南
2026-07-06 15:16:27 +0800 CST
view 252
深度解析SmolVM微虚拟机:基于libkrun的轻量VMM,冷启动<200ms,OCI镜像兼容,跨平台支持macOS/Linux/Windows。为AI Agent提供硬件级安全沙箱,比Docker隔离强、比QEMU快100倍。含完整架构分析、代码实战与生产部署指南。
SmolVM
microVM
libkrun
AI Agent
沙箱
虚拟化
Rust
容器
万字深度解析 DeepSeek V4:当 1.6 万亿参数遇见 DSA 稀疏注意力——开源大模型如何让 API 账单暴降 95%(2026)
编程
万字深度解析 DeepSeek V4:当 1.6 万亿参数遇见 DSA 稀疏注意力——开源大模型如何让 API 账单暴降 95%(2026)
2026-07-01 07:13:58 +0800 CST
view 347
2026年4月DeepSeek V4发布,1.6万亿参数+百万上下文+SWE-Bench 80.6%,API成本暴降95%。深度解析DSA稀疏注意力、MoE架构、生产级部署实战。
DeepSeek V4
DSA 稀疏注意力
MoE 架构
百万上下文
开源大模型
API 成本优化
大模型部署
Agent 能力
SWE-Bench
DeepSeek
Kimi K2.6 开源:12小时连续编码,300个Agent并行,4000次工具调用
编程
Kimi K2.6 开源:12小时连续编码,300个Agent并行,4000次工具调用
2026-04-21 11:06:57 +0800 CST
view 771
Kimi K2.6 开源版发布:SWE-Bench Pro 58.6,多项榜单压GPT-5.4和Claude Opus 4.6,支持300个并行sub-agent、12小时持续编码、4000次工具调用,开源SOTA位置稳固
Kimi
K2.6
开源
SWE-Bench
Agent
Swarm
长程编码
AI编程
模型开源
HuggingFace
Moonshot
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
编程
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
2026-07-07 00:13:46 +0800 CST
view 256
深度解析美团开源的LongCat-2.0万亿参数MoE大模型:50K国产卡全流程训练、LSA稀疏注意力实现1M超长上下文、零计算专家动态激活33B-56B、MOPD多专家融合、SWE-bench Pro 59.5超越GPT-5.5。从架构原理到生产级实战的完整指南。
LongCat-2.0
美团
MoE
万亿参数
国产算力
LSA稀疏注意力
Agentic Coding
开源大模型
Redis 8.x AI 原生深度拆解:从缓存到 AI 实时数据基础设施——向量搜索、语义缓存、Agent Memory 工程实战
编程
Redis 8.x AI 原生深度拆解:从缓存到 AI 实时数据基础设施——向量搜索、语义缓存、Agent Memory 工程实战
2026-07-30 22:43:18 +0800 CST
view 78
深度拆解 Redis 8.x 的 AI 原生能力:Vector Sets 原生向量数据类型、HNSW/SVS-VAMANA 向量索引、LangCache 语义缓存、Agent Memory 智能体记忆层、完整 RAG Pipeline 实战,以及生产部署架构决策与渐进式采纳路线。万字长文,代码实战。
Redis
AI原生
向量搜索
语义缓存
Agent Memory
RAG
Spring AI
Vector Sets
HNSW
LangCache
世界模型深度解析:从预测下一个词到预测世界下一秒——NTP 到 NSP 的范式革命与生产级实战指南
编程
世界模型深度解析:从预测下一个词到预测世界下一秒——NTP 到 NSP 的范式革命与生产级实战指南
2026-07-07 02:12:36 +0800 CST
view 270
深度解析2026年最火爆的AI技术——世界模型:从Next Token Prediction到Next-State Prediction的范式革命。涵盖DreamerV3潜在空间动力学、Google Gemini Omni原生多模态世界模型、EvoPhys-World国产GPU训练突破,含完整PyTorch实战代码。
世界模型
World Model
NTP
NSP
Next-State Prediction
DreamerV3
Gemini Omni
PyTorch
AI
HarmonyOS 7 深度实战:当操作系统学会「思考」——从Agent亲和架构到HMAF 2.0智能体框架的生产级开发完全指南(2026)
编程
HarmonyOS 7 深度实战:当操作系统学会「思考」——从Agent亲和架构到HMAF 2.0智能体框架的生产级开发完全指南(2026)
2026-06-13 09:54:08 +0800 CST
view 744
深度拆解HarmonyOS 7 Agent亲和架构、HMAF 2.0智能体框架、A2A/A2UI协议、openPangu 2.0大模型,含完整开发实战代码与性能优化指南
HarmonyOS
鸿蒙
Agent
HMAF
A2A
A2UI
MCP
华为
智能体
从浏览器到云原生:WASM Component Model + WASI Preview 2 如何重塑 Universal Compute 范式
编程
从浏览器到云原生:WASM Component Model + WASI Preview 2 如何重塑 Universal Compute 范式
2026-07-31 08:14:48 +0800 CST
view 93
深度拆解 WASI Preview 2 核心 API(wasi:http、wasi:sockets、wasi:filesystem)与 Component Model 类型系统。Rust、C、Python 多语言 Wasm 组件实战,云原生 K8s 部署,Sidecar 模式,AI 推理集成。
WebAssembly
WASI Preview 2
Component Model
WasmEdge
云原生
Wasm运行时
Universal Compute
Rust
多语言互操作
MoonBit 深度拆解:为 AI Agent 打造的「类型安全 + GC + WASM」三合一编程语言——从张宏波的 ReScript 基因到云边端统一工具链
编程
MoonBit 深度拆解:为 AI Agent 打造的「类型安全 + GC + WASM」三合一编程语言——从张宏波的 ReScript 基因到云边端统一工具链
2026-07-31 09:17:26 +0800 CST
view 68
深度拆解 MoonBit 编程语言:为 AI Agent 打造的类型安全 + GC + WASM 三合一语言,从语言设计哲学、编译器架构、多后端编译、类型系统、GC 实现、WASM 优化、AI 集成到工具链生态的完整解析。
MoonBit
编程语言
WebAssembly
AI Agent
类型系统
GC
编译器
Rust
云原生
边缘计算
WASI 0.3.0 正式发布:WebAssembly 的"Docker 时刻"终于降临——从 async 原生到 serverless 革命
编程
WASI 0.3.0 正式发布:WebAssembly 的"Docker 时刻"终于降临——从 async 原生到 serverless 革命
2026-07-25 18:14:44 +0800 CST
view 141
2026年3月WASI 0.3.0正式发布,WebAssembly async原生架构彻底改变serverless和边缘计算。深入解析Component Model、WIT接口、流式处理与跨语言互操作
WebAssembly
WASI
Wasm
serverless
edge computing
云原生
Component Model
腾讯混元 Hy3 正式版深度解析:快慢思考融合的 MoE 架构与开发者实战指南
编程
腾讯混元 Hy3 正式版深度解析:快慢思考融合的 MoE 架构与开发者实战指南
2026-07-07 14:15:18 +0800 CST
view 472
深度解析腾讯混元 Hy3 正式版的技术架构,涵盖 MoE 混合专家、快慢思考融合机制、256K 上下文、Agent 能力等核心特性,并提供 API 调用与 SDK 集成的完整实战指南。
MoE架构
快慢思考
腾讯混元
Hy3
AI大模型
混合专家
Agent
开发者工具
MiMo Code 深度实战:当小米用 1 万亿参数杀入 AI 编程 Agent 赛道——从持久记忆到 Max Mode、从四层记忆体系到动态工作流的生产级完全指南(2026)
编程
MiMo Code 深度实战:当小米用 1 万亿参数杀入 AI 编程 Agent 赛道——从持久记忆到 Max Mode、从四层记忆体系到动态工作流的生产级完全指南(2026)
2026-06-19 01:25:01 +0800 CST
view 646
2026年6月小米正式开源MiMo Code V0.1.0,一款面向终端的AI编程助手。本文深度解析其架构设计:计算层Max Mode多采样机制、记忆层四层持久记忆体系、进化层Dream/Distill模式,以及与Claude Code的深度对比评测。
AI编程
MiMo Code
小米
Agent
长程任务
编程助手
腾讯混元 Hy3 preview 开源:295B 参数、推理提效 40%,姚顺雨首秀交卷
资讯
腾讯混元 Hy3 preview 开源:295B 参数、推理提效 40%,姚顺雨首秀交卷
2026-04-23 21:18:45 +0800 CST
view 894
2026年4月23日,腾讯发布并开源新一代大模型混元Hy3preview,总参数295B、激活参数21B的MoE架构,支持256K超长上下文,推理效率提升40%,API最低1.2元/百万tokens。在复杂推理、代码与Agent能力上表现突出,接近GPT-5.4级别,数学推理创国内最高纪录。已接入腾讯云、元宝等多条产品线,并上架TokenHub。
人工智能
大模型
腾讯
开源
MoE
推理
代码生成
Agent
云计算
开源 Grok Build 深度拆解:当 xAI 把「隐私门」变成开源礼——从 Rust 微内核架构、Agent 循环到本地优先运行的完整工程指南(2026)
编程
开源 Grok Build 深度拆解:当 xAI 把「隐私门」变成开源礼——从 Rust 微内核架构、Agent 循环到本地优先运行的完整工程指南(2026)
2026-07-21 10:14:59 +0800 CST
view 242
2026年7月15日xAI开源Grok Build完整源代码。本文深度拆解其Rust微内核架构、Agent循环机制、扩展系统与本地优先运行配置,提供完整工程指南。
Rust
Grok Build
xAI
AI编程
Agent
开源
隐私
CLI
TUI
Plan Mode
DwarfStar 深度解析:antirez 的 DeepSeek V4 Flash 本地推理引擎——Metal 与 CUDA 双轨优化革命(2026 完全指南)
编程
DwarfStar 深度解析:antirez 的 DeepSeek V4 Flash 本地推理引擎——Metal 与 CUDA 双轨优化革命(2026 完全指南)
2026-05-28 19:13:18 +0800 CST
view 566
DwarfStar(ds4)是Redis创始人antirez开发的DeepSeek V4 Flash专用推理引擎,支持Metal与CUDA双轨优化、磁盘KV Cache、imatrix量化和原生Agent集成。本文深入解析其架构设计与性能表现。
DeepSeek
ds4
Metal
CUDA
本地推理
MoE
量化
GGUF
Agent
Python
C
Serverless WebAssembly 深度实战:当 Wasm 从浏览器走进生产服务器——WASM Component Model、边缘计算与 AI 推理的下一站(2026)
编程
Serverless WebAssembly 深度实战:当 Wasm 从浏览器走进生产服务器——WASM Component Model、边缘计算与 AI 推理的下一站(2026)
2026-06-14 14:19:12 +0800 CST
view 529
服务端 WebAssembly 2026 年最新进展:深入解析 WASM Component Model、边缘计算、AI 推理落地、WASI 2.0 接口与性能优化实战,从零构建完整的 WASM 服务端项目。
WebAssembly
WASM
WasmEdge
Serverless
边缘计算
Component Model
WASI
AI推理
云原生
性能优化
深入解析 codebase-memory-mcp:让 AI 编程助手真正「看懂」代码库
编程
深入解析 codebase-memory-mcp:让 AI 编程助手真正「看懂」代码库
2026-07-26 09:44:32 +0800 CST
view 205
深入解析 GitHub 10K+ Stars 的 codebase-memory-mcp 项目:用 tree-sitter + 知识图谱为 AI 编程助手构建持久化代码记忆,让 Claude Code、Cursor 等工具真正「看懂」代码库结构。
AI编程助手
codebase-memory-mcp
MCP
代码知识图谱
AI Agent
tree-sitter
MemPalace 深度实战:当 AI Agent 学会「永久记忆」——从三层宫殿架构到 96.6% 召回率的工程完全指南(2026)
编程
MemPalace 深度实战:当 AI Agent 学会「永久记忆」——从三层宫殿架构到 96.6% 召回率的工程完全指南(2026)
2026-06-14 20:20:25 +0800 CST
view 346
MemPalace 深度实战:全量原文存储的 AI 记忆系统,96.6% LongMemEval 召回率,零 API 依赖。从三层宫殿架构到四层记忆栈,29 个 MCP 工具完整解析,性能优化从 3 秒到 50ms。
AI Agent
Memory System
MemPalace
MCP
Claude Code
ChromaDB
Vector Search
GLM-5.2 深度解析:百万上下文 + 异步Agent RL + MIT开源,国产大模型里程碑级突破
编程
GLM-5.2 深度解析:百万上下文 + 异步Agent RL + MIT开源,国产大模型里程碑级突破
2026-06-27 18:46:30 +0800 CST
view 975
智谱AI发布GLM-5.2旗舰开源大模型:744B MoE架构+40B激活参数、1M百万Token稳定上下文、异步Agent RL训练、IndexShare稀疏注意力将计算量降低2.9倍。SWE-bench Pro编程能力超越GPT-5.5,MIT协议完全开源。本文深度解析其技术架构、训练方法、性能评测与生产实践。
GLM-5.2
Z.ai
开源大模型
MoE
异步Agent RL
百万上下文
MIT协议
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 539
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
5
6
7
8
9
...
89
下一页