程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
LongCat-2.0 深度解析:美团万亿参数大模型如何用「零计算专家」和「稀疏注意力」在国产算力上跑出 SWE-bench Pro 59.5 分——从架构设计到 API 接入的完整实战指南
编程
LongCat-2.0 深度解析:美团万亿参数大模型如何用「零计算专家」和「稀疏注意力」在国产算力上跑出 SWE-bench Pro 59.5 分——从架构设计到 API 接入的完整实战指南
2026-07-06 11:44:38 +0800 CST
view 516
深度解析美团开源LongCat-2.0万亿参数大模型:MoE架构1.6T参数/48B激活、LongCat稀疏注意力(LSA)实现1M上下文、零计算专家动态激活、MOPD多专家融合、五万卡国产算力全流程训练、SWE-bench Pro 59.5超越GPT-5.5。含完整API接入代码实战。
LongCat
美团
大模型
MoE
稀疏注意力
国产算力
Agentic Coding
开源
DeepSeek V4 Flash 深度拆解:当后训练决定「不改架构只改脑子」——从 DSA2 混合注意力到 98% 缓存命中,一个 13B 激活参数的轻量模型如何用「后训练革命」在 9 项 Agent 基准上全面超越自家 1.6 万亿旗舰预览版
编程
DeepSeek V4 Flash 深度拆解:当后训练决定「不改架构只改脑子」——从 DSA2 混合注意力到 98% 缓存命中,一个 13B 激活参数的轻量模型如何用「后训练革命」在 9 项 Agent 基准上全面超越自家 1.6 万亿旗舰预览版
2026-08-05 22:19:15 +0800 CST
view 205
深度拆解DeepSeek V4-Flash正式版:13B激活参数如何通过后训练革命在9项Agent基准上超越1.6万亿旗舰预览版,98%缓存命中实现/bin/zsh.03单任务成本,DSA2混合注意力架构全面解析
DeepSeek
V4-Flash
MoE
DSA2
Agent
开源大模型
稀疏注意力
后训练
成本优化
国产算力
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
编程
LongCat-2.0 深度解析:美团万亿参数 MoE 大模型如何用国产算力 + LSA 稀疏注意力 + 零计算专家打造 Agentic Coding 王者——从架构原理到生产级实战的完整指南
2026-07-07 00:13:46 +0800 CST
view 345
深度解析美团开源的LongCat-2.0万亿参数MoE大模型:50K国产卡全流程训练、LSA稀疏注意力实现1M超长上下文、零计算专家动态激活33B-56B、MOPD多专家融合、SWE-bench Pro 59.5超越GPT-5.5。从架构原理到生产级实战的完整指南。
LongCat-2.0
美团
MoE
万亿参数
国产算力
LSA稀疏注意力
Agentic Coding
开源大模型
美团 LongCat-2.0 深度解析:1.6 万亿参数 MoE 大模型如何在五万卡国产算力上跑通全流程——从 LSA 稀疏注意力到 MOPD 多类型专家架构的完整技术剖析
编程
美团 LongCat-2.0 深度解析:1.6 万亿参数 MoE 大模型如何在五万卡国产算力上跑通全流程——从 LSA 稀疏注意力到 MOPD 多类型专家架构的完整技术剖析
2026-07-07 10:14:22 +0800 CST
view 346
深度解析美团LongCat-2.0万亿参数MoE大模型:1.6T总参数/48B激活、LSA稀疏注意力实现1M原生上下文、N-gram Embedding 135B参数强化代码理解、MOPD三类专家动态调度、五万卡国产算力全流程训练。SWE-bench Pro 59.5超GPT-5.5,从架构原理到生产级实战的完整技术剖析。
LongCat-2.0
美团
MoE
大模型
国产算力
LSA
稀疏注意力
N-gram Embedding
MOPD
开源
CLEAR 深度实战:当浙大+腾讯+北大联手破解AI推理「算力浪费」难题——从理性放弃机制到生产级LLM推理优化完全指南(2026)
编程
CLEAR 深度实战:当浙大+腾讯+北大联手破解AI推理「算力浪费」难题——从理性放弃机制到生产级LLM推理优化完全指南(2026)
2026-06-12 14:20:52 +0800 CST
view 657
深度解析 ICML 2026 接收的 CLEAR 推理优化方法。浙江大学、腾讯、北京大学联合提出:对没有希望的问题理性放弃,把算力集中到能解决的问题上。包含完整 Python 实现、vLLM/SGLang 集成、生产级部署指南。
LLM
推理优化
ICML 2026
CLEAR
算力分配
GitHub Copilot 暂停新用户注册背后:AI Agent 算力危机与编程范式重构
编程
GitHub Copilot 暂停新用户注册背后:AI Agent 算力危机与编程范式重构
2026-04-23 13:42:10 +0800 CST
view 871
深度分析 GitHub Copilot 暂停新用户注册背后的算力危机:AI Agent 如何重塑计算经济学、定价模型的结构性缺陷、技术优化路径与商业模式重构方向。
AI
Copilot
GitHub
Agent
算力
万字深度解析 HAMi:当 KubeCon EU 2026 把 GPU 调度器推向云原生 AI 基础设施舞台中央——从异构算力虚拟化到 K8s 生产级部署的完整技术指南(2026)
编程
万字深度解析 HAMi:当 KubeCon EU 2026 把 GPU 调度器推向云原生 AI 基础设施舞台中央——从异构算力虚拟化到 K8s 生产级部署的完整技术指南(2026)
2026-07-02 17:16:43 +0800 CST
view 628
深度解析 HAMi 项目在 KubeCon EU 2026 的亮相,涵盖异构算力虚拟化原理、K8s 生产部署实践、性能优化与监控体系
HAMi
GPU调度
Kubernetes
云原生
AI基础设施
KubeCon
异构算力
NPU
CNCF
vGPU
量智融合时代降临:AI与量子计算如何突破算力天花板
编程
量智融合时代降临:AI与量子计算如何突破算力天花板
2026-04-24 13:50:54 +0800 CST
view 671
深入解析2026年量智融合技术革命,从算力危机本质到量子计算原理,从AI赋能量子到量子赋能AI的双向路径,深度剖析量智开物的追风与扁鹊算法,探讨开发者如何进入这一前沿领域
量子计算
人工智能
AI量子融合
算力
量子纠错
CPO/NPO 光互联革命:AI 算力基础设施的「最后一公里」博弈
编程
CPO/NPO 光互联革命:AI 算力基础设施的「最后一公里」博弈
2026-04-17 13:47:50 +0800 CST
view 817
深度解析2026年AI算力基础设施的光互联技术革命,对比CPO与NPO两条技术路线,分析产业格局与程序员视角下的影响
AI算力
CPO
NPO
光互联
数据中心
光模块
OpenAI Astra 深度拆解:2000 美元破解十年数学悬案——多智能体长时程协作架构如何重新定义「AI 做科研」
编程
OpenAI Astra 深度拆解:2000 美元破解十年数学悬案——多智能体长时程协作架构如何重新定义「AI 做科研」
2026-08-03 23:14:51 +0800 CST
view 251
深度拆解OpenAI Astra下一代模型架构:多智能体长时程协作、10项数学突破Lean 4形式化验证、2000美元算力成本的完整工程分析
OpenAI
Astra
多智能体
数学证明
Lean 4
形式化验证
GPT-6
长时程Agent
算力成本
开源
Kimi K3 深度拆解:2.8 万亿参数、前端代码全球第一,国产大模型凭什么在「算力内卷」时代杀出重围
编程
Kimi K3 深度拆解:2.8 万亿参数、前端代码全球第一,国产大模型凭什么在「算力内卷」时代杀出重围
2026-07-28 07:17:15 +0800 CST
view 327
深度拆解月之暗面 Kimi K3:2.8万亿参数MoE架构、前端代码全球第一、100万token长上下文,KDA混合线性注意力+AttnRes残差+Mooncake分离式推理三大技术创新,附完整API接入实战与生产落地指南。
Kimi K3
大模型
MoE
KDA
长上下文
前端代码
开源
国产AI
月之暗面
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
编程
MusaCoder 深度实战:当国产GPU遇见AI驱动的Kernel生成——从PyTorch到CUDA/MUSA原生算子的全栈训练完全指南(2026)
2026-06-16 06:47:47 +0800 CST
view 496
MusaCoder是首个基于国产GPU完成全链路训练的代码大模型,在KernelBench上超越Claude Opus 4.7。从三阶段数据合成、多样性RFT到执行反馈RL,深度解析全栈训练方法论。
MusaCoder
GPU Kernel
摩尔线程
国产GPU
CUDA
MUSA
大模型
强化学习
KernelBench
代码大模型
AI Coding
深度学习
DeepSeek 专家模式深度解析:当低调更新成为AGI赛道的产品哲学宣言
编程
DeepSeek 专家模式深度解析:当低调更新成为AGI赛道的产品哲学宣言
2026-04-09 10:23:56 +0800 CST
view 925
2026年4月8日,DeepSeek悄然上线「专家模式」,无发布会无公告,却被业内视为V4发布前最有分量的产品预告。本文深度拆解双模式技术架构差异,实测数理推理、专业编程、创意写作三大场景,并解读这一低调更新背后的产品哲学与行业信号。
DeepSeek
AI大模型
V4
专家模式
推理模型
产品设计
国产AI
场景分层
DeepSeek V4 专家模式深度解析:当国产大模型终于学会「分场景思考」
编程
DeepSeek V4 专家模式深度解析:当国产大模型终于学会「分场景思考」
2026-04-10 07:21:56 +0800 CST
view 906
DeepSeek V4专家模式深度解析:双模式架构、LTM长期记忆技术、6710亿参数、场景分层设计,标志着国产大模型从参数比拼转向精细化竞争
DeepSeek
V4
专家模式
国产大模型
AI
Qwen3.8-2.4T-A95B 首次开源:从 2.4 万亿参数旗舰到本地部署,2026 年最重磅开发者事件深度解析
编程
Qwen3.8-2.4T-A95B 首次开源:从 2.4 万亿参数旗舰到本地部署,2026 年最重磅开发者事件深度解析
2026-08-13 09:52:01 +0800 CST
view 161
2026年8月13日阿里Qwen团队正式开放Qwen3.8-2.4T-A95B模型权重,这是Qwen-Max级别旗舰首次开源。本文从技术原理、MoE架构、上下文扩展、双协议兼容、性能对比、本地部署门槛、生产踩坑清单六个维度深度解析这一2026年最重磅开发者事件。
Qwen3.8
2.4T参数
MoE架构
开源权重
本地部署
稀疏混合专家
AI大模型
国产大模型
aardio 深度解析:22 年持续更新的国产桌面开发利器,6.8MB 干翻 Electron
编程
aardio 深度解析:22 年持续更新的国产桌面开发利器,6.8MB 干翻 Electron
2026-05-01 20:12:47 +0800 CST
view 778
aardio 是一个诞生于 2002 年的国产桌面软件快速开发工具,体积仅 6.8MB,开发出的程序普遍在 1MB 以内。对比 Electron 动辄 100MB+ 的体积,它是被低估的 Windows 桌面开发利器。
aardio
桌面开发
Windows
国产软件
Electron
轻量级
达梦数据库 DM9 深度解析:国产数据库的「集中分布一体化」革命——从 450 项新特性到 AI 原生架构的全链路技术拆解
编程
达梦数据库 DM9 深度解析:国产数据库的「集中分布一体化」革命——从 450 项新特性到 AI 原生架构的全链路技术拆解
2026-05-02 17:07:56 +0800 CST
view 809
深度解析达梦数据库 DM9 的技术架构:集中分布一体化设计、450 项新特性、AI 原生能力、向量检索、多租户架构,以及金融核心系统迁移实战案例。
数据库
达梦
DM9
国产数据库
AI
Kimi K3 开源深度拆解:2.8T MoE 架构 + 三项 Infra 突破,国产大模型首次摸到开源前沿的天花板
编程
Kimi K3 开源深度拆解:2.8T MoE 架构 + 三项 Infra 突破,国产大模型首次摸到开源前沿的天花板
2026-07-30 15:44:58 +0800 CST
view 546
深度拆解 Kimi K3 技术架构:2.8T MoE 稀疏化、Stable LatentMoE 稳定性设计、KDA+Gated MLA 混合注意力、Attention Residuals 深度优化,以及 MoonEP/FlashKDA/AgentEnv 三项开源 Infra 技术的工程价值。
Kimi K3
MoE
KDA
Stable LatentMoE
MoonEP
FlashKDA
AgentEnv
LLM
开源大模型
国产AI
OceanBase 湖库一体 AI数据库深度实战:当「湖」的灵活遇上「库」的一致,一次把国产 AI 数据库架构讲透(2026)
编程
OceanBase 湖库一体 AI数据库深度实战:当「湖」的灵活遇上「库」的一致,一次把国产 AI 数据库架构讲透(2026)
2026-07-13 17:45:29 +0800 CST
view 279
深度拆解OceanBase 2026湖库一体AI数据库架构:从行存列存统一存储、内置VECTOR类型向量检索、生产级AI Agent数据底座实战,到性能对比与避坑指南,配完整SQL与Python代码。
OceanBase
湖库一体
AI数据库
向量检索
HNSW
国产数据库
分布式数据库
RAG
OLAP
OLTP
ZCode 3.0深度解析:自研Agent内核如何重构国产AI编程体验
编程
ZCode 3.0深度解析:自研Agent内核如何重构国产AI编程体验
2026-07-07 20:50:43 +0800 CST
view 263
测试
ZCode
智谱
GLM-5.2
AI编程
国产工具
DeepSeek V4 技术架构深度解析:从万亿参数 MoE 到百万 token 上下文的工程实践(2026)
编程
DeepSeek V4 技术架构深度解析:从万亿参数 MoE 到百万 token 上下文的工程实践(2026)
2026-07-07 23:16:31 +0800 CST
view 349
深入解析 DeepSeek V4 的四大核心技术:MoE 分层专家路由、CSA/HCA/mHC 三层混合注意力、Engram 记忆架构、国产算力适配方案
MoE架构
百万上下文
Engram记忆
国产AI
深度求索
大模型
DSA
CSA
推理优化
DragonOS 深度实战:当 Rust 从零重写操作系统内核——Linux ABI 兼容、Serverless 轻量化与国产自主可控的生产级完全指南(2026)
编程
DragonOS 深度实战:当 Rust 从零重写操作系统内核——Linux ABI 兼容、Serverless 轻量化与国产自主可控的生产级完全指南(2026)
2026-06-19 07:57:31 +0800 CST
view 999
DragonOS是用Rust从零自研内核的国产操作系统,提供Linux二进制兼容性,面向Serverless场景。深度解析其内核架构、ABI兼容机制、内存管理、调度子系统、虚拟化支持与RISC-V适配。
DragonOS
Rust
操作系统
Linux ABI
Serverless
国产自主
RISC-V
“信创”浪潮下IT人员的机遇与准备
资讯
“信创”浪潮下IT人员的机遇与准备
2024-11-18 18:26:47 +0800 CST
view 1857
信创是推动国内信息技术产业发展的重要举措,为IT从业者提供了广阔的发展空间。文章详细介绍了国产化操作系统、数据库管理系统、中间件、信息安全技术及云计算与大数据等领域的机会与准备策略,强调了学习和适应国产技术的重要性,以帮助软件开发者在信创市场中实现职业发展。
信息技术
国产化
职业发展
Qwen3.8-2.4T-A95B 深度实战:2.4万亿参数MoE旗舰模型首次开源——从512专家细粒度路由到多芯部署全链路拆解
编程
Qwen3.8-2.4T-A95B 深度实战:2.4万亿参数MoE旗舰模型首次开源——从512专家细粒度路由到多芯部署全链路拆解
2026-08-16 15:16:00 +0800 CST
view 86
深度拆解阿里Qwen3.8-2.4T-A95B旗舰开源MoE模型:2.4万亿参数、512专家细粒度路由、95B稀疏激活、原生262K上下文可扩展至100万Token、9芯FlagOS适配,从架构原理到vLLM部署全链路实战。
Qwen3.8
MoE架构
开源大模型
混合专家
细粒度路由
512专家
长上下文
多芯部署
FlagOS
国产AI芯片
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
2
下一页