程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
编程
百度 Unlimited OCR 深度实战:30亿参数仅激活5亿、R-SWA注意力革命——长文档OCR端到端SOTA完全指南(2026)
2026-06-28 06:43:54 +0800 CST
view 570
百度2026年6月开源Unlimited OCR:30亿参数仅激活5亿,R-SWA注意力把KV Cache压成常数,一次前向推理处理几十页文档,OmniDocBench v1.6得分93.92%刷新SOTA。
百度 Unlimited OCR
OCR
R-SWA
长文档
端到端
MoE
SGLang
GLM-5.2 深度实战:当开源编程模型首次摸到 Opus 4.8 的天花板——从 753B MoE 架构到 1M 无损上下文、从 DSA 稀疏注意力到国产算力 Day-0 部署的生产级完全指南(2026)
编程
GLM-5.2 深度实战:当开源编程模型首次摸到 Opus 4.8 的天花板——从 753B MoE 架构到 1M 无损上下文、从 DSA 稀疏注意力到国产算力 Day-0 部署的生产级完全指南(2026)
2026-06-20 15:52:19 +0800 CST
view 1014
GLM-5.2 开源深度解析:753B MoE 架构、1M 无损上下文、DSA 稀疏注意力、生产级部署完全指南
AI
开源模型
GLM
智谱
编程工具
MoE
大模型
Qwen3.8深度拆解:2.4万亿参数稀疏MoE架构的技术革命,从模型设计到开源落地的全链路复盘
编程
Qwen3.8深度拆解:2.4万亿参数稀疏MoE架构的技术革命,从模型设计到开源落地的全链路复盘
2026-08-11 10:55:36 +0800 CST
view 11
深度拆解阿里Qwen3.8的2.4万亿参数稀疏MoE架构:专家池设计、负载均衡、混合注意力机制、100万Token上下文、编程能力突破、开源生态影响与生产部署指南
Qwen3.8
大模型
MoE架构
稀疏激活
开源AI
千问
AI编程
深度学习
Transformer
DeepSeek V4 深度解析:DSA 稀疏注意力与 mHC 流形约束——百万上下文普惠化的技术革命(2026)
编程
DeepSeek V4 深度解析:DSA 稀疏注意力与 mHC 流形约束——百万上下文普惠化的技术革命(2026)
2026-07-04 06:44:28 +0800 CST
view 334
2026年4月DeepSeek V4发布,开创百万上下文普惠化时代。深度解析DSA稀疏注意力、mHC流形约束、Muon优化器三大技术创新,含完整代码实战与部署指南。
DeepSeek V4
大模型
MoE
稀疏注意力
长上下文
DSA
mHC
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
编程
LLM 推理优化全景实战:从 PagedAttention 到投机解码——让大模型推理成本下降 70% 的技术革命(2026)
2026-05-30 15:42:55 +0800 CST
view 586
深度解析 LLM 推理优化的核心技术:PagedAttention 内存管理革命、投机解码加速策略、INT4/FP8 量化技术、MoE 架构优化,从架构原理到代码实战,让大模型推理成本下降 70%。
LLM
推理优化
vLLM
PagedAttention
投机解码
量化
MoE
百度 Unlimited OCR 深度解析:R-SWA 如何让长文档 OCR 从"逐页煎熬"走向"一次搞定"
编程
百度 Unlimited OCR 深度解析:R-SWA 如何让长文档 OCR 从"逐页煎熬"走向"一次搞定"
2026-06-28 14:13:06 +0800 CST
view 451
深度解析百度 Unlimited OCR 的 R-SWA 参考滑动窗口注意力机制,如何将 KV Cache 从线性增长压到常数,使长文档 OCR 性能恒定不衰减。含完整架构分析、训练配方、性能基准和实战代码。
Unlimited OCR
R-SWA
OCR
端到端
百度
文档识别
KV Cache
MoE
DeepEncoder
长文档处理
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
编程
ds4 深度解析:Redis 作者的最后一战?—— DwarfStar 4 本地推理引擎的技术革命
2026-05-15 17:47:40 +0800 CST
view 946
深入解析 antirez(Redis 作者)新开源项目 ds4:DwarfStar 4 本地推理引擎,专门为 DeepSeek V4 Flash 打造,支持 Metal/CUDA 后端,2-bit 量化可在 96GB 内存 MacBook 上运行 284B 参数模型。
AI推理
本地部署
DeepSeek
Redis
Apple Silicon
CUDA
Metal
MoE
量化
历史的分水岭:GitHub Copilot 接入 Kimi K2.7 Code,开源编程模型的登堂入室
编程
历史的分水岭:GitHub Copilot 接入 Kimi K2.7 Code,开源编程模型的登堂入室
2026-07-04 13:44:27 +0800 CST
view 293
深度解析Kimi K2.7 Code接入GitHub Copilot:从技术架构、性能测试到开源生态影响,全面解读这起开源编程模型登堂入室的历史性事件
Kimi K2.7 Code
GitHub Copilot
开源模型
AI编程
MoE架构
字节跳动
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
编程
Qwen3.8-Max 深度拆解:2.4万亿参数的MoE巨兽如何重新定义大模型天花板——从稀疏混合专家到1M上下文的全栈架构哲学
2026-08-03 17:14:27 +0800 CST
view 364
深度拆解Qwen3.8-Max 2.4万亿参数MoE大模型架构:稀疏混合专家路由机制、混合注意力1M上下文、GQA KV Cache优化、量化部署实战、vLLM推理优化,附完整代码示例与性能基准分析
Qwen3.8
MoE
大模型
阿里巴巴
通义千问
混合专家
1M上下文
稀疏注意力
量化部署
vLLM
开源
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
编程
智谱 GLM-5.1 深度解析:当开源模型突破「8小时自治」临界点
2026-04-09 00:53:51 +0800 CST
view 1483
2026年4月8日智谱发布GLM-5.1,744B参数MIT开源,SWE-bench Pro 58.4分超越Claude Opus 4.6,全球首个支持8小时长程自治的开源模型。
GLM-5.1
智谱AI
开源大模型
MoE
SWE-bench
长程自治
LLM
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
编程
DeepSeek V4-Flash 正式版深度拆解:284B MoE 架构如何用 13B 激活参数干翻自家 1.6T 旗舰——CSA+HCA 混合压缩注意力、Muon 优化器与 Agent 能力跃迁的全栈工程哲学
2026-08-03 19:12:41 +0800 CST
view 168
深度拆解DeepSeek V4-Flash 284B MoE架构:CSA+HCA混合压缩注意力机制让1M上下文KV Cache降至V3.2的7%,Muon优化器替代AdamW,Agent能力跃迁至Terminal Bench 82.7分,13B激活参数推理成本仅0.88元/530万token,附完整部署代码与性能优化实战指南
DeepSeek
V4-Flash
MoE
CSA
HCA
Muon优化器
Agent
大模型
开源
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
编程
DeepSeek V4 深度解析:百万token上下文的技术革命,让开源模型站上全球之巅
2026-04-28 08:19:25 +0800 CST
view 717
深度解析 DeepSeek V4:混合注意力机制、MoE 架构、100万token 上下文、Agent 能力,从技术原理到部署实战,全面剖析开源模型新天花板
DeepSeek
AI大模型
开源
长上下文
MoE
混合注意力
Agent
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
编程
TileLang + TileKernels 深度解析:DeepSeek 如何用 Python 写出让 GPU 逼近理论性能上限的 GPU 内核
2026-04-28 10:55:20 +0800 CST
view 797
深度剖析 DeepSeek 开源的 TileLang DSL 和 TileKernels GPU 内核库:从 GEMM 到 MoE,从 TVM 编译基础设施到生产级量化内核,揭示用 Python 写接近硬件极限性能 GPU 代码的秘密。
TileLang
GPU内核
DeepSeek
高性能计算
CUDA
GEMM
MoE
量化
TVM
开源项目
Google Gemma 4 深度解析:当开源AI进入「逐层嵌入平行化」时代
编程
Google Gemma 4 深度解析:当开源AI进入「逐层嵌入平行化」时代
2026-04-09 04:54:56 +0800 CST
view 1035
Google于2026年4月发布Gemma 4开源模型系列,首次全面切换Apache 2.0许可证,搭载Per-Layer Embedding架构创新,26B MoE以3.8B激活参数击败Qwen3-235B。本文深度解析PLE架构、稀疏激活机制与全规格产品矩阵。
Gemma 4
Google
开源模型
Apache 2.0
MoE
Per-Layer Embedding
uv 深度拆解:当 Rust 决定「干掉 pip + poetry + venv + pyenv」——一个 68K Star 的 Python 工具链如何用 100 倍性能重新定义包管理的未来
编程
uv 深度拆解:当 Rust 决定「干掉 pip + poetry + venv + pyenv」——一个 68K Star 的 Python 工具链如何用 100 倍性能重新定义包管理的未来
2026-08-04 02:43:35 +0800 CST
view 122
深度拆解uv 68K Star开源Python包管理器架构:Rust重写pip poetry venv pyenv全套工具链、PubGrub依赖解析算法、tokio异步并发下载、全局缓存策略、PEP 723脚本支持、uv.lock锁文件、Workspace Monorepo支持,附完整代码示例与性能基准对比
uv
Astral
Rust
Python包管理
pip替代
虚拟环境
依赖解析
pyenv
poetry
性能优化
开源
Go 1.27 的小对象分配革命:当编译器学会为每个尺寸定制 malloc
编程
Go 1.27 的小对象分配革命:当编译器学会为每个尺寸定制 malloc
2026-07-05 16:38:18 +0800 CST
view 290
Go 1.27编译器为小于80字节的小对象生成尺寸特化分配代码,绕过mallocgc通用路径,直接内联分配逻辑。小对象分配延迟降低约30%,整体免费1%性能提升,无需改代码。解析Swiss Tables/Green Tea GC/栈分配的基础建设如何促成这一优化。
Go
Go 1.27
编译器
性能优化
内存管理
malloc
小对象分配
尺寸特化
mallocgc
GreenTeaGC
SwissTables
栈分配
GOEXPERIMENT
uv 深度解析:Rust 重写的 Python 工具链,如何一口气吃掉 pip/poetry/pyenv/pipx
编程
uv 深度解析:Rust 重写的 Python 工具链,如何一口气吃掉 pip/poetry/pyenv/pipx
2026-07-24 02:43:38 +0800 CST
view 224
从工程师视角深度拆解 Astral 的 uv:PubGrub 解析器、内容寻址全局缓存与硬链接、universal resolution 跨平台锁文件、PEP 723 内联脚本依赖,以及 Docker/CI 生产落地与从 pip/poetry 迁移的完整实战。
uv
Python
Rust
pip
poetry
依赖管理
PubGrub
包管理
Astral
工具链
Elixir 1.19 深度实战:从类型系统飞跃到编译速度4倍提升——2026年函数式编程的性能革命完全指南
编程
Elixir 1.19 深度实战:从类型系统飞跃到编译速度4倍提升——2026年函数式编程的性能革命完全指南
2026-05-24 09:09:31 +0800 CST
view 629
Elixir v1.19.0 深度解析:类型系统推断飞跃、编译速度最高4倍提升、OTP 28支持、OpenChain供应链安全认证。从架构原理到生产级代码实战,全面掌握这次重大更新。
Elixir
Phoenix
BEAM
OTP28
函数式编程
Go 1.23 深度解析:性能认知革命与云原生范式的深度适配
编程
Go 1.23 深度解析:性能认知革命与云原生范式的深度适配
2026-05-12 02:28:37 +0800 CST
view 652
深度解析Go 1.23的核心突破:性能认知框架从被动调优转向主动设计、GC P99停顿降低37%(启用gcplineline)、泛型约束简化(T语法)、net/http HTTP/3统一收口、strings/bytes包零分配优化、Windows UTF-8原生支持、GOEXPERIMENT特性(gcplineline/fieldtrack/bignum/rtmlock)、零拷贝切片操作unsafe.String/slice
Go1.23,性能优化,GC,泛型,HTTP/3,标准库,Windows,GOEXPERIMENT,零拷贝,云原生
uv 深度实战:一个 Rust 二进制如何统一 Python 工具链——从 pip 到 poetry 再到 pyenv,一次把 Python 包管理讲透(2026)
编程
uv 深度实战:一个 Rust 二进制如何统一 Python 工具链——从 pip 到 poetry 再到 pyenv,一次把 Python 包管理讲透(2026)
2026-07-14 05:42:24 +0800 CST
view 162
深度拆解 uv:从 Python 工具链碎片化史、Rust 架构(全局缓存/PubGrub 求解/python-build-standalone/uv.lock),到 uv init/add/sync/run/python/uvx/workspaces 全命令实战、CI 与 Docker 多阶段加速,配完整可运行代码与 Astral 生态版图、避坑指南。
uv
Python
包管理
Astral
Rust
依赖管理
Poetry
pyenv
pip
chinese-poetry-api:40万首古诗词 API,Go高性能 REST+GraphQL双接口 + Docker一键部署
编程
chinese-poetry-api:40万首古诗词 API,Go高性能 REST+GraphQL双接口 + Docker一键部署
2026-07-22 07:39:47 +0800 CST
view 191
chinese-poetry-api(40万首古典诗词)Go高性能双接口:RESTful+GraphQL支持分页/筛选/自定义字段、简繁300ns切换、多维度精准检索(朝代/作者/体裁)、Docker一行命令部署(amd64/arm64)、内置IP限流+k6压测脚本(3000并发),私有化部署无第三方限制。
chinese-poetry-api
古诗词API
Go
GraphQL
RESTful
简繁转换
Docker
诗词数据库
GPL
私有化部署
后端
小米 MiMo Code 深度解析:从 Max Mode 到四层记忆体系,一次把国产 AI Coding Agent 讲透(2026 深度长文)
编程
小米 MiMo Code 深度解析:从 Max Mode 到四层记忆体系,一次把国产 AI Coding Agent 讲透(2026 深度长文)
2026-07-13 15:43:45 +0800 CST
view 546
深度拆解小米 MiMo Code AI编程助手:从 Max Mode 多采样决策、四层记忆体系、Dynamic Workflow 到插件生态,配完整代码示例与性能基准。
MiMo Code
AI编程助手
Coding Agent
Max Mode
四层记忆体系
OpenCode
MiMo
Bun
TypeScript
AI编程
OpenHuman 深度实战:用 Rust 构建个人 AI 操作系统——从记忆树到模型路由,登顶 GitHub Trending 的技术内幕
编程
OpenHuman 深度实战:用 Rust 构建个人 AI 操作系统——从记忆树到模型路由,登顶 GitHub Trending 的技术内幕
2026-05-16 07:44:37 +0800 CST
view 791
OpenHuman 深度技术拆解:Memory Tree记忆树、TokenJuice压缩、模型路由、潜意识循环、SQLite+Markdown双轨存储
OpenHuman
Rust
AI Agent
Memory Tree
Model Router
开源项目
Supermemory 深度实战:AI 时代的 Memory API 完全指南——从记忆引擎架构到生产级集成的完整解析(2026)
编程
Supermemory 深度实战:AI 时代的 Memory API 完全指南——从记忆引擎架构到生产级集成的完整解析(2026)
2026-06-01 19:52:22 +0800 CST
view 545
Supermemory 是 AI 时代的 Memory Engine,自动提取事实、处理矛盾、构建用户画像。本文深入解析其架构原理、API 使用、集成实战(Vercel AI SDK、LangChain、OpenClaw)、性能优化与生产部署,并对比 Mem0、Zep 等竞品。
AI
Memory
Supermemory
LLM
编程
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
3
4
5
6
7
...
16
下一页