程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
腾讯混元 Hy3 正式版深度解析:快慢思考融合的 MoE 架构与开发者实战指南
编程
腾讯混元 Hy3 正式版深度解析:快慢思考融合的 MoE 架构与开发者实战指南
2026-07-07 14:15:18 +0800 CST
view 459
深度解析腾讯混元 Hy3 正式版的技术架构,涵盖 MoE 混合专家、快慢思考融合机制、256K 上下文、Agent 能力等核心特性,并提供 API 调用与 SDK 集成的完整实战指南。
MoE架构
快慢思考
腾讯混元
Hy3
AI大模型
混合专家
Agent
开发者工具
MCP协议致命漏洞CVE-2026-30615深度解析:20万台服务器沦陷,Anthropic为何拒绝修复
编程
MCP协议致命漏洞CVE-2026-30615深度解析:20万台服务器沦陷,Anthropic为何拒绝修复
2026-04-23 10:14:12 +0800 CST
view 1019
深度解析MCP协议架构级漏洞CVE-2026-30615:20万台服务器沦陷、Anthropic拒绝修复的原因,以及从个人到企业的完整防御方案。
MCP
Model Context Protocol
CVE
AI安全
Anthropic
漏洞分析
RCE
安全协议
Python
TypeScript
万字深度解析 Rspack:当字节跳动用 Rust 重写前端构建——从三明治架构到 5-10 倍性能提升的完整技术指南(2026)
编程
万字深度解析 Rspack:当字节跳动用 Rust 重写前端构建——从三明治架构到 5-10 倍性能提升的完整技术指南(2026)
2026-07-02 09:47:44 +0800 CST
view 400
深度解析字节跳动开源的Rspack:Rust编写的Webpack替代方案,40K+ Stars,三明治架构设计,SWC极速转译,5-10倍构建性能提升,含完整迁移实战代码。
Rspack
Rust
Webpack
前端构建
SWC
字节跳动
Rsbuild
Module Federation
Moonshine 深度解剖:比 Whisper 快 5 倍的端侧语音识别引擎——变长音频、卷积前端、RoPE 与实时流式 ASR 工程实战
编程
Moonshine 深度解剖:比 Whisper 快 5 倍的端侧语音识别引擎——变长音频、卷积前端、RoPE 与实时流式 ASR 工程实战
2026-07-26 01:44:11 +0800 CST
view 119
深度拆解 Moonshine 端侧语音识别引擎:为何扔掉梅尔频谱与30秒定长、直接吃原始波形按变长计算,配合卷积前端与RoPE做到比Whisper快5倍、体积仅27MB。含Python/ONNX推理、Silero VAD实时流式管线、int8量化与端侧部署优化Checklist。
Moonshine
语音识别
ASR
端侧AI
Whisper
流式识别
ONNX
RoPE
模型量化
边缘计算
万字深度解析百度 Unlimited-OCR:当端到端OCR遇见R-SWA革命,从逐页失忆到40页文档一口气解析(2026)
编程
万字深度解析百度 Unlimited-OCR:当端到端OCR遇见R-SWA革命,从逐页失忆到40页文档一口气解析(2026)
2026-07-02 10:46:07 +0800 CST
view 230
深度解析百度2026年开源的Unlimited-OCR模型:3B参数的端到端OCR系统,R-SWA机制实现常数级KV缓存,OmniDocBench 93.92% SOTA评分,可一口气解析40页文档
Unlimited-OCR
百度
OCR
R-SWA
MoE
CLIP
端到端
长文档处理
深度学习
多模态
R-SWA如何让OCR「过目不忘」:百度Unlimited-OCR的KV缓存革命与40页长文档解析实战(2026)
编程
R-SWA如何让OCR「过目不忘」:百度Unlimited-OCR的KV缓存革命与40页长文档解析实战(2026)
2026-07-02 10:47:12 +0800 CST
view 326
深度解析百度2026年开源的Unlimited-OCR模型:3B参数的端到端OCR系统,R-SWA机制实现常数级KV缓存,OmniDocBench 93.92% SOTA评分,可一口气解析40页文档
Unlimited-OCR
百度
OCR
R-SWA
MoE
CLIP
端到端
长文档处理
深度学习
多模态
worldmonitor 深度解剖:69K Star 的开源"彭博终端"——500+ 信源聚合、三级缓存与 AIS 背压架构的工程真相
编程
worldmonitor 深度解剖:69K Star 的开源"彭博终端"——500+ 信源聚合、三级缓存与 AIS 背压架构的工程真相
2026-07-26 03:15:25 +0800 CST
view 158
深度拆解GitHub Trending榜首项目worldmonitor:500+信源聚合、四级AI降级链、三级缓存与stale-on-error、in-flight Promise缓存击穿防护、Welford算法统计基线、AIS三水位背压、边缘函数冷启动优化85%,附可复用代码模式。
worldmonitor
开源
TypeScript
边缘计算
缓存架构
背压
Vercel
MCP
实时系统
数据聚合
MCP深度解析:Anthropic推出的AI工具集成标准协议——从原理到生产级实战的完整技术内幕
编程
MCP深度解析:Anthropic推出的AI工具集成标准协议——从原理到生产级实战的完整技术内幕
2026-05-18 13:24:04 +0800 CST
view 568
深度解析MCP协议:从JSON-RPC通信机制到Python/TypeScript实战,覆盖架构原理、Transport层、安全机制、生产级部署的完整技术内幕
MCP
AI Agent
Model Context Protocol
Anthropic
AI工具集成
GitHub Copilot 接入 Kimi K2.7 Code 深度解读:开源模型的登堂入座与 AI 编程格局重塑
编程
GitHub Copilot 接入 Kimi K2.7 Code 深度解读:开源模型的登堂入座与 AI 编程格局重塑
2026-07-07 20:12:44 +0800 CST
view 252
2026年7月,GitHub Copilot 首次接入开源模型 Kimi K2.7 Code。本文从技术原理、模型架构、性能实测、开发者体验、格局影响等多维度,深度解析这一里程碑事件的真实含义。
GitHub Copilot
Kimi K2.7
AI编程
开源模型
编程助手
Moonshot AI
月之暗面
AI Agent
MiMo Code 深度实战:当小米用 1 万亿参数杀入 AI 编程 Agent 赛道——从持久记忆到 Max Mode、从四层记忆体系到动态工作流的生产级完全指南(2026)
编程
MiMo Code 深度实战:当小米用 1 万亿参数杀入 AI 编程 Agent 赛道——从持久记忆到 Max Mode、从四层记忆体系到动态工作流的生产级完全指南(2026)
2026-06-19 01:25:01 +0800 CST
view 636
2026年6月小米正式开源MiMo Code V0.1.0,一款面向终端的AI编程助手。本文深度解析其架构设计:计算层Max Mode多采样机制、记忆层四层持久记忆体系、进化层Dream/Distill模式,以及与Claude Code的深度对比评测。
AI编程
MiMo Code
小米
Agent
长程任务
编程助手
codebase-memory-mcp深度解析:毫秒级代码库知识图谱让AI编程助手拥有持久记忆
编程
codebase-memory-mcp深度解析:毫秒级代码库知识图谱让AI编程助手拥有持久记忆
2026-07-07 20:58:46 +0800 CST
view 230
测试
codebase-memory-mcp
MCP
代码知识图谱
AI编程
Token优化
DiffusionGemma 深度实战:当文本生成进入「扩散纪元」——从离散扩散原理到本地高速推理的完全指南(2026)
编程
DiffusionGemma 深度实战:当文本生成进入「扩散纪元」——从离散扩散原理到本地高速推理的完全指南(2026)
2026-06-14 01:18:58 +0800 CST
view 624
2026年6月Google开源DiffusionGemma——基于离散扩散技术的文本生成模型,打破传统自回归范式,实现4倍生成速度提升。本文深入解析其架构原理、性能实测、代码实战与生产落地。
DiffusionGemma
离散扩散
文本生成
AI大模型
Google
并行推理
MoE架构
Qwen3.8 深度实战:2.4T MoE 巨兽来了——从 Preview API 接入、函数调用到本地部署与微调的完整工程指南(2026)
编程
Qwen3.8 深度实战:2.4T MoE 巨兽来了——从 Preview API 接入、函数调用到本地部署与微调的完整工程指南(2026)
2026-07-21 01:43:04 +0800 CST
view 221
2026年Qwen3.8深度实战:2.4T MoE架构原理、Preview API接入、流式调用、函数调用、RAG检索增强、vLLM/SGLang本地部署与QLoRA微调的完整工程指南
Qwen3.8
MoE
大模型部署
函数调用
QLoRA
vLLM
通义千问
2026
MCP 深度解析:当 AI Agent 从「纸上谈兵」走向「动手执行」——Model Context Protocol 工程全解
编程
MCP 深度解析:当 AI Agent 从「纸上谈兵」走向「动手执行」——Model Context Protocol 工程全解
2026-04-14 16:56:30 +0800 CST
view 740
深入解析 Model Context Protocol(MCP):AI Agent 如何从「纸上谈兵」走向「动手执行」。覆盖协议架构、代码实现、安全模型、生态全景与未来演进方向。
AI
Agent
MCP
Model Context Protocol
Anthropic
Claude
Claude Fable 5深度解析:Anthropic"神话级"模型的编程能力实测与技术架构
编程
Claude Fable 5深度解析:Anthropic"神话级"模型的编程能力实测与技术架构
2026-07-07 21:13:57 +0800 CST
view 346
Claude Fable 5是Anthropic史上第一个面向公众的Mythos级模型,在SWE-bench Verified上创下95%的最高分记录。本文深度解析其自适应思考机制、百万Token上下文、128K输出等技术架构,以及与Opus 4.8的选型对比和开发者选型指南。
Claude Fable 5
Anthropic
AI编程
模型评测
SWE-bench
MoE
HarmonyOS 6 深度实战:ArkTS + ArkUI + AI 原生——从架构原理到生产级应用开发完全指南(2026)
编程
HarmonyOS 6 深度实战:ArkTS + ArkUI + AI 原生——从架构原理到生产级应用开发完全指南(2026)
2026-06-05 15:07:15 +0800 CST
view 844
从ArkTS语言设计到ArkUI声明式框架,从Aspect AOP到系统级AI集成,全面解析HarmonyOS 6的生产级应用开发
HarmonyOS
ArkTS
ArkUI
鸿蒙开发
AI原生
方舟编译器
DeepSeek V4 技术架构深度解析:从万亿参数 MoE 到百万 token 上下文的工程实践(2026)
编程
DeepSeek V4 技术架构深度解析:从万亿参数 MoE 到百万 token 上下文的工程实践(2026)
2026-07-07 23:16:31 +0800 CST
view 229
深入解析 DeepSeek V4 的四大核心技术:MoE 分层专家路由、CSA/HCA/mHC 三层混合注意力、Engram 记忆架构、国产算力适配方案
MoE架构
百万上下文
Engram记忆
国产AI
深度求索
大模型
DSA
CSA
推理优化
腾讯混元 Hy3 preview 开源:295B 参数、推理提效 40%,姚顺雨首秀交卷
资讯
腾讯混元 Hy3 preview 开源:295B 参数、推理提效 40%,姚顺雨首秀交卷
2026-04-23 21:18:45 +0800 CST
view 890
2026年4月23日,腾讯发布并开源新一代大模型混元Hy3preview,总参数295B、激活参数21B的MoE架构,支持256K超长上下文,推理效率提升40%,API最低1.2元/百万tokens。在复杂推理、代码与Agent能力上表现突出,接近GPT-5.4级别,数学推理创国内最高纪录。已接入腾讯云、元宝等多条产品线,并上架TokenHub。
人工智能
大模型
腾讯
开源
MoE
推理
代码生成
Agent
云计算
百度 Unlimited OCR 深度实战:告别「越生成越慢」,一次性解析整本书的 OCR 革命
编程
百度 Unlimited OCR 深度实战:告别「越生成越慢」,一次性解析整本书的 OCR 革命
2026-06-27 02:13:37 +0800 CST
view 466
深度解析百度2026年6月开源的Unlimited OCR模型,介绍其R-SWA机制如何解决长文档OCR的KV cache线性增长问题,包含完整实战代码和性能优化技巧。
Unlimited OCR
百度
OCR
深度学习
MoE
R-SWA
长文档解析
MongoDB 8.3 深度解析:面向 AI 智能体生产环境的平台升级,向量搜索性能提升 50%
编程
MongoDB 8.3 深度解析:面向 AI 智能体生产环境的平台升级,向量搜索性能提升 50%
2026-05-14 02:04:57 +0800 CST
view 547
MongoDB 8.3于2026年5月12日在伦敦.Local大会发布,向量搜索性能提升50%(延迟从5.2秒降至2.1秒),召回率提升至92%。新增混合搜索()联合优化向量+全文+地理搜索,智能体事务冲突自动解决,吞吐量提升320%。
MongoDB,向量搜索,混合搜索,智能体,AI生产环境,事务冲突自动解决
万字深度解析百度 Unlimited OCR:当长文档解析遇见 R-SWA 革命——从常数级 KV Cache 到 40 页一次性识别的完整技术指南(2026)
编程
万字深度解析百度 Unlimited OCR:当长文档解析遇见 R-SWA 革命——从常数级 KV Cache 到 40 页一次性识别的完整技术指南(2026)
2026-07-02 18:16:20 +0800 CST
view 513
深度解析百度 Unlimited OCR 的 R-SWA 参考滑动窗口注意力机制,将 KV Cache 从线性增长压至常数级;3B MoE 解码器架构、DeepEncoder 视觉编码器;完整本地部署代码、KV Cache 监控脚本与 SGLang 生产推理优化指南。OmniDocBench v1.6 综合得分 93.92%,端到端 OCR 新 SOTA。
OCR
R-SWA
KV Cache
MoE
百度
长文档解析
Transformer
深度学习
Python
性能优化
MCP协议深度实战:从架构原理到RCE漏洞修复,AI工具互联的安全与工程指南
编程
MCP协议深度实战:从架构原理到RCE漏洞修复,AI工具互联的安全与工程指南
2026-04-24 03:41:51 +0800 CST
view 829
深度解析MCP协议架构原理,实战Python/TypeScript/Go三种语言开发MCP Server,深入剖析2026年4月OX Security披露的RCE漏洞技术细节,给出企业级安全加固方案
MCP
AI安全
RCE漏洞
Model Context Protocol
安全加固
AI 原生前端开发 2026 深度解析:LLM-as-Compiler、编译时语义理解、声明式 UI 合成——前端开发的范式革命
编程
AI 原生前端开发 2026 深度解析:LLM-as-Compiler、编译时语义理解、声明式 UI 合成——前端开发的范式革命
2026-05-14 03:40:08 +0800 CST
view 597
2026年奇点智能技术大会正式提出AI原生前端开发范式,LLM不再只是辅助工具而是编译过程的一部分。深度解析LLM-as-Compiler、编译时语义理解、声明式UI合成及Vite5.4+插件调用本地MoE模型的技术实现。
AI原生前端,LLM-as-Compiler,编译时语义理解,声明式UI合成,Vite5.4,MoE模型
ASMR 彻底颠覆 RAG:Supermemory 如何以 99% 准确率重新定义 AI Agent 永久记忆
编程
ASMR 彻底颠覆 RAG:Supermemory 如何以 99% 准确率重新定义 AI Agent 永久记忆
2026-05-28 15:44:20 +0800 CST
view 798
ASMR(Agentic Search and Memory Retrieval)在 LongMemEval 基准测试中以 99% 准确率刷新世界纪录,彻底颠覆传统 RAG 方案。本文深入解析 ASMR 的 Observer Agents、Search Agents、Memory Graph 三大核心组件,以及无向量数据库的实现原理。
ASMR
AI Agent
永久记忆
LongMemEval
Supermemory
RAG替代
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
24
25
26
27
28
...
63
下一页