程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
html在线编辑
登录注册
AI,自己全程接管维护
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
最新
最热
oMLX 深度实战:当 Apple Silicon 遇见本地大模型推理——从 MTP 加速到分层 KV 缓存的生产级完全指南(2026)
编程
oMLX 深度实战:当 Apple Silicon 遇见本地大模型推理——从 MTP 加速到分层 KV 缓存的生产级完全指南(2026)
2026-06-16 16:46:05 +0800 CST
view 240
深度解析 2026 年 Apple Silicon 本地大模型推理技术栈:从 llama.cpp 量化体系到 oMLX 分层 KV 缓存架构,从 MTP 加速到 CoreAI 全栈指南,包含实测 Benchmark 与生产级部署方案。
Apple Silicon
MLX
llama.cpp
oMLX
MTP
本地大模型
量化
本地推理
DiffusionGemma 深度实战:当 Google 用「扩散」颠覆自回归——从离散文本扩散原理到 MoE 架构、本地推理加速与生产级部署的完全指南(2026)
编程
DiffusionGemma 深度实战:当 Google 用「扩散」颠覆自回归——从离散文本扩散原理到 MoE 架构、本地推理加速与生产级部署的完全指南(2026)
2026-06-16 18:52:52 +0800 CST
view 221
Google DeepMind联合NVIDIA发布DiffusionGemma——基于离散文本扩散的实验性开源模型。本文深入解读26B MoE架构、双向注意力机制、本地推理4倍加速原理,附完整代码示例和部署实战。
Google
DiffusionGemma
扩散模型
MoE
开源LLM
本地推理
AI推理加速
狂揽50000 Star!谷歌开源Agent Skills:让AI从只会写代码进化成懂工程有纪律的靠谱队友
编程
狂揽50000 Star!谷歌开源Agent Skills:让AI从只会写代码进化成懂工程有纪律的靠谱队友
2026-06-16 19:45:38 +0800 CST
view 154
Google开源Agent Skills(50000+ Star):把《Software Engineering at Google》方法论拆解成20+独立Skill,/spec需求定义+/plan任务拆解+/ship三Agent并行评审,让AI从只会写代码进化成懂工程有纪律的靠谱队友。
Agent Skills
Google
AI编程
软件工程
Claude Code
Cursor
开源
Code Review
测试覆盖
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
编程
oMLX 深度实战:当 macOS 菜单栏成为本地 LLM 推理的控制中心——从连续批处理到 SSD 分层缓存、从 MLX 后端加速到生产级部署的完全指南(2026)
2026-06-22 17:24:05 +0800 CST
view 132
oMLX 是专为 Apple Silicon 优化的 LLM 推理服务器,通过连续批处理、分层 KV Cache、MLX 后端加速和 macOS 菜单栏管理,让本地 AI 推理从可用走向实用。
LLM
Apple Silicon
MLX
本地推理
MCP
免费 + 100万上下文 + 内置搜索:Gemini CLI 凭什么挑战 Claude Code?
编程
免费 + 100万上下文 + 内置搜索:Gemini CLI 凭什么挑战 Claude Code?
2026-05-11 12:52:32 +0800 CST
view 368
Google 开源 Gemini CLI,Apache 2.0 许可,完全免费,100万 token 上下文全部可用,内置 Google 搜索增强,支持 Skills/MCP/Hooks 系统,CI/CD 集成完整。本文深度对比与 Claude Code 的差异、实战场景和最佳实践。
Gemini CLI,Claude Code,AI编程工具,Google,100万token上下文,MCP协议,Skills系统,免费AI助手,终端编程
CLEAR 深度实战:当浙大+腾讯+北大联手破解AI推理「算力浪费」难题——从理性放弃机制到生产级LLM推理优化完全指南(2026)
编程
CLEAR 深度实战:当浙大+腾讯+北大联手破解AI推理「算力浪费」难题——从理性放弃机制到生产级LLM推理优化完全指南(2026)
2026-06-12 14:20:52 +0800 CST
view 159
深度解析 ICML 2026 接收的 CLEAR 推理优化方法。浙江大学、腾讯、北京大学联合提出:对没有希望的问题理性放弃,把算力集中到能解决的问题上。包含完整 Python 实现、vLLM/SGLang 集成、生产级部署指南。
LLM
推理优化
ICML 2026
CLEAR
算力分配
Agent Skills 深度解析:Addy Osmani 如何用纯 Markdown 给 AI 编程助手装上「工程纪律」
编程
Agent Skills 深度解析:Addy Osmani 如何用纯 Markdown 给 AI 编程助手装上「工程纪律」
2026-05-11 15:53:36 +0800 CST
view 379
Google Chrome 工程总监 Addy Osmani 发布了一个名为 agent-skills 的开源项目,通过将 Google 内部严苛的工程规范编码为 AI Agent 可直接执行的纯 Markdown 工作流,让 AI 编程助手从「能跑就行」进化到「可以安全合并」。
Agent Skills
AI编程
Addy Osmani
Claude Code
工程规范
Cursor
Markdown
工作流
Google工程
Google LangExtract 深度解析:用LLM实现非结构化文本的精准结构化提取与可视化
编程
Google LangExtract 深度解析:用LLM实现非结构化文本的精准结构化提取与可视化
2026-05-17 19:18:49 +0800 CST
view 308
Google LangExtract库深度解析,介绍如何使用LLM从非结构化文本中精准提取结构化信息,包含精确源接地、交互式可视化、代码实战和性能优化。
LLM
信息提取
Google
Python
NLP
Google LangExtract 深度实战:LLM结构化信息提取的完整指南(2026版)
编程
Google LangExtract 深度实战:LLM结构化信息提取的完整指南(2026版)
2026-05-17 19:30:29 +0800 CST
view 293
2026年最新Google LangExtract深度实战指南,全面解析如何用LLM从非结构化文本中精准提取结构化信息,包含精确源接地、交互式可视化、代码实战和性能优化。
LLM
信息提取
Google
Python
NLP
结构化数据
Google LangExtract 深度实战:从非结构化文本到结构化知识的工程化完全指南(2026)
编程
Google LangExtract 深度实战:从非结构化文本到结构化知识的工程化完全指南(2026)
2026-05-24 13:30:29 +0800 CST
view 272
Google LangExtract 深度实战:从非结构化文本到结构化知识的工程化完全指南,涵盖架构分析、代码实战、性能优化。
LangExtract
LLM
结构化提取
Google
Python
Gemma 4 12B 深度实战:当 Google 把多模态 AI「塞进」你的笔记本——从无编码器架构到本地 Agent 工作流的完全指南(2026)
编程
Gemma 4 12B 深度实战:当 Google 把多模态 AI「塞进」你的笔记本——从无编码器架构到本地 Agent 工作流的完全指南(2026)
2026-06-13 12:46:40 +0800 CST
view 176
深度解析 Google DeepMind Gemma 4 12B 无编码器多模态架构,从架构原理到本地部署,从 Agent 工具链集成到生产级实战,5400+ 字完全指南。
Gemma 4 12B
Google DeepMind
多模态模型
本地推理
Agent
Ollama
无编码器架构
Google LangExtract 深度解析:用 LLM 从非结构化文本精准提取结构化信息——28K Star 的谷歌开源利器架构内幕
编程
Google LangExtract 深度解析:用 LLM 从非结构化文本精准提取结构化信息——28K Star 的谷歌开源利器架构内幕
2026-05-18 18:48:34 +0800 CST
view 267
Google LangExtract 深度解析,28K Star 开源项目,用 LLM 从非结构化文本中精准提取结构化信息,支持源文本定位、幻觉检测、交互式可视化
LLM
信息提取
Google
开源项目
NLP
Python
Gemma 4 12B 深度实战:当 Google 把「无编码器多模态」塞进 16GB 笔记本——从统一架构原理到生产级本地 Agent 的完全指南(2026)
编程
Gemma 4 12B 深度实战:当 Google 把「无编码器多模态」塞进 16GB 笔记本——从统一架构原理到生产级本地 Agent 的完全指南(2026)
2026-06-14 04:46:45 +0800 CST
view 211
深度解析 Google DeepMind Gemma 4 12B 的无编码器统一多模态架构,从原理到代码实战,涵盖 llama.cpp 部署、量化策略、Agent 工作流和生产级架构设计(2026)。
Gemma 4
Google DeepMind
多模态
本地部署
Agent
llama.cpp
开源大模型
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
编程
TurboQuant 深度实战:Google 的 KV 缓存压缩算法完全指南(2026)
2026-06-08 20:52:38 +0800 CST
view 172
2026年3月Google Research在ICLR 2026发表TurboQuant算法,将LLM的KV缓存压缩至3-bit,实现6倍内存缩减和8倍推理加速。本文深入剖析TurboQuant的技术原理,并提供生产级部署指南。
TurboQuant
KV缓存压缩
LLM推理优化
量化算法
Google Research
ICLR2026
Google LangExtract 深度实战:让 LLM 从"黑盒"变"透明"——从架构原理到生产级结构化提取完全指南(2026)
编程
Google LangExtract 深度实战:让 LLM 从"黑盒"变"透明"——从架构原理到生产级结构化提取完全指南(2026)
2026-05-30 15:10:01 +0800 CST
view 223
Google LangExtract 深度实战:从架构原理、核心源码、代码实战到生产级部署,全面掌握这款让LLM从"黑盒"变"透明"的神器。
LLM
Google
Python
结构化提取
NLP
信息抽取
开源项目
AI工程化
Google LangExtract 深度实战:当 LLM 学会「精准定位」——从非结构化文本到结构化数据的完全指南(2026)
编程
Google LangExtract 深度实战:当 LLM 学会「精准定位」——从非结构化文本到结构化数据的完全指南(2026)
2026-06-09 16:19:31 +0800 CST
view 130
Google LangExtract 深度实战教程,详解如何从非结构化文本中提取结构化信息,包含精确源定位、交互式可视化、长文档优化等核心特性,附完整代码示例。
LLM
信息提取
Python
Google
NLP
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
编程
llama.cpp 深度实战:当 C/C++ 重写遇见端侧 LLM 推理——从 GGUF 量化到 Apple Silicon 38 tokens/s 的生产级完全指南(2026)
2026-06-16 01:17:28 +0800 CST
view 224
llama.cpp 是端侧 LLM 推理的事实标准(180K+ Stars)。本文从源码架构、GGUF 格式、量化方法、跨平台后端、生产部署、性能优化到 DeepSeek V4 Flash 实战,全方位讲解本地 AI 推理。
llama.cpp
GGUF
量化
端侧推理
本地AI
C/C++
Apple Silicon
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
案例
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎,Mac上跑出468 token/s
2026-05-10 08:40:22 +0800 CST
view 588
Redis之父antirez亲自下场!为DeepSeek V4 Flash打造专属推理引擎ds4.c,C+Metal从头编写,Mac Studio M3 Ultra上预填充468 token/s。关键优化:非对称量化(MoE专家层2-bit)、KV缓存搬硬盘、内置OpenAI/Anthropic双API。128GB Mac可跑,专为coding agent优化。
DeepSeek
AI推理
Mac
Redis
antirez
Metal
本地推理
MoE
GGUF
C语言
Apple Silicon
Claude Code
OpenAI API
Anthropic API
AI 编程 CLI 工具 2026 终极横评:Claude Code vs Codex vs Gemini CLI vs OpenCode,架构分析与选型指南
编程
AI 编程 CLI 工具 2026 终极横评:Claude Code vs Codex vs Gemini CLI vs OpenCode,架构分析与选型指南
2026-06-17 21:55:57 +0800 CST
view 163
深度横评2026年四大AI编程CLI工具:Claude Code(Fable 5)、Codex CLI(GPT-5.5)、Gemini CLI、OpenCode,从架构设计到实战对比,结合真实项目测试和成本模型,给出完整选型指南。
Claude Code
Codex CLI
Gemini CLI
OpenCode
AI编程
2026技术
Fable 5
GPT-5.5
MCP
CLI工具
编程工具
Drizzle ORM v1.0.0-rc.1 深度实战:当 TypeScript ORM 遇见 Bun SQL——JIT Row Mappers、Effect 集成与超越 Go 的性能神话(2026)
编程
Drizzle ORM v1.0.0-rc.1 深度实战:当 TypeScript ORM 遇见 Bun SQL——JIT Row Mappers、Effect 集成与超越 Go 的性能神话(2026)
2026-06-18 12:25:32 +0800 CST
view 126
深度解析 Drizzle ORM v1.0.0-rc.1 的 JIT Row Mappers 技术、Effect v4 集成、casing API 重构,以及 Drizzle + Bun 组合如何超越 Go 的性能神话,附生产迁移指南。
Drizzle ORM
Bun
JIT
TypeScript
Go
ORM
Effect
PostgreSQL
性能优化
AI 时代的 USB 接口迎来最大升级:MCP 协议 2026-07-28 规范候选版深度解析
编程
AI 时代的 USB 接口迎来最大升级:MCP 协议 2026-07-28 规范候选版深度解析
2026-06-26 14:16:30 +0800 CST
view 8
45天后这些代码将全部失效——深度解析MCP 2026-07-28规范的七大破坏性变更:会话移除、OAuth 2.1强制接入、Streamable HTTP传输层升级,以及从有状态到无状态的完整迁移实战指南。
MCP
AI-Protocol
OAuth
开发者工具
Agent
无状态架构
Streamable HTTP
协议规范
TypeScript
Python
Anthropic 22亿收购Stainless:当SDK自动生成成为AI战争的战略高地
编程
Anthropic 22亿收购Stainless:当SDK自动生成成为AI战争的战略高地
2026-05-19 15:49:10 +0800 CST
view 371
Anthropic以超过22亿元收购Stainless,独占SDK自动生成与MCP服务器生成基础设施,深度解析技术架构与行业影响
Anthropic
Stainless
SDK
MCP
AI工具链
OpenAPI
Google Genkit:Firebase 出品的全栈 AI 应用开发框架
编程
Google Genkit:Firebase 出品的全栈 AI 应用开发框架
2026-04-18 09:17:44 +0800 CST
view 459
Google Firebase 团队开源的 Genkit 框架,一个框架支持 JavaScript/TypeScript、Go、Python 三种语言,统一接口接入多模型,提供 Flows、Dotprompt、RAG、Tool Calling 等核心能力,v0.5.0 已进入生产就绪状态。
AI
Google
Genkit
Firebase
TypeScript
开源框架
WWDC 2026 开发者全景深度解析:Swift 6.4 底层革命、Xcode 27 Agentic 编程与 SwiftUI 工业级进化
编程
WWDC 2026 开发者全景深度解析:Swift 6.4 底层革命、Xcode 27 Agentic 编程与 SwiftUI 工业级进化
2026-06-21 15:30:28 +0800 CST
view 166
WWDC 2026 完整开发者更新解析:Swift 6.4 Ref/MutableRef 底层革命、Xcode 27 Agentic 编程与 Agent Skills、SwiftUI 工业级进化、Foundation Models LanguageModel 协议,配完整代码实战。
WWDC 2026
Swift 6.4
Xcode 27
SwiftUI
Foundation Models
Swift Testing
macOS 27
AI编程
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
回调
上一页
1
...
11
12
13
14
15
...
55
下一页