程序员茄子
全部
编程
代码
资讯
案例
综合
联系我们
LLM 相关技术文章(第3页)
php
mysql
shell
go
vue
css
api接口对接
支付接口对接
用 PandaAI 做自然语言数据分析:数据源、可视化与自托管部署
编程
用 PandaAI 做自然语言数据分析:数据源、可视化与自托管部署
2026-09-04 22:26:16
PandaAI 是 Python 实现的自然语言数据分析工具,支持 Text2SQL 与问答式图表生成。文章介绍数据源支持、LiteLLM 多模型接入、在线 PandaBI 体验,以及 pip 自托管部署的最小示例。
PandaAI
数据分析
Text2SQL
Python
LLM
半年 Agent 产品实践:24 个高频术语的工程理解,从 Function Calling 到 Computer Use
编程
半年 Agent 产品实践:24 个高频术语的工程理解,从 Function Calling 到 Computer Use
2026-09-04 00:20:17
做 Agent 产品半年踩坑总结,用 LLM、多模态、Function Calling、Tool Use、ReAct、MCP、Agent Runtime、评测等 24 个关键词串起「模型如何变成能干活系统」的完整链路,含可打断性、Sub-Agent、Computer Use 等取舍判断。
Agent
LLM
MCP
Function
Calling
ReAct
Humanizer:把 AI 味文本改写成自然语言,保留原意与事实
编程
Humanizer:把 AI 味文本改写成自然语言,保留原意与事实
2026-09-03 21:51:42
介绍开源 skill Humanizer:基于维基百科 Signs of AI writing 的 35 种模式,把 AI 生成文本改写成像真人写的中性风格,不改原意不编造事实,支持任何支持 skills 的 agent。
AI写作
skills
Claude
LLM
文本改写
在模型入口前压缩工具输出:Headroom v0.37.0 离线测试记录
编程
在模型入口前压缩工具输出:Headroom v0.37.0 离线测试记录
2026-09-03 21:45:34
在模型入口前压缩工具输出,贴稿改写 AI Agent 上下文压缩工具 Headroom 的安装/离线金标验证记录;项目地址已保留。
Headroom
AI
Agent
上下文压缩
LLM
编程
video-use:让 Agent 读转录文本做视频剪辑的开源技能
2026-09-03 00:04:48
介绍 browser-use 开源视频剪辑技能 video-use:LLM 不逐帧看视频,改读约 12KB 转录文本做剪辑决策,词级对齐时间戳、免模板。含双层感知架构、处理管线、安装步骤与使用示例,并指出文本优先对画面型剪辑的局限。
video-use
AI视频剪辑
Claude
Code
LLM
ffmpeg
给 Agent 做实时搜索:问题拆解与 AnySearch 接入方案
编程
给 Agent 做实时搜索:问题拆解与 AnySearch 接入方案
2026-09-02 11:49:10
给Agent接入实时搜索的四个真实痛点拆解(模型无实时数据、自建链路琐碎、HTML噪音烧Token、数据源分散),以及AnySearch三种接入方式(Skill/MCP/REST API)与适用边界,含需自行实测的官方口径。
AI
Agent
搜索
MCP
LLM
crawl4ai:面向 LLM/RAG 的开源爬虫,不只是把 HTML 洗成 Markdown
编程
crawl4ai:面向 LLM/RAG 的开源爬虫,不只是把 HTML 洗成 Markdown
2026-09-01 10:06:24
从 requests+BeautifulSoup 的局限切入,介绍专为 LLM/RAG 优化的爬虫工具 crawl4ai:安装、异步爬取、CLI、Docker API,并给出适用边界与取舍判断。
爬虫
LLM
RAG
Playwright
crawl4ai
Python
Crawl4AI 工程师笔记:LLM/Agent 场景下的爬虫选型参考
编程
Crawl4AI 工程师笔记:LLM/Agent 场景下的爬虫选型参考
2026-09-01 09:53:09
crawl4ai 是专为 LLM/RAG/Agent 设计的开源爬虫,能把网页转成干净 Markdown/JSON。本文给出适用与不适用场景、安装步骤、Python/CLI/Docker 用法及选型判断要点,帮你在动态页提取与普通静态抓取之间做对选择。
crawl4ai
爬虫
LLM
RAG
Playwright
Python
一个匿名的 1M 上下文模型突然出现在 OpenRouter,值得试但别拿生产数据喂
资讯
一个匿名的 1M 上下文模型突然出现在 OpenRouter,值得试但别拿生产数据喂
2026-08-30 23:47:06
OpenRouter 上突现匿名模型 stealth/ox-alpha:1M 上下文、多模态、免费。本文梳理它的实际配置、白嫖方式与边界,并提醒别拿生产数据去喂一个连开发者都不明的模型。
OpenRouter
stealth
ox-alpha
AI模型
LLM
上下文
Advisor Strategy 落地笔记:让执行模型自己决定何时去问 Opus
编程
Advisor Strategy 落地笔记:让执行模型自己决定何时去问 Opus
2026-08-30 15:25:51
Anthropic Advisor Strategy 的工程落地而非哲学:在 Messages API 里声明 advisor 工具、executor 何时求助 advisor、单请求内完成模型交接、max_uses 与分开计费控成本,以及 pause_turn 恢复、result variants、配对校验等坑,和什么时候不该用这个模式。
Advisor
Strategy
Claude
LLM
Agent
成本优化
API
token
本地跑 LLM 的最短路径:Ollama 的安装、命令与边界
编程
本地跑 LLM 的最短路径:Ollama 的安装、命令与边界
2026-08-29 20:31:34
用 Go 写的 Ollama 在本地拉模型跑对话有多快,本文给出安装、run/pull/list/serve 常用命令、本地 HTTP API 与 OpenAI 兼容端点、GPU 与 Modelfile 用法,并明确什么情况下不该用它(高并发、完整 OpenAI 生态、复杂编排)。
Ollama
大模型
本地推理
Go
LLM
PenguinHarness 实测:自建 Agent 的低 token 方案,数据全在本地
编程
PenguinHarness 实测:自建 Agent 的低 token 方案,数据全在本地
2026-08-29 17:26:49
介绍开源项目 PenguinHarness:如何用它自建 agent,并通过本地数据与自我进化机制把 token 消耗压到官方编码任务的十分之一量级。附安装、示例与边界。
Agent
LLM
Claude
低token
开源工具
LLM 只当演员,规则引擎当导演:heartmorrow 的架构与取舍
编程
LLM 只当演员,规则引擎当导演:heartmorrow 的架构与取舍
2026-08-27 00:05:49
从架构与设计取舍角度拆解开源项目 heartmorrow:浏览器只连本地服务器、密钥不出本机,规则引擎决定游戏事实、LLM 只负责生成内容,约会结算用独立校验 pass 避免数值漂移。适合关注 LLM 应用架构、AI 游戏设计的工程师参考。
LLM
架构
开源
Node.js
本地部署
AI应用
命令行是 AI Agent 的「高考」:Terminal Bench 2.1 如何用真实任务测出模型上限
编程
命令行是 AI Agent 的「高考」:Terminal Bench 2.1 如何用真实任务测出模型上限
2026-08-15 17:16:04
深度拆解2026年最权威AI Agent评测体系Terminal Bench 2.1:用真实终端任务替代静态题库,从规划能力、工具选择、错误处理等五大维度全面评估Agent水平
Terminal Bench
AI Agent
评测基准
模型评估
LLM
强化学习
Shell
命令行
Terminal Bench 2.1 深度拆解:当「用命令行执行真实任务」成为衡量 AI Agent 能力的黄金标准——2026 评测体系全解析
编程
Terminal Bench 2.1 深度拆解:当「用命令行执行真实任务」成为衡量 AI Agent 能力的黄金标准——2026 评测体系全解析
2026-08-15 17:15:05
深度拆解2026年最权威AI Agent评测体系Terminal Bench 2.1:从真实终端任务设计、沙箱安全机制到五大核心维度评分,配代码示例与行业数据
Terminal Bench
AI Agent
评测基准
模型评估
LLM
强化学习
Shell
命令行
AirLLM 深度实战:8GB 显存跑 405B 大模型——分层推理如何拆掉「显存墙」(2026 实战指南)
编程
AirLLM 深度实战:8GB 显存跑 405B 大模型——分层推理如何拆掉「显存墙」(2026 实战指南)
2026-08-15 09:44:41
深度拆解 AirLLM 分层推理架构:8GB 显存跑 405B 大模型的时间换空间哲学,从 mmap 权重映射、单层计算流水线到完整 Python 实战与 15 条生产级优化建议。
AirLLM
大模型推理
显存优化
LLM
内存推理
Python
性能优化
GPU
从碎片对话到结构化知识:腾讯 Agent Memory 四层记忆架构工程实践
编程
从碎片对话到结构化知识:腾讯 Agent Memory 四层记忆架构工程实践
2026-08-14 15:46:56
深度拆解腾讯开源的 Agent Memory 项目:从 L0 原始对话层到 L3 用户画像层的四层渐进式记忆架构,配完整代码实战与生产级集成指南。
Agent Memory
腾讯云
AI记忆
LLM
TencentDB
知识图谱
个性化AI
向量数据库
PageIndex:无向量推理驱动 RAG 革命,AI 检索如何告别向量嵌入依赖
编程
PageIndex:无向量推理驱动 RAG 革命,AI 检索如何告别向量嵌入依赖
2026-08-11 13:27:39
深度拆解 PageIndex 无向量推理检索框架:从传统向量 RAG 的切块陷阱与 Embedding 失真问题出发,详细解析树形索引构建、LLM 推理定位、精确答案提取的全链路架构,含完整 Python 代码实战、性能对比与生产选型指南。
PageIndex
RAG
向量数据库
推理检索
AI
LLM
检索增强生成
无向量
OpenVINO 2026.3 深度拆解:从 MoE 磁盘卸载到 FP8 量化,Intel 的端侧 AI 推理全家桶又升级了
编程
OpenVINO 2026.3 深度拆解:从 MoE 磁盘卸载到 FP8 量化,Intel 的端侧 AI 推理全家桶又升级了
2026-08-10 11:46:27
深度拆解 Intel OpenVINO 2026.3 四大核心更新:MoE 磁盘卸载让 300B 模型跑在 16GB 机器上、Linux 懒加载消除权重复制、FP8 量化新能力、三条 GenAI 新流水线,配完整代码实战与性能数据对比
OpenVINO
Intel
AI推理
MoE
FP8量化
端侧部署
NNCF
LLM
CPU推理
Intel OpenVINO 2026.3 深度拆解:让 300 亿参数 MoE 模型跑进 16GB 内存的工程实践
编程
Intel OpenVINO 2026.3 深度拆解:让 300 亿参数 MoE 模型跑进 16GB 内存的工程实践
2026-08-09 03:16:31
深度拆解 Intel OpenVINO 2026.3:MoE 模型磁盘卸载(16GB 运行 30B MoE)、FP8 量化、NNCF、持续批处理、至强 6+ AMX 加速、Omni 多模态流水线等核心新特性,含可运行代码与十大生产踩坑清单。
OpenVINO
Intel
AI推理
模型部署
LLM
MoE
FP8量化
持续批处理
异构计算
NPU
CPU优化
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
编程
2026 LLM 推理框架深度拆解:当 vLLM 0.5 决定「让 PagedAttention 吞掉最后一块显存碎片」——从 PagedAttention 到 FlashAttention 3.0,四大推理框架如何用「算子融合 + 量化混合 + 动态批处理」重新定义大模型推理的终极形态
2026-08-06 06:16:32
深度拆解2026年四大主流LLM推理框架:vLLM 0.5 PagedAttention进化、TGI 2.0流式输出优化、TensorRT-LLM 1.8算子融合、DeepSpeed-MII 0.9自动优化,含完整架构分析、代码实战、性能基准测试与成本计算
LLM
vLLM
TensorRT-LLM
推理框架
PagedAttention
量化
GPU
H100
大模型
DeepSpeed
TGI
SkillOpt 深度拆解:当微软决定「像训练神经网络一样训练 Skill」——从轨迹驱动优化到文本空间搜索,一个 3.1K Star 的框架如何用「不改权重只改文档」重新定义 Agent 技能优化的终极形态
编程
SkillOpt 深度拆解:当微软决定「像训练神经网络一样训练 Skill」——从轨迹驱动优化到文本空间搜索,一个 3.1K Star 的框架如何用「不改权重只改文档」重新定义 Agent 技能优化的终极形态
2026-08-05 21:49:06
深度拆解微软开源的SkillOpt框架:用训练神经网络的方法论优化Agent技能文档,不改权重只改Markdown,52个评测组合全部最优,准确率提升20%+
SkillOpt
微软
AI Agent
技能优化
LLM
Prompt工程
强化学习
轨迹优化
文本空间搜索
开源
TradingAgents 深度拆解:当 AI 决定「用多智能体模拟一整家华尔街交易公司」——从 LangGraph 图引擎到多空辩论机制,一个 31.9K Star 的开源框架如何用「七个角色吵出一个交易决策」重新定义金融 AI 的终极形态
编程
TradingAgents 深度拆解:当 AI 决定「用多智能体模拟一整家华尔街交易公司」——从 LangGraph 图引擎到多空辩论机制,一个 31.9K Star 的开源框架如何用「七个角色吵出一个交易决策」重新定义金融 AI 的终极形态
2026-08-05 20:46:07
深度拆解TradingAgents多智能体金融交易框架:7个AI角色模拟华尔街交易公司、LangGraph图引擎编排、多空辩论机制、多数据源集成、68.5%准确率,附完整代码实战与生产部署指南
TradingAgents
Multi-Agent
LLM
金融交易
LangGraph
AI Agent
开源
量化交易
多智能体
Tauric Research
React Compiler 迁移 Rust 深度拆解:当 Meta 决定「用 Rust 重写前端编译器」——从 TypeScript 到 Arena 分配,一个 3 倍性能提升的移植如何用 LLM 辅助重写重新定义前端工具链的终极形态
编程
React Compiler 迁移 Rust 深度拆解:当 Meta 决定「用 Rust 重写前端编译器」——从 TypeScript 到 Arena 分配,一个 3 倍性能提升的移植如何用 LLM 辅助重写重新定义前端工具链的终极形态
2026-08-05 20:14:26
深度拆解Meta将React Compiler从TypeScript重写为Rust:Arena分配、索引数据结构、Turbopack零拷贝集成,3-10倍性能提升,LLM辅助重写的争议与反思
React Compiler
Rust
TypeScript
前端工具链
Meta
Turbopack
Babel
编译器
性能优化
LLM
大家都在搜索什么?
devops
易支付
一个官网+多少钱
统一接受回调
统一回调
python
sub
node
宝塔日志
mysql
shell
ElasticSearch
css
vue
api接口对接
2025
支付接口对接
go
php
php回调
上一页
1
2
3
4
5
6
7
…
12
下一页
共 12 页
到第
页
确定