分类:AI模型

Anthropic协议01、Anthropic底层协议快速理解

<p>本文快速拆解 Anthropic Messages API 的底层 wire 协议:system 顶层字段、content block 消息结构、SSE 流式事件,以及 tool_use / tool_result 工具调用细节,并用完整 curl 演练非流式与流式两轮工具调用的真实请求与响应。</p>

OpenAI协议01、OpenAI底层协议快速理解

<p>本文快速拆解 OpenAI Chat Completions 底层协议:messages 请求体、chat.completion 响应、finish_reason、SSE 流式增量及 function calling 的 tool_calls 细节,并用 curl 演练两轮工具调用的真实请求与响应。</p>

LM Studio 本地部署大模型

<p>详解如何在Mac(M1/M2/M3/M4)用LM Studio零配置本地运行Llama、DeepSeek、Qwen等开源大模型,支持MLX极速格式与OpenAI兼容API,16GB内存即可流畅体验,全程离线保护隐私。</p>

部署模型平台选型指南:LM Studio vs Xinference

<p>对比LM Studio与Xinference在大模型商业部署中的许可证、性能与扩展性差异,指出LM Studio因禁止大规模商用及缺乏生产级功能而不适合商业场景,Xinference凭借Apache 2.0协议与分布式架构成为企业安全高效部署开源大模型的首选,同时提醒务必审查模型许可证以确保合规。</p>

04、LangChain4j快速对接VL视觉理解模型

<p>本文详细介绍了如何使用LangChain4j框架对接阿里云qwen3-vl-plus视觉理解模型,支持图片URL和本地文件两种多模态交互方式,包含完整的Java代码示例与iflow平台免费模型调用实践。</p>

Milvus向量库Java对接使用指南

<p>系统梳理Milvus向量数据库的核心概念与实战技巧,涵盖Collection Schema设计、索引类型选型、内存估算、过滤/分组/混合搜索调优及MilvusClientV2升级注意事项,助力高召回低延迟的向量检索落地。</p>