首页
学习
活动
专区
圈层
工具
发布
首页标签大模型部署

#大模型部署

GPT-6 Astra API 接入实操:从 GPT-5.6 迁移的四个 Breaking Change

用户12727346

OpenAI 于 2026 年 9 月 3 日发布 GPT-6 Astra(模型 ID 为 gpt-6-astra),把上下文窗口拉到 105 万 token,...

600

东南亚头部企业 DMARC 部署现状与域名仿冒风险防控研究

芦笛

中国互联网络信息中心 | 工程师 (已认证)

域名消息身份验证合规协议 DMARC 是抵御企业域名仿冒、商业邮件劫持以及 AI 生成式钓鱼攻击的基础技术手段。基于 Proofpoint 针对财富东南亚 50...

100

国内怎么用上 Claude Code:从零到跑通的完整步骤(2026 年 9 月实测)

用户6170966

国内用 Claude Code 一共三条路:官方订阅(要海外信用卡和稳定网络)、API 中转(改一个环境变量,国内直连)、换国产模型(用 GLM、DeepSee...

1300

大模型API调用核心拆解:详解流式输出、Token管控、限流处理与模型调度容错方案22.0

未闻花名

在大模型实际应用过程中,多数线上稳定性故障,并非源于模型推理精度缺陷,而是研发人员对大模型API底层交互机制认知不足,缺少标准化的流量管控、异常容错与调度治理方...

900

国内 Claude Code 第三方接入工具分五类:怎么分辨、怎么自己验(OpenRouter / Code2AI / CC Switch 实测)

用户6170966

国内确实有一批「针对 Claude Code 的第三方工具」,但它们不是一类东西,混在一起比较毫无意义。按「你把 Key 和代码交给谁」来分,一共五类:网页端聚...

1300

AI大模型全景解读:从“参数竞赛”到“智能涌现”

闪 学it

如果说2023年是AI大模型的“元年”,那么2026年则是它们真正融入基础设施的“深耕之年”。从最初仅供少数研究员把玩的巨量参数,到如今每个人手机里都能跑起来的...

2700

# LLM 量化到底省不省电?我造了一个实测专家替你算

用户9867296

做 LLM 推理部署的人都会默认一件事:模型量化 = 省显存 = 省电。但我在 5 款消费级 GPU 上、从 0.5B 到 14B 的模型里跑了 42 组实测数...

3000

视频生成模型 API 接入实战:即梦 Seedance 2.0、可灵、通义万相统一调用方案

用户12727346

即梦 Seedance 2.0、可灵 Kling、通义万相 Wan 2.5 这类视频生成模型,官方接口各有各的参数命名和鉴权方式,但调用形态高度一致:都是提交任...

3500

AI Infra 系列 · 第六章 · GPU 性能工程(一):训练慢,先别改代码,先做一次性能体检

dongdonglog

假设你手里有个 MoE 模型在训,一个训练步(forward + backward + 优化器)跑得很慢。直觉告诉你:肯定是专家层的矩阵乘法(matmul)太慢...

2510

大模型写文章:从原理到10行代码实战

闪学it点com

当我们谈论“AI大模型”时,指的是拥有数百亿甚至数万亿参数的巨型神经网络(如GPT-4、DeepSeek-V3、Llama 3)。它们不再是简单的“软件工具”,...

2200

亲测被驳回 4 次后才懂:算法备案和"生成合成标识"是两件事

AI算法大模型备案当当

先声明一句:我不是法务,也没有任何机构背景,只是一个把算法备案从零跑到拿号、又差点在"内容标识"上栽跟头的 SaaS 团队负责人。这篇文章把我在坑里爬出来的认知...

2510

Claude Code 接入服务的七项核查:主体、退款条款与付款方式怎么自己验证

用户6170966

先给结论,赶时间的可以只看这张表。下面七条都能在自己的浏览器里查完,不用联系客服,一条都不用问人:

3500

MCP 实战:30 分钟写一个能查本地文件的 Server(从 0 到 1)

用户12727346

今年下半年「MCP(Model Context Protocol)」几乎成了 AI 圈的高频词。它的定位很简单:给大模型和外挂工具之间定一套统一接口,就像 US...

8310

视觉大模型开发:从多模态融合架构到高效训练与推理部署的工程实践

用户12502927

视觉大模型开发:从多模态融合架构到高效训练与推理部署的工程实践,这绝非仅仅是将一张图片“喂”给大语言模型(LLM)那么简单。当我们在为GPT-4V(Vision...

12810
领券