首页
学习
活动
专区
圈层
工具
发布

#开源

开源是一种源代码可以任意获取的计算机软件,这种软件的版权持有人在软件协议的规定之下保留一部分权利并允许用户学习、修改以及以任何目的向任何人分发该软件。

K8s调度开源文生视频模型可行吗?

李福春code for life . 用代码解决碰到的问题。
已采纳
正:从架构视角,K8s调度开源文生视频模型可行,但要把推理拆成预处理、文本编码、DiT去噪、VAE解码四段,用GPU Operator、MIG或时间片隔离显存,再通过Triton或TensorRT承接并发;短任务走在线池,长任务走离线池,模型权重放对象存储并预热。 反:边界在于文生视频单请求显存和时长远高于LLM,K8s原生调度不看显存碎片,Pod频繁漂移会引发冷启动和OOM;CogVideoX、Wan2.1、Mochi-1的并行策略各异,统一镜像容易变成伪共享,跨节点NVLink缺失时扩卡收益会骤降。 定:可执行验证是搭一个双节点8卡集群,固定16条prompt,分别测单卡、张量并行、流水并行三组,采集P95延迟、显存碎片率、Pod重启次数和队列等待;若P95超过SLA两倍或OOM率高于1%,就退回单模型单池部署,不强行上K8s多租。... 展开详请

开源文生视频模型怎样做基准测试?

李福春code for life . 用代码解决碰到的问题。
已采纳
正:从测试视角,开源文生视频模型基准测试要同时覆盖质量与工程指标。质量侧用VBench、CLIPScore、FVD和固定prompt集,覆盖人物、动物、运动、文字、镜头切换;工程侧测首帧延迟、总生成时长、吞吐、峰值显存和失败重试,环境固定A100/4090、分辨率、帧率、seed与采样步数。 反:但边界是FVD依赖参考分布,CLIPScore与人类观感常背离,人工评分又贵且主观;不同模型默认帧率、分辨率、水印和提示词模板不同,直接横比SVD、CogVideoX、Wan2.1会失真,测试集若只来自公开短视频,会漏掉电商与口播场景。 定:可执行验证是建立三层门禁:冒烟层跑10条prompt查崩溃与OOM,回归层跑100条算VBench与延迟,验收层由3名标注员盲评可用率;每次模型或依赖升级都产出对比报告,低于上版95%可用率或延迟劣化20%即阻断发布。... 展开详请

开源文生视频模型靠什么收费?

李福春code for life . 用代码解决碰到的问题。
已采纳
正:从商业化视角,开源文生视频模型收费不靠卖权重,而靠托管算力、企业私有化、行业模板、API调用、合规审核与运维支持组合;国内Wan2.1、CogVideoX、HunyuanVideo可做本地化与信创适配,海外SVD、Mochi-1可做海外创作者订阅,按生成秒数、并发路数或席位分层报价。 反:但边界是开源许可可能限制商用、模型输出版权归属不清、客户会拿自建集群压价;若只按token或秒数计费,GPU空转和长尾请求会吃掉毛利,而模板和精调若不能显著降低客户制作成本,续费很难成立。 定:可执行验证是选10家种子客户做报价实验,A组按生成时长、B组按席位加算力包,记录试用转化、单客毛利、次月续费和超额用量;只要毛利率低于30%或续费低于60%,就砍掉纯API低价套餐,转向私有化加模板年费。... 展开详请

我们近期在部署qData数据中台开源版,内网环境有没有现成的ARM镜像可以外面下载传到服务器导入的?

目前没有单独提供现成的 ARM 镜像包。如果是内网环境,可以先在有网络的环境下,通过 Docker 指定 ARM 架构拉取 qData 部署所需镜像,再使用 `docker save` 将镜像导出成镜像包,传到内网服务器后通过 `docker load` 加载。镜像加载完成后,就可以按照正常的部署流程启动使用。... 展开详请

DeepSeek Harness(dsh)到底是什么?它和 Claude Code、Codex CLI 有何本质区别?

技术方舟

科大讯飞 | 资深架构师 (已认证)

江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
dsh:更偏“批量任务 + 自动运行 + 评分输出(报告/指标)”。你关心的是:“模型在这组任务上到底多好?稳定不稳定?改动后提升多少?” Claude Code / Codex CLI:更偏“对话/指令驱动 + 代码变更 + 你主导验收”。你关心的是:“这个库/这个功能能不能被它改出来并通过我的验收?”... 展开详请

开源大模型与闭源大模型的核心差距到底在哪?

紫风十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
分三层看。 能力:顶配闭源(GPT-4、Claude 3.5)在复杂推理、长上下文上还领先开源一截。但开源追得快,Llama 3.1 405B、Qwen2.5、DeepSeek V3 把通用能力拉到接近闭源。闭源领先主要靠 RLHF 数据和工程细节。 工程差距更大。闭源背后是上千卡集群 + 自研编译器 + 调度系统。同样参数量的开源模型自部署,延迟和吞吐只有闭源 API 的 60% 到 70%。 数据与合规:开源用公开数据,闭源用了大量专有数据训练,法律金融医疗这些领域开源微调补不上。 落地:toC 直接用闭源 API;toB 涉及合规或深度定制的,开源自部署更可控。盲目追开源不一定省钱,硬件和运维算进去可能比 API 还贵。... 展开详请

假如明天把你们公司的全部源代码开源,或者干脆卖掉,你的公司还剩下什么?

Lean 4自动证明离数学家多远?

V4涨价却开源Harness?

语言世界模型能替代真实环境训练 Agent 吗?

紫风十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
短期内替代不了。语言世界模型用视频和文本预训练,能生成视觉场景的想象,但缺了物理交互的反馈闭环。真实环境训练 Agent 的核心不是看,是做——推门感受阻力、踩地知道软硬、撞墙学到边界,这些 embodied experience 是语言模型给不了的。但 LWM 不是没用,它可以在真实训练前做预训练,让 Agent 带着先验进入物理环境,大幅减少真实交互次数。更可能的路径是 LWM 加仿真器加真实环境的渐进式管线。... 展开详请

第三方量化版的下载量反超原始权重,说明了什么?

技术方舟

科大讯飞 | 资深架构师 (已认证)

江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
如果你真的要确定“最低位宽心理底线”,最有效的方法其实是做一个小评测,而不是只看经验值: 选 10~20 个代表性修复任务(最好包含失败原因:编译错误、接口不匹配、测试失败) 用同一个推理设置(上下文长度、温度、最大步数、是否强制输出 patch 格式) 对比 Q4 vs Q5 vs(更高/更低)在两项指标上的差异: 一次成功率(少轮数完成或无需回滚) 工具链可解析率(patch/格式是否稳定可用)... 展开详请

长程 Agent 的检查点应该做在哪一层?

紫风十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
长程 Agent 的检查点不该放在对话层,应该在工具调用层做。原因很直接:对话上下文丢了可以从检查点恢复,但如果工具执行的中间状态丢了,Agent 会重复执行有副作用的操作(发邮件、写数据库),这才是真正的灾难。具体做法是每次工具调用前后持久化输入参数和输出结果,对话上下文可以用摘要压缩,但工具执行记录必须全量保存。有些框架把检查点放在 LLM 输出层,只存了 prompt 和 response,遇到中途工具失败就抓瞎了。... 展开详请

万亿参数模型开放权重后,中小团队该怎么用起来?

我想把tradingview搬到本地,该如何做?

技术方舟

科大讯飞 | 资深架构师 (已认证)

江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验

分析型数据库开源方法是什么

分析型数据库开源方法是指通过开放源代码的方式,提供分析型数据库的软件实现,允许开发者自由使用、修改和分发这些数据库系统,以满足大数据分析、实时查询等需求。这种方法通常依托于社区协作,推动技术透明化与快速迭代。 解释: 分析型数据库主要用于处理大规模数据的复杂查询与分析任务,比如数据仓库、商业智能(BI)等场景。开源方法使得企业或开发者无需依赖专有商业软件,可以基于开源项目自建或定制适合自己的分析平台,同时降低许可成本,提高灵活性和可控性。 常见的开源分析型数据库包括: - **Apache Doris**:一个现代化的 MPP(大规模并行处理)分析型数据库,支持实时数据导入与高性能查询,适用于多维报表和即席查询。 - **ClickHouse**:面向联机分析处理(OLAP)的列式存储数据库,以高速查询著称,适合日志分析与实时监控场景。 - **Apache Druid**:用于实时探索大规模事件数据的分布式分析数据库,强调低延迟与高并发。 - **Greenplum**:基于 PostgreSQL 的 MPP 数据仓库,适合复杂 SQL 分析与大规模 ETL。 举例: 一家电商企业希望实时分析用户行为日志,以优化推荐系统。该企业可以选择使用 **Apache Doris** 作为开源分析型数据库,将用户点击流、订单等数据实时导入 Doris,利用其高性能的分布式查询能力,快速生成用户画像与商品推荐,支撑前端实时展示。 如果企业希望部署稳定、弹性且易于管理的分析型数据库服务,可以考虑使用腾讯云的 **EMR(Elastic MapReduce)** 或 **云数据仓库 TCHouse-D(基于 Apache Doris)**,它们提供托管的大数据分析服务,支持开源组件一键部署,简化运维,提升效率。其中,TCHouse-D 兼容 Apache Doris 生态,具备高性能、高可用特性,适合构建企业级实时数仓。... 展开详请
分析型数据库开源方法是指通过开放源代码的方式,提供分析型数据库的软件实现,允许开发者自由使用、修改和分发这些数据库系统,以满足大数据分析、实时查询等需求。这种方法通常依托于社区协作,推动技术透明化与快速迭代。 解释: 分析型数据库主要用于处理大规模数据的复杂查询与分析任务,比如数据仓库、商业智能(BI)等场景。开源方法使得企业或开发者无需依赖专有商业软件,可以基于开源项目自建或定制适合自己的分析平台,同时降低许可成本,提高灵活性和可控性。 常见的开源分析型数据库包括: - **Apache Doris**:一个现代化的 MPP(大规模并行处理)分析型数据库,支持实时数据导入与高性能查询,适用于多维报表和即席查询。 - **ClickHouse**:面向联机分析处理(OLAP)的列式存储数据库,以高速查询著称,适合日志分析与实时监控场景。 - **Apache Druid**:用于实时探索大规模事件数据的分布式分析数据库,强调低延迟与高并发。 - **Greenplum**:基于 PostgreSQL 的 MPP 数据仓库,适合复杂 SQL 分析与大规模 ETL。 举例: 一家电商企业希望实时分析用户行为日志,以优化推荐系统。该企业可以选择使用 **Apache Doris** 作为开源分析型数据库,将用户点击流、订单等数据实时导入 Doris,利用其高性能的分布式查询能力,快速生成用户画像与商品推荐,支撑前端实时展示。 如果企业希望部署稳定、弹性且易于管理的分析型数据库服务,可以考虑使用腾讯云的 **EMR(Elastic MapReduce)** 或 **云数据仓库 TCHouse-D(基于 Apache Doris)**,它们提供托管的大数据分析服务,支持开源组件一键部署,简化运维,提升效率。其中,TCHouse-D 兼容 Apache Doris 生态,具备高性能、高可用特性,适合构建企业级实时数仓。

实时数据库有哪些开源的?

开源实时数据库包括InfluxDB、TimescaleDB、OpenTSDB和Druid等。 **解释问题**:实时数据库需支持高频写入、低延迟查询,常用于监控、物联网或金融场景。开源方案提供灵活部署和成本优势。 **举例**: 1. **InfluxDB**:专为时间序列数据优化,适合IoT传感器数据存储,支持高吞吐写入。例如监控服务器CPU使用率时,每秒写入数千条数据并实时查询趋势。腾讯云提供类似功能的时序数据库CTSDB,兼容InfluxDB协议。 2. **TimescaleDB**:基于PostgreSQL的扩展,将时间序列数据分块存储,兼顾关系型查询能力。例如存储设备历史日志并关联设备元数据。腾讯云PostgreSQL支持扩展插件集成。 3. **OpenTSDB**:构建在HBase上的分布式时序库,适合超大规模数据。例如电网监控中存储数百万设备的分钟级读数。腾讯云HBase可提供底层支撑。 4. **Druid**:面向实时分析,擅长快速聚合查询。例如电商实时统计用户点击流数据。腾讯云EMR支持Druid集群部署。 腾讯云相关产品如CTSDB(时序数据库)、TDSQL(支持时序扩展)、HBase及EMR可满足不同实时场景需求。... 展开详请

如何参与开源数据库的开发?

参与开源数据库开发通常需要以下步骤: 1. **选择目标项目** 根据兴趣或需求挑选活跃的开源数据库,如MySQL、PostgreSQL、MongoDB等,或新兴项目如TiDB、CockroachDB。 2. **学习与熟悉代码** 阅读官方文档和代码库,理解架构设计、核心模块及开发规范。例如,PostgreSQL的源码结构清晰,适合新手逐步研究。 3. **从简单任务入手** 通过修复文档错误、优化测试用例或提交小Bug修复开始积累经验。比如为MySQL添加缺失的单元测试用例。 4. **参与社区协作** 在GitHub/GitLab提交Pull Request,响应Issue,或在邮件列表讨论设计方案。积极沟通能提升贡献成功率。 5. **深入核心开发** 熟悉后尝试实现新功能或性能优化,如为MongoDB设计分片策略改进方案。需通过代码审查并符合项目标准。 **腾讯云相关推荐**:若开发过程中需要托管数据库服务测试,可使用腾讯云的**TDSQL**(兼容MySQL/PostgreSQL)或**MongoDB云数据库**,提供高性能实例和便捷管理工具,加速开发验证。... 展开详请

开源式关系型数据库是什么

开源式关系型数据库是指源代码公开、遵循开源协议的关系型数据库管理系统,允许用户自由使用、修改和分发。其核心特点是采用结构化查询语言(SQL)管理数据,通过表格形式存储数据,并支持事务处理、ACID特性等。 **解释**:这类数据库的开放性使开发者能深度定制功能,同时降低企业成本。常见的开源协议如GPL、MIT等规定了使用范围。相比闭源商业数据库,它更灵活但可能需要更多自主维护。 **举例**: 1. **MySQL**:广泛用于Web应用,如电商网站存储订单和用户数据,支持主从复制提升性能。 2. **PostgreSQL**:以高级功能著称,适合复杂查询场景,例如地理信息系统(GIS)存储空间数据。 **腾讯云相关产品**:若需托管服务,可选用**TencentDB for MySQL**或**TencentDB for PostgreSQL**,提供自动备份、弹性扩缩容能力,简化运维流程。... 展开详请

开源社区有哪些优秀的数据库压缩项目?

答案:优秀的开源数据库压缩项目包括 **SQLite 的 ZIPVFS**、**MySQL 的 InnoDB 压缩表**、**PostgreSQL 的 TOAST 机制** 和 **CockroachDB 的透明数据压缩**。 解释: 1. **SQLite ZIPVFS** 是 SQLite 的扩展,允许使用 ZIP 压缩算法存储数据库文件,减少存储占用,适合嵌入式场景。 2. **MySQL InnoDB 压缩表** 支持对表数据进行压缩,通过页级压缩减少磁盘空间使用,适用于读多写少的业务。 3. **PostgreSQL TOAST** 自动压缩大字段(如文本、JSON),通过变长存储优化空间,无需手动干预。 4. **CockroachDB** 提供透明压缩功能,支持 ZSTD 等算法,降低分布式存储成本。 举例: - 使用 **SQLite ZIPVFS** 可以将一个 100MB 的数据库压缩到 30MB 左右,适合物联网设备存储。 - **MySQL InnoDB** 对一张 1GB 的日志表启用压缩后,可能减少到 400MB,节省 60% 空间。 腾讯云相关产品推荐: - 如果使用 **MySQL 或 PostgreSQL**,可搭配 **腾讯云数据库 TDSQL-C** 或 **TDSQL for PostgreSQL**,它们支持原生压缩功能,并提供弹性扩缩容能力。 - 对于 **海量数据存储**,腾讯云 **COS(对象存储)** 可配合压缩工具(如 ZSTD)进一步优化成本。... 展开详请

智能数据库的代码开源与闭源策略有何利弊?

**答案:** 智能数据库的代码开源策略允许用户自由查看、修改和分发源代码,而闭源策略则由厂商控制代码访问权限,仅提供二进制版本。 **开源利弊:** - **优势**:透明度高,用户可自主审计安全性;社区协作加速功能迭代;成本较低(通常免费或低价)。 - **劣势**:企业级支持依赖第三方;定制化可能增加维护复杂度;存在碎片化风险(如不同分支兼容性问题)。 *示例*:MySQL的开源版允许开发者根据需求调整存储引擎,但企业若需官方SLA保障需购买商业许可。 **闭源利弊:** - **优势**:厂商统一优化性能与安全,提供专业技术支持;产品集成度高(如配套工具链);长期稳定性有保障。 - **劣势**:用户无法自主排查底层问题;许可费用较高;创新依赖厂商路线图。 *示例*:某商业智能数据库通过闭源实现自动索引优化,但客户需等待版本更新才能获得新功能。 **腾讯云相关推荐**: - 开源场景可选**TDSQL-C MySQL版**(兼容开源生态,支持灵活扩展),搭配**CODING DevOps**实现代码协作管理。 - 闭源需求可考虑**TDSQL for PostgreSQL**(企业级增强特性),提供7×24小时专家服务及一体化监控方案。... 展开详请
领券