腾讯云
开发者社区
文档
建议反馈
控制台
登录/注册
首页
学习
活动
专区
圈层
工具
MCP广场
文章/答案/技术大牛
搜索
搜索
关闭
发布
首页
标签
模型
#
模型
关注
专栏文章
(39.9K)
技术视频
(17)
互动问答
(3K)
关于本地化ai的自我学习以及完善大模型?
0
回答
模型
、
Agent 记忆服务
大模型时代,程序员会被逐步替代吗?
0
回答
程序员
、
模型
、
前端
workbuddy9月4日更新后无法使用?
0
回答
bug
、
模型
、
日志
、
网络
、
WorkBuddy
垂直领域大模型真的比通用大模型更好用吗?
1
回答
模型
、
前端
紫风
十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
不能一刀切。垂域模型在边界清晰、数据封闭的场景里确实更稳,比如医疗诊断、法律文书、工业质检,这些领域需要严格术语和可控输出。但代价是通用能力下降,换个场景就拉胯。通用大模型胜在迁移快、脑洞多,适合探索性任务。关键不在模型本身,而在于你有没有高质量领域数据做微调或RAG。数据质量不行,垂域模型照样胡说;数据做得好,通用模型加知识库也能打。选型时把准确率和成本放在一起看,别为了一点提升牺牲可维护性。...
展开详请
赞
0
收藏
0
评论
0
分享
不能一刀切。垂域模型在边界清晰、数据封闭的场景里确实更稳,比如医疗诊断、法律文书、工业质检,这些领域需要严格术语和可控输出。但代价是通用能力下降,换个场景就拉胯。通用大模型胜在迁移快、脑洞多,适合探索性任务。关键不在模型本身,而在于你有没有高质量领域数据做微调或RAG。数据质量不行,垂域模型照样胡说;数据做得好,通用模型加知识库也能打。选型时把准确率和成本放在一起看,别为了一点提升牺牲可维护性。
大模型会不会走向同质化内卷?
0
回答
模型
、
前端
中转站的国内外模型都比官网便宜,到底是如何做到的?
1
回答
模型
、
上海同盟
紫风
十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
已采纳
本质上是规模化采购加流量套利。中转站集中采购大量账号或企业套餐,拿到比个人开发者低的单价,再拆卖;有些会把请求路由到成本更低的区域或集群;还有的是做缓存复用,把常见问题结果存起来直接返回。但要注意,这种模式有隐患:账号可能被封、响应稳定性差、数据经过第三方有合规风险。如果项目对延迟和隐私敏感,建议直接走官方渠道;如果只是实验性质,中转站能省点钱。...
展开详请
赞
1
收藏
0
评论
0
分享
本质上是规模化采购加流量套利。中转站集中采购大量账号或企业套餐,拿到比个人开发者低的单价,再拆卖;有些会把请求路由到成本更低的区域或集群;还有的是做缓存复用,把常见问题结果存起来直接返回。但要注意,这种模式有隐患:账号可能被封、响应稳定性差、数据经过第三方有合规风险。如果项目对延迟和隐私敏感,建议直接走官方渠道;如果只是实验性质,中转站能省点钱。
大模型推理成本,还有多大下降空间?
1
回答
模型
、
前端
紫风
十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
还有下降空间,但边际收益会递减。看得见的路径:模型压缩、量化、蒸馏出小模型;推理侧做KV Cache复用、动态批处理、投机采样;基础设施用更密的算力和更优的调度。但真正的成本大头是业务侧的无脑调用,比如长上下文塞垃圾、反复重试、不分流复杂任务。接下来成本下降更多来自工程化,而不是单纯等模型降价。建议先把自己的调用链路审计一遍,别盯着厂商价格表。...
展开详请
赞
0
收藏
0
评论
0
分享
还有下降空间,但边际收益会递减。看得见的路径:模型压缩、量化、蒸馏出小模型;推理侧做KV Cache复用、动态批处理、投机采样;基础设施用更密的算力和更优的调度。但真正的成本大头是业务侧的无脑调用,比如长上下文塞垃圾、反复重试、不分流复杂任务。接下来成本下降更多来自工程化,而不是单纯等模型降价。建议先把自己的调用链路审计一遍,别盯着厂商价格表。
企业落地AI大模型最容易踩哪些坑?
2
回答
企业
、
模型
、
前端
技术方舟
科大讯飞 | 资深架构师 (已认证)
江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
我认为是:选题、数据、工程化、评估与治理、运营成本这几类关键环节 1、把大模型当“万能功能”,在信息不完整、规则要求极高、价值链不清晰的场景硬上。结果是演示很炫、落地却不稳定或不赚钱。 2、上线前只做主观体验;上线后也没有稳定的离线评测集与在线监控,导致“今天好用、明天不可控”。 3、直接把大量文档丢进向量库,导致“检索不到正确证据”,模型只能胡编;或文档版本混乱、权限混用。 4、把大模型当客服文本生成器,缺少与业务系统的接口、状态管理、幂等、回滚等工程能力。 5、不做细粒度权限控制;把敏感数据无意间暴露到提示词或日志;缺少审计与脱敏策略。 6、上线后发现调用成本远超预期(尤其是高并发、长上下文、反复重试、复杂推理)。 7、没有 SLA(响应时间、成功率)、没有超时/熔断/降级,导致高峰期体验崩坏。 8、没有“何时必须人工复核”的阈值;或者把所有内容都让人改,成本爆炸。 9、过度依赖单一平台接口,导致后续更换模型/服务困难;数据与评测也绑定在某家系统里。 10、团队只会做 Demo,缺少持续运营:问题收集、指标看板、版本治理、SOP、培训与交付。...
展开详请
赞
1
收藏
0
评论
0
分享
我认为是:选题、数据、工程化、评估与治理、运营成本这几类关键环节 1、把大模型当“万能功能”,在信息不完整、规则要求极高、价值链不清晰的场景硬上。结果是演示很炫、落地却不稳定或不赚钱。 2、上线前只做主观体验;上线后也没有稳定的离线评测集与在线监控,导致“今天好用、明天不可控”。 3、直接把大量文档丢进向量库,导致“检索不到正确证据”,模型只能胡编;或文档版本混乱、权限混用。 4、把大模型当客服文本生成器,缺少与业务系统的接口、状态管理、幂等、回滚等工程能力。 5、不做细粒度权限控制;把敏感数据无意间暴露到提示词或日志;缺少审计与脱敏策略。 6、上线后发现调用成本远超预期(尤其是高并发、长上下文、反复重试、复杂推理)。 7、没有 SLA(响应时间、成功率)、没有超时/熔断/降级,导致高峰期体验崩坏。 8、没有“何时必须人工复核”的阈值;或者把所有内容都让人改,成本爆炸。 9、过度依赖单一平台接口,导致后续更换模型/服务困难;数据与评测也绑定在某家系统里。 10、团队只会做 Demo,缺少持续运营:问题收集、指标看板、版本治理、SOP、培训与交付。
DeepSeek Harness(dsh)到底是什么?它和 Claude Code、Codex CLI 有何本质区别?
2
回答
开源
、
cli
、
code
、
模型
、
腾讯云智能体应用引擎
技术方舟
科大讯飞 | 资深架构师 (已认证)
江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
dsh:更偏“批量任务 + 自动运行 + 评分输出(报告/指标)”。你关心的是:“模型在这组任务上到底多好?稳定不稳定?改动后提升多少?” Claude Code / Codex CLI:更偏“对话/指令驱动 + 代码变更 + 你主导验收”。你关心的是:“这个库/这个功能能不能被它改出来并通过我的验收?”...
展开详请
赞
2
收藏
0
评论
0
分享
dsh:更偏“批量任务 + 自动运行 + 评分输出(报告/指标)”。你关心的是:“模型在这组任务上到底多好?稳定不稳定?改动后提升多少?” Claude Code / Codex CLI:更偏“对话/指令驱动 + 代码变更 + 你主导验收”。你关心的是:“这个库/这个功能能不能被它改出来并通过我的验收?”
小参数模型未来能否打赢超大参数大模型?
2
回答
模型
、
前端
技术方舟
科大讯飞 | 资深架构师 (已认证)
江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
在垂直领域,肯定是小参数模型超越超大参数大模型,可以了解一下:026 年 8 月 26 日,Google Research 放出 GlucoFM,一个面向连续血糖监测的基础模型。它拿 109,066 小时没人标注过的血糖曲线做自监督预训练,可训练参数只有 0.72M,却在 14 组临床任务评估上压过所有同语料重训的专用基线。...
展开详请
赞
1
收藏
0
评论
0
分享
在垂直领域,肯定是小参数模型超越超大参数大模型,可以了解一下:026 年 8 月 26 日,Google Research 放出 GlucoFM,一个面向连续血糖监测的基础模型。它拿 109,066 小时没人标注过的血糖曲线做自监督预训练,可训练参数只有 0.72M,却在 14 组临床任务评估上压过所有同语料重训的专用基线。
每次大模型测试有可能用不同的harnass工程测试?
2
回答
模型测试
、
测试
、
模型
、
腾讯云架构师技术同盟
技术方舟
科大讯飞 | 资深架构师 (已认证)
江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
每次大模型测试都可以使用不同的 Harness 工程,例如: 不同模型需要不同的 API、鉴权或请求格式; 云端模型、本地模型和推理服务的部署方式不同; 不同团队使用各自的评测框架; 专项测试需要独立 Harness,例如安全、性能、Agent、RAG 测试。 但如果每次都更换整个 Harness 工程,测试结果往往不能直接横向比较。Harness 的提示词模板、采样参数、评分器、重试机制、超时设置和结果解析方式,都可能影响最终分数。...
展开详请
赞
2
收藏
0
评论
1
分享
每次大模型测试都可以使用不同的 Harness 工程,例如: 不同模型需要不同的 API、鉴权或请求格式; 云端模型、本地模型和推理服务的部署方式不同; 不同团队使用各自的评测框架; 专项测试需要独立 Harness,例如安全、性能、Agent、RAG 测试。 但如果每次都更换整个 Harness 工程,测试结果往往不能直接横向比较。Harness 的提示词模板、采样参数、评分器、重试机制、超时设置和结果解析方式,都可能影响最终分数。
大模型的版权问题该如何界定?
1
回答
模型
、
前端
技术方舟
科大讯飞 | 资深架构师 (已认证)
江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
大模型的版权问题目前尚无全球统一定论,通常可从四个层面界定: 1. 训练数据的版权 2. 模型参数是否构成侵权复制品 3. 生成内容的版权归属 4. 输出是否侵害他人版权 责任分配上,开发者应重视训练数据来源、权利人退出机制、过滤与防止记忆化输出;平台应建立投诉和处理机制;使用者则应避免要求复刻具体在世作者或特定作品,并在商用前进行相似性和授权审查。因此,较稳妥的原则是:训练环节看数据授权与法定例外,生成环节看人类创作贡献,使用环节看是否实质性复制具体表达,同时以合同条款和适用法域为准。...
展开详请
赞
2
收藏
0
评论
1
分享
大模型的版权问题目前尚无全球统一定论,通常可从四个层面界定: 1. 训练数据的版权 2. 模型参数是否构成侵权复制品 3. 生成内容的版权归属 4. 输出是否侵害他人版权 责任分配上,开发者应重视训练数据来源、权利人退出机制、过滤与防止记忆化输出;平台应建立投诉和处理机制;使用者则应避免要求复刻具体在世作者或特定作品,并在商用前进行相似性和授权审查。因此,较稳妥的原则是:训练环节看数据授权与法定例外,生成环节看人类创作贡献,使用环节看是否实质性复制具体表达,同时以合同条款和适用法域为准。
大模型训练为什么需要消耗巨量算力?
2
回答
模型
、
前端
紫风
十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
参数量摆在那,千亿模型每次前向反向都要过一遍所有参数,还得存梯度、优化器状态和激活值。数据量也大,几千亿token要反复扫多轮。Transformer的注意力计算复杂度跟序列长度平方成正比,长上下文尤其烧钱。再加上分布式训练几千张卡同步梯度、通信、故障恢复,这些都不是线性开销。预训练完了还要微调、对齐、RLHF,每一轮都是钱。...
展开详请
赞
1
收藏
0
评论
1
分享
参数量摆在那,千亿模型每次前向反向都要过一遍所有参数,还得存梯度、优化器状态和激活值。数据量也大,几千亿token要反复扫多轮。Transformer的注意力计算复杂度跟序列长度平方成正比,长上下文尤其烧钱。再加上分布式训练几千张卡同步梯度、通信、故障恢复,这些都不是线性开销。预训练完了还要微调、对齐、RLHF,每一轮都是钱。
求助,为啥我的workbuddy积分用完了,免费的模型hy3,hy4,我自己绑定api都不能用了?
1
回答
api
、
模型
、
软件需求
、
WorkBuddy
九五
热爱学习
是不是用的企业版?如果用的是企业版的话过期只有就用不了了
赞
0
收藏
0
评论
0
分享
是不是用的企业版?如果用的是企业版的话过期只有就用不了了
企业咨询服务用哪个免费模型更好?WORKBUDDY现在免费要排队,不好用
0
回答
企业
、
企业组织
、
模型
、
WorkBuddy
国内大模型距离世界第一梯队还差什么?
2
回答
模型
、
前端
技术方舟
科大讯飞 | 资深架构师 (已认证)
江湖人称“山哥”,在数字化、人工智能、电商和金融等领域积累了丰富的平台架构设计经验
国内大模型已处于全球第一梯队附近,尤其在中文理解、工程部署、开源生态和成本优化方面进步很快。但若以“全球最领先水平”衡量,主要仍有几方面差距: 1、基础研究与原创范式 国内模型在架构、训练方法和工程优化上跟进迅速,但引领性的底层创新相对较少。下一阶段竞争不只是扩大参数和数据,而是突破推理、记忆、世界模型、智能体学习等新范式。 2、高质量数据与数据治理 公开中文数据丰富,但高可信、专业化、可授权、跨语言的高质量数据仍不足。代码、科研、法律、医疗、工业等领域数据的清洗、标注、版权合规和持续更新能力尤为关键。 3、高端算力与软硬件生态 顶级训练依赖高性能芯片、先进互联网络、集群调度和训练框架。国内在可用算力、芯片性能稳定性、集群规模和软硬协同上仍面临约束,影响超大规模实验的频率和效率。 4、复杂推理与可靠性 在数学、代码、长链推理、复杂工具调用等任务中,模型不仅要“答对”,还要稳定、可验证、可追溯。降低幻觉、提升事实准确率与任务执行成功率,是从“能聊天”到“能办事”的核心差距。 5、原生应用与全球生态 真正的领先还取决于是否形成高频、刚需、可规模化的产品,以及开发者、企业、科研机构共同参与的生态。国内落地速度快,但面向全球用户的产品影响力、基础工具链和标准话语权仍需加强。 因此,差距不应简单理解为“参数规模不够”。更重要的是形成“算力—数据—算法—人才—应用—商业回报”持续循环,并在安全、版权、隐私和评测体系上建立可信能力。...
展开详请
赞
1
收藏
0
评论
0
分享
国内大模型已处于全球第一梯队附近,尤其在中文理解、工程部署、开源生态和成本优化方面进步很快。但若以“全球最领先水平”衡量,主要仍有几方面差距: 1、基础研究与原创范式 国内模型在架构、训练方法和工程优化上跟进迅速,但引领性的底层创新相对较少。下一阶段竞争不只是扩大参数和数据,而是突破推理、记忆、世界模型、智能体学习等新范式。 2、高质量数据与数据治理 公开中文数据丰富,但高可信、专业化、可授权、跨语言的高质量数据仍不足。代码、科研、法律、医疗、工业等领域数据的清洗、标注、版权合规和持续更新能力尤为关键。 3、高端算力与软硬件生态 顶级训练依赖高性能芯片、先进互联网络、集群调度和训练框架。国内在可用算力、芯片性能稳定性、集群规模和软硬协同上仍面临约束,影响超大规模实验的频率和效率。 4、复杂推理与可靠性 在数学、代码、长链推理、复杂工具调用等任务中,模型不仅要“答对”,还要稳定、可验证、可追溯。降低幻觉、提升事实准确率与任务执行成功率,是从“能聊天”到“能办事”的核心差距。 5、原生应用与全球生态 真正的领先还取决于是否形成高频、刚需、可规模化的产品,以及开发者、企业、科研机构共同参与的生态。国内落地速度快,但面向全球用户的产品影响力、基础工具链和标准话语权仍需加强。 因此,差距不应简单理解为“参数规模不够”。更重要的是形成“算力—数据—算法—人才—应用—商业回报”持续循环,并在安全、版权、隐私和评测体系上建立可信能力。
本地部署大模型,门槛究竟有多高?
0
回答
部署
、
模型
、
前端
大模型的幻觉问题,有可能被彻底解决吗?
0
回答
模型
、
前端
普通开发者该如何低成本上手大模型开发?
0
回答
开发
、
开发者
、
模型
、
前端
开源大模型与闭源大模型的核心差距到底在哪?
4
回答
开源
、
模型
、
前端
紫风
十五年服务端架构专家,用高可用承载亿级流量,用高性能支撑毫秒级响应。为业务增长提供坚实的技术底座。
分三层看。 能力:顶配闭源(GPT-4、Claude 3.5)在复杂推理、长上下文上还领先开源一截。但开源追得快,Llama 3.1 405B、Qwen2.5、DeepSeek V3 把通用能力拉到接近闭源。闭源领先主要靠 RLHF 数据和工程细节。 工程差距更大。闭源背后是上千卡集群 + 自研编译器 + 调度系统。同样参数量的开源模型自部署,延迟和吞吐只有闭源 API 的 60% 到 70%。 数据与合规:开源用公开数据,闭源用了大量专有数据训练,法律金融医疗这些领域开源微调补不上。 落地:toC 直接用闭源 API;toB 涉及合规或深度定制的,开源自部署更可控。盲目追开源不一定省钱,硬件和运维算进去可能比 API 还贵。...
展开详请
赞
1
收藏
0
评论
0
分享
分三层看。 能力:顶配闭源(GPT-4、Claude 3.5)在复杂推理、长上下文上还领先开源一截。但开源追得快,Llama 3.1 405B、Qwen2.5、DeepSeek V3 把通用能力拉到接近闭源。闭源领先主要靠 RLHF 数据和工程细节。 工程差距更大。闭源背后是上千卡集群 + 自研编译器 + 调度系统。同样参数量的开源模型自部署,延迟和吞吐只有闭源 API 的 60% 到 70%。 数据与合规:开源用公开数据,闭源用了大量专有数据训练,法律金融医疗这些领域开源微调补不上。 落地:toC 直接用闭源 API;toB 涉及合规或深度定制的,开源自部署更可控。盲目追开源不一定省钱,硬件和运维算进去可能比 API 还贵。
热门
专栏
腾讯云中间件的专栏
323 文章
133 订阅
腾讯云 DNSPod 团队
777 文章
55 订阅
腾讯开源的专栏
511 文章
120 订阅
腾讯云服务器团队的专栏
218 文章
324 订阅
领券