如果您正在考虑把 AI 放进公司、接入企业微信或内部资料,下面先用容易理解的方式回答常见问题。显存、推理框架等技术细节,会在确定业务需求后再进行评估。

先回答客户最关心的问题

没有服务器,可以把大模型装在公司吗?

可以。我们可以协助规划软硬一体总包;如果客户已有服务器、私有云或指定硬件供应商,也可以只提供模型部署、系统接入、应用开发、测试验收和运维。

已有服务器,但模型没有稳定运行,能处理吗?

可以。我们会先检查设备、网络、运行环境、模型文件和现有问题,再确定是优化现有系统、重新部署,还是分阶段调整方案。

能不能安排深圳上门实施?

可以。深圳可提供现场勘察、设备安装、模型部署、系统联调、培训、验收和后续运维;香港上门不包含在标准服务范围内,需另行确认。

可以接入企业微信、CRM 和 OA 吗?

可以评估企业微信应用、CRM、OA、WPS、Microsoft 365、内部知识库及其他系统的接口、账号和权限边界,再确定接入范围。

AI 能根据企业自己的资料回答吗?

可以。通过企业知识库和 RAG(检索增强生成),AI 会先查找企业授权资料,再组织回答,并尽量保留文档出处,方便复核。

员工会看到全部资料吗?

不应该。知识库需要继承企业已有的账号、部门、项目和文档权限,并通过测试确认不同身份不能检索无权访问的资料。

可以先做一个部门或一个场景吗?

可以。20–50 人企业或一个部门可以先从知识问答、文档分析、研发/法务助手或数字员工开始,再根据真实使用情况扩展。

可以部署哪些模型?

可以按业务和设备条件评估 Qwen3.8-27B、DeepSeek-V4-Flash、GLM-5.3-Flash 等模型,也可以评估其他兼容模型。最终要结合模型版本、许可证、上下文、并发和实测效果确认。

设备、模型与部署周期

需要买哪一种服务器?

没有一套设备适合所有企业。我们会根据模型、使用人数、上下文长度、响应目标和现有机房条件判断单机、双节点或多节点方案;客户也可以自行采购设备。

为什么不能只按模型参数量选设备?

除了模型权重,还要考虑上下文、运行时开销、并发、缓存和安全余量。最终需要用真实问题和业务负载测试,而不是只看一张显存表。

没有自有机房怎么办?

可以评估专属私有云、合规托管机房或混合方式。选择时要同时确认资料存放位置、网络出口、远程运维、备份恢复和责任边界。

DeepSeek、Qwen、GLM 和 Llama 都能部署吗?

要看具体型号的许可证、运行框架和硬件适配情况。当前可以评估 DeepSeek-V4-Flash、Qwen3.8-27B、GLM-5.3-Flash 等模型,但不承诺所有版本在所有设备上都能达到相同效果。

项目通常需要多久?

取决于设备是否到位、模型文件、网络边界、资料整理、系统接入和验收范围。概念验证、部门试点和正式生产的周期不同,评估后再确定计划。

数据安全与合规

如何证明资料没有跑到外部?

可以把模型、文档、向量数据和日志放在指定环境,并通过网络策略、身份认证、权限控制和访问日志验证。严格离线场景还需要规划模型和补丁的受控导入。

外企在深圳部署要注意什么?

需要同时确认总部系统、中国区网络、个人信息、重要数据和跨境访问要求。技术方案可以提供配置和测试证据,但具体合规结论由客户法务、隐私或总部治理团队确认。

香港团队和深圳团队可以共用一套系统吗?

可以评估统一模型服务或分区部署,但要先确认数据是否允许跨境、身份权限如何继承、系统如何连接以及故障时的服务边界。

费用、验收与维护

大模型本地部署大概要多少钱?

预算通常分为设备与配套、基础实施、业务模块和年度运维。已有设备时可以只计算软件实施;没有设备时再评估软硬一体总包。可以先使用预算估算器查看含税区间,正式报价需结合现场条件确认。

本地部署和云端 API 哪个更划算?

低调用量、短期试验和波动大的任务通常更适合云端 API;稳定使用、敏感资料或深度系统接入的任务更值得评估本地部署。应按相同服务周期比较设备、网络、实施、维护和调用成本。

项目如何验收?

至少确认功能、性能、安全和运维四类指标,包括问答、接口、权限、日志、响应时间、并发、备份、恢复、升级和交接文档。指标应在实施前确定。

上线后谁负责维护?

客户 IT 团队可以承担日常工作,也可以按合同由我们提供监控、升级、备份、故障支持和深圳现场协助。具体工作量和响应范围以合同为准。

联系我们

告诉我们希望 AI 帮谁做什么、资料在哪里、是否已有设备、需要接入哪些系统,以及是否需要深圳上门实施,我们会先帮您判断适合的路径。

电话:+86 139 2521 1225 邮箱:tianjun@jsle.cn