内容纲要
第四周-周报
2026-06-22 周一
1、开发
2026-06-23 周二
1、开发
2、鄱阳湖算力沟通会议
参会内容:就算力问题进行沟通,
参会人员:江西员工(试用模型之后,负责梳理后提出问题)、东莞总公司人员、九江电信负责人(负责解决问题)
目前算力状况:
昇腾910B服务器4台;一台服务器配8张64GB的910B显卡。单机512GB显存。共计32 * 64 =2048GB,也就是2TB的显存总量、
模型:deepseek v4 pro。现有算力刚好够部署一个模型
痛点&解决办法:
模型调用,生成速度慢,尤其是龙虾智能体接入之后,响应更慢
1)目前显卡的算力明显不够,直接的就是从4台扩充到8台,将显存扩充到两倍。
2)10月份可以换机群,从华为昇腾的910B到910C,效果是910B性能的三倍
试用期20天已经结束,但是还需要继续试用
1)试用结束,先支付费用,延长使用,但是可以按月或者按季度支付
技术方案对比,英伟达H100和华为昇腾AI显卡
3)九江有英伟达的显卡,也可以拿出来部署集群,方便对比英伟达和华为显卡的在部署技术的优劣势。
4)目前英伟达的卡,还做不到集群,但是后期可以做适配,技术实现上没有问题
2026-06-24 周三
1、开发
2、高管项目会议
对接开发项目(先做需求分解):
1)重大投资智能体-李
2)管理钉钉智能体-陈
3)会议管理智能体-袁
4)政企互动智能体-吕
3、重做方案,重提重大投资预立项(算力)
2026-06-25 周四
1、更换minimax-M2.5模型为deepseek v4 flash int8 W8A8模型
2、提投资预立项的OA流程
3、信息化中台建设会议
中泰和神州(数据中台和AI底座的外部供应商)
4、开发组内部会议,给高管项目智能体排期,交代需求
2026-06-26 周五
1、写周报
2、开发
3、参加数字化研发部门周例会,汇报AI开发小组整体开发进展
2026-06-27 周六
1、更换minimax-M2.5模型为deepseek v4 flash int8 W8A8模型,行为失败了。原因是deepseek v4 有DSML的格式问题,openAI协议跟DSML冲突之后,就会存在这个问题。导致无法调用工具。需要切换回minimax
第三周-周报
2026-06-15 周一
1、开发
2026-06-16 周二
1、开发
2、处理claude 商用模型调用额度采购的问题,催采购专员+对接模型额度分发部门
2026-06-17 周三
1、开发
2、统计阿里平头哥PPU架构支持的模型,和江西算力中心的华为昇腾ascend架构支持的模型做对比
3、写智能体开发的项目列表、效果预期、所需资源
4、重写算力需求(说明上中下的需求方案,以及原因、比价策略)
2026-06-18 周四
1、开发
第二周-周报
2026-06-08 周一
1、模型调用失败
问题描述:
祁武强(启泰江西分公司)本地电脑 & 服务器都连接不上AI模型,报错码:503、504
原因定位:
公司对上网策略的限制,服务器网段的上网限制 & 个人电脑网段的上网限制。
验证方法:
更换手机热点,绕开上网策略后,尝试调用模型。
解决方法:
让分公司IT人员开通此AI网关域名的访问权限。已解决
2、提采购OA流程(算力服务器 & claude code)
问题描述:
带显卡的云服务器3台 & 数据库服务器1台,部署智能体项目需要、模型微调需要、部署特定领域模型需要。
claude opus 4.7模型的额度,组内一成员半个月消耗1800元,目前四人小组,一个人900的配额,预期不够,需要走采购。
原因定位:
暂借的服务器无GPU,硬盘空间不足。claude模型额度按部门分发的方案不合理:部门人多人少,都是一万。
解决方法:
走OA流程,提采购。走流程中
3、解决模型问题
问题描述:
谢水星,模型连接超时
(备注:旧的PAI-EAS调用的信息作废,给了一个新的AI网关的账号,已解决)
2026-06-09 周二
1、算力方案
问题描述:
和丽君姐讨论:算力服务器集中购买部署和管理,还是各个分公司进行购买管理
原因定位:
各个分公司的人都在开发智能体,需要部署一些小模型,目前的江西算力中心、集团阿里云算力都是基于华为、阿里云的部署框架,受到这些限制,不能自由的部署和管理市面上开源的模型
验证方法:
问题的痛点在于,阿里云的PAI平台,并不能实时适配市面上新出的模型,比如deepseek v4,并且一些市面上开源的视觉模型,并不支持部署,比如数字人模型,魔搭社区和hugging face平台都有发布开源模型,可用下载部署。但是在PAI平台的模型市场中找不到。
华为的昇腾卡,我估计也是如此。
并且阿里云的PAI平台不支持一卡多模型
解决方法:
模型部署可以集中部署和管理(类似于现在的阿里云-PAI平台和江西的算力中心)因为模型是在市场下载的,嵌入模型、重排模型,很多分公司的需求是重复的,出于成本的计算,可以接模型部署的需求。
至于智能体产品的部署,产品大多不一样,需要现场沟通进行部署,所以需要给开发人员,提供远程访问权限。这些服务器也可以统一采购和管理,将远程权限下发给指定团队人员即可。
可以统一采买、统一管理。
2、算力服务器采购后续
问题描述:
服务器前面应该还要走个投资预立项流程,才行
(备注:去OA流程再加一个预算申请流程,已走流程)
2026-06-10 周三
1、问题描述:
上午和数字化部门讨论算力管理的事情、下午部署qwen3-embedding-8b模型(调整rerank模型)
2026-06-11 周四
1、部署数字人模型
2、下午开会,3点开始,去和数字化部门一起跟阿里员工讨论算力购买和PPU的一些弊端的解决。四点开始和业务开会,介绍已完成的智能体产品,做演示。
2026-06-12 周五
1、跟阿里同事,沟通PAI平台重排模型,接入AI网关,无法调用的问题
记住AI网关的url地址的后缀跟PAI平台的URL访问地址的后缀要一致
2、解决anthropic的claude code无法调用其他的模型的配置问题
3、参加数字化研发部门周例会,汇报AI开发小组整体开发进展
4、解决openclaw 的download链接失败的问题
2026-06-13 周六
请假半天