202606-月报-中泰

内容纲要

第四周-周报

2026-06-22 周一

1、开发

2026-06-23 周二

1、开发

2、鄱阳湖算力沟通会议
参会内容:就算力问题进行沟通,

参会人员:江西员工(试用模型之后,负责梳理后提出问题)、东莞总公司人员、九江电信负责人(负责解决问题)

目前算力状况:
昇腾910B服务器4台;一台服务器配8张64GB的910B显卡。单机512GB显存。共计32 * 64 =2048GB,也就是2TB的显存总量、
模型:deepseek v4 pro。现有算力刚好够部署一个模型

痛点&解决办法:

模型调用,生成速度慢,尤其是龙虾智能体接入之后,响应更慢
1)目前显卡的算力明显不够,直接的就是从4台扩充到8台,将显存扩充到两倍。
2)10月份可以换机群,从华为昇腾的910B到910C,效果是910B性能的三倍

试用期20天已经结束,但是还需要继续试用
1)试用结束,先支付费用,延长使用,但是可以按月或者按季度支付

技术方案对比,英伟达H100和华为昇腾AI显卡
3)九江有英伟达的显卡,也可以拿出来部署集群,方便对比英伟达和华为显卡的在部署技术的优劣势。
4)目前英伟达的卡,还做不到集群,但是后期可以做适配,技术实现上没有问题

2026-06-24 周三

1、开发

2、高管项目会议

对接开发项目(先做需求分解):
1)重大投资智能体-李
2)管理钉钉智能体-陈
3)会议管理智能体-袁
4)政企互动智能体-吕

3、重做方案,重提重大投资预立项(算力)

2026-06-25 周四

1、更换minimax-M2.5模型为deepseek v4 flash int8 W8A8模型

2、提投资预立项的OA流程

3、信息化中台建设会议
中泰和神州(数据中台和AI底座的外部供应商)

4、开发组内部会议,给高管项目智能体排期,交代需求

2026-06-26 周五


1、写周报

2、开发

3、参加数字化研发部门周例会,汇报AI开发小组整体开发进展

2026-06-27 周六

1、更换minimax-M2.5模型为deepseek v4 flash int8 W8A8模型,行为失败了。原因是deepseek v4 有DSML的格式问题,openAI协议跟DSML冲突之后,就会存在这个问题。导致无法调用工具。需要切换回minimax

第三周-周报

2026-06-15 周一

1、开发

2026-06-16 周二

1、开发

2、处理claude 商用模型调用额度采购的问题,催采购专员+对接模型额度分发部门

2026-06-17 周三

1、开发

2、统计阿里平头哥PPU架构支持的模型,和江西算力中心的华为昇腾ascend架构支持的模型做对比

3、写智能体开发的项目列表、效果预期、所需资源

4、重写算力需求(说明上中下的需求方案,以及原因、比价策略)

2026-06-18 周四

1、开发

第二周-周报

2026-06-08 周一

1、模型调用失败

问题描述:
祁武强(启泰江西分公司)本地电脑 & 服务器都连接不上AI模型,报错码:503、504
原因定位:
公司对上网策略的限制,服务器网段的上网限制 & 个人电脑网段的上网限制。
验证方法:
更换手机热点,绕开上网策略后,尝试调用模型。
解决方法:
让分公司IT人员开通此AI网关域名的访问权限。已解决

2、提采购OA流程(算力服务器 & claude code)

问题描述:
带显卡的云服务器3台 & 数据库服务器1台,部署智能体项目需要、模型微调需要、部署特定领域模型需要。
claude opus 4.7模型的额度,组内一成员半个月消耗1800元,目前四人小组,一个人900的配额,预期不够,需要走采购。
原因定位:
暂借的服务器无GPU,硬盘空间不足。claude模型额度按部门分发的方案不合理:部门人多人少,都是一万。
解决方法:
走OA流程,提采购。走流程中

3、解决模型问题

问题描述:
谢水星,模型连接超时
(备注:旧的PAI-EAS调用的信息作废,给了一个新的AI网关的账号,已解决)

2026-06-09 周二

1、算力方案

问题描述:
和丽君姐讨论:算力服务器集中购买部署和管理,还是各个分公司进行购买管理
原因定位:
各个分公司的人都在开发智能体,需要部署一些小模型,目前的江西算力中心、集团阿里云算力都是基于华为、阿里云的部署框架,受到这些限制,不能自由的部署和管理市面上开源的模型
验证方法:
问题的痛点在于,阿里云的PAI平台,并不能实时适配市面上新出的模型,比如deepseek v4,并且一些市面上开源的视觉模型,并不支持部署,比如数字人模型,魔搭社区和hugging face平台都有发布开源模型,可用下载部署。但是在PAI平台的模型市场中找不到。
华为的昇腾卡,我估计也是如此。
并且阿里云的PAI平台不支持一卡多模型
解决方法:
模型部署可以集中部署和管理(类似于现在的阿里云-PAI平台和江西的算力中心)因为模型是在市场下载的,嵌入模型、重排模型,很多分公司的需求是重复的,出于成本的计算,可以接模型部署的需求。
至于智能体产品的部署,产品大多不一样,需要现场沟通进行部署,所以需要给开发人员,提供远程访问权限。这些服务器也可以统一采购和管理,将远程权限下发给指定团队人员即可。
可以统一采买、统一管理。

2、算力服务器采购后续

问题描述:
服务器前面应该还要走个投资预立项流程,才行
(备注:去OA流程再加一个预算申请流程,已走流程)

2026-06-10 周三

1、问题描述:
上午和数字化部门讨论算力管理的事情、下午部署qwen3-embedding-8b模型(调整rerank模型)

2026-06-11 周四

1、部署数字人模型

2、下午开会,3点开始,去和数字化部门一起跟阿里员工讨论算力购买和PPU的一些弊端的解决。四点开始和业务开会,介绍已完成的智能体产品,做演示。

2026-06-12 周五

1、跟阿里同事,沟通PAI平台重排模型,接入AI网关,无法调用的问题
记住AI网关的url地址的后缀跟PAI平台的URL访问地址的后缀要一致

2、解决anthropic的claude code无法调用其他的模型的配置问题

3、参加数字化研发部门周例会,汇报AI开发小组整体开发进展

4、解决openclaw 的download链接失败的问题

2026-06-13 周六

请假半天

发表评论

您的邮箱地址不会被公开。 必填项已用 * 标注

滚动至顶部