消息称商汤科技正研发新图像模型:代号 U1 Pro,内部称对标 OpenAI

新浪科技独家获悉,商汤科技近期正秘密研发一款多模态大模型,该模型主要面向设计场景打造,由商汤科技联合创始人、首席科学家林达华牵头负责,意在对标 OpenAI 旗下 GPT-Image 2,打造一款“会思考”的图像生成模型。

目前,该模型在内部代号为U1 Pro,由商汤研究院推进研发,属于商汤日日新模型家族成员。预计今年 7 月该模型将启动内部邀请测试,并向客户提供服务。

据知情人士透露,面对复杂设计需求,该模型能像“会思考的设计师”一样,实现设计、生成、评审的长程循环,且支持 8K 分辨率输出。该知情人士介绍,在大量内部评测中,在相同提示词下,该U1 Pro模型生成的图片,与 GPT-Image-2 生成的图片效果高度接近,甚至更具优势。

4 个赞

感觉很难,能达到即梦的水平就很厉害了,还很难追上gpt

3 个赞

其实我在家都是对标吴彦祖的。
:sweat_smile:

11 个赞

对标嘛 就是目标,目标就是还差得远

1 个赞

甚至不愿出一张图让大伙看看效果如何

4 个赞

一听8K就知道是超分上去的了 :face_with_raised_eyebrow: 把咱们当小日子整啊

1 个赞

是竞技场那个吗

竞技场有一个新模型

新绘图模型好像出现在匿名竞技场 - 前沿快讯 / 前沿快讯, Lv1 - LINUX DO新绘图模型好像出现在匿名竞技场 - 前沿快讯 / 前沿快讯, Lv1 - LINUX DO

3 个赞

商汤的生图我最近试了很多次,sensenova-u1-fast 这个生图模型适合生成一些简单线条的图片,画人物完全不行。如果比这种风格的话国内还算是比较好的,智谱、百度、龙猫的生图还要拉跨,除了这些也就是字节和阿里还算强一点,目前多模态生成国内的研究兴致确实不高

1 个赞

先等出来尝尝咸淡,对不对标的,到时候就知道啥水平了

1 个赞

到时候真大规模发布就知道了,是骡子是马出来溜溜呗

连 sensenova 里的 ds4f 都弄不明白(降智、疯狂截断,还有 各种400报错,连中转站都不如的水平),免费都没人用的东西,就别自己搞基模research了。

商汤的Artist v1.0 Alpha 其实很不错,之前我在他们官网免费用的,有mid的感觉,而且能8k,后来加了个水印就很恶心了

https://token.sensenova.cn/v1里已经能获取sensenova-u1-fast模型了,但是提示无权限使用。

更新:
要用这个请求地址:https://token.sensenova.cn/v1/images/generations
但是加了官方推荐的参数后,sensenova-u1-fast模型生成的图片效果实在不行。

对于生成复杂信息图,我们强烈推荐使用以下参数:–cfg_scale 4.0、–timestep_shift 3.0 和 --num_steps 50。