人工智能 新版GPT Image 2.5曝光:伪造发布会截图几可乱真 OpenAI即将推出的GPT Image 2.5模型被曝可生成高度逼真的图像,甚至能伪造GPT-6发布会截图和奥特曼推文,文字与面孔均无明显破绽。
人工智能 MiniMax H3 通用视频模型开源:支持多模态上下文与 2K 视频生成 MiniMax H3 正式开源,可理解文本、图像、视频、音频等多模态输入,生成最长 15 秒、最高 2K 分辨率视频。
人工智能 商汤发布旗舰级多模态智能体SenseNova U1 Pro,长程任务闭环成核心突破 在2026世界人工智能大会上,商汤科技正式推出SenseNova U1 Pro,定位为面向长程任务的交付级原生多模态智能体基座,攻克了AI图像生成中反复“抽卡”的痛点,标志着多模态AI从单点生成迈入系统级交付新阶段。
未来科技 Google Vids 更新:上传自拍即可生成专属 AI 数字分身,视频创作进入个性化时代 Google 为 Vids 引入个性化 AI 数字分身,用户只需上传自拍和录音即可生成“自己”出镜的视频。同时,Gemini Omni 多模态模型加持,支持图文混合提示、逐步编辑等功能,让视频创作更智能、更便捷。
人工智能 Google I/O 2026释放新信号:AI竞争焦点正从Coding转向全模态 Google I/O 2026展示Gemini Omni后,AI行业的关注点开始从编程能力扩展到全模态生成与智能体应用。
人工智能 前OpenAI CTO新公司发布TML-Small:把AI交互从“回合制”推向实时协作 Thinking Machines Lab推出TML-Interaction-Small,强调实时多模态协作、0.4秒响应与主动视觉能力,试图改变当前AI对话模式。