人工智能 微信开源 WeMM-Embedding:十亿级调用的多模态嵌入模型走向社区 微信 AI 宣布开源通用多模态嵌入模型 WeMM-Embedding,提供 2B、4B、9B 三个版本,已用于微信推荐与搜索系统。
人工智能 疑似 GPT-6 灰测 Demo 引发热议,OpenAI 新旗舰模型或临近发布 一批疑似 OpenAI 新模型 Astra 的灰测演示在社区流传,3D 生成能力成为焦点,但官方尚未确认其身份与发布时间。
人工智能 Seedance 2.5上线:字节视频生成模型补强长视频与可控编辑 Seedance 2.5将单次生成时长提升至30秒,并强化多模态参考、白模生成和局部编辑能力,但在剧情延续与素材理解上仍有短板。
科技 AI评测背后的华人“出题人”:陈文虎与MMLU-Pro、MMMU的故事 当AI模型在MMLU等基准测试上逼近满分,评测体系面临失效。华人学者陈文虎推出MMLU-Pro、MMMU等更难更严谨的评测,重新拉开模型差距,成为行业新标尺。
人工智能 DDIM 研究者宋佳铭确认离开 Luma AI,下一站暂未公布 扩散模型重要研究者宋佳铭已在职业信息中确认离开 Luma AI。过去三年,他参与了该公司从 3D 生成、视频生成到多模态模型的多轮技术转向。
人工智能 OpenAI研究员陈博远走到台前:GPT Image 2为何让中文生图更像“可读设计” GPT Image 2发布后,中文文字渲染能力引发关注。OpenAI研究员陈博远在知乎分享训练与示例背后的思路。
人工智能 阿里AI新秀HappyHorse亮相:一场围绕“Token经济”的战略布局 阿里AI视频大模型HappyHorse在匿名冲榜后正式官宣,凭借音视频原生同步生成技术引发关注。这背后是阿里围绕Token经济进行的组织重构与商业化提速,标志着AI竞争进入应用与变现新阶段。
人工智能 可灵AI的“非典型”突围:从“Nobody”到全球首发,敢不敢比能不能更重要 快手可灵AI凭借《纸手机》短片出圈,背后是其从资源受限起步,以“敢不敢”的决断力抢先发布全球首个可用DiT视频大模型的“非典型”创新路径。本文解析其技术演进、战略决策与行业影响。