📡 Poller 最後抓取: 27 分鐘前 (08-08 22:00)
BestBlogs 精選 (38238)
🏷️ 熱門標籤
● 今日开源(2026-7-23):小红书开源 BigMac,多模态 LLM 流水并行训练新范式,嵌套编码器与生成器至 LLM 流水线,训练提速 1.08-1.9 倍
● 打通感知-理解-交互链路,全栈视频理解大模型 VideoChat3 开源了
● claude-real-video:用场景切换检测让 LLM 真正“看懂”视频
● 刚刚,一个开源项目火了:Claude、ChatGPT 终于能真正“看视频”了?
● 全球首个!京东全栈开源 JoyAI-VL-Interaction,让大模型从“一问一答”走向“边看边说”
● 入选 ECCV 2026!清华开源空间模型打败 Gemini:真正的空间智能是在世界变化中持续学习
● 对话灵感实验室:全帧率 VLM、低成本与分层部署,业务现场不止需要炫技模型
📅 2026-05-20 16:39 (05-20 16:39) InfoQ 中文 人工智能 2 分鐘 ★ 88
● 美团 CVPR 2026 中稿精选:视觉生成遇上慢思考,解码多模态推理新范式
● 让大模型理解真实医疗视频,全球首个开源技术方案来了!
● 今日开源(2026-4-27):谷歌开源 TIPSv2 模型,对比学习框架驱动图像文本特征对齐,覆盖零样本分类应用场景
● 记得住、答得快、用得省:HERMES 让流式视频理解实时响应提速 10 倍
● Gemma 4 的 10 个令人印象深刻的创意应用案例
● CVPR 2026 | 火山引擎多媒体实验室提出 TempR1,显著增强多模态大模型视频时序理解能力
● 南大团队直击大模型高分神话:人类 90 分,最强模型仅 49 分
● 流媒体视频理解的简单基准方法
● 阿里发布 Qwen3.5-Omni,多模态能力超越 Gemini-3.1 Pro
📅 2026-03-30 22:21 (03-30 22:21) 量子位的朋友们 人工智能 1 分鐘 ★ 88
● Meta AI 发布 V-JEPA 2.1,解锁视频自监督学习新能力
● Video-CoE:通过事件链增强视频事件预测
● 腾讯联合清华推出 Spatial-TTT:赋能流式视觉空间智能
📅 2026-03-16 18:07 (03-16 18:07) Tencent HY 人工智能 1 分鐘 ★ 88