当前位置: 首页 > news >正文

“心内推理”:一种动态多模态潜在空间推理范式 | 直播预约

主题

“心内推理”:一种动态多模态潜在空间推理范式

时间

2026.01.17 周六 10:00 北京时间
2026.01.16 周五 21:00 美东时间
2026.01.16 周五 18:00 美西时间

直播平台

🎙本次分享为全英文讲座!🌍

微信视频号:

b站直播间:

Youtube直播间:

https://www.youtube.com/live/U0rDRX7ZkYM

内容介绍

当前多模态大模型在推理过程中,往往依赖冗长的文字化 Chain-of-Thought 或频繁调用外部视觉工具,导致推理效率低下且稳定性不足。本次分享将介绍 DMLR(Dynamic Multimodal Latent Reasoning),一种无需额外训练、仅在推理阶段生效的方法。该方法通过在潜空间中动态优化潜在思考token,并以模型内部不确定性为信号自适应地引入关键视觉信息,实现高效且稳定的多模态推理过程,更贴近人类按需感知与推理的认知机制。

Reasoning Within the Mind: Dynamic Multimodal Interleaving in Latent Space
论文地址:https://arxiv.org/pdf/2512.12623\

嘉宾

Chenzhi Liu,加州大学圣塔芭芭拉分校(UCSB)计算机科学博士生,导师为Xin Eric Wang, 研究方向包括多模态大模型幻觉与可靠性,以及 agent 推理系统设计。
个人网站:
https://chengzhiliu666.github.io/

主持人

李大卫,亚利桑那州立大学一年级博士生,在ACL,EMNLP,NAACL等顶级会议发表多篇论文,同时担任ARR,ICLR,NeurIPS,AISTATS等国际会议审稿人。研究兴趣包括从结构化/非结构化文本以及参数化模型中蒸馏知识,高效模型训练/推理,以及探索大模型的社会智能和社交智能。

入群

欢迎加入NICE每周分享交流群,可与NICEer唠嗑,以及第一时间收到后续NICE分享报告的通知。加群通过小助手认证,群内无广告。

备注【昵称-单位-方向-NICE入群】

NICE介绍

NICE(Nexus forIntelligenCE)是一个由全球50+位一线青年学者共同发起的顶尖AI前沿交流平台。 成立以来,我们汇聚海内外300+嘉宾,通过百余场线上深度分享与线下高规格活动(北京/上海/苏州等),全网积累超13万关注。目前,NICE已构建起覆盖中、美、欧的国际化团队,正加速在硅谷、纽约、香港等地落地,致力于打造连接学术、产业与未来的全球化AI前沿社区。
NICE主页
https://nice-nlp.github.io
NICE海外
https://nice-intl.github.io
b站
https://space.bilibili.com/507524288
Youtube
https://www.youtube.com/@NLPAcademicExchangePlatform

编辑:冯可蘅 华盛顿大学
http://www.cnnetsun.cn/news/656348.html

相关文章:

  • AWPortrait-Z模型压缩:在边缘设备上运行的尝试
  • 为什么选择cv_resnet18_ocr-detection?OCR模型选型深度解析
  • Paraformer-large语音识别实战:长视频字幕生成的一站式解决方案
  • 一文搞懂Qwen3-Embedding-0.6B:从安装到应用全流程
  • TurboDiffusion种子管理技巧,帮你保存最佳结果
  • 电商设计师福音!批量处理100张图片只要半小时
  • 多语言文档处理利器|基于PaddleOCR-VL-WEB的完整部署教程
  • MinerU镜像使用指南:默认workspace路径切换详细步骤
  • opencv实战-人脸检测
  • 用bhyve-webadmin来管理FreeBSD系统下的bhyve虚拟机(上)
  • SGLang性能对比实测:云端GPU 10元搞定3大模型评测
  • 为什么Sambert部署总失败?依赖修复镜像部署教程是关键
  • Python3.8图像处理:云端OpenCV预装,免去编译痛苦
  • Day 71:【99天精通Python】项目篇开篇 - 金融数据看板需求分析
  • Java Web web音乐网站系统源码-SpringBoot2+Vue3+MyBatis-Plus+MySQL8.0【含文档】
  • 语音机器人对话优化,根据用户情绪调整回复策略
  • AI写作大师Qwen3-4B进阶教程:自定义模型微调指南
  • Z-Image-Turbo_UI界面新手指南:零基础实现AI绘图全流程
  • 单目深度估计实战:MiDaS模型部署与优化
  • MinerU处理模糊PDF失败?源文件质量优化建议
  • Meta-Llama-3-8B-Instruct性能对比:不同硬件
  • 通义千问3-4B-Instruct-2507中文处理优势:C-Eval评测部署教程
  • GPT-OSS-20B-WEBUI操作手册:管理员后台管理功能
  • 用PyTorch-2.x-Universal-Dev镜像轻松实现AI模型训练与微调
  • Z-Image-Turbo多模态融合:文本+图像联合推理场景构建
  • BERT填空置信度不准?模型微调部署优化实战案例解析
  • BGE-Reranker-v2-m3为何选它?高精度rerank模型对比分析
  • Qwen2.5-0.5B-Instruct优化技巧:提升对话质量的实战方法
  • 零基础也能做!用GLM-TTS镜像快速实现方言语音合成
  • SAM3技术前沿:最新改进与应用趋势