Pourquoi les démonstrations de robots humanoïdes échouent toujours au test de généralisation

The Robot Report Podcast · Pourquoi les démonstrations de robots humanoïdes échouent toujours au test de généralisation
Jeanine Sinanan-Singh, directrice de la recherche GenAI à Appen.
Dans l'épisode 265 du podcast The Robot Report, notre invitée est Jeanine Sinanan-Singh, directrice de la recherche sur l'IA générative chez Appen. Elle discute de l’importance continue des humains dans la boucle de formation des robots.
Sinanan-Singh travaille sur les évaluations agentiques, les environnements RL et la conception d'ensembles de données pour les modèles d'IA frontaliers post-formation. Elle explique également pourquoi des démonstrations impressionnantes ne prouvent pas nécessairement que le comportement robotique peut être généralisé.
Sinanan-Singh a précédemment fondé une startup d'automatisation de pharmacie construite sur une plateforme d'impression 3D pour fabriquer des médicaments personnalisés. Diplômée de Harvard avec une expérience antérieure chez Microsoft et Surge, elle s'exprime fréquemment sur l'évaluation et le raisonnement de l'IA.
Afficher la chronologie
8h10 – Actualités de la semaine
29h06 – Jeanine Sinanan-Singh, directrice de GenAI Research chez Appen
Nouvelles de la semaine
Boston Dynamics nomme l'ancien dirigeant d'Amazon Rohit Prasad au poste de PDG
L'acquisition de PTC permet à Schneider Electric de défier Siemens
Également mentionné : le PDG de Berkshire Grey discute de l'IA physique et de l'expansion européenne
Locus maîtrise la manipulation robotique grâce à la technologie Nexera
Commanditaires
Boucler la boucle de l’autonomie nécessite plus qu’un grand robot.
WiBotic fournit une recharge sans fil fiable et une gestion de l'énergie de la flotte pour les robots autonomes et autres systèmes alimentés par batterie.
Cette technologie brevetée donne aux robots plus de liberté pour charger tout au long de leur flux de travail normal, contribuant ainsi à augmenter la disponibilité, le retour sur investissement et la sécurité de votre flotte.
AMR, drones, autolaveuses, humanoïdes et tout le reste, WiBotic rend le chargement simple, transparent et évolutif.
Apprenez-en davantage sur http://www.wibotic.com/robotreport
Pour savoir comment vous pouvez sponsoriser un futur épisode du podcast The Robot Report, contactez Jami Brownlee à [email protected]
Souhaitez-vous être l'invité d'un prochain épisode ? Contactez Mike Oitzman à [email protected]
Inscrivez-vous maintenant et aidez-nous à célébrer les 20 ans de RoboBusiness !
L'article Pourquoi les démonstrations de robots humanoïdes échouent toujours au test de généralisation apparaît en premier sur The Robot Report.
Article traduit automatiquement depuis la couverture d’origine d’un média international ; des imprécisions sont possibles. Consultez « Lire l’original » pour la source.
Les actualités sont collectées automatiquement depuis des flux publics robotique & IA.
Articles liés

Pourquoi la dextérité est le véritable goulot d’étranglement de l’IA physique
Le prochain défi majeur en matière de dextérité robotique consiste à rendre l’ensemble du système suffisamment fiable pour transformer ses capacités en travail utile. L'article Pourquoi la dextérité est le véritable goulot d'étranglement de l'IA physique apparaît en premier sur The Robot Report.

Agentic开发时代到来!鸿蒙PC三大原生开发工具公测,补齐国产操作系统生态关键短板
智东西 作者 | 程茜 编辑 | 漠影 当一台鸿蒙PC,既能跑鸿蒙应用,又能原生开发鸿蒙应用,会发生什么? 智东西10月10日报道,10月8日,可视化一站式IDE工具DevEco Studio、一站式鸿蒙应用AI开发工具DevEco Code与AI开发能力套件DevEco CLI,同步开启鸿蒙PC版公测。 三者分工明确:DevEco Studio主打集成开发、多端调试,承担基础IDE核心能力;DevEco Code提供端到端一站式Agentic开发体验;DevEco CLI对外输出鸿蒙开发能力,可无缝对接外部各类Agent工作流,让 AI 辅助开发融入鸿蒙 PC 原生环境。 DevEco三件套

编程体验接近Opus 5.5?谷歌Gemini 4新版本曝光
智东西 编译 | 杨京丽 编辑 | 李水青 智东西10月10日消息,今日,据外媒Business Insider报道,谷歌正在 内部测试Gemini 4的一个新版本 ,代号为 Carbon ,有望进一步缩小其与竞争对手在编程能力上的差距。 目前,Carbon已接入谷歌内部编程平台Jetski。部分员工认为,该模型的编程体验 与Claude Opus 5.5近似 ,但有员工强调,模型实际需要进行更多测试,才能作出更准确的判断。 谷歌已于10月1日发布Gemini 4 Argon ,重点面向 软件工程、企业知识工作、网络安全防御等场景 ,目前该模型尚未面向公众推出。 Carbon可能是Argon训

2026中国计算机大会定了,12位院士演讲,腾讯阿里百度、小米京东都来了
智东西 作者 | 王涵 编辑 | 云鹏 智东西10月10日报道,今天,第二十三届中国计算机大会(CNCC2026)新闻发布会在京举行,智东西等媒体受邀参加。 据介绍,CNCC2026将于 10月21日至24日 在四川成都举办,主会场设于中国西部国际博览城和天府国际会议中心,大会主题为 “数聚驱动,智算未来” 。 本届大会共设 17场特邀报告、3场大会论坛、167个专题论坛及40余场专题活动 ,同期还将举办CCF计算机展览会。 其中,专题论坛演讲者有 789位 , 院士级演讲者有12位 ,来自腾讯、阿里、百度、小米、京东等企业专家达 92位 。 专题论坛围绕 11大主题 领域展开,包括:AI基础

00后硕士揭开AI推理“黑科技”:两个Token,基模追平强化学习版本
智东西 作者 | 杨京丽 编辑 | 李水青 智东西10月10日报道,一项来自麻省理工学院(MIT)等机构的研究发现, 只要固定基础模型回答开头的两个Token,就能让模型的数学推理成绩接近对应的强化学习版本 。 以艾伦人工智能研究所(Ai2)的基础模型Olmo-3-7B为例, 将回答固定为“.\n\nOkay”开头 后,模型在MATH-500上的 准确率从42%升至78% , 超过其强化学习版本的75% 。 这个过程没有修改模型参数,也没有给模型增加新的解题示例。模型只是换了一个回答起点,原本没有稳定表现出来的解题能力,似乎就更容易被调用出来。 换句话说,基础模型答错题,有时不一定是完全不会做

好产品就是与时代和生活共振|2026 年度极客最爱好物启动
一件好产品,往往是在用过一段时间之后,才让人意识到它的好。出门时顺手带上,遇到事情时首先打开,或者因为有了它,愿意尝试一件过去觉得麻烦的事。这样的产品,值得被分享给更多人。 2026 年,我们把寻找好产品的目光,投向更丰富的形态。能协助完成任务的 AI 应用、戴在身上的智能设备,以及尝试在真实环境中干活的机器人,都进入了今年的选品视野。技术提供了新的可能,具体的产品体验,决定了人们愿不愿意把它们带进生活。 我们关注产品解决了什么问题,也在意使用它要付出多少学习和操作成本。一款创作工具,可以让想法更容易实现;一件有趣的小设备,也可以只负责让人开心。我们同样欢迎那些在设计、手感或某个小细节上做得出