logoReadhub
  1. 热门话题
  2. 每日早报
  3. 排行榜
  4. AI
  5. 科技动态
  6. 财经快讯
  7. 医疗产业
  8. 汽车
  9. 专业版
登录

© 2026 NoCode 无码科技(杭州)有限公司浙ICP备17005035号-6联系我们加入我们产品介绍MCP 接入

record浙公网安备 33010902002965 号浙 B2-20181004

logo
科技新闻,每天 3 分钟
  • 谷歌发布新一代机器人基础模型:一个模型控制完整人形机器人全身运动
    相比上一代 Gemini Robotics 只能控制机器人上半身完成桌面任务,此次更新的关键变化在于,一个视觉-语言-动作(VLA)模型首次实现了对完整人形机器人的控制,覆盖从双腿到手指的全身自由度,并在多个形态迥异的硬件平台之间共用同一份模型权重。传统路线如波士顿动力(Boston Dynamics)的阿特拉斯(Atlas)等,其行走、平衡等能力由基于模型预测控制或强化学习训练的独立控制器分别负责。此次发布的三个模型在通用性与实用性上仍有明显短板,但从架构层面验证了一个颇具潜力的方向:人形机器人行走与操作的分层拼接,未来将在同一模型内走向协同。
    麻省理工科技评论
    14 小时前
  • 李飞飞收购机器人仿真公司 SceniX:为机器人打造无限试错的世界
    李飞飞创办的空间智能公司 World Labs 宣布收购机器人仿真初创公司 SceniX,后者致力于将真实场景转化为可供机器人训练和评估的数字环境。交易公布后,李飞飞与 SceniX 联合创始人李昀烛在播客中详细解释了交易背后的技术判断,讨论了仿真如何开启下一代机器人技术,以及训练机器人为何需要与训练语言模型截然不同的方法。她认为,未来的机器人基础模型很可能是一个包含「动作」的多模态模型:既接收视频、文字、图像等信息,也输出世界状态和机器人动作。
    麻省理工科技评论
    14 小时前
  • GPT-5.6 大幅降价,性能提升显著
    GPT-5.6 通过重写并优化运行内核实现成本大幅下降,价格较此前降低 80%。该模型分为三档:Sol 为旗舰版,Terra 为日常平衡版,Luna 为最快最便宜版。内测期间,活跃研究员的日均 token 输出量达到 GPT-5.5 时代峰值的两倍以上。
    智源社区
    1 小时前
  • Jina Reranker v3.5:专注垂直领域的 0.6B 列表式重排器
    Jina Reranker v3.5 在保持轻量化推理优势的同时,解决了生产环境中的三个工程痛点:垂直领域适配、结构化记录的逻辑识别,以及长列表下的显存爆炸。该模型基于 0.6B 参数和 Listwise 架构,在通用基准测试上表现优异,为长列表响应慢、垂直领域检索和结构化数据理解提供了高性价比的技术选型。
    智源社区
    1 小时前
  • 10 万科学家免费用 1 年 OpenAI 把科研流水线搬进 ChatGPT
    OpenAI 给学术圈发了一份大礼,正式推出「ChatGPT for Academic Researchers」,要给 10 万名科研人员免费开放前沿模型。这次获批的研究者,到手的正是这样一整套:ChatGPT、ChatGPT Work、Codex,还配上扩容版 Deep Research、更高的使用限额、更大的上下文窗口。OpenAI 的目标很明确:把你的整个研究流程,搬进 ChatGPT。
    智源社区
    14 小时前
  • OpenAI:GPT-5.4 和 GPT-5.4mini 将从 8 月 31 日起不再向登录 ChatGPT 的用户提供
    这些模型仍将在 OpenAI API 以及使用 API 密钥进行身份验证的 Codex 会话中继续提供。
    财联社
    5 小时前
  • Claude 聊天记录因分享链接可被谷歌搜索到,引发隐私担忧
    用户在 Claude 中点击「分享」按钮后,系统会生成一张无需登录、无需身份校验的公开网页,而非仅限指定对象访问的私密链接。只要有用户把 Claude 分享链接发到 Reddit、X、公开论坛、GitHub 文档等任何可被爬虫访问的公开页面,谷歌在爬取那个页面时,就会发现这条 /share 链接。主流推测是,部分用户将分享链接发布到了公开论坛、社交平台、开源项目文档等可被爬虫访问的公开页面,谷歌在爬取这些页面时,同步发现了对应的 /share 链接。
    雷锋网
    15 小时前
  • Google DeepMind 提出「视觉提示工程」新范式:比文本指令更有效
    在一篇最新论文中,Google DeepMind 提出了「视觉提示工程」(visual prompt engineering,VIPE),将提示工程成功扩展到了视觉领域。研究团队表示,视觉提示工程指向了一种新的范式,即「视觉提示本身也可以像文本提示一样被优化」。视觉提示工程是针对视频模型视觉输入的提示工程方法,在不改变任务逻辑的前提下,将原始图像转换为模型更容易理解和推理的视觉形式,让模型能在新的视觉场景中处理同一问题。
    智源社区
    16 小时前
  • 接力跑盘活全国算力,PD 分离终于破局:延迟砍半、成本直降近 40%
    PDD 架构不仅仅是一个跨域以太网传输延迟优化技巧,它也承载着无问芯穹对下一代模型即服务(Model-as-a-Service,MaaS)基础设施的核心设计理念与底层判断 —— 极简局部异构 + 灵活远端分离。未来,我们不需要在同一个机房里堆砌庞杂的异构芯片,只需要在主算力中心保留极小比例的「接力手」,就能像云原生调度资源一样,把庞大的解码任务分发到全国乃至全球的低成本算力节点上。在面对因模型迭代、PD 配比变化而带来的资源闲置问题时,这种「极简局部异构 + 灵活远端分离」的跨集群范式,也能大幅盘活存量算力,压低资源空置比例。
    智源社区
    17 小时前
  • 刚刚,DeepSeek V4 系列更新,架构没变,Agent 能力为何大涨
    刚刚,DeepSeek 更新了 DeepSeek-V4-Flash ... 但比起「正式版」这个名字,这次更新更值得关注的是另一句话:DeepSeek-V4-Flash-0731 与此前的 Preview 版本采用相同的模型结构和参数规模,只重新进行了后训练 ... 更准确的理解是,DeepSeek 正在验证一条更加务实的技术路线:当模型结构和参数规模保持不变时,能否通过重新后训练、工具接口适配和 Agent 运行框架,进一步提高模型完成真实任务的能力。
    雷锋网
    17 小时前
  • loading