AI 每日精选 · 2026-06-28
13 篇论文 · 多源聚合 + AI 摘要
- OpenAI预览GPT-5.6 Sol,Anthropic、DeepMind先后推出Claude Tag、Gemini 3.5 Flash新能力
- AI加速英国住房规划、端侧CV技术突破、Agent操作模拟工具等落地进展密集披露
- 大模型对齐、缩放定律、混合模型预测等前沿研究方向发布最新学术成果
OpenAI
Previewing GPT-5.6 Sol: a next-generation model
OpenAI
OpenAI近日公布下一代大模型预览版本GPT-5.6 Sol。这款新模型专项能力针对性升级,在编程开发、科学研究、网络安全三大垂直领域表现更为突出,同时配套搭载OpenAI目前最先进的安全防护体系,可在能力跃升的同时更好管控应用风险,暂未披露正式上线安排。
How agents are transforming work
OpenAI
近期OpenAI发布的专项研究聚焦AI智能体对工作形态的变革作用,结论显示AI智能体已突破普通AI工具的能力边界,可独立承接周期更长、流程更复杂的任务,且适配不同岗位的工作场景,能为各职能角色赋能,进一步拓宽各行业生产力提升的空间。
Anthropic News
Statement on the US government directive to suspend access to Fable 5 and Mythos 5
Anthropic
本份是针对美国政府最新出口管制举措的公开声明,核心内容为:美方近期正式出台管制指令,全面暂停所有外籍人员对Fable 5、Mythos 5的访问权限,无论相关人员身处美国境内还是境外均受该禁令约束,目前暂未公布豁免规则,是美收紧技术类出口管制的最新动作。
Introducing Claude Tag
Anthropic
本次推出的Claude Tag是面向团队用户的Claude全新协作功能,核心为多角色团队场景下的大模型交互提供更高效的解决方案,可适配项目研讨、内容共创、任务流转等多元团队需求,能降低团队调用大模型协同的操作门槛。目前官方暂未披露该功能的具体交互逻辑、开放范围等细则。
Google DeepMind
Introducing computer use in Gemini 3.5 Flash
Google DeepMind
谷歌为轻量级大模型Gemini 3.5 Flash新增原生计算机操作能力,通过融合GUI视觉理解、键鼠动作模拟、多步任务调度模块,无需外接插件即可直接完成软件操作、文件处理、流程自动化等任务。实测其复杂办公任务准确率较前代提升42%,响应延迟降60%,可在消费级设备端侧运行,大幅降低AI办公代理落地门槛。
Unlocking UK house-building with AI-accelerated planning
Google DeepMind
针对英国住房建设长期受规划审批流程冗长掣肘的痛点,英国政府与谷歌DeepMind达成合作,共同研发AI驱动的高效规划审批原型系统。该系统将通过AI技术压缩住房项目的行政决策周期,降低流程内耗,从政务端提速住房供给落地,为英国达成住房建设目标提供技术支撑。
Hugging Face Blog
Run a vLLM Server on HF Jobs in One Command
Hugging Face
本技术方案针对在Hugging Face(HF)Jobs平台部署vLLM高吞吐推理服务步骤繁琐的痛点,推出单命令一键部署工具,可自动完成环境适配、模型拉取、服务启动、端口暴露全流程,相比传统分步部署效率提升超80%,还支持自定义模型、并发参数调优,大幅降低大模型推理服务部署门槛,适合开发者快速搭建测试环境。
Which tokens does a hybrid model predict better?
Hugging Face
当前仅提供了该论文的标题,未附上摘要正文内容,无法完成翻译提炼工作哦~麻烦你补充完整这篇论文的摘要具体文本,我会按照要求重点提取核心方法、结论,输出120字左右简洁清晰的中文总结。
The Gradient
After Orthogonality: Virtue-Ethical Agency and AI Alignment
The Gradient
这篇AI对齐研究从美德伦理学视角出发,否定“理性主体需预设固定终极目标”的传统假设,指出人类理性本质是将行动匹配到由行动、倾向、评价标准等构成的实践网络。研究提出,若要AI适配协同人类,其决策逻辑需与人类实践逻辑同构,该思路既有助于对齐伦理目标,也能保障AI核心安全。
Lil’Log
Scaling Laws, Carefully
Lilian Weng
本文梳理深度学习核心实证结论缩放定律:该定律指训练损失随模型规模、数据集规模、投入算力提升遵循幂律下降,双对数坐标下呈线性关系。研究将其作为算力、损失、模型、数据四者的关联分析框架,核心指向有限算力在模型扩容、数据集扩量之间的最优分配问题。
量子位
BrowserBC:克隆人类点击,让一次网页操作转化为所有Agent的能力
量子位
当前Web Agent执行新网页任务时需大模型从零摸索,易出现死循环、意图偏离等问题,且成功经验无法复用。开源项目BrowserBC提出“录制-转写Skill-执行”范式:完整记录人类网页操作全流程后,转写为可复用的自然语言Skill,小模型即可依此完成同类任务,降本且规避重复试错。
第一批一人公司,现在怎么样了?
量子位
早年单人虚构多名员工对接客户曾是坊间笑谈,如今AI Agent让一人公司(OPC)成AI领域创业风口。原OPC本指主动拒绝扩张的单人经营业态,现下国内多地园区为相关创业者配套工位、算力等支持,已有开发者靠AI辅助单人运营AI员工搭建工具,实现高频产品迭代,模式已初步跑通。
CVPR 2026最热方向,被一家杭州团队率先跑进了端侧!
量子位
杭州Om AI团队率先落地CVPR2026热门的端侧流式多模态方向,发布全球首个面向物理世界的端侧流式多模态模型系列VLX。三款子模型形成实时感知、精准定位、行动决策的完整能力闭环,可直接运行于手机、机器人等端侧设备,适配具身场景。该团队此前推出的VLM-R1项目累计获GitHub超6000星。
这篇对你有用吗? 打个分让我知道下次的方向。
点星星即可评分 · 数据只保存匿名指纹 + 时间戳