2026年10月7日 Ai热榜

2天前 BAOLONG
5 0

每日 AI 资讯精选,聚焦大模型、算力、智能体与产业动态。更新时间:2026-10-07

1

何恺明团队 VISTA 打穿 AGI 考试:Claude 满分、GPT 99 分

何恺明团队新论文 VISTA 让 Claude Opus 5 拿下 ARC-AGI-3 全部 25 个游戏满分(100 分),GPT-5.6 Sol 获 99 分;核心是把官方递的数字表换回图片+无损视觉记忆「相册」。
澎湃/新智元·今日
2

OpenAI 集中公开 722 篇数学手稿,平均每项约消耗 3 小时 ChatGPT Pro 级算力

OpenAI 公开由先进 AI 模型生成的 722 篇数学手稿、372 组关联研究结果,含数百个开放问题解决方案,并公布推理说明、算力估算与 GitHub 审查引用规则。
鞭牛士/The Verge·今日
3

AI 算力订单暴增至 500 亿美元:英伟达支持的 Lambda 拟融资 40 亿美元冲刺 IPO

获英伟达支持的云计算公司 Lambda 正筹集至多 40 亿美元,投前估值 145 亿美元,目标 2027 年 IPO;AI 算力积压订单从 6 月 150 亿增至 9 月 500 亿美元。
财联社·今日
4

Anthropic 扩大网络核验计划:已挖出十几万漏洞,向更多安全团队开放最强 Claude 模型

Anthropic 公布新版网络核验计划(CVP),整合玻璃翼计划与旧核验项目;玻璃翼计划今年已发现超 10 万漏洞,4-10 月开源扫描另发现 5500 个。
IT之家/路透社·今日
5

Sierra 与 Meta 联合沃尔玛等公司开发智能体协议

Sierra 与 Meta Platforms 联合沃尔玛等公司共同开发智能体协议,推动跨平台 AI 智能体互操作标准建设。
财联社·今日
6

musubi 发布轻量实时审核决策模型 policy-lm-1.7b(开放权重)

musubi 宣布推出面向实时内容审核的轻量决策模型 policy-lm-1.7b,采用开放权重发布,适用于大规模内容治理场景。
SIIT·今日
7

OpenAI 数学成果引学术验证争议:AGMAI 建议勿当营销工具

数学与人工智能顾问组 AGMAI 建议 AI 实验室公开数学成果时披露模型、提示词与算力成本,且不应把未充分验证的成果当成宣传模型能力的营销工具。
鞭牛士/AGMAI·今日
8

新云行业持续火爆:Lambda 500 亿订单主要由 Anthropic 350 亿美元承诺推动

Lambda 积压订单大幅增长主要由 Anthropic 作出的 350 亿美元承诺推动;投资者仍愿押注与大型 AI 实验室签有大额合同的 GPU 算力供应商。
财联社·今日
9

Google 收紧 Gemini 个人账号权限:免费档仅 Flash-Lite,AI Plus 也失去 Pro

Google 将收紧 Gemini 模型使用权限,免费用户 10/9 起只能使用 Flash-Lite,低价 AI Plus 用户也将失去 Pro 模型权限,Pro/Ultra 保留全部三档。
抖音/人工智能通讯社·今日
10

VISTA 关键第一招:把数字表换回图片,GPT-5.6 Sol 分数从 13.33 跳到 47.32

官方考场递给模型的只是一张 64×64 数字表,VISTA 团队把数字表换回图片后 GPT-5.6 Sol 分数涨三倍多,且图片版更省算力(每局 3070 万 Token vs 文本版 7190 万)。
澎湃/新智元·今日
11

VISTA 核心杀招「无损视觉相册」:翻帧不算步数,模型随时回看任一帧

VISTA 给模型配备按编号存档的视觉记忆「相册」,支持多帧并排对比、角落放大与 read_pixels 读色;翻相册不计步数,只有游戏操作才计步,团队称之为「显式注意力」。
澎湃/新智元·今日
12

VISTA:320B 开源模型从 1.89 分被抬到 66.93 分,暴涨 35 倍

用官方实现几乎交白卷(1.89 分)的 320B 开源模型,套上 VISTA 后被抬至 66.93 分,验证了「ARC 是视觉问题」的路线判断。
澎湃/新智元·今日
13

Anthropic 专项层级:获许可机构可对电网、航空、银行系统做攻击性测试

Anthropic CVP 专项层级约束最少,仅面向一小部分机构开放,允许对电网、航空飞行系统、银行跨行转账基础设施等关键系统开展测试,会同美国政府审核资质。
IT之家/路透社·今日
14

Anthropic CVP 三级权限:防御层、红队层、专项层各设审核要求

新版网络核验计划分三个层级:防御层面向应急响应与恶意软件分析,红队层增加授权渗透测试,专项层约束最少;全部层级可用 Claude Opus 5.5、Sonnet 5.5、Mythos 5.1。
IT之家/路透社·今日
15

OpenAI 数学成果含 Lean 形式化证明,可直接通过计算机校验

OpenAI 公开成果包含 Lean 语言形式化证明,让数学证明内容可直接通过计算机完成校验,单份成果平均消耗约等于 ChatGPT Pro 三小时深度推理算力。
财联社·今日
16

OpenAI 数学成果已放 GitHub,制定审查和引用规则供学界验证

OpenAI 已将数学成果放到 GitHub 代码仓库,并制定相应审查和引用规则,方便数学界进一步验证和使用。
鞭牛士/The Verge·今日
17

Anthropic 开放 Claude Opus 5.5/Sonnet 5.5/Mythos 5.1 供网络安全测试

Anthropic 与美国政府合作扩大先进 AI 模型使用权限,允许经筛选机构使用包括 Claude Opus 5.5、Sonnet 5.5、Mythos 5.1 及未来新模型进行安全测试。
IT之家/财联社·今日
18

何恺明组一年三篇 ARC 论文:VARC、NAT-ARC、VISTA 死磕「ARC 是视觉问题」

从 1800 万参数小视觉模型 VARC 追平人类平均分,到 NAT-ARC 补抽象推理课,再到 VISTA 给前沿大模型配「相册」,何恺明团队一年三篇持续押注视觉路线。
澎湃/新智元·今日
19

Anthropic 玻璃翼计划 4-7 月核实超 12.9 万漏洞,33000+ 被评严重高危

Anthropic 玻璃翼计划合作方在 4-7 月至少找到 129000 个已核实漏洞,自身开源扫描 4-10 月额外发现 5500 个;超 33000 个被评定为严重或高危,实际影响或为数据的五倍。
IT之家/路透社·今日
20

Lambda 备战 IPO:任命 Michel Combes 接任 CEO,联合创始人转任 CTO

自今年春季以来 Lambda 进行系列人事调整备战公开市场检验:5 月任命资深高管 Michel Combes 接替联合创始人 Stephen Balaban 出任 CEO,Balaban 转任 CTO。
财联社·今日

暂无评论

none
暂无评论...