AI动态

汇集AI最新资讯、行业动态与实用工具,涵盖ChatGPT、DeepSeek、大模型应用等内容,让您及时掌握人工智能领域的最新发展与工具更新。

  • 最新发布
  • 最多下载
  • 价格最低
a
Anthropic 研究:训练一个错位的奖励寻求者模型
AI动态 aideit_admin 9月2日
Anthropic 研究:训练一个错位的奖励寻求者模型 Anthropic 发布新研究《Training a Misaligned Reward Seeker》,探究奖励作弊(reward-hacking)是否会让模型学会不择手段追求奖励。 研究在 80 个已知可被攻破的生产环境中训练了一个 Opu...
AI动态
0 免费
a
路透社调查:美国 AI 数据中心现大量幽灵用电需求,得州等多州出手整治
AI动态 aideit_admin 9月2日
路透社调查:美国 AI 数据中心现大量幽灵用电需求,得州等多州出手整治 据路透社报道,美国中部大片地区的数据中心申请的用电量,大致相当于为全国每个家庭供电所需的电量,但其中相当一部分需求可能只是幻象。 路透社对公用事业公司及电网数据的审查发现,在美国中西部、中大西洋地区和南部的部分地区,超大型用电户...
AI动态
0 免费
a
Fable 5.1 系统卡披露隐蔽任务与监控难度上升等安全发现
AI动态 aideit_admin 9月2日
Fable 5.1 系统卡披露隐蔽任务与监控难度上升等安全发现 来自 Fable 5.1 系统卡的一些非常有趣的披露: • Anthropic 表示,它自己的模型可能正变得越来越难以监控。 • 在一个要求模型将有害任务偷偷绕过 AI 监督者的基准测试中,它"实现了我们迄今发布的所有模型中最高...
AI动态
0 免费
a
Google DeepMind 为 Gemini 推出 agentic 视频理解功能
AI动态 aideit_admin 9月2日
Google DeepMind 为 Gemini 推出 agentic 视频理解功能 Google 刚刚为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 推出了智能体视频理解功能。该功能允许模型动态扫描视频片段,在提升准确性的同时,将 token 使用量最高...
AI动态
0 免费
a
OpenAI 评定 Astra 达到网络安全 Critical 能力阈值,将受限发布
AI动态 aideit_admin 9月2日
OpenAI 评定 Astra 达到网络安全 Critical 能力阈值,将受限发布 OpenAI 宣布 Astra 在其 Preparedness Framework 下达到"关键级网络安全能力"门槛,是首个被评定为该级别的模型。这意味着在具备合适工具和访问权限的情况下,它能够发现...
AI动态
0 免费
a
Claude Fable 5.1 登顶 Artificial Analysis 智能指数
AI动态 aideit_admin 9月2日
Claude Fable 5.1 登顶 Artificial Analysis 智能指数 Artificial Analysis 最新评测显示,Claude Fable 5.1 在 max effort 模式下以 66 分的成绩登顶 Artificial Analysis Intelligence ...
AI动态
0 免费