Importance10 items
AArtificial Analysis 头像
Artificial AnalysisX · 原帖 08/24 21:40 · 抓取 08/24 21:43

韩国主权AI项目第二轮评估收缩至三支队伍

摘要与判断

韩国政府主导的主权AI基础模型项目完成第二轮评估,参赛队伍由四支缩减至三支,Upstage、SK Telecom与LG AI Research分别凭借Solar Open 250B、A.X K2和K-EXAONE 2.0晋级。三队预计各获约1000块英伟达B200 GPU、约400亿韩元支持,总额约1200亿韩元,下一轮计划于2027年初举行并缩减至两队。

medium
韩国主权AI项目第二轮评估收缩至三支队伍 配图
CCNBC 头像
CNBCX · 原帖 08/24 21:39 · 抓取 08/24 21:43

TWG Global聘请高盛资深人士Markowitz担任首席律师

摘要与判断

CNBC报道称,Mark Walter领导的TWG Global在旗下保险公司面临调查之际,聘请高盛资深人士Markowitz担任首席法律顾问。此次任命将使该集团在监管调查背景下获得更强的法律应对支持,也凸显其保险业务面临的合规压力。

medium
YY Combinator 头像
Y CombinatorX · 原帖 08/24 21:39 · 抓取 08/24 22:02

Jeremy发布开放式代码基准测试项目 Jcode bench

摘要与判断

Jeremy发布Jcode bench,称其是首个开放且难以污染的代码基准,针对私有基准难以信任、公开基准易被针对优化、评分粗糙及难以区分前沿与中端模型等问题,采用围绕参考实现持续优化的评测方式。该项目还支持审计任务与运行记录,并可在评测数据可能被训练后生成新任务,有望为模型编码能力提供更连续的比较信号。

medium
Jeremy发布开放式代码基准测试项目 Jcode bench 配图
MMax For AI 头像
Max For AIX · 原帖 08/24 21:38 · 抓取 08/24 22:11

Thinking Machines推出最高5万美元的开放模型安全研究资助

摘要与判断

Thinking Machines宣布推出Tinker资助计划,为开放权重模型安全研究提供最高5万美元的Tinker Credits,而非现金资助。研究者可用这些额度开展模型后训练、强化学习、能力评测及危险能力检测与防御实验,底层训练基础设施由Thinking Machines提供。该计划将大规模后训练安全实验的资源开放给外部研究者,扩大开放模型安全研究的实践参与范围。

medium
BBin Liu 头像
Bin LiuX · 原帖 08/24 21:35 · 抓取 08/24 21:57

Bin Liu:任何内容都可在 HyperFrames 中转化为代码化可视化

摘要与判断

Bin Liu引用Jake Moran关于用JavaScript和HyperFrames将实时图像转为绘画动画的帖子,并表示任何内容都可以成为代码、在HyperFrames中实现可视化。该内容主要是对创作方式和工具能力的概括,展示了实时图像处理与动画化方向,但未披露新的产品发布或明确落地结果。

low
Bin Liu:任何内容都可在 HyperFrames 中转化为代码化可视化 配图
RReuters 头像
ReutersX · 原帖 08/24 21:35 · 抓取 08/24 21:49

意大利监管机构批准Ludoil收购西西里岛炼油厂

摘要与判断

意大利监管机构批准Ludoil收购一家西西里岛炼油厂,意味着这笔能源资产并购已获得监管层面放行。该批准降低了交易完成的合规障碍,将推动相关炼油资产进入后续交割与所有权变更流程,对意大利能源并购市场参与者具有即时参考价值。

medium
DDAIR.AI 头像
DAIR.AIX · 原帖 08/24 21:34 · 抓取 08/24 21:50

一份终端代理调查论文讨论代理定义与评测矛盾

摘要与判断

转发内容介绍了一份关于终端代理的调查论文,称其有助于理解终端代理的具体含义,并解释不同测试框架为何会得出相互矛盾的比较结果。该内容主要提供论文线索与概括,面向关注代理评测方法的读者具有一定参考价值。

low
一份终端代理调查论文讨论代理定义与评测矛盾 配图