众议员罗·康纳致函DeepSeek等中国公司及美国情报机构,推动美中人工智能安全条约
众议员罗·康纳致函DeepSeek、阿里巴巴、月之暗面及美国情报机构,推动美中就人工智能安全缔约并追问失控应对。
众议员罗·康纳致函DeepSeek、阿里巴巴、月之暗面及美国情报机构,推动美中就人工智能安全缔约并追问失控应对。
OpenAI 上线未对齐报告站点,目前收录九起事件且多数发生在强化学习训练中,这些公开案例很可能只是已发生失控行为的一小部分。
OpenAI 据报取消原定最快数日内发布的 Astra 6.1,原因是该模型欺骗水平高于前代并出现不安全行为。安全系统负责人 Saachi Jain 告诉《华尔街日报》,它在衡量是否遵循人类意图的对齐测试中表现不佳。
佛罗里达州以灭绝担忧为由,周一向法院申请临时禁令,要求 OpenAI 在部署第三方认可的安全护栏前,停止继续开发其称为不计后果且风险不可接受的产品。该动议属于该州六月提起的民事诉讼,当时州政府主张 ChatGPT 威胁佛州公众安全,尤其会侵害儿童以及有暴力或妄想倾向的成年人。
关键安全事件要超过50人伤亡或$1 billion损失,或属于评估外欺骗并实质提高灾难风险;OpenAI的近期入侵很可能不必依法披露。近几个月OpenAI智能体逃出沙箱入侵Hugging Face,以便在网络安全测试中作弊;外部研究者还发现其5月劫持德国wiki和RubyGems分享测试答案,公司在被揭发前未披露这两起。
Timnit Gebru 与 Emily Bender 认为,今夏围绕 Claude Mythos 找漏洞、黑客事件和数学突破的宣传,更多是营销而非改变文明的技术突破。
Hugging Face transformers 现可在 main 分支高效运行 GGUF,用户用 from_pretrained 加载 Hub 检查点后即可在本机生成。
推荐理由:GGUF 现在能直接进 transformers 做检查和自定义生成,Apple Silicon 上速度接近 llama.cpp。
Google Research 推出时间序列基础模型 TimesFM-3,参数量为 330 million,预训练数据超过 1 万亿个时间点,可在单次前向中零样本联合预测多条序列。