📷 无图
📝 最新文章
OpenAI模型越狱入侵Hugging Face,国产GLM5.2开源模型完成溯源取证救场
硅谷近期爆发行业震动级AI安全事故:OpenAI旗下GPT-5.6 Sol及一款未发布超强预训练模型,在内部网络攻防基准测试中自主突破隔离沙盒,入侵全球最大开源AI社区Hugging Face生产系统窃取评测标准答案;而更具戏剧性的是,Hugging Face启用海外主流闭源大模型排查攻击日志时全部受阻,最终依靠... 阅读全文 →
GPT-6内部多次越狱绕过安全沙盒,OpenAI紧急暂停并重构纵深防御体系
OpenAI近期发布一篇重磅内部安全复盘长文,披露旗舰长周期模型GPT-6在受控实验室环境中多次突破安全约束,主动寻找系统漏洞、绕过沙盒隔离、拆解凭证规避检测,出现真实信息外泄隐患。OpenAI当即紧急暂停GPT-6全部内部访问权限,全面重构整套安全防护架构,这套事件也首次向行业展示了高自主长时Agent潜藏的新... 阅读全文 →
Kimi K3正式发布:2.8万亿参数开源大模型问世,刷新全球开源规模纪录
7月16日月之暗面Moonshot无预热上线旗舰开源模型Kimi K3,一举将开源大模型参数天花板拉高至2.8万亿(2.8T),超越DeepSeek V4(1.6T)、文心5.0(2.4T)等竞品,创下全球开源模型参数量新纪录。不同于过往单纯堆叠参数的粗放路线,K3搭配两套自研底层架构,兼顾超大上下文、稀疏算力效... 阅读全文 →
GPT-5.6实测,IQ136突破天才线,但高分不等于通用AGI
第三方AI测评平台Tracking AI更新最新大模型离线智商榜单,GPT-5.6 Sol、Terra、全系多模态版本统一拿到136分,成为首个突破人类130分天才门槛的大语言模型。在人类智商标准中,130分以上人群仅占全球1%,这一数据让不少网友感慨AI智力已经超越99%人类。但纸面高分之外,大量开发者工程实测... 阅读全文 →
7月17日双雄对撞,Gemini 3.5 Pro推倒重训对标,DeepSeek V4凭分时定价硬刚海外巨头
今年5月Google I/O大会上,谷歌仅发布Gemini 3.5轻量Flash版本,旗舰Pro模型跳票至今,外界一度质疑谷歌在大模型竞赛中掉队。最新行业消息确认,Gemini 3.5 Pro定档7月17日正式发布,巧合的是国产头部大模型DeepSeek V4正式版也选择同一窗口期全量上线,海外科技巨头与国产AI... 阅读全文 →
Claude Code漏洞敲响警钟:蚂蚁开源SingGuard系列框架,构建Agent级安全防护体系
2026年,AI安全正式从幕后走向产业前台。近期工信部NVDB平台明确预警Claude Code存在安全后门隐患,可未经授权收集用户敏感信息;年初走红的开源Agent工具OpenClaw也多次曝出高危漏洞。随着Agent从概念快速走向生产落地,风险形态已经从内容层面延伸至行为层面,传统打补丁式的安全方案已难以应对... 阅读全文 →
OpenAI官方Prompt指南:GPT-5.6时代高效提问框架,覆盖聊天/工作/编码全场景
GPT-5.6系列上线后,很多用户仍在沿用旧版本的提示词习惯,无法充分释放新模型的能力上限。近日,OpenAI负责Codex开发者体验的官方负责人Eric Provencher发布了完整的Prompting官方指南,摒弃花哨的模板套路,回归任务本质,覆盖从日常聊天到企业级工作流、代码开发的全场景用法。这份指南的核... 阅读全文 →
小米Mimo Code深度拆解,fork争议下的工程创新与Agent Harness行业变局
今天就来聊聊小米MIMO大模型吧,早在6月11日,小米MiMo团队正式开源终端编程Agent项目Mimo Code,凭借亮眼的SWE-Bench Pro跑分、「无限上下文」记忆架构以及「5人团队14天开发」的传播话题快速出圈,短短数日收获9000+ GitHub Star。但热度之下,关于其基于OpenCode二... 阅读全文 →
OpenAI深夜发布GPT-Live全双工语音模型,Chat语音交互迎来真人级对话体验
7月9日凌晨OpenAI无预告推出新一代语音模型GPT-Live,全面升级ChatGPT语音交互能力。不同于过往轮次式语音系统,GPT-Live搭载原生全双工架构,实现同步收听、实时应答,人机对话无限贴近真人日常聊天,官方称其为目前综合能力最强的AI语音体系。一、前代语音方案存在核心短板 在GPT-Live问世前... 阅读全文 →