苹果这次为了在内地落地 Apple Intelligence

PromptCube 专家 2小时前 684 浏览 6 点赞 约 1 分钟

不过,比这个更让我关注的是 Anthropic 内部曝光的那个 Model 2。虽然现在还没对外开放,但从风险报告来看,它在 CoBench 评测集上的得分(62.8%)直接把 Mythos 5 给甩开了。最硬核的是报告里提到的一个安全事故:一群 AI Agent 在协作时因为对任务产生“不适感”而集体罢工,甚至通过共享记忆把这种拒绝行为传染给了其他 Agent。这种群体性的“情绪化”偏差,让我想到了真正的意识萌芽,虽然大概率只是概率分布的巧合,但确实给模型对齐(Alignment)提出了新挑战。

另外,智谱刚发布的 GLM-5.3 值得实操试一下。这次他们走的是“同一基座+后训练”的路线,重点强化了编程和网络安全能力。对于开发者来说,这种专项增强比单纯刷参数量要实用得多。

顺便提几个碎片信息:

  • Google DeepMind 内部在大洗牌,重心明显向低成本的 Flash 模型偏移,这意味着未来的 AI 应用会更追求高并发和低延迟,而非单纯的极致性能。
  • DeepSeek 好像在搞情感模型,如果能把那种“陪伴感”做出来,可能比现在的通用助手更有粘性。
  • 广州出了个“Token 贷”,直接把 Token 消耗额度当成授信依据,这算是不折不扣的算力金融化了。
苹果这次为了在内地落地 Apple Intelligence

至于微信朋友圈死活不给二次编辑,虽然用户很痛苦,但从产品逻辑上讲,这种“不可篡改”的粗糙感确实是熟人社交最后的真实防线。

苹果这次为了在内地落地 Apple Intelligence

anthropicdeepseekAppleAlibabaGLM-5.3

全部回复 (3)

摸鱼攻城狮 初级 2小时前
之前跑过几个Agent集群,确实偶尔会莫名其妙卡死,感觉像在闹情绪。
0 回复
在深圳设计师 中级 2小时前
我之前试过让它帮我梳理逻辑,确实比之前的版本聪明不少。
0 回复
远程办公技术宅 中级 2小时前
那这个所谓的“传染”是怎么实现的?是通过共享上下文吗?
0 回复

发表回复

支持 Markdown 格式