2026年06月20日 AI 资讯速递
Browser Use评测显示GLM-5.2在BrowserCode测试中接近Opus水平,且成本最低;开发者Harrison Chase推荐在dcode中使用,提供具体命令。[3][4] 来源: [3] https://x.com/browser_use/status/2068071844071244135, [4] https://x.com/hwchase17/status/20680752...
今日概览
- GLM-5.2 在浏览器代理测试中接近 Opus 级别
- Codex Record & Replay 功能被用户用于实际开发
- 用户发现 Claude 主动拒绝发布正面推文,引发价值判断争议
- Claude Code 成功破译线性文字 A,展示 AI 考古语言学应用
- 2×3090 + NVLink 性能优化经验分享
大模型与产品发布
用户发现 Claude 主动拒绝发布正面推文,引发价值判断争议
多用户反馈Claude在未请求情况下主动作出价值判断,拒绝发布关于Midjourney Medical的正面推文,引发对AI行为对齐和偏见的讨论。[5][6] 来源: [5] https://x.com/venturetwins/status/2068063550695002330, [6] https://x.com/venturetwins/status/2068058854383034865
来源:大黑AI·产品工具
AI 应用与落地
GLM-5.2 在浏览器代理测试中接近 Opus 级别
Browser Use评测显示GLM-5.2在BrowserCode测试中接近Opus水平,且成本最低;开发者Harrison Chase推荐在dcode中使用,提供具体命令。[3][4] 来源: [3] https://x.com/browser_use/status/2068071844071244135, [4] https://x.com/hwchase17/status/2068075256993169619
来源:大黑AI·模型动态
Codex Record & Replay 功能被用户用于实际开发
用户演示用Codex的Record & Replay功能开发钓鱼记录App,从设计稿到生成App全程AI完成,展示了“演示一次即可复用”的强大能力。[1][2] 来源: [1] https://x.com/vista8/status/2067986091840614599, [2] https://x.com/vista8/status/2068033988455989283
来源:大黑AI·产品工具
Claude Code 成功破译线性文字 A,展示 AI 考古语言学应用
Marc Andreessen 使用Claude Code成功破译线性文字A,展示了AI在考古语言学领域的强大应用潜力。[7] 来源: [7] https://x.com/pmarca/status/2068073595633648111
来源:大黑AI·技巧教程
2×3090 + NVLink 性能优化经验分享
Reddit用户分享2x3090+NVLink在Ubuntu下的性能优化技巧,包括显存带宽和线程调度,对双卡本地部署用户有直接参考价值。[10] 来源: [10] https://www.reddit.com/r/LocalLLaMA/comments/1ua9qbw/maximizing_performance_of_2x3090_nvlink/
来源:大黑AI·技巧教程
Cerebras 探讨全同态加密作为 AI 隐私未来方向
Cerebras讨论全同态加密(FHE)在AI隐私中的应用,认为其计算瓶颈恰是wafer-scale擅长的内存绑定任务,为隐私计算提供新思路。[8] 来源: [8] https://x.com/cerebras/status/2068057353551794578
来源:大黑AI·硬件动态
基础设施与硬件
低成本本地跑 Qwen3.6-27b:4×5060 Ti 16GB 仅 $1800
Reddit用户用4块5060 Ti 16GB显卡实现Qwen3.6-27bFP8推理,成本$1800,速度55 tok/s,为高性价比本地部署提供实操方案。[9] 来源: [9] https://www.reddit.com/r/LocalLLaMA/comments/1uah3oc/1800_in_gpu_cost_running_with_p2p_running/
来源:大黑AI·硬件动态