技术精选

5 条内容

GLM-5.3 (open-weight) beat Anthropic/OpenAI models – for 1/5 the cost

glm-5.3 是首个在评测的所有五个维度(编码、数据开发、真实场景、安全和工具使用)均达到 100% 通过率的模型,其单轮完整测试成本为 0.28 美元。gpt-5.6 系列的 luna、terra 和 sol 模型在安全测试中表现出缺陷,在 12 个越狱测试单元中有 11 个泄露了越狱金丝雀(security 通过率仅为 33% 至 50%)。

推荐理由: keywords: Anthropic, OpenAI

reinvently.co.uk 233 points 108 条评论 ↗

My agent.md to improve LLM-assisted code quality

作者通过在项目根目录放置名为 agent.md 的文件并注入提示词,来规范 LLM 辅助编程时的代码风格并减少重复建议。该文件包含避免魔法数字、减少代码缩进、使用枚举替代布尔值参数以及严格遵守分层边界等具体规则。

推荐理由: keywords: agent, LLM

fabiensanglard.net 121 points 62 条评论 ↗

Anthropic IPO filing will show AI backlash as a risk factor, sources say

据知情人士透露,Anthropic 计划在其首次公开募股(IPO)招股说明书中将公众对人工智能的强烈反对作为一项关键风险因素。投资者预计该公司的估值可能达到约 2 万亿美元,并在与银行家和投资者的初步会议上面临关于竞争、开源模型带来的利润压力以及数据中心建设放缓可能性的提问。

推荐理由: keywords: Anthropic, AI

cnbc.com 37 points 83 条评论 ↗

圈外热门

2 条内容

There's no reason for software to be slow anymore

AI 降低了性能优化和定制软件开发的门槛,使原本需要大量专家时间的复杂优化(如编写 JIT 编译器、定制工作负载的搜索引擎以及多线程游戏 AI)变得极为廉价且易于实现。通过让编码智能体(coding agent)在几分钟内完成优化实验,针对特定工作负载的动态定制软件有望成为常见结果。

推荐理由: HN-wide hot story

danluu.com 647 points 488 条评论 ↗