跳到正文

首页

44 条
清除筛选按发布时间 · 最新在前
9月9日周三
  1. 思特沃克洞见 / wechat发布时间:57
    编程与智能体 · 图文

    真实项目 Design-to-Code 实测:Kimi K3、Claude Opus 5 与 GPT-5.6 Sol 对比

    这是一场在真实企业前端项目中的 Design-to-Code 对比实测:作者用 GitHub Copilot CLI、自定义 Agent、Skill 和 Figma MCP,让三款模型把 Figma 设计稿还原为受 React 19、VDS、CSS Modules、i18n 与三道门禁约束的页面。测试中 Kimi K3 和 Claude Opus 5 均通过门禁,视觉分数分别为 74.8 和 60.4;GPT-5.6 Sol 因编译错误无法运行。作者认为,截图与节点树交叉验证、主动管理上下文和强制自检,比单看生成速度更影响可交付性。

9月1日周二
  1. 思特沃克洞见 / wechat发布时间:63
    编程与智能体 · 图文

    AI 代码生成如何用 Harness Engineering 管理理解债务与代码审查

    AI 大量生成代码后,代码生成成本下降了,但团队理解系统的成本没有同步下降,这种缺口被称为“理解债务”。文章讨论如何用 Harness Engineering 把任务边界、测试、类型检查、Linter 和独立评估写进 Agent 工作环境,把人的注意力留给架构、业务语义和高风险变更。规格驱动开发能对齐需求,却不能替代对实现的理解;更现实的方向是按风险决定自动合并或人工审查,而不是完全跳过代码阅读。

8月25日周二
  1. Chip Huyen / twitter发布时间:21
    应用落地 · 文本

    gpt 5.6 为何如此倾向于过度工程化?

    Chip Huyen 质疑 gpt 5.6 为何如此倾向于过度工程化,也就是把工程方案设计得过于复杂。帖子仅提出这一疑问,没有提供具体案例、原因分析或应对方法。

8月4日周二
  1. 优设 / wechat发布时间:62
    模型与能力 · 图文

    MiniMax、DeepSeek 等国产 AI 集中发力:优设解读大模型「反攻」

    优设认为,国产 AI 的「反攻」体现为竞争重心从算力与跑分转向单位成本、工作流和开放生态,并不代表已经全面胜出。7月31日也不是四家同时发布新基础模型:MiniMax H3上线、Seedance 2.5扩大开放、DeepSeek V4-Flash开启API公测,GLM Coding Plan则恢复订阅并调整价格与额度。作者提出按任务分配模型:强模型负责复杂规划,低价模型承担实现、测试等任务,再用评测与验证兜底。