跳到正文

首页

9 条
清除筛选按发布时间 · 最新在前
10月8日周四
  1. AI圈的那些事 / xiaohongshu发布时间:75
    应用落地 · 图文

    Tibo「28天计划」Day 3:GPT-6 更新、用户纪录与额度重置

    该帖称,GPT-6 进入 Chat,并同步推送 Intelligent UI,让回答可直接生成图表、按钮、表单和交互组件,甚至现场做出小工具。功能从今天开始向付费用户陆续开放。付费账号也陆续获得 banked reset(额度重置),预计在 PST 当天结束前完成。

    仅基于配文整理

  2. OpenAI发布时间:20
    应用落地 · 文本

    OpenAI 展示可随操作变化的交互式视觉内容

    OpenAI介绍一种可响应用户尝试与探索的视觉内容,用来帮助理解想法。配文尚未列出具体例子和操作方式,无法据此判断可调哪些变量或适用于哪些问题,完整演示需查看原帖。

    仅基于配文整理

  3. OpenAI发布时间:60
    应用落地 · 文本

    Intelligent UI:把说明、图表和可操作控件放进回答

    OpenAI介绍,GPT-6可通过Intelligent UI按问题组合文字、图形、图表、按钮和表单,让解释与操作发生在同一段对话中。适合需要直观理解或直接试用小工具的任务;本帖说明功能形式,未列出全部开放条件。

    仅基于配文整理

9月25日周五
  1. Google DeepMind发布时间:
    应用落地 · 文本

    Google 推出 Gemini 3.8 Live with Live Avatar

    Google 于9月24日推出 Gemini 3.8 Live with Live Avatar,结合近实时视频生成与语音,在后台异步调用工具时可继续交流。官方称其支持97种语言,当日已在 Gemini Enterprise 提供;自定义 Avatar 可由参考图生成,但创建目前仅向企业白名单开放。音视频输出包含 SynthID 水印,尚未宣布向免费个人用户普遍开放。

9月18日周五
  1. Jina AI / wechat发布时间:73
    未分类 · 图文

    jina-ocr-v1:在低成本 GPU 上更快解析文档

    Jina AI 发布 jina-ocr-v1,将扫描页、照片或 PDF 转成 Markdown,保留表格和公式。它通过先预测、再验证后续文本加速;厂商单卡 L4 测试中,Eager 与 CUDA Graph 模式的最佳加速比分别为 1.95x 和 1.17x,收益随运行方式变化。可通过 API 调用或本地部署;本地推测加速需 vLLM 0.21 以上,权重采用 CC BY-NC 4.0,限非商业使用。

7月16日周四
  1. Shunyu Yao关联|SWE-agent/SWE-agent、princeton-nlp/intercode 仓库更新发布时间:21
    应用落地 · 文本

    修复 SweBenchEvaluate 的 multimodal 子集映射,适配 sb-cli 的 swe-bench-m

    SweBenchEvaluate 将 multimodal 映射改为 swe-bench-m,解决 sb-cli 参数校验导致的评估失败。full 和 multilingual 无对应的 sb-cli 子集,现抛出列明支持子集的 ValueError,并新增相关回归测试。

6月12日周五
  1. Universal Everything / Matt Pyke / instagram发布时间:
    灵感 · 视频

    面向 Apple Vision Pro 的新一代交互式音乐体验

    Universal Everything 的 Apple Vision Pro 交互式音乐体验结合空间音频,将会对音频作出反应的声音雕塑置于用户周围。用户通过在空间中绘画,逐步叠加、组合声音层,创作复杂的音乐作品。声音由 @freefarm_sound 制作。

    仅基于配文整理;正式参考价值分;依据原始文字;已检查1幅视频封面静帧评审副本;未评价完整视频、运动、剪辑或声音

2025年3月14日周五
  1. CAC AI labeling measures发布时间:89
    应用落地 · 文本

    国家网信办等四部门印发《人工智能生成合成内容标识办法》

    国家网信办等四部门印发《人工智能生成合成内容标识办法》,规范AI生成文本、图片、音视频及虚拟场景的标识,自2025年9月1日起施行。办法适用于相关规定覆盖的网络信息服务提供者:符合规定情形的生成服务须添加用户可明显感知的显式标识,并按规定在文件元数据中写入隐式标识。传播平台须核验并添加提示,用户发布生成合成内容须主动声明、使用标识功能,任何组织和个人不得恶意删除、篡改、伪造或隐匿标识。

发布时间未知
  1. Microsoft发布时间:未知未评分
    模型与能力 · 文本

    Florence-2模型卡:OCR、检测与定位任务怎么表达

    知识资料|发布日期未知。Microsoft的Florence-2模型卡列出图像描述、目标检测、定位、分割和OCR等任务提示,并给出推理用法。该仓库同时提示,此继续预训练版本采用4k上下文,训练质量可能仍有不足;这些材料不等于独立复现的评测结论。