Tibo「28天计划」Day 3:GPT-6 更新、用户纪录与额度重置
该帖称,GPT-6 进入 Chat,并同步推送 Intelligent UI,让回答可直接生成图表、按钮、表单和交互组件,甚至现场做出小工具。功能从今天开始向付费用户陆续开放。付费账号也陆续获得 banked reset(额度重置),预计在 PST 当天结束前完成。
仅基于配文整理
该帖称,GPT-6 进入 Chat,并同步推送 Intelligent UI,让回答可直接生成图表、按钮、表单和交互组件,甚至现场做出小工具。功能从今天开始向付费用户陆续开放。付费账号也陆续获得 banked reset(额度重置),预计在 PST 当天结束前完成。
仅基于配文整理
OpenAI介绍一种可响应用户尝试与探索的视觉内容,用来帮助理解想法。配文尚未列出具体例子和操作方式,无法据此判断可调哪些变量或适用于哪些问题,完整演示需查看原帖。
仅基于配文整理
OpenAI介绍,GPT-6可通过Intelligent UI按问题组合文字、图形、图表、按钮和表单,让解释与操作发生在同一段对话中。适合需要直观理解或直接试用小工具的任务;本帖说明功能形式,未列出全部开放条件。
仅基于配文整理
Google 于9月24日推出 Gemini 3.8 Live with Live Avatar,结合近实时视频生成与语音,在后台异步调用工具时可继续交流。官方称其支持97种语言,当日已在 Gemini Enterprise 提供;自定义 Avatar 可由参考图生成,但创建目前仅向企业白名单开放。音视频输出包含 SynthID 水印,尚未宣布向免费个人用户普遍开放。
Jina AI 发布 jina-ocr-v1,将扫描页、照片或 PDF 转成 Markdown,保留表格和公式。它通过先预测、再验证后续文本加速;厂商单卡 L4 测试中,Eager 与 CUDA Graph 模式的最佳加速比分别为 1.95x 和 1.17x,收益随运行方式变化。可通过 API 调用或本地部署;本地推测加速需 vLLM 0.21 以上,权重采用 CC BY-NC 4.0,限非商业使用。
SweBenchEvaluate 将 multimodal 映射改为 swe-bench-m,解决 sb-cli 参数校验导致的评估失败。full 和 multilingual 无对应的 sb-cli 子集,现抛出列明支持子集的 ValueError,并新增相关回归测试。
Universal Everything 的 Apple Vision Pro 交互式音乐体验结合空间音频,将会对音频作出反应的声音雕塑置于用户周围。用户通过在空间中绘画,逐步叠加、组合声音层,创作复杂的音乐作品。声音由 @freefarm_sound 制作。
仅基于配文整理;正式参考价值分;依据原始文字;已检查1幅视频封面静帧评审副本;未评价完整视频、运动、剪辑或声音
国家网信办等四部门印发《人工智能生成合成内容标识办法》,规范AI生成文本、图片、音视频及虚拟场景的标识,自2025年9月1日起施行。办法适用于相关规定覆盖的网络信息服务提供者:符合规定情形的生成服务须添加用户可明显感知的显式标识,并按规定在文件元数据中写入隐式标识。传播平台须核验并添加提示,用户发布生成合成内容须主动声明、使用标识功能,任何组织和个人不得恶意删除、篡改、伪造或隐匿标识。
知识资料|发布日期未知。Microsoft的Florence-2模型卡列出图像描述、目标检测、定位、分割和OCR等任务提示,并给出推理用法。该仓库同时提示,此继续预训练版本采用4k上下文,训练质量可能仍有不足;这些材料不等于独立复现的评测结论。