跳到正文

模型与能力

57 条
清除筛选按发布时间 · 最新在前
2025年7月1日周二
  1. AI大模型知识君 / douyin发布时间:17
    模型与能力 · 视频

    LoRA 大模型微调解析:七个问题,从原理到调参

    AI大模型知识君以七个问题为线索,解析大模型 LoRA 微调,主题涵盖原理与参数调节。配文只说明了内容范围,未列出具体问题、参数设置或操作步骤。

2025年6月30日周一
  1. AI大模型知识君 / douyin发布时间:43
    模型与能力 · 视频

    Dify 25分钟手把手搭建基于知识图谱的 RAG 系统

    这是一段25分钟的手把手教学,演示如何使用 Dify 搭建基于知识图谱的 RAG 系统,适合想了解这类工作流搭建方法的读者。

2025年6月26日周四
  1. AI大模型知识君 / douyin发布时间:13
    模型与能力 · 视频

    Dify 教程:20分钟教你搭建企业级 AI 问答助手

    AI大模型知识君的教程以基于 Dify 搭建企业级 AI 问答助手为目标,作者称可在 20 分钟内教会搭建。现有配文只说明了教程主题,未提供具体步骤、所需环境或部署条件,也未解释“企业级”的具体标准。

2025年5月23日周五
  1. Jingna Zhang|本人原生博客发布时间:66
    模型与能力 · 文本

    Jingna Zhang 称有人未经同意发布可生成其深度伪造图像的 AI 模型

    摄影师 Jingna Zhang 表示,有人未经她同意发布了可生成其深度伪造图像的定制 AI 模型,并可生成 NSFW 内容。她指出,相关模型可在应用中下载或导入,制作深度伪造的门槛正在降低,并呼吁加强 AI 安全监管、为受害者提供救济。文章引用 Thorn 2025 年 3 月报告称,1 in 8 名未成年人表示认识遭遇过深度伪造的人。

2024年5月3日周五
  1. Anima Anandkumar / 共同署名物理场研究发布时间:49
    模型与能力 · 文本

    Geo-FNO:共同署名几何域映射与PDE流场研究

    人工整理|Geo-FNO共同署名研究把不规则物理域映射到均匀潜在域后预测PDE场;结构化网格可使用已知映射,非结构化情况联合学习x+f(x,a),文中f为3层宽32网络。复杂拓扑另讨论延拓及域分解,可作几何与流场研究的方法参考。翼型训练用8控制节点,逆设计示例为7样条节点,范围分别保留。原文为2024-05-02的v2,首发2022;旧仓库停止维护。未训练、验证通用性能或查看两张截断大图,不是商业CG网格、材质、绑定或影视流体交付教程。

2021年6月11日周五
  1. KnowingAI知智发布时间:未评分
    模型与能力 · 文本

    AutoML概念资料:区分流程自动化与模型搜索的三项设计

    知识资料|原始发布日期2021-06-11。知智的授权转载文字把机器学习分为数据准备、特征工程、模型生成和评估,再解释模型搜索空间、搜索策略及评价标准。适合在选择自动建模工具前厘清其覆盖环节;这是2021年的概念说明,不是安装或训练实操教程,NAS的RNN例子不当作全部现代方法,平台效果与成本未实测。

发布时间未知
  1. Elvis Saravia关联|dair-ai/ml-visuals 仓库更新发布时间:未知未评分
    模型与能力 · 文本

    Elvis / Prompt Guide:先取证、再回答的提示链

    人工整理|具体页面将文档问答拆成先提取相关内容、再连同原文回答,可参考把视觉brief、证据摘取和输出检查分成阶段。原例的quotes主要是技巧名清单,未证明完整证据定位或无幻觉;例子受Anthropic文档启发,保留社区维护与改编署名。原文去掉引用的练习仅作研究,本批不执行。没有模型调用、性能测试或付费课程阅读,发表日未知。

  2. Microsoft发布时间:未知未评分
    模型与能力 · 文本

    Florence-2模型卡:OCR、检测与定位任务怎么表达

    知识资料|发布日期未知。Microsoft的Florence-2模型卡列出图像描述、目标检测、定位、分割和OCR等任务提示,并给出推理用法。该仓库同时提示,此继续预训练版本采用4k上下文,训练质量可能仍有不足;这些材料不等于独立复现的评测结论。

  3. Lilian Weng|本人博客 RSS发布时间:未知未评分
    模型与能力 · 图文

    Lilian 的 Scaling Laws, Carefully:分配方法与拟合边界

    人工整理|2026-06-24原文所选Chinchilla与拟合限制段,讨论固定模型/数据或算力条件下怎样观察loss,并提醒数据有限、重复、噪声、测量精度和拟合区域会影响外推。Hoffmann等2022的IsoFLOP三联图在原文注明来源,Lilian的综述与引用图分别署名。可用来整理实验设计及资源分配问题,不能当本任务的训练预算报价、实测最优配比或所有下游能力保证。本批未训练、运行toy滑块/模拟或复验计算;RSS时间的零点不补成实际发表时刻。

  4. Nathan Lambert|写作目录变化发布时间:未知未评分
    模型与能力 · 文本

    Nathan 的模型式 RL 排查:预测轨迹与规划反馈

    人工整理|Nathan Lambert于2021-06-29的历史经验文章,所选Practical Tips关注历史状态输入、不同种子与多步预测误差、候选轨迹多样性、重规划频率,以及预测轨迹和真实结果的偏离。可用于机器人或仿真系统排错时组织观察量,非已完成机器人案例。原示意图抓取超时,本条不附图、不重试。未安装、训练、部署硬件或复现实验;年代相关SOTA、库/硬件速度和作者取舍不作2026事实。

  5. Chris Olah|写作目录变化发布时间:未知67
    模型与能力 · 图文

    Chris Olah 的 LSTM 图解:状态通路与逐步门控

    人工整理|本人2015-08-27历史文章所选核心段,解释贯穿时间的细胞状态,以及遗忘、写入、状态更新和输出如何分工。原链静图以配色、箭头和淡化相邻模块突出当前单元,可用于序列模型入门及技术图解的层次设计。本人about精确自链ch402,两篇原文支持既有推荐对象关联;引用和致谢不增加推荐名单。本批未训练或运行LSTM、复验梯度/性能,2015的流行度与预测不作2026现状;只看所列一图,不声称核完整课程。

  6. Jim Fan / X发布时间:未知未评分
    模型与能力 · 图文

    MetaMorph共同研究:模块化机器人形态控制

    人工整理|Agrim Gupta、Linxi/Jim Fan、Surya Ganguli与Li Fei-Fei的MetaMorph将模块化机器人形态作为Transformer条件,在多种形态上共同预训练控制策略。原方法图区分动力学、运动学与任务变化,作者报告零样本和少样本迁移;本任务未复测。辅助README给出联合训练、3个预训练/2个评估环境,以及Unimal-100形态集数量,均为来源声明;运行说明涉及Docker、MuJoCo许可与GPU。本条为机器人控制研究,不能当作人体绑定、动捕重定向或广告CG流程。未安装、下载数据/模型或训练,兼容性、性能、成本和商用许可未核;ICLR 2022年份不替代具体发表时间。

  7. Chris Olah|写作目录变化发布时间:未知72
    模型与能力 · 图文

    Chris Olah 的表示可视化:总览、单点查询与降维限制

    人工整理|本人2015-01-16文章所选段比较输入和隐藏层表示,并讨论高维数据界面需要总览与单点查询;二维坐标轴不能直接当有明确语义的数值。所列原图将网络层和降维视图对应,可用于组织模型解释或数据探索界面。基本降维方法与文献不是作者独创,保留贡献边界。本批未操作hover/筛选、运行t-SNE或神经网络,图不独立证明全局距离、训练效果或唯一的数据结构解释;历史论述不作最新模型事实。

  8. Dave Ebbelaar发布时间:未知未评分
    模型与能力 · 文本

    混合检索教程:BM25、向量、RRF与固定查询集评估

    知识资料|发布日期未知。Dave Ebbelaar按数据与相关性标注、关键词和向量候选、RRF融合、重排及评估组织RAG检索过程,并强调固定查询样本比较不同组合。适合知识站评估检索是否真正找到正确资料;文中也指出融合并非自动优于单一方法,本批未跑基准、生成向量或调用重排服务。

  9. merve关联|merveenoyan/smol-vision 仓库更新发布时间:未知未评分
    模型与能力 · 文本

    Merve等:PaliGemma 2的图像描述与LoRA适配

    人工整理|四位共同署名说明给出图像与caption提示的处理、去掉输入tokens后的解码、NF4量化及LoRA/QLoRA适配,可参考视觉素材描述与问答的数据流程。Google基础模型与HF集成团队贡献保留,输入图像理解不等于生成海报。未看原示例图、调用demo、下载模型或测精度/费用;2024兼容与许可陈述未作当前认证。原文日2024-12-05。

  10. Cole Medin发布时间:未知未评分
    模型与能力 · 文本

    Local AI Packaged项目资料:服务组合、工作流导入与本地文件入口

    知识资料|发布日期未知。Cole Medin的README描述Ollama、n8n、Supabase等服务的组合,区分GPU/Apple Silicon运行路径,并给出starter工作流导入、服务连接与共享文件目录的说明。适合了解本地知识自动化项目的依赖结构;公开示例值不用于真实凭据,云部署、可选服务与模型成本另核,本批未改Compose、网络或启动服务。

  11. Sebastian Raschka|本人博客 RSS发布时间:未知未评分
    模型与能力 · 文本

    LLM 学习项目排错:图片链接、个人 notebook 与 MPS 验证

    人工整理|作者项目的具体排错文档。notebook 图片来自外部图片主机,可先单独打开图片链接,区分网络问题与notebook内容;个人实验应放在复制的notebook、独立目录或分支,以减少跟随原仓库更新时的JSON合并冲突。Apple Silicon出现训练损失异常或结果不符时,作者建议先用CPU核对基线,并提醒CUDA专用选项需单独处理;文档不保证当前MPS兼容性。本批只读文字,未修改系统网络、clone、安装nbdime、运行训练或下载权重。主仓库目录只作发现入口,不单独作raw,本文发布时间未知。