将近 2 年前
纸质工艺、建筑模型、道路、地图、导航、从上看角度、简单、白色 --ar 16:9
OpenAI推出的视频生成模型Sora现已向公众开放,但账户创建暂时关闭。Sora支持文本、图像和视频输入,生成最高1080p的20秒视频,具备多种预定义样式和配置选项。用户Plus和Pro分别需支付20美元和200美元,使用上有诸多限制,如不允许上传含人像的媒体。尽管有不同的评价,从‘惊艳’到‘垃圾’不等,Sora面临激烈竞争,可能未能满足市场期待。
Flux.1是一种先进的文本到图像生成模型,具有120亿参数,结合了变换器和扩散架构,能够生成高质量图像。该模型适用于数字艺术、设计原型、市场视觉和教育内容。通过微调,用户可根据特定需求优化模型,提升准确性并减少训练时间。本文提供了微调Flux.1的步骤,包括环境设置、数据集准备和模型加载等。
黑森林实验室正式推出FLUX.1模型套件,旨在重新定义媒体生成标准,尤其是在图像和视频领域。该团队由杰出的AI研究人员和工程师组成,拥有深厚的技术背景,致力于推动生成媒体的普及。FLUX.1系列包括多种型号,满足不同用户需求,特别是在生成质量和风格多样性方面表现出色。实验室计划推出生成文本到视频的模型,进一步推动创意和效率的发展,标志着生成AI领域的一个重要时刻。
DeepSeek发布了新的研究,提出了一种名为Natively-trainable Sparse Attention的算法突破,挑战现代AI的现状,或许可以解锁‘无限长度’的上下文窗口。这项研究聚焦于AI语言模型中对词语语义的更新过程,强调了通过上下文建立词义的重要性,并探讨了如何通过向量代表词汇属性。该研究反映出当前AI模型的简单性以及对深层次理解的必要性,为AI发展的未来开辟了新方向。
本文介绍如何在Browser-Use网页界面中使用本地LLMs,并选择Ollama作为提供者。Browser-Use允许用户选择多种LLM提供者,Ollama的使用消除了API费用,使其成为实验本地LLMs的绝佳选择。文章详细讲解了安装、配置及使用步骤,并提供了如何下载和安装必要模型的指导。尽管在测试中任务未能成功完成,但验证了本地LLMs确实可以与Browser-Use结合使用。
本文介绍了一种在Mac上运行Flux.1的替代方法,使用stable-diffusion.cpp生成图像。用户需在Huggingface创建账户并生成令牌,安装命令行工具,下载所需模型及Lora适配器。通过Python应用程序,用户可以生成命令行参数并显示结果,支持多种分辨率和步骤设置。实现了图像生成的简便性和可视化操作。
© 2026. All Rights Reserved