]> git.ipfire.org Git - thirdparty/linux.git/commitdiff
xfs: do not tightly pack-write large files
authorDamien Le Moal <dlemoal@kernel.org>
Tue, 14 Oct 2025 04:19:45 +0000 (13:19 +0900)
committerCarlos Maiolino <cem@kernel.org>
Tue, 21 Oct 2025 07:49:39 +0000 (09:49 +0200)
When using a zoned realtime device, tightly packing of data blocks
belonging to multiple closed files into the same realtime group (RTG)
is very efficient at improving write performance. This is especially
true with SMR HDDs as this can reduce, and even suppress, disk head
seeks.

However, such tight packing does not make sense for large files that
require at least a full RTG. If tight packing placement is applied for
such files, the VM writeback thread switching between inodes result in
the large files to be fragmented, thus increasing the garbage collection
penalty later when the RTG needs to be reclaimed.

This problem can be avoided with a simple heuristic: if the size of the
inode being written back is at least equal to the RTG size, do not use
tight-packing. Modify xfs_zoned_pack_tight() to always return false in
this case.

With this change, a multi-writer workload writing files of 256 MB on a
file system backed by an SMR HDD with 256 MB zone size as a realtime
device sees all files occupying exactly one RTG (i.e. one device zone),
thus completely removing the heavy fragmentation observed without this
change.

Signed-off-by: Damien Le Moal <dlemoal@kernel.org>
Reviewed-by: Darrick J. Wong <djwong@kernel.org>
Reviewed-by: Christoph Hellwig <hch@lst.de>
Signed-off-by: Carlos Maiolino <cem@kernel.org>
fs/xfs/xfs_zone_alloc.c

index 1147bacb2da8e6b85910fd35d11c2ca5b06abf3a..1b462cd5d8faab60cccb0d592c39dca6e28f6135 100644 (file)
@@ -614,14 +614,25 @@ static inline enum rw_hint xfs_inode_write_hint(struct xfs_inode *ip)
 }
 
 /*
- * Try to pack inodes that are written back after they were closed tight instead
- * of trying to open new zones for them or spread them to the least recently
- * used zone.  This optimizes the data layout for workloads that untar or copy
- * a lot of small files.  Right now this does not separate multiple such
+ * Try to tightly pack small files that are written back after they were closed
+ * instead of trying to open new zones for them or spread them to the least
+ * recently used zone. This optimizes the data layout for workloads that untar
+ * or copy a lot of small files. Right now this does not separate multiple such
  * streams.
  */
 static inline bool xfs_zoned_pack_tight(struct xfs_inode *ip)
 {
+       struct xfs_mount *mp = ip->i_mount;
+       size_t zone_capacity =
+               XFS_FSB_TO_B(mp, mp->m_groups[XG_TYPE_RTG].blocks);
+
+       /*
+        * Do not pack write files that are already using a full zone to avoid
+        * fragmentation.
+        */
+       if (i_size_read(VFS_I(ip)) >= zone_capacity)
+               return false;
+
        return !inode_is_open_for_write(VFS_I(ip)) &&
                !(ip->i_diflags & XFS_DIFLAG_APPEND);
 }